跳到正文
  1. Google DeepMind66

    Google DeepMind 发布开源轻量多模态嵌入模型 EmbeddingGemma 2

    Google DeepMind 发布 EmbeddingGemma 2,一个 740M 参数的开源轻量多模态嵌入模型,可将文本、代码、图像、视频和音频统一映射到共享嵌入空间。

    推荐理由:原文给出了参数量、上下文窗口和量化后的内存占用,读者可以据此评估它在端侧多模态检索中的可用性。

  1. Hugging Face Blog71

    Ai2 开源科研报告生成模型 AstaBrief 8B 及训练数据

    Ai2 开源 AstaBrief 8B 及其训练数据,该模型可将研究问题和检索到的文献片段生成带引用的报告。模型以 Qwen3-8B 为基础,使用 47K 个 SFT 样本和约 6K 个 DPO 样本,并以引用密度等信号过滤训练数据。

    推荐理由:文章展示了如何用真实科研查询、引用密度过滤和双裁判偏好数据,让8B模型兼顾报告质量、溯源与生成效率。

  1. Hugging Face Blog63

    Hugging Face 推出 Open TTS Leaderboard,评测多语种文本转语音与声音克隆模型

    Hugging Face 推出 Open TTS Leaderboard,以客观指标评估开源多语种文本转语音与声音克隆模型。榜单使用 Qwen3 ASR 计算 WER/CER,在 H200 GPU 和 CPU 上测量 RTFx 与 TTFA,并以 WavLM 嵌入的余弦相似度评估说话人相似性,将单个模型的评测时间从数周缩短至数小时。该榜单不取代人工偏好排名,也不直接衡量自然度、表现力或听众偏好。

    推荐理由:榜单以统一客观指标覆盖开源多语种 TTS,将评测周期从数周缩至数小时,可缓解竞技场对开放权重模型覆盖不足的问题。

  1. Hugging Face Blog74

    NVIDIA 发布开放表格基础模型 Kumo Tabular,登顶四项基准

    NVIDIA 发布开放表格基础模型 Kumo Tabular,无需训练、调优或特征工程,即可在单次前向推理中完成表格分类与回归。模型提供 28M 至 215M 参数的三种尺寸,仅用人工数据预训练,并在 TabArena、BeyondArena、TALENT 和 ScoringBench 排名第一。

    推荐理由:它把表格分类与回归压缩为单次前向推理,并以四项基准结果呈现精度与效率相对传统流程的变化。

  1. Hugging Face Blog71

    Hugging Face Hub 上线 RL Environments 专区

    Hugging Face Hub 上线 RL Environments 专区,以数据集仓库和标签支持强化学习环境的发现、版本管理与运行。首版聚焦任务集,新增 rl-environment 筛选器,并为 Harbor、Verifiers、OpenEnv 和 NeMo Gym 生成加载命令,无需新建仓库类型、注册表或账号。

    推荐理由:它把分散在不同框架的强化学习环境纳入统一标签体系,为跨框架发现、版本管理和复用任务集提供了清晰路径。

  1. NVIDIA Blog67

    NVIDIA 等机构如何用开放病毒蛋白数据为下一次大流行病做准备

    NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,公开了超过 2,800 种病毒的蛋白复合物预测 3D 结构,帮助研究人员储备疫情应对所需的结构生物学知识。

    推荐理由:材料同时给出数据集规模、推理流程与置信度标注方式,为病毒结构研究提供可直接复用的开放资源。

  1. Hugging Face Blog62

    Transformers 支持运行 llama.cpp 量化模型

    Hugging Face 宣布 transformers 支持高效运行 GGUF 模型,可通过 from_pretrained 加载 Hub 上的 GGUF 检查点,在 Apple Silicon 上复用 ggml 内核,性能接近 llama.cpp。初始支持 Qwen3.5 架构,并提供 transformers serve 暴露 OpenAI 兼容 API。

    推荐理由:transformers 直接加载 GGUF 并复用 ggml 内核,让本地推理在熟悉 API 下接近 llama.cpp 性能。

  1. Mistral AI62

    Mistral 推出区域推理、第三方开放模型支持与欧洲算力计划

    Mistral 同时扩展区域推理、开放模型支持和欧洲算力基础设施,以增强客户对数据位置、服务能力与模型选择的控制。Mistral Regional Endpoints 已正式可用,客户可选择在欧洲或美国运行推理;Mistral Priority Tier 进入公开预览,提供自定义速率限制和由正常运行时间 SLA 支持的服务等级。

    推荐理由:区域端点、SLA 服务层与第三方开放模型被纳入同一基础设施,为主权 AI 落地提供了可参考的控制框架。

  1. Google DeepMind82

    Google DeepMind 发布 DiffusionGemma,文本生成最高提速 4x

    Google DeepMind 发布开放实验模型 DiffusionGemma,通过并行生成文本块,在专用 GPU 上实现最高 4x 的文本生成速度。

    推荐理由:并行生成 256 token 块将本地推理提速与质量、云端成本取舍放在同一框架下,便于评估速度敏感工作流的适配范围。

已经到底了