跳到正文
今天10月7日周三5 条
  1. Simon Willison40

    Simon Willison 评 EmbeddingGemma 2:Apache 2.0 许可对嵌入模型至关重要

    EmbeddingGemma 2 采用 Apache 2.0 许可,Simon Willison 认为嵌入模型不应使用闭源、专有、仅托管的形式。嵌入模型应用通常需计算并存储数千甚至数百万个嵌入向量,若模型专有,供应商一旦停供,用户需付费重新计算已存储的向量。他更愿付费使用托管版本,同时保留自行运行开放权重版本或另寻供应商的选项。

  2. TechCrunch · AI40

    LibreOffice 称“无 AI”现已成为一项软件功能

    LibreOffice 背后的 The Document Foundation 宣布,在可预见的未来不会为其开源文档编辑器添加 AI,默认安装中不含任何 AI 功能。该组织称这是“刻意的设计立场”,以确保用户文档不被上传至服务器处理、软件无需联网即可运行,用户仍可通过安装扩展连接本地 AI 模型。

10月6日周二
  1. Hugging Face Blog29

    Falcon-Emirati-7B:让 LLM 学会阿联酋方言、文化与语感

    Falcon-Emirati-7B 发布,这是基于 Falcon-H1-Arabic 的 7B 方言专用模型,专注理解与生成阿联酋阿拉伯语。它沿用 Falcon-H1 混合架构(Mamba 与 Transformer 注意力并行),家族覆盖 3B、7B、34B,上下文窗口最高 128K 与 256K tokens。团队用真实方言网页数据、MSA 文化语料和受术语表约束的合成数据完成方言适配。

10月5日周一
10月3日周六
  1. TechCrunch · AI65

    Meta 推出 Muse Gadgets,让开发者自制连接 Muse 的硬件

    Meta 推出开源项目 Muse Gadgets,让开发者构建可连接个人 AI 智能体 Muse 的硬件。项目提供开源固件、Linux SDK及彩色电子墨水屏和 HDMI 电视棒等创意,并支持 Raspberry Pi、ESP32及多类外设。Meta 还制作了 5,000 台 USB-C 供电的 Muse Home Link,将在库存有限的情况下免费提供给 Muse 订阅用户。

10月2日周五
  1. Hugging Face Blog71

    Ai2 开源科研报告生成模型 AstaBrief 8B 及训练数据

    Ai2 开源 AstaBrief 8B 及其训练数据,该模型可将研究问题和检索到的文献片段生成带引用的报告。模型以 Qwen3-8B 为基础,使用 47K 个 SFT 样本和约 6K 个 DPO 样本,并以引用密度等信号过滤训练数据。

    推荐理由:文章展示了如何用真实科研查询、引用密度过滤和双裁判偏好数据,让8B模型兼顾报告质量、溯源与生成效率。

9月30日周三
  1. Hugging Face Blog63

    Hugging Face 推出 Open TTS Leaderboard,评测多语种文本转语音与声音克隆模型

    Hugging Face 推出 Open TTS Leaderboard,以客观指标评估开源多语种文本转语音与声音克隆模型。榜单使用 Qwen3 ASR 计算 WER/CER,在 H200 GPU 和 CPU 上测量 RTFx 与 TTFA,并以 WavLM 嵌入的余弦相似度评估说话人相似性,将单个模型的评测时间从数周缩短至数小时。该榜单不取代人工偏好排名,也不直接衡量自然度、表现力或听众偏好。

    推荐理由:榜单以统一客观指标覆盖开源多语种 TTS,将评测周期从数周缩至数小时,可缓解竞技场对开放权重模型覆盖不足的问题。

9月29日周二
  1. Hugging Face Blog74

    NVIDIA 发布开放表格基础模型 Kumo Tabular,登顶四项基准

    NVIDIA 发布开放表格基础模型 Kumo Tabular,无需训练、调优或特征工程,即可在单次前向推理中完成表格分类与回归。模型提供 28M 至 215M 参数的三种尺寸,仅用人工数据预训练,并在 TabArena、BeyondArena、TALENT 和 ScoringBench 排名第一。

    推荐理由:它把表格分类与回归压缩为单次前向推理,并以四项基准结果呈现精度与效率相对传统流程的变化。

9月28日周一
  1. Hugging Face Blog71

    Hugging Face Hub 上线 RL Environments 专区

    Hugging Face Hub 上线 RL Environments 专区,以数据集仓库和标签支持强化学习环境的发现、版本管理与运行。首版聚焦任务集,新增 rl-environment 筛选器,并为 Harbor、Verifiers、OpenEnv 和 NeMo Gym 生成加载命令,无需新建仓库类型、注册表或账号。

    推荐理由:它把分散在不同框架的强化学习环境纳入统一标签体系,为跨框架发现、版本管理和复用任务集提供了清晰路径。

9月24日周四
  1. NVIDIA Blog67

    NVIDIA 等机构如何用开放病毒蛋白数据为下一次大流行病做准备

    NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,公开了超过 2,800 种病毒的蛋白复合物预测 3D 结构,帮助研究人员储备疫情应对所需的结构生物学知识。

    推荐理由:材料同时给出数据集规模、推理流程与置信度标注方式,为病毒结构研究提供可直接复用的开放资源。

9月23日周三
9月22日周二
  1. Latent Space82

    小米发布 MiMo-V2.6-Pro 与 Flash 开源全模态模型,训练成本约 300 万美元

    小米发布 MiMo-V2.6 系列两款原生全模态开源模型,MiMo-V2.6-Pro 为 1.02T 总参数、42B 激活参数,采用 MIT 许可,Artificial Analysis 称其以 46 分登顶开源权重模型智能指数,输入输出价格分别为 $0.435/M 与 $0.87/M tokens。

    推荐理由:小米首次进入前沿开源模型序列,其 RL 环境与训练配方一并开源,可观察后训练成本结构的变化。

  2. Hugging Face Blog62

    Transformers 支持运行 llama.cpp 量化模型

    Hugging Face 宣布 transformers 支持高效运行 GGUF 模型,可通过 from_pretrained 加载 Hub 上的 GGUF 检查点,在 Apple Silicon 上复用 ggml 内核,性能接近 llama.cpp。初始支持 Qwen3.5 架构,并提供 transformers serve 暴露 OpenAI 兼容 API。

    推荐理由:transformers 直接加载 GGUF 并复用 ggml 内核,让本地推理在熟悉 API 下接近 llama.cpp 性能。

  3. Hugging Face Blog33

    oMLX 创作者 Jun Kim 加入 Hugging Face,支持 MLX 社区

    oMLX 创作者兼维护者 Jun Kim 加入 Hugging Face,全职投入 MLX 社区建设。oMLX 将从副业转为有资金支持的正式项目,继续保持 Apache 2.0 开源协议并由 Jun 继续领导,目标是提升稳定性并加快开发。Hugging Face 计划让 oMLX 成为新想法的试验场,并推动 transformers 模型定义快速转为可被不同引擎使用的 MLX 参考实现。

9月21日周一
  1. NVIDIA Blog35

    NVIDIA 谈 AI 安全:如何在智能体栈的每一层解决这一工程问题

    NVIDIA 提出 AI 安全是工程问题,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。智能体栈中模型、harness 与运行时环境各层都承担安全责任,权限不能随任务自动扩展,敏感操作仍需人工审批。NVIDIA OpenShell 作为开源安全运行时在智能体之外强制执行策略并提供沙箱执行,Cisco DefenseClaw 与 JFrog 已在其上构建治理与技能扫描能力。

  2. Import AI49

    Import AI 473:美国的超级智能战略、鼠颅中的人脑与机器诠释学

    Import AI 473 聚焦美国超级智能战略、在小鼠脑内培育类人脑组织,以及机器诠释学。RAND建议美国在通往超级智能的高度不确定路径上维持“行动自由”,围绕人类-AI生态、AI安全架构、国家安全机构改造和社会响应能力投入。研究人员还在脑组织被刻意削弱的幼鼠体内培育出类人脑组织。

9月19日周六
9月16日周三
  1. Mistral AI52

    Mistral 与 Mozilla 合作,以 Mistral 模型驱动 Firefox Smart Window

    Mistral 与 Mozilla 达成合作,Firefox Smart Window(beta)现由 Mistral 模型提供支持,覆盖法国和北美,英国与德国预计于今年晚些时候跟进。该 AI 浏览助手可梳理复杂搜索、找回用户离开的重要页面,并根据浏览器标签页获取信息;对话默认不保存在 Mozilla 服务器,Mistral 等合作方同意零数据保留。

9月1日周二
8月21日周五
8月11日周二
  1. Mistral AI62

    Mistral 推出区域推理、第三方开放模型支持与欧洲算力计划

    Mistral 同时扩展区域推理、开放模型支持和欧洲算力基础设施,以增强客户对数据位置、服务能力与模型选择的控制。Mistral Regional Endpoints 已正式可用,客户可选择在欧洲或美国运行推理;Mistral Priority Tier 进入公开预览,提供自定义速率限制和由正常运行时间 SLA 支持的服务等级。

    推荐理由:区域端点、SLA 服务层与第三方开放模型被纳入同一基础设施,为主权 AI 落地提供了可参考的控制框架。

8月10日周一
7月29日周三
6月11日周四