跳到正文
今天10月7日周三1 条
  1. AWS Machine Learning Blog22

    Amazon SageMaker HyperPod 管理与治理最佳实践

    针对多团队共享 Amazon SageMaker HyperPod 集群的治理难题,AWS 提出组织、项目、集群、工作负载四层控制模型,并说明如何通过 SageMaker Unified Studio 将已批准的 HyperPod 集群接入项目,同时保留底层 IAM、Amazon EKS、RBAC 或 Slurm 控制。集群与稀缺加速器容量应集中在单一容量账户,项目仅是协作边界而非运行时安全边界。

10月6日周二
  1. Google Research52

    Google 发布 Earth AI 地理空间基础模型在公共卫生领域的验证研究

    Google Research 介绍 Earth AI 的人口动态基础模型 PDFM,通过五个独立公共卫生案例验证其地理空间嵌入在疫苗接种、心血管疾病、登革热、产后抑郁和霍乱预测中的增益。PDFM 嵌入无需微调即可接入现有模型,在多项任务中匹配或优于传统输入,并已通过 Google Maps Platform 以 Population Dynamics Insights 提供商业预览。

  2. Hugging Face Blog29

    Falcon-Emirati-7B:让 LLM 学会阿联酋方言、文化与语感

    Falcon-Emirati-7B 发布,这是基于 Falcon-H1-Arabic 的 7B 方言专用模型,专注理解与生成阿联酋阿拉伯语。它沿用 Falcon-H1 混合架构(Mamba 与 Transformer 注意力并行),家族覆盖 3B、7B、34B,上下文窗口最高 128K 与 256K tokens。团队用真实方言网页数据、MSA 文化语料和受术语表约束的合成数据完成方言适配。

10月2日周五
  1. AWS Machine Learning Blog36

    在 Amazon SageMaker AI 上用多轮 RL 微调搜索智能体

    AWS 介绍如何用 Amazon SageMaker AI 的多轮强化学习(MTRL)微调 Qwen3.6-27B 搜索智能体,该智能体配备 BM25 词法搜索与向量搜索两个工具。MTRL 以多轮 rollout 生成训练数据、用策略梯度优化模型,支持 PPO、CISPO 等算法与 GRPO 等优势估计器,并提供无服务器执行、异步 rollout、可恢复训练及 MLflow 轨迹观测。

  2. Hugging Face Blog71

    Ai2 开源科研报告生成模型 AstaBrief 8B 及训练数据

    Ai2 开源 AstaBrief 8B 及其训练数据,该模型可将研究问题和检索到的文献片段生成带引用的报告。模型以 Qwen3-8B 为基础,使用 47K 个 SFT 样本和约 6K 个 DPO 样本,并以引用密度等信号过滤训练数据。

    推荐理由:文章展示了如何用真实科研查询、引用密度过滤和双裁判偏好数据,让8B模型兼顾报告质量、溯源与生成效率。

  3. Google Research62

    Google 探索基于 TEE 的可验证隐私联邦学习

    Google Research 公布新一代基于 TEE 的联邦学习系统,通过可远程证明的执行和公开透明日志提供可验证、可审计的数据匿名化保障。系统仅向操作方暴露指标和差分隐私模型权重,设备加密数据只能按预授权策略在 TEE 内限时解密处理。Gboard 已用其训练英文和日文下一词预测模型,获得更强隐私保障和更高准确率,并将此前每个模型 1-2 个月的训练瓶颈转移到服务器端并行计算。

    推荐理由:文章拆解了从访问策略、KMS 到透明日志的端到端设计,可用于理解联邦学习如何兼顾可审计隐私与训练效率。

  4. Hugging Face Blog49

    AutoSynthData:为企业智能体生成训练数据

    ServiceNow CoreAI 构建 AutoSynthData,将企业环境中目标模型的能力缺口转化为可执行、可验证的智能体训练任务,并随模型改进动态调整课程。它结合目标模型的失败与更强教师模型的成功表现,生成由系统规范、用户提示和验证器组成的新任务,经环境检验后用于后训练,并以 EnterpriseOps Gym 数据集演示流程。

  5. AWS Machine Learning Blog38

    Amazon Quick 推出 Live Data in Apps:AI 构建应用可实时查询受治理数据集

    Amazon Quick 为 AI 构建的 Quick Apps 推出 Live Data in Apps,应用每次打开时都会实时查询受治理的 Quick Sight 数据集,而非使用构建时的静态快照。该功能支持 SPICE 和 Direct Query 两种数据集模式,查询以查看者身份执行,自动沿用现有行级与列级安全规则,每位查看者首次使用需按数据集授权同意。

10月1日周四
9月30日周三
9月29日周二
  1. Hugging Face Blog74

    NVIDIA 发布开放表格基础模型 Kumo Tabular,登顶四项基准

    NVIDIA 发布开放表格基础模型 Kumo Tabular,无需训练、调优或特征工程,即可在单次前向推理中完成表格分类与回归。模型提供 28M 至 215M 参数的三种尺寸,仅用人工数据预训练,并在 TabArena、BeyondArena、TALENT 和 ScoringBench 排名第一。

    推荐理由:它把表格分类与回归压缩为单次前向推理,并以四项基准结果呈现精度与效率相对传统流程的变化。

  2. Microsoft Research61

    Microsoft Research 推出面向复杂生物学的 AI 研究系统 Quine

    Microsoft Research 推出 Quine,这套实验性 AI 研究系统由多模态生物世界模型和连接模型、科学工具、文献、湿实验及研究人员的交互框架组成。

    推荐理由:案例展示了如何用跨模态生物世界模型筛选实验候选,再以湿实验反馈迭代,提供了可迁移的计算与实验闭环思路。

9月28日周一
  1. Hugging Face Blog71

    Hugging Face Hub 上线 RL Environments 专区

    Hugging Face Hub 上线 RL Environments 专区,以数据集仓库和标签支持强化学习环境的发现、版本管理与运行。首版聚焦任务集,新增 rl-environment 筛选器,并为 Harbor、Verifiers、OpenEnv 和 NeMo Gym 生成加载命令,无需新建仓库类型、注册表或账号。

    推荐理由:它把分散在不同框架的强化学习环境纳入统一标签体系,为跨框架发现、版本管理和复用任务集提供了清晰路径。

9月24日周四
  1. NVIDIA Blog67

    NVIDIA 等机构如何用开放病毒蛋白数据为下一次大流行病做准备

    NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,公开了超过 2,800 种病毒的蛋白复合物预测 3D 结构,帮助研究人员储备疫情应对所需的结构生物学知识。

    推荐理由:材料同时给出数据集规模、推理流程与置信度标注方式,为病毒结构研究提供可直接复用的开放资源。

9月23日周三
9月22日周二
9月21日周一
9月19日周六
9月16日周三
  1. Google Research47

    绕过推理瓶颈:用 Retrieve-for-Train 加速复杂 AI 搜索

    Google Research 的 Retrieve-for-Train 通过离线 RL 发现符合奖励的查询扇出并编译为监督数据,再蒸馏至轻量扩散检索器,以单次非自回归推理绕过测试时 CoT 开销。其 53.9M 参数扩散模型可直接将查询嵌入映射为目标嵌入集合,监督样本由冻结的扇出语言模型离线生成,无需人工标注。

9月11日周五
9月10日周四
  1. OpenAI News60

    OpenAI 在 ChatGPT Work 中上线 Data agent

    OpenAI 宣布 ChatGPT Work 中的 Data agent 面向所有人开放,可连接公司数据、发现洞察,并用自然语言让 AI 构建交互式仪表盘。

    推荐理由:OpenAI 官方披露 ChatGPT Work 数据智能体的连接数据与自然语言建看板能力,可据此判断企业数据工作流的入口变化。

9月8日周二
  1. Google DeepMind75

    Google DeepMind 发布 AlphaGenome Atlas,绘制人类基因组90亿种单碱基变化预测图谱

    Google DeepMind 推出 AlphaGenome Atlas,预计算人类基因组约90亿种单核苷酸变异的分子影响。该平台包含1-petabyte数据,并以AVI评分整合AlphaGenome与AlphaMissense的预测,可通过免费网站、AlphaGenome API及Google Antigravity技能访问。

    推荐理由:它把90亿种单核苷酸变异的预计算结果与AVI评分集中到同一入口,便于研究者排序变异并追溯其分子影响。

9月3日周四
9月1日周二
8月25日周二
  1. Mistral AI53

    Mistral 与 HUMAIN 宣布数亿欧元规模的主权 AI 战略合作

    Mistral 与 HUMAIN 宣布数亿欧元规模的战略合作,将在沙特及中东地区推进 AI 基础设施、先进模型开发和 AI 解决方案部署。双方计划开发并本地化先进模型,初期聚焦网络安全与语音,同时开发阿拉伯语表现更强的前沿模型。Mistral 将探索使用 HUMAIN 的数据中心基础设施,双方还计划面向沙特受监管行业制定联合市场策略。

8月21日周五
7月26日周日
  1. Berkeley AI Research51

    ABBEL 教 LLM 更新信念以实现高效长程交互

    Berkeley AI Research 提出 ABBEL,通过可监督的自然语言信念状态,让 LLM 在长程交互中以信念替代完整历史作为工作上下文。在 CollabBench 上,基于重建的信念评分将其与完整上下文模型的性能差距缩小约 50%,训练步数比无信念评分版本减少 50%,同时保持更低的峰值 token 用量。

7月1日周三
  1. Google Research58

    Google Research将屋顶反射率数据扩展至全球50多个城市

    Google Research发布建筑级屋顶反射率研究与扩展数据集,覆盖9个国家的50多个城市,并通过新的高分辨率 Heat Resilience Earth Engine App 开放访问。其方法融合Sentinel-2数据与30-cm卫星影像,生成的反照率地图相对实测数据RMSE为0.04。模型结果显示,利用这些数据定向规划凉屋顶可在全球范围内将极端城市热度降低最高0.5°C (0.9°F)。