跳到正文
10月6日周二
  1. Google Research52

    Google 发布 Earth AI 地理空间基础模型在公共卫生领域的验证研究

    Google Research 介绍 Earth AI 的人口动态基础模型 PDFM,通过五个独立公共卫生案例验证其地理空间嵌入在疫苗接种、心血管疾病、登革热、产后抑郁和霍乱预测中的增益。PDFM 嵌入无需微调即可接入现有模型,在多项任务中匹配或优于传统输入,并已通过 Google Maps Platform 以 Population Dynamics Insights 提供商业预览。

  2. The Decoder62

    JEPA-Anything:将 LeCun 的 JEPA 扩展为跨物理到生物学的通用世界模型

    PhAI Labs 联合斯坦福、牛津、普林斯顿的研究者提出 JEPA-Anything,将预测状态拆分为四个正交因子并分别预测,在物理、机器人、天气等十个任务上优于标准 JEPA,动态系统预测误差降低 35%。该模型还从生物数据中提出 IL-18 与 CD73 阻断的肝癌治疗组合,在类器官、肿瘤组织和免疫细胞共培养中显示更强杀伤与免疫激活,但尚未确立为实际疗法。代码与模型已公开。

  3. The Decoder60

    Google研究人员提出RRSI,防止自改进AI智能体记忆测试任务

    Google研究人员提出RRSI,通过逐步收紧编辑预算和批评器审查,减少智能体在自优化过程中记忆测试任务的问题。基于冻结的Claude Opus 4.8,RRSI在8个基准上测试,训练任务最高提升14.1分,并在5个未见基准上最高提升4.7分。其运行时token用量比未正则化版本少约30 percent,代码已发布在GitHub。

10月5日周一
  1. MIT Technology Review · AI57

    AI 智能体如何连接企业知识

    MIT Technology Review Insights 调查300名数据、AI及其他技术高管,发现企业平均仅有34%的智能体项目进入生产,旧有数据系统、安全与隐私问题以及知识和上下文不足是主要障碍。生产领先组织平均有61%的项目越过试点阶段,55%的受访者将数据碎片化列为扩大知识访问的主要挑战。企业计划优先投资数据摄取管道、AI-ready APIs、RAG、AI 评估智能体和知识图谱。

10月2日周五
  1. Google Research62

    Google 探索基于 TEE 的可验证隐私联邦学习

    Google Research 公布新一代基于 TEE 的联邦学习系统,通过可远程证明的执行和公开透明日志提供可验证、可审计的数据匿名化保障。系统仅向操作方暴露指标和差分隐私模型权重,设备加密数据只能按预授权策略在 TEE 内限时解密处理。Gboard 已用其训练英文和日文下一词预测模型,获得更强隐私保障和更高准确率,并将此前每个模型 1-2 个月的训练瓶颈转移到服务器端并行计算。

    推荐理由:文章拆解了从访问策略、KMS 到透明日志的端到端设计,可用于理解联邦学习如何兼顾可审计隐私与训练效率。

  2. Hugging Face Blog49

    AutoSynthData:为企业智能体生成训练数据

    ServiceNow CoreAI 构建 AutoSynthData,将企业环境中目标模型的能力缺口转化为可执行、可验证的智能体训练任务,并随模型改进动态调整课程。它结合目标模型的失败与更强教师模型的成功表现,生成由系统规范、用户提示和验证器组成的新任务,经环境检验后用于后训练,并以 EnterpriseOps Gym 数据集演示流程。

  3. Ars Technica · AI60

    Ataraxos以15胜1负4平击败Stratego顶尖选手

    卡内基梅隆大学、MIT、纽约大学和斯坦福大学研究者开发的Ataraxos,以15胜1负4平击败Stratego选手Pim Niemeijer。该系统仅使用16 GPUs、花费数千美元完成训练,而此前DeepMind未能构建可稳定击败最佳人类玩家的系统。Stratego每方有40枚身份隐藏的棋子,身份仅在交战时揭晓,隐藏信息会在很长时间跨度内逐步展开。

10月1日周四
9月30日周三
9月29日周二
  1. Microsoft Research61

    Microsoft Research 推出面向复杂生物学的 AI 研究系统 Quine

    Microsoft Research 推出 Quine,这套实验性 AI 研究系统由多模态生物世界模型和连接模型、科学工具、文献、湿实验及研究人员的交互框架组成。

    推荐理由:案例展示了如何用跨模态生物世界模型筛选实验候选,再以湿实验反馈迭代,提供了可迁移的计算与实验闭环思路。

9月28日周一
9月24日周四
  1. NVIDIA Blog67

    NVIDIA 等机构如何用开放病毒蛋白数据为下一次大流行病做准备

    NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,公开了超过 2,800 种病毒的蛋白复合物预测 3D 结构,帮助研究人员储备疫情应对所需的结构生物学知识。

    推荐理由:材料同时给出数据集规模、推理流程与置信度标注方式,为病毒结构研究提供可直接复用的开放资源。

9月21日周一
  1. Import AI49

    Import AI 473:美国的超级智能战略、鼠颅中的人脑与机器诠释学

    Import AI 473 聚焦美国超级智能战略、在小鼠脑内培育类人脑组织,以及机器诠释学。RAND建议美国在通往超级智能的高度不确定路径上维持“行动自由”,围绕人类-AI生态、AI安全架构、国家安全机构改造和社会响应能力投入。研究人员还在脑组织被刻意削弱的幼鼠体内培育出类人脑组织。

9月19日周六
9月16日周三
  1. Google Research47

    绕过推理瓶颈:用 Retrieve-for-Train 加速复杂 AI 搜索

    Google Research 的 Retrieve-for-Train 通过离线 RL 发现符合奖励的查询扇出并编译为监督数据,再蒸馏至轻量扩散检索器,以单次非自回归推理绕过测试时 CoT 开销。其 53.9M 参数扩散模型可直接将查询嵌入映射为目标嵌入集合,监督样本由冻结的扇出语言模型离线生成,无需人工标注。

9月11日周五
9月8日周二
  1. Google DeepMind75

    Google DeepMind 发布 AlphaGenome Atlas,绘制人类基因组90亿种单碱基变化预测图谱

    Google DeepMind 推出 AlphaGenome Atlas,预计算人类基因组约90亿种单核苷酸变异的分子影响。该平台包含1-petabyte数据,并以AVI评分整合AlphaGenome与AlphaMissense的预测,可通过免费网站、AlphaGenome API及Google Antigravity技能访问。

    推荐理由:它把90亿种单核苷酸变异的预计算结果与AVI评分集中到同一入口,便于研究者排序变异并追溯其分子影响。

8月24日周一
8月17日周一
8月10日周一
7月26日周日
  1. Berkeley AI Research51

    ABBEL 教 LLM 更新信念以实现高效长程交互

    Berkeley AI Research 提出 ABBEL,通过可监督的自然语言信念状态,让 LLM 在长程交互中以信念替代完整历史作为工作上下文。在 CollabBench 上,基于重建的信念评分将其与完整上下文模型的性能差距缩小约 50%,训练步数比无信念评分版本减少 50%,同时保持更低的峰值 token 用量。

7月1日周三
  1. Google Research58

    Google Research将屋顶反射率数据扩展至全球50多个城市

    Google Research发布建筑级屋顶反射率研究与扩展数据集,覆盖9个国家的50多个城市,并通过新的高分辨率 Heat Resilience Earth Engine App 开放访问。其方法融合Sentinel-2数据与30-cm卫星影像,生成的反照率地图相对实测数据RMSE为0.04。模型结果显示,利用这些数据定向规划凉屋顶可在全球范围内将极端城市热度降低最高0.5°C (0.9°F)。

3月13日周五