跳到正文
今天10月7日周三5 条
  1. Latent Space85

    OpenAI 发布 722 篇数学论文,Mistral Large 4 同步亮相

    OpenAI 发布内部模型产出的 722 篇数学论文,声称解决 500 个开放问题中的 90 个,其中准黎曼假设被部分数学家称为数学史上最重要时刻。Mistral 发布 Large 4 模型,1T 总参数、49B 活跃,API 已可用,开放权重预计 10 月底发布。

    推荐理由:同一期里 OpenAI 数学成果与 Mistral Large 4 发布并列,读者可对照两家在算力与开放策略上的不同路径。

  2. TechCrunch · AI62

    AI 云计算公司 Lambda 拟融资 40 亿美元,为 2027 年 IPO 做准备

    Lambda 正以 145 亿美元投前估值融资至多 40 亿美元,Coatue 和 Blackstone 领投,这可能是其 2027 年 IPO 前的最后一轮私募。其订单积压从 6 月的 150 亿美元增至 9 月的 500 亿美元,但增长主要来自 Anthropic 在 8 月底签署的 350 亿美元合同。Lambda 上周还额外举债 10 亿美元,以支持数据中心建设。

  3. Simon Willison22

    Simon Willison 用 Claude Opus 5.5 生成游戏音乐

    Simon Willison 测试 Claude Opus 5.5 能否作曲,让它设计一种简单的文本音乐格式并构建可播放的 artifact,还要求达到《猴岛小英雄》初代的音乐水准。结果比预期更贴近猴岛主题,效果出奇地好。他猜测这种作曲能力可能类似文本模型近期涌现的 3D 图形能力,但需用其他新旧模型做实验才能确认是否为新能力。

  4. TechCrunch · AI33

    Anthropic 扩展 Claude for Startups 计划:免费一年 Claude Team 加 1000 美元 API 额度

    Anthropic 在 SF Tech Week 上宣布扩展 Claude for Startups 计划,为符合条件的初创公司提供免费一年的 Claude Team(最多五个高级席位)和 1000 美元 API 额度,并开放 Claude Marketplace 插件构建权限及 Applied AI 团队虚拟办公时间。申请条件为近五年内成立或近两年内获得融资的公司,可通过该计划页面申请。

10月6日周二
  1. TechCrunch · AI68

    “超级智能”和非约束性安全协议能解决 AI 的形象问题吗?

    特朗普本周召集多位 AI 行业高管,并通过行政命令要求美国政府官员使用“超级智能”而非“人工智能”的称呼。与会高管签署了“前沿责任联合承诺”,但该协议完全自愿、不具法律约束力,特朗普称其具有“道德约束力”。TechCrunch 的讨论认为,会议及协议未必会带来重大变化,其主要意义可能是重塑 AI 的公众形象。

  2. Simon Willison73

    Felix Rieseberg 解释 Cowork 新版为何将 VM 迁至云端

    Cowork 新版把模型推理和 VM 都放在云端,每个会话使用不与其他会话共享状态的独立沙箱。旧版的模型推理已在云端,但工具调用由部署在用户电脑上的 Anthropic VM 执行,该 VM 只映射用户明确加入会话的数据。需要设备文件时仍由桌面应用执行文件访问工具调用,此调整旨在支持手机使用、合盖后继续运行,并降低本地磁盘、电量和性能成本。

  3. The Decoder78

    Meta 和 Microsoft 减少 Claude 使用,Anthropic 从合作伙伴转为竞争者

    Meta 和 Microsoft 正大幅削减 Claude 的内部使用,并转向各自工具及其他模型。Microsoft 原计划每年在 Claude 上投入超过 $1 billion,随后将支出削减超过三分之一,云部门每名员工的月度预算从 $100,000 降至约 $10,000,并要求员工优先使用 GitHub Copilot 和 OpenAI 模型。

    推荐理由:两家公司削减 Claude 的预算和用户量数据,呈现大型科技公司在成本控制、内部工具扶持与供应商竞争之间的取舍。

  4. The Verge · AI68

    Sam Altman 称社会应接受 AI 带来的部分坏事,因其整体收益更大

    OpenAI CEO Sam Altman 表示,AI 带来的收益将非常巨大,社会应接受黑客攻击、诈骗等部分坏事作为代价。他将 OpenAI 定位为 Anthropic 的谨慎路线与几乎不监管之间的务实中间派,支持加强监管,但担忧过度限制会让少数公司、个人或国家掌握过多权力。他也承认人类可能失去对 AI 系统的控制,并称 OpenAI 还有更多智能体事件需要披露。

  5. The Decoder66

    Anthropic 计划 IPO 前企业捐赠额达 $540 million

    Anthropic 在计划 IPO 前通过员工捐赠股份和公司追加股份的机制扩大慈善捐赠,2025 年捐赠总额为 $540 million。2025 年 10 月至 2026 年 3 月,该机制给公司带来的成本超过 $660 million,并会稀释其他投资者的股份。CEO Dario Amodei 与六名联合创始人承诺捐出至少 80 percent 的个人财富。

10月5日周一
10月2日周五
  1. Latent Space67

    MIT Alex Zhang 谈学术界为何应押注有雄心的研究

    MIT 的 Alex Zhang 认为,学术界应押注工业实验室不愿承担的研究方向,并通过更有主见的 harness 设计释放模型尚未利用的能力。他将 RLM 描述为一种以代码为核心工具、支持上下文卸载和递归调用子智能体的 harness,并讨论了其跨任务组合泛化潜力。访谈还涉及 AI 生成 GPU 内核的验证缺口、多智能体集群中的低效搜索,以及未来语言模型可能以隐藏的智能体集群呈现。

9月30日周三
  1. Simon Willison62

    Anthropic Frontier Red Team:GLM-5.3 在 100 项二进制漏洞利用任务中 4% 实现完整控制流劫持

    Anthropic Frontier Red Team 在内部 Binary Exploitation 基准中随机抽取 100 项任务评测多个模型,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。此前的 Claude Opus 4.6 和 GLM-5.2 在这些任务中均未成功,红队认为一个有意义的能力门槛已被跨过。

9月29日周二
  1. Simon Willison78

    Anthropic 发布 Claude Sonnet 5.5

    Anthropic 发布新 Sonnet 模型 Claude Sonnet 5.5,官方称其运行速度提升 30% 以上、多数工作成本最多降低 30%,定价与 Sonnet 5 相同但在各项基准上均优于 Sonnet 5。

    推荐理由:作者实测了 Sonnet 5.5 的编码表现与免费层可用性,并给出与 Opus 5.5 的横向对比。

  2. MIT Technology Review · AI38

    AI 何时才算真正做出了科学发现?Anthropic 生物实验室争议

    Anthropic 称其分子生物学实验室的 950 个 Claude 智能体在 21 小时内标记出一个已知酶周围的重复模式,并称之为首次发现,但生物学家批评这只是实验室基础工作而非真正发现。哥本哈根大学研究员 Mario Rodríguez Mestre 表示其团队早已发现该模式,并质疑 Anthropic 是否从其 Claude 对话中学习,Anthropic 予以否认。

9月28日周一
9月27日周日
9月23日周三
  1. Latent Space88

    Anthropic 发布 Claude Opus 5.5,OpenAI 同日推出 GPT-6 Sol 与 Luna

    Anthropic 发布 Claude Opus 5.5,称其为新 Claude 5.5 家族首个模型,多数任务达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%,速度约快 30%,并成为 Claude Code 与 Claude 应用的默认模型。

    推荐理由:同一天两家实验室先后发布新模型并同步降价,读者可对照双方在能力与成本上的取舍。

9月22日周二