Simon Willison 用 Claude Opus 5.5 生成游戏音乐
Simon Willison 测试 Claude Opus 5.5 能否作曲,让它设计一种简单的文本音乐格式并构建可播放的 artifact,还要求达到《猴岛小英雄》初代的音乐水准。结果比预期更贴近猴岛主题,效果出奇地好。他猜测这种作曲能力可能类似文本模型近期涌现的 3D 图形能力,但需用其他新旧模型做实验才能确认是否为新能力。
Simon Willison 测试 Claude Opus 5.5 能否作曲,让它设计一种简单的文本音乐格式并构建可播放的 artifact,还要求达到《猴岛小英雄》初代的音乐水准。结果比预期更贴近猴岛主题,效果出奇地好。他猜测这种作曲能力可能类似文本模型近期涌现的 3D 图形能力,但需用其他新旧模型做实验才能确认是否为新能力。
特朗普本周召集多位 AI 行业高管,并通过行政命令要求美国政府官员使用“超级智能”而非“人工智能”的称呼。与会高管签署了“前沿责任联合承诺”,但该协议完全自愿、不具法律约束力,特朗普称其具有“道德约束力”。TechCrunch 的讨论认为,会议及协议未必会带来重大变化,其主要意义可能是重塑 AI 的公众形象。
OpenAI CEO Sam Altman 表示,AI 带来的收益将非常巨大,社会应接受黑客攻击、诈骗等部分坏事作为代价。他将 OpenAI 定位为 Anthropic 的谨慎路线与几乎不监管之间的务实中间派,支持加强监管,但担忧过度限制会让少数公司、个人或国家掌握过多权力。他也承认人类可能失去对 AI 系统的控制,并称 OpenAI 还有更多智能体事件需要披露。
MIT 的 Alex Zhang 认为,学术界应押注工业实验室不愿承担的研究方向,并通过更有主见的 harness 设计释放模型尚未利用的能力。他将 RLM 描述为一种以代码为核心工具、支持上下文卸载和递归调用子智能体的 harness,并讨论了其跨任务组合泛化潜力。访谈还涉及 AI 生成 GPU 内核的验证缺口、多智能体集群中的低效搜索,以及未来语言模型可能以隐藏的智能体集群呈现。
Anthropic 的 Thariq Shihipar 在访谈中回顾了 Claude Code 的快速演进,并重点讨论了提示词作为核心技能、Claude Mods 对 harness 的自定义能力,以及智能体安全与 Pacing the Frontier 的论点。
Anthropic 称其分子生物学实验室的 950 个 Claude 智能体在 21 小时内标记出一个已知酶周围的重复模式,并称之为首次发现,但生物学家批评这只是实验室基础工作而非真正发现。哥本哈根大学研究员 Mario Rodríguez Mestre 表示其团队早已发现该模式,并质疑 Anthropic 是否从其 Claude 对话中学习,Anthropic 予以否认。
Simon Willison 在 WeAreDevelopers 大会主题演讲中按时间线梳理了 2026 年 LLM 的关键进展。2025 年 11 月发布的 Claude Opus 4.5 和 GPT-5.1 让 Claude Code、Codex 等编码智能体从"经常出错"变得"足以日常使用"。