OpenAI 将 Daybreak 计划网络访问权限扩展至乌克兰民用防御
OpenAI 宣布将 Daybreak 计划的访问权限扩展至乌克兰政府,用于支持民用基础设施的网络防御。该计划此前已向部分机构开放,此次扩展聚焦于民用领域的网络安全防护。
OpenAI 宣布将 Daybreak 计划的访问权限扩展至乌克兰政府,用于支持民用基础设施的网络防御。该计划此前已向部分机构开放,此次扩展聚焦于民用领域的网络安全防护。
invideo 借助 GPT-6 Astra 以更高精度规划剪辑,将色彩校正与调色效率提升 3 倍,并在一天内生成 50 个自定义特效。
Ringg 基于 GPT-5.6 打造的 AI 智能体可解决最多 65% 的客户来电,覆盖语音、聊天、WhatsApp 和网页等多语言场景。相比 GPT-4.1,其成本降低 90%。
Harvey 借助 GPT-6 Astra 生成结构更清晰、更贴合上下文的法律文书,让律师得以专注于策略。
OpenAI CEO Sam Altman 在联合国安理会发表讲话,讨论 AI 安全、人类控制与国际合作。
OpenAI 发布 MentalHealthBench,一个由专家参与构建的基准,用于评估 AI 在真实心理健康对话中回复是否有帮助且安全。
Anthropic 发布 Claude Opus 5.5,称其为新 Claude 5.5 家族首个模型,多数任务达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%,速度约快 30%,并成为 Claude Code 与 Claude 应用的默认模型。
推荐理由:同一天两家实验室先后发布新模型并同步降价,读者可对照双方在能力与成本上的取舍。
Simon Willison 与 Jesse Vincent 将于 10 月 14 日(周三)在旧金山举办一场面向 coding agent 构建者的晚间交流活动,形式为非正式的 agentic show-and-tell。活动鼓励参与者分享尚未公开的尝试、奇怪实验和未完成项目,无需正式演讲,也不是产品推介。
NVIDIA 与合作伙伴在 AI Day Singapore 展示东南亚 AI 进展,以 Nemotron 开放模型和工具推动公共部门及企业规模化部署。新加坡 HTX 正研究 Nemotron 3 Super 与 Nemotron 3 Nano Omni;泰国 iApp Technology 开源法律模型,Thanoy 聊天机器人约有 43,000 名用户。
ChatGPT Ads 扩展至东南亚和台湾,使符合条件的企业可在超过 60 个国家和地区触达用户。
Airbnb 正在扩大 GPT-6 Astra 及 OpenAI 前沿模型的使用范围,帮助工程团队排查 bug、设计系统并加快交付。
OpenAI 与 Grab 联合推出区域项目 GO Forward with AI,计划帮助东南亚 3 万名合作伙伴掌握实用 AI 技能。该项目面向 Grab 合作伙伴群体,覆盖东南亚地区。
Anthropic 发布 Claude Opus 5.5,约一小时后 OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,作者称 GPT-6 Sol 与 Luna 的价格是 GPT-5.6 同级模型的一半。
推荐理由:作者实测新模型并整理价格表,读者可据此比较各家定价与推理档位的实际表现。
Google 的 John Platt 在访谈中介绍团队提出的 Empirical Research Assistance(ERA),其思路是把科学问题转化为可打分任务,再由 Gemini 维护一棵历史实验 notebook 的搜索树,用 Upper Confidence Bound 规则挑选最有希望的分支并每次提出约十个变异,各分支共享历史。
GPT-6 通过更高的缓存命中率、新的诊断工具、显式断点和控制选项改进提示词缓存,从而降低延迟和成本。
OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,分别以不同的能力与成本平衡将前沿智能带入日常工作。
NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,引入智能体工作流和 ROS Lyrical、Ubuntu 24.04 支持,帮助开发者更快构建和部署机器人应用。新版本提供 FoundationStereo 微调技能、FoundationPose 推理库和 pick and place 技能,并支持从 Jetson Orin Nano 到 Jetson Thor 的可扩展计算。
推荐理由:原文给出了新版本在智能体工作流和平台支持上的具体变化,读者可以据此判断它对机器人开发流程的实际影响。
Parallel 借助 GPT-6 Astra 让智能体研究并综合劳动力市场数据,耗时和成本相比此前模型均减半。
小米发布 MiMo-V2.6 系列两款原生全模态开源模型,MiMo-V2.6-Pro 为 1.02T 总参数、42B 激活参数,采用 MIT 许可,Artificial Analysis 称其以 46 分登顶开源权重模型智能指数,输入输出价格分别为 $0.435/M 与 $0.87/M tokens。
推荐理由:小米首次进入前沿开源模型序列,其 RL 环境与训练配方一并开源,可观察后训练成本结构的变化。
英国 AI Security Institute(AISI)正采用 EvalEval 的 Every Eval Ever schema 和 Evaluation Cards 平台公开分享评测结果,以提升评测科学的可复现性。
Hugging Face 宣布 transformers 支持高效运行 GGUF 模型,可通过 from_pretrained 加载 Hub 上的 GGUF 检查点,在 Apple Silicon 上复用 ggml 内核,性能接近 llama.cpp。初始支持 Qwen3.5 架构,并提供 transformers serve 暴露 OpenAI 兼容 API。
推荐理由:transformers 直接加载 GGUF 并复用 ggml 内核,让本地推理在熟悉 API 下接近 llama.cpp 性能。
OpenAI 提出针对前沿模型与防护措施的第三方 AI 安全评估优先事项与原则,强调评估需严谨、安全且独立。
oMLX 创作者兼维护者 Jun Kim 加入 Hugging Face,全职投入 MLX 社区建设。oMLX 将从副业转为有资金支持的正式项目,继续保持 Apache 2.0 开源协议并由 Jun 继续领导,目标是提升稳定性并加快开发。Hugging Face 计划让 oMLX 成为新想法的试验场,并推动 transformers 模型定义快速转为可被不同引擎使用的 MLX 参考实现。
TypeSafe AI CEO Diogo Almeida 在 Latent Space 访谈中介绍其新模型 Jev,称其为面向代码消费的 System 1 大模型,优化目标是每美元智能而非聊天体验。
推荐理由:InstructGPT 作者复盘 RLHF 路线问题,并解释 RLCD 为何把校准概率而非人类偏好当作优化目标。
NVIDIA 推出 DSX Ready 认证计划,用于审核合作伙伴产品是否符合 NVIDIA DSX AI 工厂参考设计要求,首批覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类。
NVIDIA 发文阐述物理 AI 规模化部署需要覆盖硬件、软件、AI 行为与运行环境的安全体系,并介绍其全栈安全系统 NVIDIA Halos。ABI Research 预计到 2035 年 L3-L5 自动驾驶汽车保有量将达 4900 万辆,Omdia 估计 2026 至 2035 年间约 6000 万台工业机器人将部署。
NVIDIA 在埃及大埃及博物馆举办活动,展示该国 AI 生态从能力建设走向规模化落地。埃及 NVIDIA Deep Learning Institute 学员规模一年增长超十倍,NVIDIA 已在非洲培训超 85,000 名开发者,尼日利亚成为该机构全球第二大市场。
Microsoft Research 在 Nature 发表逆合成模型 RetroChimera,并开源其实现与权重。该模型通过学习式集成融合 Transformer 模型 R-SMILES 2 与图神经网络模型 NeuralLoc,按排名为候选反应分配权重。
NVIDIA 提出 AI 安全是工程问题,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。智能体栈中模型、harness 与运行时环境各层都承担安全责任,权限不能随任务自动扩展,敏感操作仍需人工审批。NVIDIA OpenShell 作为开源安全运行时在智能体之外强制执行策略并提供沙箱执行,Cisco DefenseClaw 与 JFrog 已在其上构建治理与技能扫描能力。
Import AI 473 聚焦美国超级智能战略、在小鼠脑内培育类人脑组织,以及机器诠释学。RAND建议美国在通往超级智能的高度不确定路径上维持“行动自由”,围绕人类-AI生态、AI安全架构、国家安全机构改造和社会响应能力投入。研究人员还在脑组织被刻意削弱的幼鼠体内培育出类人脑组织。
OpenAI 正与一个独立的数学与人工智能咨询小组合作,用于指导新兴 AI 成果的评审与传播。该小组为独立性质,具体成员与运作细节未在文中披露。
Higgsfield AI 借助 GPT-6 Astra,一天内上线新的视频功能,让小微企业制作视频广告更简单,并更快将新创意工具推向市场。
NVIDIA 在纽约气候周上介绍了五家用 AI 推进清洁能源的公司。ThinkLabs AI 用 CUDA 平台打造数字孪生与智能体,帮助南加州爱迪生将电网并网申请评估时间从 30-45 天缩短至 2 分钟。
OpenAI 提出构建全球共享 AI 标准的路径,呼吁通过协调一致的评估、报告与治理来提升安全性。
OpenAI Academy 新增面向员工、开发者、管理者、教育者和学生的多条学习路径,用于培养和展示实用 AI 技能。
Hugging Face 发布 tokenizers v1,输出 token ID 与 v0.23 完全一致,但速度常达 v0.23 的数十倍。v1 将单一 crate 拆为 workspace,引入 bitcannon 用 SIMD 位运算替代正则分词、无分配合并循环、线程本地词缓存和原生多线程并行。
V7 使用 GPT-5.6 将分散的公司文件转化为智能体可用的上下文,以完成复杂的、可溯源的工作,同时将成本削减 78% 并提升准确率。
Google 推出 MilleMiglia,一款用 C++ 编写的中程物流实例生成器,可生成逼真且保护隐私的基准数据。它以时空图上的多商品流问题建模跨配送中心运输、换车与暂存,源代码和文档已在 GitHub 提供。
GitHub 认为,开发者仍需审查并对 AI 生成代码负责,RAG 并未过时,Skills 与 MCP 解决的是不同问题。审查强度应随风险调整,MCP 提供连接工具和数据的标准方式,Skills 承载项目语境与流程,RAG 补充模型训练数据之外的相关信息。文章还将模型难以理解代码库视为可维护性压力测试,并主张通过实际构建和记录检验观点。
OpenAI 发布澳大利亚青少年安全蓝图,这是一份包含六大支柱的路线图,旨在打造更安全的 AI 体验,以保护和赋能青少年。