亚马逊 SageMaker Studio 可直接管理 HyperPod Spaces
Amazon SageMaker Studio 新增 HyperPod Spaces 管理界面,数据科学家无需 CLI 或 kubectl,即可在浏览器中创建、配置、启停并打开 JupyterLab 和 Code Editor 环境。
Amazon SageMaker Studio 新增 HyperPod Spaces 管理界面,数据科学家无需 CLI 或 kubectl,即可在浏览器中创建、配置、启停并打开 JupyterLab 和 Code Editor 环境。
GLM 5.3 已在 Amazon Bedrock 上向符合条件的企业客户开放,可通过全托管 API 使用跨区域推理、提示缓存和服务层级。该模型是发布于 Hugging Face Hub 的 753B 参数 MoE 模型,面向编码和长时程智能体任务。
Amazon SageMaker AI 推出 aws-ai-ml 智能体技能,可让 Kiro、Claude Code、Codex 等 MCP 兼容编码智能体执行推理基准测试、推荐部署配置、比较性能结果并生成可执行的 SageMaker Python SDK v3 代码。
推荐理由:文章给出从安装技能到基准测试、实例选型和结果对比的完整流程,可迁移到现有 MCP 编码智能体工作流中。
NVIDIA Inception 初创企业正用 AI 改善乳腺癌影像、风险评估和治疗规划。iSono Health 的 FDA 获批 ATUSA 每侧乳房约2分钟完成3D超声,公司称灵敏度较手持2D超声高28%;Ataraxis AI 以病理切片和临床变量预测治疗反应与复发风险。
OpenAI 在 ChatGPT 中推出新的视觉广告格式,并扩展面向广告主的衡量工具、归因合作伙伴关系和品牌适宜性支持。
推荐理由:新广告格式与衡量、归因及品牌适宜性能力同步扩展,可用于了解ChatGPT广告产品的整体构成。
NVIDIA DGX Spark 将新增 64GB 统一内存配置,10月23日周五起由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 发售,起价 $4,999。
Amazon Quick 为 AI 构建的 Quick Apps 推出 Live Data in Apps,应用每次打开时都会实时查询受治理的 Quick Sight 数据集,而非使用构建时的静态快照。该功能支持 SPICE 和 Direct Query 两种数据集模式,查询以查看者身份执行,自动沿用现有行级与列级安全规则,每位查看者首次使用需按数据集授权同意。
NVIDIA 与 CoreWeave 将新一代智能体 AI 基础设施投入生产,CoreWeave 宣布 NVIDIA Vera Rubin NVL72 可用,并推出连接模型与智能体训练、评估和改进流程的 CoreWeave Forge。
推荐理由:材料结合真实软件工程负载与多项性能数据,可用于评估新基础设施对智能体推理、沙箱运行和训练成本的影响。
OpenAI 发布 dots,一种能跨复杂项目和日常任务持续工作的主动式助手,并说明其如何让用户在推进工作的同时保持掌控。
Hugging Face Hub 上线 RL Environments 专区,以数据集仓库和标签支持强化学习环境的发现、版本管理与运行。首版聚焦任务集,新增 rl-environment 筛选器,并为 Harbor、Verifiers、OpenEnv 和 NeMo Gym 生成加载命令,无需新建仓库类型、注册表或账号。
推荐理由:它把分散在不同框架的强化学习环境纳入统一标签体系,为跨框架发现、版本管理和复用任务集提供了清晰路径。
OpenAI 正在为 Codex Originals 项目征集使用 Codex 的开发者、研究者与创作者的真实故事,入选者将参与该项目的下一阶段。感兴趣的用户可通过官方表单提交自己的项目与经历。
Proaction 借助 Codex、GPT-Live-1 和 GPT-6 Astra,更快地构建、运营并销售现代车队管理产品,销售提升 60%,节省 75+ 小时。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将近实时视频生成与原生实时对话模型结合,并已在 Gemini Enterprise 提供。
推荐理由:它将实时对话、流式视频与异步工具调用整合进企业智能体,为客服和交互导览提供更连续的多模态交互路径。
Liquid AI 发布实验性 DSpark 草稿模型 LFM2.5-VL-DSpark,为视觉语言模型 LFM2.5-VL-3B 加入投机解码路径。该草稿模型新增 280M 参数(占 3B 目标模型 8.9%),端侧解码最高提速 3.13x、H100 上最高 2.66x,端到端最高提升 2.62x 和 2.27x,且不改变输出质量。
Google 将为 Private AI Compute 增加私密的服务器端持久记忆,让 AI 在保持设备端隐私标准的同时跨设备保留上下文。数据存入专用加密空间,解密密钥仅保存在用户个人设备上;访问时,设备通过端到端加密通道连接云端安全隔离区,数据只在隔离内存中临时解密并随即重新加密。Google 还发布了更新后的技术白皮书、服务器软件防篡改公开记录及独立安全审计结果。
推荐理由:该架构展示了如何结合设备端密钥、云端安全隔离区和加密存储,兼顾跨设备长期记忆与隐私保护。
Ringg 基于 GPT-5.6 打造的 AI 智能体可解决最多 65% 的客户来电,覆盖语音、聊天、WhatsApp 和网页等多语言场景。相比 GPT-4.1,其成本降低 90%。
Harvey 借助 GPT-6 Astra 生成结构更清晰、更贴合上下文的法律文书,让律师得以专注于策略。
ChatGPT Ads 扩展至东南亚和台湾,使符合条件的企业可在超过 60 个国家和地区触达用户。
GPT-6 通过更高的缓存命中率、新的诊断工具、显式断点和控制选项改进提示词缓存,从而降低延迟和成本。
NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,引入智能体工作流和 ROS Lyrical、Ubuntu 24.04 支持,帮助开发者更快构建和部署机器人应用。新版本提供 FoundationStereo 微调技能、FoundationPose 推理库和 pick and place 技能,并支持从 Jetson Orin Nano 到 Jetson Thor 的可扩展计算。
推荐理由:原文给出了新版本在智能体工作流和平台支持上的具体变化,读者可以据此判断它对机器人开发流程的实际影响。
Hugging Face 宣布 transformers 支持高效运行 GGUF 模型,可通过 from_pretrained 加载 Hub 上的 GGUF 检查点,在 Apple Silicon 上复用 ggml 内核,性能接近 llama.cpp。初始支持 Qwen3.5 架构,并提供 transformers serve 暴露 OpenAI 兼容 API。
推荐理由:transformers 直接加载 GGUF 并复用 ggml 内核,让本地推理在熟悉 API 下接近 llama.cpp 性能。
NVIDIA 推出 DSX Ready 认证计划,用于审核合作伙伴产品是否符合 NVIDIA DSX AI 工厂参考设计要求,首批覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类。
OpenAI Academy 新增面向员工、开发者、管理者、教育者和学生的多条学习路径,用于培养和展示实用 AI 技能。
Hugging Face 发布 tokenizers v1,输出 token ID 与 v0.23 完全一致,但速度常达 v0.23 的数十倍。v1 将单一 crate 拆为 workspace,引入 bitcannon 用 SIMD 位运算替代正则分词、无分配合并循环、线程本地词缓存和原生多线程并行。
V7 使用 GPT-5.6 将分散的公司文件转化为智能体可用的上下文,以完成复杂的、可溯源的工作,同时将成本削减 78% 并提升准确率。
Pawprint Studio 的 Aniimo 本周首发上线 GeForce NOW,这是一款免费开放世界捉宠 RPG,玩家可在 Idyll 大陆捕捉 Aniimo 并 Twine 变身,无需下载 45GB 即可在 Steam Deck 和 Firefox 等设备串流。
Cooley 基于 ChatGPT Work 打造了 GO Public,把智能能力引入 IPO 流程,帮助律师更早发现问题并将判断力集中在最关键之处。
OpenAI 发布 Astra for Law,为法律行业提供前沿智能、律所自定义工作流、法律数据源接入,以及针对机密客户工作的法律级管控。该产品隶属 OpenAI for Law,具体模型版本、价格与可用性未在原文披露。
OpenAI 推出 AI 驱动的广告新体验,包括 Sponsored Agents 以及面向营销人员的工具,并集成 HubSpot 和 Shopify。
Hex 的数据智能体借助 GPT-6 Astra,把分析答案转化为可交互的可视化内容,让员工愿意主动分享。
Fyxer 基于 OpenAI 模型、微调与记忆能力,并结合真实用户反馈,打造出可整理收件箱、按用户本人语气起草邮件的 AI 行政助理。
Cognition 用 GPT‑6 Astra 提升 Devin 测试软件并证明其可用的能力,目标是让工程师少审代码、多交付。GPT‑6 Astra 强化了 Devin 对自身工作成果的验证环节。
OpenAI 宣布 ChatGPT Work 中的 Data agent 面向所有人开放,可连接公司数据、发现洞察,并用自然语言让 AI 构建交互式仪表盘。
推荐理由:OpenAI 官方披露 ChatGPT Work 数据智能体的连接数据与自然语言建看板能力,可据此判断企业数据工作流的入口变化。
OpenAI 发布 ChatGPT for Financial Services,将内置金融数据与 GPT-6 Astra 结合,用于研究、建模和面向客户的材料制作。
推荐理由:OpenAI 把内置金融数据与 GPT-6 Astra 打包成行业版本,读者可据此判断金融工作流的入口变化。
Gradio 发布 Workflow1111,用 73 个节点在单个工作流画布上重建了 AUTOMATIC1111 的大部分功能,包括文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成蒙版、ControlNet 风格标注器、背景移除、PNG 信息存储和图生视频。
推荐理由:用 73 个节点重建了 A1111 的多数功能,并说明每个输出节点可直接作为 REST 或 MCP 工具调用。
OpenAI 发布 Agents API,这是一个由 Codex harness 驱动的托管服务,用于构建和上线云端智能体。该服务支持编排、长时间运行的会话以及工具调用。
推荐理由:OpenAI 官方发布托管式 Agents API,读者可据此了解云端智能体的编排与长会话能力入口。
OpenAI 在 API 中推出 GPT-Live-1,为开发者带来自然的全双工语音对话能力。该模型在指令遵循上更强,并支持自定义音色和电话通信(telephony)。
推荐理由:OpenAI 把全双工语音对话能力开放到 API,开发者可据此评估现有语音应用的改造空间。
MIT 一位研究人员使用 GPT-5.6 Sol 配合 Codex,自主运行量子计算实验、分析结果并校准量子比特。该案例展示了 GPT-5.6 Sol 在量子计算实验流程中的自主执行与结果分析能力。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图和参考照片转化为更个性化、更精致的图像,并更贴近用户原本的构想。
推荐理由:官方给出 ChatGPT Images 2.5 的输入类型与输出定位,可据此判断图像生成能力的变化方向。
Mistral 发布 Agentic Search,通过多步检索循环让 AI 系统在复杂文档和多数据源中查找、浏览并核验信息,现已通过 Mistral Search Toolkit 及 Studio、Vibe 中的 Libraries 提供。
推荐理由:多步检索与文档内导航被纳入同一套默认工具栈,两项基准呈现了相对单次 RAG 的准确率、token 和延迟变化。