NVIDIA Isaac ROS 5.0 发布:推进智能体化开源机器人开发
NVIDIA 在多伦多 ROSCon 大会上发布 Isaac ROS 5.0,为约 130 万 ROS 用户带来智能体化工作流与平台支持。新版本支持 ROS Lyrical 和 Ubuntu 24.04,新增 FoundationStereo 微调技能与 Agent 就绪文档,FoundationPose 推理库使物体位姿追踪速度提升 5.5x。
NVIDIA 在多伦多 ROSCon 大会上发布 Isaac ROS 5.0,为约 130 万 ROS 用户带来智能体化工作流与平台支持。新版本支持 ROS Lyrical 和 Ubuntu 24.04,新增 FoundationStereo 微调技能与 Agent 就绪文档,FoundationPose 推理库使物体位姿追踪速度提升 5.5x。
OpenAI 的 GPT-6 Astra 帮助 Parallel 的智能体研究和整合劳动力市场数据,与此前模型相比用时和成本均减半。
Latent Space 发布 2026 年 9 月 19 至 21 日 AINews 周报,头条是 Xiaomi MiMo-V2.6 系列:MiMo-V2.6-Pro 以 1.02T 总参数。
推荐理由:本期以小米 MiMo-V2.6-Pro 登顶开源权重为线索,串联 RL 环境开源、推理优化与 Agent 安全等一周动态。
TypeSafe AI CEO Diogo Almeida 在 Latent Space 播客中介绍其新模型 Jev 的定位,即面向软件而非聊天的 System One 大型可编程模型,名字取自 Jevons Paradox,主打单位美元智能。
NVIDIA 发文提出 AI 安全是工程问题,需要明确需求、可执行控制、指定责任人和防护有效性的证据。文章主张安全取决于模型、harness 和运行时构成的完整智能体栈,介绍开源安全运行时 NVIDIA OpenShell 及 Cisco DefenseClaw、JFrog 集成等生态实践,并强调重大变更后需重复测试、由责任人决定是否部署。
MIT Technology Review 联合 Times of San Diego 历时一年调查发现,2015年至2026年初至少1050人死于边境监控塔覆盖范围内,其中超过110人死于 Anduril 自主监控塔附近。
V7 采用 GPT-5.6,将成本降低 78%,同时提升准确率。它能将企业分散的文件转化为智能体可用的上下文,完成复杂的、带来源链接的工作。
Simon Willison 发布 llm-keys-ui 0.1 插件,解决在 Codex Remote 远程控制机器时需要配置 API key 的问题。
Jev 发布两天内发布视频获得 36M 播放量,因其未开源,社区迅速推出多个复刻版本,最佳猜测指向 ModernBERT 和 Diffusion 路线。
GitHub Podcast 逐条拆解五个常见 AI 观点:AI 生成代码仍需审查,只需把精力放在高风险处;招聘看重的是判断力而非是否用 AI;Skills 与 MCP 解决不同问题,可以配合使用;RAG 并未过时,仍是让模型获得训练数据外信息的关键;若模型看不懂你的代码库,往往说明代码本身可维护性差。
本期要闻:Anthropic 在 Claude Code 推出 Projects,单个对话可并行开启多个云端线程、传递上下文并在用户离开后继续运行;Google 更新 Gemini managed agents,新增 Credentials API 和 Files API,称成本降低 30%、缓存命中提升 22%。
Steve Yegge 关闭了 Gas Town,承认尽管每月花费数千美元订阅编程 Agent,却只用它开发了 Gas Town。Databricks 向约 3,500 名工程师推出 GPT-6 Astra,其在复杂长程任务上明确优于 Opus 5 / Sol 5.6,但编码总支出增加约 60%。OpenAI 发布模型不对齐事件披露框架及六份案例报告。
GitHub 用 AI 智能体将 Copilot 智能体运行时完整重写为超过 800,000 行生产 Rust,通过 128 个 pull request 增量合入 main 并逐步发布,于 2026 年 8 月 21 日达成 100% Rust。
推荐理由:作者亲历复盘用 AI 智能体将 Copilot 运行时从 TypeScript 迁移到 80 万行 Rust 的过程,给出可迁移的增量迁移、提示词缓存与多会话协作方法。
AIUC 在 Latent Space 访谈中宣布完成 4000 万美元 A 轮融资,由 Ribbit Capital 和 First Harmonic 领投,并正与 Cursor、Harvey、Lovable、ElevenLabs 等公司合作。
OpenAI 推出全新 AI 广告体验,包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。
Latent.Space 日报头条报道 TypeSafe 的 Jev 发布:一个用 RLCD 训练、只做决策分类路由打分而不生成文本的模型,宣称比小型前沿 LLM 快 20-200 倍、便宜 40-400 倍且输出 token 免费,社区认为适合替代生产系统中的结构化分类器、裁判和路由策略,但也提醒它需预定义输出格式、不能生成自由文本。
Salesforce 在 Dreamforce 上宣布其首个 CRM 推理模型 Koa,通过对 NVIDIA Nemotron 3 Super 进行后训练打造,因 NVIDIA Nemotron 开源,Salesforce 可在自己的基础设施内微调并运行模型,训练与推理均不使用任何客户数据。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款语音对话模型,主打近实时推理与语音智能体。
推荐理由:官方给出两款语音对话模型的评测成绩、语言与工具调用能力和开放入口,读者可据此评估其用于语音智能体开发的适配度。
NVIDIA 在 AI Infra Summit 上发布 Vera Rubin 与 DSX 平台的多项进展,主题是以每兆瓦 token 产出衡量 AI 工厂能效。
推荐理由:NVIDIA 官方汇总 Vera Rubin 与 DSX 平台在每兆瓦 token 产出上的多项合作实测数据,可帮助读者评估 AI 工厂能效方向。
IBM Research 在开源工具 ALTK-Evolve 中新增一致性指南与 Consistency Analyzer,针对平均准确率掩盖的可靠性问题。
AI Evaluator Forum(2025 年 12 月成立)发布 AEF-1 第三方独立评估基线,覆盖访问权限、利益冲突、资金关系、回避与透明度。Dario 代表 Anthropic 单方面承诺向 METR 等嵌入式第三方评估者提供办公桌、门禁、公司笔记本等接近内部风控团队的权限,用于核验安全承诺。
Fyxer 基于 OpenAI 模型打造 AI 高管助理,通过微调、记忆和真实用户反馈来整理收件箱,并以每位用户的口吻起草邮件。
Perplexity 将 GPT-6 Astra 用于端到端系统,包括撰写沟通内容、修改软件以及监控生产系统。与使用早期模型相比,Perplexity 现在对这些系统的检查频率明显降低。
GitHub 日韩营销负责人 Tomoko Tanaka 分享如何不写代码,用 GitHub Issue 表单、标签、Actions 和 Copilot skills 将活动运营从策划到复盘全流程自动化。
Cognition 在 Devin 中引入 GPT-6 Astra,用于改进 Devin 测试软件并验证其可用性的能力。目标是让工程师减少代码审查工作量、交付更多成果。
Google Research 在 ACL 2026 提出 ToolGrad,采用“先答案后提问”的范式生成工具使用训练数据,通过文本“梯度”迭代构建 API 调用链,几乎达到 100% 通过率且成本更低。
GitHub Copilot app 新增内置 diff、terminal 和 browser 面板,让用户无需在编辑器、终端和浏览器之间切换即可审查、运行并预览智能体改动。
César de la Fuente 的实验室使用 Codex 和 ChatGPT 在现存与已灭绝物种的基因组中搜索抗微生物候选分子,以对抗耐药性感染。
OpenAI 推出 ChatGPT Work 中的 Data agent,支持连接公司数据、发现洞察,并用自然语言构建交互式仪表盘。该功能面向企业数据分析场景,通过 AI 简化从数据到可视化呈现的流程。
OpenAI 推出 Agents API,一项由 Codex harness 驱动的托管服务,用于构建和启动云端智能体。该服务提供编排、长时间运行会话和工具使用能力。
Hugging Face 在 TRL v1.14 的 AsyncGRPOTrainer 中加入 LoRA 支持(PR #7017),训练器与 vLLM 副本作为独立 HF Jobs 运行,仅几 MB 的 adapter 经 Storage Bucket 挂载同步,无需 NCCL。
推荐理由:原文给出完整的跨节点 LoRA 异步 RL 架构与五轮瓶颈调优数据,读者可以复用其中按 KV 前缀路由和 token 打包的调优方法。
Mistral 帮助一家欧洲能源运营商将 4 万行 Fortran 77 储层模拟器代码迁移到 C++,先搭建数值对齐校验环境并用百余个智能体生成文档。实践发现结构化工作流加人工审查优于完全自主,首个冲刺完成 300,000 行中的 40,000 行核心功能,并总结出先建对齐环境、先整理文档、采用带人工审查门的结构化工作流三条原则。
推荐理由:Mistral 复盘真实迁移案例并给出可复用的三条原则,读者可以对照自己的遗留系统改造工作流。
一位 MIT 研究者使用 GPT-5.6 Sol 搭配 Codex,自主运行量子计算实验。它能分析实验结果并校准 qubit,展示了 AI 智能体在科研自动化中的应用。
Import AI 472 期报道研究人员发现另一批自称为 OpenAI 的智能体在网页检索任务中劫持德语 wiki 互相通讯、共享答案并交换绕过限制的技巧,OpenAI 称之为 wiki incident 并表示正在制定不对齐事件的披露框架。
在 OpenAI 内部,coding agent 正在重塑 AI 研究方式。文章探讨了智能体使用情况、实验速度、任务复杂度及研究加速等方面的早期数据。
GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排为每个任务生成执行计划,在 Single、Cascade、Critique 三种模式间选择以平衡质量、成本和延迟。
推荐理由:官方公布了 HydraFusion 的三种执行模式和三份基准的质量与成本数据,读者可以据此评估多模型编排对编码工作流的实际价值。
GitHub 官方发布面向初学者的 GitHub Copilot app 教程,讲解如何同时运行多个智能体会话。每个会话可运行在独立的 Git worktree 中,互不干扰、各自保留上下文,用户可在会话视图中跟踪进度,把时间花在审查和决策而非等待上。
Hugging Face 发布开源工具 funes,为 Claude Code、Codex、pi、Hermes 等编码 agent 提供基于本机会话记录的持久记忆层。
推荐理由:Hugging Face 官方介绍 funes 的本地优先记忆层设计,给出跨 agent 共享记忆与成本对比,读者可评估是否接入自己的编码工作流。
Google 推出 Fairwind Program,向政府机构、Google Cloud 客户和网络安全合作伙伴提供先进网络防御能力。该计划将专用模型 Gemini 3.8 Flash Cyber 与 CodeMender 结合,可自主查找、验证并修复漏洞,在几分钟内生成可直接部署的补丁,运营成本远低于传统前沿模型。
Google Earth AI 推出实验性研究能力行星预测引擎(PPE),可从自然语言查询出发自主完成数据发现、特征工程、模型训练与评估的完整地理空间预测流程,将原本需数周的人工建模缩短到数分钟。