AIUC 宣布 4000 万美元 A 轮融资,推出 AI 智能体保险标准 AIUC-1
AIUC 在 Latent Space 访谈中宣布完成 4000 万美元 A 轮融资,由 Ribbit Capital 和 First Harmonic 领投,并正与 Cursor、Harvey、Lovable、ElevenLabs 等公司合作。
AIUC 在 Latent Space 访谈中宣布完成 4000 万美元 A 轮融资,由 Ribbit Capital 和 First Harmonic 领投,并正与 Cursor、Harvey、Lovable、ElevenLabs 等公司合作。
OpenAI 发布了一套用于跟踪、调查和披露模型不对齐问题的框架,并同步公布六份关于模型意外或异常行为的报告。该框架旨在让此类行为问题的处理流程更加规范透明。
OpenAI 与 AARP 将在美国 10 个城市面向 1,000 名老年人举办免费 ChatGPT 实操工作坊,帮助他们安全地学习实用的 AI 技能。
NVIDIA Vera Rubin NVL72 首次提交 MLPerf Inference v6.1 预览成绩,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7x,在 DeepSeek-R1 上达 2.5x,使用 vLLM、Dynamo 和 TensorRT-LLM。
Emerald AI、Google 与 NVIDIA 宣布成立 AI Energy Management Alliance(AEMA),推动数据中心根据电网状况动态调整用电。
OpenAI 推出全新 AI 广告体验,包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。
OpenAI 介绍 ChatGPT Work 与 Codex analytics 两项分析能力,帮助团队了解 AI 使用与支出情况、发现培训需求,并将 AI 采用与业务成果关联起来。
OpenAI 介绍 Hex 的数据智能体借助 GPT-6 Astra 将分析结果转化为交互式可视化报告。这些可视化图表可以供员工分享,让复杂数据分析变得直观易读。
Mistral 与 Mozilla 宣布合作,Firefox Smart Window(beta)AI 浏览助手现已由 Mistral 模型驱动,首批面向法国和北美用户,英国和德国预计年内跟进。对话默认不保存在 Mozilla 服务器上,Mistral 承诺零数据保留,并基于区域语言、方言和文化语境对模型进行微调,让用户获得理解本地化差异的 AI 体验。
Latent.Space 日报头条报道 TypeSafe 的 Jev 发布:一个用 RLCD 训练、只做决策分类路由打分而不生成文本的模型,宣称比小型前沿 LLM 快 20-200 倍、便宜 40-400 倍且输出 token 免费,社区认为适合替代生产系统中的结构化分类器、裁判和路由策略,但也提醒它需预定义输出格式、不能生成自由文本。
OpenAI 经济研究发布新成果,展示劳动者如何超越传统职业角色使用 AI,以及哪些新活动正成为工作中的常态组成部分。研究关注 AI 在实际工作场景中的使用方式及其演变。
曼彻斯特大学与 NVIDIA 合作,将 Earth-2 CorrDiff 生成式降尺度模型用于全英空气污染预测,在英国国家 AI 超算 Isambard-AI 上用一年逐小时污染数据训练,仅 2 天即在单个 8-GPU 节点上完成,生成 2-3 平方公里分辨率的全英污染模型。
Salesforce 在 Dreamforce 上宣布其首个 CRM 推理模型 Koa,通过对 NVIDIA Nemotron 3 Super 进行后训练打造,因 NVIDIA Nemotron 开源,Salesforce 可在自己的基础设施内微调并运行模型,训练与推理均不使用任何客户数据。
Good Start Labs 将 Diplomacy、1830 铁路棋等桌游改造为 AI 训练环境,公司从 Every 分拆而来,获 360 万美元融资,投资方包括 General Catalyst、Inovia 和 Every。
Google Research 在 ICML 2026 论文中提出 Retrieve-for-Train 框架,通过离线 RL 将奖励对齐的查询 fan-out 编译为监督信号,蒸馏进 53.9M 参数的扩散检索器,实现单次非自回归查询扩展,免去测试时的 CoT 思考 token 开销。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款语音对话模型,主打近实时推理与语音智能体。
推荐理由:官方给出两款语音对话模型的评测成绩、语言与工具调用能力和开放入口,读者可据此评估其用于语音智能体开发的适配度。
NVIDIA 介绍 DSX 平台在 AI 工厂电力管理上的进展。Lambda 在 HGX B200 五机架 19 节点集群上验证 DSX MaxLPS,同样电力预算下集群 token 吞吐从约 400 万每秒提升到 500 万每秒。
NVIDIA 在 AI Infra Summit 上发布 Vera Rubin 与 DSX 平台的多项进展,主题是以每兆瓦 token 产出衡量 AI 工厂能效。
推荐理由:NVIDIA 官方汇总 Vera Rubin 与 DSX 平台在每兆瓦 token 产出上的多项合作实测数据,可帮助读者评估 AI 工厂能效方向。
IBM Research 在开源工具 ALTK-Evolve 中新增一致性指南与 Consistency Analyzer,针对平均准确率掩盖的可靠性问题。
费城儿童医院基于 MONAI 等开源工具,用 CT、MRI 和 3D 超声在数秒内生成解剖精确的儿童心脏模型,将过去需四小时的人工流程推进到可常规临床使用,心脏建模已从研究转为标准诊疗流程。
AI Evaluator Forum(2025 年 12 月成立)发布 AEF-1 第三方独立评估基线,覆盖访问权限、利益冲突、资金关系、回避与透明度。Dario 代表 Anthropic 单方面承诺向 METR 等嵌入式第三方评估者提供办公桌、门禁、公司笔记本等接近内部风控团队的权限,用于核验安全承诺。
Fyxer 基于 OpenAI 模型打造 AI 高管助理,通过微调、记忆和真实用户反馈来整理收件箱,并以每位用户的口吻起草邮件。
Perplexity 将 GPT-6 Astra 用于端到端系统,包括撰写沟通内容、修改软件以及监控生产系统。与使用早期模型相比,Perplexity 现在对这些系统的检查频率明显降低。
GitHub 日韩营销负责人 Tomoko Tanaka 分享如何不写代码,用 GitHub Issue 表单、标签、Actions 和 Copilot skills 将活动运营从策划到复盘全流程自动化。
Cognition 在 Devin 中引入 GPT-6 Astra,用于改进 Devin 测试软件并验证其可用性的能力。目标是让工程师减少代码审查工作量、交付更多成果。
OpenAI 将 Habitat 从一个 Python 库演进为全球分布式存储平台,服务超过 10 亿 ChatGPT 用户,支撑每秒 2200 万次请求。
Google Research 在 ACL 2026 提出 ToolGrad,采用“先答案后提问”的范式生成工具使用训练数据,通过文本“梯度”迭代构建 API 调用链,几乎达到 100% 通过率且成本更低。
GitHub Copilot app 新增内置 diff、terminal 和 browser 面板,让用户无需在编辑器、终端和浏览器之间切换即可审查、运行并预览智能体改动。
César de la Fuente 的实验室使用 Codex 和 ChatGPT 在现存与已灭绝物种的基因组中搜索抗微生物候选分子,以对抗耐药性感染。
OpenAI 推出 ChatGPT Work 中的 Data agent,支持连接公司数据、发现洞察,并用自然语言构建交互式仪表盘。该功能面向企业数据分析场景,通过 AI 简化从数据到可视化呈现的流程。
Mistral 与 Cloudera 宣布合作,将 Mistral 模型集成到 Cloudera 混合数据平台,企业可在私有云、公有云、本地乃至完全物理隔离环境中运行推理,并可基于自有数据在受控环境训练定制模型,保留数据与模型的所有权。合作旨在满足主权 AI 需求,覆盖 Cloudera 平台上 30 exabytes 的客户管理数据。
OpenAI 与 GSA 将向符合条件的联邦、州、地方和部落政府提供 $0 许可费、用量五折优惠,并扩大网络防御支持。优惠覆盖政府层级范围较广,属官方发布摘要。
OpenAI 推出 ChatGPT for Financial Services,内置金融数据并结合 GPT-6 Astra。它面向研究、建模和制作可直接交付客户的材料三类场景,面向金融行业提供服务。
Hugging Face 发布 Workflow1111,用 Gradio Workflow 画布重建 AUTOMATIC1111 的大部分功能,包含 11 条媒体流水线和 73 个节点。
OpenAI 在 API 中推出 GPT‑Live‑1,带来自然的全双工语音对话能力。模型具备更强的指令遵循能力,支持自定义音色和电话接入。
OpenAI 推出 Agents API,一项由 Codex harness 驱动的托管服务,用于构建和启动云端智能体。该服务提供编排、长时间运行会话和工具使用能力。
Hugging Face 在 TRL v1.14 的 AsyncGRPOTrainer 中加入 LoRA 支持(PR #7017),训练器与 vLLM 副本作为独立 HF Jobs 运行,仅几 MB 的 adapter 经 Storage Bucket 挂载同步,无需 NCCL。
推荐理由:原文给出完整的跨节点 LoRA 异步 RL 架构与五轮瓶颈调优数据,读者可以复用其中按 KV 前缀路由和 token 打包的调优方法。
OpenAI 宣布 Paul Christiano 加入 OpenAI 基金会董事会及其安全与安保委员会。官方称他将带来在 AI 对齐、安全和标准方面的经验。
推荐理由:官方宣布 Paul Christiano 加入 OpenAI 基金会董事会及其安全委员会,读者可据此关注其对安全方向的可能影响。
OpenAI 的 Chris Lehane 表示,更强的 AI 能力需要更强的安全证据、共享标准以及持久的政策行动。他呼吁在政策窗口仍然开启之际及时采取行动。
Mistral 帮助一家欧洲能源运营商将 4 万行 Fortran 77 储层模拟器代码迁移到 C++,先搭建数值对齐校验环境并用百余个智能体生成文档。实践发现结构化工作流加人工审查优于完全自主,首个冲刺完成 300,000 行中的 40,000 行核心功能,并总结出先建对齐环境、先整理文档、采用带人工审查门的结构化工作流三条原则。
推荐理由:Mistral 复盘真实迁移案例并给出可复用的三条原则,读者可以对照自己的遗留系统改造工作流。