OpenAI 推出 proactive 智能体 dots
OpenAI 推出 dots,一类主动式(proactive)智能助手,可在复杂项目和日常任务中持续推进工作。dots 的设计让工作在向前推进的同时,用户始终保有控制权。
OpenAI 推出 dots,一类主动式(proactive)智能助手,可在复杂项目和日常任务中持续推进工作。dots 的设计让工作在向前推进的同时,用户始终保有控制权。
OpenAI DevDay 2026 带来超过 20 项发布,包括 GPT-6 Astra、ChatGPT、Codex、API 更新、安全能力以及面向开发者的新工具。
OpenAI 的 GPT-6.1 Sol 在 Amazon Bedrock 正式可用,是 GPT-6 Sol 的重大升级。
推荐理由:官方发布说明了模型在代理编码等任务上的成本与性能对比,以及 Bedrock 上的安全与数据保留配置,便于评估落地。
OpenAI 发布 GPT-6.1 Sol,定位为接近 Astra 智能水平的模型,覆盖编码、计算机使用和专业工作场景,API 输入和输出 token 价格为 Astra 标准价的五分之一。
推荐理由:官方明确了 GPT-6.1 Sol 的定位与价格对比,读者可以直接评估在编码和计算机使用场景下的成本替代空间。
Amazon Bedrock 现已在首尔区域(ap-northeast-2)支持 Claude Opus 5 和 Claude Sonnet 5、在新加坡区域(ap-southeast-1)支持 Claude Sonnet 5 的区域内推理。
Amazon Bedrock 宣布在印度地区提供 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过地理跨区域推理在 Mumbai 和 Hyderabad 两个 Region(ap-south-1 和 ap-south-2)内处理数据。
Google Research 提出 Diffusion Controller 框架,将去噪过程重构为连续控制问题,用轻量级"转向阻尼"网络在不改动基座模型的情况下引导生成。基于 Stable Diffusion v1.4 的实验用 HPS-v2 评测,涵盖 SFT、RWL 和 PPO 三种微调方式,其完全解锁版本相对基线模型达到 90% 胜率,并且能在不接触底层代码的情况下控制闭源模型。
Condé Nast 与 AWS Generative AI Innovation Center 合作,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频发现方案,采用 TwelveLabs Marengo 嵌入模型联合编码视觉、音频和文字稿信号,支持意图式语义搜索、图片查询和时间戳定位。
AWS 发布了一个合同智能平台参考架构,用 AI 智能体从合同 PDF 中提取 8 个关键字段并独立验证,解决 RAG 无法跨数百份合同做汇总查询的问题。提取由 Claude Sonnet 系列模型驱动,Claude Haiku 独立复核,签名分歧时由 Amazon Textract 做确定性裁定,结果存入 Amazon Aurora PostgreSQL。
AWS 这篇教程按组件讲解 Amazon Quick 的提示词技巧。Quick Research 需要明确研究目标、受众与范围,可拆解子问题并从 Quick Index。
AWS 发文讲解 Amazon Quick 的提示词工程基础原则与结构化框架,帮助用户让平台的 AI 功能更准确地响应自然语言请求。文章提出通过具体化、提供业务上下文、用示例(few-shot)示范输出格式等核心原则,并介绍 CRISPE 等通用框架。本文为系列第一篇,聚焦跨组件通用方法,第二篇将深入 Research、Flows、Sight、Chat Agents 等具体组件的技巧。
Microsoft Research 发布 Quine,一个包含生物学世界模型和交互式 harness 的 AI 研究系统,可跨基因组、蛋白质、化学、细胞状态和生物成像等模态联合学习。
NVIDIA 发布开源表格基础模型 Kumo Tabular,对分类和回归任务无需训练、调参或特征工程,单次前向传播即可预测新行标签,权重已在 Hugging Face 开放,采用 OpenMDW-1.1 许可证。
Hugging Face 团队提出 ProvenanceGuard,一个针对基于 MCP 的 LLM 智能体的生成后验证层,能检测“跨来源混淆”——事实存在但被归因到错误来源的情况。
xAI 的 Grok 4.7 上线 Amazon Bedrock,提供 500K token 上下文窗口和 low 到 xhigh 四档推理力度,通过 us.xai.grok-4.7 和 global.xai.grok-4.7 跨区域推理配置接入,支持 Responses、Chat Completions 和 Converse API。
推荐理由:原文给出 Bedrock 上的接入方式、推理档位与 Artificial Analysis 独立评测数据,可帮助读者评估成本与接入取舍。
Microsoft Research Asia – Singapore 于 2025 年 7 月 24 日成立,是 Microsoft 在东南亚的首个研究实验室。
OpenAI 就涉及澳大利亚政府网站的事件公开致歉,并表示将推出更强的安全防护措施与支持,以加强澳大利亚的网络防御能力。
OpenAI 发布针对前沿 AI 训练的安全案例早期指南,内容涵盖技术防护措施、运营实践,以及模型不对齐事件的调查方法。该指南旨在为评估前沿模型训练安全提供框架参考。
AWS 宣布 Claude Sonnet 5.5 可在 Amazon Bedrock 和 Claude Platform on AWS 使用,主打专注编码与知识工作,多数任务单次成本更低、速度更快。
推荐理由:原文给出 Sonnet 5.5 在 Bedrock 的能力变化、与 Opus 5.5 的分工建议和接入步骤,可据此规划工程工作流。
AWS 发布教程,讲解如何在 Amazon SageMaker AI 上通过 vLLM-Omni DLC 部署 Qwen3-TTS,实现语音生成完成前即可开始播放的流式语音输出。
在 Amazon SageMaker AI 上部署同一 AWS vLLM-Omni Deep Learning Container 的两个端点:实时端点运行 FLUX.2-klein-4B 生成图像,异步端点运行 Wan2.1-VACE-1.3B 将图像生成为视频,MP4 结果存入 Amazon S3。
Mistral 宣布在慕尼黑开设新枢纽,设立专注 Physics AI 和工业 AI 的研究团队与应用工程团队。2026 年 5 月收购 Emmi AI 后超过 30 名物理与工程 AI 人员加入;正与 BMW 合作碰撞仿真、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学利用风洞设施研发汽车空气动力学数字孪生。
AWS 通过 Amazon Nova Act 与 Amazon Bedrock AgentCore 构建智能体驱动的合成监控方案,用自然语言动作替代基于 DOM 选择器的 Selenium、Playwright 脚本。
H 公司发布 Holo4 系列通用计算机使用智能体模型,含 27B dense 与 35B-A3B MoE 两种规格,并附带更新版 Holotron4 Nano。
推荐理由:模型可跨 GUI、代码、MCP 和 API 多种接口工作并开源权重与轨迹,读者可对比其与前沿模型的成本差异来判断适用场景。
OpenAI 扩大对 Lenfest Institute 的 AI Collaborative and Fellowship Program 的支持,追加 500 万美元资金,以及最高 500 万美元的软件额度与工程支持。该项目由 Lenfest Institute 运营,此次扩展使其规模进一步扩大。
Basis 的税务工作簿场景中,GPT-6 Astra 完成 50 个 tab 的税务工作簿速度比 GPT-5.6 Sol 快一倍。其对用户意图的理解更强,让 Basis 在实际使用中更有信心。
OpenAI 正在征集开发者和研究者使用 Codex 创造的真实故事,邀请他们加入下一期 Codex Originals 计划。感兴趣的用户可提交自己的故事和项目参与。
Proaction 使用 Codex、GPT-Live-1 和 GPT-6 Astra 更快地构建、运营和销售现代车队管理方案,销售增长 60%,并节省 75+ 小时。
AWS 在 Amazon EKS 上结合 Elastic Fabric Adapter(EFA)和 DeepEP,构建了加速 MoE 模型大规模强化学习训练的架构,吞吐量提升 40%。
本文演示在 Amazon SageMaker HyperPod 上用开源 RL 框架 SkyRL 训练 Qwen3-VL-8B 视觉语言模型完成视觉迷宫导航任务。
AWS 的 NarrateAI 在 Amazon Bedrock 上通过五项技术为实时商业问答提供生产级 LLM 质量保障,实现约 99% 的数值准确率并实时流式输出响应。
Alibaba Cloud Qwen 团队开源的 Qwen3-TTS-12Hz-1.7B-Base 文本转语音模型现可通过 Amazon SageMaker JumpStart 部署到全托管实时推理端点。
Datacor 在其 TrackAbout 解决方案中集成 Amazon Quick Sight,为工业气体与焊接分销商提供租赁资产自助分析,客户无需再等待 IT 出报表,其客户合计管理 2750 万资产、每月超 72.5 万笔账单。
Amazon SageMaker HyperPod 与 Qumulo 的 Cloud Native Qumulo(CNQ)及 Cloud Data Fabric(CDF)结合,可让训练算力与数据集分别位于不同 AWS Region,无需复制数据即可跨区域读取。
GitHub Copilot 团队认为聊天不是与 AI 交互的正确界面,介绍了 GitHub Copilot app 中的 canvas 功能,它是可与应用内 agent 双向通信的全栈小程序。作者用 Connect 4 游戏、Winget 包管理、SQLite 操作和自动化开发工作流等示例说明,与其让 agent 处理每次交互浪费 token,不如让它构建一个后续交互免费的自定义工具。
Google Research 推出 AI 视频联合导演研究,基于 Gemini 和 Veo 构建统一多智能体框架,包含 Co-Director、CANVAS、A²RD 和 VQQA 四套框架,将长视频生成建模为全局优化与世界状态跟踪问题。
GitHub Security Lab 的 Antonio Morales 发布 Fuzzing Taskflow,一个基于 Taskflow Agent 的自主模糊测试流水线,只需提供 GitHub 仓库即可自动识别入口点、编写 harness、运行 AFL++、改进覆盖并分诊崩溃。
推荐理由:原文详述了用 LLM Agent 自动写 harness、跑 AFL、追覆盖缺口和分诊崩溃的完整流水线设计,可直接复用。
Google DeepMind 在 Gemini 3.8 Live 发布一周后推出 Live Avatar 功能,为对话模型带来近实时的视频形象。
AWS 发布 WhisperX 深度学习容器(DLC),在 OpenAI Whisper 基础上加入批处理推理、wav2vec2 强制对齐的词级时间戳和说话人分离,可在 SageMaker AI 上一键部署。
AWS 展示如何用 Amazon Bedrock AgentCore Gateway 和 MCP 构建多账户架构,让数据保留在各业务线(LOB)账户中,智能体通过统一端点跨账户发现和调用工具。