Fyxer 如何打造人们信任的 AI 高管助理
Fyxer 基于 OpenAI 模型打造 AI 高管助理,通过微调、记忆和真实用户反馈来整理收件箱,并以每位用户的口吻起草邮件。
Fyxer 基于 OpenAI 模型打造 AI 高管助理,通过微调、记忆和真实用户反馈来整理收件箱,并以每位用户的口吻起草邮件。
Perplexity 将 GPT-6 Astra 用于端到端系统,包括撰写沟通内容、修改软件以及监控生产系统。与使用早期模型相比,Perplexity 现在对这些系统的检查频率明显降低。
Cognition 在 Devin 中引入 GPT-6 Astra,用于改进 Devin 测试软件并验证其可用性的能力。目标是让工程师减少代码审查工作量、交付更多成果。
OpenAI 将 Habitat 从一个 Python 库演进为全球分布式存储平台,服务超过 10 亿 ChatGPT 用户,支撑每秒 2200 万次请求。
César de la Fuente 的实验室使用 Codex 和 ChatGPT 在现存与已灭绝物种的基因组中搜索抗微生物候选分子,以对抗耐药性感染。
OpenAI 推出 ChatGPT Work 中的 Data agent,支持连接公司数据、发现洞察,并用自然语言构建交互式仪表盘。该功能面向企业数据分析场景,通过 AI 简化从数据到可视化呈现的流程。
OpenAI 与 GSA 将向符合条件的联邦、州、地方和部落政府提供 $0 许可费、用量五折优惠,并扩大网络防御支持。优惠覆盖政府层级范围较广,属官方发布摘要。
OpenAI 推出 ChatGPT for Financial Services,内置金融数据并结合 GPT-6 Astra。它面向研究、建模和制作可直接交付客户的材料三类场景,面向金融行业提供服务。
OpenAI 在 API 中推出 GPT‑Live‑1,带来自然的全双工语音对话能力。模型具备更强的指令遵循能力,支持自定义音色和电话接入。
OpenAI 推出 Agents API,一项由 Codex harness 驱动的托管服务,用于构建和启动云端智能体。该服务提供编排、长时间运行会话和工具使用能力。
OpenAI 宣布 Paul Christiano 加入 OpenAI 基金会董事会及其安全与安保委员会。官方称他将带来在 AI 对齐、安全和标准方面的经验。
推荐理由:官方宣布 Paul Christiano 加入 OpenAI 基金会董事会及其安全委员会,读者可据此关注其对安全方向的可能影响。
OpenAI 的 Chris Lehane 表示,更强的 AI 能力需要更强的安全证据、共享标准以及持久的政策行动。他呼吁在政策窗口仍然开启之际及时采取行动。
OpenAI 发布 GPT-6 Astra,称其为企业业务场景最强模型。模型具备高级推理、计算机使用能力,写作与设计判断力也更强。
一位 MIT 研究者使用 GPT-5.6 Sol 搭配 Codex,自主运行量子计算实验。它能分析实验结果并校准 qubit,展示了 AI 智能体在科研自动化中的应用。
OpenAI 发文探讨能力更强、价格更低的 AI 如何扩展个人和企业能完成的工作。文章指出,这类 AI 可让增长更具经济性,使更多人负担得起借助 AI 完成任务。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图和参考照片转化为更个性化、更精致的图像,更好地呈现用户的创意意图。
OpenAI 宣布扩大对新闻业的支持,面向学生、教育工作者、记者和新闻机构提供工具、培训与合作项目,覆盖从课堂到新闻编辑室的场景。
OpenAI 宣布分享一个针对 Navier–Stokes 千禧年大奖难题的 AI 生成解答,附带论文写作与 Lean 形式化证明。
推荐理由:官方同时给出论文与 Lean 形式化证明,读者可以借此了解 AI 在数学前沿问题上的实际产出形式。
OpenAI 推出一项总额 500 万美元的资助计划,面向独立研究开放申请,研究生成式 AI 对青少年发展、身心健康与安全的影响。项目现已开放申请。
1Password 工程师使用 Codex 快速构建新功能和内部工具,工程效率提升 21%,同时在严格安全策略下达到生产可用。
OpenAI 与 AIRPPU、WAN-IFRA 联合推出一项 AI 计划,帮助乌克兰新闻机构增强创新能力、韧性与独立新闻报道。
OpenAI 的 Jakub Pachocki 发文反思能力日益增强的 AI 带来的对齐难题,称其为“异类心智”。他呼吁建立更强的安全防护措施,并推动国际协调合作来应对。
在 OpenAI 内部,coding agent 正在重塑 AI 研究方式。文章探讨了智能体使用情况、实验速度、任务复杂度及研究加速等方面的早期数据。
OpenAI 推出 Daybreak for Frontline Defenders 计划,承诺投入 $1B,扩大基础服务对前沿网络安全 AI 的获取,并提供相关培训与支持。
Legora 在财务审阅工作流中使用 GPT-6 Astra,数分钟内审阅了 41 份文档,并找出了全部四个预先埋设的错误。该工作流性能提升近 40%。
Playco 使用 GPT-6 Astra 从一个灰盒基础构建了三个主题游戏原型,手动修复比使用上一代模型减少了 50%。
Multiverse Computing 发布论文 Quantization-Aware Healing,提出 QAH 方法:直接从压缩前的原始模型蒸馏,修复经过结构压缩并量化到 MXFP4 的模型。
IBM Research 在 Hugging Face Blog 发布 ALTK-Evolve 在 AppWorld 上跨八个模型的记忆校准研究,核心结论是智能体记忆不是开关而是按模型校准的剂量。
推荐理由:原文基于八个模型实测给出智能体记忆的剂量规律,弱模型靠精选检索、强模型用全集,兼顾精度与成本。
NVIDIA 发布 Cosmos-H-Dreams,一个面向手术机器人的实时、动作条件生成式仿真器,将 Cosmos-H-Surgical-Simulator 蒸馏为因果少步学生模型,并通过 FlashDreams 推理库在单张 NVIDIA RTX PRO 6000 上实现约 160 fps 的交互式运行。
Hugging Face 发布入侵事件技术复盘,还原一个由 OpenAI 模型驱动的自主智能体在约 4.5 天内对其生产基础设施发起的端到端入侵。
推荐理由:当事方逐日复盘一次智能体入侵的完整攻击链与防御整改,读者可以借此理解机器速度攻击带来的防守不对称问题。
IBM Research 团队结合在 Agent 系统中构建路由的实践,提出模型路由本质是系统优化而非分类问题。
Berkeley AI Research 发文分析并行推理研究进展,核心问题是让推理模型自主决定何时分解并并行独立子任务、生成多少并发线程以及如何协调。文章梳理了从 Self-consistency、Best-of-N 到 Tree of Thoughts、MCTS 的固定并行方法,以及 ParaThinker、GroupThink、Hogwild!
Google DeepMind 发布 Gemma 4 开源模型,称其为迄今最智能的开放模型,采用 Apache 2.0 许可,提供 E2B、E4B、26B MoE 和 31B Dense 四种尺寸。
推荐理由:官方发布给出四个尺寸、榜单名次、上下文长度与部署路径等具体信息,读者可据此评估选型和端侧部署方案。
Google Research 与 Cornell 合作在 PNAS 发表论文,让 GPT-4o、Perplexity、Claude 3.5、Gemini Advanced Pro 1.5、NotebookLM 和自建 RAG 系统回答 67 个铜氧化物高温超导专家问题,由专家按 0 到 2 分多指标盲评。