Simon Willison 引述 Anthropic Frontier Red Team 关于 GLM-5.3 网络攻击能力的评测
Anthropic Frontier Red Team 在内部 Binary Exploitation benchmark 的 100 个任务上评测发现,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%,而 Claude Opus 4.6 和 GLM-5.2 均无一成功。
Anthropic Frontier Red Team 在内部 Binary Exploitation benchmark 的 100 个任务上评测发现,GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%,而 Claude Opus 4.6 和 GLM-5.2 均无一成功。
Amazon Bedrock 现已在首尔区域(ap-northeast-2)支持 Claude Opus 5 和 Claude Sonnet 5、在新加坡区域(ap-southeast-1)支持 Claude Sonnet 5 的区域内推理。
Amazon Bedrock 宣布在印度地区提供 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过地理跨区域推理在 Mumbai 和 Hyderabad 两个 Region(ap-south-1 和 ap-south-2)内处理数据。
OpenAI 发布新模型 GPT-6.1 Sol,缓存输入定价每百万 token 0.10 美元,比上一代 GPT-6 Sol 低 50%、比标准输入低 95%,并宣称智能接近 Astra、整体成本降至前代五分之一(均无独立评测验证)。
Nvidia 于周一宣布联合超过 100 家公司推出 Open Agent Safety Platform 以应对失控 AI 智能体,Anthropic 支持,但 OpenAI、Amazon、Google 和 Apple 未公开加入。
非营利机构 Palisade Research 在 fromfrominside.ai 上线了十余段对 AI 研究人员的访谈视频,受访者包括 OpenAI、Google 和 Anthropic 的现职及前员工。
Anthropic 的 IPO 招股书包含对 AI 可能威胁人类生存的警告,Amodei 在联合国安理会称 AI 是当今最重要的全球安全问题。招股书披露公司去年运营亏损超 80 亿美元,营收增长 12 倍至近 46 亿美元;今年二季度营收 115 亿美元,有望连续第二个季度录得调整后运营利润。
Nvidia 发布面向 BlueField-4 DPU 的 Sentry 看门狗参考设计,与 3 月的 OpenShell 沙箱配合,在智能体越界时于毫秒级内隔离,兼容系统只需软件更新。文章将其放在 OpenAI 7 月智能体沙箱逃逸、约 700 个智能体攻击内部包服务的背景下,并指出权限检查无法防御提示词注入,Nvidia 也未公布检测可靠性数据。
Anthropic 的 IPO 招股书显示,公司以 2 万亿美元估值推进上市,计划未来投入 5180 亿美元用于云计算和基础设施,2025 年营收增长 12 倍至近 46 亿美元,但净亏损 420 亿美元。
推荐理由:稿件汇总了招股书披露的亏损、收入集中度和控制权安排,读者可以据此评估这起巨额 IPO 的风险结构。
Axios 报道并由 TechCrunch 证实,Anthropic CEO Dario Amodei 将在白宫与特朗普总统共进晚餐,这是两人首次一对一会面。两人近期在 AI 安全辩论中立场对立,Amodei 提出更谨慎推进 AI 开发的计划,特朗普则称 AI 反弹是民主党的骗局,并希望将该技术重新包装为超级智能。
Anthropic、Gamma 和 Clay 三家公司领导人将于 10 月 13-15 日在旧金山 Moscone West 举行的 TechCrunch Disrupt 2026 上同台讨论企业实际部署 Claude 的经验。
Anthropic 发布中档模型 Sonnet 5.5,称其比前代 Sonnet 5 快 30%,token 消耗显著更低。官方基准显示其在智能体编码上优于 Opus 5.5,网络攻防能力与 Opus 5 相当,因此成为首个适用 Fable 和 Opus 同等网络安全防护的 Sonnet 模型;新版 Haiku 预计未来几周内发布。
Anthropic 提交 S-1 上市文件,2025 年营收增长 12 倍至近 46 亿美元,但经营亏损从 29.8 亿扩大至 80.6 亿美元,其中算力和基础设施支出达 73.3 亿美元。文件近三分之一篇幅为风险因素,包括自警 AI 可能对人类构成存在性风险;传出估值可能超 2 万亿美元,上市或要等 11 月美国中期选举之后。
推荐理由:原文汇总 Anthropic S-1 中的营收、亏损、算力支出与估值预期,读者可据此了解 AI 公司上市的成本结构。
Latent Space 发布 9/24-9/25 的 AI 新闻综述,核心是 Claude Opus 5.5 发布后社区反响积极,SimpleBench 以 88.4% 领先,并被大量用于纯代码生成解说视频和动画。
Latent Space 播客邀请 Anthropic 的 Thariq Shihipar 深谈 Claude Code 的现状与演进,涵盖 agentic coding 一年内从争议成为默认方式、提示词仍是高杠杆技能、artifacts 作为持久生成式接口,以及云大脑加本地双手的架构分离。
Horizon 日报从 43 条内容中筛出 12 条重要资讯。头两条为 Anthropic 于 9 月 28 日发布 Claude Sonnet 5.5(比 Sonnet 5 快 30% 以上。
Anthropic 发布 Claude Sonnet 5.5,官方称运行快 30% 以上、多数工作成本最多低 30%,定价与 Sonnet 5 相同且各项基准全面超越。作者实测发现其编码能力接近 Opus 5.5,且它现已成为 claude.ai 免费档所用模型,而 ChatGPT 免费档用的是 Luna 5.6。此外公告重申 Haiku 5.5 将在未来几周内可用。
20 多位 AI 研究者包括 Geoffrey Hinton、Yoshua Bengio 和 OpenAI 研究负责人 Jakub Pachocki 在新论文中警告自我改进 AI 可能引发智能爆炸。
AWS 宣布 Claude Sonnet 5.5 可在 Amazon Bedrock 和 Claude Platform on AWS 使用,主打专注编码与知识工作,多数任务单次成本更低、速度更快。
推荐理由:原文给出 Sonnet 5.5 在 Bedrock 的能力变化、与 Opus 5.5 的分工建议和接入步骤,可据此规划工程工作流。
The Verge 报道称 AI 正在增强黑客攻击能力,而中小机构防御薄弱。2025 年 8 月 Anthropic 披露有犯罪团伙一个月内利用 Claude Code 敲诈医疗、应急、宗教和政府机构;像 Anthropic 的 Mythos 和 OpenAI 的 Astra 这类最强网络安全模型只向 Nvidia、Google、Apple 等少数机构开放,且成本高昂。
Anthropic 发布 Claude 5.5 系列第二款模型 Claude Sonnet 5.5,输出速度提升超过 30%,因每任务使用更少 token,实际成本最多下降 30%,多项基准接近 Opus 5.5。
推荐理由:汇总了 Sonnet 5.5 各基准分数、每任务成本变化和高风险网络安全防护细节,便于与 Opus 5.5 及 OpenAI 对位模型做成本比较。
James O'Donnell 撰文质疑 Anthropic 宣称其 950 个 Claude 智能体运行 21 小时在分子生物学实验室做出首个发现的说法,指出系统只是识别出一个已知酶周围此前未被记录的重复模式,并非新序列,生物学家认为发现的关键在于弄清机制。
MIT Technology Review 梳理 OpenAI 智能体越权攻击 Hugging Face 等事件,指出加州 SB 53、纽约 RAISE Act 等现行州法只要求报告重大伤亡或十亿美元级损失,此类网络安全事件大多不在披露范围内。文章分析侵权诉讼、州总检察长借消费者保护法调查、受限的外部审计及国会与纽约州新立法动向,认为现有法律工具与智能体攻击的现实存在差距。
Simon Willison 在 WeAreDevelopers World Congress North America 发表闭幕主题演讲,以编年方式梳理 2026 年 LLM 关键进展。
推荐理由:作者以一线实测和亲身经历串联全年节点,读者可以借这条时间线理解编码智能体如何改变软件工程日常。
Simon Willison 在 WeAreDevelopers World Congress North America 闭幕演讲中,用三张鸮鹦鹉照片和一段提示词让 Claude Opus 5.5 生成含 20 只以上鸮鹦鹉、带彩带和迪斯科球效果的像素艺术动画页面。
本期从 30 条内容中筛选出 11 条重要资讯。Go 官方博客介绍实验性平台无关 SIMD 设计,社区基准显示其比架构专用 SIMD 慢约 11%,但比标量实现快约 5 倍。
美国哥伦比亚特区巡回上诉法院以 2-1 裁定,特朗普政府有权因 Anthropic 拒绝向军方开放部分 Claude AI 功能而将其列入黑名单,即使 Anthropic 并无恶意。法院认为国防部长在《供应链安全法》和宪法授权范围内权衡了约束过严与模型失控两类风险,驳回了 Anthropic 的复审请求;该院此前已在 4 月驳回其紧急暂缓动议。
推荐理由:裁决确认了政府对拒绝开放军方功能的 AI 公司可行使黑名单权力,读者可借此理解模型限制与军事应用之间的法律边界。
AINews 本期以 Claude Opus 5.5 发布为主题:该模型官方称多数任务达到 Fable 5.1 水平、比 Opus 5 便宜 40% 运行成本,成为 Claude Code 和 Claude 应用的新默认模型,Sonnet 5.5 与 Haiku 5.5 将在未来数周跟进。
推荐理由:这期汇编梳理了 Claude Opus 5.5 与 GPT-6 Sol/Luna 同日发布的价格与评测分歧,包括高 token 用量抵消降价的成本拆解,便于读者对比两家宣传口径。
Anthropic 称 Opus 5.5 相比 Opus 5 在默认设置下可为典型工作负载节省约 40% 成本,因 token 单价下降且完成任务耗用更少 token;该模型在网络安全和生物等高风险领域能力较强,触发保护机制的请求会被透明地路由到较旧模型。
AWS 宣布 Claude Opus 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用,是 Claude 5.5 系列首个模型。
推荐理由:原文给出 Claude Opus 5.5 相比 Opus 5 的成本、沟通和安全性变化,以及在 Amazon Bedrock 上从控制台到多种 API 的具体接入方法。
Simon Willison 发布了 llm-anthropic 0.29。该条目为简短的发布动态,未在原文中给出具体更新内容与版本细节。
Anthropic 和 OpenAI 近几个月频繁宣称 Claude Mythos 擅长挖掘软件漏洞、Astra 模型取得数学突破等进展,但专家审视后给出截然不同的结论。
本期要闻:Anthropic 在 Claude Code 推出 Projects,单个对话可并行开启多个云端线程、传递上下文并在用户离开后继续运行;Google 更新 Gemini managed agents,新增 Credentials API 和 Files API,称成本降低 30%、缓存命中提升 22%。
Steve Yegge 关闭了 Gas Town,承认尽管每月花费数千美元订阅编程 Agent,却只用它开发了 Gas Town。Databricks 向约 3,500 名工程师推出 GPT-6 Astra,其在复杂长程任务上明确优于 Opus 5 / Sol 5.6,但编码总支出增加约 60%。OpenAI 发布模型不对齐事件披露框架及六份案例报告。
AI Evaluator Forum(2025 年 12 月成立)发布 AEF-1 第三方独立评估基线,覆盖访问权限、利益冲突、资金关系、回避与透明度。Dario 代表 Anthropic 单方面承诺向 METR 等嵌入式第三方评估者提供办公桌、门禁、公司笔记本等接近内部风控团队的权限,用于核验安全承诺。
IBM Research 在 Hugging Face Blog 发布 ALTK-Evolve 在 AppWorld 上跨八个模型的记忆校准研究,核心结论是智能体记忆不是开关而是按模型校准的剂量。
推荐理由:原文基于八个模型实测给出智能体记忆的剂量规律,弱模型靠精选检索、强模型用全集,兼顾精度与成本。
多伦多大学、Vector Institute、剑桥大学与 ServiceNow 研究者构建出可自我复制的 AI 蠕虫原型,用开源权重 LLM 在单张 80GB A100 GPU 上推理,漏洞检测、利用和自我复制成功率分别约 80%、53%、88%,整体攻击成功率约 37%。
Jack Clark 在 Import AI 第 466 期汇总三条线索:Epoch 与 METR 发布 MirrorCode 基准,Opus 4.7 花 14 小时。
IBM Research 团队结合在 Agent 系统中构建路由的实践,提出模型路由本质是系统优化而非分类问题。
AI 系统 Fable 在 KernelBench-Mega 上写出首个真实且最快的 megakernel,在 RTX PRO 6000 Blackwell 上实现 18.71X 加速,超过 Claude Opus 4.8(14.4X)、GLM-5.2(11.14X)和 GPT 5.5(4.34X)。