GPU 管理:为什么闲置 GPU 是新的“停场飞机”
Hugging Face 提出企业 AI 的下一个真正约束是利用率而非智能,并以航空业类比:GPU 成本按日历小时累积(融资、折旧、电力、制冷),产出却只按计算小时累积。
Hugging Face 提出企业 AI 的下一个真正约束是利用率而非智能,并以航空业类比:GPU 成本按日历小时累积(融资、折旧、电力、制冷),产出却只按计算小时累积。
UC Berkeley 的 Aditya G. Parameswaran 等人撰文指出,GPT-4 级能力的推理成本已从 2023 年初的约 $30 per million tokens 降至 $1 以下,部分供应商甚至低于 $0.10,基准推理价格每年下降 9x 至 900x。
Dharma AI 解读 Goldfeder、Wyder、LeCun 与 Shwartz-Ziv 2026 年论文《AI Must Embrace Specialization via Superhuman Adaptable Intelligence》,论证专业化是有效 AI 系统的必然路径。
NVIDIA 发布 ENPIRE 框架,让物理机器人像 AI 智能体一样自主实验与改进策略,前端 coding agent(Codex 内的 GPT-5.5、Claude Code 内的 Opus 4.7)可使机器人在 PushT 等真实灵巧操作任务上达到 99% 成功率。
Import AI 第 459 期报道:弗吉尼亚大学、Anthropic 与加拿大银行研究人员的论文估计,美国 2025 年名义 AI GDP 约 $250 billion,质量调整后实际年增速约 2,600%,但在传统 GDP 统计中难以显现。
Import AI 第 458 期刊登作者在牛津大学人类中心 AI 实验室(HAI Lab)与 Cosmos Institute 合办的 2026 Cosmos HAI Lab Lecture 上的长篇演讲及一篇虚构的正面奇点故事。
Import AI 第 457 期报道三大主题:SentinelOne 拆解了约 20 多年前的病毒 fast16.sys,它篡改高精度计算软件(如 LS-DYNA 970。
Import AI 第 456 期介绍 Institute for Law & AI 提出的“激进可选性”(Radical Optionality)AI 治理思路:政府应避免过度监管,同时提前投资建设信息收集、举报人保护、模型权重安全等能力,为未来危机保留决策选项。
Berkeley AI Research 发文分析并行推理研究进展,核心问题是让推理模型自主决定何时分解并并行独立子任务、生成多少并发线程以及如何协调。文章梳理了从 Self-consistency、Best-of-N 到 Tree of Thoughts、MCTS 的固定并行方法,以及 ParaThinker、GroupThink、Hogwild!
Jack Clark 在 Import AI 455 撰文判断,2028 年底前出现 AI 自主训练后继模型的概率超过 60%,2027 年为 30%。