跳到正文

全部动态

今日 11 条
9月25日周五
9月24日周四
  1. Hugging Face Blog60

    Liquid AI 发布 LFM2.5-VL-3B-DSpark 草稿模型,视觉语言模型解码提速最高 3.13x

    Liquid AI 为视觉语言模型 LFM2.5-VL-3B 发布实验性 DSpark 草稿模型,通过投机解码在不改变输出质量的前提下加速推理。解码最高提速 3.13x(M5 Max 端侧)和 2.66x(H100),端到端最高提升 2.62x 和 2.27x;草稿模型增加 280M 参数(约 8.9%),首日支持 llama.cpp、MLX-VLM 和 SGLang。

    推荐理由:原文给出视觉语言模型投机解码加速的具体数字、内存开销和第一天框架支持,读者可以据此评估端侧与 GPU 部署收益。

  2. GitHub Blog · AI & ML60

    GitHub Copilot 应用如何渲染超大 Pull Request

    GitHub Copilot 应用重构了 Pull Request 视图,可流畅渲染一个含 2,200 个文件、超一百万行变更、400 多条行内评论的开源巨型 PR。核心做法是把高度拆成确定性的代码几何与按需测量的动态评论块几何,配合滚动锚定校正、空闲调度测量,以及无人值守的变更到测量到改进循环来定位 bug。

    推荐理由:原文完整拆解了超大 PR 渲染的双几何设计与自动化测量方法,工程细节可直接迁移到类似虚拟化场景。

  3. Microsoft Research53

    Microsoft Research 研究显示将机器人 AI 推理卸载到边缘或云端可提升性能与续航

    Microsoft Research 通过系统性测量研究指出,仅依赖机器人机载 GPU 会限制性能、续航与可扩展性。实验显示小型 GPU 上地图与规划最高慢 383%,导航障碍及时检测率下降 30%,VLA 模型准确率下降 50%;换成 Raspberry Pi-5 并卸载推理可显著延长电池时间,Jetson Thor 等机载 GPU 对机器人的电池消耗高达 160%。

  4. OpenAI News15

    OpenAI Academy 两周年

    OpenAI Academy 迎来两周年,OpenAI 表示将继续把 AI 技能带给更多社区。该项目两年来面向公众推广 AI 技能教育,未来计划覆盖更广泛的人群。

9月23日周三
  1. Google DeepMind65

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,覆盖 100 多种语言和方言,支持从 30 秒音频样本复刻声音、逐行导演表演节奏以及原生双说话人场景编排。

    推荐理由:官方发布说明了两个 TTS 模型的定位、评测成绩和语音设计能力,开发者可以直接对照评测与入口评估是否接入。

  2. NVIDIA Blog23

    NVIDIA 验证工程师 Sakeena Fiza 助力硬件规模化成功

    NVIDIA 验证工程师 Sakeena Fiza 负责在大规模量产前发现数据中心硬件缺陷,她曾见证 NVIDIA Rubin GPU 首次在系统级成功枚举。验证工作贯穿从单板、整机架到 AI 工厂的各个环节,一块单板可能包含数万个元器件,一个机架接近 50 万个,团队需要排查高速信号、散热余量、电源完整性等各类失效原因。

  3. AWS Machine Learning Blog63

    OpenAI GPT-6 Sol 和 GPT-6 Luna 正式登陆 Amazon Bedrock

    OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 在 Amazon Bedrock 正式可用,API 定价显著低于 GPT-5.6 前代。GPT-6 Sol 面向推理、编码和多步骤复杂任务,内部事实性评估中事实错误约为 GPT-5.6 Sol 的一半;GPT-6 Luna 面向大规模重复性任务,支持按请求调整推理力度。

    推荐理由:原文给出两款模型的定位差异、定价变化与数据管控细节,读者可以据此为不同负载选型和评估上云方式。

  4. OpenAI News62

    OpenAI 发布 GPT-6 Sol 和 Luna 两款模型

    OpenAI 发布 GPT-6 Sol 和 Luna 两个模型,将前沿智能带入日常工作,两者在能力与成本之间提供不同的平衡。

    推荐理由:官方宣布 GPT-6 Sol 和 Luna 两个模型,定位在能力与成本间做不同取舍,可关注两者的差异化定位。

9月22日周二
  1. NVIDIA Blog25

    从赋能到落地:埃及 AI 生态迈向生产级规模

    NVIDIA 在大埃及博物馆举办活动,展示埃及 AI 生态进入生产级规模:Deep Learning Institute 学员一年内增长逾十倍,Hassan Allam 与 A15 将投资约 4 亿美元新建数据中心。非洲一年内已宣布或上线四座 AI 工厂,另有 656 兆瓦在建产能;NVIDIA 已培训逾 85,000 名非洲开发者,尼日利亚成为其全球第二大市场。

9月21日周一
  1. Microsoft Research58

    Microsoft Research 发布逆合成模型 RetroChimera 并在 Nature 发表论文

    Microsoft Research 在 Nature 发表逆合成预测框架 RetroChimera,并开源实现和权重(MIT 许可,GitHub 和 Microsoft Foundry 可用)。模型由 R-SMILES 2 和 NeuralLoc 两个子模型通过 learning-to-rank 集成,盲测中 PhD 级化学家更偏好其单步预测,10 个挑战性目标中完成 9 个,优于子模型和基线。

  2. NVIDIA Blog55

    NVIDIA 提出 AI 安全是工程问题并给出智能体栈分层安全方案

    NVIDIA 发文提出 AI 安全是工程问题,需要明确需求、可执行控制、指定责任人和防护有效性的证据。文章主张安全取决于模型、harness 和运行时构成的完整智能体栈,介绍开源安全运行时 NVIDIA OpenShell 及 Cisco DefenseClaw、JFrog 集成等生态实践,并强调重大变更后需重复测试、由责任人决定是否部署。