跳到正文

全部动态

今日 20 条
9月10日周四
9月9日周三
9月8日周二
  1. Google DeepMind69

    Google DeepMind 发布 AlphaGenome Atlas,预测人类基因组 90 亿个单碱基变异影响

    Google DeepMind 于 9 月 8 日发布 AlphaGenome Atlas,包含人类基因组约 90 亿个单核苷酸变异的分子效应预测,数据集达 1 PB,是 AlphaFold Database 的 30 多倍。

    推荐理由:原文给出平台规模、AVI 评分构成和免费学术入口,读者可据此评估它在变异解读和罕见病研究中的用法。

9月5日周六
  1. GitHub Blog · AI & ML68

    GitHub 发布 Project HydraFusion 研究预览,用多模型运行时编排提供前沿级编码质量

    GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排为每个任务生成执行计划,在 Single、Cascade、Critique 三种模式间选择以平衡质量、成本和延迟。

    推荐理由:官方公布了 HydraFusion 的三种执行模式和三份基准的质量与成本数据,读者可以据此评估多模型编排对编码工作流的实际价值。

9月3日周四
9月2日周三
  1. Google DeepMind73

    Google DeepMind 为 Gemini 推出 agentic video understanding,token 消耗最高降 88%

    Google DeepMind 发布 agentic video understanding 功能,覆盖 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite,通过智能体循环动态搜索和检视视频片段,替代固定帧率的静态处理。

    推荐理由:官方公布了具体降本增效数字和 API 启用方式,开发者可据此评估长视频分析的成本与精度取舍。

9月1日周二
  1. Hugging Face Blog62

    Hugging Face 发布 @huggingface/kernels 与 207 个 WebGPU 内核

    Hugging Face WebAI 团队发布 @huggingface/kernels 库及 207 个 WebGPU 内核,每个内核以带版本、正确性与基准测试的独立仓库形式发布在 Hub 上,采用 Apache-2.0 许可。

    推荐理由:官方发布 207 个 WebGPU 内核及加载库,并给出与 ORT WebGPU 的实测对比,读者可据此评估浏览器推理的加速空间。

8月28日周五
8月27日周四
  1. Google DeepMind54

    Google DeepMind 试点全球首个专有前沿模型双盲评估

    Google DeepMind 推出全球首个针对专有前沿 AI 模型的双盲评估,将外部评测限制在密码学安全的隔离环境中,防止模型提前接触测试题造成基准污染。Gemini Flash Lite 模型将与 Singapore AI Safety Institute、OpenMined、AVERI 和 MLCommons 合作,在隐私保护环境下测试机密基准。

8月25日周二
8月22日周六
8月20日周四
  1. Mistral AI67

    Mistral 发布 Agentic Search,多步检索循环显著提升复杂文档问答精度

    Mistral 发布 Agentic Search 检索层,通过 search、open、navigate、read、grep 五个工具实现多步检索循环,让模型在长文档和多数据源中查找、验证信息。

    推荐理由:原文给出 FinanceBench 与 OfficeQA Pro 的具体精度、延迟和 token 数据,读者可据此评估检索方案是否迁移到自家场景。

8月13日周四
8月11日周二
8月6日周四
7月31日周五
  1. Microsoft Research62

    Microsoft Research 发布 Echoverse 计算机使用 Agent 训练环境并开源四个世界

    Microsoft Research 推出 Echoverse,为计算机使用 Agent 构建了 12 个深度训练环境,包括 10 个领域世界和 2 个能力世界(日期选择器与嵌套过滤)。

    推荐理由:原文给出深度世界优于浅层世界的实验对比和开源入口,读者可以据此判断合成训练环境如何影响 Agent 训练。

7月30日周四
7月23日周四
  1. Hugging Face Blog68

    Hugging Face 将 Nunchaku 4-bit 扩散推理原生集成进 Diffusers

    Hugging Face 在 Diffusers 中新增 Nunchaku Lite 集成路径,可像普通 Diffusers 模型一样用 from_pretrained() 加载 Nunchaku SVDQuant 4-bit(W4A4)检查点,无需单独推理引擎或本地 CUDA 编译。

    推荐理由:官方宣布 Diffusers 原生支持 Nunchaku 4-bit 推理,附实测数据和自己量化新架构的完整工作流。

7月21日周二
7月13日周一
7月9日周四
  1. Mistral AI43

    Mistral Studio 为 Prompts 和 Skills 提供系统记录

    Mistral 推出 Studio,为企业 Prompts 和 Skills 提供统一的系统记录,实现版本化、明确归属和可追溯。每个资产拥有不可变版本、回滚、标签分类和审计日志,业务人员可即时迭代并经审批和 CI/CD 推送到生产。技能可作为 MCP servers 直接调用,结合 Observability 将生产输出追溯到对应版本;该功能现已面向 Mistral Studio 客户开放。

7月8日周三
7月7日周二
  1. Hugging Face Blog64

    Hugging Face 与 SkyPilot 推出 store: hf,实现跨云零出口费挂载 Hub 存储

    Hugging Face 与 SkyPilot 联合推出 store: hf 后端,用 hf:// URL 将 Hugging Face Bucket 或任意 Hub 仓库挂载进 SkyPilot 任务,可在 20+ 云、Kubernetes 和 Slurm 上调度,读取数据零出口费。

    推荐理由:原文给出无出口费存储接入 SkyPilot 的具体用法、基准数字和成本对比,读者可据此评估跨云 GPU 训练的存储方案。

  2. Hugging Face Blog71

    Hugging Face LeRobot v0.6.0 发布:世界模型策略、奖励模型 API 与六大仿真基准

    Hugging Face 发布 LeRobot v0.6.0,引入 VLA-JEPA、LingBot-VA、FastWAM 等世界模型策略,新增 GR00T N1.7、MolmoAct2、EO-1、Multitask DiT、EVO1 等 VLA,以及统一奖励模型 API(Robometer、TOPReward)。

    推荐理由:官方发布说明完整列出世界模型策略、奖励模型、评测基准与部署工具的具体变化,读者可据此评估是否升级和如何用于自己的机器人训练流程。

7月6日周一
7月1日周三
6月30日周二
6月27日周六
6月25日周四
  1. Google DeepMind71

    Gemini 3.5 Flash 内置 computer use 能力

    Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前该能力仅以独立的 Gemini 2.5 computer use 模型提供。

    推荐理由:官方说明 computer use 从独立模型并入 Gemini 3.5 Flash 主模型的定位变化,并给出配套安全机制与使用入口,读者可据此评估迁移时机。