OlmoEarth 嵌入向量发布:OlmoEarth Studio 支持自定义 embedding 导出用于下游分析
Hugging Face 的 OlmoEarth Studio 现已支持计算并导出开源 OlmoEarth 基础模型的 embedding 向量,用于相似性搜索、少样本分割等下游任务。
Hugging Face 的 OlmoEarth Studio 现已支持计算并导出开源 OlmoEarth 基础模型的 embedding 向量,用于相似性搜索、少样本分割等下游任务。
Mistral 宣布三项主权 AI 举措:Mistral Regional Endpoints 正式可用,可选择推理在 Europe 或 US 运行;Mistral Priority Tier 公开预览,提供自定义速率限制和 uptime SLA。
NVIDIA 发布 Magpie TTS Multilingual 开放权重模型,参数量 364M,新增现代标准阿拉伯语、韩语和巴西葡萄牙语,共支持 12 种语言,并提供生产级 NIM 部署容器。
推荐理由:原文给出TTFA延迟数据和架构改进细节,读者可据此评估自部署级联语音方案相对一体化语音模型的取舍。
Baseten 正式成为 Hugging Face Hub 的 Inference Provider,为 Hub 上的 serverless 推理提供支持,首发支持对话与文本生成任务,涵盖 Kimi K3、DeepSeek V4 Flash、GLM-5.2 等开源权重 LLM。
Google DeepMind 推出新一代音乐生成模型 Lyria 3.5,现已在 Google Flow Music 中上线。新模型改进了音乐性,可生成更丰富自然的旋律结构;歌词质量和提示词遵循度更高;人声更真实、更具情感表达且发音更准。用户还可更方便地控制生成音乐的节奏和时长。
NVIDIA 发布 Cosmos-H-Dreams,一个面向手术机器人的实时、动作条件生成式仿真器,将 Cosmos-H-Surgical-Simulator 蒸馏为因果少步学生模型,并通过 FlashDreams 推理库在单张 NVIDIA RTX PRO 6000 上实现约 160 fps 的交互式运行。
Hugging Face 在 Diffusers 中新增 Nunchaku Lite 集成路径,可像普通 Diffusers 模型一样用 from_pretrained() 加载 Nunchaku SVDQuant 4-bit(W4A4)检查点,无需单独推理引擎或本地 CUDA 编译。
推荐理由:官方宣布 Diffusers 原生支持 Nunchaku 4-bit 推理,附实测数据和自己量化新架构的完整工作流。
Hugging Face 旗下 Pollen Robotics 发布开源低成本系统 Grabette,用手持夹爪即可录制操作演示并自动生成机器人可用数据集,无需真实机器人或遥操作设备。
Google DeepMind 与印度 Atal Innovation Mission 合作推出 ATL Saathi 试点,这是一款基于 Gemini 的教师助手应用,服务覆盖 1100 万学生创新实验室。
Mistral 推出 Studio,为企业 Prompts 和 Skills 提供统一的系统记录,实现版本化、明确归属和可追溯。每个资产拥有不可变版本、回滚、标签分类和审计日志,业务人员可即时迭代并经审批和 CI/CD 推送到生产。技能可作为 MCP servers 直接调用,结合 Observability 将生产输出追溯到对应版本;该功能现已面向 Mistral Studio 客户开放。
Hugging Face 宣布 vLLM 的 transformers 建模后端在多个 LLM 架构上已达到甚至超过 vLLM 手写原生实现的推理速度。
推荐理由:官方给出三组 Qwen3 对比基准和可复现脚本,读者可据此判断是否直接切换到 transformers 后端省去移植成本。
Hugging Face 与 Amazon SageMaker AI 推出深度链接集成,开发者在 Hugging Face 模型页点击 “Customize on SageMaker AI” 或 “Deploy on SageMaker AI”,即可一键进入 SageMaker Studio 的微调或端点部署工作流,模型已预加载。
Microsoft 在 Build 2026 上宣布 Hugging Face models on Foundry,一个每周更新的精选开放权重模型目录,可一键部署到 Foundry Managed Compute 托管 GPU 平台。
Hugging Face 与 SkyPilot 联合推出 store: hf 后端,用 hf:// URL 将 Hugging Face Bucket 或任意 Hub 仓库挂载进 SkyPilot 任务,可在 20+ 云、Kubernetes 和 Slurm 上调度,读取数据零出口费。
推荐理由:原文给出无出口费存储接入 SkyPilot 的具体用法、基准数字和成本对比,读者可据此评估跨云 GPU 训练的存储方案。
Hugging Face 发布 LeRobot v0.6.0,引入 VLA-JEPA、LingBot-VA、FastWAM 等世界模型策略,新增 GR00T N1.7、MolmoAct2、EO-1、Multitask DiT、EVO1 等 VLA,以及统一奖励模型 API(Robometer、TOPReward)。
推荐理由:官方发布说明完整列出世界模型策略、奖励模型、评测基准与部署工具的具体变化,读者可据此评估是否升级和如何用于自己的机器人训练流程。
Hugging Face 发布 🤗 Kernels 项目重大更新,几乎重新设计了整个项目。Hub 新增 kernel 仓库类型;安全方面引入可信发布者机制(默认仅加载可信发布者的 kernel。
Hugging Face 与 Cerebras 发布一个模块化、开源的实时语音对话(speech-to-speech)流水线,用 Cerebras 的高速推理解决语言模型响应延迟瓶颈。
推荐理由:原文给出了完整开放的级联语音对话架构和各层组件,开发者可以照此搭建或替换自己的实时语音 AI 流水线。
Google Research 发布覆盖 50 多个全球城市的建筑级屋顶反照率数据集,并通过新的高分辨率 Heat Resilience Earth Engine App 开放访问。
Google DeepMind 发布 Nano Banana 2 Lite(gemini-3.1-flash-lite-image),4 秒生成 1K 图像、每张 $0.034,上线 Google AI Studio、Gemini API 等平台。
推荐理由:官方给出两款新模型的价格、延迟和限制等具体参数,开发者可以据此评估替换现有模型的成本收益。
Google 通过为冻结权重的 Gemini Nano v3 模型附加轻量 MTP head,实现端侧推理提速,已部署到 Pixel 9 和 10 系列。该 zero-copy 架构直接复用主模型的 KV cache,每个实例节省 130MB 内存,且因错误草稿会在验证中被丢弃,输出与主模型逐位一致。
Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前该能力仅以独立的 Gemini 2.5 computer use 模型提供。
推荐理由:官方说明 computer use 从独立模型并入 Gemini 3.5 Flash 主模型的定位变化,并给出配套安全机制与使用入口,读者可据此评估迁移时机。
Mistral AI 推出 Connectors 多项新能力:管理员控制(GA)可按 workspace/org 设置连接器访问并开关单个工具,API key 支持连接器 scope,多账号连接器(GA)允许一个连接器绑定多个账号。
Google Research 在 Farmscapes 2020 栅格地图基础上,发布英国树篱、石墙和小林地的矢量化数据集,用于自然修复与碳核算。
段已按要求撰写
推荐理由:原文给出 70 多种语言的近实时语音翻译能力、流式生成机制和各产品线的开放入口,读者可以据此判断它对会议和翻译场景的实际影响。
Google 推出 Gemini Enterprise Agent Platform 托管的 Cross-Corpus Retrieval,基于 agentic RAG 通过规划、改写和多智能体协作处理跨数据源的多跳查询,事实类数据集准确率较标准 RAG 最高提升 34%。
Google Research 在 GitHub 上以 Apache 2.0 许可证开源其水文建模框架,让各国气象水文部门能将 AI 洪水预报接入自身工作流。
Google 在 I/O 2026 上宣布推出 Gemini for Science,一套整合其基础研究成果的实验性科学工具套件。
Mistral 在 AI Now Summit 2026 发布面向工业工程的 AI 栈,并与 Airbus、BMW、ASML 合作优化设计、仿真与生产。其统一智能体 Vibe 可处理长周期多步任务,覆盖深度研究、日常流程编排和从需求到合并的编码工作。Les Ulis 10 MW 数据中心将专注推理,计划 2026 年 Q3 开放,以加强对算力的直接控制。
Mistral 发布统一 AI 智能体 Vibe,将 Le Chat 整合为一套智能体和许可证,工作与编码场景共用。
推荐理由:Mistral 官方把 Le Chat 升级为统一智能体 Vibe,原文给出 Work 与 Code 两种模式的具体能力和定价,可据此评估对现有工作流的影响。
Mistral AI 发布 Search Toolkit 公开预览版,一个用于构建 AI 应用生产级搜索管线的可组合开源框架。
Google Research 推出面向隐私分析服务的高效密码学聚合新方案,遵循零信任原则,结合新型密码学协议与 TEE 硬件防护。该协议支持设备以单条一次性消息安全提交数据,无需多轮交互保持在线;密码学层可证明保证 Google 只能获得匿名化聚合结果,TEE attestation 则向所有参与者提供协议按公开代码正确执行的可验证证明。
Mistral 发布 Studio 中的 Connectors(Public Preview),内置连接器与自定义 MCP 均可通过 API/SDK 用于所有模型和 Agent 调用。
Google DeepMind 在亚太地区启动首期 Accelerator 加速器计划,主题为"AI for the Planet",帮助初创团队、研究团队和非营利组织用前沿 AI 解决自然、气候、农业和能源等领域的问题。
Google DeepMind 发布博文,介绍生物学家 Omar Abudayyeh 和 Jonathan Gootenberg 的实验室用 Co-Scientist 加速逆转细胞衰老的基因研究。Co-Scientist 扫描数万篇论文后提出超过 20 个候选基因因子,其中部分在实验中成功推动细胞进入更年轻状态;筛选数据分析从原本最长六个月缩短到几天。
Google DeepMind 在 Project Genie 中上线 Street View grounding 能力,用户可在美国地点的 Maps 图钉基础上生成风格化交互世界,如“Ocean World”或“B&W film”风格。该能力由 Maps Imagery Grounding 驱动,并逐步向全球 18 岁以上的 Google AI Ultra $200 订阅用户开放。
Google DeepMind 推出 Gemini for Science,包含 Google Labs 上三个实验工具:基于 Co-Scientist 的 Hypothesis Generation。
Google DeepMind 宣布扩展内容透明度与验证工具,覆盖 Search、Gemini、Chrome、Pixel 和 Cloud。
推荐理由:官方公布了 SynthID 验证与 C2PA 内容凭证在 Gemini、Search、Chrome 等产品中的扩展计划,读者可据此了解内容溯源工具的实际落地范围。
剑桥大学 Clare Bryant 教授使用 Google DeepMind 的 Co-Scientist 研究病原体跨物种传播引发脓毒症等重症的分子开关。该工具根据其流感研究提案生成并排序假设,逐步将候选蛋白细化到具体氨基酸。原本需两到三年的实验验证工作有望在六个月内完成。
Google DeepMind 的 Co-Scientist 正被 Calico Life Sciences 用于连接衰老生物学领域的零散研究发现并生成可检验假说。Calico 团队利用它提出了整合应激反应(ISR)如何受代谢调控的新颖假说,并与之交互完善实验设计。相关实验取得了对 ISR 在健康与疾病中作用具有重要意义的新发现,团队计划发表结果。
爱丁堡大学Filippo Menolascina团队使用Co-Scientist研究代谢功能障碍相关脂肪性肝炎(MASH),筛选潜在联合用药方案。系统针对药物resmetirom仅对部分患者有效的问题,提出NLRP3炎症小体是连接炎症与代谢的分子桥梁,该假说已获实验验证,有望推动双重靶向疗法。