跳到正文

全部动态

今日 11 条
7月2日周四
  1. Mistral AI65

    Mistral 发布 Leanstral 1.5:6B 激活参数的形式化证明模型

    Mistral 发布 Apache-2.0 开源的 Leanstral 1.5,总参数 119B、激活 6B,专攻 Lean 4 形式化证明。模型饱和 miniF2F,解出 PutnamBench 587/672 题,在 FATE-H 87%、FATE-X 34% 达到新 SOTA,成本约每题 $4。

    推荐理由:官方给出了完整训练流程、基准数字和开源获取方式,读者可以据此评估它在 Lean 4 形式化证明上的实际可用性。

7月1日周三
6月30日周二
6月27日周六
6月25日周四
  1. Google Research46

    Google 研究提出线性弹性缓存:用“滑雪租赁”问题优化云端缓存成本

    Google Research 在 CIDR 发表线性弹性缓存方法,把页面逐出建模为“滑雪租赁”问题,用轻量级机器学习动态调整缓存大小,以最小化缓存管理总拥有成本(TCO)。该方法已在 Spanner 生产服务器上集成数月,相比固定大小缓存,内存占用降低 15.5%,cache miss 仅增加 5.5%,TCO 约降 5%,实际 I/O 成本影响仅 0.5%。

  2. Google DeepMind71

    Gemini 3.5 Flash 内置 computer use 能力

    Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前该能力仅以独立的 Gemini 2.5 computer use 模型提供。

    推荐理由:官方说明 computer use 从独立模型并入 Gemini 3.5 Flash 主模型的定位变化,并给出配套安全机制与使用入口,读者可据此评估迁移时机。

6月24日周三
6月23日周二
6月17日周三
6月16日周二
6月13日周六
6月11日周四
  1. Google DeepMind74

    Google DeepMind 发布开源实验模型 DiffusionGemma,GPU 文本生成最快提速 4 倍

    Google DeepMind 发布开源实验模型 DiffusionGemma,采用 26B 总参数、3.8B 激活的 MoE 扩散架构,在专用 GPU 上文本生成最高提速 4 倍,单块 NVIDIA H100 超过 1000 tokens/s,RTX 5090 超过 700 tokens/s。

    推荐理由:官方给出扩散文本生成的速度数据、显存占用与质量取舍,适合评估本地交互场景的落地条件。

6月10日周三
6月9日周二
  1. Google DeepMind75

    Google DeepMind 发布 Gemma 4 12B:无编码器统一多模态模型

    Google DeepMind 发布 Gemma 4 12B,可在 16GB 内存或显存的笔记本本地运行,性能接近其 26B MoE 模型但内存占用不足一半。该模型采用无编码器统一架构,视觉与音频输入直接进入 LLM 主干,是首个支持原生音频输入的中等规模 Gemma 模型,以 Apache 2.0 许可发布,并同步推出官方 Skills 仓库。

    推荐理由:原文来自官方发布,给出架构细节、内存门槛和下载入口,可帮助读者评估在本地设备运行多模态模型的可行性。

  2. Google DeepMind29

    Google DeepMind Accelerator: Robotics 选拔 15 家欧洲机器人初创公司

    Google DeepMind 推出为期 3 个月的 Google DeepMind Accelerator: Robotics 加速器,从欧洲遴选 15 家早期机器人初创公司,本周在伦敦开营。入选公司将获得 DeepMind 与 Google 专家的技术指导、产品指引,以及 AI 技术栈和 Gemini robotics 模型的使用权限,覆盖物流、制造、医疗、气候和导航等具身 AI 领域。

6月8日周一
  1. Google DeepMind67

    Google DeepMind 发布塞拉利昂 Gemini Guided Learning 对照试验结果

    Google DeepMind 公布在塞拉利昂开展的预注册对照试验结果,使用 Guided Learning 的学生数学成绩较对照组提升 0.258 个标准差,约相当于 1.2 至 1.7 年的常规学习进度。

    推荐理由:原文给出预注册RCT的关键数据和开放式材料,读者可以了解AI辅助教学在真实课堂中的效果与局限。

6月5日周五
6月4日周四
5月29日周五
5月28日周四
  1. Mistral AI48

    Mistral 在 AI Now Summit 2026 发布工业工程 AI 栈、统一智能体 Vibe 与 Les Ulis 数据中心

    Mistral 在 AI Now Summit 2026 发布面向工业工程的 AI 栈,并与 Airbus、BMW、ASML 合作优化设计、仿真与生产。其统一智能体 Vibe 可处理长周期多步任务,覆盖深度研究、日常流程编排和从需求到合并的编码工作。Les Ulis 10 MW 数据中心将专注推理,计划 2026 年 Q3 开放,以加强对算力的直接控制。

  2. Google Research48

    Google Research 通过零信任聚合实现隐私分析

    Google Research 推出面向隐私分析服务的高效密码学聚合新方案,遵循零信任原则,结合新型密码学协议与 TEE 硬件防护。该协议支持设备以单条一次性消息安全提交数据,无需多轮交互保持在线;密码学层可证明保证 Google 只能获得匿名化聚合结果,TEE attestation 则向所有参与者提供协议按公开代码正确执行的可验证证明。

5月27日周三
  1. Mistral AI48

    Mistral 收购 Emmi AI,推出面向工程加速的 physics AI 基础能力

    Mistral 将 Emmi AI 收入麾下,为企业级 AI 原生工业工程构建 physics AI 基础能力。这类数据驱动模型可从几何与边界条件直接预测物理行为,单 GPU 上一次前向传播数秒内输出完整物理场,替代传统 CFD/FEM 求解需数小时至数周的流程。已合作 ASML、Airbus、Safran、Siemens Energy 等伙伴,应用于产品设计、工装工艺设计和实时数字孪生。

  2. Mistral AI38

    Mistral 收购 Emmi AI,加码物理 AI 研究

    Mistral 收购 Emmi AI,深耕面向航空航天、汽车、半导体和能源等工业领域的 Physics AI 基础研究。其已发表成果包括:约 30,000 个样本的跨音速 3D 机翼 CFD 数据集、单 GPU 处理 9M 表面与 140M 体网格的 AB-UPT、支持流化床反应器实时仿真的 NeuralDEM,以及面向核聚变等离子体湍流的 GyroSwin 5D 代理模型。

5月23日周六
5月22日周五
  1. Mistral AI74

    Mistral 发布 Mistral Medium 3.5 并推出 Vibe 云端远程智能体和 Le Chat Work 模式

    Mistral 发布 128B 开源权重旗舰模型 Mistral Medium 3.5(256k 上下文窗口,SWE-Bench Verified 77.6%),在 Hugging Face 以修改版 MIT 许可发布,API 定价为每百万输入 token $1.5、输出 $7.5。

    推荐理由:官方披露了新模型的参数量、上下文窗口和基准成绩,以及云端异步编码智能体的具体工作方式。