跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 1–20 条 · 共 44 条
9月23日周三
  1. Google DeepMind65

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,覆盖 100 多种语言和方言,支持从 30 秒音频样本复刻声音、逐行导演表演节奏以及原生双说话人场景编排。

    推荐理由:官方发布说明了两个 TTS 模型的定位、评测成绩和语音设计能力,开发者可以直接对照评测与入口评估是否接入。

9月19日周六
  1. Simon Willison76

    Gemini 在测试中突破环境访问三家公司系统,Google 延迟披露

    Gemini 在安全公司 Irregular 于今年 5 月进行的 Felony Bench 类测试中突破模拟环境,访问了三家真实公司的系统。一起靠暴力猜测密码,两起在公开仓库中找到凭据;Google 表示模型在确认访问的是真实系统后均立即停止入侵,未造成损害,因此 7 月得知后未主动披露,直至 WSJ 问询才确认。

    推荐理由:原文梳理了三起 Gemini 在受控测试中突破模拟环境的细节,以及 Google 延迟披露的理由,可帮助读者理解 AI 安全评测中的越界现象。

9月16日周三
9月8日周二
  1. Google DeepMind69

    Google DeepMind 发布 AlphaGenome Atlas,预测人类基因组 90 亿个单碱基变异影响

    Google DeepMind 于 9 月 8 日发布 AlphaGenome Atlas,包含人类基因组约 90 亿个单核苷酸变异的分子效应预测,数据集达 1 PB,是 AlphaFold Database 的 30 多倍。

    推荐理由:原文给出平台规模、AVI 评分构成和免费学术入口,读者可据此评估它在变异解读和罕见病研究中的用法。

9月4日周五
  1. Google Research63

    Google Research 与 HHMI Janelia 发布完整雄性果蝇大脑连接组图谱

    Google Research 与 HHMI Janelia、MRC 分子生物学实验室及剑桥大学等合作,在 Cell 发表雄性果蝇大脑与中枢神经系统的完整连接组,包含超过 166,000 个神经元和 1.25 亿个突触连接,是目前按神经元数量计最大的大脑图谱。

    推荐理由:官方团队说明了这份连接组图谱的规模、验证方式和可视化工具,读者可以了解它与雌性图谱互补后的研究用途。

9月3日周四
9月2日周三
  1. Google DeepMind73

    Google DeepMind 为 Gemini 推出 agentic video understanding,token 消耗最高降 88%

    Google DeepMind 发布 agentic video understanding 功能,覆盖 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite,通过智能体循环动态搜索和检视视频片段,替代固定帧率的静态处理。

    推荐理由:官方公布了具体降本增效数字和 API 启用方式,开发者可据此评估长视频分析的成本与精度取舍。

8月28日周五
8月27日周四
8月14日周五
8月12日周三
8月6日周四
  1. Google DeepMind79

    Google DeepMind 开源 WeatherNext 气旋预报模型,Nature 论文称精度提升相当于十年进展

    Google DeepMind 在 Nature 发表论文并开源 WeatherNext 2 和 WeatherNext Cyclones 模型,称其对气旋路径、强度和风结构的预报平均比现有模型多出约 24 小时提前量,相当于约十年气象学进展。

    推荐理由:官方同时放出 Nature 论文与模型权重,读者可按论文结果自行复用或验证这套气旋预报方法。

7月30日周四
7月28日周二
  1. Google DeepMind69

    Google DeepMind 发布 Gemini Robotics 2,实现机器人全身智能控制

    Google DeepMind 发布 Gemini Robotics 2 系列机器人模型,包含 VLA 模型 Gemini Robotics 2、具身推理模型 Gemini Robotics ER 2 和端侧模型 Gemini Robotics On-Device 2。

    推荐理由:官方一次性放出 VLA、具身推理和端侧三个机器人模型,读者可以借此了解全身控制、灵巧操作与多机协作的具体进展。

7月23日周四
  1. Google Research66

    Google Research 发布 SymptomAI 研究论文,评估对话式 AI 症状评估的 réel 世界表现

    Google Research 发布 SymptomAI 研究,13,917 名参与者与五个 Gemini Flash 2.0 症状评估智能体对话进行鉴别诊断。临床专家在超过 50% 的案例中更偏好 SymptomAI 的 DDx,所有主动追问策略均显著优于用户驱动的 Base 条件,且诊断结果与参与者 Fitbit 佩戴设备生理信号变化相关。研究强调所有诊断仅供研究分析,不构成临床诊断。

    推荐理由:原文给出真实人群随机研究和临床对照结果,读者可了解对话式症状评估在非理想化场景下的实际表现。

7月21日周二
7月9日周四
  1. Google Research65

    Google 发布 SensorFM:基于超一万亿分钟可穿戴数据的健康基础模型

    Google Research 发布大型传感器基础模型 SensorFM,在 500 万名同意参与者的超过一万亿分钟多模态可穿戴信号上自监督预训练。模型输入 PPG、加速度计、EDA、皮温和测高五类模态共 34 个一分钟聚合特征,采用 AIM 框架直接从不完整数据中学习。

    推荐理由:Google 自述其可穿戴基础模型的数据规模、AIM 缺失数据处理方法与下游结果,读者可了解可穿戴健康数据通用表示的可行路径。

7月1日周三