跳到正文

全部动态

今日 11 条
5月22日周五
5月20日周三
5月19日周二
5月18日周一
  1. Google DeepMind81

    Google DeepMind 发布 Gemini Omni Flash 多模态视频生成模型

    Google DeepMind 发布 Gemini Omni 系列首个模型 Gemini Omni Flash,可结合图像、音频、视频和文本输入生成高质量视频,并支持通过自然语言多轮编辑。

    推荐理由:官方公告说明了 Gemini Omni Flash 的视频生成与对话式编辑能力、可用入口和订阅范围,读者可据此判断它如何改变创作流程。

5月17日周日
5月16日周六
  1. Google DeepMind40

    Google DeepMind Co-Scientist 开启衰老研究新路径

    Google DeepMind 的 Co-Scientist 正被 Calico Life Sciences 用于连接衰老生物学领域的零散研究发现并生成可检验假说。Calico 团队利用它提出了整合应激反应(ISR)如何受代谢调控的新颖假说,并与之交互完善实验设计。相关实验取得了对 ISR 在健康与疾病中作用具有重要意义的新发现,团队计划发表结果。

  2. Google DeepMind48

    Google DeepMind Co-Scientist 加速发现肝病机制

    爱丁堡大学Filippo Menolascina团队使用Co-Scientist研究代谢功能障碍相关脂肪性肝炎(MASH),筛选潜在联合用药方案。系统针对药物resmetirom仅对部分患者有效的问题,提出NLRP3炎症小体是连接炎症与代谢的分子桥梁,该假说已获实验验证,有望推动双重靶向疗法。

  3. Google DeepMind67

    Google DeepMind 复盘 WeatherNext 如何助 NHC 提前五天预测飓风 Melissa 登陆牙买加

    Google DeepMind 发布复盘,介绍其 AI 气象模型 WeatherNext 如何帮助美国国家飓风中心(NHC)预测 2025 年飓风 Melissa 的路径与强度。模型在距登陆五天前以 80% 置信度预测其将以五级强度登陆牙买加,三天前置信度接近 100%;NHC 年度验证报告显示它是 2025 年飓风季路径与强度表现最好的单一模型。

    推荐理由:Google 官方复盘 WeatherNext 在飓风 Melissa 预报中的作用,读者可以了解 AI 气象模型如何与传统预报协作。

5月12日周二
  1. Google DeepMind67

    Google DeepMind 发表 Co-Scientist 多智能体科研系统并开放 Hypothesis Generation 工具

    Google DeepMind 在 Nature 发表 Co-Scientist 研究,推出基于 Gemini 的多智能体 AI 系统,可迭代生成、辩论和进化科学假设,并通过 Hypothesis Generation 实验工具向个人研究者开放,未来几周开始推出,可在 labs.google/science 注册。

    推荐理由:原文给出系统架构、验证机制和多个实验室实测结果,读者可以据此评估多智能体假设生成的实际科研用法。

5月8日周五
5月6日周三
5月2日周六
4月30日周四
4月27日周一
4月23日周四
  1. Google Research62

    Google Photos Auto frame 上线 3D 视角重组功能

    Google 在 Google Photos 的 Auto frame 功能中推出新方法,可在拍摄后调整照片的相机视角。方法先用内部 3D 点图估计模型重建场景并近似焦距,再用生成式 latent diffusion 模型补全新视角下的空洞,并自动检测广角前置镜头的人脸透视畸变,自动为含有人物的合格照片生成重组后的第二候选版本。

    推荐理由:原文解释了用 3D 点图加生成补全改换拍摄视角的两阶段方法,读者可以理解它与普通裁剪编辑的本质差别。

4月22日周三
4月21日周二
  1. Google DeepMind18

    Google DeepMind 携手 Accenture、麦肯锡等五大咨询公司加速企业 AI 转型

    Google DeepMind 宣布与 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey 合作,帮助企业大规模采用前沿 AI。合作包括三大支柱:开发行业专属 AI 解决方案、让合作伙伴提前体验包括 Gemini 系列在内的前沿模型、以及安排 AI 领导层与客户 CEO 和董事会对接。重点覆盖金融、制造、零售和媒体娱乐等行业。

4月20日周一
4月16日周四
  1. Google DeepMind62

    Google DeepMind 发布 Gemini 3.1 Flash TTS 语音模型

    Google DeepMind 发布文本转语音模型 Gemini 3.1 Flash TTS,主打更强的可控性、表达力和音质,在 Artificial Analysis TTS 排行榜获得 Elo 1,211 分。

    推荐理由:官方宣布了音频标签等新控制方式和上线渠道,并给出 Artificial Analysis 的 Elo 分数,可据此评估其表达力与成本定位。

4月14日周二
4月13日周一
4月9日周四
4月3日周五
4月1日周三
3月31日周二
  1. Mistral AI67

    Mistral AI 发布 Spaces CLI,为人类与智能体提供统一开发工具

    Mistral AI 发布 Spaces CLI,用于脚手架搭建、开发环境启动和部署,最初为内部解决方案团队构建,后发现智能体也成为主要用户。文章总结核心设计原则:每个交互式输入都有等价 flag、用 context. 和 AGENTS.md 为智能体提供项目上下文、显式化状态替代 CWD 隐式依赖,并用插件注册表作为唯一数据源;一个智能体曾据此从单个提示词在 10 分钟内完成配置生成与部署。

    推荐理由:Mistral 以自家 CLI 实战总结出一套让人类与智能体共用的开发工具设计原则,可直接迁移到自己的工具链构建。

  2. Google Research54

    Google Research 发布白皮书评估量子计算机破解加密货币椭圆曲线加密所需资源

    Google Quantum AI 团队在白皮书中更新了破解 ECDLP-256 的量子资源估算,给出两种 Shor 算法电路,分别使用不到 1,200 逻辑比特和 9,000 万 Toffoli 门、不到 1,450 逻辑比特和 7,000 万 Toffoli 门,并估计在超导量子计算机上以不到 50 万物理比特数分钟内完成,所需物理比特较此前估算降低约 20 倍。