跳到正文

#产品更新

今日 17 条
9月22日周二
9月21日周一
9月20日周日
9月18日周五
9月17日周四
  1. OpenAI News32

    OpenAI 推出 Astra for Law

    OpenAI 推出 Astra for Law,为法律行业提供前沿智能支持。该产品包含定制化律所工作流、可连接的法律数据源,以及面向机密客户工作的法律级管控能力。

9月16日周三
  1. Mistral AI50

    Mistral 与 Mozilla 合作:为 Firefox 浏览器带来开放、隐私的多语言 AI

    Mistral 与 Mozilla 宣布合作,Firefox Smart Window(beta)AI 浏览助手现已由 Mistral 模型驱动,首批面向法国和北美用户,英国和德国预计年内跟进。对话默认不保存在 Mozilla 服务器上,Mistral 承诺零数据保留,并基于区域语言、方言和文化语境对模型进行微调,让用户获得理解本地化差异的 AI 体验。

9月14日周一
9月12日周六
9月10日周四
9月9日周三
9月8日周二
  1. Google DeepMind69

    Google DeepMind 发布 AlphaGenome Atlas,预测人类基因组 90 亿个单碱基变异影响

    Google DeepMind 于 9 月 8 日发布 AlphaGenome Atlas,包含人类基因组约 90 亿个单核苷酸变异的分子效应预测,数据集达 1 PB,是 AlphaFold Database 的 30 多倍。

    推荐理由:原文给出平台规模、AVI 评分构成和免费学术入口,读者可据此评估它在变异解读和罕见病研究中的用法。

9月5日周六
  1. GitHub Blog · AI & ML68

    GitHub 发布 Project HydraFusion 研究预览,用多模型运行时编排提供前沿级编码质量

    GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排为每个任务生成执行计划,在 Single、Cascade、Critique 三种模式间选择以平衡质量、成本和延迟。

    推荐理由:官方公布了 HydraFusion 的三种执行模式和三份基准的质量与成本数据,读者可以据此评估多模型编排对编码工作流的实际价值。

9月3日周四
9月2日周三
  1. Google DeepMind73

    Google DeepMind 为 Gemini 推出 agentic video understanding,token 消耗最高降 88%

    Google DeepMind 发布 agentic video understanding 功能,覆盖 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite,通过智能体循环动态搜索和检视视频片段,替代固定帧率的静态处理。

    推荐理由:官方公布了具体降本增效数字和 API 启用方式,开发者可据此评估长视频分析的成本与精度取舍。

9月1日周二
  1. Hugging Face Blog62

    Hugging Face 发布 @huggingface/kernels 与 207 个 WebGPU 内核

    Hugging Face WebAI 团队发布 @huggingface/kernels 库及 207 个 WebGPU 内核,每个内核以带版本、正确性与基准测试的独立仓库形式发布在 Hub 上,采用 Apache-2.0 许可。

    推荐理由:官方发布 207 个 WebGPU 内核及加载库,并给出与 ORT WebGPU 的实测对比,读者可据此评估浏览器推理的加速空间。

8月27日周四
8月25日周二
8月22日周六
8月21日周五
  1. Hugging Face Blog60

    Liquid AI 为 LFM2.5 系列发布 DSpark 草稿模型,推理最高提速 3.18x

    Liquid AI 为 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 三个模型发布 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下提升解码速度。

    推荐理由:原文给出三类模型的加速数字、质量不变的原理和 llama.cpp、SGLang 的接入命令,读者可据此评估端侧与 GPU 推理收益。

8月20日周四
  1. Mistral AI67

    Mistral 发布 Agentic Search,多步检索循环显著提升复杂文档问答精度

    Mistral 发布 Agentic Search 检索层,通过 search、open、navigate、read、grep 五个工具实现多步检索循环,让模型在长文档和多数据源中查找、验证信息。

    推荐理由:原文给出 FinanceBench 与 OfficeQA Pro 的具体精度、延迟和 token 数据,读者可据此评估检索方案是否迁移到自家场景。