Google DeepMind 发布 Gemini 3.5 系列,首发 Gemini 3.5 Flash
Google DeepMind 发布 Gemini 3.5 模型系列,首发 Gemini 3.5 Flash,主打智能体与编码性能,3.5 Pro 将于下月推出。
推荐理由:官方发布给出了 3.5 Flash 在编码与智能体基准上的具体成绩、速度对比和开放渠道,读者可据此评估替换现有工作流模型的收益。
模型推理能力的进展:思维链、推理模型、数学与逻辑基准的突破与争议。
Google DeepMind 发布 Gemini 3.5 模型系列,首发 Gemini 3.5 Flash,主打智能体与编码性能,3.5 Pro 将于下月推出。
推荐理由:官方发布给出了 3.5 Flash 在编码与智能体基准上的具体成绩、速度对比和开放渠道,读者可据此评估替换现有工作流模型的收益。
Google DeepMind 发布 Gemma 4 开源模型,称其为迄今最智能的开放模型,采用 Apache 2.0 许可,提供 E2B、E4B、26B MoE 和 31B Dense 四种尺寸。
推荐理由:官方发布给出四个尺寸、榜单名次、上下文长度与部署路径等具体信息,读者可据此评估选型和端侧部署方案。
Mistral 发布 Mistral Small 4,是首个将 Magistral 推理、Pixtral 多模态和 Devstral 智能体编码能力统一到单一模型的小型旗舰,采用 Apache 2.0 许可开源。
推荐理由:原文给出架构参数、reasoning_effort 用法和与 GPT-OSS 120B 的输出效率对比,读者可据此评估部署成本与选型。
Mistral 发布新一代模型系列 Mistral 3,包含 Mistral Large 3(41B 激活、675B 总参数的 MoE)以及 3B、8B、14B 三档 Ministral 3 模型,全部以 Apache 2.0 许可开源。
推荐理由:官方一次放出 675B MoE 旗舰与三档小模型,全部 Apache 2.0 开源并给出部署路径,适合评估开源选型空间。
Mistral AI 发布首个推理模型 Magistral,分为 24B 参数开源的 Magistral Small 和企业版 Magistral Medium。
推荐理由:官方公布两个版本的关键评测分数和开源许可,读者可以据此对比其在推理模型中的定位与可用部署方式。