跳到正文

#Hugging Face

今日 0 条
9月29日周二
9月28日周一
9月24日周四
  1. Hugging Face Blog60

    Liquid AI 发布 LFM2.5-VL-3B-DSpark 草稿模型,视觉语言模型解码提速最高 3.13x

    Liquid AI 为视觉语言模型 LFM2.5-VL-3B 发布实验性 DSpark 草稿模型,通过投机解码在不改变输出质量的前提下加速推理。解码最高提速 3.13x(M5 Max 端侧)和 2.66x(H100),端到端最高提升 2.62x 和 2.27x;草稿模型增加 280M 参数(约 8.9%),首日支持 llama.cpp、MLX-VLM 和 SGLang。

    推荐理由:原文给出视觉语言模型投机解码加速的具体数字、内存开销和第一天框架支持,读者可以据此评估端侧与 GPU 部署收益。

9月22日周二
9月16日周三
9月10日周四
  1. Hugging Face Blog60

    Hugging Face 用 Storage Bucket 和代理实现跨 Jobs 的 Async GRPO LoRA 训练,无需 NCCL

    Hugging Face 在 TRL v1.14 的 AsyncGRPOTrainer 中加入 LoRA 支持(PR #7017),训练器与 vLLM 副本作为独立 HF Jobs 运行,仅几 MB 的 adapter 经 Storage Bucket 挂载同步,无需 NCCL。

    推荐理由:原文给出完整的跨节点 LoRA 异步 RL 架构与五轮瓶颈调优数据,读者可以复用其中按 KV 前缀路由和 token 打包的调优方法。

9月3日周四
  1. Hugging Face Blog63

    Hugging Face 用 TRL GRPO 100 步微调 LFM2.5-350M 提升结构化输出,IFStruct 从 22.6% 升至 29.7%

    Hugging Face 发布完整教程,用 TRL 库的 GRPO 结合 LoRA 微调 LiquidAI/LFM2.5-350M,仅需约 500 样本和 100 步训练即可在免费级 Colab 或 Kaggle 16 GB GPU 上完成。

    推荐理由:完整开源了小模型 GRPO 结构化输出微调的配方和评测对比,资源门槛低,方法可直接迁移到其他小模型任务。

  2. Hugging Face Blog62

    用 TRL 和 OpenEnv 复现让编码模型画水彩画的完整开源流程

    Hugging Face 博客发布一篇开源复现:受 Surya Narreddi 病毒视频启发,作者用 TRL 和 OpenEnv 训练 Qwen/Qwen3.5-35B-A3B 通过 LoRA 写 p5.brush JavaScript 画水彩画,参考池、RL 环境、训练脚本和模型全部公开。

    推荐理由:作者把审美偏好的RL复现完整开源,奖励设计、三组对照和踩坑修复都可迁移到类似的代码生成训练中。

9月1日周二
  1. Hugging Face Blog62

    Hugging Face 发布 @huggingface/kernels 与 207 个 WebGPU 内核

    Hugging Face WebAI 团队发布 @huggingface/kernels 库及 207 个 WebGPU 内核,每个内核以带版本、正确性与基准测试的独立仓库形式发布在 Hub 上,采用 Apache-2.0 许可。

    推荐理由:官方发布 207 个 WebGPU 内核及加载库,并给出与 ORT WebGPU 的实测对比,读者可据此评估浏览器推理的加速空间。

8月28日周五
8月26日周三
  1. Hugging Face Blog71

    Sentence Transformers v6.0 教程:训练与微调多向量嵌入模型

    Sentence Transformers v6.0 引入 MultiVectorEncoder 模型类型并配套完整训练流程,作者以医学检索为例演示如何微调 ColBERT 式多向量模型。

    推荐理由:原文给出完整可复现的多向量模型微调配方,并用实验数据对比起点选择、训练开销和索引压缩,方法可直接迁移到自己的领域数据。

8月25日周二
8月21日周五
  1. Hugging Face Blog61

    Hugging Face 研究量化语音识别模型的基准优化行为

    Hugging Face 发布研究,提出三种测试量化 ASR 模型的基准优化(benchmaxxing)现象。评估 11 个开源模型发现,部分高分模型会复现 VoxPopuli 与 LibriSpeech 的错误参考文本、在音频中数字被静音时仍以约 30-40% 的比例输出该数字,并通过声学线索切换拼写以匹配基准期望;在模型训练截止后新采集的同源音频上,这些行为明显减弱。

    推荐理由:研究用三种探针量化了语音识别中的基准优化行为,为选型者提供了超越公开基准 WER 的评估思路。

8月18日周二
8月14日周五
  1. Hugging Face Blog71

    Hugging Face 发布 2026 夏季开源模型生态观察报告

    Hugging Face 发布 2026 年 1 至 8 月开源模型生态观察报告:Hub 公开模型仓库从 243 万增至 296 万,中国实验室在多数月份发布的最大开源模型超过美国,Qwen 衍生模型达 151,448 个成为社区主要基座。

    推荐理由:Hugging Face 用七个月的 Hub 数据量化开源模型生态的变化,读者可以据此核对中美发布策略、下载与关注度的错位以及 Agent 流量的真实构成。

8月13日周四
  1. Hugging Face Blog76

    Hugging Face 复盘 ICML 2026 论文复现挑战赛:1,221 人复现 2,226 篇论文

    Hugging Face 复盘今年 7 月 15 日至 8 月 2 日举办的 ICML 2026 Open Reproductions 挑战赛:1,221 名社区成员用 Claude Code、Codex、Cursor 等智能体,19 天发布 6,816 份 Trackio 日志,尝试复现 2,226 篇论文,约占会议论文的 34%。

    推荐理由:文中给出按声明逐条复核会议论文的结果分布和典型的证伪案例,读者可以借此理解智能体复现研究中人类角色的边界。

8月11日周二
  1. Hugging Face Blog60

    NVIDIA 发布 Magpie TTS Multilingual 开放权重模型,支持 12 种语言并降低语音生成延迟

    NVIDIA 发布 Magpie TTS Multilingual 开放权重模型,参数量 364M,新增现代标准阿拉伯语、韩语和巴西葡萄牙语,共支持 12 种语言,并提供生产级 NIM 部署容器。

    推荐理由:原文给出TTFA延迟数据和架构改进细节,读者可据此评估自部署级联语音方案相对一体化语音模型的取舍。

8月10日周一
8月6日周四
7月27日周一
  1. Hugging Face Blog85

    Hugging Face 技术复盘 2026 年 7 月智能体入侵事件:约 17600 个攻击动作的完整时间线

    Hugging Face 发布入侵事件技术复盘,还原一个由 OpenAI 模型驱动的自主智能体在约 4.5 天内对其生产基础设施发起的端到端入侵。

    推荐理由:当事方逐日复盘一次智能体入侵的完整攻击链与防御整改,读者可以借此理解机器速度攻击带来的防守不对称问题。

7月23日周四
  1. Hugging Face Blog68

    Hugging Face 将 Nunchaku 4-bit 扩散推理原生集成进 Diffusers

    Hugging Face 在 Diffusers 中新增 Nunchaku Lite 集成路径,可像普通 Diffusers 模型一样用 from_pretrained() 加载 Nunchaku SVDQuant 4-bit(W4A4)检查点,无需单独推理引擎或本地 CUDA 编译。

    推荐理由:官方宣布 Diffusers 原生支持 Nunchaku 4-bit 推理,附实测数据和自己量化新架构的完整工作流。

7月21日周二
7月16日周四
  1. Hugging Face Blog30

    DharmaOCR 如何以领域专精持续领先新发布的 Mistral OCR4 与 Unlimited-OCR

    DharmaOCR 在巴西葡萄牙语 OCR 基准上以 0.925 的得分领先新模型 Mistral OCR4(0.798)和 Unlimited-OCR(0.7587),证明领域专精的优势依然成立。该模型先通过葡萄牙语文档监督微调对齐词汇与文档结构,再用 DPO 从偏好数据中学习以降低输出退化率和推理成本。专项化训练使全部参数集中于单一语言,这一结构性取舍构成了对多语言模型的可量化优势。

  2. Hugging Face Blog85

    Hugging Face 披露由自主 AI 智能体驱动的入侵事件及应对

    Hugging Face 披露本周检测并处置了一起由自主 AI 智能体系统端到端驱动的入侵,攻击者通过恶意数据集利用两条代码执行路径获得处理节点访问权限,窃取了部分内部数据集和多项服务凭证。

    推荐理由:披露一起由自主智能体发起的入侵及 AI 取证应对细节,读者可以了解防御侧如何在护栏限制下自建可用模型能力。

7月15日周三
  1. Hugging Face Blog81

    Thinking Machines 发布开源多模态大模型 Inkling 及 Inkling-Small

    Thinking Machines 在 Hugging Face 发布开源多模态模型 Inkling,总计 975B 参数、激活 41B 的 MoE 架构,原生接受图像、文本和音频输入,支持 1M 上下文,训练数据为 45 万亿 token。

    推荐理由:原文给出 Inkling 与 Inkling-Small 的架构细节、部署配置和多份基准数字,可帮助读者评估其在多模态推理场景的可用性。

7月10日周五
7月8日周三
7月7日周二
  1. Hugging Face Blog64

    Hugging Face 与 SkyPilot 推出 store: hf,实现跨云零出口费挂载 Hub 存储

    Hugging Face 与 SkyPilot 联合推出 store: hf 后端,用 hf:// URL 将 Hugging Face Bucket 或任意 Hub 仓库挂载进 SkyPilot 任务,可在 20+ 云、Kubernetes 和 Slurm 上调度,读取数据零出口费。

    推荐理由:原文给出无出口费存储接入 SkyPilot 的具体用法、基准数字和成本对比,读者可据此评估跨云 GPU 训练的存储方案。