跳到正文

全部动态

今日 4 条
今天9月30日周三
  1. AWS Machine Learning Blog47

    基于 Amazon Quick 和 Amazon Bedrock AgentCore 构建 AI 合同智能平台

    AWS 发布了一个合同智能平台参考架构,用 AI 智能体从合同 PDF 中提取 8 个关键字段并独立验证,解决 RAG 无法跨数百份合同做汇总查询的问题。提取由 Claude Sonnet 系列模型驱动,Claude Haiku 独立复核,签名分歧时由 Amazon Textract 做确定性裁定,结果存入 Amazon Aurora PostgreSQL。

  2. AWS Machine Learning Blog30

    Amazon Quick 提示词工程基础指南

    AWS 发文讲解 Amazon Quick 的提示词工程基础原则与结构化框架,帮助用户让平台的 AI 功能更准确地响应自然语言请求。文章提出通过具体化、提供业务上下文、用示例(few-shot)示范输出格式等核心原则,并介绍 CRISPE 等通用框架。本文为系列第一篇,聚焦跨组件通用方法,第二篇将深入 Research、Flows、Sight、Chat Agents 等具体组件的技巧。

9月29日周二
9月28日周一
9月27日周日
9月26日周六
9月25日周五
  1. GitHub Blog · AI & ML53

    GitHub Copilot 如何用 canvas 替代聊天界面

    GitHub Copilot 团队认为聊天不是与 AI 交互的正确界面,介绍了 GitHub Copilot app 中的 canvas 功能,它是可与应用内 agent 双向通信的全栈小程序。作者用 Connect 4 游戏、Winget 包管理、SQLite 操作和自动化开发工作流等示例说明,与其让 agent 处理每次交互浪费 token,不如让它构建一个后续交互免费的自定义工具。

  2. GitHub Blog · AI & ML64

    GitHub Security Lab 发布 Fuzzing Taskflow,用 LLM Agent 自动化 C/C++ 项目模糊测试

    GitHub Security Lab 的 Antonio Morales 发布 Fuzzing Taskflow,一个基于 Taskflow Agent 的自主模糊测试流水线,只需提供 GitHub 仓库即可自动识别入口点、编写 harness、运行 AFL++、改进覆盖并分诊崩溃。

    推荐理由:原文详述了用 LLM Agent 自动写 harness、跑 AFL、追覆盖缺口和分诊崩溃的完整流水线设计,可直接复用。

9月24日周四
9月23日周三
  1. Latent Space61

    Latent Space 访谈 John Platt 谈 Google ERA 与 AI for Science

    Latent Space 发布对 John Platt 的长篇访谈,介绍 Google 的 Empirical Research Assistance(ERA),用 Gemini 维护实验笔记本树并以类蒙特卡洛树搜索方式迭代变异,已产出至少十篇论文。访谈还讨论了用 AI 减少飞机凝聚尾迹(约占人为变暖 1%)、FireSat 卫星火灾监测,以及如何避免对评分函数的 Goodhart 式过拟合。

9月21日周一
9月11日周五
9月10日周四
  1. Hugging Face Blog60

    Hugging Face 用 Storage Bucket 和代理实现跨 Jobs 的 Async GRPO LoRA 训练,无需 NCCL

    Hugging Face 在 TRL v1.14 的 AsyncGRPOTrainer 中加入 LoRA 支持(PR #7017),训练器与 vLLM 副本作为独立 HF Jobs 运行,仅几 MB 的 adapter 经 Storage Bucket 挂载同步,无需 NCCL。

    推荐理由:原文给出完整的跨节点 LoRA 异步 RL 架构与五轮瓶颈调优数据,读者可以复用其中按 KV 前缀路由和 token 打包的调优方法。

9月4日周五
9月3日周四
  1. Hugging Face Blog63

    Hugging Face 用 TRL GRPO 100 步微调 LFM2.5-350M 提升结构化输出,IFStruct 从 22.6% 升至 29.7%

    Hugging Face 发布完整教程,用 TRL 库的 GRPO 结合 LoRA 微调 LiquidAI/LFM2.5-350M,仅需约 500 样本和 100 步训练即可在免费级 Colab 或 Kaggle 16 GB GPU 上完成。

    推荐理由:完整开源了小模型 GRPO 结构化输出微调的配方和评测对比,资源门槛低,方法可直接迁移到其他小模型任务。

  2. Hugging Face Blog62

    用 TRL 和 OpenEnv 复现让编码模型画水彩画的完整开源流程

    Hugging Face 博客发布一篇开源复现:受 Surya Narreddi 病毒视频启发,作者用 TRL 和 OpenEnv 训练 Qwen/Qwen3.5-35B-A3B 通过 LoRA 写 p5.brush JavaScript 画水彩画,参考池、RL 环境、训练脚本和模型全部公开。

    推荐理由:作者把审美偏好的RL复现完整开源,奖励设计、三组对照和踩坑修复都可迁移到类似的代码生成训练中。

8月26日周三
  1. Hugging Face Blog71

    Sentence Transformers v6.0 教程:训练与微调多向量嵌入模型

    Sentence Transformers v6.0 引入 MultiVectorEncoder 模型类型并配套完整训练流程,作者以医学检索为例演示如何微调 ColBERT 式多向量模型。

    推荐理由:原文给出完整可复现的多向量模型微调配方,并用实验数据对比起点选择、训练开销和索引压缩,方法可直接迁移到自己的领域数据。

8月21日周五
8月19日周三
8月18日周二
  1. Hugging Face Blog52

    Dharma AI 发布约束感知 GPU 调度器:同集群利用率最高提升 33 个百分点

    Dharma AI 在 Hugging Face Blog 发布约束感知 GPU 分配器,与 FIFO 调度器在 7 个基准场景对比,GPU 利用率最高提升 33 个百分点,优先级加权产出平均提升 52%。该调度器将实时推理视为需求曲线而非峰值预留,批任务按优先级在 24 小时视野内规划,每次决策仅 1 至 15 毫秒,每个时间步只提交当前分配并每 30 至 60 分钟重跑以吸收预测误差。

8月14日周五
8月13日周四
  1. Hugging Face Blog76

    Hugging Face 复盘 ICML 2026 论文复现挑战赛:1,221 人复现 2,226 篇论文

    Hugging Face 复盘今年 7 月 15 日至 8 月 2 日举办的 ICML 2026 Open Reproductions 挑战赛:1,221 名社区成员用 Claude Code、Codex、Cursor 等智能体,19 天发布 6,816 份 Trackio 日志,尝试复现 2,226 篇论文,约占会议论文的 34%。

    推荐理由:文中给出按声明逐条复核会议论文的结果分布和典型的证伪案例,读者可以借此理解智能体复现研究中人类角色的边界。

7月16日周四
7月10日周五