跳到正文

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

26条精选相关主题Agent 智能体Cursor教程实践

最新精选

第 1–20 条 · 共 26 条
今天9月30日周三
  1. AWS Machine Learning Blog62

    GPT-6.1 Sol 正式登陆 Amazon Bedrock

    OpenAI 的 GPT-6.1 Sol 在 Amazon Bedrock 正式可用,是 GPT-6 Sol 的重大升级。

    推荐理由:官方发布说明了模型在代理编码等任务上的成本与性能对比,以及 Bedrock 上的安全与数据保留配置,便于评估落地。

  2. The Decoder76

    OpenAI 发布 GPT-6.1 Sol,以五分之一成本接近 Astra

    OpenAI 发布 GPT-6.1 Sol,称其在 agentic 编码、计算机使用和办公任务上接近 GPT-6.1 Astra,成本约为五分之一,API 定价为每百万输入 token $2、输出 $10、缓存输入 $0.10。

    推荐理由:原文汇总了 Sol 的定价、基准成绩与 Astra 因安全问题推迟的背景,读者可据此权衡性价比与安全取舍。

9月29日周二
  1. The Decoder76

    Anthropic 发布 Claude Sonnet 5.5,基准接近 Opus 5.5 且每任务成本最多低 30%

    Anthropic 发布 Claude 5.5 系列第二款模型 Claude Sonnet 5.5,输出速度提升超过 30%,因每任务使用更少 token,实际成本最多下降 30%,多项基准接近 Opus 5.5。

    推荐理由:汇总了 Sonnet 5.5 各基准分数、每任务成本变化和高风险网络安全防护细节,便于与 Opus 5.5 及 OpenAI 对位模型做成本比较。

9月25日周五
  1. GitHub Blog · AI & ML64

    GitHub Security Lab 发布 Fuzzing Taskflow,用 LLM Agent 自动化 C/C++ 项目模糊测试

    GitHub Security Lab 的 Antonio Morales 发布 Fuzzing Taskflow,一个基于 Taskflow Agent 的自主模糊测试流水线,只需提供 GitHub 仓库即可自动识别入口点、编写 harness、运行 AFL++、改进覆盖并分诊崩溃。

    推荐理由:原文详述了用 LLM Agent 自动写 harness、跑 AFL、追覆盖缺口和分诊崩溃的完整流水线设计,可直接复用。

9月23日周三
  1. Latent Space83

    Latent Space AINews:Claude Opus 5.5 发布成新默认模型,OpenAI 随即降价 40-50% 推出 GPT-6 Sol 和 Luna

    AINews 本期以 Claude Opus 5.5 发布为主题:该模型官方称多数任务达到 Fable 5.1 水平、比 Opus 5 便宜 40% 运行成本,成为 Claude Code 和 Claude 应用的新默认模型,Sonnet 5.5 与 Haiku 5.5 将在未来数周跟进。

    推荐理由:这期汇编梳理了 Claude Opus 5.5 与 GPT-6 Sol/Luna 同日发布的价格与评测分歧,包括高 token 用量抵消降价的成本拆解,便于读者对比两家宣传口径。

9月22日周二
9月17日周四
  1. GitHub Blog · AI & ML80

    GitHub 用 Copilot 将 Copilot 智能体运行时从 TypeScript 增量迁移至 Rust

    GitHub 用 AI 智能体将 Copilot 智能体运行时完整重写为超过 800,000 行生产 Rust,通过 128 个 pull request 增量合入 main 并逐步发布,于 2026 年 8 月 21 日达成 100% Rust。

    推荐理由:作者亲历复盘用 AI 智能体将 Copilot 运行时从 TypeScript 迁移到 80 万行 Rust 的过程,给出可迁移的增量迁移、提示词缓存与多会话协作方法。

9月5日周六
  1. GitHub Blog · AI & ML68

    GitHub 发布 Project HydraFusion 研究预览,用多模型运行时编排提供前沿级编码质量

    GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排为每个任务生成执行计划,在 Single、Cascade、Critique 三种模式间选择以平衡质量、成本和延迟。

    推荐理由:官方公布了 HydraFusion 的三种执行模式和三份基准的质量与成本数据,读者可以据此评估多模型编排对编码工作流的实际价值。

9月3日周四
  1. Hugging Face Blog62

    用 TRL 和 OpenEnv 复现让编码模型画水彩画的完整开源流程

    Hugging Face 博客发布一篇开源复现:受 Surya Narreddi 病毒视频启发,作者用 TRL 和 OpenEnv 训练 Qwen/Qwen3.5-35B-A3B 通过 LoRA 写 p5.brush JavaScript 画水彩画,参考池、RL 环境、训练脚本和模型全部公开。

    推荐理由:作者把审美偏好的RL复现完整开源,奖励设计、三组对照和踩坑修复都可迁移到类似的代码生成训练中。

8月14日周五
8月10日周一
5月28日周四
5月22日周五
  1. Mistral AI74

    Mistral 发布 Mistral Medium 3.5 并推出 Vibe 云端远程智能体和 Le Chat Work 模式

    Mistral 发布 128B 开源权重旗舰模型 Mistral Medium 3.5(256k 上下文窗口,SWE-Bench Verified 77.6%),在 Hugging Face 以修改版 MIT 许可发布,API 定价为每百万输入 token $1.5、输出 $7.5。

    推荐理由:官方披露了新模型的参数量、上下文窗口和基准成绩,以及云端异步编码智能体的具体工作方式。

5月16日周六
5月6日周三