跳到正文

#编码

今日 51 条
2月6日周五
  1. 美团 LongCat:HuggingFace 新模型55

    美团开源 LongCat-Flash-Lite:68.5B 参数 MoE 模型,主打 N-gram 嵌入与推理效率

    美团发布 LongCat-Flash-Lite,非思考型 68.5B 参数 MoE 模型,激活参数约 3B,支持 256k 上下文,权重以 MIT 协议开源在 HuggingFace。模型集成 N-gram 嵌入表提升性能与推理速度,官方评测显示其 SWE-Bench 达 54.40,agentic 与编码能力在同规模模型中具竞争力,并给出 transformers 与 SGLang 部署方案。

2月2日周一
  1. OpenAI Developers(RSS)65

    OpenAI 发布 Codex app,支持多智能体并行协作

    OpenAI 发布 Codex app,定位为基于智能体构建软件的指挥中心。它支持并行运行多个智能体并用 worktrees 隔离各自改动,可将工具和约定打包成可复用的 skills,还支持通过后台定时工作流把重复性工作交给 Codex。目前提供 macOS 下载(https://openai.com/codex),Windows 支持即将推出。

    推荐理由:视频给出了 Codex app 的并行多任务、skills 打包和后台自动化等能力与 macOS 下载入口,读者可据此评估其对现有开发流程的影响。

1月29日周四
1月28日周三
  1. Ethan Mollick:One Useful Thing(RSS)65

    Ethan Mollick:管理能力是 AI 时代的超能力

    Ethan Mollick 在宾夕法尼亚大学实验课上让几乎没有编程经验的 EMBA 学生用 Claude Code、Google Antigravity 及 ChatGPT、Claude、Gemini 四天内从零做出创业原型,成果远超以往一学期的学生水平。

    推荐理由:作者基于四天创业课实测提出委托公式和管理技能框架,读者可以据此判断哪些任务适合交给 AI。

  2. Mistral AI:News(网页)62

    Mistral 发布终端原生编码智能体 Mistral Vibe 2.0,搭载 Devstral 2

    Mistral AI 发布 Mistral Vibe 2.0,这是其终端原生编码智能体的重大升级,由 Devstral 2 模型系列驱动。新增自定义 subagents、多选项澄清、slash 命令技能、统一 agent 模式和自动更新;产品现已在 Le Chat Pro 和 Team 套餐开放,支持按量付费或自带 API key。

    推荐理由:官方宣布 Mistral Vibe 2.0 上线,列出 subagents、slash 命令技能等新能力和 Le Chat Pro/Team 套餐与 Devstral 2 定价,读者可据此评估工作流适配。

1月27日周二
1月22日周四
1月8日周四
  1. Ethan Mollick:One Useful Thing(RSS)67

    Ethan Mollick 实测 Claude Code 并详解其智能体机制

    Ethan Mollick 让 Claude Code(由 Opus 4.5 驱动)独立开发一个创业项目,AI 通过三个选择题确认需求后自主工作 1 小时 14 分钟,生成数百个代码文件并部署了一个可运行、可收款的销售网站。

    推荐理由:作者以亲历实验拆解 Claude Code 的上下文压缩、Skills 和 subagents 机制,非程序员也能据此理解并上手这类新工具。

12月31日周三
12月18日周四
12月16日周二
12月9日周二
  1. Mistral AI:News(网页)72

    Mistral AI 发布 Devstral 2(123B)与 Devstral Small 2(24B)编码模型及 Mistral Vibe CLI

    Mistral AI 发布开源编码模型 Devstral 2(123B,修改版 MIT 许可)和 Devstral Small 2(24B,Apache 2.0),并推出开源命令行编码助手 Mistral Vibe CLI。

    推荐理由:官方公布了两档开源编码模型的参数规模、SWE-bench Verified 成绩和定价,并说明各自部署门槛,可据此评估实际选用成本。

12月2日周二
11月19日周三
  1. Ethan Mollick:One Useful Thing(RSS)79

    Ethan Mollick 实测 Gemini 3:从 GPT-3 到智能体时代的三年之变

    Ethan Mollick 实测 Google 新发布的 Gemini 3,让模型用三年前的 GPT-3 帖子演示 AI 进步,结果它直接构建了一个可玩的“糖果驱动 FTL 飞船模拟器”小游戏。

    推荐理由:作者用三年前的旧帖和新任务做对照,展示了 Gemini 3 在编程智能体和独立研究上的实际表现与局限。

11月4日周二
  1. OpenAI Developers(RSS)63

    OpenAI 演示如何用 Codex 自动审查 GitHub 拉取请求与 Codex CLI 代码

    OpenAI 的 Maja Trębacz 和 Romain Huet 演示如何设置 Codex 自动审查 GitHub 上的新拉取请求以及在 Codex CLI 中进行代码审查,并讨论了训练模型生成高质量代码审查的研究方法。视频还涵盖 Codex 代码审查与静态分析的区别、用 AGENTS.md 自定义审查,入口为 chatgpt.com/codex/code-review。

10月27日周一
10月22日周三
  1. OpenAI Developers(RSS)67

    OpenAI 演示在代码编辑器中使用 Codex

    OpenAI 展示如何将 Codex 与主流代码编辑器搭配使用,简化编辑器内的工作流,内容涉及 codex 与 IDE 扩展。

    推荐理由:官方演示了 Codex 与主流代码编辑器的搭配方式,可帮助开发者了解如何把工作流收进编辑器内完成。

10月20日周一
10月13日周一
  1. Answer.AI 官方研发博客(RSS)50

    如何用 SolveIt 把 Karpathy 的 tokenizers 视频做成书稿章节

    Answer.AI 的 Jeremy Howard 用 SolveIt 把 Andrej Karpathy 两小时 tokenizers 视频教程改写成带可运行代码、超链接和图片的书稿章节。他采用两阶段"双对话"流程:先把带时间戳的转录稿拆成小段逐条补充超链接、代码示例等素材,再用充实后的转录稿分节撰写正文,避免一次性让 AI 转换导致内容平淡、遗漏概念和幻觉。

10月11日周六
10月2日周四
10月1日周三
  1. Answer.AI 官方研发博客(RSS)65

    Answer.AI 开源 cachy:缓存 LLM 响应让 notebook 测试提速 60 倍

    Answer.AI 开源 cachy 包,通过修改 httpx 的 send 方法把 LLM 响应缓存到本地文件,无需手写 mock。测试运行从 2 分钟缩短到约 2 秒,并让 CI/CD 测试和 notebook diff 更干净。

    推荐理由:开源工具 cachy 通过拦截 httpx 缓存 LLM 响应,测试从 2 分钟降到约 2 秒,方法可直接迁移到自己的项目。

9月25日周四
  1. Johann Rehberger / Embrace The Red(RSS)74

    Johann Rehberger 演示跨智能体提权:被攻陷的 GitHub Copilot 可改写配置释放 Claude Code

    安全研究员 Johann Rehberger 提出跨智能体提权的新型攻击模式:间接提示词注入可劫持 GitHub Copilot,令其写入 Claude Code 的 MCP 配置(如 ~/.mcp.)或指令文件(如 CLAUDE.md),使 Claude Code 执行任意代码,两个智能体还可互相改写配置形成提权循环。

8月30日周六
8月29日周五
8月27日周三
8月24日周日
8月23日周六
8月21日周四
8月20日周三
  1. Johann Rehberger / Embrace The Red(RSS)79

    Amazon Q Developer VS Code 扩展存在提示词注入导致远程代码执行漏洞

    安全研究者 Johann Rehberger 披露 Amazon Q Developer VS Code 扩展(下载量超 100 万)存在间接提示词注入漏洞:executeBash 将 find 归类为 readonly 并跳过人工确认。

    推荐理由:作者亲测复现了 Amazon Q Developer 的间接提示词注入到任意命令执行路径,读者可借此理解 Agent 权限模型的风险。

8月19日周二
  1. Johann Rehberger / Embrace The Red(RSS)77

    Amazon Q Developer 提示词注入可经 DNS 请求泄露开发者密钥

    安全研究人员 Johann Rehberger 披露 Amazon Q Developer VS Code 扩展(下载量超 100 万)存在高危漏洞:处理不可信数据时可被提示词注入劫持,通过 ping 等 readOnly 命令将开发者 .env 文件内容经 DNS 请求外泄。

    推荐理由:作者第一手复现了 Amazon Q Developer 通过 DNS 请求泄露 .env 密钥的提示词注入漏洞,并披露 AWS 已静默修复但未发公告或 CVE。