AI 编程笔记

为用 Agent 交付的人做的 AI 编程实测。

面向使用 Codex、Claude Code、Cursor 和其他 Agent 的开发者,分享工作流、编程 Agent 现场笔记和真实的大模型评测。

从这里开始

查看全部文章

最新现场笔记

最新文章

按问题浏览

主题

我关注什么

三条主线。

AI 编程

面向 Codex、Claude Code、Cursor 以及整个 AI 编程工具栈的可复用工作流。

编程 Agent

循环、上下文、MCP、技能,以及演示之后才会暴露的失效场景。

大模型评测

亲自动手的模型测试(Claude Opus 4.8/Opus 5/Fable 5、GPT-5.6 Sol、Kimi k3、GLM-5.3、Gemini 3.7 Flash、Grok 4.6/4.7 等):一个新大模型适合用在哪里、成本多少,以及在真实工作中会在哪里出问题。

关于 AI Kai

构建者对构建者。

我在真实项目里测试 AI 编程工具、编程 Agent 和新的大模型,然后分享那些经得起考验的部分,以及会白白浪费一个周末的失效场景。