Pi > Claude Code 和 Codex?同一个模型,账单只有一半

Databricks 拿自家几百万行真实代码库跑了一遍主流大模型 × 命令行工具的两两组合:性价比最高的 7 个组合里 4 个是 Pi,全场最高分 90% 也是 Pi。同样的活,Pi 的账单往往只有 Claude Code 的一半。从数据可信度、Pi 为什么这么省、到你自己该用哪个,一篇讲透。

2026年7月25日 · David Zhang

一文看懂 Harness Engineering,帮你的 AI 提效 10 倍

裸模型在严肃工程任务上已经不够用了。真正拉开差距的,是围绕模型搭出来的 Harness:上下文管理、工具执行、任务编排、反馈机制和架构护栏。

2026年5月15日 · David Zhang

给 Coding Agent 造一个记忆仓库

每次会话结束,AI 的上下文清零——这不是 bug,是所有 coding agent 的根本缺陷。本文分享我如何用纯 Markdown 文件构建三层记忆架构,让 Claude Code 和 Codex 跨 session 记住决策和踩过的坑,哪些东西值得记、哪些是噪音,以及跨 agent 兼容时遇到的工程现实。

2026年4月7日 · David Zhang

保持更新