跳到正文

AI

6篇文章

2026. 09. 22 · 阅读约41分钟

决策模型,Jev 与 Kev

有个模型不返回文本,只返回概率。confidence 不是学出来的值而是算术,校准也不是模型的性质而是分布的性质。本文用公开的 Jev 实测 5,743 条,以及把复现实现 Kev 直接跑在本博客音译闸门上的结果来验证。

2026. 06. 22 · 阅读约23分钟

Harness(系统)工程

从 prompt engineering 到 context engineering,下一步将走向哪里?本文以 Anthropic 工程博客近期呈现的脉络为线索,梳理 harness 设计、eval、containment(隔离)三个方向及其与 token 节省讨论的联系。

2026. 06. 11 · 阅读约45分钟

AI Token 节省方法

AI 编程工具的 Token 成本从哪里产生,又该如何降低。文章结合 Anthropic 价格表,用 React POC 实测 prompt caching、subagent、精简 MCP、context engineering 与 Cursor Composer 等已验证的节省策略。

2026. 06. 10 · 阅读约23分钟

Token 的工作原理

AI Token 既不是单词也不是字符。本文系统讲解 BPE tokenizer 如何生成 Token、Token 如何变为 embedding 向量并进入模型、为何 decode 输出比 prefill 输入更贵,以及 KV cache 与 prompt caching 降低成本的原理。

2026. 05. 29 · 阅读约47分钟

AI 智能体工具

从四个角度梳理使用 Claude 进行前端开发时遇到的工具:CLAUDE.md、AGENTS.md 与 SKILL.md 的区别,MCP 的原理,Serena、CodeGraph 等代码智能工具的工作方式,以及如何阅读 GitHub Trending。

2026. 03. 02 · 阅读约36分钟

AI 前端工程师

在 AI 代替人编写代码的时代,前端工程师该如何成长并生存下去?本文基于 Karpathy 的 agentic engineering、Vercel v0、Stack Overflow Survey、METR 研究等可靠资料,梳理以验证、规格与判断力为核心的新能力和学习策略。