Coding Agent 要完成大型软件任务,究竟还缺什么
Factory 的 ProgramBench 实验说明:Coding Agent 在大型任务中往往不是能力不够,而是过早认定完成;一套独立、可执行的完成标准,能显著提高最终行为完整度。
个人 AI 知识库
收录 Agent 教程、Vibe Coding 图解与值得留存的一手资料——写给正在用 AI 做东西的人。
搜点什么,比如「水合」「Endpoint」…⌘K43 篇内容75 个术语图解6 个栏目
浏览知识库
写给没有技术背景的读者:用直觉、动图和小实验讲清大模型的基本问题。
从入门到实战,系统掌握 Codex 的使用方法。
从终端第一步到 Skills 与 Extensions,理解并用好极简 Agent Harness。
从办公协作到自动化,系统掌握 WorkBuddy 的使用方法。
值得长期保存的一手资料与深度解读。
把 AI 编程的概念一块一块拆开:图解、比喻加可以上手玩的演示。
大公司写给 AI 编码工具看的 DESIGN.md,逐个品牌拆解色彩、字体与设计哲学。
持续整理与维护
Factory 的 ProgramBench 实验说明:Coding Agent 在大型任务中往往不是能力不够,而是过早认定完成;一套独立、可执行的完成标准,能显著提高最终行为完整度。
Andrew Ng 梳理 AI 工程师构建可靠应用所需的六组核心能力:LLM 基础、数据增强、Agent 系统、评测驱动开发、生产运维与机器学习基础。
以 TrueForge 网页研究 Agent 为例,完整拆解模型循环、MCP、Skills、沙箱、子 Agent、上下文压缩、审批门禁与持久事件流如何共同支撑长任务。
解释推理轨迹为何本质上是被路由到独立通道的文本、推理强度怎样写入系统提示词,以及模型如何在关闭原生推理时泄漏思考。
从广义相对论的另一条推导路径出发,讨论互联知识如何支持科学突破,以及它对 AI 安全与持续学习意味着什么。
Marek Minor 复盘一年时间里如何手工设计、校准、迁移并交付 Cursor 的 600 多枚图标,以及怎样把一致性变成可持续的设计基础设施。