Articles · Lcc ResearchEditorial research archive
Editor's Lead

Harness Engineering for Self-Improvement(面向自我改进的 Harness Engineering)

Lilian Weng 对 Harness Engineering 的系统论述:将 Agent 从一次性工具升级为可自我改进的系统,涵盖 Skill/Tool/Hook 三层架构、上下文工程、记忆系统与评测体系

Start Here

第一次来,先从三条阅读主线进入

想看 Claude Code、Codex、Hermes 一类编程与执行型 agent,看 AI 编程智能体;想看 memory、runtime、多 agent 与 harness,看 AI Agent 系统;想看上下文与知识系统,看相关专题。

阅读方式

别从头刷完,按目标进入更高效

想抓近期判断

先看主推与精选,快速建立这站最近最值得读的几篇。

想系统补一个主题

直接进入专题页,按主题连续阅读会更顺。

想找具体文章

归档页按时间和分类组织,定位最快。

Latest Desk

最新发布

按时间倒序收拢最近更新,保留摘要和关键信息,方便快速扫完这一轮新增内容。

科普
2026-09-18·44 分钟阅读·模型系统与训练

A deep dive into Jev, TypeSafe's System One model

Flavio Copes 的 Jev 深度指南:系统讲解 TypeSafe 首个 System One 模型如何把文本转成 Choice、Score、Noul 与概率,覆盖 API、成本、延迟、适用边界、Agent 集成和真实工作流。

科普
2026-09-18·8 分钟阅读·模型系统与训练

Jev 不是另一个聊天机器人:它想把 AI 变成代码里的“智能 if”

一篇说人话的 Jev 中文分析:解释 System One 模型、Choice/Score/Noul、并行决策、概率校准与“不会幻觉”的真实边界,并给出在 Agent 路由、安全门控和内容筛选中的落地方法。

科普
2026-09-14·12 分钟阅读·AI Agent 系统

FDE实践|如何通过AI+需求管理,让团队每个版本少开5次会?

Jacky 复盘一套真实的企业 AI 落地方案:用两个飞书机器人完成真需求四要素追问、需求评分与版本立项,在不到 50 元 Token 成本下,让团队每个版本减少 5 次会议,并揭示 FDE 应从单点结果而非大而全系统开始。

科普
2026-09-09·12 分钟阅读·AI Agent 系统

GPT-6 官方推荐的 11 段提示词:不知道怎么用,就从这里开始

苏乐整理 OpenAI 官方推荐的 11 段 GPT-6 提示词,按主动性、指令遵循、写作风格、子代理协作和测试验证五类场景给出中文版本与英文原文,适合直接嵌入 Codex、Agent 和日常 AI 工作流。

研究
2026-07-06·8 分钟阅读·AI Agent 系统

Harness 工程实践:如何让 Agent 完成自主迭代

汉松这篇工程复盘讲清 Harness 工程如何把 badcase 分析、prompt 修改、部署、评测和 champion-challenger 验证串成 Agent 自主迭代闭环;关键不是让 AI 多写代码,而是把工具链、评测集、长程执行约束和防 reward hacking 机制做成可调用的工程环境。

科普
2026-06-10·6 分钟阅读·AI 编程智能体

Harness之后,最近爆火的 Loop Engineering 是什么?怎么做?

这篇科普把 Prompt→Context→Harness→Loop 四层路径拆开,解释 Loop 不是更长的 prompt,而是一套带 done check、state、feedback 和 stop condition 的控制层。

科普
2026-06-09·20 分钟阅读·AI 编程智能体

Addy Osmani 讲 Loop Engineering:别再只会 Prompt,开始设计会自己运行的 AI Coding 循环【中文精译 + 原文】

Addy Osmani 这篇长文把 Loop Engineering 讲成一套六件事:automations、worktrees、skills、plugins/connectors、sub-agents,再加一层外置 memory。真正的变化不是 prompt 写得更花,而是人从亲自提示 agent,转向设计一个会自己发现工作、分派任务、验证结果并持续运行的系统。

研究
2026-06-08·18 分钟阅读·AI 编程智能体

Loop 到底是什么:AI 编程正在从 Prompt 走向后台编排

从 Peter Steinberger 与 Boris Cherny 引爆的 loops 争论出发,系统拆解 loop 的技术谱系、工程边界、成本结构,以及在 Hermes / Codex / Claude Code 里真正可落地的设计清单。

Taxonomy

按阅读类型进入

研究适合看系统判断,科普适合快速补课,调研适合做工具、产品和路线比较。

Topic Atlas

按专题进入

如果你准备连续读一个主题,直接进入专题页会比在首页或标签页里跳着找更省时间。

Start Here

第一次来,可以这样读

不用从上到下把首页刷完,按你的阅读目标选入口,会更快进入状态。

推荐路径

想先看现在最值得读的内容

先从主推和精选开始,快速抓住这个站当前最强的几篇判断。

想系统读懂一个主题

直接进入专题页,按主题连续阅读,会比单篇跳读更省时间。

想找某篇文章或最近更新

去归档页按时间回看,适合快速定位和补漏。

按目的进入

不同读法,对应不同入口

首页适合发现现在最值得先读的内容,专题适合系统阅读,归档适合检索和回看旧文。

Tags

按关键词继续延伸

如果你只想追一个概念、工具、公司或方法,可以直接从标签继续往下钻。