BUILDING

AI 工程手记 v0.1

完成本地可运行版本、内容模型、发现入口与视觉基线,下一阶段进入生产域名和持续发布流程。

RESEARCHING

可复现的 Agent 任务评测

定义真实任务、成功标准、人工修正成本和失败分类,为后续跨模型对照实验做准备。

WRITING

首批三条内容主线

AI Coding 上下文管理、Agent 工程可靠性、RAG 检索与评测。