Projects / Case Index

项目

人与 AI 协作中的具体问题

01

Agent 交接协议

SACP

当 agent 宣称任务完成时,怎样留下一个能被下一位操作者验收、判断和继续执行的交接单?

持续研究
receiptevidencevalidatorhandoff
已经做了
参考 Git 和 HTTP 的设计思路,整理任务回执、证据、责任边界和下一负责人之间的关系。
仍在解决
协议对模型的约束仍不够硬,独立验收标准和多 agent 协同模式还没有解决。
02

可检查执行记录

Agent Flight Recorder

一次 agent 运行结束后,能不能把声明、证据、缺口和修复建议组织成外部可以检查的记录?

原型验证
skillauditreceipt hashreflection loop
已经做了
把 SACP 的回执思想集成进 skill,并尝试将 receipt hash 锚定到公开网络,形成可复查的执行证据。
仍在解决
早期 skill 承担的职责太多,下一步需要拆成更小的记录、验证和修复接口。
03

任务合同编译器

token-prompt-compiler

怎样把一个模糊请求整理成目标、边界、验证、修复和停止条件明确的任务合同?

公开仓库
objectiveboundariesvalidatorrepairstop rule
已经做了
结合 prompt 学习、reflection 机制和 SACP,把常见任务结构整理成可复用的编译与检查流程。
仍在解决
不同模型对格式的响应差异还缺少系统 benchmark,任务合同与最终结果之间也需要更强闭环。
04

Markdown-first AI 工作流

Solo AI Company OS

怎样固定常用 AI 角色、任务模板、工作记录和上下文,让重复协作不必每次从零开始?

探索中
rolescontextdashboardmemoryhandoff
已经做了
把总控、技术、销售、研究和学习教练等 AI 角色,以及启动词、上下文和交接方式组织成 Markdown 工作系统。
仍在解决
架构仍在变化,真实长期运行数据、状态存储和多 agent 并行协作还需要继续验证。
05

网页证据 Agent

ShadowBuyer

不同地区看到的价格、税费和条件不一致时,能不能留下可复查证据,帮助酒店理解渠道差异?

Hackathon 原型
multi-agentregional pricingHTMLscreenshotsaudit
已经做了
从 Amazon 的地区价格差异出发,转向 Booking 酒店数据,尝试并发采集、清洗、换算并组织网页证据。
仍在解决
采集稳定性、反爬、数据合规和价格口径仍需继续验证,当前结果只代表原型阶段。

产品与短周期交付

06

语言学习助手

IELTS Assistant

怎样把材料处理、写作反馈和复习流程连接成一个可以持续使用的语言学习助手?

在线产品
OCRwriting coachlearning loop
已经做了
把个人语言学习痛点做成线上助手,连接材料处理、写作反馈和复习流程。
仍在解决
当前展示的是个人学习系统实验,不宣称为成熟教育产品。
07

36 小时 Hackathon 交付

Journease

怎样在极短时间里把一个模糊 idea 推进到可以运行和展示的产品?

交付复盘
problem framingdeliveryreview
已经做了
在 36 小时内完成问题定义、协作、实现和展示,并记录时间压力暴露出的工程短板。
仍在解决
这是一次短周期交付证据,不能替代对长期维护和工程质量的验证。