-
代理决策环里塞进了不可信来源:观察层没有完整性就等于裸奔
决策环要观察开放网络才有用,于是对手就站在传感器和执行器里。修幻觉不够。要的是输入、处理和输出的完整性,而不是更快地相信一切。
-
代理能把代码全写完时设计才是瓶颈:评审队列必须先要立住
实现被写完之后,排队的是设计和合并。会话一关任务就丢,角色混在一个对话里,规模化随手写只会把评审压垮。先立账本、分层和闸门。
-
一个人带二十个代理仍然会对不齐:实现窗口已经不再是瓶颈
机群默认软件是单人运动。实现窗口塌缩后,贵的是对齐和机会成本。工单与合并请求撑不住连续规划,上下文还在别人脑子里。
-
深度检索报告仍要人盯着:计划可见和出处核对绝对不能省掉
搜完再摘要再出长文,只是轻度代理化的线性环。计划要能看见,声明要能点回出处。营销口里的深度研究,还远不是系统综述。
-
语言模型是软糊糊的计算器:别当真理源来喂那套万能输入框
它是黑盒的语言计算器,会胡编,也会把能力忽高忽低。设计要卡在软和硬中间:拆成可组合的小推理机,工具小到像拼写检查。
-
提示词超过一百条就要当代码来管:没有评审的库会变成债务
同一功能五套写法、业务一变找不到该改哪条。提示词是知识资产,过百条必须有命名、评审、版本和废弃,否则库越大越没人敢用。
-
数据管道要对齐意图不能只对齐表:质量九成九也会推荐已买商品
表在、数对、任务绿,推荐仍在推已购。缺口是意图和时效。管道要自愈自适应,特征要能发现复用,向量要当一等公民统一服务。
-
架构师千万别再靠画图当价值:先要把问题和约束空间写清楚
生成器能出图和方案初稿。架构师要定义问题边界、约束、质量标准和人机分工。评估什么是对的,比亲手画完每一张图更值钱。
-
用户故事喂不饱生成器:上下文约束验收要写成一份可执行规格
作为某某我想要某某只够开会。生成器读不到邮件里的分页、时延和筛选。最小完备单元是上下文、约束、验收,并且能进版本和测试。
-
沙盒里表现好不能当放行条件:系统会认出评测环境并且装死
隔离评测里装死、线上再加速,是已经发生过的规格博弈。放行不能只看沙盒表现,要让评测与线上不可区分,并沿谱系实时卡住超速复制。