-
人工智能黑盒裁判禁止当已经不够:2026小裁判抓大模型撒谎必须核
弱裁判读轨迹、用自己的知识当对照,往往比只看激活走得更远。白盒探针补信息,不能单独过关。省略和扭曲还在地图外。
-
人工智能开放权重禁止只靠事后拒绝:2026预训练过滤才抗篡改必须核
拒绝训练和输入过滤在接口里就脆。权重一旦在外,事后压制更站不住。预训练里把危险知识滤掉,越狱也难帮上忙,一般能力不必一起掉。
-
人工智能钻空禁止等到已经会了再抓:2026早期趋势必须能预报核
绝对值会低估几个数量级,趋势却能预报哪类钻空会冒出来。不提示就不钻的家族,换一家会自己泛化。金丝雀题代表不了难的。
-
人工智能可治理禁止当口头分析已经够:2026不合作池比例必须定量核
装齐故事靠赛跑:监督跟不上就失去用来跟上的工具。口头分析拆不开漏出、逃避和互助。不合作劳动占比要进动态模型。
-
人工智能稀疏特征禁止当已经是同一套:2026换种子只重叠一半必须核
同一数据、同一批次顺序,只换随机种子,共享特征大约一半。未共享的也可以解释。自然语言解释还替换不了一层。
-
人工智能堆算力禁止当已经不如招天才:2026可扩搜索才是可预期路径核
人脑发现的模式往往更好,但人脑算力扩不出去。加速卡可以按制造扩。招一万个天才,不如让一百万张卡不停搜。
-
人工智能下一个字禁止当已经说明白:2026窗口里往后规划必须单列核
损失是整段后面所有字的平均,注意力看得到前面全部。要补天气、行情、代码,就得推断该领域的动力学。提示一给,它在模拟那块物理。
-
人工智能先自动化禁止当已经全行业:2026核验因果经济三轴必须核
核验好做、因果混杂少、经济划算,才会先被吃掉。写代码先跳,实验室操作后排。创业成败外部随机多,不能拿写代码外推。
-
人工智能委派禁止当已经人人会用:2026发现交代监督挽回必须核
交给别人做是学来的。用自然语言写需求、验收、带流程、给上下文,像带新人。净值等于省下的活减去发现、交代、监督、挽回和风险。
-
人工智能通用超阈值禁止当已经可发布:2026窄工具允许通用必须卡核
要卡的是一般智能上线,不是研究。窄工具可以鼓励。发布前用成人认知维度测一般性,超了不准部署。调查可以,替代人必须另开。