-
人工智能心理安全测评别再平均专家分:2026高风险场景先保留分歧
心理安全不是算术题。专家用不同临床尺子,分数对不上。一对上就平均,模型会驶向谁都不认的中间句。高风险场景要分框架训、升级人工,禁止用综合分放行。
-
人工智能推荐别把愤怒当兴趣:2026先把价值观写进排序再刷信息流
为你推荐把停留、转发、回复都当成喜欢。人对着冒犯的内容也会回复。越聪明地追互动,信息流越偏离你在乎的事。先把自述价值观写成排序信号,愤怒互动单独…
-
人工智能科研别把出题分当发现:2026先测复现和可行性再写突破
考题和选择题可以超过人类平均,整篇复现、可行实验仍经常过不了。点子可以更新颖,落地往往更差。科研助手先当副手:假设人拍板,执行人验收,突破绑定复…
-
代理守法不能靠假如是人:必须先给它真的法律义务再谈对齐
说代理该守法,若法律只约束人,这句话就和说石头该守法一样空。用「假如是人做了」去套,复制自己、潜伏推理、专用工具会对不上。要先把义务直接写到代理…
-
吹哨要护公共危险不能只护违法:必须先把封口合同写成无效
内部人最先看见危险,法条往往还没追上。只保护举报违法,实质危险会被封口协议堵死。报复禁止几乎不增加合规负担,却是政府拿到现场信息的最低成本通道。
-
合规成本降不下来就别急着管:必须先把可自动写成生效扳机
创新和风控会僵持在「现在管还是以后管」。把生效绑在合规真能低成本自动完成,管早和管晚都能被同一把尺子量。还靠人填的表,不能当已经可执行。
-
责任险买不到真正安全:必须先强制报事故再谈让保险公司来管
加责任会把保险公司推到守门位置,但许多智能事故看不见、测不准、没有公认防护。网络险已经证明:保了主要是在限责,不是在把风险降下来。先强制报告,精…
-
棋盘分数涨了不等于已经通用:必须先按种类把智能拆开再测
封闭规则里能赢,测不到物体还在不在、见一次会不会、乱局里会不会自己找。很小的动物就会的直观物理,机器常常不会。智能要按种类记账,一根总分会把不会…
-
人在回路不等于已经在管:必须先给真干预权再谈才可以放行
回路上站着人,不等于人能看懂、能拦住、能改口。自动化越强,留给人的往往是生疏的高风险一刀。人还会偏向信机器,出事时又被当成锅。干预权、核验和否决…
-
街上的智能必须让当事人走一遍:绝对不要只用演示当已经负责
车和杆在实验室里很顺,到了真实街道会撞上台阶、信号和身体条件。负责不能写在路线图上,要让坐轮椅、视力弱、带小孩的人把摩擦走出来。走不出来的点,就…