-
人工智能法律引用幻觉有五类:2026页码对不上往往不是模型而是没原文
不存在、名称对不上、页码错、逐字引错、内容张冠李戴。前两类能查库,后三类必须读判决。免费档幻觉没有下降。不准把会生成引用当成已经核对过。
-
人工智能鉴真不等于核验内容:2026拍得真不代表画面支撑它配的那句话
出处准不等于主张成立。工具不当真假开关,要按环节叠置信度。鉴真问从哪来,核验问是不是那回事。不准一次分类交差。
-
人工智能科学结论合成远未过关:2026干净房间里事实调和平均只有三成
会去网上抄标准答案。评测不挡泄漏测到的是检索不是合成。结论要对又要全。已上线健康助手一半结论里至少有一条对着专家综述。不准当第一站终审。
-
人工智能要问模型还学了什么:2026测试准确不等于没记住训练名单
成员推断能从输出反推记录有没有进训练集。多余容量会藏后门。任务无关特征照样从内部漏出去。最小权限才该进生产。不准只报测试正确率。
-
人工智能通过考试不等于能上岗:2026律师工作不是整天做资格考题
资格考分数投射不到岗位。通用智能不是软件属性,制度法律组织适配不上就不算落地。上游榜单不能当下游验收。不准把发布会分数当成能替换岗位。
-
人工智能代理的身份在状态不在权重:2026换模型还是它换记忆就变成另一个
换模型还是同一个代理,换记忆就是另一个。系统提示、消息和派生事实才个体化。权重再大也不含这个之所以是这个。不准把改记忆当成小更新。
-
人工智能评审环只要三百行:2026收集提交工具循环自己接模型和地址
收集、提交、工具再喂、批准驳回或只留评论。模型名地址密钥必须能自选。返回纯文本就当未决退出。不准默认合入,也不准只接一家订阅。
-
人工智能推理还没完就追加再等:2026把结束思考标成停词再让它续想
结束思考当停词,删掉后换行写再等,让模型续想。轮数当旋钮。过早结束会丢分,再多也不等于一直更好。不准把一次出词当成已经想够。
-
人工智能前缀不变才能打中缓存:2026改系统提示或抽样参数缓存全废
对话像共用一卷纸,每次都从头重算除非前缀中间态留下。禁止改已经发出的旧消息。命中了才少做乘法。不准把每次会话都当全新前向。
-
人工智能别禁工具改要页脚声明:2026机器可读比追查谁撒谎更硬
禁令挡不住撒谎。默认配置就要写出协助行,模型名和工具名能被脚本扫到。披露了才知道哪套工具后续事故多。不准把猎巫当政策。