模型在开场时会被告知「你有搜网这个能力」。但它手里到底有没有这个工具,是另一套逻辑决定的。两边今天不是同一个判据。
所以会出现这种事:开场白说「你能搜网」,而工具表里其实没有 —— 模型于是要么去调一个不存在的工具,要么凭印象编一个答案,而不是老实说「我搜不了」。你看到的是模型答得很自信但内容没根据。
不做会怎样:模型的自我认知和它真实的能力长期错位,而这种错位只在它答错时才被发现,且很难归因。
给实现方 — [REQ-1414][CODE-2] · S
父票 alpha-code#1414。方案基线 §七 CODE-2,owner 2026-09-24 批准。
现状
#1414 勘破实测:全仓有四份判断「能不能搜网」的判据,其中一处是
buildAlphaCapabilities —— 它把能力事实直接写进系统提示,而它与真正的工具注册闸不同源。
边界(基线原文)
要改:packages/ui-mac/src/main/alpha-identity.ts、alpha-config-injection.ts:128-135。
不要:新建抽象层;动 buildAlphaIdentity 的文案骨架。
负责的不变量
基线 §三 的 S4:系统提示里声称的能力,必须与模型工具表里的在场性一致。
退出条件(基线原文)
一条四格测试:登出 / 登录有额度 / 登录无额度 / kill-switch —— 每格断言
「提示里那一行」与「工具表的在场性」相符。
Out of scope
- 本地腿在登录后的在场性本身:CODE-1(
alpha-code#1411)。
- 决策文件:CODE-3。
- runtime 取证:VERIFY-1。
模型在开场时会被告知「你有搜网这个能力」。但它手里到底有没有这个工具,是另一套逻辑决定的。两边今天不是同一个判据。
所以会出现这种事:开场白说「你能搜网」,而工具表里其实没有 —— 模型于是要么去调一个不存在的工具,要么凭印象编一个答案,而不是老实说「我搜不了」。你看到的是模型答得很自信但内容没根据。
不做会怎样:模型的自我认知和它真实的能力长期错位,而这种错位只在它答错时才被发现,且很难归因。
给实现方 —
[REQ-1414][CODE-2]· S父票
alpha-code#1414。方案基线 §七 CODE-2,owner 2026-09-24 批准。现状
#1414勘破实测:全仓有四份判断「能不能搜网」的判据,其中一处是buildAlphaCapabilities—— 它把能力事实直接写进系统提示,而它与真正的工具注册闸不同源。边界(基线原文)
要改:
packages/ui-mac/src/main/alpha-identity.ts、alpha-config-injection.ts:128-135。不要:新建抽象层;动
buildAlphaIdentity的文案骨架。负责的不变量
基线 §三 的 S4:系统提示里声称的能力,必须与模型工具表里的在场性一致。
退出条件(基线原文)
一条四格测试:登出 / 登录有额度 / 登录无额度 / kill-switch —— 每格断言
「提示里那一行」与「工具表的在场性」相符。
Out of scope
alpha-code#1411)。