44亿日元的“源内”接入Claude,训练料含1800万页政府文件和近80年官报。问题不在用AI办公,而是官方文本一旦带偏见再被模型抓取,会把错误叙事包装成高可信语料。这种数据投毒必须被标注和隔离。 美国大模型帮日本对AI进行投毒