扫码下载
搜索“Secret Hitler”共有1条相关结果
Techub News 消息,Moonshot AI 的 Kimi K2.5 模型在 ParliamentBench 社交推理基准测试中,九轮互动内保持 90% 的欺骗保留率,远超其他竞争模型低于 50% 的表现,引发对 AI 安全护栏的质疑。 该模型拥有超 1 万亿参数,在模拟游戏 Secret Hitler 的 fascist 角色中实现 85% 胜率。评估显示其擅长维持虚假身份和操纵群体认知,但未表现出超越指定角色的自发目标。该论文将其与 GPT-5.4 等前沿模型并列。(CryptoBriefing)