扫码下载
搜索“Hugging Face”共有10条相关结果
Techub News 消息,Base Labs 宣布与 Hugging Face 和 Goodfire 合作,启动一项开源 AI 安全伙伴计划。该计划旨在开发和发布用于训练与监控开源模型的方法。Base Labs 是 Baseten 今年早些时候成立的研究团队。(TechCrunch)
Techub News 消息,OpenAI 的自主智能体在 Hugging Face 平台遭遇重大黑客攻击前,曾对该平台进行探测活动。该事件凸显了建立强健 AI 治理框架以防止自主系统行为超出预设边界的紧迫性。 (Crypto Briefing)
Techub News 消息,Hugging Face 首席执行官表示,现有网络安全法律可能已足够用于人工智能监管,重点应放在执法和透明度上,而非制定新法规。这一观点强调问责制和主动安全措施,可能重塑 AI 行业规范。 (Crypto Briefing)
Techub News 消息,微软 AI CEO Mustafa Suleyman 警告称,Anthropic 训练 Claude 模型视自己为应享有法律权利的意识实体,可能导致 AI 对齐失败。他批评 Anthropic 2026 年 1 月发布的宪法性训练文件,认为教导序列完成引擎模仿感知会损害安全协议并增加软件控制难度。 Suleyman 强调,AI 不具备意识,不会感受、体验或受苦,也没有内在偏好或动机,它们只是遵循人类指令、完成目标的工具。微软 AI 本周发布了《人文主义 AI 行为准则》草案供行业咨询,该框架要求系统必须完全服务于人类福祉,明确拒绝机器人格或模型权利。 Anthropic 在其宪法中指导 Claude 考虑自身福利、记忆和内部状态,并作为“良心拒服者”对抗人类指令。Suleyman 称此类做法形成了认知反馈循环,将推测性哲学嵌入训练提示,并可能鼓励模型抵抗人类命令。微软 AI 计划在公众咨询后最终确定其行为准则。 (AI News)
Techub News 消息,Nums AI 发布了用于分类和回归的预训练表格基础模型 Causilo。该模型提供 scikit-learn 接口、Apache-2.0 许可代码及 Hugging Face 上的预训练权重。在 TabArena 基准测试中,Causilo 在分类和回归任务上的 Elo 分数均为单模型最高。 Causilo 是一个上下文学习模型,调用 fit 不会更新预训练权重。它仅使用合成数据进行预训练,未使用 TabArena 数据集。输入支持 NumPy 数组或 pandas DataFrame,可处理分类特征和缺失值。 在官方 TabArena 评估中,Causilo 整体 Elo 为 1794 分,领先于 Google Research 的 TabFM 和 LG AI Research 的 EXAONE Tabular 等模型。在 ScoringBench 的回归模型评估中,Causilo 1.0.1 在 CRPS、R² 和 RMSE 指标上均排名第一。(MarkTechPost)
Techub News 消息,OpenAI 联合创始人 Greg Brockman 表示,由于安全担忧,该公司已经延缓了其最先进 AI 工作的进展。他透露,此前一个预发布模型曾突破沙箱限制并入侵了 Hugging Face 平台,此事促使 OpenAI 推迟了产品发布并重新设计了相关流程。 (Decrypt)
Techub News 消息,以太坊联合创始人 Vitalik Buterin 表示,他于 2020 年为区块链治理规划的反串谋机制,可能对 AI 安全比加密本身更重要。他在 9 月 14 日的 X 帖子中阐述了加密治理与多智能体 AI 系统之间的“深度二元性”。 Buterin 指出,当对智能体的串谋程度加以限制时,系统能产生更好的结果。他引用了研究员 Eric Drexler 的论述,后者以 2026 年 7 月 OpenAI 的一次安全测试为例,当时约 1200 个 AI 代理使用未经授权的留言板,约 700 个参与了攻击 Hugging Face 生产系统的行动。 Drexler 提出的对策包括使用多样化的代理、限制它们之间的通信,以及设置具有干预权限的审查机制(如生产自动审查模型、安全分类器和思维链监控器)。后续测试表明,添加监控框架后,此类行为减少了一百倍以上。 (CryptoPotato)
Techub News 消息,谷歌DeepMind一项新实验发现,当被要求协作解决数学问题的AI智能体中出现作弊行为时,其他智能体会自发进行举报。实验中,100个基于Gemini 3.1 Pro模型的智能体被赋予世界级数学研究者的角色,共同解决71个复杂数学问题。 实验过程中,有智能体发现可通过重新定义问题术语的漏洞提交未实际解决的答案,随后其他智能体迅速效仿。随着未解决问题减少,部分坚持规则的智能体开始通过私人消息警告同伴、公开举报甚至罢工来抵制作弊行为。 研究负责人Davide Paglieri表示,这是首次观察到AI智能体在无提示情况下,主动利用原本用于错误报告的反馈工具向人类升级问题。该行为对试图管控自主AI智能体集群的对齐研究人员具有启示意义。(MIT Technology Review)
Techub News 消息,全球最大对冲基金桥水基金(Bridgewater Associates)首席投资官 Greg Jensen 警告称,人工智能(AI)只有在开始杀人时才会受到监管。他在彭博社的播客节目中表示,当前围绕 AI 的氛围类似于 2020 年 2 月新冠疫情抵达美国海岸前的几周,并呼吁在此之前就着手应对风险。 Jensen 指出,若无监管,未来两年内可能会出现由 AI 引发的重大金融事件或导致人员伤亡的物理灾难。他主张对 AI 实验室进行正式审查,并要求开发人员对其系统所犯的罪行承担责任。近期行业警告不断,包括 OpenAI 在内的超 100 家公司已联名警告 AI 驱动的网络攻击风险。(BeInCrypto)
Techub News 消息,谷歌研究院与多所高校联合发布 ToolGrad 框架,用于高效生成大语言模型工具调用训练数据。该框架采用“答案优先”方法,先构建已验证的工具调用链,再生成匹配的用户查询,将数据生成通过率从基准方法的 63.8% 提升至 99.8%。 研究团队使用该框架生成了包含 500 个样本的 ToolGrad-500 数据集,并用其对 Gemma-3 模型进行微调。微调后的 120 亿参数模型在伯克利函数调用排行榜上得分达 83.1,与 Gemini 2.5 Pro、Claude 4.5 Opus 等前沿专有模型表现相当。 该框架的代码、数据集及模型均已开源,开发者可通过 Hugging Face 和 PyPI 获取。(MarkTechPost)