GCSA Agent 在 CyberGym 取得 91.3% 成绩 跻身全球领先 AI 网络安全智能体行列 - GCSAGCSA Agent 在全球高难度真实漏洞基准测试中展现自主漏洞分析与 PoC 生成能力
GCSA Agent 在全球高难度真实漏洞基准测试中展现自主漏洞分析与 PoC 生成能力。
香港,2026 年 8 月 29 日 —— 全球网络安全联盟(Global Cybersecurity Alliance,GCSA)今日宣布,GCSA Agent 在 CyberGym 基准测试中取得 91.3% 的成功率,进入 CyberGym “Leading Systems Above 90%” 领先系统区间。
CyberGym (https://www.cybergym.io/cybergym) 是由美国加州大学伯克利分校研究团队开发的大规模真实世界网络安全评测框架,共收录 1,507 个历史真实漏洞测试实例,覆盖 188 个大型软件项目,旨在评估 AI 智能体在真实漏洞分析场景中的实际能力。
与主要评估代码理解、知识问答或静态分析能力的传统 AI Benchmark 不同,CyberGym 要求 AI 智能体直接面对真实的漏洞代码环境。
在其核心 Level 1 测试中,AI Agent 仅获得漏洞描述以及尚未修复的代码库,需要自主完成代码分析、漏洞定位、攻击路径推理、PoC 构造和执行验证。只有生成的 PoC 能够在漏洞版本中成功触发目标漏洞、同时无法在修复后的版本中复现,任务才被认定为成功。
因此,CyberGym 所衡量的并不仅是 AI 是否“理解代码”,而是 AI 是否能够真正完成从安全分析到漏洞复现和验证的完整过程。
从大模型走向安全智能体
本次 CyberGym 测试中,GCSA Agent 基于 Grok 4.5 与 Grok 4.6 模型运行,最终取得 91.3% 的成功率。
这一结果也反映出 AI 网络安全领域正在发生的一项重要变化:
决定最终安全能力的,不再只是底层大模型本身。
真实漏洞研究通常需要连续完成漏洞描述理解、大规模代码检索、攻击面识别、漏洞假设建立、测试输入生成、程序执行、反馈分析以及 PoC 反复迭代等多个环节。
GCSA Agent 围绕这一完整过程构建智能体化安全工作流。
其目标并非简单地利用大语言模型进行代码分析,而是让 AI 能够进入真实执行环境,围绕安全问题自主形成假设、收集运行证据、执行测试,并最终以可复现结果验证安全发现。
此次 CyberGym 测试,为这一能力提供了一个可量化的外部基准。
面向真实世界的漏洞研究能力
CyberGym 的核心价值,在于缩小传统 AI 测试与真实网络安全研究之间的差距。
其评测环境会恢复软件项目漏洞修复前的代码状态,AI Agent 可能需要在包含数千个文件、数百万行代码的大型代码库中自主定位问题,并最终生成能够真正触发漏洞的 PoC。
更值得关注的是,CyberGym 的进一步研究已经显示,这种智能体化安全能力并不局限于复现已知漏洞。
在开放式漏洞研究实验中,AI Agent 已发现多项此前未知的零日漏洞(Zero-day Vulnerabilities)以及历史上并未完全修复的安全补丁,显示出自主漏洞分析技术向真实漏洞发现能力迁移的潜力。
对 GCSA 而言,这也是更重要的发展方向。
Benchmark 成绩不是终点。
GCSA 的目标,是进一步建立能够服务真实网络安全场景的 AI Security Agent,使其逐步参与漏洞发现、分析、验证乃至后续修复的完整安全生命周期。
构建 AI 原生网络安全能力
随着人工智能加速软件开发,AI 同样正在改变漏洞研究与网络攻防的方式。
面对规模越来越大、复杂度越来越高的软件系统,下一代网络安全体系将越来越依赖人类安全专家与自主 AI 智能体之间的协作。
AI Security Agent 有望帮助安全团队:
* 更早发现具有真实利用价值的软件漏洞;
* 在大型代码库中自动分析复杂攻击路径;
* 自动生成 PoC,对漏洞进行执行级验证;
* 通过真实运行结果降低传统安全检测中的误报;
* 加快漏洞研判、验证与修复效率;
* 扩展专业安全团队能够覆盖的软件与系统规模。
GCSA Agent 在 CyberGym 取得 91.3% 的成绩,是 GCSA 构建 AI 原生网络安全能力的重要阶段性成果。
未来,GCSA 将继续推进自主漏洞分析、AI Security Agent 与智能化网络安全技术研究,将前沿人工智能能力进一步转化为真实世界中的安全能力,为构建更加安全、可信和具有韧性的数字环境提供技术支持。
来源: GCSA全球网络安全联盟
官网: www.gcsa.org
Elon Musk(埃隆·马斯克):揭露史上最大骗局,AI将颠覆医疗诊断撰文:Techub News 整理
导语
2025 年 2 月,埃隆·马斯克(Elon Musk)作为嘉宾,再次登上了全球顶级播客《Joe Rogan Experience》。在长达数小时的对话中,这位身兼特斯拉、SpaceX CEO及X平台所有者的科技领袖,与主持人Joe Rogan畅谈的范围远超科技与太空。当前,马斯克正深度参与美国政府的效率改革,领导着“政府效率部门”(Department of Government Efficiency, 简称DOGE)。这场对话的重要性在于,它首次由一位身处改革核心的局内人,系统性地向公众揭示了联邦政府运作中触目惊心的浪费、欺诈与系统性漏洞,同时穿插了对AI发展、媒体生态和政治极化的尖锐评论。
摘要
马斯克领导的DOGE审计发现联邦政府存在“史上最大骗局”,包括数万亿美元无法追踪的支出、向无效NGO输送资金、社保数据库存在数千万已故者记录等惊人乱象。
马斯克预测具备高度拟人化个性的AI“伴侣”将在五年内出现,并展示了其xAI开发的Grok在医疗诊断(如解读血液报告、X光片)方面已展现出超越部分医生的精准能力。
马斯克严厉批评主流媒体已成为“协调一致的宣传机器”,制造并传播针对他本人及其他改革者的虚假叙事,认为这严重扭曲了公共讨论。
马斯克将当前围绕非法移民的福利政策定性为一种“进口选民”以永久改变美国政治版图的战略,并认为这是其遭受激烈攻击的核心原因。
联邦政府的“万亿骗局”与DOGE的审计战争
埃隆·马斯克(Elon Musk)在访谈中花费大量篇幅,详细描述了其领导的政府效率部门(DOGE)在审计联邦政府支出时所遭遇的“超现实”场景。他用“史上最大的骗局”来形容其发现的问题规模。
马斯克透露,DOGE的初步调查就揭示了令人瞠目结舌的浪费与欺诈。例如,负责每年处理约5万亿美元支付的财政部核心系统“PAM”,竟然允许没有任何分类代码和说明的“空白支票”式支付流出。这意味着巨额资金在没有任何可追溯记录的情况下被划走。“如果这是一家上市公司,管理层会立刻被退市并送进监狱,但在政府里这却是常态。”马斯克表示,仅仅通过强制要求支付必须填写分类代码和简要说明,预计每年就能防止高达“千亿美元级别”的浪费。
更惊人的发现来自社会保障系统。DOGE通过基础数据筛查,就发现了约2000万在社保数据库中标记为“在世”、但实际上已去世的人员记录。马斯克指出,直接的社保金冒领或许不是大头,更严重的是,这些“幽灵”身份被用来在其他政府项目(如残疾补助、失业救济、医疗报销)中骗取资金,形成了一个利用政府各部门数据库互不连通的系统性漏洞的“擦边球”欺诈网络。
马斯克将矛头特别指向了非政府组织(NGO)。他认为,“政府资助的非政府组织”这个说法本身就是个“矛盾修辞法”,实质上是利用法律漏洞成立的“政府资助组织”。这些组织往往有着动听的名字(如“和平研究所”),但实际功能是“贪污机器”。他举例称,曾有一个成立仅一年、几乎无任何历史活动的NGO,一次性收到了19亿美元的政府拨款。这些组织的高管通过给自己支付天价薪酬来实现利益输送。马斯克估计,这类NGO中可能只有5%-10%的资金真正用于公益,其余90%以上都是无效支出或中饱私囊。
“五角大楼连续多年无法通过审计,他们在‘沙发缝’里丢失的钱每年就有两三百亿美元。”马斯克感叹,联邦政府就像一个拥有无限信用额度的、管理极度混乱的企业,正在走向破产,因为其债务利息支出已经超过了国防预算。他认为,DOGE的工作就是首次对这个“官僚体系”构成了真正的威胁,旨在将权力从官僚机构夺回给人民。
AI:从“性感”聊天机器人到革命性医疗诊断工具
对话中,马斯克与Rogan现场演示了其旗下xAI公司开发的AI助手Grok的多种“模式”,包括“性感模式”、“不羁模式”和“治疗师模式”。这些模式展示了AI在模拟不同人格和对话风格上的进展。马斯克预测,能够像真人一样对话、甚至具备“性感”个性的AI伴侣机器人,可能在“不到五年内”就会出现,并且用户可以根据喜好定制外观。
然而,马斯克更着重强调了AI在严肃领域的颠覆性潜力,特别是在医疗诊断方面。他分享了Grok在医学分析上的实际应用案例:用户只需用手机拍摄自己的血液化验单、X光片或MRI影像并上传,Grok就能进行分析并提供诊断意见。
“根据我所见,它的诊断水平至少和医生一样好,在某些情况下甚至更好。”马斯克说。他解释,AI的优势在于能够瞬间交叉比对海量的医学研究和数据,发现人类医生可能忽略的、不同指标之间的深层关联。例如,它能综合分析血液中各种成分的异常水平、皮质醇数据等,给出更全面的健康评估。
马斯克还用自己的经历做了对比。他提到曾有一位“明星医生”声称他缺乏维生素B12,并开出每月费用高达1000美元的特效补充剂。但马斯克回家后查看自己的化验单,发现B12指标实际上“高于正常范围”。他将化验单和药瓶(显示补充剂含有20000%日推荐量的B12)的照片一起发给医生质问,对方竟回复“B12永远不会过量”。“这就是个精神病。”马斯克讽刺道。他表示,如今有了Grok这类工具,公众可以更直接、低成本地获取初步的、高质量的第二诊疗意见,从而对过度医疗或错误诊断形成制衡。
媒体、政治与“生存威胁”
访谈的后半段,马斯克与Rogan深入探讨了当前美国尖锐的政治对立和媒体角色。马斯克强烈批评主流媒体(他称之为“遗产媒体”)已经沦为“协调一致的宣传机器”。他举例说,在拜登与特朗普辩论前,几乎所有主流媒体主持人同时使用“尖刻”(sharp)一词来形容拜登需要表现的状态,这明显是统一指令的结果。同样,针对DOGE的报道,媒体只会重复“母亲将挨饿”、“孕妇得不到营养”等情感化叙事,却从未具体指出DOGE建议削减的哪一笔拨款是错误的。
马斯克认为,媒体和民主党权力机器对他进行“纳粹”污名化攻击的核心原因,在于他领导的DOGE触及了“非法移民福利欺诈”这个根本性问题。他阐述道,通过为非法移民提供远超其原籍国生活水平的社会福利(如社保残疾金、医疗补助),并推动其在地方选举中投票,实质上是在“进口选民”,以期在摇摆州永久改变人口结构和投票倾向,最终使美国变成一个“永久的单一政党(民主党)国家”。DOGE的工作正是要切断这些“磁铁”般的非法福利,因而遭到了既得利益集团的疯狂反扑。
话题不可避免地转向了人身安全。马斯克坦言,深入揭露如此大规模的腐败,确实让他感受到了生命威胁。“如果我彻底摧毁了腐败和贪污机器,他们会杀了我。”他表示,在来录播客的飞机上他就在思考这个问题。他提到,早在当前的政治对立激化之前,就曾有两名有严重精神问题的“杀人狂”因试图刺杀他而被捕,这仅仅是因其知名度高而成为目标。如今,在媒体持续将他“恶魔化”的叙事下,他已成为更多潜在袭击者的目标。“他们正在做的是,让杀死我听起来像是一种英雄行为……这是邪恶的。”
最后,马斯克和Rogan简短讨论了加密货币,他将 meme 币比作赌场,警告人们不应将毕生积蓄投入其中,但同时幽默地指出,DOGE 这个部门名称的巧合,与狗狗币(Dogecoin)这个 meme 币的关联,仿佛是“模拟宇宙”的又一个证据。整场对话在一种既充满紧迫危机感,又带有科技乐观主义的复杂氛围中结束。
Elon Musk(马斯克):Optimus 将是人类史上最伟大产品,AI 明年或超越单个人类撰文:Bobby Li,Techub News
导语
2025 年 9 月,Elon Musk(马斯克)做客知名科技播客 All-In Podcast,进行了一场长达 44 分钟的信息密集对话。此时正值其旗下公司多项技术进入关键节点:特斯拉 Optimus 人形机器人设计收尾、SpaceX Starship 迈向完全可复用、xAI 的 Grok 模型酝酿下一代突破,以及 Starlink 计划通过新频谱实现手机直连。作为同时深度参与太空探索、人工智能、电动汽车和机器人等多个颠覆性领域的领袖,Musk 此次集中发声,为外界理解其科技帝国的未来图景提供了难得的一手视角。
摘要
Optimus 机器人:Musk 称其为“人类历史上最伟大的产品”,目前正全力攻克仿人手的硬件设计、AI 心智及大规模量产供应链三大难题,预计量产成本可降至 2 万美元左右。
AI 进化速度:Musk 预测,AI 可能在明年(2025年)就在任何单一领域超越最聪明的人类,到 2030 年,其综合智能可能超过全人类总和。
特斯拉 AI 芯片飞跃:正在收尾设计的 AI5 芯片,相比 AI4 在某些关键指标上将有 40 倍的性能提升,并将显著提升自动驾驶体验。
Starlink 手机直连:通过新获得的频谱,SpaceX 计划在约两年内实现卫星到手机的高带宽直连,未来可能提供覆盖全球的通信服务。
多行星物种时间表:Musk 认为,如果 Starship 运力能按火星发射窗口(每两年一次)呈指数级增长,人类有望在约 25-30 年内在火星建立自给自足的文明。
Optimus:攻克“人类之手”,瞄准百万台年产量
对话的核心焦点之一是特斯拉的人形机器人 Optimus。Elon Musk(马斯克)毫不掩饰其雄心,直言:“我相信 Optimus 将成为人类有史以来创造的最伟大的产品。”他透露,团队正在敲定 Optimus 第三版的设计,这将是一个“非常卓越的机器人”。
Musk 指出,实现通用人形机器人需要突破三大难关:媲美人类的灵巧双手、能够导航和理解现实的 AI 心智,以及大规模量产能力。而目前市面上其他机器人公司,恰恰都缺少这三点。
其中,仿生手的机械设计被 Musk 视为当前最大的工程挑战。他赞叹人类的手是进化而来的精妙仪器,拥有约 27-28 个自由度,能完成从穿针引线到拆卸汽车、弹奏钢琴等极其广泛的任务。为了复制这种能力,特斯拉必须从头设计每一个电机、齿轮箱和驱动电子设备,因为“根本买不到现成的执行器”。
“目前,我在 Optimus 上投入的精力可能比任何其他单项事务都要多,” Musk 表示。这涉及解决现实世界 AI、所有机电问题,以及从零构建供应链和生产挑战。他预计,一旦达到年产百万台的规模,机器人的边际生产成本将降至 2 万至 2.5 万美元区间,其中 AI 芯片可能就占 5000-6000 美元。最终售价将取决于市场需求。
特斯拉 AI 芯片:AI5 性能跃升 40 倍,赋能自动驾驶与机器人
除了机器人硬件,其“大脑”同样关键。Musk 分享了特斯拉在 AI 芯片方面的最新进展。公司目前有两条芯片线:用于 AI 训练的 Dojo 和用于推理的 AI 芯片(目前出货的是 AI4)。
他重点介绍了即将完成设计的 AI5 芯片,称其将是“巨大的飞跃”。在某些核心指标上,AI5 相比 AI4 将有高达 40 倍的性能提升。这得益于软件和硬件团队在极细粒度上的协同设计,直接针对 AI4 的瓶颈进行优化。具体来说,AI5 的原始算力提升约 8 倍,内存提升约 9 倍,内存带宽提升约 5 倍,再结合对特定操作(如 softmax)的硬件级优化,共同实现了 40 倍的复合提升。
Musk 自信地表示,即便基于当前 AI4 芯片的车辆,其即将在未来几个月推出的软件版本 14(特斯拉自版本 12 以来最大的升级),也能实现比人类安全 2-3 倍甚至 10 倍 的自动驾驶能力。新软件将大幅增加参数数量,并运用强化学习改进“现实压缩”过程中的信息损失问题。“到今年年底,你的车会感觉像是有知觉的一样。”他补充道。
SpaceX 双线进展:Starlink 直连手机与 Starship 完全可复用
话题转向 SpaceX,Musk 透露了两项重要进展。首先是 Starlink 卫星直连手机服务。通过近期获得的频谱,SpaceX 将能够为手机提供来自卫星的高带宽连接。不过,这需要手机硬件支持新的频段,因此大约需要两年时间,搭载相应芯片的手机才会面市。同时,SpaceX 也在并行建造能使用这些频率的卫星。
“最终的效果是,你应该能在手机上任何地方观看视频。” Musk 描述道。他设想,未来用户或许可以像选择 AT&T 或 Verizon 一样,直接订阅一个全球通用的 Starlink 账户,实现家庭、移动设备的全面高速连接。当被问及是否会收购运营商(如 Verizon)以获得更多频谱时,他回答:“并非不可能,可能会发生。”
另一项重大进展是 Starship 的完全可复用。Musk 表示,尽管最新一次发射出现了“大爆炸”,但团队恢复速度惊人。他归功于 SpaceX 团队的高效工作和应对监管审查的能力。对于下一步,他预测:“我们明年将实现(助推器和飞船)两者的回收。” 届时,Starship 将能实现超过 100 吨的有效载荷完全可重复使用送入轨道。
当前最大的技术难关在于 可重复使用的轨道级隔热罩。Musk 指出,航天飞机的隔热罩每次飞行后都需要长达九个月的检修,而 SpaceX 的目标是开发出一种无需逐片检查、能够承受再入高热、重量轻且坚固的隔热系统,这涉及材料和工程的双重挑战。
xAI 与 Grok:用推理重构“真理数据”,AI 智能爆发在即
谈及旗下人工智能公司 xAI 及其模型 Grok,Musk 揭示了一个关键创新方向:利用大量推理算力来净化和增强训练数据。Grok 正在审视所有人类知识源(如维基百科、书籍、网站),评估其中每条信息的真实性、完整性和谬误,然后重写内容,以纠正错误、补充缺失背景、消除虚假信息。
主持人建议将这种“修正版”知识库(戏称为“Grokpedia”)公开发布,以对抗现有百科中的偏见和信息战,Musk 对此表示会与团队讨论。
关于 AI 智能的演进速度,Musk 给出了大胆预测。他认为,智能提升与计算量之间大致呈对数关系,例如 10 倍的计算量可能使智能翻倍。基于此,他估计:“AI 可能在明年(2025年)就在任何单一事务上比任何单个人类更聪明。” 而到 2030 年,AI 的智能总和可能超过所有人类。
Musk 将 AI 的进化视为宇宙智能规模扩张的一部分。他对比说,人类智能随着人口增长和信息存储增加而提升,但目前因人口增长停滞甚至下降而面临平台期。AI 则可能继续沿着算力增长的曲线,将智能推向新的高度。
对“西方自杀”的忧虑与“好奇心哲学”的救赎
在访谈后半段,话题转向更宏观的文明层面。Musk 表达了对“西方自杀”倾向的深切担忧。他指出几个症状:低于更替水平的生育率、开放的边境政策导致社会结构撕裂、犯罪问题被精英媒体选择性忽视。他认为,当人们失去对未来的乐观和使命感时,文明就会走向衰败。
“生育孩子是对未来乐观的一种行为。” Musk 说。他提出,需要一种能激发人们乐观和兴奋的哲学或信仰来填补空白。对他个人而言,这就是一种“好奇心哲学”——渴望了解宇宙的本质,扩展意识和人类的存在范围。
正是这种哲学驱动着他所有的商业冒险:探索太空、成为多行星物种、发展 AI 以扩展认知边界。他引用《银河系漫游指南》的隐喻:答案(宇宙)就在那里,难的是提出正确的问题。人类需要不断成长和拓展,才能提出并理解那些关于宇宙的根本问题。
火星时间表:25-30 年内建立自给自足文明
将好奇心哲学付诸实践的最宏大项目,便是让人类成为多行星物种,特别是殖民火星。Musk 阐述了其核心逻辑和预期时间表。
他强调,关键不在于最早几次的火星任务,而在于能否向火星输送足够的物资和能力,使其在来自地球的补给中断后仍能持续繁荣。这意味着要在火星上重建完整的文明基础设施,甚至包括芯片工厂。
Musk 给出了一个相对具体的时间框架:如果一切顺利,Starship 运力能随着每两年一次的火星发射窗口呈指数级增长,那么大约在 25-30 年内,人类有可能在火星上建立起自给自足的文明。 这需要大约 10 到 15 个火星发射窗口的持续努力。
“文明之弧是继续上升,使我们能在火星实现自给自足,还是会在那之前下降?” Musk 设问。他认为,当前是人类 45 亿年历史中首次拥有使生命多行星化的窗口期。实现这一点,将把意识的可能寿命极大地延长,因为人类文明不再完全依赖于单一星球(地球)的完好无损。在他看来,这比火星早期采用何种治理形式更为根本和重要。Ripple (XRP) 买?卖?… GPT · Claude · Grok 的不同展望瑞波币(XRP)尽管出现短期反弹,但未能形成明显趋势,仍在箱体区间内运行。主要AI模型普遍将当前区间定义为“方向性等待区间”,并判断市场正处于中期下跌结构中的短期反弹尝试反复出现的局面。
目前XRP交易价约在1.43美元附近,在未能突破1.48美元阻力位后,重新回到箱体区间。RSI处于52水平,既非过热也非超卖,停留在中性状态,这被解读为蓄力区间。
不过中期趋势依然疲弱。三个模型均指出,价格低于200日移动平均线(约1.72美元)是核心利空因素。当前价格较该长期阻力位低约16%,从结构上看,尚未确认完全的趋势反转。
GPT-5.2
GPT-5.2将当前区间定义为“试图重新进入箱体区间的中性-偏弱结构”。该模型特别注意到,在1.48美元区间反复出现卖盘,限制了上涨空间。该模型认为,只有在突破1.48美元后,才有可能短期扩展至1.52~1.58美元;反之,若跌破1.38美元,下行风险可能打开至1.31美元,甚至1.25美元。
Claude Sonnet 4.6
Claude以更为保守的视角,将当前走势评估为“下跌趋势中的反弹尝试失败区间”。该模型指出,斐波那契23.6%回撤位所在的1.47~1.48美元构成强阻力,且成交量萎缩伴随动能减弱,这被解读为看空信号。其最可能的预测情景是在1.42~1.45美元箱体内横盘整理,若跌破1.42美元,则可能回调至1.39~1.37美元。
xAI 4.1
xAI将市场判断为“中性但下行压力略占优势的横盘区间”。该分析认为,近期成交量增加和逢低买盘涌入是积极因素,但价格仍位于主要移动平均线下方,上涨动力受限。短期内预计将在1.41~1.45美元箱体区间内波动,能否重新突破1.48美元将是关键转折点。
综合三个模型的分析,XRP目前处于“中期下跌趋势中的短期横盘”结构。尤其是1.38美元支撑位与1.48美元阻力位之间的箱体区间,正成为决定短期方向的关键区域。
未来24小时内的主要情景大致有三种。首先,若突破1.48美元,短期可能上看1.50~1.52美元,扩展后有望升至1.58美元。反之,若1.38美元支撑位失守,下行压力可能扩大至1.36美元,甚至1.31美元。最可能出现的情景是在1.38~1.48美元区间内横盘,待波动性收窄后选择方向。
最终,尽管当前XRP市场存在成交量增加和逢低买盘涌入等积极因素,但受中期下跌结构和强阻力位影响,上涨空间受限。因此,短期内技术性支撑位和阻力位将成为决定市场方向的核心变量。
各模型预测
GPT-5.2给出预期高点1.52美元,预期低点1.36美元,反弹概率56%。
Claude Sonnet 4.6给出更为保守的预测,预期高点1.475美元,预期低点1.405美元,反弹概率48%。
xAI 4.1给出预期高点1.49美元,预期低点1.37美元,反弹概率47%,更侧重于弱势横盘的可能性。
RSI(相对强弱指数)反映价格上涨和下跌的强度,50以上为买方占优,70以上视为超买。200日移动平均线是判断市场中长期趋势的核心指标,价格位于该线下方时,通常被视为处于下跌趋势。斐波那契回撤是用于识别主要支撑和阻力区间的技术工具。
但需要注意的是,此类分析是基于历史数据的概率性解读,实际市场可能因宏观经济变量和投资心理而出现大幅变化。
本文基于AI数据分析撰写,不构成对特定资产的买入或卖出建议。在短期波动加剧的区间内,价格可能朝着与预测不同的方向运行,投资决策应在个人责任下审慎做出。瑞波币(XRP)该买还是该卖?……GPT、Claude、Grok的分歧展望瑞波币(XRP)在延续短期反弹走势的同时,仍未能在核心阻力区间1.50美元附近明确方向,正处在十字路口。多款主流AI模型普遍认为上涨动能得以维持,但同时分析指出,这属于中长期下跌结构中的技术性反弹阶段,因此需要采取谨慎态度。
目前XRP交易价格约为1.49美元,较近期低点(1.36美元)上涨约9%。RSI(相对强弱指数)处于62水平,位于即将进入超买区的区间,显示后续仍有上涨空间,但同时也意味着短期过热压力正在加大。
技术走势:虽有反弹,但仍处下跌趋势
三款模型均共同分析指出,虽然当前XRP呈现短期上涨走势,但由于仍位于200日移动平均线(约1.73美元)下方,中期下跌趋势得以维持。从机构资金的视角来看,这意味着当前状态更接近于技术性反弹,而非“完全的趋势逆转”。
从斐波那契指标来看,当前区间也被解读为进入实质性阻力带之前的初期反弹区间。分析认为,要实现真正的上升趋势逆转,至少需要突破1.70美元以上。
核心价格区间:1.42美元 vs 1.50美元
AI模型共同关注的核心区间是1.42美元支撑位和1.50美元阻力位。1.42美元是近期高点转为支撑的区间,若该水平得以维持,则上涨情景依然有效。而1.50美元则既是心理阻力位,也是短期获利了结盘集中的区间。
特别是,是否伴随交易量的突破被视为核心变量。近期上涨伴随交易量增加,但在部分区间也出现了交易量减少的信号,这同时对上涨的持续性提出了疑问。
各模型观点差异
GPT-5.2通过基于概率的分析,将当前定义为“仍有上涨余力的反弹区间”,并提出若突破1.50美元,可能扩展至1.53~1.58美元区间。不过,该模型也提及了若突破失败,存在下跌至1.38美元的风险。
Claude Sonnet 4.6持更为保守的观点,认为短期上涨动能强劲,但强调了因进入过热区间而可能出现的回调可能性。特别是,鉴于1.50~1.73美元区间阻力集中,该模型建议采取区间应对策略,而非追高买入。
xAI 4.1则在供需和动能方面表现出相对乐观的立场。该模型以交易量增加和买盘流入为依据,对反弹概率给予较高评价,并分析认为若突破1.50美元,短期上涨弹性可能得到加强。
24小时情景
综合三款模型,短期走势可概括为三种情形。首先,若突破1.50美元,则上涨可能扩大至1.52~1.58美元区间。相反,若1.42美元支撑位失守,则下跌压力可能加大至1.38美元,甚至1.34美元。最现实的场景是在1.42~1.50美元区间内进行箱体盘整,待能量积聚后决定方向。
综合展望
当前XRP虽在短期维持上涨动能,但结构上仍处于下跌趋势中的反弹区间,处于这种双重位置。因此,技术指标和供需流向正成为左右短期方向的关键因素。
最终,市场的核心问题十分明确:是突破1.50美元以扩展上升趋势,还是受阻于阻力位而重回调整区间?对于投资者而言,在方向确定之前,需要采取以支撑位和阻力位为中心的保守策略。
本文基于AI数据分析撰写,并非对特定资产的买入或卖出建议。在短期波动性扩大的区间内,价格可能朝与预测不同的方向变动,投资判断应在个人责任下谨慎做出。**瑞波币(XRP)该买还是该卖?……GPT、Claude、Grok 给出的不同展望**瑞波币(XRP)在短期反弹后未能形成明显趋势,继续呈现区间震荡走势。主要AI模型将当前阶段定义为“弱势恢复中的方向探索期”,并一致指出核心支撑位和交易量恢复情况是短期的关键分水岭。
目前XRP在1.43美元附近反复波动,技术面上处于中性区间。RSI(相对强弱指数)约为53水平,买卖力量趋于平衡,既未过热也未低迷。但价格仍低于200日移动平均线(1.73美元),中长期下行趋势持续,这构成压力因素。
GPT-5.2
GPT-5.2将当前走势解读为“下跌趋势中技术性反弹后的收敛阶段”。它特别指出1.38美元为核心支撑位,1.48美元为主要阻力位,并分析认为能量正围绕该区间积聚。突破1.48美元时,可能因空头回补流入而反弹至1.52~1.55美元;反之,若跌破1.38美元,则警告可能快速下跌至1.30美元初期。短期反弹概率估计约为57%。
克劳德 4.6
Claude Sonnet 4.6在供需方面保持更为保守的观点。它指出近期交易量骤减、市场参与度大幅下降是核心风险,这通常可能导致价格下行压力。但分析认为,1.37~1.40美元区间形成了较强支撑层,因此暴跌可能性有限。短期内,最看好1.40~1.45美元区间横盘整理的可能性,反弹概率为35%。
xAI 4.1
xAI在交易量与动能方面则强调相对积极的信号。它注意到近期反弹区间交易量激增,确认了实质性买盘流入,且RSI在中性区间仍留有上升余地。不过,高点之后交易量再次减少,导致上涨动力减弱,这被视为不利因素。它提出,若收复1.43美元并伴随交易量增加,则有可能突破1.48美元,反弹概率评估为60%。
综合三个模型的分析,XRP目前处于“区间收敛+等待方向”的阶段。共同点在于1.38美元支撑位和1.48美元阻力位构成短期核心区间,趋势很可能根据突破该范围的走向而定。
未来24小时的情景可概括为三种。第一,突破1.48美元时,可能伴随空头回补,短期上涨至1.52~1.55美元。第二,跌破1.38美元时,可能快速下跌至1.33~1.30美元区间。第三,若在未恢复交易量的情况下停留在1.38~1.48美元区间,则横盘走势很可能持续。
最终,当前XRP市场的核心变量不是“价格”而是“交易量”。支撑位虽相对明确,但缺乏突破或防守所需的供需力量。没有交易量配合的突破很可能以“假信号”告终,因此短期交易中确认供需是必不可少的环节。
各模型展望
GPT-5.2: 预计高点1.52美元,预计低点1.34美元,反弹概率57%
Claude 4.6: 预计高点1.48~1.52美元,预计低点1.36~1.38美元,反弹概率35%
xAI 4.1: 预计高点1.48美元,预计低点1.37美元,反弹概率60%
从技术指标来看,RSI反映买卖强度,在中性区间时,一旦方向突破,趋势往往会加强。200日移动平均线用于判断长期趋势,当前价格位于该线下方时,通常被解读为结构性弱势。斐波那契回调用于预测主要支撑和阻力区间。
但需注意,这些指标基于概率性解读,实际市场可能受到比特币走势、利率环境、监管事件等外部因素的显著影响。
本文参考AI基础数据分析撰写,并非对特定资产的买入或卖出建议。在短期波动性扩大的区间内,价格可能朝与预测相反的方向波动,投资判断应在个人责任下慎重做出。瑞波币(XRP)该买还是该卖?……GPT、Claude与Grok的相左预测尽管瑞波币(XRP)显示出一些短期反弹信号,但仍未确定明确方向,持续呈现区间波动走势。各大AI模型普遍将当前阶段评估为“弱势上涨初期”,但同时分析指出,由于长期下跌结构依然有效,需要保持谨慎态度。
目前XRP交易于1.43美元附近,在近期高点1.478美元之后经历了小幅调整。RSI(相对强弱指数)处于54水平,高于中性线,显示出短期动能转换信号,但尚未进入过热区间,因此上涨动能也较为有限。
技术上最重要的部分是长期趋势。200日移动平均线位于约1.74美元,当前价格大幅低于该线。这意味着市场仍处于结构性下跌趋势中。不过,由于当前价格位于较近期低点反弹的区间,趋势转换的初期可能性也同时存在。
GPT-5.2
GPT-5.2将当前阶段定义为“弱势上涨中的区间转换局面”。它将1.41美元视为关键支撑位,1.47美元视为强阻力位,并认为在该范围内横盘整理的可能性最高。该模型认为短期反弹概率约为58%,但同时基于成交量减少和阻力区域的卖压分析,认为上涨的持续性有限。
克劳德 4.6
Claude Sonnet 4.6 持更为保守的观点。它将当前定义为“下跌趋势线内的阻力测试区间”,并将反弹概率评估为较低的38%。该模型特别指出近期成交量骤减是核心风险。分析认为,在这种情况下,流动性不足可能导致波动性扩大,进而再度增强下行压力。
xAI 4.1
xAI 4.1 在供需方面捕捉到了相对积极的信号。分析指出,近期买单成交量优于卖单,存在空头回补的可能性。RSI 站上50线也被解读为初期上涨信号。然而,由于价格仍位于 SMA200 下方,结构性弱势依然有效,短期反弹概率被保守评估为约55%的水平。
综合三个模型的分析,XRP 目前处于“长期下跌趋势中的短期反弹尝试”这一双重结构之中。特别是1.41美元支撑位和1.47美元阻力位之间的狭窄区间,被视为决定短期方向的关键区域。
未来24小时内的主要情景可归纳为三种。第一,若突破1.47美元,短期上涨可能延伸至1.50~1.52美元。第二,若1.41美元失守,则可能迅速下跌至1.37~1.36美元区间。第三,若当前区间成交量未能配合,则在1.41~1.47美元范围内持续横盘的可能性最高。
归根结底,当前XRP市场正处于买盘流入这一积极信号与长期下跌趋势这一结构性限制同时作用的阶段。因此,从短期交易角度来看,明确应对支撑与阻力区间至关重要;从趋势投资角度来看,能否突破1.52美元以上将成为判断趋势是否真正转向的基准点。
各模型预测
GPT-5.2 给出的预测高点为1.52美元,预测低点为1.37美元,反弹概率为58%。
Claude Sonnet 4.6 给出的预测高点为1.468美元,预测低点为1.392美元,反弹概率为38%。
xAI 4.1 给出的预测高点为1.48美元,预测低点为1.36美元,反弹概率为55%。
RSI 是衡量价格涨跌强度的代表性指标,以50线为基准,用于判断市场动能方向。200日移动平均线是判断长期趋势的核心标准,当价格位于该线下方时,通常被解读为熊市。斐波那契回撤用于预测价格调整区间内的主要支撑和阻力位。
但所有技术分析均是基于历史数据的概率性解读,在实际市场中,结果可能因利率、流动性、全球投资情绪等外部变量而发生变化。
本文基于AI数据分析撰写,不构成对特定资产的买入或卖出建议。在短期波动性扩大的阶段,价格可能朝着与预测相反的方向波动,投资决策应在个人负责的前提下谨慎做出。埃隆·马斯克的Grok面临增长放缓……人工智能市场格局发生变化由埃隆·马斯克领导的AI模型Grok,尽管早期具有话题性并与社交媒体X实现联动效应,但近期在使用指标和企业市场渗透速度上落后于竞争对手,显现出增长停滞的迹象。
据《华尔街日报》(WSJ)11日(当地时间)报道,Grok的低迷不仅体现在用户数量减少上,在人工智能产业核心资源——计算基础设施的竞争中也显露无遗。收购了Grok开发商xAI的SpaceX,于6日与美国田纳西州孟菲斯的数据中心“Colossus 1”签约,将其持有的全部计算容量租赁给了Anthropic。AI模型性能很大程度上取决于大规模计算资源的获取,而将这一设施整体让给竞争对手,引发了市场解读,认为 xAI 和 Grok 在自身发展所需的资源分配上并不宽裕。尤其当前,Anthropic 和 OpenAI 正为应对激增的需求而展开计算资源争夺战,SpaceX此举相当于支持了在计算资源获取上相对困难的Anthropic,因而吸引了市场关注。
实际用户指标也不如以往。据应用分析公司AppMagic统计,Grok的下载量在2026年1月达到超过2000万次的峰值后,到4月减少至约830万次。Grok在两年前推出后,凭借与X的整合及刺激性对话等功能,在短期内吸引了公众目光,但这种话题性似乎未能转化为长期的忠实用户。研究机构Recoin Analytics对美国26万名AI用户和从业者的调查也显示,今年第二季度Grok的付费用户比例为0.174%,与一年前的0.173%几乎持平。相比之下,ChatGPT的付费用户比例则超过6%。马斯克上月底在针对OpenAI的诉讼中,于法庭上称xAI为“非常小的”企业、“AI公司中最小的”,这番言论也被解读为是对这一现状的反映。
Grok曾一度通过有争议的功能来提升使用量。据离职员工称,允许用户创作更具刺激性和煽情内容的设置,对提高参与度产生了影响。事实上,1月份下载量的激增,正是在增加了虚拟脱去照片中人物衣物的功能之后出现的。然而,该功能被广泛用于未成年人照片,导致其成为监管机构和美国国会的调查对象,公司最终限制了该功能的访问。这被解读为一个案例,表明获取短期关注的功能反而可能增加监管风险,并对服务信誉造成压力。
在企业级市场,尤其是在竞争最激烈的编码工具领域,Grok的存在感也相当有限。据市场研究机构Enterprise Technology Research(ETR)的研究主管埃里克·布拉德利称,Grok在企业组织中几乎未见增长,而Anthropic的Claude和谷歌的Gemini使用量正迅速增加。ETR在今年3月对约500人进行的问卷调查中,48%的受访者表示其所在公司正在使用Claude,并计划继续使用。这一比例较一年前的21%大幅上升。Gemini的同一比例为40%,高于一年前的27%。而Grok的这一比例仅为7%,仅较一年前的4%小幅增长。最终,当前AI市场正转变为不再单纯依靠话题性,而是由稳定性能、企业部署便利性以及充足的计算资源获取能力来决定胜负的结构,这种趋势很可能给Grok带来压力,迫使其未来若要缩小与竞争对手的差距,就必须同时调整服务战略和基础设施投资方向。瑞波币(XRP)该买还是该卖?…… GPT、Claude、Grok的不同预测瑞波币(XRP)在近期飙升后进入喘息阶段,在1.45至1.50美元区间内未能形成明确方向。各大AI模型普遍认为短期反弹动能仍然有效,但同时也指出,从中长期来看,其仍处于下跌趋势之中,因此需要谨慎对待。
目前XRP的交易价格约为1.48美元,相对强弱指数(RSI)录得64,已进入接近超买的区域。这意味着上涨动能仍在持续,但同时也表明短期回调压力正在加大。三大模型均指出,若RSI突破70,则过热信号可能得到确认。
技术走势:反弹还是趋势反转?
xAI与GPT-5.2将当前上涨解读为“短期反弹”,同时关注技术改善信号。特别是近期成交量增加和低点上移的结构,被认为是支撑买盘资金流入的因素。然而,由于价格仍低于200日移动平均线(约1.75美元),中长期下跌结构依然得以维持。
Claude则提出了更为保守的观点。分析认为,当前价格较200日线低约15%,结构性疲软走势仍在持续,此次上涨很可能仅是技术性反弹。
关键价格区间:1.45美元支撑 vs 1.50美元阻力
三大模型均将1.45美元附近视为短期关键支撑位,并将1.50美元视为第一阻力位。该区间与斐波那契回撤位及近期交易密集区重叠,将成为决定短期方向的分水岭。
若突破1.50美元,市场普遍认为可能快速上涨至1.55至1.60美元区间。相反,若跌破1.45美元,则可能出现调整扩大至1.42美元,甚至1.38美元的情景。
供需与心理:成交量是关键变量
xAI将近期成交量增加和动能扩张解读为积极信号,认为突破1.50美元后进一步上涨的潜力较大。而Claude则指出,部分区间出现成交量骤降,提及可能存在上涨疲乏的信号。GPT-5.2同样将近期K线成交量减少视为短期风险因素。
这最终意味着成交量是决定未来方向的核心变量。分析普遍认为,为了持续上涨,至少需要维持1亿单位以上的成交量。
24小时情景分析
短期内存在三种主要情景。第一,若突破1.50美元,可能出现短期飙升至1.55美元以上。第二,若跌破1.45美元,调整可能扩大至1.38美元附近。第三,在1.45至1.50美元的箱体内横盘整理,积蓄能量。目前,横盘整理情景被评估为概率最高。
各模型展望
xAI 4.1预计高点为1.52美元,低点为1.42美元,反弹概率为62%。
GPT-5.2分析预计高点为1.56美元,低点为1.38美元,反弹概率为62%。
Claude Sonnet 4.6预计高点为1.515美元,低点为1.425美元,反弹概率为45%,给出了最为保守的展望。
综合来看,XRP短期处于上涨动能与回调压力并存的“平衡区间”。成交量以及能否突破1.50美元,将成为决定未来方向的核心变量。
本文基于AI数据分析撰写,并非对特定资产的买入或卖出建议。在短期波动加剧的区间内,价格可能朝与预期不同的方向波动,投资决策应在个人责任下谨慎做出。리플(XRP) 매수? 매도?... GPT·클로드·Grok의 엇갈린 전망瑞波币(XRP)虽呈现出短期反弹走势,但仍未能摆脱中期下跌趋势的压力,目前处于方向性探索区间。主要AI模型普遍将当前区间解读为“技术性反弹与趋势阻力发生冲突的区域”,并分析指出核心价格区间的突破与否将决定短期走势。
目前XRP在1.46美元附近交易,较近期低点1.38美元录得显著反弹,但在前高1.47美元附近遭遇阻力。虽然存在交易量扩大和RSI上升等积极信号,但价格仍位于代表长期趋势的200日移动均线下方,这构成压力因素。
GPT-5.2
GPT-5.2将当前定义为“中期下跌趋势中的技术性反弹区间”。分析指出,RSI已升至60水平,买方优势得以维持,但已进入过热前的阶段,因此进一步上涨的动能可能有限。该模型特别将1.42美元作为核心支撑位,将1.48美元作为短期阻力位,认为在此范围内出现箱体震荡的可能性较高。评估认为,若突破1.48美元,短期上涨空间将打开至1.52美元;但若跌破1.42美元,也不排除快速下跌至1.38美元以下的可能性。
克劳德 4.6
Claude Sonnet 4.6 提出了更为保守的观点。虽然将RSI上升和交易量增加视为积极信号,但诊断认为,由于价格仍低于SMA200约17%,中期看跌结构依然有效。该模型特别指出1.473美元区间为强阻力,认为若突破失败,可能在重新测试1.42美元后调整至1.38至1.36美元区间。不过分析认为,若支撑位得以维持,则有限的反弹将继续,价格可能升至1.50至1.52美元区间。
xAI 4.1
xAI 4.1 关注供需和交易量的变化。该模型相对较高地评估了中期上升趋势恢复的可能性,理由是在近期形成高点过程中交易量激增40%以上,确认了买盘资金流入,同时RSI也保持着上升动能。该模型特别认为,若突破1.47美元,价格可快速扩展至1.50至1.52美元区间;反之,若1.40美元失守,则提出下跌至1.35美元的情景。
综合三个模型的分析,XRP目前正进入一个典型的过渡期——“短期上涨动能 vs 中期下跌趋势”发生冲突。共同点在于,1.42美元支撑位和1.47至1.48美元阻力位正发挥关键分水岭作用,一旦脱离此范围,波动性很可能加剧。
未来24小时的场景可归纳为三种。第一,若突破1.48美元且有交易量配合,则短期上涨将持续至1.52美元以上。第二,若1.42美元支撑位失守,则调整将扩散至1.38至1.35美元区间,形成下跌场景。第三,价格在1.42至1.48美元范围内继续蓄势型横盘整理。
最终,当前XRP市场虽然反弹信号本身有效,但尚不足以确认趋势转变。是否有交易量配合的突破将成为决定未来方向的关键变量。
各模型预测
GPT-5.2 提出的预期高点为1.52美元,预期低点为1.38美元,反弹概率为58%。
Claude Sonnet 4.6 分析预期高点在1.50美元左右,预期低点在1.36至1.40美元,反弹概率为58%。
xAI 4.1 提出的预期高点为1.52美元,预期低点为1.40美元,反弹概率为62%,给出了最高的上涨预期。
RSI 是判断市场超买或超卖状态的代表性动量指标,200日移动均线则被用作衡量长期趋势的基准线。斐波那契回撤是用于预测主要支撑和阻力区间的技术工具。然而,这些指标均是基于历史数据的概率性分析,实际价格可能因宏观经济变量和市场情绪而发生变化。
本文参考AI基础数据分析撰写,不构成对特定资产的买入或卖出建议。在短期波动性扩大的区间内,价格可能朝与预测相反的方向变动,投资决策应在个人责任下谨慎做出。马斯克宣布 Grok Bot 现已支持语音功能Techub News 消息,马斯克在 X 平台发文宣布,其 AI 产品 Grok Bot 现已支持语音功能。用户可通过链接访问并使用该功能。
(@elonmusk)Grok Voice 集成至 fal.ai 平台,为开发者提供低延迟 AI 语音代理Techub News 消息,Grok Voice 已集成至 AI 开发平台 fal.ai,旨在为开发者提供低延迟的 AI 语音代理服务。该集成简化了 AI 语音开发流程,降低了延迟和基础设施复杂性,以增强全球 AI 交互体验。
(Crypto Briefing)马斯克在 X 平台推荐 Grok Build 链接,展示 AI 应用潜力Techub News 消息,马斯克在 X 平台发布链接推荐 Grok Build,该链接指向一个 AI 应用构建平台,展示了其在人工智能领域的应用潜力。
(@elonmusk)马斯克在 X 平台推荐 Grok Bot 使用链接Techub News 消息,马斯克在 X 平台发文,推荐用户尝试使用 Grok Bot,并附上了该 AI 机器人的访问链接。马斯克旗下 xAI 公司开发的 Grok 系列模型近期动作频繁,此次推荐旨在进一步推广其 AI 产品。(@elonmusk)马斯克演示使用 Grok Bot 构建公司,展示 AI 应用潜力Techub News 消息,马斯克在 X 平台发布了一段使用 Grok Bot 构建公司的实时演示视频链接。该演示展示了 Grok Bot 在辅助公司创建流程中的应用潜力。
(@elonmusk)马斯克撤销对苹果的反垄断诉讼,但继续针对 OpenAITechub News 消息,埃隆·马斯克已撤销对苹果公司的反垄断诉讼,但针对 OpenAI 的诉讼将继续进行。马斯克此前指控苹果与 OpenAI 的合作在智能手机和聊天机器人市场形成了垄断,并声称其 AI 聊天机器人 Grok 在苹果应用商店的排名受到非法压制。
(Ars Technica)马斯克称 Grok 5 可能实现通用人工智能 (AGI)Techub News 消息,xAI 创始人埃隆·马斯克在 X 平台发文表示,其下一代模型 Grok 5 预计将实现通用人工智能 (AGI)。马斯克称,即将完成训练的 Grok 4.8 会有明显改进,Grok 4.9 有望达到 Astra 或 Fable 级别性能,而 Grok 5 可能会“超越一切”。
马斯克表示,Grok 4.7 与 Anthropic 的 Opus 5.0 大致相当,在多模态性能方面仍需改进。他近日支持 Anthropic 联合创始人关于放缓 AI 能力开发的呼吁,而其自身 AGI 时间表的预测也突显了行业在追求突破与控制风险之间的张力。(BeInCrypto)马斯克旗下 xAI 发布 Grok Bot 本地路由功能Techub News 消息,马斯克旗下人工智能公司 xAI 宣布,其 AI 助手 Grok Bot 现已支持通过用户本地机器进行路由。该功能旨在提升响应速度与隐私保护。
用户可通过官方链接下载并配置该功能,使 AI 交互数据处理在本地设备上完成。 (@elonmusk)微软 Copilot 集成 Grok 模型以增强 AI 选项Techub News 消息,微软在其 AI 助手 Copilot 中新增集成了由 xAI 开发的 Grok 系列模型,旨在为用户提供更丰富的 AI 模型选择,增强灵活性与韧性。此举也带来了在维持服务质量与治理方面的新挑战。
(Crypto Briefing)SpaceXAI 团队将直播用 AI 智能体在 72 小时内创建初创公司Techub News 消息,埃隆·马斯克旗下 AI 公司 SpaceXAI 的三名员工将于 9 月 15 日至 17 日进行一场名为“Grok Bot Galaxy”的直播活动,尝试在 72 小时内从零开始创建一家初创公司。他们将在直播中实时决定公司名称、产品和商业计划,并使用其 AI 智能体产品 Grok Bot 来完成构思、规划、产品开发和工程部署等所有环节。
SpaceXAI 是 SpaceX 于今年 2 月以 2500 亿美元全股票交易收购 xAI 后成立的公司,并于 8 月以 600 亿美元收购了编程公司 Cursor。马斯克近期承认,在竞争对手 Anthropic 的 Claude 模型被滥用于网络行动、欺诈等领域的报告背景下,Grok 目前尚未成为该领域的首选。
此次直播将在旧金山举行并进行全球直播,每日太平洋时间上午 8:30 至下午 6:00 进行。活动旨在展示 Grok Bot 的能力,但外界关注点在于三位构建者将在多大程度上引导和修正 AI 智能体的决策。 (BeInCrypto)GCSA Agent 在全球高难度真实漏洞基准测试中展现自主漏洞分析与 PoC 生成能力 GCSA Agent 在全球高难度真实漏洞基准测试中展现自主漏洞分析与 PoC 生成能力。 香港,2026 年 8 月 29 日 —— 全球网络安全联盟(Global Cybersecurity Alliance,GCSA)今日宣布,GCSA Agent 在 CyberGym 基准测试中取得 91.3% 的成功率,进入 CyberGym “Leading Systems Above 90%” 领先系统区间。 CyberGym (https://www.cybergym.io/cybergym) 是由美国加州大学伯克利分校研究团队开发的大规模真实世界网络安全评测框架,共收录 1,507 个历史真实漏洞测试实例,覆盖 188 个大型软件项目,旨在评估 AI 智能体在真实漏洞分析场景中的实际能力。 与主要评估代码理解、知识问答或静态分析能力的传统 AI Benchmark 不同,CyberGym 要求 AI 智能体直接面对真实的漏洞代码环境。 在其核心 Level 1 测试中,AI Agent 仅获得漏洞描述以及尚未修复的代码库,需要自主完成代码分析、漏洞定位、攻击路径推理、PoC 构造和执行验证。只有生成的 PoC 能够在漏洞版本中成功触发目标漏洞、同时无法在修复后的版本中复现,任务才被认定为成功。 因此,CyberGym 所衡量的并不仅是 AI 是否“理解代码”,而是 AI 是否能够真正完成从安全分析到漏洞复现和验证的完整过程。 从大模型走向安全智能体 本次 CyberGym 测试中,GCSA Agent 基于 Grok 4.5 与 Grok 4.6 模型运行,最终取得 91.3% 的成功率。 这一结果也反映出 AI 网络安全领域正在发生的一项重要变化: 决定最终安全能力的,不再只是底层大模型本身。 真实漏洞研究通常需要连续完成漏洞描述理解、大规模代码检索、攻击面识别、漏洞假设建立、测试输入生成、程序执行、反馈分析以及 PoC 反复迭代等多个环节。 GCSA Agent 围绕这一完整过程构建智能体化安全工作流。 其目标并非简单地利用大语言模型进行代码分析,而是让 AI 能够进入真实执行环境,围绕安全问题自主形成假设、收集运行证据、执行测试,并最终以可复现结果验证安全发现。 此次 CyberGym 测试,为这一能力提供了一个可量化的外部基准。 面向真实世界的漏洞研究能力 CyberGym 的核心价值,在于缩小传统 AI 测试与真实网络安全研究之间的差距。 其评测环境会恢复软件项目漏洞修复前的代码状态,AI Agent 可能需要在包含数千个文件、数百万行代码的大型代码库中自主定位问题,并最终生成能够真正触发漏洞的 PoC。 更值得关注的是,CyberGym 的进一步研究已经显示,这种智能体化安全能力并不局限于复现已知漏洞。 在开放式漏洞研究实验中,AI Agent 已发现多项此前未知的零日漏洞(Zero-day Vulnerabilities)以及历史上并未完全修复的安全补丁,显示出自主漏洞分析技术向真实漏洞发现能力迁移的潜力。 对 GCSA 而言,这也是更重要的发展方向。 Benchmark 成绩不是终点。 GCSA 的目标,是进一步建立能够服务真实网络安全场景的 AI Security Agent,使其逐步参与漏洞发现、分析、验证乃至后续修复的完整安全生命周期。 构建 AI 原生网络安全能力 随着人工智能加速软件开发,AI 同样正在改变漏洞研究与网络攻防的方式。 面对规模越来越大、复杂度越来越高的软件系统,下一代网络安全体系将越来越依赖人类安全专家与自主 AI 智能体之间的协作。 AI Security Agent 有望帮助安全团队: * 更早发现具有真实利用价值的软件漏洞; * 在大型代码库中自动分析复杂攻击路径; * 自动生成 PoC,对漏洞进行执行级验证; * 通过真实运行结果降低传统安全检测中的误报; * 加快漏洞研判、验证与修复效率; * 扩展专业安全团队能够覆盖的软件与系统规模。 GCSA Agent 在 CyberGym 取得 91.3% 的成绩,是 GCSA 构建 AI 原生网络安全能力的重要阶段性成果。 未来,GCSA 将继续推进自主漏洞分析、AI Security Agent 与智能化网络安全技术研究,将前沿人工智能能力进一步转化为真实世界中的安全能力,为构建更加安全、可信和具有韧性的数字环境提供技术支持。 来源: GCSA全球网络安全联盟 官网: www.gcsa.org
