扫码下载
搜索“大模型”共有10条相关结果
Techub News 消息,比特币开发者 Jameson Lopp 在 X 平台发文表示,他最近收到一份 50 页的法律合同,面临两种选择:一是支付数千美元聘请律师花费数小时审阅,二是花费不到 1 美元,让一个 2 万亿参数的大语言模型在 20 分钟内完成审阅。他指出,这 1 美元推理代币的投资回报率令人震惊。 Lopp 的分享展示了 AI 大模型在替代传统专业服务、显著降低成本与时间方面的潜力,尤其是在法律文件处理等场景。(@lopp)
Techub News 消息,9月15日,由AI大模型工场主办的“2026 AI产业生态大会”在北京举行。大会旨在探讨AI产业的智能生长与生态共生。(量子位)
Techub News 消息,B站“AI无限竞技场”于9月16日正式上线,首期大模型测评榜单同步公布。榜单汇集全球百大AI模型进行同场竞技,结果显示OpenAI的GPT-6模型高居榜首。 (量子位)
Techub News 消息,稳准智能联合清华大学发布新一代结构化数据基础模型 LimiX-2。该模型参数规模提升至 400M,并在国际评测榜单中排名第一。 (量子位)
Techub News 消息,7名博士生仅用3个月时间,从零开始成功训练出一个70亿参数的大语言模型。该项目全程由数百个AI智能体(Agent)参与研发,实现了AI辅助AI开发的流程。团队已将完整的训练代码、数据集以及详细的训练日志全部开源,旨在为学术界提供可复现的研究范本。(量子位)
Techub News 消息,研究人员发布 Fly Language Model(FLM),将完整的雄性果蝇中枢神经系统连接组(166,700 个节点、2558 万条有向边)接入一个冻结的 LiquidAI LFM2.5-1.2B-Instruct 大语言模型主干。该模型仅训练 27.8 万个参数的读出层,占主干参数的约 0.0238%。 在 32 个日常对话数据集上的测试显示,接入果蝇连接组的模型将每个词元的负对数似然降低了 0.0222 纳特,但一个无连接图的直接输入控制模型在所有三次实验种子中表现更优,差异为 0.000488 纳特。研究证明,连接组确实参与了计算,但并未带来特异性增益,且其状态记忆每词元衰减 0.6,未能提供长期记忆。 开发者明确表示不宣称这是首个基于连接组的语言模型,其特点在于使用了完整的连接组图并采用冻结主干设计。模型代码已在 MIT 许可下开源,可在本地 Python 3.12 环境运行。 (MarkTechPost)
Techub News 消息,蚂蚁集团旗下百灵大模型发布首个金融增强开放模型 Ling-3.0-flash-Fin。该模型专为金融场景设计,旨在进入真实的投资研究等工作流程。 (量子位)
Techub News 消息,Z.ai 发布了 GLM-5.3-Flash,这是 GLM-5 系列中首个原生多模态模型,也是该实验室推出的最具性价比的编程模型。它是一个混合专家模型,总参数量为 3200 亿,每个令牌激活 180 亿参数,上下文窗口达 1,048,576 个令牌,并支持图像和视频输入。该模型以 MIT 许可证发布,权重已上传至 Hugging Face。 Z.ai 报告称,该模型在基准测试和实际工作负载中均优于 GLM-5.2,价格约为其十分之一,并在其内部编程基准测试中与 Claude Opus 4.8 的差距在半个百分点以内。模型的首周预览以“Ox Alpha”匿名身份在 OpenCode 和 OpenRouter 上运行,完全基于国产中国 AI 芯片提供服务。 该模型可在 Hugging Face 上获取权重,并已提供托管 API 服务。默认 FP8 检查点权重约为 306 GiB,当前 vLLM 路径仅支持 NVIDIA Hopper 及更新架构,这意味着中型和大型组织或租用 GPU 容量的 AI 原生初创公司可自行托管。 (MarkTechPost)
Techub News 消息,腾讯混元新一代硬核基座大模型 Hy3 已在官网上线并免费全量开放。该模型旨在与当前领先的模型竞争,腾讯鼓励用户对其能力进行评估。 (@justinsuntron)
Techub News 消息,特斯拉在中国市场全系车型的车载系统中正式接入字节跳动旗下豆包大模型。此举旨在通过本地化 AI 技术以满足监管要求并提升用户体验。(Crypto Briefing)