SAP CEO Christian Klein(克里斯蒂安·克莱因):AI 飞轮驱动企业韧性撰文:Techub News 整理
导语
在 2025 年于奥兰多举行的 SAP Sapphire 年度大会上,SAP 首席执行官 Christian Klein(克里斯蒂安·克莱因)发表了长达近两小时的主题演讲。面对全球经济波动、地缘政治紧张和 AI 技术重塑商业格局的宏观背景,Klein 的核心信息聚焦于“不确定性”——这是当今所有企业面临的共同挑战。他阐述了 SAP 如何通过其“业务 AI”战略和“飞轮”理念,帮助企业构建韧性、提升竞争力,并重新构想业务流程。本次演讲不仅是对 SAP 产品路线图的一次集中展示,更揭示了这家企业软件巨头在 AI 时代如何定位自身,以应对来自新兴 AI 公司和传统竞争对手的双重挑战。
摘要
SAP 提出由应用、数据、AI 构成的“飞轮”效应,是企业应对不确定性的核心引擎。
业务 AI 助手 Juul 升级为“无处不在、无所不答”的智能体,可跨 SAP 及非 SAP 应用工作,并与 Perplexity 合作整合外部网络信息。
推出“AI 智能体中心”和“提示词优化器”等工具,旨在规模化部署和管理 AI 智能体,并降低模型切换成本。
发布面向特定业务线的“智能应用”和深化与 Palantir、Adobe 等伙伴的数据合作,强化其数据平台 Business Data Cloud。
宣布与埃森哲推出“Advance”计划,并优化“RISE with SAP”迁移方案,承诺让客户上云之旅更快、更简单、成本更低。
应对不确定性:SAP 的“飞轮”承诺
Christian Klein(克里斯蒂安·克莱因)在演讲开篇即直面全球企业共同困境:市场波动、通胀压力、供应链中断、地缘政治风险以及 AI 竞赛带来的剧变。他指出,SAP 虽无法消除宏观不确定性,但其使命是帮助企业变得更坚韧、更具竞争力。
为此,SAP 提出了其核心战略框架——“飞轮”。这个类比物理学的概念包含三个相互驱动的元素:应用(拥有最广泛、最关键的端到端业务流程组合)、数据(这些应用产生的丰富、语义化的关键业务数据)以及AI(基于这些海量数据构建的强大业务 AI)。AI 反过来又会被注入回应用中,驱动飞轮加速旋转,形成正向循环。
Klein 强调,SAP 的独特优势在于其对企业业务流程和行业特性的深刻理解,这使其能够访问到其他科技公司无法比拟的、富含语义的业务数据海洋,从而训练出真正懂业务的 AI。
业务 AI 重塑工作方式:Juul 成为“超级用户”
演讲的核心演示环节展示了 SAP 业务套件与嵌入式 AI 如何协同工作,帮助一家虚构公司应对突发的关税挑战。通过 CFO、首席营收官、COO 和 CHRO 四个角色的无缝衔接,展现了从风险识别、财务影响模拟、销售策略调整、供应链响应到人力资源规划的全流程、实时协同。这一切都通过统一的 AI 助手 Juul 在集成的业务套件中完成,避免了传统烟囱式系统间的数据孤岛和延迟。
SAP 董事会成员 Muhammad Alam 随后解释了为何这种“飞轮”效应在传统异构、分散的应用环境中难以实现。他称之为“冰山效应”——企业将 80% 的资源和预算耗费在整合应用和数据这种“水下”的繁重工作上,只有 20% 用于创造价值。在 AI 时代,这种脆弱的平衡被彻底打破,因为 AI 需要端到端的业务流程上下文才能创造指数级价值。
Alam 断言,在 AI 时代,单一“最佳单品”应用的优势正在消失,应用层将像云基础设施一样被商品化。未来的价值在于“套件即服务”,即 SAP 提供的“最佳单品级套件”,它能原生地实现飞轮效应,让企业专注于利用端到端上下文创造差异化价值。
Christian Klein(克里斯蒂安·克莱因)回归舞台后,宣布了 SAP 业务 AI 的雄心目标:让每位终端用户的生产力提升 30%。为实现这一目标,SAP 正将用户交互方式从传统的 GUI、移动端,推向以自然语言与 AI 交互的新时代。
Juul 的进化体现在两个维度:“无处不在”和“无所不答”。通过整合去年收购的 WalkMe(数字化应用采纳平台),Juul 将成为一个“全在、全时、主动、个性化”的 AI 助手,出现在任何 SAP 或非 SAP 应用(如 ServiceNow、Gmail、LinkedIn)中,理解屏幕内容并提供情境化帮助与自动化建议。
现场演示显示,一位供应链经理在 ServiceNow 中收到物料批次问题的紧急工单,Juul 能即时总结问题、评估影响(如无备用供应商的风险),并推荐行动。随后,Juul 可跨应用自动在 SAP Ariba 中寻找供应商、在 Gmail 中检索历史报价、生成 RFP(询价请求)、创建采购订单,并最终回到 ServiceNow 更新工单状态,整个过程无需用户在不同系统间手动切换。
在“无所不答”方面,SAP 宣布与 AI 答案引擎 Perplexity 建立合作伙伴关系。Perplexity CEO Aravind Srinivas 登台解释,其产品旨在提供可信、可溯源答案,而非一堆链接。合作后,Juul 将能结合企业内部 SAP 结构化数据与 Perplexity 索引的整个网络新闻和公共信息,回答更广泛的业务问题。例如,用户可以询问“某国新关税政策对我的业务意味着什么?”,Juul 将关联内部该国业务数据与外部关税信息,给出综合分析。
从“洞察到行动”到“推理并行动”:AI 智能体与基础架构
SAP 首席技术官 Philip Herzig 登台,回顾了 SAP 业务 AI 的进展:Juul 已支持超 1600 项技能,覆盖 HR、财务、供应链等广泛任务;生成式 AI 场景已交付超 230 个,预计到年底将超 400 个。他分享了客户案例:英国电信(BT)使用 AI 将寻找合适技能候选人的时间节省了 85%;普华永道(PwC)为诺和诺德(Novo Nordisk)设计的税务解决方案,每年节省了三年的人工工作量;博世(Bosch)利用 Juul for Developers 将开发人员生产力提升了 10%。
渣打银行(Standard Chartered)的代表 Tom Fox 和 Melinda McKinley 分享了他们的转型之旅。他们从六年前拥有 30 多个财务和国库系统、关账需三周的混乱状态,通过采用 SAP RISE 方案和坚持“清洁核心”原则,成功将每年约 2 万亿美元客户账户交易迁移至 SAP S/4HANA。他们利用嵌入式 AI 核心能力,在六周内实现了用户过去梦寐以求的功能,例如使用 AI 预测分析师在财报电话会议上可能提出的问题(准确率约 80%),以及在几天内构建出能分析关税影响的“关税智能体”。
Herzig 随后阐述了 SAP 的 AI 战略三层架构:Juul(新用户体验)、Juul 智能体(重新构想业务流程)和BTP 上的 AI 基础层。他宣布 SAP 正在实现从“洞察到行动”到“推理并行动”的范式转变。新一代“智能体”将具备推理和协作能力。
例如,全新的财务风险与规划智能体能基于外部市场数据(如来自 Perplexity)和内部分析数据进行推理,识别关键风险并提出缓解策略(如供应商多元化、新定价策略),然后模拟对损益表的影响,再由规划智能体接管并在供应链或财务中实施战术。全新的应计费用智能体通过“学习”公司数百页的会计手册,结合财务数据,能在财务结算期间自动提出正确的应计费用建议,将手工工作量削减高达 90%。
为管理日益增多的智能体(来自 SAP 应用、客户自定义或第三方),SAP 推出了“AI 智能体中心”(作为 SAP LeanIX 的一部分)。它可以将每个 AI 智能体映射到其支持的相应业务能力或流程步骤,实现可视化、发现自动化缺口,并确保智能体符合企业的伦理和合规标准。
在 AI 基础架构层面,SAP AI Foundation on BTP 已提供超 90 项技术能力,并新增了 AI 智能体运行时、AI 评估服务等 60 多项新功能。它支持最新的 AI 模型,如 GPT-4o、Claude 3.7 Sonnet、Gemini 2.5,也提供与 Mistral、Meta 等合作的自托管模型,以及行业特定模型(如与 Datalogix 合作引入其金融和供应链模型)。
针对模型切换的挑战(因性能、成本、法规等原因),SAP 与旧金山的 Not Diamond AI 实验室合作,推出了“提示词优化器”。该功能可一键将现有针对某模型的提示词,自动优化并转换为适用于其他模型的版本。Herzig 认为,这标志着“提示词工程”成为过去,未来将是“基准工程”的时代——专注于描述 AI 用例的预期结果,而非明确指示模型如何做。
最后,Herzig 展望了将 Juul 智能体带入物理世界的未来。通过展示与 Nvidia 和机器人公司 NeoBotix 的合作,演示了人形机器人如何利用 SAP 视觉检测模型判断注塑机是否需要维护,并通过 Juul 与后台维护智能体交互,调度另一台机器人取送替换零件。这预示着 AI 将深度融合数字与物理世界。
数据:智能应用的基石与开放生态
Christian Klein(克里斯蒂安·克莱因)将话题转向飞轮的第二个元素——数据。他重点介绍了今年二月推出的 SAP Business Data Cloud(BDC),称之为企业在不确定时代的“水晶球”,提供业界最大的语义化数据层。
Muhammad Alam 进一步阐释,BDC 集成了 SAP 管理的、采用统一数据模型的数据产品、用于统一 SAP 与非 SAP 应用数据的“数据编织”层,以及与 Databricks 合作的顶级数据工程平台。他宣布了首批基于 BDC 的“智能应用”:面向私有云客户的 Cloud ERP Intelligence(整合财务、供应链及可持续发展数据)、People Intelligence(基于 SuccessFactors、Fieldglass 和财务数据)以及 Spend Intelligence(全面支出视图)。
在开放生态方面,SAP 宣布与 Adobe 合作,后者正在开发一款结合 SAP Cloud ERP 数据与 Adobe Experience Platform 数据的智能应用,以实现更精准的财务、供应链计划和营销活动。同时,SAP BDC 与 Databricks 的结合方案将扩展到所有主流超大规模云平台(AWS 现已可用,GCP 和 Azure 将在未来几个月推出)。
现场演示展示了 CFO、首席采购官、CHRO 等角色如何通过自然语言询问 Juul,直接跳转到相应的智能应用仪表板,查看现金流、可持续发展目标、供应商关联以获取批量折扣、人才流动与员工敬业度等实时洞察。数据科学家则可在 BDC 内直接使用 SAP Databricks 进行员工流失预测建模,并利用 AI 模拟能力分析成千上万种业务场景,找出影响流失率的关键驱动因素(如薪酬比率、技能发展)。BDC 的知识图谱还能关联不同数据源(如 HR 与财务数据),提供更丰富的语义上下文。
简化旅程:更快、更简单、更低成本上云
Muhammad Alam 强调,实现飞轮效应不仅需要卓越的产品,还需要简化的路径。他介绍了 SAP 在业务转型套件和 BTP(业务技术平台)方面的创新。
业务转型套件:WalkMe 数字采纳平台现已集成到核心应用(SuccessFactors, Ariba, Concur, Sales & Service),下半年将扩展到私有和公有云 ERP。SAP Signavio 新增 AI 驱动的转型顾问和根因分析功能,可自动从财务报告中识别业务挑战并提供改进建议。SAP LeanIX 新增 AI 辅助的架构指导,可自动检查企业架构并提出优化步骤。
BTP:作为 SAP Build 的一部分,推出了 Juul Studio 中的 Skill Builder(用于定义基于规则的任务)和 AI Agent Builder(用于创建处理目标导向复杂场景的自定义智能体)。SAP BTP 计划在 2025 年下半年登陆所有主流超大规模云市场(AWS、Google Cloud、Microsoft Azure)。
为帮助客户完成转型旅程,SAP 与埃森哲(Accenture)联合推出了名为“Advance”的新计划,旨在帮助年收入 50 亿美元以上的客户,通过预配置和定制化的 SAP 业务套件包,以及埃森哲的咨询专长,加速上云转型。
SAP 首席运营官 Sebastian Steinhaeuser 分享了“SAP 如何运行 SAP”的经验:利用 Juul 实现数亿欧元的 AI 驱动效率提升;作为 BDC 的首位客户,实现了数据战略的阶跃式变化;使用 Signavio 和 LeanIX 简化流程和架构;通过 WalkMe 赋能变革管理;并全面采用 RISE with SAP 方案迁移至云端。
Mars 旗下健康零食品牌 Kind 的 CIO Anand Krishnan 分享了其采用 SAP 公有云 ERP 构建“两层架构”的经验。通过“爬、走、跑”的方法,他们以“绿地”方式将 True Fruit、Nature‘s Bakery 等被收购品牌逐一迁移至标准化的云 ERP,支持了业务的高速增长(True Fruit 过去两年增长超两位数),并为即将到来的 Kind 品牌迁移奠定了基础。
Christian Klein(克里斯蒂安·克莱因)最后宣布了让“RISE with SAP”和“GROW with SAP”迁移之旅更快、更简单、成本更低的三项举措:
更快:在整个 RISE 工具链中嵌入 AI 智能体(用于流程对标、架构优化、代码生成和系统迁移),目标是将迁移速度提升 35%。
更简单:推出面向具体业务线(财务、HR、供应链、销售、采购、服务)的解决方案包,简化商业条款和合同,包含 SAP Build 扩展能力、AI 包、SAP 托管的行业特定内容,实现“最佳套件即服务”。
成本更低:对于遵循“适配标准”原则并应用“清洁核心”方法的 ECC 和 S/4HANA 本地客户,SAP 将承担迁移到业务套件的典型成本,旨在改变软件与服务成本 1:10 的现状。
伙伴视角与行业展望
安永(EY)全球董事长兼首席执行官 Janet Truncale 作为 SAP 的长期客户与合作伙伴登台。她分享了 EY 这家拥有 40 万员工、遍布 150 个国家的组织,如何依赖 SAP 应对业务复杂性,并正在进行自身的 RISE 迁移之旅,以期获得更简化的流程、清洁的核心和更强的自动化与协作能力。
谈及 AI,Truncale 强调了四点:价值(关注生产力和增长)、以人为本(AI 赋能而非取代劳动力)、信任(在受监管环境中确保控制与风险框架)以及数据(需要准确、清洁、安全的数据策略)。她认为,在不确定时期,数据和技术能帮助企业做出精准决策,从而脱颖而出。
尾声:与莱德杯的特别合作
演讲最后,Christian Klein(克里斯蒂安·克莱因)宣布 SAP 成为著名高尔夫赛事莱德杯(Ryder Cup)的官方赞助商,并邀请欧洲队队长 Luke Donald(卢克·唐纳德)和美国队副队长 Jim Furyk(吉姆·福瑞克)上台。他们探讨了高尔夫运动中的不确定性(天气、观众、弹跳)以及可控因素(努力、态度、准备、计划),这与企业应对商业挑战的道理相通。一场轻松的高尔夫推杆趣味比赛为这场技术盛会画上了充满活力的句号。
Klein 在总结中重申了 SAP 的承诺:在不确定的时代,继续倾听客户需求,交付卓越创新,并全程陪伴客户旅程,助力企业“在纯粹的和谐中运营”。
体验完 Livo,我想聊聊它暴露出的行业真相一句话的影响价值有多大?
在大多数AI产品里,答案取决于你说了什么、对谁说的。但在Livo里,一句话影响的可能不只是某个具体的Agent,而是整个世界——人与自己的关系、人与人的关系、人与世界的关系,都可能因为这一句话产生改变。
这正是Livo试图回答的问题。过去三年,生成式AI把内容的生产成本压到接近于零。文字、图片、视频,一切曾经需要人类投入大量时间的东西,现在几秒钟就能生成。随着行业的发展,相关应用层出不穷,“与虚拟人格对话”变成了千万级用户的日常习惯。
但一个断层始终存在:AI生成的是内容,是角色,不是一个持续存在、会自己运转的世界。你关闭App,那个角色就冻结了;你不再说话,故事就停了。所谓“互动”,本质上仍然是你推一下,它动一下。
Livo想做的,是让这句话的“影响半径”从一次对话扩展到一个世界。快看漫画在2026年9月将它推入内测,名字来自Living(活着)、World(世界)与Orbit(闭环)——它想做的,是一个角色拥有独立人格、记忆与行为逻辑,能够在用户不在场时继续“过日子”的“仿生世界”。
这个世界独立存在,却又因“我(用户)”的行为选择产生了些许不同。在这个被创造出的世界中,“我(用户)”不是全知全能的“上帝”,也不是只能按照既定剧情路线前进的“旁观者”,而是真正具有主观能动性的“参与者”。
带着这个期待,我进入了Livo。
初体验:“穿越”有了读心术
第一次打开Livo,让我想起了一部知名的影视作品——《西部世界》。
《西部世界》里有“西部世界”、“罗马世界”、“中世纪世界”供游客选择,Livo里也有“蒂利亚之冬”、“DOLO最后的夏天”、“崩溃世纪Love 90s”和“拯救废稿世界”供用户选择。每个世界对应一条故事线,角色之间有关系网络,有各自的时间线。无论用户喜欢恋爱体验、奇幻冒险还是阵营对抗,在这里都能找到符合自己口味的选择。
不同于一般的“AI角色聊天”、“AI情感陪伴”APP,Livo从一开始就不是一个对话窗口,而是一个可以选择进入的“世界”。
初入Livo的体验很像“穿越”:精致的开场视频交代了世界观背景,接着我被“放置”到一个具体场景中。我需要主动找话题跟角色对话,甚至跟路过的NPC搭话。在这里没有任务列表,没有“点击继续”的按钮,如果我不开口,时间就在那里流逝。
但最大的不同很快显现了。在和重要角色“罗兰”的对话过程中,我可以选择系统提供的内容选项,也可以自己发挥。对于他说的每一句话,我不仅能看到这句话本身,还能看到他为什么说这句话——他的状态栏里写着“当前情绪:愉悦”。角色不是在对我的输入做“条件反射”,他在调用自己的记忆和当前状态来回应我。
另一个值得玩味的点是,我可以主动选择推进主线剧情“注定命运”,也可以在不同的场景中“闲逛”,与路过的NPC“闲聊”,触发支线剧情“潜在命运”。
比如在既定的沟通中,罗兰应该慢慢“套出”我的身份信息。可我没有选择系统给出的建议回复,而是直截了当地回复:“你对我很好奇,甚至故意找机会接近我,为了什么呢?”
罗兰也给出了很有意思的反馈:“你一句话,就把我最擅长的把戏掀了个底朝天。习惯了掌控节奏,却没想到会被你看穿……”这句话揭开了一个他的“秘密”——我由此知晓,自己是罗兰此次登上和平号列车最核心的任务之一,而罗兰在此之前从未接触过“万晁女孩”等新信息。
这让我意识到一件事:在Livo里,沟通的主动权不是用户的“天然权力”。在大多数聊天产品里,我随时可以发一条消息,角色必须回应。但在Livo中,角色是否愿意跟我深入聊某件事,取决于我们之前建立的关系,取决于他此刻的状态,取决于这个世界里正在发生的事。对话是“世界产生关系后的必然产物”,不是“用户行使的权利”。
Livo的第一眼体验,不像任何一个现有的AI产品类别。它不是聊天工具的升级版,不是互动小说的AI化,也不是AI版RPG。它更接近一个带地图、有时间线、有角色关系网络的微型世界模拟器。
有因必有果,你的反馈就是“我”
作为一个对话过不下百个Agent的“老用户”,我对AI角色的耐心已经所剩无几。
从最开始的疯狂投入,到后来发现所有角色都在用同一套模板拉扯,再到最后只看人设、立绘和配音——缺少“灵魂”的Agent越来越难打动我。市面上很多“AI角色聊天类应用”的问题很一致:角色靠“堆量”取胜,推送新奇人设吸引你点进去,但聊不了几句就OOC了,互动体验的情绪阈值被提高后,疲劳感来得飞快。
Livo给我的感受完全不同。核心差异在于:角色不是为我而存在的。
一般情况下,关闭App,甚至退出和TA的聊天框后,这个角色就冻结了。但在Livo里,在我和其他人沟通的时候、在我自己探索新场景的时候,罗兰有自己的日程。他上午在台灯下撰写《荆棘花信》的新章节,下午去阅览室看书。我没有参与这些事,但我却能看到它们发生了。他的人生有“主线”,而我只是进入了他的世界,不是他围绕我运转。
这种能力并不是主要角色的特权,就连戏份少得可怜的NPC同样拥有自己的生活。
Livo的底层逻辑是“世界状态持续演化”——用户不在的时候,角色之间的关系在变,事件在发生,因果在累积。这听起来像是一句产品文案,但实际体验中有一个瞬间让我真正理解了它的含义。
一次任务,我和NPC咖啡店老板与面包店老板产生了交集。因为我送给列车员一个暖手袋的小事件,三者产生了很奇妙的化学反应。在我无意间再次打开这个场景的对话框时,我发现他们三个人正在探讨我什么时候会再来,要给我一直温着暖手袋从而回报我的善意,要请我再喝一杯新创的咖啡,品尝一下可口的小面包……
坦言之,看到这些内容我是震惊的。他们只是我这段体验中很边缘化的角色,甚至都不是主角,但依然做着自己的事情,甚至会因我而产生争吵。宛如他们并不是NPC,而是一个个切切实实活在那个世界中的人。
这就是“因果”在Livo里的样子。我对列车员说的话、做的事,影响了他自己的行为模式,进而影响咖啡店老板与面包店老板对我的态度。这不是预设的剧情分支,而是几个独立Agent之间的信息流动产生的连锁反应。在轮次对话产品里,这种多角色因果链不可能出现。你生成的是“回应”,Livo试图生成的是“轨迹”。
更让我意外的是,Livo里一个叫“照见我”的模块。与任轻义交流,随着角色逐渐认识你,系统会生成属于我自己的“照见我”。这里记录的是我留下了怎样的痕迹,角色如何理解我,以及这个世界正在如何“看见我”。
换句话说,Livo里的“我”不是用户自己定义的人设,而是这个世界对我的行为的反馈与沉淀。我在任轻义面前的样子、在罗兰面前的样子、在咖啡店老板面前的样子,被分别记录、分别理解,最终汇聚成一个被世界“看见”的“我”。这让我意识到,Livo试图做的不仅是让角色“活着”,更是让用户在被世界看见的过程中,重新认识自己。
这可能才是“有因必有果”的真正含义——你的每一个行为都会进入这个世界的因果链条,而这个世界最终会把这些因果,以“你是什么样的人”的形式,还给你。
一个“活着的世界”究竟靠什么成立?
这次我不仅体验了APP的完整功能,还拿到了新Demo的内测权限,在Demo上直观看到了这个世界运行的底层代码。
比如因为“窗外暴雪”的因,散廷·姚产生了“推开小型放映厅门时肩头还落着雪,他抖落雪的动作比胶片转动声音轻”的“果”;又比如在没有我的地方,施塔恩与罗兰开始了关于等待的相互试探……
从公开信息来看,Livo的技术架构为双层结构,由「创作者灵魂注⼊⼊⼝层」与「三⼤引擎」共同构成,此为Livo区别于⼀般AI⻆⾊/聊天机器⼈产品的底层差异。
入口层将创作者以文学语言撰写的素材,结构化为可供引擎运行的数据。具体来看,在个体侧,人物小传被抽离为「六层人格」档案,包括自我意识、底层需求、信念、思维、立场和情绪;在世界侧,世界观骨架被抽离为「六层世界结构」,包括本源、动力、信念、秩序、律法和气象。
有了入口层的这串“基础代码”,「三⼤引擎」就可以开始协同工作。World Agent,负责管理日程、事件、天气、运势等影响整体状态的因素。Soul Agent负责用户与角色之间的交互。「深度被感受」引擎,通过五步链路保证情感回应的真实性。此时每个角色本身都是一个独立Agent,拥有不同的人设、世界观和状态,调用各自的Sub-agent和MCP服务。底层是Memory和“因果编剧”——前者负责长期信息的保存和召回,后者负责维持长时间运行后的故事因果不崩。
这个架构试图解决的核心问题不是“技术单点突破”,而是“长时段运行后的一致性”。
那些投入了大量的经济成本与时间成本才“调教”好的Agent突然OOC,忘记了我们的过往,忘记了我们之前一起经历的种种,产生出一些不符合角色的行为,对于我们这些老用户而言是致命性的打击。
但Livo走了一条完全不同的路——它不追求物理引擎级别的真实感,它追求叙事因果层面的可信度。“活着的世界”靠的不是更多的角色、更长的剧情、更漂亮的画面,而是三样东西:长期记忆的叙事性、多Agent的自主交互、用户行为的因果进入。
记忆层面,Livo的设计逻辑不是“记住用户说过的话”,而是角色拥有自己的经历。“经历过的事”和“知道的事实”是两回事,这个区分决定了角色是在“回忆”还是在“检索”。
多角色自主性层面,任轻义和罗兰之间的关系张力不是我能直接控制的。他们之间的互动有自己的逻辑,我感受到的是一个本来就在运转的关系网络,而不是一个为我搭建的舞台。
技术路线上,Livo的团队借鉴了斯坦福AI小镇的思路,但明确表示不会照搬任何现有方案。这个产品需要的基础设施,市面上还没有现成的。让子弹再飞一会儿,是合理的态度。
尾声
客观来说,Livo目前还不是一个完美的“活世界”。
角色的“涌现”深度有限,长时间交互后人格偶尔会漂移;有时候剧情已经结束了,角色应该离开了,对话框却还停留在那里,引导我继续沟通交流;“照见”等模块的体验还不完整;故事剧情是单向发展的,不能像聊天Agent那样撤回自己说的话,也不能像影游那样回溯到某个节点……
这些问题的本质其实是同一个:一个持续运转的世界,意味着任何一次交互都会永久改变世界状态。自由度和容错性之间,Livo选择了前者。这个选择有代价,但方向是对的。
所以比起这些体验上的小问题,我更关心的是另一个问题:第十小时、第一百小时之后,这个世界是否还值得回去。
这个问题,其实不只是Livo的问题。每个时代都有属于自己的娱乐方式。电力与光影技术让电影出现,电子技术与广播电视网让电视剧热播,个人电脑与互联网让互动叙事游戏广受欢迎,生成式AI与多智能体架构也让Livo出现。
它们看似是不同年代的产品,背后却是同一条线索:媒介技术的每一次跃迁,都在重新定义“人如何进入一个故事”。电影让人坐在黑暗里观看,电视剧让人在客厅里陪伴,互动叙事游戏让人在选项里参与,而Livo试图让人“活”在一个会自己运转的世界中。从“看”到“陪”,从“选”到“在”——每一次跃迁,都是“进入”的深度在加深。
而在这个方向上,快看还有一个被低估的优势。十二年的漫画经验,意味着它对“角色怎么让人在乎”有肌肉记忆。在一个比拼“世界感”的赛道上,这种能力比想象中更重要——因为一个世界之所以值得回去,不是因为技术多先进,而是因为里面有人让你惦记。
从“生成内容”到“生成持续存在”,这可能是AI内容产品的下一个分水岭。Livo还不是那个分水岭本身,但它是目前更接近让人感觉到“世界在活着”的产品。它验证了“世界可以自己往前走”这件事不是空想,但距离“一个真正活着的世界”还有大量未解决的问题。
它值得被看到,不是因为它已经做成了什么,而是因为它指向的方向——让故事不再停在“然后呢”,让它真的有一个“然后”。
图片来源|企业供图
在折腾9个月后,手机Agent的王者,豆包手机助手它回来了。终于,憋了很久很久很久的努比亚发布会,在下午,终于开完了。
会上,搭载豆包手机助手消费者版本的努比亚Navix Ultra正式开售。
12+512GB的配置定价5999,国补后到手5499。
16+512GB定价6499,16GB+1TB定价7499。
去年12月,豆包手机助手技术预览版发布的时候,我也第一时间做过一轮实测一手实测豆包手机助手,这就是当今手机Agent的天花板。。
虽然后面经历了一些风波,但它在当时的我看来,依然是最好的手机Agent。
九个多月过去,豆包手机助手终于走到了消费者版本。
搭载它的手机,也从之前的限量工程机努比亚M153,换成了真正面向消费者的外观更精致的量产机,努比亚NaviX Ultra。
还是跟之前一样,豆包手机助手负责里面的AI助手体验,努比亚负责硬件工程和手机本身。
这次,我也非常荣幸,在几天前,提前拿到了真机。
整体的质感终于变得非常扎实了,跟之前的工程机的质感完全不一样了。
先说手机本身。
颜色从单一白色增加到了黑、白、粉、蓝四种颜色,正面是四等边直屏,背面换成了横向三摄模组,我们拿到的就是黑色款。
机身厚度7.62mm,电池容量增加到了7100mAh,全系512GB起步,主摄也翻了4倍,拉到了2亿像素。
简单来说,硬件层面,这次至少在外观、续航和影像上,都全面升级了。
除了外观变得更好看了,我觉得在硬件层面上,最特别的,还是侧边那颗非常显眼的橙色AI按键。
我觉得消费者版最值得聊的,还真就得从这颗按键说起。
1. AI键有指纹鉴权了
AI键本身已经不稀奇了,现在很多手机都有一个专门唤醒AI的入口。
这颗按键的基本操作和上一代一样,按一下调出功能栏。
长按可以直接提问,连按两下还能进入豆包实时视频通话。
但消费者版,有一个最重要的改变,就是这个AI键上,第一次加上了指纹鉴权。
我专门在锁屏状态下,让其他人拿起这台手机试了试。
他们直接按AI键吊起豆包手机助手,直接去问天气,或者一些普通问题,都可以正常回答,没有问题。
但是他们,一旦去问跟我有关的我的私人信息,或者是要操作我的手机去做点什么事情,它就会进行指纹鉴权,来判断操作手机的人是不是我。
如果是已经录入的指纹的话,它会显示已通过系统鉴别,在指纹验证的同时,豆包助手也唤醒了,不需要你先解锁手机再叫豆包。
这个时候,所有的关于我自己的一些内容,或者去操作,都可以正常的去使用。
但是如果指纹不对,他发现用手机的人不是我,它就会弹密码解锁,或者屏下指纹解锁等等你设置的手机解锁方式。
如果用户无法正确解锁的话,它就会取消任务,拒绝对话。
除了这个AI键,和上一代一样,它也支持语音唤醒。
这些就是我觉得一台Agent手机在保护用户隐私和安全的道路上,迈出的非常有用且坚实的一步。
并且这次还增加了连续对话,打开以后,唤醒一次就能接着聊,不用每问一句都重新叫它。
有了这两种方式,我在实测的过程中,再也没有去手机上手动打开豆包App了。
但是还是上面我说的,Agent用着越方便,那这个AI键的身份验证,就太太太太重要了。
2. 复杂长程任务上的能力提升
说完了AI键,这次豆包手机在复杂长程任务上的能力也提升了。
比如,我自己在内部最喜欢用手机Agent干的活,让他跑了一遍我们公司的飞书报销。
因为我们飞书报销的流程还是挺复杂的。
得去知道这个发票开销属于哪一类,再打开报销单模板,把内容和金额填进对应的表格,填完以后,还要保存表格和发票,进入飞书审批,把信息、表格和发票等等一起传上去,最后提交。
更别提未来更复杂的那种,我需要把邮件里面或者是手机各种App的发票先开出来,再全部从邮箱里面收集,再去报销,报销真的是我一生之敌。。。
不过就单纯的发票报销这件事,它还真的一次性跑完了,给大家看看10倍速的完整过程。
和我上次测试预览版时感受到的能力相比,消费者版本这次确实能把更长更复杂的流程跑完。
而且它在后台干活的时候,你还可以继续干别的。
而且这次还增加了任务排队和插队。
所以它干活的时候,你也可以接着发新任务。
新的任务可以选择排队,也可以选择立刻插队。
这就方便多了。
你可以一口气把所有活都派完,如果你手上突然来一个什么急活,也能够及时地插队去处理。
不过,插队这里有个不方便的地方是,一旦选择插队,前一个任务就会被终止,后面没法重新接着刚才的进度干。
所以遇到报销这种流程比较长的活,不着急的情况下不建议选择立刻插队。
3. 记忆和快捷指令
长流程能跑通以后,还有个很实际的问题。
有些重复要做的事,还有我们的偏好,如果每次都要和AI从头说一遍,那也太呆了,这个其实就是记忆的问题了。。
因为预览版出的比较早,所以记忆这个点,在真正去操作手机的时候,干的没有那么好。
不过消费者版本也通过记忆功能的大幅度升级和快捷指令,已经在很大的程度上解决了。
先说记忆。
你可以让它记住所有跟你生活相关的信息,比如你外卖打车的常用地址、口味、习惯和其他所有希望被记住的信息。
你可以直接给他说,比如记一下“我喜欢跟坤坤联名的所有产品”之类的,它就会记住。
比如还有,我跟它说,记一下,我不喜欢Anthropic这家公司,这个公司就是个大XX。
它就会把这条放进了个人信息,还给分到了科技爱好下面。
你也可以是在浏览某一个页面的时候,直接三指上滑,它也能存进记忆里面。
记忆里面存的信息,在后续让它执行任务的时候都是可以调用的。
举个例子,我定期会往家里买点猫粮,但其实每次买的都是那一款。
这种重复的事就可以让它给我干,我就只需要摁住AI键说一句,去抖音商城里面买一袋我经常买的猫粮送到我家。
它就可以自己去抖音上看我经常买哪一款下的哪一个规格。我默认地址其实是公司,它也会自动换到我家去,一路操作到支付页面。
我确认付款就完了,非常省事。
另一个让我很惊喜的功能,是把跑通的操作保存成快捷指令。
我们视频组的同事,平常会在即梦里大量去生成视频、测试看到的各种各样的提示词。
遇到喜欢的素材,会把视频和提示词一起存进公司的AI生成素材库,同时发给同事一起共享。
这个过程,他们也拿这台手机给实现了。
就比如说,他们平常零碎时间刷手机刷到喜欢的AI视频,不用跳转,直接摁住AI键口喷需求。
然后豆包手机助手就能复制视频的生成提示词,把视频下载到本地。接着打开飞书,找到AI生成素材库这张多维表格,填上内容名、内容类型、提示词等等巴拉巴拉,再上传视频。
一阵操作之后,它又去飞书里找到相应的同事,把视频和提示词发过去,告诉对方已经入库。
整个过程它实现的还是蛮丝滑的,中途只需要在他填完表格内容后,进行一个确认提交,其他的全都交给他就行了。
从提示词的长度,你应该也能发现,这个过程要表述清楚其实挺长的,说出来真的很费嗓子。
所以消费者版也新增了一个快捷指令。
任务完成后,对于可以复用的流程,豆包会提供保存成快捷指令的入口。
点进去,可以设置简短指令,比如设置成:提示词入库。
下一次直接说这个简短指令,它就能够复刻整个流程,非常省事。
4. 理解屏幕内容并干活
还有过去的一种操作,也很麻烦。
就是很多时候信息已经在屏幕上了,但是我们要让AI干活,每次还要截个图,然后再唤醒,再把这个截图扔到这个AI里面。。
那消费者版也终于把这个问题也解决了。
比如,因为我们中秋和国庆中间三天也都是线上办公,大家基本约等于有十几天的连续假期,所以他们就又约着一起要去成都玩的,有个J人就在疯狂写攻略文档中。。。
但网上的攻略总是零零散散的,你可能在一条帖子里面被安利了一家店,又在另一条帖子里面被安利了一个景点。
所以搞起来,太慢了,她们也吐槽说,收藏了一堆,逐个整理起来无敌麻烦。
但其实用这台手机的话,完全可以刷攻略的时候,看到啥喜欢的直接让豆包去给你改文档就行了。
随便拿个店铺举例,可以直接就着当前页面,让豆包搜索相关攻略,编辑攻略文档相应的部分。然后再通过飞书分享给同行的人。
5. 豆包手机助手更加深入系统
除了上面这些,相机、录音等等这些系统应用里,这次也接进了更多AI能力。
这里的点就比较碎了,但其实都是我们平常用手机都会高频用上的。
先说我们每个人每天可能都要做的,拍照。
相机里直接内置了AI改图功能。
你可以一句话给手办换一套装扮。
还有机位辅拍也挺有意思。
拍摄的时候点一下左下角的小魔法棒,画面里会出现构图提示和焦点指引。两个点重合以后,相机会自动调整焦段并完成拍摄。
可以看看最后拍出来的,照着他的指引拍出来,构图确实比一开始的画面方正的多。
消费者版这次系统录音和打电话都接入了飞书妙记,可以完成转录、说话人区分、总结和信息调取。
开会的时候打开录音,妙记生成后,直接让它像前面的例子一样去飞书上建日程或者任务,或者是约其他会议,都是一句话的事了。
比如我之前在公司做了一场Q3公司战略分享会。
直接打开手机录音,录完后就会生成飞书妙记。
那会后,如果想总结一下具体的Q3职责,给到相应的同事,也是给他说就行了。
最后,这里叠个甲,因为我们拿到的是测试机,版本也比较新,所以上述所有case,可能在未来大家拿到的时候,跟视频有点不太一样,到时候大家以实际到手版本为主,也可以关注一下系统升级。
从去年12月到现在,九个多月过去了。
预览版带着些莽撞的把手机Agent的潜力展示给大家看。
在它的基础上,消费者版做的,更多是把用户习惯、产品体验给完善了。
到现在,才真正开始可以说是面向每一个人的手机。
这大概就是消费者版本这几个字,真正的意义。
当然,它现在还有一些限制。
一个是目前手机操作做任务的免费额度是有限的。并不是买了手机豆包助手就能随便爽用了。
二是生态限制,目前操作手机的功能主要还是支持系统及中兴应用、字节系应用和部分已接入的第三方应用。
不过这次,豆包手机助手推出了SAEP屏幕自动化操作声明协议,还开启了30天规则公示。
简单来说,就是第三方App可以自己选择是否允许豆包助手在应用内进行GUI操作。
可以接受,也可以拒绝。
这个就很有意思了,我还非常期待,想看到有多少的应用愿意接入它们。
可以说,这就是新时代与旧时代的过渡。
剩下的,就看这个时代。
到底会不会。
配得上我们所期待的那个盛夏了。
Apple:2000 美元的 iPhone 改变了投资逻辑投资观点
我对 Apple Inc.(AAPL)股票依然持积极看法。我继续给予该股“强烈买入(Strong Buy)”评级,并维持 372 美元的目标价(基于当前股价,对应约 18% 的潜在上涨空间)。我认为 Apple 股价仍然存在进一步上涨机会,原因有很多。
**iPhone 高端化:**Apple 已明确致力于推动 Pro 系列或更高价格产品的销售,即使 iPhone 销量没有出现爆发式增长,这也能够支撑平均售价(ASP)。
**毛利率:**虽然面对大宗商品价格等成本快速上涨时,许多公司都会很难完全消化这些压力,但 Apple 庞大的规模、高度整合的供应链以及强大的定价能力,为公司带来了独特优势。因此,即使宏观经济环境可能变得不那么有利,Apple 依然处于非常有利的位置,可以维持较高的毛利率。
**人工智能:**我对 Apple 人工智能战略——也就是设备端 Apple Intelligence——的潜力并没有特别强烈的看法,不过这些功能确实可能增强 Apple 生态系统的用户黏性,让用户更难离开 Apple,从而提高客户忠诚度,并持续支持新一轮 iPhone 换机周期。目前来看,虽然 AI 存在一定潜力,但我几乎完全把它视为一种防御性策略。
当你看到服务业务以高利润率增长,同时配件不断强化整个生态系统时,本质上也是同样的逻辑。真正的主要优势来自每一个持续把用户进一步连接到 Apple 生态系统中的新设备或新服务。
当然,这里同样存在风险,我显然很清楚这些风险。例如,全球经济增长放缓可能导致 iPhone 需求下降,而 Android 在低端市场依然拥有非常庞大的市场份额。不过,也正是在这里,Apple 的脆弱程度相对更低。因此,我们认为其风险收益关系依然非常有吸引力。 fileciteturn0file0L1-L8
今天发生了什么变化
很多人一直在等待这场发布会,而自从 Apple 举办“Surprise & Shine”活动以来,我对这只股票的整体看法其实并没有真正改变。
新任 CEO John Ternus 现在已经开始带领 Apple 向前发展,而投资者都在问自己:“未来几年 Apple 打算把 iPhone 带向什么方向?”根据今天的发布内容,答案已经非常明显。Duo 起售价为 1,999 美元,2TB 版本最高达到 3,199 美元。iPhone 18 Pro 起售价为 1,199 美元,而 Pro Max 起售价为 1,299 美元。
【原文图片位置:Apple 新款 iPhone 产品与定价(Apple)】
另外,我不知道你是否注意到,Apple 并没有发布“标准版”的 iPhone 18。换句话说,标准版 iPhone 18、18e 以及 Air 2 都会在之后推出。因此,在未来几个月里,希望购买 iPhone 的消费者能够选择的型号会相对有限,基本上只有 Pro 系列或者 Duo。
因此,我越来越觉得,Apple 希望推动产品结构向更高价格产品转移,并在不需要销售明显更多 iPhone 的情况下提高平均售价。 fileciteturn0file0L10-L20
iPhone Duo
让我们具体谈谈 Duo。正如我们所知道的,可折叠手机并不是什么新鲜事物,市场上早就已经有可折叠智能手机。具体来说,Samsung(SSNLF)早在 2019 年就发布了 Galaxy Fold。此外,还有一些公司已经开始生产双铰链的三折叠手机。不过,在经历了一个不错的开局之后,整个行业却出现了下滑。根据 IDC 的数据,今年前六个月折叠屏手机出货量下降了 15%。虽然 Apple 进入折叠屏手机市场早在几个月前就已经被市场广泛预期,但分析师认为,Apple 的加入将显著提振整个行业。具体而言,预计到 2026 年,Apple 将占据全球折叠屏智能手机总销售收入的 44%。
【原文图片位置:折叠屏智能手机市场数据(Agar Capital,Bloomberg Terminal)】
从财务角度来看,我很好奇这种定价能力最终会有多少真正转化为毛利润。随着内存和存储成本上涨,公司成本也在上升。而 Apple 只将 Pro 型号价格提高 100 美元,这可能会成为一次非常有意思的测试。对我而言,真正的问题是:更高的售价能否完全抵消内存和存储成本上涨带来的全部额外成本,还是毛利率依然会承受一定压力?
人工智能
对于人工智能(AI),我对这里所提出的愿景要保守得多。Apple 将 iPhone 称为一个“Personal Intelligence Hub(个人智能中心)”。这个个人智能中心包括设备端 AI、云端 AI,以及能够连接超过 30 万款应用的 Siri。目前这些功能的真正价值,更多在于它们能够帮助推动 iPhone 换机周期,并进一步提升用户在 Apple 生态系统中的留存率。A20 Pro 也与这些目标高度契合:采用 2nm 制程、上一代 Neural Engine 两倍的性能、更强的图形能力以及更好的持续性能。Apple 已经开发出了实现这些技术所需要的芯片和操作系统。此外,Apple 还拥有强大的分销渠道,以及超过 10 亿最终可以使用这些技术的客户。在我看来,这为公司长期构建更大的 AI 平台提供了一个非常强大的基础。
Apple Watch 与 AirPods
我对 Apple Watch 和 AirPods 的看法也是如此。最新的健康监测技术、环境智能以及基于 Siri 的创新,为整个生态系统增加的价值远远大于单纯提升每一类产品的销量。每一种产品都会再给用户一个继续留在 Apple 生态系统中的理由。用户忠诚度始终都是 Apple 最重要的优势。如果你现在正用 iPhone 阅读这篇文章,你可能非常清楚我在说什么。
iPhone 高端化
Apple 大约一半的收入都来自 iPhone,因此,如果你想知道公司下一步可能走向哪里,就必须从 iPhone 开始分析。过去几年里,Apple 一直在推动“Pro”型号,而在 9 月 9 日的发布会之后,这一战略已经非常明显。
【原文图片位置:Apple iPhone 收入及产品结构(Agar Capital,Bloomberg Terminal)】
随着新一代 iPhone 产品线的定价明显高于过去——iPhone 18 Pro 起售价为 1,199 美元,Pro Max 为 1,299 美元,而全新的 Duo 起售价接近 2,000 美元——即使公司卖出的 iPhone 数量与过去相同,甚至略少一些,只要每台设备的售价大幅提高,整体盈利仍然可能增长。这就是平均售价(ASP)发挥作用的地方。
正如你所知道的,过去几年 iPhone 的 ASP 一直持续上升。分析师预计,消费者向 Pro 型号迁移的趋势将在 2026 年继续支撑 iPhone ASP 增长。由于 Duo 将进入一个完全全新的价格区间,而且分析师预计折叠屏手机的平均价格将超过 2,550 美元,这将进一步提高 Apple 产品组合中高价格设备的占比。
【原文图片位置:iPhone 平均售价趋势(Agar Capital,Bloomberg Terminal)】
这意味着,从整体来看,即使全球智能手机市场增长放缓,只要更多消费者选择 Pro、Pro Max 或 Duo,iPhone 收入依然能够继续增长。换句话说,Apple 正在努力从每一台售出的设备中赚取更多利润。
存储芯片短缺也迫使行业内许多公司提高平均售价。根据 IDC 的数据,预计 2026 年全球智能手机 ASP 将上涨 27.6%。由于 Apple 几乎只生产高端设备,因此相比那些同时销售高端和低端设备的厂商,公司在这些产品上面临的降价压力明显更小。
【原文图片位置:全球智能手机 ASP 预测(Agar Capital,Bloomberg Terminal)】
iPhone Duo:市场情景分析
Duo 是 Apple 首次进入折叠屏市场,目前我们还无法确定消费者会以多快的速度接受一款售价超过 2,000 美元的 iPhone。因此,我更喜欢通过不同“情景”来构建预期,而不是在缺乏充分证据的情况下直接做单一预测。
在悲观情景中,我预计消费者反应相对平淡。Apple 最终获得全球折叠屏智能手机市场大约 10% 的份额,每年销售约 200 万至 300 万台 Duo。按照 2,300 美元的平均售价计算,这意味着 Apple 每年可以从这一产品获得大约 50 亿至 70 亿美元收入。因此,虽然对于一个全新的产品来说,这已经是非常不错的表现,但它对 Apple 整体利润的影响仍然相对有限。很多人担心会重演 Vision Pro 的情况。
基准情景是我认为最有可能发生的情况,我预计每年 Duo 销量约为 500 万至 700 万台,对应每年约 140 亿至 180 亿美元收入。
然后是乐观情景。在这种情况下,Apple 重演自己过去的历史模式:晚于其他厂商进入一个新产品类别,然后迅速占据主导地位。根据 IDC 提供的预测,如果 Apple 能够占据折叠屏市场接近 40% 的份额,那么每年可能销售 900 万至 1,100 万台 Duo。如果平均售价提高至 2,700 美元甚至更高,则对应收入可以达到约 250 亿至 300 亿美元。
情景
2026 年 Duo 销量(百万台)
2027 年 Duo 销量(百万台)
ASP(美元)
2027 年 Duo 收入(十亿美元)
占 2027 年 Apple 销售额比例
悲观(10% 份额)
~2.3M
~2.7M
2,300
~6.2
~1.2%
基准(25% 份额)
~5.7M
~6.8M
2,550
~17.2
~3.3%
乐观(40% 份额)
~9.2M
~10.8M
2,700
~29.2
~5.6%
从这些数字可以非常明显地看出,基准情景预测是现实的,对应收入大约占 Apple 整体收入的 3%。另一方面,乐观情景的上限则可以接近 6%。 fileciteturn0file0L56-L69
利润率与零部件成本分析
在利润率方面,Apple 依然拥有一个极其强劲的基础。Apple 规模庞大,能够以许多其他公司根本无法达到的采购量购买零部件,而且从历史上来看,公司一直能够在成本结构中实现显著的规模经济。因此,产品业务毛利率通常维持在 30%-35% 之间,而服务业务毛利率则超过 70%。受更好的产品组合以及有效成本管理推动,FY2023 公司整体毛利率进一步改善至 44.1%。
【原文图片位置:Apple 毛利率趋势(Agar Capital,Bloomberg Terminal)】
Apple 目前面临的主要问题来自内存成本。RAM(随机存取存储器)和 NAND(NAND Flash),也就是 iPhone 用于存储和处理数据的芯片,自去年以来价格已经显著上涨。根据 Wall Street Journal 最近一篇文章中引用的一些预测,部分 iPhone 18 Pro 配置的内存芯片成本可能上涨了三到四倍。如果只从单个零部件成本角度考虑,这种幅度的成本增加显然可能给任何商业模式带来非常大的压力。
幸运的是,Apple 有两种方式可以缓解这种影响。其中一部分内存成本上涨可以由 Apple 自己直接吸收,从而表现为较低的营业利润率。另一种方式,则是通过提高售价,把全部或者部分成本转嫁给消费者。从最新一代 iPhone 产品线来看,Apple 看起来正是这样做的。具体而言,Pro 和 Pro Max 的售价已经提高,而且有证据显示产品组合正在进一步向价格更高的高端型号以及 Duo 倾斜。
因素
iPhone 17 Pro
iPhone 18 Pro(预估)
基础首发价
$1,099
$1,199(+9.1%)
RAM + NAND 成本
$52(256GB)
$77(256GB)↑
其他零部件成本
~$200
~$200
预计毛利率
~37%
~36%-38%
在这种情景下,计算其实相当直接。虽然内存成本会增加几十美元,但如果一台 iPhone 的最终售价仅仅提高大约 10%,那么 Apple 很可能仍然可以保住大部分甚至全部原本可能损失的利润,甚至从单机美元利润角度来看还有可能实现改善。我的高端定价投资逻辑包含多个重要方面,但其中可能没有哪一点比它在原材料成本上涨时保护利润率的能力更加重要。
因此,我认为,即使物料清单(BOM)成本提高,Apple 未来仍然能够在很大程度上保护自己的毛利率。 fileciteturn0file0L71-L88
估值
我不认为 Apple 必须大幅提高 iPhone 销量才能兑现自身潜力。公司真正需要做的是提高每一台设备所创造的收入、扩大服务业务,并通过股票回购减少总流通股数量。这些策略应该能够推动每股收益(EPS)继续增长。
根据 Bloomberg 对 FY2028 EPS 10.68 美元的一致预期,我给予大约 35 倍市盈率,由此得到每股 373.80 美元的估值,基本与我的 372 美元目标价一致。
【原文图片位置:Apple FY2028 EPS 与目标价估值(Agar Capital,Bloomberg Terminal)】
35 倍市盈率显然是一个非常高的估值。不过,Apple 当前前瞻市盈率大约为 33 倍,而过去五年平均值大约为 30 倍。
【原文图片位置:Apple 前瞻市盈率与五年平均估值(Agar Capital,Bloomberg Terminal)】
因此,为了达到我的目标价,我并不是假设市场会从头开始彻底重估 Apple。相反,我只是预计估值倍数会温和扩张,同时盈利继续取得一定增量增长。
【原文图片位置:Apple 股价走势图(TradingView)】
结论
我将继续维持“强烈买入(Strong Buy)”评级,并保持 372 美元目标价不变。我们暂时把折叠屏 iPhone 和 Apple 对 AI 的应用放到一边,先看看 Apple 正在如何通过整个生态系统本身获取更多收入。每一代新 iPhone 发布时,Apple 都在提高 iPhone 的平均售价。同时,公司从每一位用户身上通过服务业务能够获得的收入也一直在增加。
【原文图片位置:Apple 生态系统及估值相关数据(Seeking Alpha)】
对我来说,真正的投资故事正是从这里开始。Apple 可能根本不需要每年比现在多卖出多少设备。真正需要做的是,通过提高每位客户的整体经济价值来保护利润率。同时,Apple 还需要把庞大的已安装用户基础进一步转化为更多持续性的经常性收入。
目前市场显然已经认识到了 Apple 很大一部分优质属性。由于 Apple 当前的估值倍数已经非常高,因此几乎没有太多犯错空间。不过,如果 Apple 能够在定价、利润率、服务业务以及 Duo 这几个方面全部执行到位,那么我认为,从当前价格计算大约 18% 的潜在上涨空间,依然足以覆盖相应风险。
跳票两年,苹果的Siri AI终于来了——但欧盟用不了,中国也用不了今天,苹果正式推送iOS 27,全新一代Siri AI以英语测试版形式上线。
这是Siri自2011年诞生以来最大的一次重构,也是苹果自2024年WWDC高调承诺"全新Siri"之后,迟到了整整两年的答卷。
问题是,这份答卷的分数,可能没苹果想象的那么高。
来了,但没完全来
先说覆盖面。
Siri AI目前只支持英语,下个月才扩展到法语、日语、韩语、葡萄牙语和西班牙语。更要命的是——欧盟用户暂时用不了。苹果官方表态:Siri AI在iOS、iPadOS和watchOS上初期不向欧盟开放,理由是"正在努力寻找一条既能保护用户隐私和安全、又能推进落地的路径"。
中国大陆同样不在首批支持范围内,苹果称正在应对当地监管要求。
也就是说,苹果最核心的两大海外市场——欧盟和中国——全部缺席。这不像是一次全球发布,更像是一次"有条件开放"。
再叠加设备限制:只有iPhone 15 Pro及以上、iPad mini(A17 Pro)及M1以上iPad、M1以上Mac才能运行Siri AI。高阶功能(个性化语音、离线听写)更是要求12GB以上内存,只有iPhone 17 Pro系列、iPhone Air和M3以上Mac才能解锁。
能用的地方不多,能用的人也不算多。
跳票的代价:2300亿美元蒸发
回头看这两年发生了什么。
2024年WWDC,苹果高调发布Apple Intelligence,承诺Siri将具备屏幕感知、跨应用操作和自然语言理解能力。资本市场信了,股价一路走高。
然后就是连续跳票。2024年秋季没上线,2025年又以"内部技术问题"推迟。更尴尬的是,2025年3月内部会议曝光:Siri新功能的执行成功率只有60%到80%——每五次交互就有一次失败。
最终苹果在2026年5月支付了2.5亿美元和解金,了结因AI功能宣传与实际不符引发的集体诉讼。
今年1月,苹果做了一个意味深长的决定:和Google达成合作,将Gemini模型整合进Siri底层架构。一个曾经以"端到端自研"为傲的公司,不得不向别人借核心技术。
6月WWDC 2026上,即将卸任的库克最后一次以CEO身份发布了Siri AI。股价盘中触及历史新高,随后一路回落,收盘跌了1.9%,从最高点蒸发超过2300亿美元市值。
市场用脚投了票。
Siri AI到底变了什么
公平地说,功能层面的升级是实质性的。
个人情境理解:Siri AI可以调用你手机里的短信、邮件、照片、日历、备忘录来回答问题。朋友在消息里推荐的餐厅,你直接问Siri就能找回来;旧邮件里的酒店确认号,Siri也能跨App搜索定位。
屏幕感知:Siri能"看到"你屏幕上正在显示的内容。收到聚餐邀请后直接问Siri该带什么,它能把食谱加进备忘录,全程不用复制粘贴或切换App。拍一张背包照片,它能结合你的航班信息判断是否符合随身行李尺寸。
跨App操作:支持从零草拟邮件、编辑相册并分享照片,不再只是"打开某个App"。
独立Siri App:首次上线,支持对话历史回看,通过iCloud私密同步,iPhone上开始、iPad上接续、Mac上完成。
底层架构才是真正值得关注的部分。苹果设计了三层推理体系:简单任务走端侧自研模型AFM 3,中等任务走苹果私有云,最复杂的推理交给Google Cloud上的定制Gemini。
AFM 3最关键的突破是一个200亿参数的稀疏模型,每次请求只激活10亿到40亿参数。靠的是苹果研究院的"指令跟随剪枝"技术——200亿参数的模型能装进手机跑起来,还不牺牲续航。
够不够"新"?
这是最致命的问题。
华尔街科技评论员Nilay Patel的评价很直接:从用户角度看,Siri AI相当于两年前ChatGPT免费提供的水准。
独立App、对话历史保留——ChatGPT 2022年就有了。视觉识别拍物体搜索——Google Lens 2017年就上线了。这些功能单独看都不新。
苹果的优势在于系统级深度集成。Siri AI不是一个独立的App,它嵌入了iOS的每一个毛细血管——照片、邮件、日历、短信、Spotlight,全部打通。这种集成度是任何第三方AI应用都做不到的。
但问题是,两年前承诺的时候,这些功能是超前的。跳票两年后落地,它们变成了"基本合格"。
更大的隐忧
华尔街分析师指出了一个长期风险:随着AI智能体和自主系统的发展,未来的经济行为——比如叫车、订餐、购物——可能直接由AI完成,绕过应用商店。
这意味着苹果赖以生存的App Store抽成模式,可能被AI时代釜底抽薪。
Siri AI现在的定位是"实用工具"而非"AI朋友",风格克制冷淡。The Verge测了一个细节:问"你能做我的朋友吗",ChatGPT会热情回应一大段,Gemini也滔滔不绝,Siri AI只回了一句——"无论顺境逆境,我都会做你的朋友。"
这句话很苹果。简洁、克制、带点冷幽默。
但市场要的不是冷幽默,是真功夫。Siri AI是苹果在AI时代的入场券,不是终局牌。迟到两年已经付出了2300亿美元的代价,接下来能不能靠系统集成的护城河追上来,就看这第一步走得多稳了。
豆包手机明日开卖,AI能帮你操作App了吗?文|李炤锋
编辑|张雨忻
昨日,豆包手机助手发布消费者版本。这款基于豆包App(应用)、与手机厂商在操作系统层合作的AI助手,首款落地机型为中兴通讯旗下努比亚NaviX Ultra,而这款手机将在9月16日正式公开发售。
去年底,豆包手机助手技术预览版曾落地努比亚M153工程样机,重点展示AI如何跨应用“操作手机”。不到一年时间,全新推出的消费者版本更强调日常可用性:除屏幕问答、本地记忆和检索外,“操作手机”功能以Beta(测试版)形式开放;豆包同时推出SAEP(屏幕自动化操作声明协议),并设置30天公示期。
根据协议,第三方应用可以自主声明是否允许AI助手执行屏幕自动化,也可以限制具体操作。30天公示期内,未明确同意接入的第三方应用默认不操作。消费者版豆包手机助手进一步加入应用侧选择权:第三方应用可以整体拒绝GUI,也可以单独限制发布、删除和权益领取等操作。
从事GUI(图形用户界面)Agent研究的人士认为:“未来手机里肯定要有一个原生AI助手。这个事情不一定由手机厂商自己做,但最后一定要做到系统级。”而随着NaviX Ultra和一众系统级手机助手进入消费市场,系统级AI助手正在走向普通用户的日常使用场景中。
走出对话框,手机AI开始跨App完成任务
今年7月,中兴通讯高级副总裁、努比亚总裁倪飞在接受媒体采访时表示:“用户真正想要的是‘省心’,但今天的手机功能越多、操作越复杂,这种矛盾已经积累到了一定程度,需要一个全新的产品形态来回应。”
这正是豆包手机助手在尝试解决的问题:它嵌入手机系统,能在用户授权后搜索当前屏幕和本机信息,调用日历等系统工具,或进入其它App完成App中的操作。用户可以通过AI键发起任务,多个任务还可以排队或临时插队。
比如,在豆包手机助手的官方演示中,用户拍下新学期课表后,可以让助手将课表加入个人日历;也可以让它打车到屏幕显示的地址,添加银都大厦为途经点,上车后再把车牌号发给飞书同事,并提醒对方10分钟后下楼。
这套使用方式在去年的技术预览版——努比亚M153上已经有过雏形。一段公开演示中,用户让豆包根据相册里的一张血压仪照片,在淘宝“挑一个便宜的同款”,再“把链接发给张三”。豆包识别出商品,也识别出“张三”是QQ好友,随后连续完成相册、电商和社交应用之间的操作。
据悉,M153调用了Android的INJECT\_EVENTS系统级权限。获得用户授权后,即使第三方App没有为AI提供接口,豆包也可以模拟点按、滑动和输入;遇到密码、人脸识别等敏感环节,再把手机交还用户。
但在实际使用中,涉及到一些登录验证和平台风控的跨App操作都可能中断任务。随后,豆包主动限制了金融支付、刷激励等高风险场景。
今年2月,Google在Galaxy S26系列和部分Pixel 10机型上测试Gemini多步任务:它可以为同事安排包含多个停靠点的网约车,任务转入后台后,用户仍可通过通知查看进度、随时接管,并在购买前确认。Google负责Android开发者产品管理的副总裁Matthew McCullough在官方博客中写道:“衡量应用成功的标准,正在从‘让用户打开App’转向‘真正完成用户的任务’。”
2026年以来,一批系统级手机AI助手批量涌现。
6月发布的HarmonyOS 7开发者Beta中,华为小艺接入超过200项系统级感知数据,可以从面试邀请中识别时间、地点和注意事项,写入备忘录;也可以在手机上要求小艺寻找电脑中的文件,再发送到手机。
7月的2026世界人工智能大会(WAIC)上,努比亚NaviX Ultra、阶跃星辰STEPX Neo和荣耀Robot Phone集中亮相。STEPX Neo搭载的Amoo助手接到“帮我处理一下明天汇报的事情”后,会读取飞书日历和群消息,拆解任务、生成PPT(演示文稿),再把文件发回飞书;修改文档前会申请权限,涉及支付则由用户确认。
而几乎在同一时间,超级App们和手机AI助手之间的关系也在发生变化。
今年6月,微信确认与华为、荣耀、小米、OPPO、vivo合作A2A(智能体间通信)能力,手机助手可以提交发消息或音视频通话指令,由微信执行并返回结果,全程采用双重授权。8月,vivo蓝心小V与支付宝服务智能体“阿宝”合作,用户说“帮我叫车去高铁站”或“帮我开具打车发票”,相关服务均可在对话中完成。
可以看出,2026年,手机AI助手进入了密集发布期。除了搭载豆包手机助手的努比亚之外,Google、华为、阶跃和荣耀相继将Agent带到手机系统层,微信、支付宝等超级App也开始接收系统助手发出的指令。
AI替你点屏幕,怎样才能不越界?
当采用GUI路线的手机AI助手越来越普及,它们更加迫切地需要处理三项权限问题:用户是否授权、应用是否放行,以及发送、下单和支付前由谁确认。从豆包此次推出SAEP(屏幕自动化操作声明协议)上,也许能窥探到有关这一权限边界的安全举措。
目前,CUA(计算机操作智能体)已经将GUI技术路线作为主流,它在解决的问题是:AI如何直接操作软件,又如何限制可访问的范围。有研究员把CUA形容为“给你的电脑配了一个特别全能的程序员,什么都懂,会写代码,同时也懂网络安全”。
目前的操作方式是:面对可以结构化处理的任务,手机会优先调用代码、命令和工具;只有遇到没有接口的软件,才转向识别屏幕、点击按钮。GUI更像一项兜底能力,让Agent能够继续操作那些尚未向AI开放的软件——手机App数量庞大,各种临时页面又不断变化,不可能全部接口化,需要GUI来覆盖未接入的部分。
一位GUI研究员告诉智能涌现:“不能指望所有App开发者都为AI完成适配,GUI肯定是必要的补充。”另一位从业者也提到,“短时间内,市面仍会有很多软件不具备AI能力,尤其是大型软件,即使有接口也非常复杂,可能一时半会儿接不完。”
手机Agent比电脑Agent更依赖应用生态。在电脑上,操作系统可以直接决定哪些软件可以通过与Agent连接;但到了手机端,操作系统不具备这样的权限,不仅不同服务都被封装在各自App内,定位、相机、通讯录等权限也由系统和应用共同控制。如果第三方App既不开放接口,也不允许AI操作界面,手机助手就无法继续执行任务。
目前,GUI会把每一步操作显示在屏幕上。一位研究员说,“大家都能看得懂,也都能够了解这个AI助手正在做什么东西”。用户可以据此判断是否暂停或接管。
但“看得见”不等于“做得好”。卡内基梅隆大学研究团队今年推出的手机Agent评测基准iOSWorld,用26款自研iOS应用模拟同一名用户的数字生活,并设计了133项任务。表现最好的模型在跨应用任务中的成功率也只有37%,真实消费场景还要面对不断变化的页面、身份验证和平台风控。
和App场景相比,手机系统层还聚合了相册、通讯录、位置、日历等用户个人信息。手机AI助手掌握的信息越完整,能完成的任务越多。所以,接下来要比拼两项能力:一是“怎么造出更多、更好的数据”,二是“怎么编排各个步骤、各个Agent之间的协作”。
但同时,更多能力也意味着对生态的要求也更高。
对此,豆包手机助手选择推出SAEP(屏幕自动化操作声明协议),允许第三方应用在GUI Agent执行前,先声明是否放行,以及哪些操作不可执行。
“SAEP有点像AI时代的Robots协议(网络爬虫访问规则)。网站通过这项协议告诉搜索引擎等自动程序,哪些页面允许抓取、哪些不允许;SAEP则让应用声明Agent能否进入应用,以及哪些操作必须停下。”一位研究员解释。
接入SAEP后,第三方应用既可以拒绝全部屏幕自动化,也可以只限制内容发布、删除、签到抽奖和权益领取等具体操作;拒绝声明随时生效。30天公示期内,除系统自带应用、字节跳动旗下应用和明确同意接入的第三方应用外,其余应用默认不操作。公示期结束后,未表态的应用将按风险等级逐步开放,明确拒绝的应用则始终不被操作。
应用通过SAEP表达意愿,手机系统负责读取声明、限制GUI权限,并在敏感步骤交还用户。这需要模型公司与终端厂商共同完成。
此前,努比亚总裁倪飞把豆包与努比亚的合作概括为:“模型公司解决AI能不能做到,终端厂商解决用户能不能真正用起来。”按照倪飞披露的分工,豆包负责大模型和Agent能力,努比亚负责系统、硬件、产品工程、质量、渠道和用户服务。合作范围覆盖模型、操作系统和整机工程。
在这套分工中,权限与信任最终由操作系统承接,这意味着手机操作系统和Agent的关系将愈发一体化。
今年8月,在杭州举行的支付宝AI生态合作伙伴大会上,vivo副总裁、AI全球研究院院长周围曾表示:“硬件形态不会消失,但操作系统会重构——从管理App,变成管理Agent、管理权限、管理信任。”
更早的7月,国家互联网信息办公室首次单独公布7款手机端侧生成式AI服务备案,涉及Apple智能、华为小艺AI大模型、OPPO AndesGPT大模型、vivo蓝心端侧大模型、小米澎湃AI、三星盖乐世AI和努比亚豆包手机大模型。手机系统级AI助手,正在进入一个行业井喷期。
一位GUI研究员对智能涌现表示,相比独立AI应用,手机拥有更稳定的用户关系:“只做AI软件,用户可能谁免费就用谁;但手机不一样,一部手机往往要用几年,会伴随用户很久。”
9月16日,NaviX Ultra将正式开售。届时,豆包手机助手将正式进入消费市场,SAEP也将随之接受真实用户和应用开发者的检验。
图片来源|豆包手机助手
实测最新版「豆包手机」助手:所有手机里的AI都该变成它这样作者|王兆洋
微信|Geisterspiele
豆包手机助手消费者版今天正式发布。
搭配了它的手机长这个样子:
搭配了豆包手机助手消费者版的努比亚 NaviX Ultra 将在 9 月 16 日发布
和预览版相比,官方对这个助手的定位显然变化:这是一个面向量产,面向广大消费者的产品。也就是说,它不再只是一个原型机了。
在此前第一次亮相时,豆包手机助手引起了不小的波澜,它以 GUI 为主的技术路线给既有的一切都带来了新思路,让所有人开始思考模型越来越强后,手机会变成什么样,过往我们已经习以为常的以 App 为主的交互方式又会变成什么样。
所以当豆包的朋友找我说要不要提前体验下这个产品时,我立刻答应下来。我对它充满了好奇,和初代的实验属性不同,这个要真正量产,大规模提供给广大用户的产品,究竟做到了什么程度?
现在正式官宣之后,也终于能跟大家分享这段时间提前使用它的感受了。
1
万能对讲机
豆包手机助手消费者版和硬件做了很多融合设计,比如第一时间拿到这台机器,从外形来看,最明显的就是侧面的 AI 键。是的,你可以用它唤起豆包助手。
在我之后的各种使用里,这个 AI 键成了我和这台机器交互最主要的方式。
比如,当我让豆包自动去飞书发送会议邀请时,我的操作过程是,在锁屏状态按住 AI 键直接呼出豆包,语音告诉它去给我们的飞书群发一个会议邀请。
因为这个小小的 AI 按键配置了指纹识别功能,手机识别指纹后可以给豆包助手相关的更高权限。所以不需要屏幕解锁,只要是 AI 键识别了你的指纹,它就在后台开始一顿操作,然后很快就完成了任务。
后来我还顺便让它去看了看我飞书上昨日在内容部门等几个核心工作群里的记录,给了我一个待办列表。这些都是很多人日常工作的常态,而整个过程丝滑无感。
这种按住说话,然后事情就完成摆在你面前的感觉,的确改变了人们对手机的交互方式的预期。
而且在使用了一段时间,用这种方式处理了诸多类似任务后,它成了我下意识会去使用的交互方式。
任务解决的完成度越高,这种新交互“习惯”养成的顺滑度也越高,我不自觉的去按这个按钮的频率,可能真不亚于人们接受 iPhone“发明”的滑动触碰交互方式的速度。
这是个融入了硬件的 AI 交互。这不免让人想起当年苹果早早在 iPhone 17 的侧面就放了一个“快门”按键,为后来的苹果 Intelligence 先占了坑,然而后面的故事有点变成笑话。
我感觉人们眼里苹果本该给这个按钮打造的功能,应该就是豆包二代的这个样子。
这种按住说话的交互给我的感觉,像是我在拿着一个万能对讲机。
这会让人想不停探索这个对讲机能搞定的事情。
我也试了几个我一直想做的,“一句话完成各种 agent 任务”的能力。
比如,我直接通过语音,让豆包助手去自己操作手机,调用底层能力,跨 App 操作,完成了一个 vlog 剪辑工作。
我“口喷”的提示词(其实就是想到哪说哪)很简单:
把我相册里不超过 20 秒的视频,按照《午夜巴黎》开头的那个空镜的组合的方式去剪辑成一个 vlog, 保留视频本身的原声音,然后再配一个同样同款的 BGM。
以下是它给我的结果:
可以看到这个指令涉及多个复杂环节,它涉及对一部电影的某个含糊表达的具体部分的理解,涉及对我意图的判断,和对手机上可以调用的 App 的选择,以及,自动操作手机的能力。
而我暗中观察了它操作的过程,这些难点都一一顺滑实现。
这是个我一直想做,但因为我从来没用过剪映没怎么剪过视频,而一直没做的任务。现在,只要我手机里有这些素材,就真的能“张张嘴一句话”完成了。
这些体验下来,你很难不觉得这个手机就像一个从哆啦 A 梦兜子里拿出来的万能对讲机。
另外,在这个任务里,还可以看到豆包手机助手在 AI 层面不少核心设计思路。
豆包手机助手预览版最引人瞩目的就是自动操作手机的能力。但也是引起最多争议的能力。这一代在操作不同 App 的方法上,也引入了类似 MCP 的方式。基于软硬件结合的设计,豆包手机助手底层的打通程度更深,大模型可以调用电话、日历、闹钟、飞书等底层工具的能力来完成任务。
而自动操作手机的能力继续以 Beta 版的形态保留。当你在设置里打开,它可以在一些任务里通过模拟点击和调用工具的方式来帮你操作手机上的各类应用。操作可以在后台进行,不影响用户正常使用手机。
在这个任务里,可以看出它对手机本身的相册的底层调用,对 App 的 GUI 点击操作。这些能力目前主要会支持一方应用和字节系相关产品调用。
这也是外界最关注的能力之一,而在这一次发布的同时,豆包手机助手也一起推出了一个新的协议:SAEP,也就是屏幕自动化操作声明协议(Screen Automation Execution Protocol)。
它给了第三方应用选择权,应用可以自主选择允许或拒绝 AI 助手在应用内执行屏幕自动化操作。
同时,它也允许开发者们申请和接入协议。
发布之日起,豆包手机助手也启动了为期 30 天的规则公示:
“公示期内,豆包手机助手仅对系统自带应用、字节跳动旗下应用,以及已经通过 SAEP 或邮件明确同意接入的第三方应用执行自动化操作,其他应用默认不操作。”
我还用了用豆包“替你接电话”的功能:
在设置里,你可以设置它接听的范围,接听的策略。我给了它所有权限,然后用自己的另一个号试了试,再然后,我就……忘记了自己开通了这个设置。
直到有天在车上,我突然看到手机自己开始对话起来,低头发现是豆包在替我接电话。
有意思的是,这个电话听到后面,我才意识到,对面也是 AI。
深度的使用了一段时间后,我发现它的很多功能都已经很强,也比较稳定。而这是任何一个有野心彻底重新建立起一套交互习惯的产品,必须做到的前提。
按照官方给出的数据是,这一代相比此前,整体可用率提升至了 80%。
这些能力已经足够神奇,但在个人 agent 类产品过去一段时间快速的在用户里渗透后,它们似乎多少还有些“常见”。
而我对这款产品更大的期待和好奇,是它能不能更加接近一个真正的个人助手,甚至,私人助手的状态。
也就是它开始在这些常规任务之外,能更深入你个人的 context,解决一些你自己定义的需求。
而在边用边查看它在技术工程上的创新点后,我突然意识到,有一个我嘀咕了一年却一直没实现过的功能,可能终于可以做出来了。
1
胡适日记 AI
2025 年我发过一条朋友圈。
要完成“根据我过去一年的照片的地理位置信息,告诉我过去一年都在哪些地方游荡,分别待了多久”这个任务,其实每一个零件都是现成的。照片有 EXIF,EXIF 里有经纬度和时间戳,地图能把经纬度翻成地名,模型能把这堆结构化数据写成人话。没有任何一环需要新技术。
我常年在外面跑,一年下来去过多少城市、见了多少人,到年底一复盘,全忘了。可这些信息全都躺在这台设备里——几千张带 GPS 和时间戳的照片,排得满满的日历,便签里塞着的机票截图和随手记。
但之前这些信息都是“死”的。
过去一年里我试过第三方 App,试过云端模型,全都卡在同一个地方:拿不到东西。没有一个第三方应用能顺畅读完你整个相册的位置信息,你得一张一张传;没有一个助手能自己跳去日历、跳去便签、跳去读书 App 把材料凑齐。想做一次完整的复盘,先花两三个小时在十几个软件之间复制粘贴——那还不如不做。
模型早就够用了。卡住的是权限和接口。没做的是具体的工程工作。
当时诸多 AI 硬件都在追逐着某种“模型原教旨主义”,试图让模型来接管一切手机和硬件产品的操作。
但我的这种需求并不是要模型来单独搞定,而需要模型、硬件底层、工程等一起协同设计解决。
所以在用了一段时间豆包手机助手消费者版后,我终于把这个需求扔给了它。
第一版指令很简单:根据我相册里的图片来告诉我这两天我在哪里,做了些什么?
几秒钟出结果。准确,完整,有据可查。这一步在过去没有任何设备替我做到过。相册、定位、时间戳,第一次真的被一个助手完整读了一遍,不用我传,不用我导,不用我在十几个软件之间来回捣腾。
但我对着结果看了一会。我发现这本质还是只是把我的数据念了一遍给我听。
读完之后,最大问题是我没觉得它更懂我。它做的还是检索和罗列,我自己想了想,我其实想要的是理解和呈现。
那怎么搞,其实能想到的直接方法也简单,就是提示词再改改。但过去的经验提示,这样去操作其实会很随机,有时效果好有时不好。
如何让这个手机上的 AI 助手能更懂你,最好就是一个安全可控的记忆系统。
说直白一点,记忆这一层夹在你和模型中间。模型本身是不记事的,每次任务都从零开始;而手机里的数据又太多太杂,全塞给它也没用。豆包这次把能记的东西分成了三类。
第一类是你手机里本来就有的存量数据——录音、联系人、相册、短信、便签、日历。这些东西一直都在,只是从来没有被完整读过。主动授权之后助手可以调用,为此他们专门配了一个本地搜索工具,负责在这堆存量里检索和找回。
第二类是你主动告诉它要记的。给助手发一条记忆指令就行,灵感、购物清单、待办都算。
第三类是你日常刷手机时顺手“收”的,豆包手机助手提供了诸多入口:语音(对手机助手说记一下),AI 按键,组合键,快捷手势(三指上滑就能把屏幕里的内容保存进记忆),截图(截完点一下「记忆」,长截图也支持)等。
此外还有一层单独的,也就是个人 context。
它有两个来源:一是你主动提供的、希望被记住的信息,比如常用地址;二是豆包在跟你对话过程中自己学到的偏好,比如口味、习惯。这些不会作为一条条"记忆"摆给你看,而是沉淀下来,在后续任务执行的时候当上下文用。
我感觉是豆包把这手机本身作为一个大模型,给它做了一整套新的 harness 系统。
于是我决定在这个记忆系统里简单操作一下。
我想了想我要它怎样来记录或者说描述我,想了想,也许就像让 Her 里的 Samantha 来描述西奥多。
然后我想到了胡适和他的日记。
既然这是一个有点日记意味的功能,那当你想要记录今天的生活,看着这个全世界不停发生“见证历史”的大事、AI 突飞猛进、但同时每个人其实还是在过着自己眼前生活的时代的时候,总让我想到胡适,想起胡适的日记。
民国乱世,世界打得天翻地覆,他似乎该打牌打牌,该读书读书。一战打得最凶的时候,他在日记里检讨自己最近牌打多了。大时代的惊涛骇浪和一个人细碎的日常揉在一起,读起来让人心有戚戚。
于是!需求到这儿就完整了:
让豆包手机通过理解相册里的图片内容和地理信息,然后用胡适的方式,把我每天的生活细节,和当天发生的行业大事拼进同一篇“日记”里,用最懂我的方式记录日常。
我先让它自己上网搜索并阅读胡适的日记,把其中最符合我所说的感觉的语句加入到长期记忆中去,作为写法的参考。与此同时,它其实也已经根据它的理解,记录了不少它认为适合记录的关于我的个人 context,我很好奇这一切“揉”在一起,产出的“日记”,会是什么样。
然后我对它用语音发出了一个非常随意但繁琐长程的指令:
能不能去看一下我昨天拍摄的照片,然后根据这些照片内容的信息,和尤其是照片在手机里存的这个地理位置信息,结合着一起,然后判断一下我在,我昨天都做了些什么事情。同时呢也去搜索一下当天发生的世界上最重要的的一些新闻,然后呢用你,我之前存过的我非常喜欢的胡适的日记的风格去记录一下我昨天的一些,算是一个小的日记,不用特别长篇大论,然后放到我的便签里面。
说完我放下手机,去倒了杯水。水还没喝完,3 分钟后,手机弹了通知:任务完成,已保存至便签。
说完我放下手机,去倒了杯水。水还没喝完,3 分钟后,手机弹了通知:任务完成,已保存至便签。
我打开这个弹窗:
七月二十一日,星期二
今日在西溪龙湖天街盘桓竟日。傍晚与友人在商场内食寿喜锅,蘸生鸡蛋入口,滋味尚佳。饭后闲步逛店,见玩具反斗城陈设,中庭人来人往,市井烟火气甚浓。晚间驱车返程,至五常港路遇晚高峰拥堵,车窗外灯火连绵,车流如织,伫立良久方得通行。阅今日新闻,英国工党伯纳姆就任首相,十年来英已换七相,政局之不稳可见一斑;西班牙竟在世界杯加时胜阿根廷夺冠,倒是意外之喜;国内上半年工业增加值增百分之五点四,青年失业率回落,也算可喜的消息。世事纷纭,日常的一餐一游,倒是最实在的光景。
看完愣了会。寿喜锅、五常港路的晚高峰、英国换首相、西班牙夺冠。
我的私人生活和当天的世界大事,就这么并排放在了一起。
1
唯一一直在你身边的可能就是你的手机
在“开发”出来这个胡适日记 AI 后,每天一天结束我都会让这个 AI 胡适出来写一写。
操作了几次之后,豆包主动提示可以把它做成一个固定任务。
这样一个我一直想实现的功能就这么实现了,而且它的确让我第一次感觉到一个"手机"能有多懂你。
在快 20 年前 iPhone 诞生的那场发布会上,乔布斯说 iPhone 是三样东西合成一个:一个宽屏 iPod,一部手机,一个上网设备。
他当时没有说、大概也没有办法预料的,是手机的第四个角色。
后来的十几年因为这个东西实在太好用,人们开始把它带去所有地方。吃饭带着,走路带着,睡觉放在枕头边。十几年里,几十亿人把自己拍的、写的、说的、买的、去过的地方,源源不断地倒进了它连着的那张网。
是手机让今天的 AI 真正成为可能。
十几年里,事实上我们一直在往这些设备里写。每个人的一生大多数时候,唯一一直在你身边的可能就是手机。它替你记下了每一个地点、每一顿饭、每一次深夜的搜索。但是从来没有过一个读者。
所以那天那篇日记让我愣住的地方,其实不在于它写得有多好,而在于这些东西第一次被理解了一遍。手机做了十几年的记录设备,现在它多了一个身份,它开始成为一个读者。
当然,没有人愿意用几千张照片、全部行程和通话记录,换一篇写得还不错的日记。它今天之所以能成立,很大程度上是因为这些检索和理解发生在这台设备本身,而不是发生在某个你看不见的地方。二代豆包手机上,这些带指纹识别的 AI 键、留在本地的全局记忆的设定、负责在本机数据里检索的本地搜索工具等,也都是在解决这个隐私和安全问题。这一切能否保障好,才是让手机变成真正最懂你的 AI 助手的前提。
而当这些功能的运转足够安全,当它们开始可以由你自己定义、自己发明、自己在手机上实现后,我觉得我们就真的回不去从前的手机体验了。
我们看待手机的方式也会快速变化。我们用了它十几年来记录这个世界。现在轮到它来记录我们了。
LP周报丨厦门,悄悄逆袭聚焦LP出资、新基金、GP招募,捕捉LP圈一周商业情报。
作者丨黎曼
来源丨LP波谱
这一周,LP圈最忙的城市是厦门。
9月2日,海翼先导战新产业基金落地集美,规模20亿;9月7日,厦门时代深远创业投资基金在火炬高新区注册成立,出资12亿。同一周,博枫首轮超120亿元的中国新能源基金,签约仪式也放在了厦门,恰逢第26届投洽会9月8日在厦门国际博览中心开幕期间。
这两支基金和厦门本地关系最深的是海翼先导战新基金,出资方包括创翼创投、海翼投资、厦门先进制造业基金(背后是集美产投与火炬产投)均为厦门国资,唯一的市场化面孔是先导科技集团。
先导科技集团是全球唯一实现铟、镓、锗等稀散金属全产业链布局的企业。这些名字陌生的材料,正是光电、半导体和AI算力硬件的上游。基金落地之前,先导与厦门国贸合资的先导国贸科技已落户集美;投洽会期间,董事长朱世会又受聘集美"城市合伙人"。先引企、再合资、后共设基金,集美这套组合拳试图用20亿基金,把先导的产业资源和厦门的光电信息、集成电路产业焊在一起。
实际上,厦门作为一个旅游城市,在半导体产业的版图上也有一席之地。厦门算不上半导体产业的老牌重镇,但这座城市正悄悄逆袭,改写了自己的位置:
从20世纪90年代开始布局,厦门半导体产业走过了近三十年的积累期。2025年,全市产业产值突破500亿元,综合竞争力跃居全国第13位。这个数字放在全国半导体产业版图中或许不算最亮眼,但若将时间轴拉长,2014年时,厦门产值仅约50亿元,十年间增长了8倍。
更重要的是,这座城市已集聚了上下游企业300余家,形成了一条从材料、设备、设计、制造到封装测试、终端应用的全产业链闭环。在全国范围内,能做到“全链条布局”的城市屈指可数,厦门是其中之一。
而且厦门的半导体故事,有自己的独特方法论。不同于一些城市以制造或封测起家,厦门很早就确立了“设计带动制造”的产业逻辑,通过培育具有核心研发能力的芯片设计企业,牵引制造、封测、材料等上下游环节协同发展。
细数一下,厦门半导体产业的制造领域有联芯集成、三安集成电路、士兰微等骨干企业;设计环节有星宸科技、开元通信、亿芯源等;封测与材料领域则有通富微电、云天半导体、安捷利美维等关键配套。在第三代半导体领域,碳化硅外延晶片提供商瀚天天成也于今年在港成功IPO。
另一只厦门时代深远创业投资基金,重点则是宁德时代和宇通的故事,则不在此赘述,下文将会进一步介绍。此外,本周LP圈还有1条募资动态、8只新基金成立,以及新沂和南京玄武的基金正在遴选GP。
募资动态
博枫发起中国新能源基金
博枫近日宣布,旗下专注于中国能源转型领域投资的博枫中国新能源基金(Brookfield China Renewable Fund,BCRF)首轮募集预期规模超120亿元人民币。博枫中国新能源基金将是博枫首只专注于中国市场的人民币能源基金。为在强劲的中国新能源市场捕捉投资机遇,博枫中国新能源基金预计将进一步引入更多资本,并投资于运营期的风电、光伏及储能资产,持续扩大平台规模。
新华保险以40亿元成为基石LP,在120亿首轮募集中占据三分之一。这一体量的险资出资,在传统美元基金架构下几乎不可能实现。人民币基金架构是解锁这一合作的关键钥匙。新华保险的诉求是:在利率下行、资产荒背景下,寻找能够提供长期稳定现金流、具备抗周期属性的实物资产。
新基金
上海菡源璟思私募投资基金合伙企业(有限合伙)成立
企查查APP显示,近日,上海菡源璟思私募投资基金合伙企业(有限合伙)成立,出资额6.96亿元,经营范围包含:以私募基金从事股权投资、投资管理、资产管理等活动。企查查股权穿透显示,该合伙企业由上海交通大学教育发展基金会、上海国投资本管理有限公司、商汤科技旗下宁波市商毅软件有限公司等共同持股。
高校基金会又下场了。上海交大教育发展基金会认缴3亿元,是9名出资方里最大的一位。商汤旗下主体只出了3000万、占比4.3%,真正的主力是高校基金会和地方国资。"菡源"系交大基金会旗下投资平台。
海南国资等成立能源产投基金,出资额10亿
企查查APP显示,近日,海南儋州湘能能源(850101)产业投资基金合伙企业(有限合伙)成立,出资额10亿元,经营范围包含:以私募基金从事股权投资、投资管理、资产管理等活动。企查查股权穿透显示,该企业由海南自由贸易港(885764)建设投资基金有限公司等共同出资。
海南自贸港基金一个月内第二次出手,上次是给宁德时代配了25亿。这次落点在儋州,这是海南的工业重镇,洋浦经济开发区所在地,石化和新材料产业基础都在那儿。
南京江宁智创股权投资合伙企业成立
企查查APP显示,近日,南京江宁智创股权投资合伙企业(有限合伙)成立,出资额25.5亿元,经营范围包含股权投资。企查查股权穿透显示,该企业由南京江宁经开产业投资有限公司等共同出资。
江宁是南京经济体量最大的区,开发区国资凑出一只25亿级的基金,区级国资基金的体量正在向市级看齐。同一周,玄武区还发了30亿AI母基金的GP遴选公告,南京区一级国资在股权投资上的密度可见一斑。
12亿,厦门时代深远创业投资基金成立
近日,厦门时代深远创业投资基金合伙企业(有限合伙)成立,出资约12亿。其经营范围含创业投资等。股权穿透显示,由郑州宇通集团、宁德时代间接持股的厦门溥泉私募基金管理合伙企业等共同持股,溥泉资本为基金管理人。
GP是宁德时代间接持股45%的溥泉资本,溥泉此前投出的银河通用、众擎机器人、易控智驾都在机器人与智驾方向。这只基金LP席上还坐着郑州宇通集团,十五年来宇通100%采用宁德电池。宇通进场后,商用车电动化和换电生态大概率会成为新的投资主线。
晋创科技创新壹号母基金第二支子基金设立
近日,由省国资运营公司下属企业晋创投资联合晋信资本发起的晋创科技创新壹号母基金,完成第二支科创子基金“深圳南山深投鹏城战新创业投资基金”的设立工作。本次设立的子基金拟定规模10亿元,由深圳市投资控股有限公司下属私募基金管理企业深圳市投控东海投资有限公司(简称“投控东海”)担任基金管理人。
这是晋创科技创新壹号母基金继首支子基金“山西晋创天使投资基金”成功落地后的第二支子基金。基金将围绕人工智能、高端制造等高成长战新赛道。
金开新能等成立战新产业投资基金
企查查APP显示,近日,天津金开国鑫战新产业投资基金合伙企业(有限合伙)成立,出资额约5亿元,经营范围包含:以私募基金从事股权投资、投资管理、资产管理等活动。企查查股权穿透显示,该合伙企业由金开新能(600821)、天津津融国盛股权投资基金管理有限公司等共同持股。
金开新能是天津市国资委实控的新能源运营商,前身是老牌上市公司天津劝业场,目前装机585万千瓦。公司正处在转型关口:2025年归母净利下滑87%,正在从单纯卖电转向"算电协同",新疆伊吾智算中心已投运,还在布局乌兰察布。
深圳坪山高新区深投控交融硬科技私募创业投资基金完成备案
近日,深投控资本、交银投资、深圳市坪山区共同设立的“深圳坪山高新区深投控交融硬科技私募创业投资基金”完成中基协备案。该基金目标规模20亿元,首期落地6亿元,存续期10年,出资方包括深投控、交银投资及坪山产投。该基金存续期长达10年。LP是典型的“国资平台+区级政府+银行系资本”组合。从基金投向看,该基金聚焦深圳市坪山区的“车、药、芯、智”产业布局,重点投向人工智能与机器人、新一代信息技术、高端装备与仪器等赛道,支持早期和成长期硬科技项目。
深投控资本作为深圳国资核心投资平台,管理基金规模超600亿元,累计投资企业超百家。据交行半年报披露,交银投资上半年新增投放纯股权项目数量及金额同比增长超2倍;实现净利润14.66亿元,同比增长175.64%。
沈阳发布人工智能产业基金
9月9日,以“智改数转 AI兴工”为主题的2026全球工业互联网大会在沈阳开幕。当日,沈阳产业投资发展集团在大会上正式发布沈阳人工智能产业基金,总规模10亿元。该基金由沈阳产业投资发展集团与中信金石投资有限公司共同管理,联合浙商证券及其他国企共同设立。基金紧扣沈阳市“智改数转”行动部署和“3+4+3”现代化产业体系,重点围绕高端装备、生物医药、汽车制造等沈阳优势产业,将资本精准投向具身智能核心赛道和“人工智能+制造”应用场景。
辽宁300亿母基金落地一个月后,沈阳跟上了。10亿规模不大,但发布场合选在全球工业互联网大会,投向明确锁定具身智能和"AI+制造"——都是冲着沈阳老工业基地的存量场景去的。"投资不过山海关"的叙事正在一点点松动。
国泰海通、阳光人寿保险成立股权投资合伙企业
企查查APP显示,近日,嘉兴亘慨源股权投资合伙企业(有限合伙)成立,注册资本为5亿元,经营范围包含:股权投资;创业投资(限投资未上市企业)。企查查股权穿透显示,该公司由阳光人寿保险股份有限公司、国泰海通(601211)全资子公司国泰海通开元投资有限公司共同持股。
险资又来当LP了。阳光人寿出钱,险资配置私募股权的口子今年一直在放宽,这类"险资出资+券商私募子管理"的组合会越来越常见。
我,30岁“包工头”,1分钟1000元不敢挣真人短剧的产能开始在全国范围内“塌陷”了。
作者丨《中国企业家》记者 陈浩
编辑丨张昊 马吉英
来源丨中国企业家杂志
8月24日下午,《中国企业家》在郑州一处老办公楼见到石艺源的时候,他刚挂断一个电话。
屋里那台五级能耗的旧空调正在费力地转着,墙上、柜子里摆满了剧组开机纪念照和奖杯,桌上摊着一本没拍的男频短剧剧本。这是一位老朋友给他的——前两年常合作的一些平台短剧业务暂停了,老朋友自己拍了4部,据说都爆了,现在想再拉一支队伍,喊石艺源一起投资制作。
老朋友出30多万元,要他再投10万元。
“所以我刚才一直打电话问行情。”他说,“过了年我没开机,一直在做AI。现在AI什么行情我都知道,但如果让我去拍短剧,我肯定也要各方面去打听。”
打听回来的数字是这样的:去年日薪8000元到10000元的主演,现在有的三五千元也拍;他常合作的一个中年演员,去年对外报1500元,现在最低500元也接,即便如此,一个月最多也就干十几天;场务之前正常是400元一天,现在听说200元一天也有人干。大部分工种,价格降幅几乎都是“腰斩”起步。
“没办法。”他说,“大环境不好,大家都没活。你不降,没人找你,但你就是再降,就算不要钱,有时候没人找你也是白费心思。”
他掰着手指数了一些熟人的去向:一个年初还在当主演的演员,去卖房子了;一个中年演员4月找他想做AI,现在在当保安;还有朋友去开服装店、直播间、做风水命理师……
过去3年,郑州被业内称作“竖店”。据行业数据,这里聚集了上千家微短剧企业和近4万名从业人员,市场规模近百亿元,日均开机近百部。其中占多数的,正是中小型公司。
2026年春节前的一周,两件事接踵而至:红果短剧(以下简称“红果”)收缩保底政策,全国握有大额保底额度的制作公司几乎在同一天接到通知——没有开机的项目,一律停掉;紧接着,字节跳动正式发布视频生成模型Seedance 2.0,AI短剧的制作门槛被再度击穿。春节过后,真人短剧的产能开始在全国范围内“塌陷”。
按往年的节奏,3月中旬本该是复工旺季。可石艺源直到现在,今年只做了4部真人剧,其中2部还没上线。公司十来号人,放了一个多月的长假。“我就相当于一个包工头。”他这么给自己定位,“上游没活干,下游只能歇业。”
暗涌
这个“包工头”30岁,河南尉氏人,2019年从大连艺术学院影视表演专业毕业。他出生在农村,从小由爷爷奶奶带大,父母很早就去了外省打工。毕业前,他在北京找到一份短视频导演的工作,合同都谈妥了,但女朋友在郑州,家里催着安定,他放弃了。
回郑州后,一度没活干。他去女朋友上班的商超应聘储备干部,面试过了,要签合同的那天,一家广告公司打来电话,让他去试镜演员。这边合同没签,他就去了那家广告公司面试,终于可以干回本行,他兴奋极了。
郑州是国内信息流广告的高地。他当时并不了解,还以为进了“传销组织”。后来干起来发现挺简单,主要就是给教辅App和各类消费贷产品拍引流广告,“一天最多能拍几十条”。台词最后一句话永远是:点击视频下方链接就可以下载了。
石艺源现在回想起来,那时他还拍过一种内容,几乎就是短剧的雏形——把网络小说的高潮片段拍成视频投出去,把用户导到小说阅读平台。但那些视频算不上剧,只是一段“钩子”——一个从广告基因里长出来的产品,从第一天起就是为转化付费,不为手艺付费。这件事,他几年后才真正体会到。
信息流广告演员的生活很“安逸”:底薪4000元,朝九晚五,双休,没活干时就歇着。他心里那点躁动压不下去,在公司要给他转正交五险一金的时候,辞职了。期间,他去考了一次北京电影学院导演系的研究生——一个字没复习,交卷时开玩笑地对监考老师说:老师,你等着我,明年我肯定考上。
考完从北京回来,2019年11月12日,他在郑州注册了河南艺影源影视传媒有限公司,干到年底一共挣了1万多元,“还不如上班,但那时候就是有一股闯劲”。
这股闯劲撑着他熬过了新冠疫情。他不只拍中视频赚播放量补贴,还天天跑黄金批发市场拍“金价探店”,靠给粉丝代购黄金一单挣一二百元。2022年信息流广告大爆发,他一天能赶几个组,“屌丝男”“霸总”无缝衔接,那时日薪能到800元,甚至1000元。
那时,一种叫“直播剧”的直播形式也在快手等平台上兴起:豪门恩怨演到情绪顶点,主播就开始卖货。他一般演“反派”:“第一次去演的时候,记忆深刻,主播就在一个臭烘烘的猪圈里,我的戏份是一脚踹开门喊‘还钱’,那天直播间人气高得吓人。”这配角的戏份,一场也能挣五六百元。
2022年年中,朋友叫他去演短剧。30集一天拍完,他惊了。现场两台机器对着两拨演员:一拨对着镜头演,另一拨在旁边背词,画外还有一个人拿着本子替他们搭话。谁忘词谁下去背,刚背好的顶上,基本一条过。
那天下午5点,他还要赶去演直播剧,担心拍不完,结果不到点导演就放他走了。他很开心,一天挣两份钱,像捡了便宜,但并不知道自己正在走进一个此后几年疯狂扩张的新业态。
最后一环
入行后,石艺源只用了几个月就干上了导演。
2022年12月,有人找他导一部100集的剧,五天拍完,导演费1500元一天。第一天拍到凌晨三四点,第二天一早六七点又出工了,他咬了一口包子,结果上面沾着血——熬了一夜,嘴唇干裂出了血。他听说那部剧投了几万块钱,但具体投资额和收益跟他无关。
这是短剧产业链最典型的生存形态。郑州大部分公司做的是短剧承制,接平台或大公司派下来的单子,赚一道差价。整个行业公认的纯承制利润率在5%到8%,而剧组是以天为单位烧钱的组织——他算过,一开机,一秒至少是一元硬成本,而一场雨、一次场地超时、一次男女主的超时,就能把这点利润吃掉。所谓承制费,本质上不是利润,而是团队出租时间的基础价格。
石艺源后来想明白了,一级供应商真正卖的并不是制作能力,而是从平台手里拿到订单的资格。垫资压力、用工风险和不确定性被一层层向下推,最终落在最没有议价能力的产业链末端——只有那里,才需要用真实的人、真实的天数、真实的现金,去兑现合同上的利润。
入行头两年,他还赶上了一轮商业模式的换轨。刚开始,短剧是小程序付费的天下,一部剧八九成的流水要拿去投流,充值款从微信提现还要被抽成。他听说投流的ROI在1.2上下就基本可以挣钱,而提现抽成点数还在一路上涨,吃掉所剩无几的利润。
后来抖音切断了向微信小程序跳转的通道,把这部分流量收进了自家生态。2023年8月,红果上线,用免费模式跑了一年,到2024年下半年,免费剧与付费剧已在市场上各占一半,转过年的春节,免费就成了主流。石艺源对红果的体量没有概念,他只知道,自己上线的剧,最终多半都进了这类免费平台的作品库。
2023年,他去一家新成立的公司当执行导演,约定的薪资结构是1万多元底薪加几个点的分成,他看重的是分成。入职后,他只要开机在组里,每天基本要工作16个小时,平均只能睡三五个小时,出现过三次心悸和呼吸困难。巨大的压力实在难以支撑,3个月后他便离职了。
后来,正赶上咪咕想拍短剧,第一批就找到他。第一部是古装剧,采用的模式是共担成本共享收益,咪咕出大头。但横店剧组有个规矩是先充值再拍摄,由于时间问题,拍摄从7天砍到6天,在保证质量的情况下,他硬挤着拍完了。第二部《君临天下》拍满了7天,结果上线后数据没跑起来,也没挣到分成,“就只挣了个导演费”。
第三部是《盖世医尊》,也是他离“钱”最近的一次。该剧的二轮播放上了红果平台,跑出了成绩,他估摸着平台结给版权方的分账可能有上百万元。但那笔钱与他无关——他只约定了首轮分成权益,而且由于和合伙公司的纠纷,导演费也没拿到,唯一落袋的是一座咪咕的年度导演奖的奖杯。
在中小承制方的视野里,平台大概分成两类:咪咕属于一类,每个项目需要走投标中标流程,比较规范,一碗水要分给很多人,管控严格到一个月最多给一部戏。
红果则是把额度集中给少数头部公司,它们手里的活干不完,从平台接下的单子一个月能到上百部。而一个剧组满负荷运转,一个月最多拍3部——产能撑不起订单,干不完的单子,只能往下转。每转包一层,价格就被“剥掉”一层,直到落进没有转包余地的人手里。
2025年,石艺源开始接一家大型承制公司的活。那家公司一个月能做100多部红果的剧,他一个月能分到一到两部,他很清楚自己在链条中的位置。
他把红果的补贴比作当年“打车大战”:烧钱抢市场,退潮是必然的。对腰部以下的公司,账期永远是悬在头顶的剑。2025年底,和一家头部制作公司再谈合作时,账期已经在拉长,年底结清时他听说对方甚至是借钱贷款结的尾款。情分他记着,但不敢再干了——价格本来就低,账期再拉长,风险高到不值得冒险。
斟酌
春节过后,石艺源开始干AI。原因有两个——真人剧没有开机;两个做AI的朋友拉他合伙。“本身对AI不是很感兴趣,也不是我主动愿意做的,但是真人实拍短剧没活,也算是被逼到这条路上了。”他说。
他先去几家好朋友的公司考察,又花钱买了教程——3月组团队,4月磨流程,五一也没有放假,因为正经接到了第一单活。他并不算早,楼下一家更早转型的兄弟公司年前就去广州学习了一轮,“去年是学习,今年正儿八经干,但听说也没赚到什么钱”。
这单活是一部2D漫剧,出品方是一家网文平台,一共180分钟,合同上每分钟按约400元结算。实操下来,前六集大约12分钟,算力就花掉1万元,折合每分钟接近800元,是合同价的近两倍。
钱烧在抽卡上。AI生成的画面要保持一致——比如这个镜头戴着眼镜,下个镜头眼镜就没了,手表会消失,衣服的拉链会自己解开,穿帮一次就得重新生成一次。全片做完,算力花了6万多元,还不包含音乐、音效和配音,而总预算只有7万多元。
“真人剧要改片子,成本是人力和时间。AI改片子,每次重新生成都要花钱,改一遍就要付费,就怕客户无限制地改。”石艺源认为,这是AI剧与真人剧最本质的差别,AI剧的边际成本是刚性的。但甲方并不理解这个区别,他们只知道AI快,于是提出比过去更多的修改要求,AI确实提高了出片速度,也降低了甲方“推翻上一版”的决策难度。
第二单是一部横屏的仿真人剧,要求直出1080P——分辨率每高一级,单价和废片率一起涨。对方开价每分钟超过1000元,他没敢接:有了上一单的教训,他怕算力超预算,提出算力由对方另算,自己只按四五百元一分钟收制作费。
5个人做了一周,烧掉近30000元算力,产出了二十多分钟的片子,交上去被甲方全部打翻,最后只留下三分钟。后来,他索性改成完全按人/天计价,每人每天400元,不管这一分钟能不能用。最后干了半个多月,挣了1万多元。事后看,这是他今年做过最正确的判断。
更让他不安的,不是钱。真人时代,他至少知道自己是“三包”还是“四包”,到了AI时代,他连这个也不知道了,“我们在给谁干活?我们在挣谁的钱?”
真人剧的分包是“笨拙”的,需要场地、剧组和一群互相认识的人,链条因此是看得见的。AI的分包完全不需要这些,一条群发,一个网上的视频,不管认识不认识,就能完成一次转手——链条变得高效,也变得不可见。他从被层层抽成,变成了被无声地“稀释”。
与此同时,行业门槛也塌了。他见过从广州花万把元学了几天AI,回来就想要开公司的三门峡夫妻;做汽车美容的师兄也来问他这行能不能干;婚庆公司、工程公司和做新能源的老板一窝蜂进场……用他的话说,但凡跟视频沾点边的人都想入行,“而这个阶段真正稳定赚钱的,是卖教程和办培训的人”。
“没入局的人看不到坑,入局的人都已经踩到了。”
上半年的行业数据他也刷到过:仅抖音端,新增AI短剧22.19万部,播放量破亿的只有1055部,破亿率不足0.5%。在这样一个分母面前,他积攒了7年的经验开始失效。
平台对AI内容的态度也在收紧。7月22日,红果就“高频AI脸”泛滥、形象同质化和版权侵权发布公告,启动专项整治。半年里,AI剧从被热捧走到被规范。
也有同行劝他做自制剧和海外剧,搏一把爆款,他摇头,“自制剧搞不好,亏得更多,海外剧一旦大家都做,也不挣钱了。”能稳稳活下来的,要么手里有平台的稳定额度,要么有自己的发行投流路子,这两样他都没有。
那天的采访结束是傍晚,一行人去吃饭。饭桌上,石艺源的微信响了。有人辗转找到他的联系方式,问他能不能带着做AI短剧,他直接劝退了。不是保守,也不是不愿意带人,是他自己也不知道钱在哪里。7年前,他到处见组、求人给活干,如今有人来求他带路,他反而觉得自己能拿出来的最有价值的东西,是一句规劝。
他30岁,两个孩子,大的快上小学了,母亲在郑州帮他带孩子,父亲还在外省打工。他没当年那么“勇”了。
问他接下来怎么办,那本真人实拍剧还入不入局?他想了很久,先是描述了下他所观察到的现状:真人短剧其实已经在慢慢回暖,有人在开机了,只是不多。
“这个行业淘汰了很多人。”他语气平淡,“我不知道能不能等到回暖。有活的话,我会接,但得先斟酌好。”
本文仅代表原作者观点,不代表投中网立场
一文看完苹果发布会:折叠iPhone又给所有手机上了一课(除了AI)作者|陆
微信|SHARK_CHILI_LU
北京时间 9 月 10 日凌晨,John Ternus 首次以苹果 CEO 的身份主持了这场秋季新品发布会。iPhone 18 Pro 和 Pro Max、AirPods 5、Apple Watch Series 12 与 Ultra 4 依次登场,折叠屏则留给了最后的“One more thing”。
图源:Apple
标准版 iPhone 18 和第二代 Air 没有在这一晚出现,整场手机新品的重心,明显向高端“移动”了。
1
苹果终于发布了折叠屏 iPhone,可是大家都猜错了名字
关于折叠 iPhone 的名字,大家替苹果操了很久的心。 最早爆料的 iPhone Fold 最直白,iPhone Ultra 听起来也符合“有史以来最贵 iPhone 的这个标签”,然而最后出现在发布会上的却是 iPhone Duo。
Duo 这个名字让我立刻想起微软的 Surface Duo,那台由两块独立屏幕组成、像小本子一样打开的设备,曾经也让人期待手机能有另一种用法。可惜这个系列没能走下去,如今两代产品都已结束系统与安全更新。苹果这次展开的是一块连续的柔性屏,技术路线不同,但那个熟悉的名字,还是让人忍不住多想了一下。
图源:不客观实验室
把 iPhone Duo 合起来看,它的轮廓更接近一本护照。5.4 英寸外屏听着不大,苹果给出的显示面积却相当于 iPhone 18 Pro 的约九成;打开之后,7.6 英寸内屏比 Pro Max 多出约一半显示面积,内外屏保持相同的画面比例,内容在开合时可以按比例展开,减少切换屏幕后重新排布的突兀感。
图源:Apple
在演示里,比屏幕尺寸更容易让人注意到的,是挪到侧面的 Dock 和操作控件。苹果把过去占据上下空间的部分按钮移到两侧,给内容留出更多纵向空间,也让拇指更容易够到。
图源:Apple
邮件可以同时显示列表和正文,两个应用可以并排运行,同一个 Safari 也能打开两个窗口,淘宝京东拼多多比价时终于不用反复切来切去。
图源:Apple
这些用法在安卓折叠屏上已经不陌生了。轮到苹果来做,我其实更想知道微信里的链接、购物页面、文档和视频,能不能同样顺畅地利用这块屏幕。发布会上展示的系统应用适配只能回答一部分问题,真正每天会碰到的,是那些我们用得最多、却未必会第一时间为新形态重新设计的应用。
苹果还预告在今年晚些时候,USB-C 版 Apple Pencil 将能在 Duo 的内外屏上使用,iPhone Duo 的侧边按钮集成了 Touch ID,内屏的 FaceTime 摄像头藏在显示屏下方;手机半折着放在桌上,可以自己站住拍照、打视频电话;进入待机显示也不再要求一直插着电。几项功能放在一起,已经能让人想到床头、办公桌和出差途中的具体用法。
图源:Apple
图源:Apple
当然,折叠屏打开之后,没用过折叠屏的用户最先找的恐怕还是那道折痕。
图源:APPLE 美国现场 爱范儿拍摄
苹果在这场发布会上花了相当多时间解释屏幕结构,表面采用纳米纹理处理,减少眩光和反射;定制聚合物覆盖层与防刮涂层负责保护表面,内部还有高强度玻璃、允许各层在弯折时相对滑动的黏合材料,以及位于底部的钛金属支撑板。
图源:Apple
发布会还展示了铰链匹配、逐台扫描和微层补偿等制造环节,想让一块能反复弯折的屏幕看起来足够平整,显然要处理的远不止中间那一道印记。听到屏幕下面的钛板,我想到的是三星前段时间公布的 Flex Titanium。
三星在 7 月 15 日的官方介绍中,提到了一套由钛合金薄膜和钛板组成的结构:薄膜位于 OLED 面板下方,提供内部支撑;更下方的钛板则支撑整个显示模组,并通过折叠区域的微孔设计兼顾弯曲能力。三星希望借此减轻折痕、提高耐用性,同时继续压缩显示结构的厚度。
图源:三星
把两个介绍放在一起看,确实很容易联想到此前关于三星为苹果提供高度定制折叠显示方案的传闻。至少在材料选择和支撑思路上,两者有值得对照的地方。不过仅凭“都用了整块钛板”还不能确认它们采用同一套结构,更不能把面板供应直接等同于整机折叠方案,苹果这次强调的表面处理、铰链、叠层和装配校准,也都在影响最终效果。
Duo 内部采用 A20 Pro、C2 调制解调器和双电池设计。苹果标注的内屏视频播放时间最长为 31 小时,外屏为 44 小时;有线快充约 20 分钟可充至最多 50%。这些是指定条件下的测试结果,日常频繁开合、拍照和联网使用的续航,还要等实际测试。
图源:Apple
拍照方面,它配备 4800 万像素主摄和超广角,支持主摄提供的 2 倍光学品质变焦,但没有 Pro 系列的独立长焦和可变光圈。
图源:Apple
折叠结构倒是带来了一些很生活化的功能:被拍的人可以在外屏看见自己,拍孩子时可以播放动画吸引视线,合照也能让手机判断大家准备好后自动拍摄。15999 元的起售价并不意味着 iPhone Duo 的每一项相机配置都超过 Pro Max,贵出来的部分更多落在这套屏幕和结构上。
图源:Apple
交互方面一直都是苹果的强项,iPhone Duo 用丝滑的动画效果,给这个世界上所有其他的手机厂商结结实实的“上了一课”。
当演示中的 iPhone Duo 在掰开的一瞬间内屏亮起,外屏进入磨砂玻璃效果的那一瞬间,你就明白了这家科技巨头仍然是地球上最注重细节的公司,那种宛如翻开一块玻璃的“通透感”,值得所有友商好好学习。
图源:Apple
值得注意的是,国行 iPhone Duo 的上市安排这次也需要把发布前后的消息分开看。
发布前曾有国行可能因 eSIM 适配而晚到的说法,这很容易让人想起去年的 iPhone Air。不过,截至发稿,苹果中国官网已经明确写出:10 月 16 日晚 8 点接受预购,10 月 23 日发售,与英文新闻稿中的首发日期一致。
图源:Apple
我更关心的,其实是已经用上 iPhone Air 的人这次能不能“少跑”一趟营业厅。毕竟手机的照片、应用和设置都可以在换机时迁移,手机号码能否一起过去,却取决于运营商是否支持相应的 eSIM 转移方式。
苹果中国官网对 Duo 的说明仍然要求前往运营商线下营业厅,核验身份证件并激活 eSIM;目前也没有看到明确适用于国行 Air 换 Duo 的免到店迁移承诺。
因此,我们还不能把系统里的“eSIM 快速转移”理解成大陆用户一定能用;甚至发布会上介绍的 iOS 27 可以支持两部 eSIM 版 iPhone 进行“信号接力”的功能,中国大陆用户也暂时无缘。
图源:Apple
对第一批接受 eSIM 的用户来说,去年已经为了体验新形态的 iPhone Air 调整过一次使用习惯,今年换机时如果还能再省掉一道手续,体感上的便利可能比发布会上许多漂亮的过渡动画都更加直接。
1
可变光圈终于来到了 iPhone Pro 上
把目光从 Duo 移开,iPhone 18 Pro 这次最值得展开说的是相机和散热。
iPhone 18 Pro 的 4800 万像素主摄加入可变光圈,提供 f/1.48、f/1.8、f/2.8 和 f/4.0 四档选择。系统可以根据场景自动调节,也允许用户自己控制。
图源:Apple
暗处需要更多进光量,合影时希望前后排都清楚,或者想主动改变画面景深,现在的新 iPhone 多了一项真正发生在镜头里的机械调节。不仅如此,iPhone 18 Pro 还首次加入了相机的 Pro 控制选项,能够自行 调整快门速度、白平衡和直方图,常用设置可以放到更容易找到的位置。
图源:Apple
对喜欢拍照的人来说,这比再多几个预设滤镜更有探索空间。不过小尺寸传感器上的光圈变化最终能带来多大程度的自然虚化和画质提升,虽然苹果在发布会用样张展示了可能性,但日常随手拍能否稳定得到同样的改善,才决定这项功能会不会经常被用到。
图源:Apple
芯片方面,A20 Pro 进入了 2 纳米制程,苹果为其增加了第二组神经网络引擎,总计 32 核,并把芯片与内存的封装布局重新调整,让芯片更直接地连接散热系统。新一代均热板面积达到上一代的三倍,官方宣称,整机持续性能相比 iPhone 17 Pro 最高提升 40%。
图源:Apple
这些变化放在游戏、长时间拍摄和设备端 AI 里更容易理解:手机刚开始运行时有多快,和运行十几分钟后还能有多快是两回事。苹果这次把不少篇幅花在热量怎么被带走上,也让人更期待后续的持续负载测试。
图源:Apple
续航方面,发布会介绍 iPhone 18 Pro Max 最长 45 小时视频播放是针对纯 eSIM 机型的,中国官网给国行标注的是 43 小时。;国行 Pro 和 Pro Max 分别从 9999 元、10999 元起售,9 月 12 日晚 8 点预购,9 月 18 日发售。
贯穿这些硬件介绍的 Siri AI,也终于有了更多可以落到具体操作上的演示。
图源:Apple
演示视频中,当使用者问 Siri “妈妈来访时想一起做什么”时,Siri 从邮件和信息里找到食谱与聊天内容,再把缺少的食材加入购物清单。
图源:Apple
它还可以根据相机看到的内容回答问题,在应用中执行操作,并通过独立的 Siri 应用保留和接续对话。比起单独回答一个常识问题,这类演示更接近人们对手机助理的期待:记得我收到过什么,也知道接下来该去哪里处理。
图源:Apple
Safari 现在能够基于 AI 监测网页变化、用自然语言生成快捷指令、打电话时调出相关订单信息,以及照片扩图和重新构图,也都沿着这个方向展开。
图源:Apple
图源:Apple
但功能演示之外,语言、地区和额度仍会影响体验:Siri AI 首先以英语测试版推出,部分依赖服务器模型的能力有使用限制,用户可以选择购买更高版本的 iCloud+来获得更多的使用时长。
国行页面对 Apple 智能的说明,依然是推出时间取决于监管审批。所以对于我们来说,买到新硬件与用上发布会上全部 AI 功能,还不能画上等号。
图源:Apple
1
Airpods 5 和新 Apple Watch
AirPods 5 的变化倒是很容易说清楚:这次两款都给了主动降噪。
图源:Apple
999 元的基础款以及 1149 元的无线充电盒款,都保留了不带硅胶耳塞的佩戴方式。后者多出耳柄滑动调音量、无线充电,以及更长的单次续航;开启降噪时,两款官方标称分别最长听 4 小时和 5 小时。
图源:Apple
两档产品只差了 150 元,我建议所有有意向购买的用户都选择 1149 元的版本。
苹果还表示,新声学结构让降噪效果相比上一代最高提升 50%。对于不喜欢耳塞深入耳道的人,值得关注这一代实际的佩戴和降噪表现。
图源:Apple
至于发布会上展示的实时翻译与 Siri AI,则仍要结合所连接的 iPhone、语言和地区支持情况来看。
在 Apple Watch 的演示里,我印象比较深的,是把刚刚没听清的话“找回来”的 Live Rewind 功能。
这是 Series 12 和 Ultra 4 借助 S11 芯片加入新的音频智能功能。餐厅服务员报完一串菜名、同事随口提了个建议,这些确实都是很容易错过的瞬间。现在你只需要双击数码表冠,Live Rewind 可以把此前 15 秒的讲话转成文字;同时 Siri Recap 则可以整理谈话中的要点,让整段“回忆”更加简介易懂。
图源:Apple
苹果表示,处理所用的原始音频随后会被删除,用户可以控制摘要功能何时开启;相关功能计划于今年晚些时候先以英语测试版提供。
除去音频功能的升级之外,Apple Watch 贴着手腕的传感器也重新设计了。发布会上给出的背景心率采样频率提高到每 5 秒一次,HRV 最频繁每 5 分钟采样一次,是目前最精准的腕上监测设备。
图源:Apple
新的 Readiness 评分会结合活动、睡眠和身体指标,帮助用户判断当天适合继续训练,还是应该放缓节奏。健康应用也展示了更多数据解读与个性化指导,不过其中依赖新 AI 能力的部分,同样有后续上线安排。
图源:Apple
Series 12 的标称续航仍为最长 24 小时;Ultra 4 的日常使用续航提高到最长 50 小时,标准运动追踪最长 18 小时,Max 延长运动模式则可达到 45 小时。
两款手表国行分别为 2999 元和 6499 元起,官网列出的预购时间是 9 月 11 日早 9 点,发售日期为 9 月 18 日。
看完这一场发布会,我最想尽快上手的还是 iPhone Duo,苹果已经把手机折起来了,接下来就等它进入那些不按演示脚本发生的日常中去了。苹果计划2029年推出搭载M8 Ultra芯片的AI服务器Techub News 消息,苹果正在研发一款AI服务器,将采用其Mac台式机中的高性能M系列Ultra芯片。据The Information报道,该企业服务器将提供两种配置,分别搭载两颗或四颗未来的M8 Ultra芯片。该项目据称在一年前启动时获得了新任CEO John Ternus的支持。
该计划与苹果Mac mini和Mac Studio在AI开发者及公司中销量激增的现状相吻合,这些设备被用于运行AI工作负载。基于M系列Ultra芯片的计算设备受欢迎程度,无疑推动了苹果研发采用相同芯片的企业服务器。该产品预计于2029年发布,这将是苹果近二十年来首次推出服务器产品。(Ars Technica AI)英国前警官因在WhatsApp传播性侵视频被判四年监禁Techub News 消息,一名英国前警官因在 WhatsApp 群组中要求分享一名性侵嫌疑人的视频,并意图向“足球伙伴们”展示,被判处四年监禁。此案揭示了执法部门内部存在的“有毒”文化。涉事警官的行为严重违背了职业操守与法律。
(BBC News)DCENT 钱包报告资产转移异常,提醒用户更新应用并警惕钓鱼Techub News 消息,硬件钱包提供商 DCENT 报告其 App Wallet 出现异常资产转移情况,并提醒用户在发起任何转账前,务必更新 DCENT 应用至最新版本。
DCENT 同时警告用户需保持警惕,防范钓鱼和假冒尝试,切勿分享恢复短语等信息。(@SlowMist_Team)苹果正基于自研芯片构建企业级服务器Techub News 消息,苹果正在构建基于自研芯片的企业级服务器。此举旨在深化其专用人工智能基础设施建设,以满足日益增长的企业级AI计算需求。
(@Kalshi)苹果开发企业级服务器,深化专用AI基础设施建设Techub News 消息,苹果公司正在开发企业级服务器,以深化其专用人工智能(AI)基础设施建设。此举可能利用其隐私保护优势和在美国本土的制造能力,吸引受严格监管行业的客户。(Crypto Briefing)Meta 推出 WhatsApp Business MCP 服务器,支持 Claude 等 AI 代理处理设置与测试Techub News 消息,Meta 为 WhatsApp Business 推出新的 MCP 服务器,允许开发者使用 Claude、Cursor、Codex 和 ChatGPT 等 AI 编码代理来处理业务账户的设置、消息模板创建、测试及故障排除等繁琐任务。该功能旨在通过 AI 自动化简化 WhatsApp Business 的初始配置与运营流程。(TechCrunch)TechCrunch 推出 AI 项目失败清单,收录苹果 Siri AI 与 OpenAI 超级应用等案例Techub News 消息,TechCrunch 发布了一份名为“AI 墓地”的持续更新清单,旨在记录那些已经关闭或未达预期的 AI 项目与初创公司。该清单提及的案例包括苹果多次推迟的 Siri AI 以及 OpenAI 混乱的“超级应用”发布。
(TechCrunch)前 TikTok 高管推出 AI 应用 Superpose,可分析照片生成拍照姿势Techub News 消息,前 TikTok 高管团队推出了一款名为 Superpose 的相机应用。该应用利用人工智能技术分析用户的自拍或照片,并生成四种潜在的拍照姿势供用户参考学习。
(TechCrunch)苹果发布基于谷歌 Gemini 的全新 Siri AI,暂不向欧盟提供Techub News 消息,苹果在多年延迟后发布了基于谷歌 Gemini 模型重建的“Siri AI”。新版 Siri 部分功能在设备端运行,部分通过私有云计算处理。早期测试者称赞其多步骤请求和屏幕上下文理解能力,但也报告存在幻觉以及与个人上下文相关的不足。目前该助手暂不向欧盟地区提供。 (The Decoder)X与SpaceXAI撤销对苹果的反垄断诉讼Techub News 消息,X(原推特)与SpaceXAI已撤销对苹果公司提起的反垄断诉讼。此前,两家公司指控苹果存在反竞争行为。
(@Kalshi)