扫码下载
搜索“Image”共有10条相关结果
Techub News 消息,英伟达 CEO 黄仁勋在 All-In 峰会舞台上接听了美国总统特朗普的电话,并开启免提。特朗普在通话中谈及近期对 AI 发展的担忧,称其为“骗局”,并向观众表示“机器人不会接管世界”。 此次通话发生在本周末 Anthropic CEO Dario Amodei 发表主张放缓 AI 发展速度的长文之后,正值 AI 新闻密集的一周。 (The Verge AI)
Techub News 消息,OpenAI 于 9 月 8 日发布最新图像生成模型 ChatGPT Images 2.5,包含 Sunburst 和 Flare 两个 API 版本。 其中 Sunburst 版本针对光照保真度、提示词遵循度和主体保持性进行优化,在上线数小时内登顶 Arena 平台文生图、单图编辑及多图编辑排行榜,ELO 评分达约 1421 分。Arena 平台目前提供该模型 72 小时免费试用,试用期结束后 API 定价为每百万输入 token 5 美元、每百万输出图像 token 30 美元。(CryptoBriefing)
Techub News 消息,苹果公司推出了一项名为“Apple Reference Image”的新功能,旨在帮助用户判断照片是否经过编辑,包括由人工智能进行的修改。该功能为用户提供了一个验证图像真实性的工具。(TechCrunch)
Techub News 消息,OpenAI 在 X 平台宣布推出 ChatGPT Images 2.5,该版本图像生成速度更快、画质更清晰、更智能,并提供了更好的工具来创建用户所能想象的内容。 新版本具体改进包括:更快的图像生成速度以保持创意流畅;更高的保真度,可生成更自然、更易识别的图像;在多次编辑中保持细节的一致性。(@OpenAI)
Techub News 消息,阿里巴巴研究机构发布了 Qwen-Drive 1.0 AI 模型,该系统集成了环境感知、交通问答和路线规划功能。研究表明,文本-图像模型无法自动理解三维空间,空间感知能力需要专门训练。其目标是打造一个能同时运行座舱和驾驶系统的单一模型。(The Decoder)
Techub News 消息,Inflection AI 联合创始人 Mustafa Suleyman 在 X 平台发文表示,公司推出的新图像模型生成速度比当前世界最佳模型 GPT-Image-2 快 2 倍。 该模型在 GPU 使用效率上提升了 72%,使其能够以极具竞争力的价格提供服务,从而获得了世界最佳性价比评分。(@mustafasuleyman)
Techub News 消息,谷歌为 Workspace 用户推出名为 Google Pics 的创意设计工具套件,旨在让企业更便捷地编辑和生成“专业级”AI 图像。该工具基于 Gemini 和 Nano Banana 生成式 AI 模型构建,提供更精细的提示词图像制作与操控功能,用户可点击特定对象或文本并描述所需更改,以避免聊天机器人生成营销图像时常见的糟糕效果。 谷歌表示,AI 图像生成在个人使用中已大获成功,但在商业应用中的情况则不同。Google Pics 的目标是让企业用户能更轻松地创建符合品牌要求的视觉内容。 (The Verge)
Techub News 消息,Instagram 宣布将采取措施打击伪装成人类的虚假 AI 影响者账户,并将“AI 创作者”标签更名为“AI 生成个人资料”,以明确标示出使用 AI 生成而非真实人物的个人资料。Instagram 表示,用户希望在使用 AI 生成人物的个人资料时能够获得明确提示。 为此,Instagram 将追查未主动标注 AI 生成个人资料的账户,并对其采取限制曝光等处罚措施。此举旨在应对日益增多且难以识别的 AI 虚假账户问题。 (The Verge)
Techub News 消息,Alphabet 首席财务官 Anat Ashkenazi 表示,公司已将 2026 年全年资本支出指引范围更新至 1950 亿美元至 2050 亿美元,主要用于 AI 基础设施投资。第二季度资本支出达 449 亿美元,占过去十二个月营收的 29.7%,远高于历史平均的 12.2%。 第二季度,Google 服务营收为 945 亿美元,Google 云营收为 248 亿美元,同比增长 82%。公司云业务积压订单已达 5140 亿美元,其中超一半预计在两年内转化为收入。CEO Sundar Pichai 称,AI 投资正在重新定义公司业务的各个方面。 尽管自由现金流在第二季度为负 59 亿美元,债务也从一年前的约 160 亿美元增至近 1000 亿美元,但 Alphabet 仍持有 2425 亿美元的现金及有价证券。市场正关注其巨额 AI 支出能否如期转化为增长动力。(Watcher Guru)
Techub News 消息,Deepseek 发布了名为 V4-Flash-Vision-Exp 的实验性多模态模型,该模型在原有 V4-Flash 文本能力基础上增加了图像理解功能。根据该公司自身的多模态智能体基准测试,其性能接近 Anthropic 的 Opus 4.8 模型,有时甚至能超越后者。(The Decoder)