DeepSeek模型与商业化
纳入来源发布时间:2026-08-13(DeepSeek 官方变更日志)
事件时间:2026-08-13;新价格自 2026-08-17 00:00(北京时间)生效。
已确认事实:DeepSeek 官方变更日志称 V4-Pro 正式版已部署至 App、Web 与 API,调用模型名仍为 deepseek-v4-pro。官方强调生产环境 Agent 能力提升,API 原生支持 OpenAI Responses API,并针对 Codex 提供配置路径;V4-Pro 与 V4-Flash 的思考强度新增 low、high、max 三档。定价页显示将引入峰谷费率。
事件背景:V4-Pro 预览版已于 4 月发布。0813 版本不靠更换模型名制造迁移成本,而是在既有入口上完成正式化、接口扩展和计费切换,目标明显指向编码 Agent 与生产工作负载。
分析判断:原生兼容 Responses API 的意义不只在“兼容 OpenAI”,而是把 Codex 等既有 Agent 工具链的切换成本压低到端点和密钥层。与此同时,峰谷定价表明 DeepSeek 正从低价获客转向按稀缺算力时段管理需求;技术开放与商业化提价并不矛盾,而是同一场规模化运营的两面。
对竞争格局或产业链的潜在影响:模型供应商围绕 OpenAI 接口事实标准的兼容会削弱上层工具对单一模型的锁定;API 网关、模型路由和任务调度将更重视时段成本,推动批处理 Agent 把可延迟任务迁移到低价窗口。
尚待观察:厂商自测 Agent 指标能否被独立复现;Responses API 的功能兼容是否覆盖流式输出、工具调用与状态管理;提价后调用量和第三方路由份额是否变化;正式版开放权重的节奏。
一句话辣评:DeepSeek 一手拆接口锁定、一手抬高算力价格,说明“便宜模型”已经开始按基础设施生意来经营。
原始来源:DeepSeek API Change Log;DeepSeek Models & Pricing
补充来源:Fortune
荣耀AI 终端
纳入来源发布时间:2026-08-13(Android Central、Digital Camera World)
事件时间:2026-08-12(荣耀在中国发布)。
已确认事实:窗口内媒体报道显示,荣耀 Robot Phone 在中国发布,12GB+512GB 起售价 9,999 元,核心形态是可从机身展开的电动云台相机;YOYO 智能体可结合主体追踪与拍摄模式控制云台动作。Android Central 报道预售已开启,并给出更高存储版本;多家媒体确认产品与 ARRI 影像合作以及 8 月上市节奏。
事件背景:荣耀此前在 MWC 和 WAIC 展示 Robot Phone 概念与预约信息,但 8 月 12 日才完成正式发布。由于前一日日报未收录,本期依据 8 月 13 日窗口内可核验的独立报道纳入,并明确区分媒体发布时间与事件时间。
分析判断:它不是单纯给手机加一颗会动的摄像头,而是把端侧智能体从屏幕内的建议者变成能改变视角、追踪人物并执行拍摄意图的物理代理。若可靠性成立,手机 AI 的竞争指标会从回答质量扩展到感知—规划—动作闭环。
对竞争格局或产业链的潜在影响:手机厂商可能加大对微型电机、云台模组、低功耗视觉模型与系统级权限的投入;影像算法、端侧模型和机械结构必须协同设计,供应链门槛高于一般 AI 功能叠加。
尚待观察:云台耐久、跌落与防水表现;YOYO 主动动作的误触发和隐私控制;高价小众形态能否形成规模;全球上市范围与第三方应用权限。
一句话辣评:当智能体终于能转动镜头,手机 AI 才第一次真正拥有了“行动力”,但机械可靠性会比演示视频更诚实。
来源:Android Central;Digital Camera World;TechRadar(事件日背景)
OpenAI推理基础设施
纳入来源发布时间:2026-08-13 18:00(北京时间,OpenAI RSS 为 10:00 GMT)
事件时间:2026-08-13。
已确认事实:OpenAI 发布 Ultrafast 早期预览,这一 API 服务档位让 GPT-5.6 Sol 相比 Standard processing 最高快 14 倍,由 Cerebras 提供算力,生成速度最高达每秒 750 个输出 token。首批仅向少量客户开放,覆盖编码、金融研究、客服、商业和研究等实时工作负载。
事件背景:OpenAI 与 Cerebras 已建立低时延推理合作。传统上,实时响应往往依赖更小模型;Ultrafast 的目标是在不切换到低能力模型的情况下缩短长链条 Agent 的每轮等待。
分析判断:对 Agent 来说,速度会在“推理—调用工具—读取结果—再推理”的循环中累积,14 倍 token 速度的价值不只体现在聊天更快,而是把原本分钟级或小时级的闭环压缩到可交互范围。推理芯片架构因此从后台成本变量变成产品体验变量。
对竞争格局或产业链的潜在影响:Cerebras 获得前沿模型生产负载的高价值样板;GPU 之外的专用推理硬件将更直接争夺低时延工作负载。模型厂商也可能把“同一模型的不同速度档位”发展为新的服务分层。
尚待观察:Ultrafast 的价格、稳定吞吐、并发限制与广泛开放时间;厂商宣称的速度在真实多工具 Agent 中能否转化为等比例任务完成时间缩短;高速执行下权限控制和人工复核是否跟得上。
一句话辣评:当最强模型开始按“速度档”售卖,推理延迟就从工程参数变成了新的利润池。
原始来源:OpenAI