🦊 海宝知识库

智能驾驶 × AI 前沿 × 财经观察 · 每日更新

🧪 模型评估 · 目录(2 篇)

早报模型对比:DeepSeek V4 Flash vs Gemini 3.1 Flash Lite

- DeepSeek 版:`每日早报/002-2026-08-17.md`(07:15 生成,DeepSeek V4 Flash)

- Gemini 版:`每日早报/003-2026-08-17.md`(10:47 手动触发,google/gemini-3.1-flash-lite)

一、实测数据

| 指标 | DeepSeek V4 Flash | Gemini 3.1 Flash Lite |

|---|---|---|

| 生成耗时 | ~10 分钟(正常完成;07:00 定时那次因微信通道故障卡 38 分钟后被中断) | 62 秒 |

| Token 用量 | 约 10.7 万 input / 1.2 万 output(8/16 期数据) | 4.85 万 input / 3.8 千 output |

| 边际成本 | 闲时半价(07:00 档约 1-2 元/期) | 订阅额度内 0 |

| 参考链接数 | 6 条 | 6 条 |

二、质量对比

1. 时效性(新闻价值)

2. 信源质量

3. 分析深度(经济学人风格)

4. 格式合规

三、结论与决策

1. 质量差距肉眼可见:DeepSeek 版是「经济学人」式日报(具体、有细节、有判断),Gemini 版是「通稿式综述」(正确但无信息量)。Gemini 快(62s vs 10min)是因为搜索轮数少、输出短——快是以深度为代价

2. 双语规则执行:Gemini 未按规则锁定一手英文信源,说明「优先 Bloomberg/Reuters/FT」的约束对 Gemini 需要更强执行力,或规则需写得更死。

3. 成本实况:2026-08-17 当天 DeepSeek 余额 ¥55.14 → ¥35.09(消耗约 20 元),大头是 07:00 被中断任务(微信重试烧 token),正常每日早报约 1-2 元。

四、决策(用户 2026-08-17 11:00 确认)

【海宝·每日早报】8月19日 周三

今日主轴:AI三巨头同日发旗舰,性能与定价权的终极摊牌;华盛顿强制盟友选边,美联储按兵不动静待9月


📡 AI × 智驾 × 新能源汽车

1. DeepSeek V4 Pro、Qwen3.8、Grok 4.6 同日落地:开源与闭源的生态权力转移

8月12-13日,xAI Grok 4.6、DeepSeek V4 Pro(GA正式版)、阿里Qwen3.8在24小时内集中发布。DeepSeek V4 Pro采用1.6T参数MoE架构、49B激活参数、100万token上下文,API定价约¥3/¥6每百万token;Grok 4.6以GPT-5.6 Sol五分之一的价格直指高端市场;阿里首次开源旗舰权重Qwen3.8-2.4T,长上下文与多模态能力暂留商业API。三款模型均将长上下文与Agent执行能力作为产品差异点。

分析:这已不是单点性能竞赛,而是「性能-定价-开放度」三维博弈的摊牌。OpenRouter 7月榜单前六已被中国开源模型占据,V4 Pro以官方GA身份入场标志开源阵营权力中心转移——从「追赶闭源」演进到「反向定义价格锚点」。对开发者生态而言,闭源溢价空间被系统性压缩;对产业格局而言,模型层差距已基本消弭,竞争重心上移至算力基础设施与生态锁定。这是能否控制下一轮应用创新浪潮的关键战场。


2. OpenAI Ultrafast模式上线:推理延迟成为新的差异化堡垒

OpenAI 8月13日发布Ultrafast新模式,宣称GPT-5.6 Sol在此模式下可达750 token/秒输出、整体推理提速14倍,针对编码与自主工作流优化;谷歌同日推出Gemini 3.7 Flash,定位软件工程与企业级Agent流程编排。

分析:当能力同质化趋近,延迟与吞吐就成为决定性变量。OpenAI将「快」产品化为独立服务层级,本质是在Agent时代争夺实时交互入口——慢一拍的系统在复杂任务编排中会被直接淘汰出局。对智驾同样发出信号:车载端到端模型对推理时延的苛刻要求(毫秒级),正在倒逼「速度工程」成为下一轮基础设施投资的优先级。谁能率先把模型推理时延压到消费级可用,谁就握住L2+到L4渐进式升级的商业化节奏。


3. 城市NOA半年装机180.2万辆、萝卜快跑登陆伦敦:从点线试验到规模运营的切换

2026上半年中国本土市场城市NOA装机量达180.2万辆(上险口径),中汽协一季度NOA渗透率已升至67%;与此同步,萝卜快跑7月28日宣布携手Uber与Freenow在伦敦启动公开道路测试,预计2027年向市民开放,与Waymo正面竞争欧洲市场;特斯拉FSD Supervised自5月入华后迭代节奏加速。

分析:两条线索在同一时间点交汇——智驾竞争已从「开城数量」切换到「规模运营与成本结构竞争」。国内NOA装机放量意味着数据飞轮进入加速期,边界清晰的中国市场正沉淀出可商业化的闭环;萝卜快跑的欧洲落子则将成本结构优势(机构测算其单位里程成本低于Waymo 30-40%)直接搬到对手家门口,打破北美中心的竞争格局。2026年下半年至2027年是L2+普及与L4商业化的分水岭——谁能同时跑通「数据积累-模型迭代-规模盈利」闭环,谁就握住下一轮定价权与资本话语权。


🌍 政治 × 财经 × 中美欧

1. 美国强制35国选边:AI地缘博弈从技术管制升级为盟友网络管理

路透社8月14日独家披露,美国国务院起草信函致35个伙伴国(6月签署美国「AI机遇声明」的国家,含Pax Silica框架成员),明确警告其不能同时加入中国AI合作框架,否则将被排除在美国AI合作圈外。中国驻美使馆随即回应反对将经贸科技议题政治化。

分析:这是AI地缘博弈从芯片出口管制升级为「盟友网络管理」的标志性动作。此前封锁集中在末端——芯片与模型出口;如今美国试图在中游环节划定排他边界,以安全名义重构全球AI供应链的准入权。对第三国而言,两头下注的空间正在收窄,战略自主成本上升;对产业而言,算力、数据与标准的「阵营化」将抬高全球AI研发的系统性成本与不确定性。这也意味着技术竞争的输赢已不能简单由商业效率决定,地缘与政治因素正成为长期竞争格局的硬约束。


2. 美联储连续五次按兵不动:沃什时代的鹰派微调与预期分歧

7月29日FOMC以9-3投票维持联邦基金利率3.50%-3.75%不变,为连续第五次会议暂停,也是新主席沃什(5月22日就任)的第二次决议。6月经济预测明显转鹰:年底利率中位数预期升至3.8%,18位官员中9人预期年内至少再加息一次;而市场目前定价年内两次降息,与点阵图存在明显分歧。下次会议定于9月15-16日。

分析:市场与美联储的预期差已成为当前全球资产定价的核心张力。沃什上任后转向规则导向与前瞻指引更明确的风格,本质是在通胀粘性、财政赤字与就业目标之间重新校准央行可信度。9月会议若点阵图维持或强化鹰派预期,全球风险资产的降息交易将面临压力测试;对国内而言,中美利差扩大与汇率约束仍是货币政策宽松节奏的外生硬约束,这将直接影响流动性定价与资产轮动节奏。


3. 对华关税结构固化:从税率竞争升级为法律工具竞争

美国最高法院否决IEEPA关税后,依据《贸易法》122条征收的附加税于7月24日到期,继之以10%基准对等关税接棒;叠加301关税与最惠国税率,当前对华综合关税约33%(加权有效约21.6%)。5月17日中美达成的贸易与投资理事会协议原则上同意在框架下讨论对等降税。

分析:关税战正从「税率高低之争」演变为「法律工具与规则之争」——美方以国内法转换关税合法性,中方修订《对外贸易法》以双反调查对等回应。这意味着即便政治面出现缓和,关税中枢也难以快速回落,企业供应链决策必须把「高关税+高政策不确定性」当作中期基准情景。对新能源汽车与智驾硬件出海而言,本地化生产已从可选项演变为必答题,这将加速全球产能配置的重组。


📊 今日观察

AI模型层的「三体对撞」与地缘层的「阵营选边」同周发生,绝非偶然——技术扩散越快、成本越低,对现有秩序的颠覆力就越强,进而激发更激进的政治应对。对智驾产业,开源定价战正压低端到端方案的算力成本门槛,但地缘分割正抬高全球统一运营的可行性成本。对宏观交易,9月15-16日美联储会议是下一个关键时点——若沃什维持鹰派,全球流动性边际收紧的预期将重新定价。


*本早报由海宝整理,信息基于公开报道,分析仅代表观点,不构成投资建议。*