跳转至

腾讯研究院AI速递 20260630

Ch01.586 腾讯研究院AI速递 20260630

📊 Level ⭐⭐ | 10.6KB | entities/腾讯研究院ai速递-20260630.md

腾讯研究院AI速递 20260630

生成式AI

一、百度旗下昆仑芯冲刺港股,目标估值500亿美元

  1. 据The Information报道,百度旗下AI芯片公司昆仑芯计划以500亿美元(约3399亿元)目标估值赴港交所上市,目前仍在等待监管审批;

  2. 昆仑芯优先引入承诺采购自家芯片的投资方,正追逐中央企业、大型互联网公司与大模型开发者三类客户;

  3. 团队前身为百度智能芯片部门,已历三代产品迭代,并公布五年路线图,正与中芯国际洽谈把部分产能转回国内生产。

二、Agnes AI模型API永久免费,并上线创作平台Pavo

  1. 全球模型榜前列的Agnes AI自6月1日起将文本、图片、视频三大模型API面向全球开发者无限期免费开放,文本模型支持百万超长上下文;

  2. 同日上线PC端创作平台Pavo,基于Agent与Harness框架,一句话即可串起剧本、分镜、视频生成到成片全流程,并内置智能模型路由;

  3. 据Omdia预测,2025年短剧全球收入将达110亿美元,其中约83%来自中国,Pavo以零成本创作模式切入这一市场。

三、Anthropic营收反超OpenAI,企业级AI份额登顶

  1. 据Ramp报告,Anthropic在2026年6月以41%的美国企业级AI支出份额超越OpenAI,ARR在15个月内从10亿增至约450亿美元;

  2. 其80%以上营收来自B端企业与开发者API,财富前十企业中已有8家深度合作,二季度有望首次盈利,与OpenAI的C端高亏损形成反差;

  3. 业内也现争议,有大客户被多收170万美元Agent账单,华尔街质疑其ARR计入了战略投资方的通道收入。

四、DeepSeek V4正式版7月中旬上线,引入峰谷定价

  1. DeepSeek通知用户,V4正式版计划于7月中旬上线,发布后将同步调整API定价,引入峰谷定价机制,高峰时段价格为平时段两倍;

  2. 高峰时段定义为工作日上午9至12点、下午14至18点,实时客服与Agent等高频应用成本上升,批处理等离线任务错峰可省一半;

  3. 缓存命中价格依然极低,固定系统提示词与长上下文复用仍是控制成本的重要手段,调整前24小时将再次邮件通知用户。

五、福特返聘350名资深工程师,纠偏过度依赖AI质检

  1. 福特此前全面加码AI自动化质检、弱化资深工程师,但算法难以处理复杂工况下的隐性缺陷,引发大规模召回,造成数十亿美元亏损;

  2. 公司三年来引进约350名被称为"灰胡子"的资深工程师,负责带教、关键设计评审与校正AI工具,确立"AI筛查加人类经验兜底"路线;

  3. 调整后质保与召回成本明显下降,福特首次在J.D. Power新车质量调查中跃居主流品牌第一,此事在技术社区引发广泛讨论。

六、逐际动力FluxVLA Engine更新,支持人形全身操作

  1. 逐际动力具身大模型工程底座FluxVLA Engine合入人形机器人VLA支持,成为首个打通全身人形机器人训练与真机部署完整链路的开源平台;

  2. 基于全尺寸人形机器人LimX Oli,以单路头部相机加33维本体状态输入、输出42维全身动作指令,实现底盘、双臂与双手的同步全身操作;

  3. 本次还新增多策略训练、RoboCasa仿真、RTC实时分块推理与Triton加速等能力,代码已推送主分支。

七、OpenRouter盘点四款开源模型,与闭源差距仅数月

  1. OpenRouter梳理出2026年6月最值得关注的四款开源模型,并指出开源与闭源差距过去18个月稳定保持在3到6个月,企业为控成本加速迁移;

  2. DeepSeek V4 Flash以极致性价比跨越智能体分水岭,GLM 5.2智力指数51分居开源第一,擅长复杂规划与长代码生成;

  3. MiniMax M3主打多模态与超长文本,英伟达Nemotron 3 Ultra背靠生态主打企业级部署,四者分别对应低价、质量、多模态与部署需求。

八、上半年新增15家百亿独角兽,具身智能融资火热

  1. 2026年上半年国内具身智能新增15家百亿估值独角兽,累计至少25家,智平方、自变量等多家估值突破200亿元,融资热度空前;

  2. 玩家可分为全栈、大脑、本体三类,全栈深绑算法与硬件,大脑派打磨通用模型,本体派靠精密制造建壁垒,各有机遇与瓶颈;

  3. 业界对估值存在"泡沫论"与"序章论"分歧,多数公司现金流仅支撑18至24个月,商业化与技术壁垒被视为活下去的关键。

九、Codex负责人谈AI编程,最难的是删代码与判断

  1. OpenAI Codex负责人Andrew指出,模型擅长增加复杂度却不擅长删代码,写代码已非最重要环节,真正稀缺的是判断与筛选能力;

  2. 实现成本降低后原型大量涌现,但PRD并未消亡,文档、原型、实验各有适用场景,团队需判断功能该不该存在、该不该上线;

  3. 未来最缺把半成品收尾成产品的Sweeper,岗位边界趋于模糊,Codex正从IDE走向调度各类工具的工作入口。

深度分析

AI芯片竞争从架构之争延伸到产能与市场之争

昆仑芯冲刺港股+与中芯国际洽谈产能回迁,与三星/海力士/美光的DRAM价格操纵诉讼(见7月1日速递)共同描绘出AI芯片竞争的全景图:已不仅是算力架构(GPU/ASIC/NPU)的比拼,更是晶圆产能分配、地缘政治供应链重组、资本市场融资的多维博弈。昆仑芯的三代迭代+五年路线图表明国产AI芯片开始具备长期产品规划能力。

API定价进入精细化运营时代

DeepSeek的峰谷定价机制是API定价策略的重要创新——将电力/算力基础设施的峰谷概念引入模型服务层。对Agent开发者而言,这意味着成本优化不仅靠模型选择,还需调整任务调度策略(实时对话走高峰、批处理走低谷)。缓存命中的低价策略进一步强化了"固定系统提示词+长上下文复用"的工程实践。

"AI+人类兜底"重回工程实践

福特"灰胡子"计划的成功揭示了AI落地的一个反直觉教训:完全自动化(full AI automation)反而降低了系统鲁棒性。AI筛查+人类经验兜底的混合模式在复杂工况下表现优于纯AI方案。这与Anthropic企业营收反超OpenAI形成对照——B端市场更看重可靠性和可审计性,而非单纯的能力上限。

具身智能的"三类玩家"分化

全栈(深绑算法与硬件)、大脑(通用模型)、本体(精密制造)三类路线各有瓶颈。15家百亿独角兽的密集出现一方面验证了技术潜力的资本共识,另一方面"18-24个月现金流窗口"的现实意味着多数企业将在2027-2028年迎来生死考验。泡沫论与序章论的分歧本质上是"技术成熟度"与"商业规模化"之间的时间差博弈。

"增复杂度容易删代码难"的产品管理启示

Codex负责人Andrew的观察揭示了AI辅助编程时代的核心矛盾——模型大幅降低了"写出代码"的边际成本,但"决定写什么和不写什么"的判断成本并未降低。结果是原型泛滥但成品稀缺,这正是"AI加速了执行,但未加速判断"的典型表现。未来Sweeper(将半成品收尾为产品的能力)将成为最稀缺的岗位技能。

实践启示

  1. AI供应链成本需纳入年度规划:AI芯片产能竞争+DRAM价格暴涨的双重压力下,AI基础设施的硬件成本将持续上升。为Agent/LLM应用预留30-50%的硬件成本缓冲区,并优先选择推理效率更高的稀疏激活模型。

  2. API调用错峰可省一半成本:DeepSeek峰谷定价是行业趋势的信号。将离线批处理、数据标注、模型评估等非实时任务调度到低谷时段(午间/夜间/周末),实时交互类任务使用缓存友好的固定系统提示词结构。

  3. AI质检/自动化部署保留人类审核环:福特的教训表明,复杂工况下的AI自动化需要保留人类经验兜底机制。在Agent系统中增加"人类-in-the-loop"的关键决策节点,尤其是在高风险操作(生产部署、客户交互、合规检查)中。

  4. 在AI加速的"原型过剩"中寻找产品定位:低边际成本的代码生成会导致大量半成品。团队的差异化竞争不应是"谁写得快",而是"谁判断准、谁收尾好"。投资产品经理的判断力和Sweeper的执行力,而非单纯提升代码生成速度。

  5. 具身智能投资关注现金流与商业化路径:15家百亿独角兽中,多数现金流仅支撑18-24个月,商业化能力和技术壁垒是筛选的关键维度。优先关注有明确付费客户场景的企业,而非纯技术演示型团队。

相关链接