腾讯研究院AI速递 20260701¶
Ch01.556 腾讯研究院AI速递 20260701¶
📊 Level ⭐⭐ | 11.4KB |
entities/腾讯研究院ai速递-20260701.md
腾讯研究院AI速递 20260701¶
生成式AI
一、Claude Code官宣大升级,子智能体默认后台运行¶
-
Claude Code创造者Boris Cherny官宣下一版子智能体默认后台运行,用户可边聊天边让智能体在后台完成代码重构、测试与PR;
-
该功能是定时任务Routines、动态工作流的集大成,Anthropic增长团队已转向多招产品经理,因每位工程师产出翻三倍,配比从1:8变为1:20;
-
Spotify每日部署约4500次,73%的PR由AI辅助,工程师同开5到10个会话只负责看diff做决策。
二、Cursor与OpenClaw同日推手机版,入口移动端开战¶
-
Cursor推出iOS移动端应用并进入公开测试,面向付费用户开放,可选仓库与模型,通过语音或斜杠命令启动Agent,也能远程控制电脑上的本地Agent;
-
云端Agent运行在隔离虚拟机中可异步执行,生成演示、截图和日志,用户在手机端查看代码差异并直接合并PR,本地与云端任务可双向迁移;
-
OpenClaw同日推出移动端应用,移动端正成为AI Agent工具的新入口。
三、Hermes上线MoA混合智能体,评分超越Opus 4.8¶
-
Hermes Agent上线MoA混合智能体功能,支持自由组合多种开源模型作为虚拟模型,在Nous Research即将发布的基准测试中评分超过Opus 4.8和GPT-5.5;
-
MoA分参考模型与聚合模型,参考模型只提意见不执行工具,聚合模型综合判断并调用工具,旨在用便宜的开源模型组合达到顶尖闭源模型水准;
-
实测显示MoA生成的游戏与交互页面质感与流畅度明显更优,但成本与耗时有所增加,并非所有场景都值得开启。
四、OpenAI首款硬件Codex Micro曝光,主打编程效率¶
-
OpenAI在AI工程师世界博览会上公布首款硬件Codex Micro,一款与Work Louder联名的客制化键盘,旨在提升开发者使用Codex编程工具的效率;
-
该键盘深度适配工作流,让开发者手不离键盘即可完成代码补全、纠错、版本回溯,旋钮还可调节AI生成代码的创造力阈值,成为桌面生态锚点;
-
OpenAI硬件战略双线并行,B端以务实配件固化生态,C端则与前苹果设计官Jony Ive合作研发取代智能手机的AI原生终端。
五、美团发布开源万亿模型LongCat-2.0,国产算力训练¶
-
美团正式发布并开源万亿参数大模型LongCat-2.0,总参数1.6T、平均激活约48B,是业界首个在五万卡国产算力集群上完成全流程训练推理的万亿模型,原生支持1M超长上下文;
-
采用LSA稀疏注意力、零计算专家和MOPD多专家融合架构,专攻Agentic Coding,预览版调用量已跻身OpenRouter全球前三;
-
在SWE-bench Pro获59.5分领先Gemini 3.1 Pro与GPT-5.5,Terminal-Bench、BrowseComp等评测均达或接近前沿闭源模型水平。
六、华为开源盘古openPangu-2.0-Flash,920亿参数¶
-
华为正式开源上线openPangu-2.0-Flash模型,参数规模为920亿,同步开放模型权重、基础推理代码与训推算子;
-
openPangu是华为开源AI模型品牌,依托昇腾原生训练与推理技术,旨在为业界用好昇腾提供最佳实践,打造Agent时代智能底座;
-
openPangu-2.0-Pro模型权重及推理代码将于7月上线,更多开源组件下半年陆续推出。
七、虎牙发布实时多模态数字人VAM 1.0,一照片成片¶
-
虎牙推出基于DiT架构的实时多模态数字人模型VAM 1.0,仅需一张照片即可生成能聊天、唱跳、玩游戏的数字人,480×832分辨率、28帧实时流式输出,可连续运行24小时以上;
-
原生覆盖静默、聆听、说话三态并支持全双工打断接话,通过三阶段训练攻克时间累积误差、交互、部署三堵技术墙;
-
在8块H200集群达36.4帧每秒,首帧延迟约1.3秒,依托十年直播场景优势可落地带货、新闻播报、虚拟演唱会等。
八、Meta将大模型用于脑机接口,隔空读脑全开源¶
-
Meta发布非侵入式脑机接口Brain2Qwerty v2,基于脑磁图记录实现实时句子级解码,准确率逼近此前需开颅手术才能达到的水平,并将v1、v2完整训练代码开源;
-
训练数据来自9名志愿者每人10小时、累计约22000条真实打字记录,采用端到端深度学习并微调大模型利用语义上下文还原嘈杂脑信号;
-
整体单词准确率达61%,最佳参与者达78%,远超此前非侵入方法的8%,且准确率随数据量对数线性增长,目标是帮助脑损伤患者交流。
九、三星SK海力士美光被诉,涉嫌操纵内存价格¶
-
三星、SK海力士、美光三家存储巨头因涉嫌操纵内存价格于6月25日被诉至美国加州北区联邦法院,原告为14名消费者与3家公司;
-
诉状指控三巨头打着转向AI高带宽内存HBM的旗号协同压缩传统DRAM产能,四年内DRAM价格累计暴涨约700%,2026年一二季度合约价分别再涨约90%与60%;
-
因HBM更费晶圆且利润高,三家集体倒向AI客户,叠加百亿建厂门槛与出口管制,无人扩产抢市场,业内预计高价或持续至2027年。
十、Anthropic洽谈SpaceX,Krieger称仅走完10%路程¶
-
Anthropic Labs负责人Mike Krieger表示,对照模型能力的终极形态目前大概只走了10%的路程,正聚焦让Claude拥有更多自主权与环境感知,弥合能力与应用机会之间的差距;
-
他透露Anthropic正与SpaceX洽谈太空相关合作,并提出未来可能从卖Token转向基于结果的定价模式,Claude Managed Agents已尝试该模式;
-
他指出消耗Token最多者与实际产出并无强相关,回应Fable撤回非营销,并称如今打造突破性消费端爆款比以往更难。
深度分析¶
AI编程进入"后台化"与"移动化"双轨时代¶
Claude Code子智能体默认后台运行 + Cursor/OpenClaw同日推出移动端,标志着AI编程工具从"交互式补全"进入"后台异步执行+随时随地下单"的新范式。工程师角色从"写代码"转变为"审diff做决策"——Spotify的数据(73% AI辅助PR)和Anthropic的配比变化(1:8→1:20)都指向同一方向:AI在编码执行层取代人力,但判断力成为更稀缺的资源。
MoA架构:低成本逼近旗舰模型的新通路¶
Hermes的MoA(混合智能体架构)用多模型协作代替单模型能力竞赛,以参考模型提意见+聚合模型做决策的分工,实现了开源模型组合逼近顶尖闭源模型的效果。这与编程领域的"多Agent协作"(如Claude Code子智能体)形成技术呼应——组合智能正在取代单体智能。但MoA的成本和延迟挑战也提醒:混合架构并非通用解决方案。
国产万亿模型的Agentic Coding突围¶
LongCat-2.0以1.6T参数、48B激活的MoE架构在SWE-bench Pro登顶,验证了"国产算力+稀疏激活"路线的工程可行性。其LSA稀疏注意力、零计算专家等技术创新表明:MoE架构正在从"横向扩展参数量"转向"纵向优化激活效率"。与华为openPangu-2.0-Flash的昇腾生态策略形成互补——一个重能力上限,一个重生态覆盖。
非侵入脑机接口的LLM驱动机遇¶
Meta Brain2Qwerty v2将大模型微调引入脑电信号解码,将非侵入方法的准确率从8%一举拉升至61%(最佳78%)。语义先验知识+端到端深度学习的组合,展示了LLM作为信号处理器的通用潜力——不仅用于文本生成,也可作为噪声环境下信号还原的语义桥接层。
DRAM价格暴涨揭示AI硬件供应链的结构性问题¶
四年700%涨幅、HBM转向压低传统DRAM产能、百亿建厂门槛阻滞新玩家——AI对高带宽内存的贪婪需求正在扭曲整个存储产业格局。这对AI基础设施成本模型的冲击将持续至2027年,企业需在硬件采购策略中纳入"内存通胀"变量。
实践启示¶
-
建立AI代码的"审阅流水线":借鉴Spotify模式,升级CI/CD流水线以支持大规模AI生成代码的diff review。工程师角色应从"每行都写"转向"可信审计"——重点投入代码审查工具和自动化测试覆盖率的提升。
-
MoA适合复杂任务,不适合简单查询:在生产中部署MoA前,评估场景的"任务复杂度阈值"。需要综合判断、多工具调用、长上下文推理的复杂任务才值得开启MoA;简单问答和批量处理用单模型更经济。
-
国产模型选型关注稀疏激活架构:LongCat-2.0(48B激活/1.6T参数)和openPangu-2.0-Flash(92B)展示了不同技术路线。选型时关注激活参数与总参数的比值(稀疏效率),而非仅看总参数量或表面benchmark分数。
-
监控AI硬件供应链中的存储成本:四年DRAM暴涨700%趋势下,部署AI应用需将内存成本纳入TCO模型。考虑模型量化、KV cache优化、推测解码等减少显存占用的策略,降低对高带宽内存的依赖。
-
定价模式创新:从tokens到结果:Anthropic讨论的基于结果的定价模式可能成为AI服务的未来方向。在构建B端AI产品时,预留按产出价值(而非API调用量)计费的能力,以匹配企业客户对ROI的关切。