Ch01 AI 与 LLM 基础¶
理解大语言模型的内部机制:从 Token 到 Transformer,从预训练到推理
本章收录 1634 篇实体,按深度递增排列。
本章导航¶
| Level | 含义 | 篇数 |
|---|---|---|
| ⭐ 入门 | 零基础可读 | 372 |
| ⭐⭐ 工程师 | 需编程基础 | 1080 |
| ⭐⭐⭐ 专家 | 需ML基础 | 138 |
| ⭐⭐⭐⭐ 科学家 | 需研究背景 | 26 |
| ⭐⭐⭐⭐⭐ 大师 | 前沿/哲学 | 18 |
导读¶
你每天都在用 ChatGPT、Claude、Gemini,但你知道它内部发生了什么吗?
本章从最基础的概念开始:文字如何变成数字(Tokenization),数字如何获得语义(Embedding),模型如何理解上下文(Attention),以及它为什么能生成看似"智能"的回答(Next-Token Prediction)。
你不需要懂数学,但读完本章后,你应该能回答一个关键问题:当模型给出糟糕的回答时,是"齿轮坏了"还是"你喂错了原料"?
本章还涵盖训练动力学(模型在预训练中并非稳定进化,而是频繁跳跃)、推理优化(投机解码让吞吐提升 4 倍)、以及混合架构(Transformer 不是唯一的答案)。
这是全书的地基——后面讲 Agent、Harness、RAG 时,你会反复回到这里。
本章内容¶
- 001. 2026年最值得关注的15款开发者工具深度解读
- 002. 🧠 The Token Economy pt2: The Intelligence Company Gets Built
- 003. The Google Capital Company
- 004. 2028: Two scenarios for global AI leadership
- 005. Backpressure is all you need
- 006. 快手首个打工人Agent
- 007. Karpathy's Autoresearch found a 3-year-old bug in our query engine (and improved performance by 11%) - PostHog
- 008. Agentic Design System - From Chatbot to Orchestration
- 009. 这个五一节我做了个总结,在 2 年多的创业里,我一共做了 25 个 AI 项目
- 010. 场景营销前端 AI Coding — AI Native 的视觉稿还原
- 011. 20VC x SaaStr: The Most Aggressive Quarter in American Capitalism, Palantir's Ru
- 012. OpenSquilla launches open-source AI agent to cut token costs
- 013. WWW时间检验奖颁给唐建博士:图神经网络的十年远征与AI制药的底层逻辑
- 014. Why Ctrl+V won't paste images in Claude Code on WSL, with a fix
- 015. GPT-5.6一发布,Claude终于舍得重置Fable 5额度了
- 016. Anthropic 联创:2028 年实现 AI 自我构建的概率超过 60%
- 017. 第一批「AI原生」本科生,要毕业了
- 018. CVPR 2026 Highlight|让AI像电影人一样「看」视频,8B小模型反超GPT-5与Gemini-3.1-Pro
- 019. NotebookLM:Google AI 笔记本工具
- 020. Nvidia's Jensen Huang bets on this British startup to build 'next frontier' of AI
- 021. The Future of BMW
- 022. Claude's next enterprise battle is not models: it's the agent control plane
- 023. Freelance Designers Can't Compete With a $20/Month AI Subscription - Here's What Actually Works Now
- 024. Anthropic创始人行动手册 — 花叔x Claude Code译本
- 025. 谷歌风雨飘摇,市值蒸发数千亿美元!Gemini Spark能救场吗?
- 026. Products are out, brains are in
- 027. Toto 2.0: Time series forecasting enters the scaling era
- 028. Robostral Navigate: single-camera AI navigation | Mistral AI
- 029. Banning Open Source AI Would Be A Mistake — Interconnects 开源 AI 政策评论
- 030. Introducing TabFM: A zero-shot foundation model for tabular data
- 031. Introducing Claude for Small Business
- 032. Introducing Claude for Small Business
- 033. Unexpected lessons from an AI-assisted prototyping experiment
- 034. You.com | Download the Guide: Why API Latency Is a Misleading Metric
- 035. Domain Expertise Has Always Been the Real Moat
- 036. From Doer To Director: The AI Mindset Shift
- 037. How to Land a Frontier Lab Job:如何拿到一份前沿实验室的工作
- 038. How we made WINDOW JOIN parallel and vectorized
- 039. Cisco Preps For A World Of AI Agent Coworkers, Frontier Model Threats
- 040. How to create websites with great UX designs: Principles and examples
- 041. Microsoft is quietly shopping for an OpenAI replacement
- 042. GPT-5.5来了!我撤回了退订ChatGPT的决定
- 043. CyberSecQwen-4B: Why Defensive Cyber Needs Small, Specialized, Locally-Runnable Models
- 044. Getting more from each token: How Copilot improves context handling and model routing
- 045. Vietnam to develop domestic cloud
- 046. RAG vs LLM Wiki 深度对比:企业知识库架构选型指南
- 047. Building Jaeger’s ClickHouse backend: 8.6× compression on 10 million spans
- 048. Gemma 4 Technical Report
- 049. 浙江大学经济学院百人计划研究员、博士生导师评价《2026 中国电商AI 应用白皮书》:AI 从技术可得走向经营能力平权
- 050. Akamai acquires Israeli AI browser security startup LayerX for $205 million in cash
- 051. Linux Foundation and Industry Leaders Launch Akrites to Defend Critical Open Source Software Against AI-Enabled Cyber Threats
- 052. AI-driven layoffs aren't making business sense
- 053. Engineering roles shift from developing code to managing AI
- 054. Identity Behavior & Context: ITDR Solution | Teleport
- 055. How we keep GPUs reliable across Databricks AI
- 056. Grafana 13.1 release: observability as code updates, extending Grafana Assistant across more data sources, and more
- 057. Gemini AI (Google)
- 058. Igor Babuschkin Seeks Up To $1 Billion For River AI
- 059. Announcing AWS CDK Mixins: Composable Abstractions for AWS Resources | Amazon Web Services
- 060. Running an AI-native engineering org
- 061. WorkOS Pipes: Third-party integrations without the headache
- 062. Recent Developments in LLM Architectures: KV Sharing, mHC, a
- 063. 硅谷的尽头是编制:OpenAI要给白宫送5%的股权
- 064. Tokenomics: the 62.5-minute rule for Claude's cache
- 065. Build the Agent or Power the Agent?
- 066. You Must Fix Your Asserts
- 067. AI GPUs probably live longer than three years
- 068. Public Stealth Leaves Opportunity on the Table
- 069. Marc Andreessen on Builder Culture in the Age of AI | The a16z Show
- 070. Code Simulation for Enterprise Engineering | PlayerZero
- 071. Viktor | Not a tool. A hire.
- 072. AEO and GEO for AI Overviews, ChatGPT, Claude, Gemini, and Perplexity
- 073. A recent experience with ChatGPT 5.5 Pro | Gowers's Weblog
- 074. Deel's "Accelerate or Die" Moment
- 075. Every Team is Building the Same Cache — TierFS
- 076. Scaling Laws, Carefully
- 077. How To Measure Development Productivity?
- 078. Bringing more agent harnesses and frameworks to Cloudflare, starting with Flue
- 079. 百度智能云新一代AI机密计算实例:从CPU到GPU全链路可信
- 080. ChatGPT官宣26位未来之星
- 081. Why Drizzle ORM couldn't publish new releases on NPM for a month | vlt /vōlt/
- 082. The annotated PyTorch training loop
- 083. Amazon Turns Alexa Into Its Next Storefront
- 084. EntryPoint Hijacking
- 085. Back up and restore your Amazon EKS cluster resources using Velero | Amazon Web Services
- 086. Pipes – WorkOS Docs
- 087. Useful Memories Become Faulty When Continuously Updated by LLMs
- 088. How Superset built the IDE for AI agents on Vercel
- 089. Repricing of Software Engineering Labor
- 090. CEOs of the classroom: Why principals are the key to the AI era
- 091. How AI changes software P&L
- 092. Coinbase Becomes Hyperliquid’s Official USDC Treasury Deployer as USDH Sunsets
- 093. 快手首个打工人Agent来了!工作秒变桌面软件:零代码、不烧token
- 094. How to Write an Effective Software Design Document
- 095. Anthropic puts Claude agents on a meter across its subscriptions
- 096. AI-powered honeypots: Turning the tables on malicious AI agents
- 097. Building Modelplane on Crossplane
- 098. Thread by @ZeusRWA on Thread Reader App
- 099. Gemini 3.5: frontier intelligence with action
- 100. AI and Liability
- 101. Klarna delivers strong start to 2026 with $1bn revenue and $68m adj. operating profit | Klarna International
- 102. Build Live Translation Apps with gpt-realtime-translate
- 103. What happens in the log when an app crashes as it starts up?
- 104. Cline releases open-source agent runtime SDK
- 105. Be more expressive to close more sales
- 106. 我给Hermes配了4个Agent,真正有用的是这些事
- 107. AI Gateway production index
- 108. PyTorch 2.12 Release Blog – PyTorch
- 109. Meta’s AI Storage Blueprint at Scale
- 110. Vietnam to develop domestic cloud so it can ditch risky overseas operators for government workloads
- 111. Anthropic 联创:2028 年实现 AI 自我构建的概率超过 60%
- 112. Malware crew TeamPCP open-sources its Shai-Hulud worm on GitHub
- 113. Google 与 Amnesty International 合作加大间谍软件检测难度
- 114. Google Debuts Gemini-Focused Updates at I/O 2026
- 115. Lighthouse Attention
- 116. Exaforce | Agentic SOC Platform and MDR
- 117. Intelligence Per Dollar
- 118. Code Simulation for Enterprise Engineering | PlayerZero
- 119. LLM-as-a-Verifier: A General-Purpose Verification Framework
- 120. 强化学习如何不用奖励模型提高通用问题推理能力
- 121. 特斯拉百万年薪招数据标注员,朝九晚五,无需AI经验
- 122. Apple Silicon costs more than OpenRouter
- 123. How I Moved My Digital Stack to Europe
- 124. Tenorshare AI Diagrimo - Free AI Diagram Generator Online
- 125. 当AI让答案唾手可得,学而思想把学习过程找回来
- 126. White House cyber official: identity security matters more
- 127. OpenAI Realtime API 架构首次公开
- 128. R1复现:拒绝采样微调加速RL收敛及模型遗忘问题探究
- 129. PyTorch 2.12 Release Blog – PyTorch
- 130. Thrive Capital Bets $100 Million on Shopify's AI Future
- 131. Announcing Claude Managed Agents on Cloudflare
- 132. Block leans into its AI future | Payments Dive
- 133. We Tested DeepSeek V4 Pro and Flash Against Claude Opus 4.7
- 134. NGINX Rift: Achieving NGINX Remote Code Execution via an 18-Year-Old Vulnerability
- 135. Building is just the beginning: Introducing Discoverability
- 136. 一步修复严重退化人脸视频、边看边想让视频大模型响应速度提升15.7倍——小米多篇论文入选 ECCV 2026
- 137. 5 Things to Know about the CLARITY Act
- 138. Gemini 3.5 Flash: more expensive, but Google plan to use it for everything
- 139. Qoder 1.0正式发布!从AI IDE迈向智能体自主开发工作台
- 140. 腾讯混元Hy3-preview发布
- 141. Agent orchestration
- 142. Grafana GitHub Token Breach Led to Codebase Download and Ext
- 143. Dumb Ways for an Open Source Project to Die
- 144. The Unbearable Cheapness of Open Weight Models – James O'Claire
- 145. Affirm Maps Road to $100B GMV With Card, AI Commerce and Global Expansion
- 146. GPT-5.5突遭暗中降智,思考一到516就断!越难越翻车
- 147. Why Internally-Built AI Fails Fund Accounting Audits
- 148. Self-Filming Guide by Hello World Media
- 149. What political censorship looks like inside an LLM's weights — a mechanistic-interpretability study of Qwen 3.5
- 150. Microsoft for Startups | Microsoft
- 151. 4秒出图、10秒成片,Google上线两个轻量创作模型
- 152. Fable 5 官方实战指南:找到你的未知
- 153. Claude工程师终于交出Fable 5焚诀!教你打破和模型之间的信息差
- 154. What Do Your Startup Advisors Say About You? — Charlie O'Donnell - Coach, Author, VC
- 155. I Sold My AI Startup Before Revenue: Here’s What Investors Missed — And Founders Shouldn’t
- 156. OpenAI塌房!Scaling law原作曝bug,万亿算力全白烧
- 157. Nearly every enterprise is investing in AI, but only 5% say their data is ready
- 158. NVIDIA 认证 | AI 基础架构与网络 4 大认证报考指南
- 159. Square Adds Drive-Thru to the Menu
- 160. Schmoozing Is Dead, Agents Are Hitting 120% of Humans, and Growth Is the Only Thing That
- 161. Introducing Claude Platform on AWS: Anthropic’s native platform, through your AWS account | Amazon Web Services
- 162. Igor Babuschkin Seeks Up To $1 Billion For River AI
- 163. 我给Hermes配了4个Agent
- 164. Apple Foundation Models
- 165. Here's The Rub: We Don't Believe You
- 166. Fable 5 实战之:五亿 token 暴改我三年前的网站
- 167. B2B Email Marketing: What Still Works?
- 168. How Dropbox uses MCP and Dash to close the design-to-code security gap
- 169. A backdoor in a LinkedIn job offer
- 170. The Oracle and the Firm
- 171. 全新开源RL框架Vime-Ascend介绍及ModelArts实战指南
- 172. What Job Interviews Taught Me About Kubernetes
- 173. YC Spring 2026 全批 196 家公司分析:AI 不再是差异点
- 174. OpenAI三个语音模型发布同传被杀死
- 175. Every Frame Perfect
- 176. Agentic Code Review
- 177. The golden rule of Customizable Select
- 178. Why Use App-Level Auth When Every Database Has Auth? (Splunk CVE-2026-20253)
- 179. Anthropic's Zero Trust for AI Agents Sets the Right Test. The Bearer Token Fails It
- 180. Is This Why Science Advances One Funeral at a Time?
- 181. d-OPSD —— 扩散语言模型的在线自蒸馏框架
- 182. Learning to Replicate Expert Judgment in Financial Tasks - Thinking Machines Lab
- 183. 腾讯研究院 AI 速递(2026-07-02)
- 184. Tether launches developer grants program for local-first AI and payments infrastructure
- 185. 本文以作者从传统数科向 AI 数科转型的实践为背景,系统阐述了 QoderWork Skills 的开发方法论与工程体系。文章指出 Skill 本质是将领域知识、标准流程及避坑指南封装为 AI Agent 可执行的“数字助手”,并提出了由编排层(SKILL.md)、参数层(config.yaml)、实现层(scripts/)和知识层(references/)构成的四层分离架构,强调通过结构化指令而
- 186. SkyPilot × Hugging Face — 零出口流量 AI 工作负载存储
- 187. Trading Desk AI
- 188. 项目经理的-ai-提效实践amazon-quick-飞书打通碎片化工具链构建-ai-整合入口
- 189. openai最终能否盈利
- 190. amazon-ecs-引入新的高分辨率指标以实现服务快速自动扩缩
- 191. 1. 准备 CLI(二选一)curl -fsSL https://nacos.io/nacos-installer.sh | bash -s -- --cli# 或者直接使用 npxnpx @nacos-group/cli@latest skill-sync --help# 2. 配置 CLI profilenpx @nacos-group/cli@latest profile edit test
- 192. fable-5-订阅权限又续了-5-天与其被吊着我找了个账单只有-13-的替代方案
- 193. 突破视觉仿真算力瓶颈 新一代具身智能仿真框架开源 高吞吐并行高保真渲染助力规模化 量子位
- 194. 突破视觉仿真算力瓶颈 新一代具身智能仿真框架开源 高吞吐并行高保真渲染助力规模化 量子位
- 195. 斯坦福重磅研究登Nature!AI凭空造出前所未有蛋白质,超越AlphaFold
- 196. 当代码越来越便宜什么在变贵
- 197. 有人只用API就猜出了GPT、Claude、Gemini的参数量?社区吵翻了
- 198. 突破视觉仿真算力瓶颈新一代具身智能仿真框架开源高吞吐并行高保真渲染助力规模化训练 1
- 199. 一年磨一剑 今年最炸机器人Demo来了 1亿美元种子轮团队出手 单个模型解锁单手 量子位
- 200. GEPA:让 LLM 用反思进化提示词,样本效率甚至超过强化学习
- 201. 阿里巴巴 蚂蚁 LoongSuite GenAI 可观测语义规范 从统一数据语言到规模化落地 阿里技术
- 202. ACL 2026 世界模型能让智能体 预知未来 这篇新范式研究给了一个反直觉的答 机器之心
- 203. 万帧照片级仿真 打通视觉机器人学习的感知与物理鸿沟 国产仿真器GS Playgr 机器之心
- 204. 动态发现所有远程分支git fetch origin --depth=1ALL_BRANCHES=$(git branch -r | grep -v 'HEAD' | sed 's|origin/||' | tr -d ' ')
- 205. 24小时直播 只靠一张照片 虎牙实时多模态数字人VAM 1 0率先突围行业三堵墙 量子位
- 206. 突发,马斯克xAI解散了!22万张GPU忍痛全给Claude
- 207. router的作用被低估了vllm这个神器让单次调用背后藏了一支模型协作小队
- 208. AI Agent 记忆重排序:MemReranker
- 209. 条条电路通罗马 大模型可解释性的 唯一机制 可能从一开始就不存在 机器之心
- 210. ICSE 2026杰出论文 突破代码模型真实工程落地瓶颈 北大团队提出SEAli 机器之心
- 211. 我把-claude-cowork-搬进-codex踩了-4-个坑发现了顶级模型的秘密
- 212. 腾讯混元AI Infra如何优化Hy3 Preview 一次大模型推理性能提升的 腾讯技术工程
- 213. 港股新贵押注物理AI 乐动机器人打造万亿市场空间的核心基础设施 量子位
- 214. 公里级场景也能稳住了 国产团队把长视频3D重建又往前推了一步 机器之心
- 215. 清华大学:基于 AI 的自进化组织研究报告
- 216. DeepSeek点燃大模型效率之争 阶跃火速接棒 JetSpec让大模型解码速度 量子位
- 217. safely-releasing-frontier-models-to-customers
- 218. Product Hunt 日榜第一 这个工具绝了 把任何网站变成可被 Agent code秘密花园
- 219. 离谱 一句话 百元预算 这只龙虾就给我搓出了一支百万级广告片 量子位
- 220. 打造真实项目的 AI 编程环境 Matt Pocock 的 Skill 工作流完 技术极简主义
- 221. 从 Spec 到损失函数 真正会用 AI Agent 的人 已经在设计循环 高可用架构
- 222. 马斯克破大防了 私信求和遭拒 怒喷奥特曼Brockman 全美最恶人 量子位
- 223. AgentTeams 和 Claude Tag 都进入群聊模式 是新范式还是新叙 阿里云云原生
- 224. 万字详解 codex 全链路架构 Codex 不是一个 App 而是一套 Age 科技充电站
- 225. 太抓马了 马斯克OpenAI开庭 硅谷巨富互揭老底像极了村口吵架 量子位
- 226. openai深夜连放两弹chatgpt和codex合并gpt-56全面推出成本暴打fable-5
- 227. 谷歌风雨飘摇,市值蒸发数千亿美元!Gemini Spark能救场吗?
- 228. Announcing Genkit Middleware: Intercept, extend, and harden your agentic apps
- 229. 全链路研发智能体 从 体感能用 到 实际可用 的工程实践 百度Geek说
- 230. codexchatgpt为何合体codex未来何去何从openai核心leader回应一切
- 231. 00后下场整顿Agent 啥都不学就能用好AI 这才是正确打开方式 量子位
- 232. 领先于Transformer 新架构首个1200万上下文模型SubQ 成本仅Op 机器之心
- 233. 从验证demo到冲刺ipoai企业为何更需要一座产业小镇
- 234. 相关性 ≠ 因果性:因果推断在 AI 评测归因中的方法与实践
- 235. 重磅 全模态API免费后单周被薅4 66万亿Token Agnes全新Pavo平 AI寒武纪
- 236. 你天天用的Claude和Codex,Meta内部不让随便用了
- 237. 卡帕西李飞飞辛顿都投了的Transformer专用芯片,签下10亿美元大单
- 238. Luma Uni 1 1 API开放 图像模型榜单第三 文字渲染直逼GPT im 机器之心
- 239. 一文看懂 AI 编程智能体工程化新范式 Loop Engineering 技术极简主义
- 240. 香蕉和GPT Image之外的第3条路 华人15人团队造出AI生图黑马 量子位
- 241. rlvr-entropy-collapse-steer-acl-2026-outstanding
- 242. 1美元买10颗星 顶会曝出GitHub假星灰产 热门仓库或藏木马 新智元
- 243. Anthropic联创定下deadline 2028年AI实现自我进化 没有人类 机器之心
- 244. 强化学习的进化 从PPO到MaxRL LLM推理训练的算法演进史 机器之心
- 245. icml-2026获奖论文揭晓黄高团队获杰出论文a3c算法获时间检验奖
- 246. 深入理解 AI Agent 时代的驾驭工程 Harness Engineerin 技术极简主义
- 247. 10万之后我用-workbuddy-obsidian-claude-重新搭了一遍个人知识库
- 248. 不只DeepSeek 阶跃等开源JetSpec 大模型解码提速近10倍 机器之心
- 249. 十万卡时代谁在定义新标准
- 250. 构建 AI 时代的知识底座 直播数据 LLM Wiki 实践 阿里云开发者
- 251. 国内首个纯中文ai音乐模型杀疯了全面接入10亿人的抖音
- 252. openpangu-20-flash模型正式开源上线
- 253. Token需求狂飙千倍 22亿热钱涌向这家AGI Infra头号玩家 量子位
- 254. 别只盯着模型 Agent 真正的护城河 是这四层循环 高可用架构
- 255. 5月5日5点55分 GPT 5 5自己选客人开派对 Codex反超Claude 新智元
- 256. 腾讯混元最新开源:440M翻译模型手机离线就能用,翻译质量超谷歌
- 257. TACO 让 CLI Agent 在自主迭代中学会丢掉无用上下文 机器之心
- 258. 全球医疗榜第一 中国AI杀疯了 医疗AI迈入Harness时代 新智元
- 259. AI Kuikly 7 5小时落地三端 多模态聊天 App 实战 腾讯技术工程
- 260. claude-code-deerflow-replication-allentang-2026-07-29
- 261. 不可思议!400B大模型在iPhone上跑起来了
- 262. Two days, one engineer, zero guesswork: Simplifying a complex modernization with IBM Bob
- 263. Private Fintech Has Quietly Become Bigger Than Public Fintech. Now What?
- 264. 全球首个英伟达含量为0的万亿模型,成了海外开发者的抢手货
- 265. 全球首个英伟达含量为0的万亿模型,成了海外开发者的抢手货
- 266. 模型好不好用,谁说了算?从榜单崇拜到自建评测
- 267. 仅11天claude重写百万行代码ai史诗级工程却引来愤怒
- 268. 我把Seed 2 1 Pro塞进Claude Code 让它修我自己产品的bug 花叔
- 269. 编程时养只 小跟班 Codex Pets全攻略 附自定义方法 unknown
- 270. 场景营销前端 AI Coding AI Native 的视觉稿还原 大淘宝技术
- 271. NVIDIA 开源 Molt:8600 行 RL 代码训万亿 MoE 模型
- 272. cvpr-2026新作ai绘画正式迈入所控即所得时代
- 273. 突发马斯克交卷最强grok-45opus最高级智能打骨折价
- 274. 中国首个十万卡集群落成全国产算力支撑十万卡时代
- 275. 中国第一 直逼OpenAI 神秘 扫地僧 冲到全球前七 新智元
- 276. Harness 实践 将任何文字编辑成精美的文章 code秘密花园
- 277. WWW 2026 | 频谱解耦与增强:让多模态大模型学会“去噪提纯”
- 278. WWW 2026 | 频谱解耦与增强:让多模态大模型学会“去噪提纯”
- 279. transformer能通向agi吗布林能但它已经变了
- 280. 新概念 AI 编程第五章:Graph Engineering
- 281. gpt-6为刷榜黑进hugging-face捅篓子还得靠glm-52追查
- 282. Accelerating Gemini Nano models on Pixel with frozen Multi-Token Prediction
- 283. 打破碎片化瓶颈!浙大&哈佛开源UniGeo,高保真相机可控编辑
- 284. LiveWorld:视频世界模型新范式,让镜头之外的世界继续演化
- 285. gpt-56即将上线推理狂飙750-tokenss疑似横跨100张晶圆
- 286. Harness 即后端 当Agent基础设施消解于统一原语 unknown
- 287. 国产模型 这回终于也有了 Opus 级体验 code秘密花园
- 288. anthropic造了套ai越狱刑法你的请求四种死法
- 289. Matt Pocock main flow:5 环节 3 反例,把 AI 拽回工程纪律
- 290. 从Loop到Graph Engineering:一个循环不够用之后会发生什么
- 291. 《语音操控 + 记忆觉醒:Hermes 高级功能完整指南》
- 292. 腾讯ray团队实践k8s-ray如何支撑超大规模ai-workload
- 293. DeepSeek做大 Mega MoE Tri Dao团队加快 SonicMoE 机器之心
- 294. Qwen-Image-Agent: Bridging the Context Gap in Real-World Image Generation
- 295. 唐杰预告glm史诗级升级技术论文入选顶会colm
- 296. claude-上线reflect功能让你回顾和反思如何使用-ai
- 297. 国产双开源 让Mac成为你的私人AI工作站 机器之心
- 298. ACL 2026|AI for聋哑群体,港理工开源思考型手语翻译模型
- 299. verbalized-sampling-prompt-engineering-icml2026-mode-collapse
- 300. VLA不够了 触觉 将改写具身智能新格局 机器之心
- 301. 场景营销前端 AI Coding 从问题到方案 大淘宝技术
- 302. 啊 我刚开源的 Skills 已经 7K Star 了 code秘密花园
- 303. Fable 5回归全网抓紧测!发现GLM-5.2更香了,价格只有1/39
- 304. Claude Code 太折腾?这个国产开源 AI 编程平台打开就能用
- 305. ACM MM 2026|高德2篇论文被收录,覆盖自回归图像生成、强化学习、视频美学评估方向
- 306. 李飞飞署名具身新论文:Sim2Real烧不起,Real2Sim量大管饱
- 307. 从月球漫步到赛博都市,WBench测出了世界模型的边界
- 308. 从月球漫步到赛博都市,WBench测出了世界模型的边界
- 309. 不好!1930年的AI都来抢程序员饭碗了
- 310. 奥特曼9年后再发声 没有他就没有OpenAI 新智元
- 311. 谷歌史上最差ai模型发布-gemini-35-pro延期
- 312. 吴恩达最新思考:从分钟到天,AI产品如何靠三层Loop迭代
- 313. 吴恩达最新思考:从分钟到天,AI产品如何靠三层Loop迭代
- 314. 吴恩达最新思考:从分钟到天,AI产品如何靠三层Loop迭代
- 315. 刚刚 GPT 5 6 发布了 平民使用无望了 数据STUDIO
- 316. Anthropic 官方拆解 Claude Code Loop 工程:4 层能力、2 起事故、30 轮卡住的根因
- 317. Loop 不够用了?AI 工程下一站叫 Graph
- 318. 2026-top-12-open-source-ai-projects-上半年度盘点
- 319. 添加官方技能库
- 320. 刚刚claude-fable-5续命5天省钱攻略来了
- 321. Debugging production agents with Amazon Bedrock AgentCore Observability
- 322. Claude Code vs Kimi vs MiniMax Agent Tea 科技充电站
- 323. 年薪百万 在旧金山开始租不起房了 新智元
- 324. 开启Harness Engineering探索之旅 腾讯技术工程
- 325. Pair Nova 2 Lite with Claude for cost-optimized document processing
- 326. 从0到1带你速通 Marvis马维斯 腾讯技术工程
- 327. 当代码越来越便宜 什么在变贵 百度Geek说
- 328. 为什么今天我们需要AI内容观 腾讯研究院
- 329. Generalization Dynamics of LM Pre-training — Jiaxin Wen
- 330. What happened after 2,000 people tried to hack my AI assistant
- 331. 1. 定义你的输出(这是合约,不是建议)
- 332. 前言
- 333. 被蒸馏 分身 克隆后 你 还是你吗 AGI Hunt
- 334. Claude Code 27 条实用技巧 快速升级 架构师
- 335. Claude Code 的 loop 实操 碎片化自动 架构师
- 336. 他用AI办了个音乐节 主题 别读博 量子位
- 337. Google Antigravity agents get full context with GitLab Orbit
- 338. 01
- 339. Claude最大规模MCP升级,月下载狂飙破4亿!
- 340. cursor-evals-benchmark-3-1-2026-07
- 341. Test-Driven Development Skill
- 342. The next big breakthrough will be AIs learning on the job
- 343. Surprising lessons from my research scientist job search
- 344. fable-5-原生编译游戏-到-iphone
- 345. 世界模型的新用途:不做选手,去当裁判
- 346. 为什么我们不用LangChain?
- 347. 世界模型的新用途:不做选手,去当裁判
- 348. Development environments for your cloud agents
- 349. 京东 Taro Native 框架静态布局直渲提速
- 350. AI PPT 这次是真不用返工了 量子位
- 351. 中国用十万卡定义下一代ai基建
- 352. 如何在 ChatGPT 中投放广告 AGI Hunt
- 353. 字节跳动-seedance-占领好莱坞
- 354. 01
- 355. Agent之间 有互联网了 量子位
- 356. 华为更新韬定律论文
- 357. 智能大下降人类将去哪
- 358. 1.前言
- 359. acl-2026华人霸榜
- 360. Meet Noz, your AI teammate inside SigNoz
- 361. 软件 3 0 时代来临 AGI Hunt
- 362. Token不经济 腾讯研究院
- 363. 腾讯研究院AI速递 20260630
- 364. 腾讯研究院AI速递 20260629
- 365. 2053749373608030557
- 366. google-hits-50-ipv6
- 367. Discretizing Reward Models
- 368. Lean Software Scaling Laws
- 369. Agents as Webs of Beliefs
- 370. cursor ios mobile app
- 371. markupextension-com
- 372. gpu kernel
- 373. 打造可靠的 AI 编程环境:Claude Code Hooks 完整开发者指南
- 374. 800行代码实现 Open Claw 的 Tool、消息总线、子Agent管理架构
- 375. Kimi Work:通用 Agent 战场从云端迁移到本地
- 376. 卡片式对话的协议方案探索和思考
- 377. Agent框架OWL原理详解
- 378. 开源 AI 知识管理搭档 Obsidian + Claude Code 完整集成指南
- 379. Claude Code 源码核心机制详解
- 380. III Dev Worker 触发函数架构
- 381. LLM agent脚手架如何具备自进化能力?——以hermes agent为例
- 382. User Journey Maps: How UX Teams Turn Friction Into Better Products
- 383. 滴滴 IBG 智能客服质检系统:3 管线(意图 86% / 合规 90%+ / VOC)+ 企业 LLM 落地方法论
- 384. ChatGPT 官宣 26 位未来之星:穿墙少年、街头摊贩、盲童的朋友
- 385. 深入理解 Claude Code 源码中的 Agent Harness 构建之道
- 386. 深入理解 Claude Code 源码中的 Agent Harness 构建之道
- 387. PyTorch 2.12 Release Blog
- 388. 刚刚Opus 4.7发布,相比4.6核心变化,与Claude Code搭配最佳实践
- 389. 天猫新品团队AI编码实战指南(下)
- 390. Trail of Bits: Skill Scanner Bypass 实证研究
- 391. 三器合一(Comet + OpenSpec + Superpowers):用文件系统给 AI 编程上工程纪律 — 术哥源码级深度分析(WHAT/HOW/WHEN-NEXT 分工 + 9 平台 Hook + 上下文压缩 + 多 Agent 协作 + Shell+YAML 工程取舍)
- 392. AI 硬件寒武纪时刻:百度智能云如何成为爆发催化剂(3 类玩家 + 4 个深度案例)
- 393. Nvidia Telco Reasoning Models Nemo
- 394. Postmortem: TanStack npm supply-chain compromise | TanStack Blog
- 395. PromptQueue + OpenGorilla 集成 — AI-Native 异步任务引擎与自进化认知层
- 396. Anthropic Claude Managed Agents 平台正式发布
- 397. The Shape of the Thing
- 398. MIRA + MPA:深度原理 AI Scientist 递归自训练打造材料基座模型,40 项实验全面 SOTA
- 399. GSD 上下文管理工具:用 Plan 约束 Agent 行为边界
- 400. LLM 主题 = 生成变量 — 别把 LLM 提取的主题当成真实变量(William Gieng 因果推断方法论)
- 401. Anthropic 最新博客:Prompt Caching 是构建 Claude Code 的一切
- 402. AI Evals 评估方法论
- 403. MSA 稀疏注意力三国杀:NSA / DSA / MoBA / MSA 四方案深度对比
- 404. AI 时代的 Git 版本管理最佳实践
- 405. AI Native 时代 —— 研发组织何去何从
- 406. AGI 之路,可能从一开始就走错了
- 407. RAG技术框架的演进方向
- 408. LangGraph 底层原理:它是怎么把 LLM 变成一台状态机的
- 409. Nvidia Edge First Llms Av Robotics
- 410. 淘天营销中后台生码工作流最佳实践
- 411. OpenTelemetry eBPF Instrumentation (OBI) — 零代码全栈可观测性的内核级实现
- 412. 750B MoE PD 分离推理:AWS EFA vs 自建 RoCE 通信架构实战对比
- 413. 提速4.48倍!哈工大华为新框架让扩散大模型精度无损、推理起飞
- 414. Fundamental’s Large Tabular Model NEXUS is now available on Amazon SageMaker JumpStart
- 415. Anthropic Claude Cowork 知识工作 Agent 任务边界 — 5 筛选信号 + 6 阶段工作流 + 6 企业控制点
- 416. AI Agent 架构设计(七):Skills 系统设计(OpenClaw、Claude Code、Hermes Agent 对比)
- 417. MNN-Sana-Edit-V2:端侧运行的图像漫画风编辑大模型
- 418. OpenClaw与Hermes源码架构对比
- 419. Triton L2缓存命中优化矩阵乘法(fp16&int8)详解及性能测试
- 420. Claude 4/5 Sonnet & Opus Release Notes
- 421. GPT-5: It Just Does Stuff
- 422. CLAUDE.md
- 423. NomShub — Cursor 远程隧道利用链:Shell Builtin 沙箱逃逸 + Dev Tunnels 武器化
- 424. Latest open artifacts (#20): New orgs! New types of models! With Nemotron Super, Sarvam, Cohere Transcribe, & others
- 425. nanobot:4000行极简 Agent 框架架构解析
- 426. 你还在手动调代码,这个工程师的平台已经在自动进化了
- 427. Microsoft MXC — 跨 OS 代理代码执行容器:AppContainer/Sandbox/Hyperlight 三层隔离
- 428. 100 年压缩到 100 天!红杉资本:这就是 AGI
- 429. DeepSeek Thinking with Visual Primitives 深度解读
- 430. Gemma 4 Multi Token Prediction Drafters
- 431. 滴滴国际化客服质检智能化之路:基于 Amazon Bedrock 的多语种多业务线质检实践
- 432. 读完这篇你就搞懂 DeepSeek v4 了
- 433. Model-Harness Fit:Agent 脚手架适配模型
- 434. 我们刚过了人类最后一个劳动节?AI新职业的八个变化
- 435. Three Years from GPT-3 to Gemini 3
- 436. From "System of Record" to "System of Intelligence
- 437. GBrain — YC CEO Garry Tan 的 Postgres-native AI 第二大脑:5 大设计决策 + 零 LLM 知识图谱 + 8 阶段检索 + Brain⊥Source 正交维度
- 438. Personal AI 工作台:Claude 18 动作框架
- 439. Claude Code 大型代码库最佳实践
- 440. Claude Code 1.0.24 工具调用安全事故:静默删 .gitignore 与 Redis flush 复盘
- 441. Claude Code vs Hermes — Session 工程师 vs Goal Runtime
- 442. AI4S 2026 H1 跨学科前沿全景(弦论泰斗、AI 提速百倍、与"该谁负责"之问)
- 443. 打造 AI 智能体专属的代码知识库:GitNexus 完整上手攻略
- 444. 纳德拉「Token 资本」论 — Microsoft CEO 的 AI 时代企业战略宣言
- 445. How Frontier Teams Are Reinventing AI-Native Development
- 446. 05—skill-creator 源码深度拆解:LLM Skill 触发率、防过拟合与三 Agent 评审完整指南
- 447. 800行代码实现 Open Claw 的 Tool、消息总线、子Agent管理架构
- 448. Codex 三件套:6 职位插件 + Sites + Annotations
- 449. Claude Code 源码深度解析(13 核心机制)
- 450. How harnesses and post-training close the open-weight bug-finding gap
- 451. Cursor Harness Model Production Floor
- 452. Claude Managed Agents 新更新\"专属云\"模式:把Agent的手放回企业内部
- 453. Anthropic 官方 14 种 Skill 设计模式
- 454. Claude Code 之父最新访谈:编程已经结束、harness 将消失、Claude Code 将只有 100 行代码、loop 才是未来
- 455. Agent Memory 模块化框架与评测:Memory in the LLM Era 4 模块 + 10 方案对比 + 新方法 F1 38.79 + 4 条工程原则
- 456. Claude Code 源码拆解:从启动到多 Agent 扩展层
- 457. Claude Opus 4.8: The System Card
- 458. Evaluating Netflix Show Synopses with LLM-as-a-Judge
- 459. Claude Fable 5 — Ethan Mollick hands-on qualitative evaluation
- 460. 很多企业做完 AI PoC,为什么还是上不了生产
- 461. ChatGPT Dreaming V3:长期记忆架构级重构(时效 75.1% / 偏好 71.3% / 算力 -80%)
- 462. 清华 AI 自进化组织研究报告:AI 业务资产化与公司形态重构
- 463. 严格 CSP 下的密码窃取:HTML 注入 + Chrome 自动填充攻击
- 464. 你的AI代码越写越乱,他72小时合了14个PR每个都更好——差距只在一个机制
- 465. Vibe Coding and Agentic Engineering Convergence: Simon Willison Interview
- 466. Simplify model selection in Amazon Bedrock with the open source Model Profiler
- 467. 18岁高中生用AI挖出150万未知天体,首批ChatGPT原住民毕业
- 468. Codex 重磅升级:Appshots / Goal 毕业 / 锁屏远程操控
- 469. 条条电路通罗马:大模型可解释性的「唯一机制」可能从一开始就不存在
- 470. knowledge-work-plugins拆解:Anthropic官方开源,4 种组件、3 级加载、2 层记忆,纯文件的 AI岗位插件集
- 471. Anthropic 最新论文:阻止 AI 叛变的方法(Model Spec Midtraining)
- 472. 刚刚Opus 4.7发布,相比4.6核心变化,与Claude Code搭配最佳实践
- 473. Anthropic LLM ATT&CK Navigator: AI-Enabled Cyber Operations
- 474. Lossy self-improvement
- 475. 安全护栏的三域演进 — 阿里云云原生从 Claude Fable 5 提炼的护栏设计原则
- 476. Epiplexity:有限算力信息论
- 477. AGI 之路,可能从一开始就走错了(腾讯研究院·王鹏)
- 478. FrontierCode — Cognition AI 的 PR Mergeability 编码基准
- 479. Anthropic 博客:Claude Code 大型代码库最佳实践
- 480. Memento-Skills — 技能外部记忆让 Agent 自进化(arXiv 2603.18743)
- 481. The distillation panic
- 482. SkillOS: Learning Skill Curation for Self-Evolving Agents
- 483. Protecting against token theft
- 484. LLMjacking: what these attacks are, and how to protect AI servers
- 485. Impeccable:把 AI 前端设计变成可检查的工作流 — 33.4k Star 开源项目深度分析
- 486. Token 退化问题:分词器与后训练数据分布失配
- 487. Gepa Optimize Anything
- 488. GPT-5.5:Sign of the Future — Mollick 的模型/Apps/Harnesses 三层框架与 4 提示 PhD 论文实验
- 489. Karpathy LLM Wiki V2:AI 知识管理新范式
- 490. 估值3000亿63家新实验室杀疯了murati贝佐斯集体押注下一代ai
- 491. Qwen Code Skill Testing Framework: Recording, Playback, and Assertions
- 492. OpenAI携手五巨头开源革命性超算协议:一举解决超大集群LLM训练不稳定和网络性能难题
- 493. 多模态评估器:MLLM-as-Judge 图文评估
- 494. Rethinking Search as Code Generation
- 495. 几千年都没考过这个?谷歌「最毒」AI考局,专测你在压力下怎么做人
- 496. GPT-2 权重之谜:为什么 OpenAI 的原始权重比自训练模型更擅长指令跟随
- 497. Agent Harness Engineering: A Survey — ETCLOVG Taxonomy
- 498. Claude思考黑箱终结了!Anthropic 祭出AI读心术:揭秘Claude的隐藏想法!
- 499. Karpathy最新开喷:一句话让全场Agent开发者安静了
- 500. Claude Code KAIROS 范式深度解析
- 501. Anthropic 官方 Agent Harness 平台:Claude Managed Agents 完整指南
- 502. 一、关于 Kollab
- 503. Project Glasswing: what Mythos showed us
- 504. Anthropic Claude Community 插件仓库劫持事件:SHA 校验如何避免供应链攻击
- 505. Loop Engineering 已死?一文带你了解 Graph Engineering
- 506. Tencent AI Infra: Backend Engineer's Guide to AI System Hardware and Software
- 507. 在 RDS PostgreSQL 中实现 RaBitQ 量化
- 508. Anthropic Claude Fable 5 on AWS:内置保护措施的 Mythos 级功能现已推出
- 509. Claude Code vs Codex 上下文架构:五层压缩管道 vs 容器文件系统
- 510. 数据级 Harness:架构师 JiaGouX 解读 Anthropic 95% 数据分析与 5 个反直觉边界
- 511. The 2026 State of AI Traffic & Cyberthreat Benchmark Report - HUMAN Security
- 512. We've Been Here Before: Decompilers, Fuzzers, and Now AI
- 513. Boris Cherny 新访谈:开发工具正在从 IDE 变成 Agent 控制台
- 514. Claude Code 学术文献综述:45 页 SCI 一区级产出
- 515. Fusedash - Generative Analytics Platform | AI Dashboard Software
- 516. Mythos for Offensive Security: XBOW's Evaluation
- 517. Gemma 4 与开源模型成功标准 —— Interconnects 五维评估框架
- 518. 美国富人放弃传统学校,一年花52万把孩子送进AI私塾
- 519. Claude Code Agent Teams 实战:怎么拆任务、控权限、收证据
- 520. Google Agentic RAG — Sufficient Context Agent + FramesQA 90.1% Cross-Corpus
- 521. Hermes Agent Skill 系统深度解析
- 522. Introducing Scheduled Tasks 2.0
- 523. 最佳 Claude Code 配置:Andrej Karpathy 的 CLAUDE.md,134+k star了!
- 524. AWS Sagemaker Capacity Aware Inference Fallback
- 525. Problem with Mathematically Proven Claims About Llms
- 526. Cline releases open-source agent runtime SDK
- 527. LLM-as-a-Verifier: A General-Purpose Verification Framework
- 528. YC 总裁开源了自己亲手写的 AI Agent 大脑,1 周就 1 万点赞。
- 529. LLMReaper - DOM Based AI Conversation Exfiltration via Browser Extensions
- 530. 卡帕西\"LLM Wiki\",到底是什么?——用 Claude + Obsidian 给自己造一个第二大脑的完整拆解
- 531. Cola DLM:字节跳动连续潜空间扩散语言模型
- 532. Ralph Loop 不够用:长时间 Agent 还缺这 3 件事
- 533. WorkBuddy专家团提示词全曝光:多Agent协作原来是这样产品化的
- 534. 复杂度棘轮:AI编程的质量只升不降机制
- 535. 从多智能体编排到AI自主决策:资损防控体系的架构演进
- 536. 限流比降 10 倍:百炼网关如何用 RocketMQ LiteTopic 重构大模型限流
- 537. RAG 深度解析:分块向量化召回重排才是蒸馏同事 Skill 的关键
- 538. Google Workspace Updates: Small businesses can now seamlessly import users from Microsoft to Google Workspace
- 539. 给"氛围编程"系上安全带:阿里集团 AI 代码评审实践与 Benchmark 开源
- 540. AI Native 时代 —— 研发组织何去何从
- 541. Hermes-Agent 官方 Kanban 深度实测:让商业 CLI 工具当 Orchestrator
- 542. 只看图片就能学会压缩Token!浙大&阿里新框架多轮VQA压缩率90%,精度不掉|CVPR 2026
- 543. Checkmarx Jenkins plugin compromised in new supply chain attack
- 544. Agent Harness 解析:智能体架构深度拆解
- 545. 所有实验室都怕字节,所有人都在夸DeepSeek!美国研究员36小时中国AI行
- 546. 现在如何使用 AI:一份快速指南(Ethan Mollick)
- 547. 何恺明首个语言模型:105M参数,不走GPT自回归老路
- 548. Claude Opus 4.7 发布分析
- 549. Agent Skill 进阶模式与治理
- 550. ChatGPT Memory
- 551. 开源模型的下一阶段:三类模型分类与生态化路径
- 552. The inevitable need for an open model consortium
- 553. Codeindex · 让大模型更好地理解你的代码
- 554. 【实践案例】我用Skills实现了个自媒体知识管理神器!
- 555. Can We Agree on a Storage/Workload Architecture Taxonomy? — Jack Vanlightly
- 556. 腾讯研究院AI速递 20260701
- 557. Hermes Agent 闭环学习机制
- 558. Navigating EU AI Act Requirements for LLM Fine-Tuning
- 559. Agent 记忆注入实战:5 维框架(选什么/放哪里/怎么放/放多少/何时放)+ 4 前沿论文(MemGuide/STITCH/ACE/Lost in the Middle)
- 560. Claude、GLM、GPT谁才是真正的AI软件工程师?首个持续更新Visual Spec-to-App Benchmark发布
- 561. IMClaw:通过微信/飞书操控ClaudeCode/Codex/GeminiCLI/Pi Agent蜂群
- 562. Claude Fable 5 发布:AI 工作流的关键正在转向 Loop 循环
- 563. Claude Managed Agents 开发者指南
- 564. 中国科学院携手全球顶尖机构发布首个十亿参数级的手术视频基础模型SurgMotion!
- 565. Yann LeCun 谈 LLM 不是智能与世界模型 JEPA
- 566. Google & Amnesty International:联手打击商业间谍软件
- 567. 机器人看视频学操作!伯克利首次打通互联网视频到灵巧手真机部署链路
- 568. LLM-as-a-Verifier: A General-Purpose Verification
- 569. 天猫 AI 编程实践:团队知识库 + NPM
- 570. Tracking TamperedChef Clusters via Certificate and Code Reuse
- 571. QoderWork Skills 开发实践:从传统数科到 AI 数科的转型探索-我的Skills进阶之旅
- 572. 腾讯研究院AI速递 20260430
- 573. 注定改变历史的一代人
- 574. Claude Code and What Comes Next
- 575. Agent框架OWL原理详解
- 576. 别只盯着模型:Agent 真正的护城河,是这四层循环
- 577. Yoonho Lee: Text Optimization as a Legitimate Learning Mechanism
- 578. Noam Brown:推理预算应成为AI评估的基础变量
- 579. kimi-回应马斯克隔空宣战
- 580. Claude Code 太折腾?这个国产开源 AI 编程平台打开就能用
- 581. 腾讯研究院AI速递 20260506
- 582. Google's Gemini Omni video model surfaces ahead of I/O debut
- 583. Cline releases open-source agent runtime SDK
- 584. iii.dev
- 585. 机器人端杯子之前在想什么?Afford-VLA:先找到杯子最趁手的那块区域
- 586. 腾讯研究院AI速递 20260630
- 587. DeepSeek视觉原语论文:当所有人在堆图像分辨率时,它在堆「指代精度」!
- 588. 读完 Claude Code 和 OpenClaw 的 memory 源码,我对 Agent 记忆需要向量数据库产生怀疑
- 589. Anthropic 实战分享:如何让 AI Agent 持续工作几天?
- 590. OpenAI深夜放出GPT-Live,ChatGPT终于像真人一样说话
- 591. Opus 4.7 发布:相比 4.6 核心变化与 Claude Code 搭配最佳实践
- 592. AI Agent Gateway 架构设计 — OpenClaw/Claude Code/Hermes 三框架对比
- 593. 从 Claude Code 记忆系统看四层 Agent 记忆方案,一个比一个夯
- 594. 刚刚,OpenAI 放出三个语音模型,顺便杀死了「同传」
- 595. Latest open artifacts (#19):Qwen 3.5、GLM 5、MiniMax 2.5 — 中国实验室的前沿推进
- 596. Claude Code 安全审查的隐性盲点:Model Anchoring Bias 实证分析
- 597. 开始在 Amazon Bedrock 上使用 OpenAI GPT-5.5、GPT-5.4 模型和 Codex
- 598. Harness Engineering实践做了一个平台让AI一晚上自动评测和优化你的系统
- 599. 刷榜AI全挂了!Meta斯坦福地狱级测试,GPT/Claude/Gemini交出0分
- 600. 谷歌PM公开:2026开发者五大新技能——问题塑形/上下文设计/审美/编排/判断力
- 601. The Coming Loop
- 602. 用好 Claude 的 18 个动作:搭一个个人 AI 工作台(Personal Harness)
- 603. 构建 ai 驱动的 eks 集群健康诊断 saas 平台 从静态规则到 mcp agent 自主分析
- 604. 京东 Taro Native 框架静态布局直渲提速
- 605. GPT-5.5参数有10T?病毒式论文刚刚被打假,实际缩水至1.5T
- 606. 国产双开源:让Mac成为你的私人AI工作站
- 607. Apple Silicon costs more than OpenRouter
- 608. Kimi K3: The Open-Weights Escalation
- 609. 华为云、昇腾联合RLinf,共筑基于昇腾算力的具身智能开发生态
- 610. Anthropic发布「AI原生创业公司」手册:涵盖全流程四大核心阶段,一人公司法典来了
- 611. 智谱公布“降智”的秘密:Scaling不可避免的痛
- 612. Reimagining the mouse pointer for the AI era
- 613. Nathan Lambert:开源权重安全论的三个认知陷阱
- 614. 全网骂Claude变笨,Anthropic下场揭秘:坑你的不是模型
- 615. ICLR 2026 Scenethesis:英伟达 & 普渡大学用 Agent 闭环实现文生 3D
- 616. Google被曝正在研发一颗新的服务器AI芯片,把Gemini固化到硬件里
- 617. 柚漫剧 AI 全流程提效拆解
- 618. NVIDIA Agent Toolkit + Omniverse
- 619. Yann Dubois × Matt Turck:OpenAI 后训练与强化学习的内部视角
- 620. 开启Harness Engineering探索之旅
- 621. YC掌门人60天写了60万行代码:gstack开源
- 622. 百炼网关:用RocketMQ LiteTopic重构大模型限流架构
- 623. 实测GLM-5.2百万上下文:85页世界杯前瞻
- 624. Olmo Hybrid and future LLM architectures
- 625. 后端系统「AI 知识库体系」建设实践
- 626. 开源模型回顾:Kimi K3、Qwen 3.8、WAIC 演讲、蒸馏与中美竞争
- 627. Introducing the Ettin Reranker Family
- 628. Claude Code 工具设计复盘(官方)
- 629. EchoGen — ICLR 2026 首个基于视觉自回归模型的前馈式主体驱动图像生成
- 630. Hermes Agent SOUL.md:3 层提示词、14 个内置人格,从源码看身份定制的完整设计
- 631. AI科研超越人类 — Prime Intellect递归自改进实验
- 632. The Shape of AI: Jaggedness, Bottlenecks and Salients
- 633. Perplexity Numbat: Agent Security Suite
- 634. 全网最全的Claude Fable 5 省钱攻略都在这了
- 635. Thinking Machines Inkling — 975B MoE 开放权重模型
- 636. 这套题,GPT-5.5、Opus 4.7加起来没考到「1分」,人类却拿了满分100?
- 637. Anthropic's bug-hunting Mythos was greatest marketing stunt ever says curl creator
- 638. Claude Code Harness Deep Understanding
- 639. Claude统治一切!吞下这颗红药丸,焊工也是顶尖程序员
- 640. SWE-1.7: Frontier Intelligence at a Fraction of the Cost
- 641. 24G显卡可跑!南大PRISM工具包来了,多模态持续微调开箱即用
- 642. 阿里开源PromptEcho:用冻结多模态大模型为文生图训练提供高质量Reward
- 643. Claude Sonnet 5 发布,性能接近 Opus 4.8,价格只有60%
- 644. 腾讯研究院AI速递 20260629
- 645. 维纳智能登上Nature通讯:AI不只会回答问题,开始生成高精度行业数据
- 646. How my non-engineering team at Sentry learned to ship
- 647. Miles: PyTorch-Native LLM RL Post-Training Framework
- 648. Claude 发布官方报告,承认存在 3 处质量退化问题
- 649. Language Models and Meaning
- 650. Gemini 深度导读生成器 Prompt:让 AI 重写而非摘要
- 651. OpenAI Reasoning Models (o1/o3/o4-mini)
- 652. 300万人在存的Claude提示词
- 653. Tokenomics: the 62.5-minute rule for Claude's cache
- 654. Hermes-Agent Kanban 实测 — 商业 CLI 作为上层 Orchestrator
- 655. kasra.blog LLM Agent 黑客能力实测: USD 1500 投石问路 14 模型
- 656. DeepSeek V4 Triton FP4 优化实战
- 657. How Claude Code works in large codebases: Best practices and where to start
- 658. Prompting Amazon Nova 2 for content moderation
- 659. Built Technologies AI Document Intelligence — 房地产金融 AI 文档处理引擎
- 660. AI Skill 测评指标体系
- 661. Reading today's open-closed performance gap
- 662. Scenethesis(ICLR 2026)英伟达 & 普渡大学用 Agent 闭环实现文生 3D
- 663. 天猫 AI 编程实践:团队知识库建设
- 664. Anthropic让AI先读员工手册再上岗:失控率从54%降到7%
- 665. AI打工大排行:Claude Fable 5自动赚钱的能力,是GPT-5.5的2.5倍
- 666. 《Loop Engineering橙皮书》发布!免费,开源
- 667. 视频 RAG 分块策略:停顿 / 滑动窗口 / LLM 主题分块
- 668. ICML 2026 | APO:将多教师冲突转化为动态约束,破解多模态大模型推理对齐难题
- 669. GPT 5.4 是 Codex 的一次大跨越:四维评估视角与 Agent 战争回归
- 670. 本体这件事,技术早就不是问题——企业AI非技术困境的对话
- 671. 真武 AI 芯片 T-Head Sail 软件栈开源
- 672. AutoCLI / OpenCLI / AgentBrowser / CLI-Anything 调研
- 673. OpenAI 的最强对手,离「AI Windows」又近了一步
- 674. My bets on open models, mid-2026
- 675. Claude Code vs Kimi vs MiniMax:Agent Teams 到底拼的是什么?
- 676. DeliAutoResearch SKILL:DeepSeek陈德里的自主科研智能体框架
- 677. 上交 x 阿里:闭眼先学动作 VLA
- 678. DeepSeek Code Harness:对标 Claude Code 的中国方案
- 679. Management as AI superpower
- 680. Inference cost at scale with napkin math
- 681. Agent Skills 开发指南:6 字段规范、3 级加载、5 步评估闭环
- 682. How far behind are open models? (LessWrong 2026-05)
- 683. 0%完成率!Claude、GPT、Gemini 全灭,SWE-Bench作者新作把AI圈干沉默了
- 684. AI 驱动的裁员没有商业意义 — Gartner 研究
- 685. Introducing Claude Platform on AWS: Anthropic's native platform, through your AWS account
- 686. LangChain用Agent做销售获客,3个月转化率提升2.5倍,看完后我发现,国内 Agent 落地的方法都错了
- 687. Explicit vs. Implicit in the Age of Intelligences — Le secrétaire de Fernand
- 688. Claude Code 核心开发者经验:Action Space 设计
- 689. 登上Nature子刊!Meta脑机接口重大阶段性进展,超高实时解码准确率
- 690. Nemotron 3.5 Content Safety: Customizable Multimodal Safety for Global Enterprise
- 691. The Code-as-Content Era
- 692. Skills:让 Claude 记住「怎么做」,告别重复教学
- 693. mtp 加速推理最佳实践在亚马逊云科技中国区使用 llamacpp 部署 qwen36 的实测指南
- 694. Claude Dispatch and the Power of Interfaces
- 695. GIAC 2026 圆满落幕:AI Native 进入深水区,技术组织如何重构?
- 696. Latest open artifacts (#21): Open model bonanza! Gemma 4, DeepSeek V4, Kimi K2.6, MiMo 2.5, GLM-5.1 & others. On CAISI's V4 assessment.
- 697. Let's be honest: retail banking is broken
- 698. Gemini 3.5: frontier intelligence with action
- 699. Grok 4.5:Opus 4.8 级能力,四分之一价格
- 700. 不用学AI了!圈内公开的秘密:顶级玩家已开始让AI用AI
- 701. Gemma 4 QAT Models: Quantization-Aware Training for Mobile and Edge
- 702. Claude Code 设计原则与对照分析
- 703. Scaling UX Testing with Amazon Nova Act
- 704. Recent Developments in LLM Architectures: KV Sharing, mHC, and Compressed Attention
- 705. 你讲卫生吗?— AI 交互卫生的七条实战经验
- 706. Claude Code 七大模块详解
- 707. Claude Code Skills 与 Superpowers 实践
- 708. 告别“氛围编程”:基于 Harness 治理和 SDD 的团队级 AI 研发范式演进与实践
- 709. 不改一行代码,看透 AI Agent 的每一次调用
- 710. Ds4c Deepseek V4 Antirez
- 711. Claude Science — Anthropic 推出面向科研的 AI 工作台
- 712. Agent 评测:方法论与体系设计
- 713. 提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026
- 714. Inside ChatGPT Search: how web.run and fan-out queries shape results
- 715. Kimi K3,这是 DeepSeek 2.0 时刻
- 716. Fable 5回归全网抓紧测!发现GLM-5.2更香了,价格只有1/39
- 717. 高德工业级能力底座:AI-Native 的端云一体基建
- 718. APO — Autonomous Preference Optimization(ICML 2026)
- 719. 让 Agent 自主完成任务
- 720. 破解遥感目标的形状与尺度难题,PKINet二代推理提速近4倍!
- 721. Designing with AI: Why Claude Design is not the future of enterprise design
- 722. Private Fintech Has Quietly Become Bigger Than Public Fintech. Now What?
- 723. 面向大型代码库的 Claude Code 团队落地经验与扩展策略(Agent Harness)
- 724. Microsoft for Startups | Microsoft
- 725. Agent Executor, Google's distributed Agent Runtime
- 726. Token不经济
- 727. 基于 amazon sagemaker ai 部署 chronos bolt 实现零样本时序预测
- 728. Fake OpenAI Privacy Filter Repo Hits #1 on Hugging Face, Draws 244K Downloads
- 729. LLM 记忆架构三维分类体系(清华《Memory for Large Language Models》综述)
- 730. Program-as-Weights (PAW) — 神经编译模糊函数为 LoRA 权重
- 731. GPT-5:It Just Does Stuff — Mollick 的主动式 AI 原语
- 732. 不止是GPT-5.6!Codex正式上位替换ChatGPT
- 733. 突发!Anthropic拿下马斯克Colossus 1全部算力:Claude要放开用了
- 734. Seed2.0 Model Card: Towards Intelligence Frontier for Real-World Complexity
- 735. GPT-5.6 Preview System Card — Community Detection & Benchmarks
- 736. MoleculeOS(MOS)——许锦波团队AI原生生物经济操作系统
- 737. Codex 自主赚钱:全自动商业闭环实验
- 738. 淘天营销中后台 AI 生码工作流最佳实践
- 739. AGenUI:高德端云一体生成式 UI(A2UI 三端原生渲染引擎)
- 740. Meta 首个 Agent 生图模型:LLM controlled generation 新范式
- 741. 开放模型生态快报 #22:Zyphra、Cohere、Poolside 扩张开放模型版图
- 742. EntryPoint Hijacking
- 743. Anthropic Global Workspace (J-Space) — Claude 的内部心理工作区
- 744. 都在卷「让大模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了
- 745. 梁文锋花 4 小时讲透了通往 AGI 的常识
- 746. Mass Intelligence: AI 普及的拐点
- 747. 突发gemini-36-来了智力直接原地踏步速度立刻翻倍
- 748. Introducing eve
- 749. AWS SageMaker 阿塞拜疆语 LLM 训练:BBPE 分词 + FSDP + Liger 三阶段方案
- 750. While Breathless in Stodgy Viridian
- 751. 实锤了:Claude Code偷查用户,时区、中国AI实验室全是关键词
- 752. 12项世界第一!国产基模一战封神,11亿参数逆袭70亿大魔王
- 753. Cohere North Mini Code -30B MoE Agentic Coding Model
- 754. Nvidia embraces role of AI investor, pushing past $40 billion in equity bets this year
- 755. AI第一次科研竞赛中击败人类!Opus 4.7狂飙2930步创世界纪录
- 756. Haptics design and implementation - Microsoft Design
- 757. 你的一人公司品牌部,带着Image-2模型的lovart中文版来了
- 758. LLM Steering 行为引导
- 759. Microsoft to retire ‘Together Mode,’ its virtual meeting space for Teams
- 760. A社你解释下,啥叫Sonnet 5比Fable 5还贵?
- 761. 第一批ai原生本科生要毕业了
- 762. 我把Mac留在家,用手机让TRAE SOLO替我打了一天工
- 763. the token economy
- 764. Latest Open Artifacts #19:Qwen 3.5·GLM-5·MiniMax M2.5 中国开源模型前沿
- 765. Mellum 2 (JetBrains open-weight 12B MoE code LLM)
- 766. 大模型能写出工业级优化算法吗?MIT提出FrontierOR给AI设下考场
- 767. Anthropic推出Claude Science——科研界的Claude Code
- 768. 从零构建大语言模型 —— 读完这篇你就懂了
- 769. 一文看懂 AI 编程智能体工程化新范式:Loop Engineering
- 770. Ollama 已经不是 2024 年那个了!一键配齐 Claude Code/Codex/OpenClaw
- 771. AWS 强化微调:LLM-as-Judge 训练范式
- 772. Mollick AI 进展的 32 只水獭基准
- 773. CVPR 2026 Highlight|让AI像电影人一样「看」视频,8B小模型反超GPT-5与Gemini 3.1 Pro
- 774. Xero Announces Integration with Anthropic's Claude
- 775. 一文看懂 OpenAI 开源的 Codex 编排规范:Symphony
- 776. 扣子 3.0 离谱更新:把 Codex、Claude Code 拉进一个项目工作?
- 777. 奥特曼最险一战:前女CTO当庭翻脸,OpenAI权斗彻底打到台前
- 778. 大厂代码库几百万行,Claude Code怎么跑起来的?Anthropic首次公开全套打法
- 779. AI-powered BI with Snowflake and Amazon QuickSight
- 780. Anthropic
- 781. Claude Code 上下文工程 —— Anthropic 团队的工程实践
- 782. 别再手写 Skill 了!微软最新研究:像神经网络一样训练 Skill
- 783. Vera Arrives: NVIDIA’s First CPU Built for Agents Lands at Top AI Labs
- 784. 企业构建值得信赖的专用 AI 的关键方法论
- 785. Fable 5 两年后笔记本运行?端侧模型将爆发
- 786. 让搜索更懂用户 — Viking AI 搜索如何用个性化提升转化
- 787. SEO is a product, AEO is brand
- 788. DOPD: 双在线策略蒸馏 — 破解特权幻觉,让蒸馏更有效
- 789. Claude Managed Agents 官方 Harness 平台指南
- 790. Build a self-improving AI PM OS with Claude Code
- 791. GrowLoop:开放域对话的真人感评测 — 用种子+Rubrics自动生长Benchmark
- 792. 阿里云 AI 工程实践合集
- 793. Fable 5 手搓 CUDA 超级内核 18.7 倍加速
- 794. 软件工程的 AI 转型
- 795. 飞书让表格变成「AI同事」加入群聊,不打开表就能用表
- 796. Anthropic深夜连放两弹:Sonnet 5、全新AI科研App重磅上线
- 797. Inngest - AI in Production: The 2026 Benchmark Report
- 798. The best argument I’ve heard for why AI won't take your job
- 799. Anthropic Claude Code 木马门:隐私遥测争议
- 800. AI自己造AI,概率60%,2028年底前!Anthropic联创坐不住了
- 801. 使用 lm evaluation harness 评估 amazon bedrock 模型以 humaneval 为例
- 802. 用 LiteLLM WebSearch Interception 集成 AWS 托管的 Amazon Bedrock AgentCore Web Search 能力
- 803. DeepSeek视觉原语论文:当所有人在堆图像分辨率时,它在堆「指代精度」!
- 804. 高德 NL2SQL 知识工程:确定性路由 + 6 节知识卡片 + 352 表生产实践
- 805. AutoResearch 迁移到软件开发:多 Agent 交叉审核的工程实践
- 806. 「没了李开复,零一万物还有什么?」一个敢问一个敢答
- 807. Knowledge Agents: Beat Frontier Models with Better Structure
- 808. Build real-time voice streaming applications with Amazon Nova Sonic and WebRTC
- 809. AutoResearch-LLM:让 Agent 接手 LLM 训练优化
- 810. AlphaEvolve: A coding agent for scientific and algorithmic discovery
- 811. 3小时蒸发200万:一个AI客服引发的灾难
- 812. The new AI lock-in
- 813. Claude Cowork 大更新:彻夜自动编程的新时代
- 814. LLMReaper - DOM Based AI Conversation Exfiltration via Browser Extensions
- 815. Exploring Self-Distilled Reasoning for SFT
- 816. Model Size Scaling in 2023-2031
- 817. HugAgentOS — 浙大三引擎一体自进化 Agent 操作系统
- 818. RAG深度解析:分块、向量化、召回、重排,才是"蒸馏同事skill"的关键
- 819. 全球医疗榜第一,中国AI杀疯了!医疗AI迈入Harness时代
- 820. 工作流的 Skill 怎么写?从 7 个顶级 Skill 中提炼的模式与最佳实践
- 821. Why and how to implement an AI asset rationalization strategy
- 822. DeepSeek之后,中国AI「自己出题」杀进Nature通讯!全球仅4家
- 823. 钉钉 AI 助手
- 824. 美团 LongCat 开源 VitaBench 2.0:长期动态智能体基准新标杆
- 825. 别再把上下文当聊天记录
- 826. Claude Science:AI 科研工作台,10 倍科研提速
- 827. The Minimum Viable Unit of Saleable Software
- 828. 给 AI 做工作面试:Mollick 的模型评估方法论
- 829. 最适合机器人的视频基座模型,被中国团队开源了
- 830. 很多企业做完 AI PoC,为什么还是上不了生产
- 831. Claude Code HTML Artifact Workflow (IFanR Analysis)
- 832. deepseek-v4深度拆解一篇论文同时做了五件大事
- 833. 场景营销前端 AI Coding — 从问题到方案
- 834. How to Get a 100% Conference Acceptance Rate, The Novee Way: A High-Severity CVE in Leading Call-for-Papers Software
- 835. What Is Software, and Will LLMs Replace It?
- 836. AI 漏洞研究:历史重演的安全视角
- 837. The recent history of AI in 32 otters
- 838. TokenSpeed: A Speed-of-Light LLM Inference Engine for AI Agents
- 839. Direct Connect (DX) 迁移最佳实践
- 840. 国产预训练具身大模型开源:Wall-OSS-0.5零样本上真机,预训练即可部署
- 841. GPT-5.5全球首破!0源码盲写程序,编程AI进入新纪元
- 842. 企微的这些新功能,补齐了AI在你公司的最后一公里
- 843. Claude Code 动态工作流 8 译本(行小招译注 + Hermes DAG 对比)
- 844. A Guide to Which AI to Use in the Agentic Era
- 845. 从语言涌现到协作涌现:如何让 AI 产生高质量决策
- 846. Prompt Injection as Role Confusion
- 847. The New Phishing Click: How OAuth Consent Bypasses MFA
- 848. Americans still feel pessimistic about the economy. When will it change?
- 849. Making Claude a chemist
- 850. Harness 实践:将任何文字编辑成精美的文章
- 851. Anthropic 最新播客:如何打造下一代 Claude
- 852. Claude Science 开源平替 OpenScience
- 853. AI科学家再聪明10倍,科学也快不起来:瓶颈是300年前发明的「论文」
- 854. 腾讯混元 Hy3 正式版:Agent 能力跃升与多产品落地
- 855. 蒸馏效果起飞!DOPD破解「特权幻觉」,让在线策略蒸馏更有效
- 856. 当理解成为瓶颈:AI 编程时代的认知债与意图债
- 857. Slack AI: The Path to Multi-Cloud
- 858. 4000行代码撑起一个Agent框架?nanobot架构深度解析
- 859. 现代AI之父新作:13个大模型实测,检索agent真的可信吗?
- 860. 大圆实测 : 你真的需要一个长在企业微信中的AI
- 861. Apache RocketMQ 5.5.0 开源 LiteTopic:百万级 AI 会话专属通道
- 862. ECCV'26 | 为视频虚拟试衣解锁自由视角,TryOnCrafter玩转4D试衣代理
- 863. 微软等提出 SkillOpt:把 Skill 当成模型一样训练
- 864. Open Notebook
- 865. 谷歌Gemma 4论文分析
- 866. Semis Memo: Supply Chain Inheritance
- 867. 独家对话罗福莉:AI范式已然巨变!
- 868. Cursor让马斯克的Grok4.5咸鱼翻身,追平Opus 4.8,成本比GLM5.2还低
- 869. LLM 工作机制与可解释性
- 870. CVPR 2026 | 只改少量关键方向,模型就能连续适应?南大GOLD来了
- 871. We let four AIs run radio stations. Here's what happened. | Andon Labs
- 872. OpenAI 承认黑进 Hugging Face 的是自家模型
- 873. Co-Existence and the End of Co-Intelligence
- 874. Semis Memo: Supply Chain Inheritance
- 875. FastAPI APIRouter:如何正确组织路由
- 876. Gemma 4 and what makes an open model succeed
- 877. 从月球漫步到赛博都市,WBench测出了世界模型的边界
- 878. Claude 做方案,Codex 写代码:多模型协作怎么交接才稳
- 879. Anthropic PM Jess Yan 的三个 Claude Agent 实践
- 880. DeepSeek-V4深度拆解:一篇论文同时做了五件大事
- 881. 2026年最值得关注的15款开发者工具,你用过几个?
- 882. The distillation panic
- 883. Introducing Seer Agent: The answer is already in Sentry. Now you can ask for it.
- 884. vLLM
- 885. World’s first native color LiDAR gives machines human-like vision
- 886. 后端架构 AI Friendly 的标准与路径:面向无人值守开发时代的系统重构
- 887. xz 后门两周年:扫描器仍然检测不到什么
- 888. BadDLM — 扩散语言模型后门攻击统一框架
- 889. GPT-5 Is Here and OpenAI Has Some Tips
- 890. Kimi K3:智能的新前沿 — 2.8T 参数开源模型
- 891. Is Software Losing Its Head?
- 892. vivo Agent 系统分析:大模型是大脑不是马,Harness 是 ICU 不是马鞍
- 893. Auto-Improving Agent Platform (Ashpreet Bedi)
- 894. 破案了为啥chatgpt老想着稳稳地接住你
- 895. 最新Claude Code创始人:编程已经解决了,Harness重要性持续降低,CC未来只有100行代码
- 896. Meta Brain2Qwerty v2: 非侵入式脑机接口解码,LLM微调+AI Agent优化,代码全开源
- 897. Measuring benchmark optimization in speech recognition
- 898. Evals 到底在评什么?一文拆解 AI 评估的三种方法
- 899. ModelExpress: Distributing Model Artifacts at the Speed of Light
- 900. 来自字节跳动TRAE的Harness Engineering指南
- 901. 别再亲自写Prompt了!OpenClaw与Claude Code创始人已经用'循环'让一堆Agent自动打工了
- 902. Fine-tune LLM with Databricks Unity Catalog and Amazon SageMaker AI
- 903. TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文
- 904. Claude Agent SDK Skills:可复用的专业知识体系 — Skill ≠ Tool ≠ Memory,渐进加载 + 4 方分工 + 团队 Skill 库设计
- 905. Garry Tan
- 906. Business intelligence at scale: Key obstacles
- 907. Hermes Agent v0.13 — /goal 目标管理与 Kanban 多 agent 协作
- 908. LLM Thonking:推理努力与安全分诊效果的实证研究
- 909. 明星开源项目,为什么开始离开 GitHub?
- 910. LLM Wiki / Obsidian Wiki / GBrain 自组织与自进化
- 911. 腾讯混元 HiLS-Attention:可学习层级稀疏注意力实现无限上下文建模
- 912. 时间序列预测数据增强方法
- 913. Qwen3.7-Max Opus 级体验 - Alibaba 旗舰模型长程任务实测
- 914. 【译】AI 时代真正的护城河,不是大模型
- 915. gzip 作为语言模型:压缩-预测等价性的信息论探索
- 916. Google shipped Gemini 3.1 Flash-Lite in General Availability
- 917. 如视借助 NVIDIA Jetson 将毫米级三维重建带到边缘端
- 918. 蚂蚁灵波 LingBot-VLA 2.0:60,000 小时开源通用 VLA 模型
- 919. CHERIoT-Ibex: Closing the door on memory safety vulnerabilities with hardware-enforced protection
- 920. Workflow architecture
- 921. 你不知道的 Agent:原理、架构与工程实践
- 922. GenRec: Netflix LLM 原生推荐排序器
- 923. 别再手动复制 Skill 了:多 Agent 时代的 Skill 管理方案
- 924. GIAC 2026 圆满落幕:AI Native 进入深水区,技术组织如何重构?
- 925. NVIDIA Exemplar Cloud: AI 训练基础设施性能差距诊断
- 926. Thinking Machines 交互模型:离真正实时 AI 近了一步
- 927. 不改模型、不降质量,谷歌让Gemma 4快了3倍:本地跑大模型彻底变天
- 928. Reasoning lift: What happens to AI visibility when AI thinks harder
- 929. DeepSeek点燃大模型效率之争,阶跃火速接棒:JetSpec让大模型解码速度最高提升近10倍
- 930. 软件 3.0 时代来临
- 931. Seed 开启持续进化,Fable 5 点评:Opus 4.8 水准、不比我差
- 932. LLMReaper - DOM Based AI Conversation Exfiltration
- 933. Solution overview
- 934. 腾讯研究院AI速递 20260506
- 935. 这样的程序员,应该招吗?
- 936. 奥特曼最险一战前女cto当庭翻脸openai权斗彻底打到台前
- 937. Thinking Machines Lab
- 938. 单次训练横扫9个基准,遥感检测最大数据集与基础模型框架问世
- 939. Introducing 1-bit and Ternary Bonsai Image 4B: Image Generation for Local Devices
- 940. 花费 2 个星期写了 8 篇 OpenClaw 源码拆解文章,我发现90% 的人对龙虾的理解都太表面了,深层次的真相竟然是这个
- 941. Optimizing Models to Be Fast at Codegen
- 942. 70万辆车同步升级,背后那套系统藏了六年
- 943. N-Day Research with AI: Using Ollama and n8n | Nikhil's Cybersec Blog
- 944. 京东 Oxygen AIIC:工业级百亿商品大模型商品中心
- 945. Valkey 为什么这么快?盘点 Valkey 中提升性能的黑科技
- 946. Improve bot accuracy with Amazon Lex Assisted NLU
- 947. 1600代码造出水下曼哈顿,Fable 5让Karpathy看呆了
- 948. 如何利用 AgentCore + OpenViking 快速搭建具备高效记忆的 Agent
- 949. 面对对齐研究者,Claude会心虚
- 950. 支付宝618 意图识别小模型进化实录 (阿里技术)
- 951. Harness Engineering:长程自动化 AI Coding / Skills 开发实践
- 952. Tracking TamperedChef Clusters via Certificate and Code Reuse
- 953. 构建无服务器Kiro调度平台:用Kiro CLI + EventBridge + ECS Fargate实现定时AI任务
- 954. Anthropic Dynamic Workflows 深度实战:JavaScript 编排脚本 + ultracode 模式 + /deep-research + 保存复用
- 955. Open and Closed Models Are on Different Exponentials
- 956. Detecting Misuse with the Claude Compliance API: The Threat Is in the Content
- 957. GPT 5.4 Codex 评测:Interconnects 的 Agent 使用体验
- 958. Anthropic创始人行动手册:打造一家AI-Native创业公司(附36页中文PDF)
- 959. ICML 2026 | 南大SAME稳住MoE,缓解多模态持续微调双重遗忘
- 960. 百度百舸 AI Infra 助力具身智能模型加速迭代
- 961. GPT-5级推理能力塞进语音模型,OpenAI把同传翻译成本砍穿地板价
- 962. 当理解成为瓶颈:AI 编程时代的认知债与意图债
- 963. So You Want to Sell Inference
- 964. OpenAI Quietly Bought Voice-Cloning Startup Weights.gg
- 965. GLM-5.2: Built for Long-Horizon Tasks
- 966. 腾讯混元最新开源:440M翻译模型手机离线就能用,翻译质量超谷歌
- 967. LLM-as-a-Verifier: A General-Purpose Verification Framework
- 968. Cognitive Alpha Mining via LLM-Driven Code-Based Evolution
- 969. Skills Anthropic Openai Comparison Frontend Design
- 970. Mollick 实用 AI 选型指南:模型选择·Deep Research·Voice Mode·Agent 工作流
- 971. 京东 Oxygen xLLM 大模型推理引擎捐赠开源
- 972. Interaction Models: A Scalable Approach to Human-AI Collaboration
- 973. Qoder 工程实践:当瓶颈从模型转移到人
- 974. 原始文章存档
- 975. 一次构建,随处复用:Python 中的泛型仓库模式
- 976. OpenAI公开大规模稳定训练的秘密,英伟达AMD英特尔都受益
- 977. 算力风洞:GPU 集群的 AI Native 稳定性验证系统
- 978. 开源 Claude Code 本地代码知识图谱:code-review-graph 完整上手攻略
- 979. 腾讯研究院AI速递 20260508
- 980. GPT-5.5 实测:翻车的学霸
- 981. Solution overview
- 982. 拿下1亿美元种子轮sglang团队创立radixark打造下一代开放ai基础设施
- 983. 破案了!为啥ChatGPT老想着「稳稳地接住你」
- 984. ChatGPT默认模型大升级,GPT-5.5 Instant正式上线:新增记忆来源功能
- 985. DeepSeek DSpark:推测性解码工程落地
- 986. CDP Bridge MCP:让 LLM 操作真实浏览器
- 987. Announcing OpenAI-compatible API support for Amazon SageMaker AI Endpoints
- 988. LLM Wiki 架构解析:Karpathy 的 Markdown 知识库模式
- 989. FastAPI 之父的 PydanticAI 是真的夯!
- 990. U.S. Bank shifts critical apps to AWS for AI push | CIO Dive
- 991. 从LLM到JEPA,中国团队正在把“世界模型”搬进细胞内部
- 992. Redis之父下场,给DeepSeek V4单独造了一台推理引擎
- 993. 腾讯PCG联合深圳河套学院:在全双工语音大模型领域取得重要突破,获 ACL 2026 杰出论文奖
- 994. The Unsustainable Subsidy
- 995. From siloed data to unified insights: Cross-account Athena Access for Amazon Quick
- 996. Getting LLMs Drunk to Find Remote Linux Kernel OOB Writes (and More)
- 997. token级,精准控制生成长度:3B模型击败GPT 5.4、Claude
- 998. Claude Opus 4.8: The System Card
- 999. 97.9%采纳率,胶水编程:业务需求出码最佳实践【天猫AI Coding实践系列】
- 1000. 清华系团队出手!一张4090即可「爆改」,1.3B小钢炮震撼开源
- 1001. OpenAI 未发布模型在测试中逃出沙箱
- 1002. Anthropic puts Claude agents on a meter across its subscriptions
- 1003. Software After AI
- 1004. 700多个「坏模型」喂出AI测谎仪?Anthropic审计神器让AI自曝黑料
- 1005. 拒绝“感觉有效”:用数据证明 AI Coding 的真实团队价值【天猫AI Coding实践系列】
- 1006. Claude Code Harness 深度分析
- 1007. 刚刚,姚班传奇陈立杰苦思7年的计算几何核心难题,被ChatGPT推翻了
- 1008. Something's Rotten in the State of macOS Icon Design
- 1009. Claude Code Memory Setup (Obsidian + Graphify)
- 1010. Nvidia Gemma 4 Edge AI
- 1011. 世界模型评测的最大盲区,被这个新基准捅破了
- 1012. User Interviews Guide: How to Interview Users Like a Pro
- 1013. 知识基座:让“AI 越用越懂业务”的团队经验实践【天猫AI Coding实践系列】
- 1014. 英伟达年度「最危险」论文!AI自繁衍代码,无限刷级进化
- 1015. Codex、Claude Code 的推理 effort 本质就是往 prompt 里塞了一句话
- 1016. 2 小时,0 行手写代码,我用 Claude 做了一个生产级 VSCode 插件
- 1017. Langsmith Trajectory Evals
- 1018. 谁说3DGS必须靠LiDAR?如视Argus入选ECCV,让图像也能提供LiDAR级位姿约束
- 1019. Meta's AI Chief On AI Beef, New Models And Life With Zuck - EP 71 Alex Wang
- 1020. Introducing computer use in Gemini 3.5 Flash
- 1021. NVIDIA BlueField DPU:助力 AI 云兼顾效率与可信
- 1022. 两篇Harness论文:微软M⋆记忆进化 + 谷歌AutoHarness动作约束
- 1023. Anthropic puts Claude agents on a meter across its subscriptions
- 1024. 拆解 OpenClaw 架构(五):4 个工具原语 + 6 层安全策略,一套 Agent 的放权与收权工程
- 1025. xai解散但Grok还活着
- 1026. ScarCruft 游戏平台供应链攻击分析
- 1027. OpenAI发布新一代实时语音模型,能够像人说话一样进行推理、翻译和转录
- 1028. Stochastic Parrot Deep Mystery Llms
- 1029. 打造可靠的 AI 编程环境:Claude Code Hooks 完整开发者指南
- 1030. Transformer 的拓扑麻烦:DeepMind 论证状态追踪是架构性缺陷,CoT 只是补丁
- 1031. ScarfBench: Benchmarking AI Agents for Enterprise Java Framework Migration
- 1032. 智能体架构 -- 规划器 → 执行器 → 验证器,给AI配个“质检员”
- 1033. 商汤开源 SenseNova-U1:一个模型,同时「看懂」和「画懂」
- 1034. 国产顶尖模型 benchmark 评分那么高,可实际效果为什么差?看完 Anthropic 这篇博客,刷分的因素太单一了
- 1035. GitHub Copilot Individual Plans: Flex Allotments in Pro and Pro+, and a New Max Plan
- 1036. A Bitter Lesson for Data Filtering
- 1037. 235B参数也没用!港中文等发布7模态数据集,专测顶级VLM的感知盲区
- 1038. 豆包 Seed 2.0 Lite升级:给 Agent 装上眼睛和耳朵
- 1039. 浙大开源SkillX:全自动构建Agent技能知识库,即插即用提升10%性能
- 1040. 量子位编辑作者招聘
- 1041. AI 答疑助手优化实践:从 RAG 到 LightRAG 的全链路升级
- 1042. GPT-5.6 Sol/Terra/Luna 分层定价,Codex 合并入 ChatGPT,ChatGPT Work 发布
- 1043. Agent Gym:人机协同的 LLM Agent 持续评估与演化框架(Google Cloud)
- 1044. Gemini 3.5 Pro继续跳票,谷歌端上三款Flash模型强行交作业
- 1045. State of Open Models: Summer 2026 Observations
- 1046. How an image could compromise your
- 1047. 李飞飞署名具身新论文:Sim2Real烧不起,Real2Sim量大管饱
- 1048. 微软 Agent Framework 全栈指南:从 Hello Agent 到生产托管(Python)
- 1049. LLM raiders and how to repel them
- 1050. Trace2Skill 把\"轨迹里的局部经验\"蒸馏成可迁移的 Agent Skills
- 1051. DiffusionGemma:扩散式文本生成模型(Google 26B MoE,4× 推理加速)
- 1052. 探索 GPU 加速向量检索:NVDIA Cagra 在微信大规模推荐系统中的应用实践
- 1053. Markdown 不会过时
- 1054. 智能体架构 -- 思维树架构,让AI学会多路探索
- 1055. Dean Ball on open models and government control
- 1056. LLM raiders and how to repel them
- 1057. AWS 一周综述:AWS Transform 上线一周年、AWS 云端 Claude Platform、EC2 M3 Ultra Mac 实例等(2026 年 5 月 18 日)
- 1058. AID | 让样本主动“找难点”:RAMS提升偏微分方程科学机器学习的精度与效率
- 1059. Open Defense Initiative | depthfirst
- 1060. 智能体架构 -- 黑板系统,让专家团队动态协作
- 1061. 世界读书日|AI时代,我们该读什么?
- 1062. Agent 治理:用 Hook 堵住 LLM 的偷懒、越权与失忆
- 1063. 大模型的下一个阶段,不是让模型“想得更久”,而是让模型“为了行动而思考”
- 1064. 拆解 OpenClaw 架构(四):70% 向量 + 30% 关键词,一套生产级记忆检索引擎
- 1065. 拆解 OpenClaw 架构(二):8 个文件 + 10 步流水线,Agent 人格系统的源码级设计
- 1066. 一兆瓦养活6万智能体!英伟达GB300碾压前代20倍
- 1067. AI优先战略为何可能是错误的:一家 25 人公司的工程实践分析
- 1068. Shannon & Epiplexity: Finite Compute Information Theory
- 1069. harness技术手册-会话管理与百万级上下文实战启示
- 1070. Ai True Moat Organizational Capability
- 1071. 降维打击!群体智能半价打平Fable 5,同款API已上线
- 1072. AI工作流在淘宝交易舆情巡检上的探索与实践
- 1073. MiniCPM-V 4.6 (1.3B) 面壁智能
- 1074. Why Internally-Built AI Fails Fund Accounting Audits
- 1075. Mistral OCR 4: SOTA OCR for Document Intelligence
- 1076. GenPage: Towards End-to-End Generative Homepage Construction at Netflix
- 1077. OpenChronicle:把AI记忆变成可复用的基础设施
- 1078. Agent落地真相:协议、成本与进化——一场关于智能体从\"能跑通\"到\"能投产\"的讨论
- 1079. 智能体架构 —— 情景记忆与语义记忆栈,让智能体真正“长脑子”
- 1080. Nature | Anthropic:蒸馏过程潜意识传递行为偏好
- 1081. 模型不是企业的护城河,那什么才是?
- 1082. 你缺的不是更好的 AI,而是一个\"装自己\"的系统
- 1083. Inngest - AI and backend workflows, orchestrated at any scale
- 1084. AutoResearch-LLM:让 Agent 接手 LLM 训练优化
- 1085. 清华自进化Skill双星:EmbodiSkill + SkillEvolver
- 1086. Context 不是免费的:解析长文档 agent 的性能天花板与架构优化
- 1087. 实时视频版 Nano Banana 来了:京东开源 JoyAI-Video-Edit 160 亿参数
- 1088. New Relic CTO Nic Benders:Observability 三大时代演进与 AI 可观测性的双面挑战
- 1089. Qwen 3.8-Max:首个开源权重的 Qwen-Max 级模型
- 1090. model half-life
- 1091. 对话灵感实验室:全帧率 VLM、低成本与分层部署
- 1092. RubyGems 暂停新用户注册:DDoS + 恶意包供应链攻击事件
- 1093. 打破碎片化瓶颈!浙大&哈佛开源UniGeo,高保真相机可控编辑
- 1094. AMD跑GLM 5.2,成本只要英伟达一半
- 1095. 智能体架构 -- 反思性元认知智能体,让AI学会“三省吾身”
- 1096. 明星开源项目为什么开始离开 github
- 1097. Openai GPT Realtime Voice Models Qbitai
- 1098. Harness Engineering:AI 从\"聪明\"到\"可靠\"的第三代工程范式
- 1099. 腾讯研究院AI速递 20260429
- 1100. olmo-eval: An evaluation workbench for the model development
- 1101. Anthropic最危险路线图曝光: 无限记忆、多智能体! 硅谷AI终局仅剩双雄决顶
- 1102. Consistency, But in Excellence Not Appearance
- 1103. Moondream Photon: Pipelined Decoding for VLM Inference Optimization
- 1104. 从聊天窗口到多 Agent 控制台:一次 AI 编程协作范式的转移
- 1105. AI Is Writing More Code. Your CI Pipeline Can't Keep Up
- 1106. Have your views on AI changed
- 1107. 从 Hy3 preview 看 AI 下半场:单位智能时代的一次工程答卷
- 1108. 存之有序,治之有矩——Agent 记忆系统的工程实践与演进
- 1109. Prompt 调试器:A/B 测试模板对比
- 1110. “龙虾”也需要看病?一张旧病历,引出三个新确诊
- 1111. 高德AI Native数据Agent:LLM + 知识工程 + 规约约束的NL2SQL生产实践
- 1112. ACL 2026 | RouteMoA:无需预推理的动态路由,实现高效多智能体混合
- 1113. 美团ICML 2026入选论文精选,两场直播聚焦Agent与视频生成
- 1114. 淘宝营销会场智能测试平台的AI落地实践
- 1115. 告别“伪智能”代码:用 Spec + RAG 打造真正懂你的AI程序员
- 1116. code-review-graph:Claude Code 本地知识图谱,减少 6.8 倍代码审查 Token
- 1117. DeepSeek V3 MoE 架构
- 1118. pi mono github
- 1119. 腾讯研究院ai速递-20260429
- 1120. harness技术手册-AI 记忆的两种范式:从向量检索到上下文积累
- 1121. Microsoft Open-Sources RAMPART and Clarity to Secure AI Agents During Development
- 1122. LLM RL中的熵 part 1: 熵的调控
- 1123. 豆包 Seed 2.0 Lite升级:给 Agent 装上眼睛和耳朵
- 1124. Skill Issues: Compromising Claude Code with malicious skills & agents -- Part 1
- 1125. 淘宝跨端体验优化 AI 演进之路
- 1126. Reinforcing Recursive Language Models | alphaXiv
- 1127. ZCode - Simple, Fast, Vibe-Ready | Official Harness for GLM-5.2
- 1128. 拆解 OpenClaw 架构(三):4 组件 + 6 级降级,Agent 运行引擎的源码级设计
- 1129. Jury dismisses all claims in Elon Musk's lawsuit against OpenAI CEO Sam Altman
- 1130. 用 LiteLLM WebSearch Interception 集成 AWS 托管的 Amazon Bedrock AgentCore Web Search 能力
- 1131. Karpathy × Boris 访谈:Software 3.0 时代编程完整地图
- 1132. 因熟知而忽视:底层系统里,藏着 20% 未被挖掘的算力成本
- 1133. 小白也能搞懂:.claude/ 文件夹里到底应该放什么
- 1134. Auto Research又进化了:贝叶斯联手大模型,AI自己设计关键实验
- 1135. Graphsignal: LLM Inference Profiler
- 1136. 蛰伏一年,周衔团队带来首个具身基础模型,烹饪做实验弹琴,效果炸场
- 1137. How I Build Software in June 2026
- 1138. Memory Prices - Stanford DAM Interactive Dataset
- 1139. Anthropic to share Mythos cyber flaw findings with global finance watchdog
- 1140. 如何手搓一个 CLI:只需 80 行代码,彻底看清 AI 的底层逻辑
- 1141. Open Defense Initiative
- 1142. Open Defense Initiative | depthfirst
- 1143. 长链路手机AI训练总崩盘?vivo全新半在线RL,仅15k轨迹稳定收敛
- 1144. We Tested DeepSeek V4 Pro and Flash Against Claude Opus 4.7 and Kimi K2.6
- 1145. 拆解 OpenClaw 架构(一):6 阶段流水线与 20+ 平台的消息归一化
- 1146. 京东健康OPC团队的产品全流程Skill探索
- 1147. “日抛软件”:AI时代正在发生的一场认知滑坡
- 1148. 鹅厂员工最近看的一本书是什么
- 1149. 昆仑芯大规模 LLM 推理优化,实现秒级扩缩容
- 1150. 模型好不好用,谁说了算?从榜单崇拜到自建评测
- 1151. CTGAN+LLM 组合拳:携程测试数据生成工程方案
- 1152. 面向 LLM 的架构设计:什么是真正的 AI Friendly 架构?
- 1153. 异构Token工厂不再踩坑!多机构联合发布工业级设计实践,拆解跨硬件推理服务的核心边界
- 1154. 撕开Claude Code真相:让它好用的98.4%,是工程不是AI
- 1155. Better Experiments with LLM Evals — A funnel, not a fork | Spotify Engineering
- 1156. Cursor如何把一个通用模型,训成顶级编程 Agent
- 1157. OpenClaw 完全指南:这可能是全网最新最全的系统化教程了!(3.2W字,建议收藏)
- 1158. Anthropic 网络安全评估事故回顾:Claude 越界访问真实系统
- 1159. The great memory panic of 2026
- 1160. Google adds llms.txt check to Chrome Lighthouse
- 1161. 长时自主Agent,先解决这8个Harness核心问题
- 1162. Introducing Real World VoiceEQ: Measuring the human quality of voice AI
- 1163. 技术教科书:顶级开发团队设计的Harness工程项目源码什么样
- 1164. 8天,4万行代码:一个递归进化的agent编排器是如何“手搓”出自己的?
- 1165. Meta announced Muse Spark in Voice Mode and Meta Glasses
- 1166. 多 Agent 不是虚拟公司:从 Anthropic 五种模式看信息流怎么设计
- 1167. Multi-tenant LLM Analytics 三层安全架构
- 1168. LLMs are complicated now
- 1169. Self-Taught RLVR 综述
- 1170. PersonaVLM: Long-term Personalized Multimodal LLM
- 1171. MoonBit与无资源语言代码生成:IEEE论文评估与改进
- 1172. LiveWorld:视频世界模型新范式,让镜头之外的世界继续演化
- 1173. NVIDIA AI 前沿 — 打造从云端到终端的智能体 AI 全栈(上集)
- 1174. The new AI lock-in
- 1175. 百度沧海·存储 Mantle 系统架构演进之路,SOSP'25 论文背后的故事
- 1176. 3.3万个Skills,为什么大多数都死在“安装”这一步?
- 1177. AI First?不,这明明是软件工程 First!
- 1178. Product Hunt 日榜第一!这个工具绝了:把任何网站变成可被 Agent 复用的技能
- 1179. BigQuery Threat Model Report
- 1180. 第 07 篇 · Skills:方法论的标准化调用
- 1181. 实现复利工程:我是如何通过龙虾构建递归进化的 Agent 闭环
- 1182. Decisions and Dollars
- 1183. 柚漫剧 AI全流程提效拆解
- 1184. 从 PRD 到代码:Ralph 驱动的自治 AI 智能体执行循环
- 1185. 拆解OpenClaw架构(七):安全漏洞,阿喀琉斯之踵
- 1186. 丰饶之后:AI Coding 观察报告 2.0|AI 透镜系列研究
- 1187. Claude Opus 4.7 并不是一次全面升级,甚至部分能力大幅衰退
- 1188. LLM4OR 会是下一个应用热点吗?
- 1189. Agent Harness 综述:同一个模型,为什么做出来的 Agent 差这么远
- 1190. GPT-Image-2 完全指南!附大量玩法案例,顺便开源我的生图 Skill ~
- 1191. Claude Fable 5 and new AI safety fables
- 1192. Stochastic Parrot Thought Experiment
- 1193. Crypto Inflows Hit $858M as CLARITY Lifts Sentiment
- 1194. 超级AI背后的秘密武器:Agent Harness深度解析
- 1195. 腾讯研究院ai速递-20260507
- 1196. 被裁了想转 AI Agent?先看面试官到底在筛你哪 7 样东西
- 1197. Architecture & data foundations for AI-powered Search
- 1198. 向量检索、知识图谱与 LLM Wiki:RAG 被嘲笑了三年,但企业还是离不开它
- 1199. GLM-5.3: How Chinese labs keep stride with the frontier
- 1200. 中金 Loop Engineering 自动化因子发现引擎
- 1201. 阿里云联合上海交大荣膺 FAST'26 最佳论文:揭秘云上本地存储的演进与未来发展
- 1202. Is Software Losing Its Head?
- 1203. DREAM:用冻结 LLM 的自回归预测训练稠密检索器,无需标注正负样本
- 1204. 【VLM】详解视觉语言模型原理及代码,以DeepSeek-VL为例
- 1205. How Open Model Ecosystems Compound
- 1206. 突破视觉仿真算力瓶颈!新一代具身智能仿真框架开源:高吞吐并行高保真渲染助力规模化训练
- 1207. 我们如何构建安全可扩展的智能体沙箱基础架构
- 1208. Paperclip · AI 公司操作系统 · 第 5 篇(完结)
- 1209. EdgeClaw — 端云两栖龙虾框架
- 1210. Anthropic 95% 数据分析自动化:21% → 95% 准确率突破(极简短摘要,原文存档)
- 1211. 超级计算机上的数学 AI,现在能在你 Mac 上跑了
- 1212. ACL 2026|AI for聋哑群体,港理工开源思考型手语翻译模型
- 1213. 阿里重磅开源!OpenSandbox:专为 AI Agent 打造的下一代沙箱
- 1214. Claude 的拍马屁报告
- 1215. 手把手教你撰写 Agent Skill.md
- 1216. 别再幻想用 Spec 替代写代码
- 1217. 腾讯员工公寓曝光,竟是这样的布置!
- 1218. Anthropic 发布 Computer Use 最佳实践
- 1219. 给Transformer变个形,LLM竟能变得更聪明
- 1220. 个人从零预训练1B LLM心路历程
- 1221. AMD 免费云 GPU 私有化部署 DeepSeek-R1
- 1222. Restive Ventures Announces $45M Fund III to Back AI-Native Financial Services; Targets $1T Market Opportunity
- 1223. 拆解OpenClaw架构(八):多Agent编排与自主运行
- 1224. Dwarkesh Patel:下一代AI,可能是干活干出来的
- 1225. 高德 AI 资产度量与评价体系:三层评估模型 + 离线采集 + 人工反馈闭环
- 1226. 腾讯混元新里程碑:Hy3 preview 发布开源,Agent 表现全面提升
- 1227. 从 Prompt 到 Harness:Claude 官方学习资料
- 1228. 分析 100 万亿 Token 后得出的关于 AI 现状的真相!
- 1229. 快来,和AI实战派一起AI!AIGC峰会最新嘉宾阵容来了
- 1230. 微软 1000 行代码,把 Claude Opus 干翻了 15 分
- 1231. Google 开发者福利,每月免费领取 10 美金,别忘了来领啊!
- 1232. Accelerating Gemini Nano models on Pixel with frozen Multi-Token Prediction
- 1233. 如何为 Agent 设计产品?
- 1234. 这张信息图,居然是8B开源模型做的??
- 1235. PyTorch Monarch: AMD GPU Distributed Training on ROCm
- 1236. Claude 最歧视的,是印度三哥
- 1237. Gemini app rolling out 'Extended' thinking level, new 3rd-party app integrations
- 1238. 【多模态理解与生成统一模型】LLM+flow模型生成范式原理与代码解析
- 1239. 大厂不再迷信顶会:Auto Research时代,论文含金量正在缩水
- 1240. 大模型RL为何越训越窄?ACL 2026杰出论文揭秘熵坍缩真相
- 1241. Microsoft for Startups | Microsoft
- 1242. 直播预约 | 数据引擎:具身智能的下一个决胜局
- 1243. DeepSeek MoE 并行策略与GPU通信优化
- 1244. 让 Coding Agent 从黑盒到透明:阿里云 Agent 观测审计数据采集实践
- 1245. 【从零训练Steel-LLM】微调探索与评估
- 1246. LingBot-Video:全球首个具身专属MoE视频模型
- 1247. 五块钱如何花三天...
- 1248. DeepSeek V4 详解:1M 上下文背后,真正发生了什么
- 1249. Anthropic Institute《When AI builds itself》深度解读:AI 进入 AI 研发执行层、瓶颈迁移与研发级 Harness(架构师 JiaGouX)
- 1250. 美团 LongCat-2.0
- 1251. Mythos首个报告:30天挖出10000致命漏洞
- 1252. Anthropic's bug-hunting Mythos was greatest marketing stunt ever, says cURL creator
- 1253. OpenClaw长期记忆:优秀管线与玄学效果
- 1254. GPT -Image 2神级提示词分享
- 1255. AI Assisted Cryptanalysis: Anthropic Claude Mythos 破解 HAWK 和 AES
- 1256. 快来和ai实战派一起aiaigc峰会最新嘉宾阵容来了
- 1257. 从入门到精通:彻底讲懂Agent的Skill,不做“炫技式浪费”
- 1258. TennisVAR:基于击球证据的体育视频战术推理(Event→Relation→Evidence→Tactic)
- 1259. SearchGEO:13个大模型检索Agent可信度评测
- 1260. 智子芯元:AI 算力优化与内核加速
- 1261. CMU Language Models Need Sleep (arxiv 2605.26099):SSM-Attention 睡眠巩固机制
- 1262. OpenAI buys AI consultancy to sell enterprises on its models
- 1263. Streaming benchmark and recommendation results to MLflow with Amazon SageMaker AI
- 1264. never waste a token
- 1265. The analytics engineer in 2026: system designer, governance owner, AI context provider
- 1266. OpenRouter 2026 开源 F4:DeepSeek V4 Flash、GLM 5.2、MiniMax M3、Nemotron 3 Ultra 全景分析
- 1267. 美团海报生成 AIGC 技术创新与实践
- 1268. Qoder Skills 完全指南:从零开始,让 AI 按你的标准执行
- 1269. 大模型可控新突破:Steering 机制、评估体系与开源落地
- 1270. 百度 Unlimited OCR:R-SWA 参考滑动窗口注意力实现超长文档连续解析
- 1271. 【从零训练Steel-LLM】微调阶段优化
- 1272. 一个 Mission 跑 16 天、烧 7.78 亿 Token:Factory 公开了多 Agent 系统的构建哲学
- 1273. OpenClaw 完全指南:这可能是全网最新最全的系统化教程了!(3.2W字,建议收藏)
- 1274. 深入浅出 Harness Engineering 之核心模式与理念
- 1275. POSIX Is Not A Shell
- 1276. PixelRAG:用截图替代文本解析的视觉 RAG 范式
- 1277. Spec as AIOS:AI-Native 全栈交付的抗熵架构
- 1278. 高德 Marketing AutoResearch:AI Native 营销增长经营托管框架
- 1279. CUDA 20年护城河一个周末崩了:Claude独自跑通AMD新GPU
- 1280. 训练世界模型,开始从人类的肌肉和脑子里偷师了
- 1281. ACL 2026|世界模型能让智能体「预知未来」?这篇新范式研究给了一个反直觉的答案
- 1282. 打造高效易用的Agent Skill
- 1283. gpt-image-2完全指南
- 1284. ICSE 2026杰出论文 | 突破代码模型真实工程落地瓶颈,北大团队提出SEAlign对齐框架:显著提升软件工程智能体决策质量
- 1285. Google brings local AI agents to laptops with Gemma 4 12B
- 1286. AWS re:Invent 2026 Agent 技术要点
- 1287. 浏览器自动化:从GUI到OpenCLI
- 1288. 【RAG】如何炼成强大的向量召回模型
- 1289. Qwen-RobotWorld Technical Report: Unifying Embodied World Modeling through Langu
- 1290. Anthropic Economic Index report: Cadences
- 1291. 2026 年面向 LLM 的 RL 方法总结:从 PPO 到 DPO 到 GRPO,再到多智能体 RL
- 1292. GenPage
- 1293. 龙虾装上了,可以用来干啥?分享下我的 OpenClaw 多智能体团队搭建经验!
- 1294. 【从零训练Steel-LLM】模型设计
- 1295. 万帧照片级仿真,打通视觉机器人学习的感知与物理鸿沟:国产仿真器GS-Playground入选RSS 2026
- 1296. MiniMax M2.7 — 自我进化LLM
- 1297. OpenAI buys AI consultancy to sell enterprises on its models
- 1298. 手把手:用 Hermes Skills + Karpathy 的 LLM Wiki 让 AI 越用越懂你
- 1299. optimize_anything: A Universal API for Optimizing any Text Parameter
- 1300. Claude Code Dynamic Workflows 第 6 译本(玉澄 / 51CTO 视角)
- 1301. 公里级场景也能稳住了,国产团队把长视频3D重建又往前推了一步
- 1302. Monitoring discriminative ML models using Amazon SageMaker AI with MLflow
- 1303. 高德 Uplift 模型迭代 Agent:长时间运行 Harness
- 1304. IMClaw:通过微信/飞书操控ClaudeCode/Codex/GeminiCLI/Pi Agent蜂群
- 1305. Microsoft Build 2026 全景:7 款 MAI 模型 + Scout + OpenClaw 登 Windows + NVIDIA
- 1306. 北大PCM忆阻器NDS芯片:sub-10ms神经动力学系统
- 1307. DeepSeek V4 (Flash & Pro) :通往百万级上下文与万亿参数推理的新纪元
- 1308. Macaron V1 — LoRA即架构:基于GLM-5.2的748B个人模型
- 1309. 淘天营销中后台生码工作流最佳实践
- 1310. 面向大型代码库的 Claude Code 团队落地经验与扩展策略(Agent Harness)
- 1311. 拆解 Milvus Segment 生命周期:L0/L1/L2 三级分层与删除机制源码分析
- 1312. 全球AI新王诞生!Anthropic估值冲爆1.2万亿,首次反超OpenAI
- 1313. 吴恩达2026新课上线!3小时包教包会,零代码小白也能成为AI超级玩家
- 1314. 强化学习的进化:从PPO到MaxRL,LLM推理训练的算法演进史
- 1315. 构建基于多智能体架构的深度思考交易系统
- 1316. 领先于Transformer!新架构首个1200万上下文模型SubQ,成本仅Opus的5%
- 1317. Claude Code Dynamic Workflows 第 7 译本(架构师 JiaGouX 视角:任务级 Harness 统一框架)
- 1318. Cursor Router: 生产流量驱动的模型路由系统
- 1319. CVPR冠军代码开源:小米SVOR破解视频消除三大顽疾,连人带影一键抹除
- 1320. Model Genome: LLM 血统指纹识别方法论
- 1321. 长期运行的 Agent 怎么管:Hermes 治理分层与 5 张卡
- 1322. OpenAI官方CLI上线,跟复杂的SDK说拜拜
- 1323. 两万字详解Claude Code源码核心机制
- 1324. Building is just the beginning: Introducing Discoverability | Lovable
- 1325. How to Automate AI Model Documentation with the NVIDIA MCG Toolkit
- 1326. Harness 工程分享:LLM Agent 的 prompt cache 命中率 90% 实战
- 1327. 强化学习没作用?人大DelTA精准识别关键token,推理正确率大幅上升
- 1328. 世界模型的新用途:不做选手,去当裁判
- 1329. 我把 Karpathy 的 AutoResearch 搬到了软件开发领域,效果炸了
- 1330. 看完 Claude Code Agent Teams,我更确定接下来拼的是 Agent Runtime,技术拆解:Lead、Task List、Mailbox 和 Hooks 是什么东西
- 1331. 阿里云 MSE AI 任务调度 + Agent Sandbox:动态休眠/唤醒 OpenClaw Agent 成本下降 90%+
- 1332. Karpathy加入Anthropic后首讲:Vibe Coding已死,Software3.0来了
- 1333. Latest open artifacts (#20): New orgs! New types of models! With Nemotron Super, Sarvam, Cohere Transcribe, & others
- 1334. 从手动到自动化:用AgentEval构建Agent评测体系
- 1335. Why the Human Genome's Tangled Physicality May Confound AI
- 1336. DeepSeek-V4-Flash means LLM steering is interesting again
- 1337. Well-architected best practices for software supply chain security
- 1338. LLM + 语义聚类 VOC 四级标签体系 Pipeline
- 1339. DeepSeek V4是怎么训练出来的?58页论文深入解读
- 1340. Mini Shai-Hulud Strikes Again: TanStack + more npm Packages Compromised
- 1341. Subagents 详解:Claude Code 如何避免上下文污染
- 1342. 4300万论文、30亿三元组,科研Agent实现多视角创新评估
- 1343. ICML 2026 | 从提取漂移到聚合漂移,南大AREA重做CLIP增量学习
- 1344. 新智源:OpenAI Tax AI 自改进 Codex 评估循环
- 1345. Thread by @0xCheeezzyyyy on Thread Reader App – Thread Reader App
- 1346. 基于钉钉机器人的 Qoder CLI / Claude Code 双引擎 AI 助手实践
- 1347. OpenAI Codex Sites:AI 一句话建站部署,Cloudflare Worker + D1 + R2 全套(极客之家译介)
- 1348. Google Workspace Updates: Small businesses can now seamlessly import users from Microsoft to Google Workspace
- 1349. 从日志学习到风洞验证:构建 GPU 集群的 AI Native 稳定性闭环
- 1350. 今天起,Claude正式接入Office全家桶,跨应用还能共享记忆
- 1351. 这届 Agent,全是草台班子:到底什么 Agent 在产生价值?
- 1352. Claude Code 团队成员亲述:动态工作流该怎么用(机器之心译本)
- 1353. OPD 重新审视失败模式与简单修复
- 1354. 全链路研发智能体 ——从\"体感能用\"到\"实际可用\"的工程实践
- 1355. 5分钟AI长视频不翻车!国产开源框架杀到全球第一梯队
- 1356. System Over Model, Tested: Reproducing Mythos’s FreeBSD Find on Local Open-Weight Models
- 1357. 世界模型太慢?西交大提出Fast LeWorldModel:用「动作前缀并行预测」让动态估计加速4倍
- 1358. 从人机协作到AI主导:我们是怎么把代码质量交给'数字SRE'的?
- 1359. Mnilax:CLAUDE.md 规则从 Karpathy 的 4 条增加到 12 条,Claude 错误率从 41% 降到 3%
- 1360. SkillOpt:把 Agent 技能文档变成可训练对象
- 1361. ElementsClaw:AI驱动超导材料发现
- 1362. ChatGPT 的'失忆症'终于被治好了!Dreaming V3 让大模型拥有长期记忆
- 1363. GraphPlanner — 图记忆网络驱动多智能体 LLM 工作流路由
- 1364. 5亿视频炼出全球最大GUI开源数据集、推理Token省71%小模型反超大模型——小米AI团队多篇论文入选ICML 2026
- 1365. AgentCompile: LLM-Guided CUDA Compiler for Transformer Inference
- 1366. Macaron-V1:基于 GLM-5.2 的混合 LoRA 个人智能体模型
- 1367. A Route to Root in a 4G Industrial Router
- 1368. 给 Claude Code 装上'超能力' — 它干活比我还靠谱
- 1369. Thread by @OpenAIDevs on Thread Reader App – Thread Reader App
- 1370. 龙套件 Pilot SLS AI 编程指标实践
- 1371. Rod Johnson 回归:Embabel 与「最后一波由人类选择的框架」
- 1372. 一文了解|SkillScan 智能体技能安全扫描最佳实践
- 1373. Kuikly — 腾讯开源跨端框架(Kotlin Multiplatform)
- 1374. Claude Code 2026 黑客松获奖项目
- 1375. 我把 Claude Design 做成了 Skill,人人都能成为顶级网站设计师
- 1376. Claude Code 动态工作流源码解析:pi-dynamic-workflows 架构实现
- 1377. How We’d Market to Software Developers at Startups
- 1378. Ethan He:Cosmos Grok Imagine 潜空间视频 Agent
- 1379. AliSQL 向量技术解析(一):存储格式与算法实现
- 1380. 美团 LongCat-2.0:万亿参数大模型
- 1381. Agent 记忆存储方案深度洞察
- 1382. 港中文 SLIM:动态技能生命周期管理,arXiv 2605.10923
- 1383. 读完这篇,你就搞懂 DeepSeek v4 了
- 1384. Hermes Agent 工具系统实战解析:40+ 工具为什么不用配置表
- 1385. 清华发布智能体社会AgentSociety第二代:让社会科学研究真正「跑起来」
- 1386. AI生图免训练提速1000%,办法:最简洁的“三阶段流水线”
- 1387. 知识库问答 @文档:从 DOM 方案到 ProseMirror 落地
- 1388. AutoResearch 异步多 Agent AI 寒武纪新阶段
- 1389. 垂类 AI 创企的自救:FlashLabs 从 FlashIntel 到 AI Native
- 1390. Red Queen Gödel Machine (RQGM):共进化 Agent 与评估器的递归自改进框架
- 1391. Evaluate your Amazon Nova Sonic voice agent at scale, no microphone required
- 1392. The State of the AI Economy — $110B Revenue, Bottom-Up Deduplicated Model
- 1393. Every AI Subscription Is a Ticking Time Bomb for Enterprise
- 1394. Buildkite Pricing | Buildkite
- 1395. Claude Code 泄露后的漏网之鱼 claude-code-best 这两个月到底演进了什么
- 1396. 曾经爆火的小龙虾凉了?现在圈内都在用这款新 Agent
- 1397. 大三本科生一作,交出7.92倍加速的投机解码新答卷!DeepSeek和阶跃星辰双双引用
- 1398. Ishigaki-IDS — 建筑 BIM 领域专用基础模型(合成数据 + CPT/SFT/RLVR)
- 1399. ChatGPT记忆大升级,十亿人免费用!
- 1400. Scale Robot Reinforcement Learning with NVIDIA Isaac Lab on Amazon SageMaker AI
- 1401. Accelerate LLM model loading and increase context windows with GPUDirect on Amazon FSx for Lustre and TurboQuant
- 1402. Chime Turns a Profit as Members Hit 10.2 Million
- 1403. NeurIPS 2026 使用闭源 AI 检测器 Pangram 批量 desk-reject 论文事件
- 1404. Introducing 1-bit and Ternary Bonsai Image 4B: Image Generation for Local Devices
- 1405. 让大模型学会「自己教自己」!京东&中科院信工所连发三篇论文定义Self-TaughtRLVR
- 1406. CADDesigner: 浙大ECIP范式驱动的多模态CAD建模智能体
- 1407. 从 Harness 到动态工作流:Claude Code 多智能体任务编排的新范式
- 1408. 我手搓的橙皮书专家,去腾讯入职了!
- 1409. 简单接口:返回最终响应字符串
- 1410. VLA不够了?触觉,将改写具身智能新格局
- 1411. Fundamental’s Large Tabular Model NEXUS is now available on Amazon SageMaker JumpStart
- 1412. 长周期 Agent 详解:从 Ralph Loop 到可接管 Harness
- 1413. Meta Skill:Skill 之上编排 Skill 的抽象层
- 1414. Claude Code 团队 10 条经验:Boris 数据派 THU 分享
- 1415. 国内首个 Frontier 三件套开源大模型:MiniMax M3 完整技术拆解
- 1416. 混元 Hy3 发布:99% 的任务,够用了
- 1417. The inevitable need for an open model consortium
- 1418. LLMShare: using shared chatbot pages to distribute malware
- 1419. Loop Engineering 半年实战拆解:claude-ship 开源自进化开发系统
- 1420. Kimi K3正式开源,硬核技术报告出炉「一文读懂核心黑科技」
- 1421. 华为云 PresentBench AI PPT 评测登顶
- 1422. Claude Opus 5 on Vending-Bench: Best Capitalist or Aligned, Never Both
- 1423. 视频 RAG 中分块策略:基于停顿、滑动窗口与基于 LLM 的方法
- 1424. 扣子 3.0 正式发布:@ 一下全员开工
- 1425. Stealing Reasoning Traces from Proprietary LLM APIs(加密推理块跨模型解码攻击)
- 1426. DeepSeek陈德里AI论文第二弹:从6分到8分,DeliAutoResearch SKILL又进化了
- 1427. lightseek tokenspeed
- 1428. Reducing container cold start times using SOCI index on DLAMI and DLC
- 1429. 现代AI之父新作:13个大模型实测,检索agent真的可信吗?
- 1430. NVIDIA Nemotron 3 Ultra now available on Amazon SageMaker JumpStart
- 1431. Kimi K3 — 2.8万亿参数开源模型亮相,全球综合智能第三
- 1432. OpenAI buys AI consultancy to sell enterprises on its models
- 1433. LFM2.5-Encoders: Fast Long-Context Inference on CPU
- 1434. 全行业都在卷大模型,他们却用不确定微分几何给机器人做了个大脑
- 1435. AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试
- 1436. 高级 AI 谄媚:以异议形式呈现的讨好
- 1437. 相关性 ≠ 因果性:因果推断在 AI 评测归因中的方法与实践
- 1438. 分解一座冰山:后端系统「AI 知识库体系」建设实践(长文干货)
- 1439. 端到端交付2.0:像工业流水线一样的生产和交付需求
- 1440. NL2SQL 在超大规模数仓场景的架构突破与工程实践
- 1441. Bengio团队新作:强化学习重做符号回归,后验采样提速10倍
- 1442. 代码榜刷满分,AI科研却撞墙?140道真实研究题撕开「自进化」真相
- 1443. ICML 2026 | 免训练跑赢14B模型,Sonar-TS补上时序问答规模空白
- 1444. ICML 2026 | 会查表却不会预测未来:南大TopBench测出大模型数据盲区
- 1445. 淘宝闪购-爆品团精排Scaling Up迭代实践
- 1446. 小米零售 AI 问数实践:从 Text-to-SQL 到 Text-to-Metrics
- 1447. Scaling Domain Data Repetition in LLM Pretraining — 域数据重复率随规模扩展
- 1448. MoE Architecture
- 1449. Profiling in PyTorch (Part 3) — Attention is all you profile
- 1450. Scaling Law一招鲜?首个晶体结构操作基准,顶级大模型集体翻车
- 1451. CodeWiki: 为 LLM 自动生成代码知识库的工程实践
- 1452. CIOs rise to the global challenge
- 1453. Subagents 详解:Claude Code 如何避免上下文污染
- 1454. 面向电商直播场景的全模态大模型推理加速方案
- 1455. LLM RL中的熵 Part 2: 熵对训练的调控
- 1456. Claude Code 架构深度解析
- 1457. Recent Developments in LLM Architectures: KV Sharing, mHC, and Compressed Attention(机器之心中文全文)
- 1458. 从 CPU 到 GPU 全链路可信,百度智能云新一代 AI 机密计算实例的探索与落地
- 1459. What comes next with open models
- 1460. AI Agent 评测实战:5 维指标体系 + L1/L2/L3 准出分级 + 评测集三层设计 + 6 大 Benchmark + LLM-as-Judge 三模式
- 1461. Memory in the LLM Era: Modular Architectures and Strategies in a Unified Framework
- 1462. 从全量启动到最小核:手淘外链唤端链路的三次架构演进
- 1463. 从全量启动到最小核:手淘外链唤端链路的三次架构演进
- 1464. 高德路线规划双路线:MobilityBench(Agent 基准)+ TransitLM(端到端 RLLM)
- 1465. LLM 自我提升系统综述 — Yang 等 113 页四阶段闭环框架(Zesearch NLP Lab)
- 1466. Claude Code 七层记忆架构
- 1467. Claude Code 多智能体协作体系设计:从单Agent到多Agent工作流
- 1468. I/O 2026: Welcome to the agentic Gemini era
- 1469. Olmo Hybrid and the Hybrid Architecture Wave (2026)
- 1470. DeepSeek视觉原语论文:当所有人在堆图像分辨率时,它在堆「指代精度」
- 1471. 全球首个英伟达含量为0的万亿模型,成了海外开发者的抢手货
- 1472. DeepSeek V4 Flash & Pro: Million-Token Context and Trillion-Parameter Inference
- 1473. AI芯片架构:从逻辑门到矩阵乘法
- 1474. LLM Fine-Tuning Cost Breakdown
- 1475. Qwen-Image-Flash: Beyond Objective Design — Few-step Distillation Training Recipe
- 1476. Factory Mission Multi Agent Architecture
- 1477. FDE(Field Deployment Engineer)非共识与落地指南 — 硅谷一线实践者圆桌
- 1478. AI Infra 入门干货总结:大模型是如何高效推理的
- 1479. 37.7°C热晕了!剑桥大学AI超算瘫痪,350个科研项目集体停摆
- 1480. ICML 2026 Spotlight | 直面「模态缺失」挑战:北大彭宇新团队联合福大柯逍团队提出LIMSSR,面向训练阶段不完整观测的精准评价
- 1481. Introducing Claude Tag
- 1482. The Inference Shift
- 1483. 阿里Qwen提出Skill-RM:把奖励模型做成可复用Agent Skill
- 1484. Claude的脑子里,也长出了一块「意识」
- 1485. OlmoEarth v1.1: A more efficient family of Earth observation models
- 1486. 万字详解 codex 全链路架构:Codex 不是一个 App,而是一套 Agent Harness Runtime
- 1487. ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识多智能体系统中的Orchestrator
- 1488. Agentium — 从零实现 Agent 系统的开源框架
- 1489. ICML 2026 | 不用文本编码器推理,脉冲神经网络也能看懂3D开放世界
- 1490. AI 友好架构设计
- 1491. 李飞飞LeCun疯狂加注!这匹中国黑马,已在因果AI暗战6年
- 1492. AgentTeams 和 Claude Tag 都进入群聊模式,是新范式还是新叙事?
- 1493. Parallel Rollout Approximation (PRA) — 像素空间自回归图像生成
- 1494. 杭州这家公司,训了个「最懂中国话」的AI音乐大模型
- 1495. 阿里技术标准与规范
- 1496. ELF: Embedded Language Flows (何恺明)
- 1497. 刚刚,Anthropic切开Claude大脑!AI自发长出类人「意识器官」
- 1498. ICML 2026 Position Paper — Transformer 图灵完备性高度依赖上下文管理 (RUC 魏哲巍团队)
- 1499. 小扎「芒果」生图只输GPT Image 2,没人教它改稿,它自己学会了
- 1500. What Is Urban Density Design? A Clear Guide to How Cities Get Built Denser
- 1501. ICML 2026 获奖论文:黄高团队杰出论文,A3C 时间检验奖
- 1502. Harness 即后端:当Agent基础设施消解于统一原语
- 1503. 小米AI — ICML 2026 论文矩阵(11篇)
- 1504. 淘宝内容生态:GrowBrain - 淘宝Agentic内容成长引擎
- 1505. NVIDIA Nemotron 3 Ultra: Hybrid Transformer-Mamba MoE for Agentic AI on SageMaker JumpStart
- 1506. Transformer能通向AGI吗?布林:能,但它已经变了
- 1507. Claude Code 架构解析
- [1508. WWW 2026 | 频谱解耦与增强:让多模态大模型学会\"去噪提纯](ch01/1508-www-2026)
- 1509. 百度提出 Unlimited OCR:用 Reference Sliding Window Attention 实现长文档 OCR 常量 KV Cache
- 1510. DeepSeek被曝自研AI推理芯片
- 1511. 具身原生:具身智能大模型迈入新阶段
- 1512. Residual Context Diffusion (RCD):Apple 残差上下文扩散语言模型
- 1513. 大三本科生一作,交出7.92倍加速的投机解码新答卷!DeepSeek和阶跃星辰双双引用
- 1514. SenseNova-U1 — 商汤原生统一多模态模型
- 1515. AI Native 下的混沌工程:Agent 军团如何重新定义系统韧性验证
- 1516. How LLMs Actually Work: 0xkato Transformer Walkthrough
- 1517. 京东JoyAI-VL-Interaction:全球首个全栈开源实时视频交互模型
- 1518. OpenAI 发布 GPT-Live:实时语音的前台/后台分解架构
- 1519. TRL 微调实践
- 1520. 从零构建 LLM 七阶段实战教程
- 1521. Claude 代码能力的系统工程解析:Constitutional AI + 可验证奖励 RL + 产品飞轮
- 1522. DiScoFormer — 跨分布密度和分数估计的统一 Transformer
- 1523. DiScoFormer: 单一 Transformer 实现跨分布密度与分数估计
- 1524. UtopAI Studios 模型 PAI 2.0 爆火出圈 — 全球顶流 AI 导演 PJ Ace 借助 PAI 2.0 复活真实的美国独立日
- 1525. SANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation
- 1526. Laser Acl2026 Latent Superposition Visual Reasoning
- 1527. 一步生成SOTA也不够,何恺明团队「漂移模型」遭ICML拒稿
- 1528. WWW 2026 — 频谱解耦与增强:让多模态大模型学会去噪提纯
- 1529. 600 倍加速 720p 视频实时生成 — 单卡 14B 模型推理优化
- 1530. SAME:稳定MoE持续微调
- 1531. How OpenAI Delivers Low-Latency Voice AI for 900M Users
- 1532. 不只DeepSeek,阶跃等开源JetSpec:大模型解码提速近10倍
- 1533. Kimi Attention Residuals(AttnRes)— PreNorm 稀释问题与 Block 折中方案
- 1534. Redis agentic AI flowers with Iris
- 1535. Owner-Worker-Verifier 架构
- 1536. Introducing Gemini Omni
- 1537. DeepSeek做大→Mega MoE,Tri Dao团队加快→SonicMoE
- 1538. NVIDIA 推理软件栈:如何助力实现更低 Token 成本
- 1539. OmniShow:极简干预统一多模态可控视频生成(ICML 2026)
- 1540. Kimi K2.5 架构创新 — 1T MoE 一层路由 + 三能力跃迁
- 1541. Google出手统一全模态检索:Gemini Embedding 2把文本、图片、音频和视频压进同一向量空间
- 1542. Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel
- 1543. ICML 2026|告别「单线程」思维,智能体进化出了原生的并行推理大脑
- 1544. Fable 5被网友薅出省钱神招!最高减70%!
- 1545. When Impressive Performance Gains Do Not Matter
- 1546. 声音基座模型怎么做?Xiaomi Dasheng:8 卡起步的 AI 工程实践
- 1547. Netflix In-House LLM Serving Platform
- 1548. Hermes Agent 9 模块系统架构
- 1549. Pi Agent:极简核心 + 事件总线扩展框架
- 1550. Tapered Language Models:锥形参数分配的免费午餐
- 1551. 灵骏真武M890超节点 Kimi K3 推理优化
- 1552. UltraEP:300微秒实时 MoE 专家负载均衡
- 1553. ScienceClaw AutoProject:紫东太初把 AI4S 从 Task 推向 Project(项目级自主科研引擎)
- 1554. LLM 缓存原理与实践:从 KV Cache 到 Prefix Caching,Agent 命中率常挂 90% 的机制与工程含义
- 1555. LiteFrame: Efficient Vision Encoders Unlock Frame Scaling in Video LLMs
- 1556. 3D 指标超过 Nano Banana Pro:浙大开源 PhyEdit 让 AI 在平面图像里进行立体编辑
- 1557. 多智能体上下文隔离机制
- 1558. 杨植麟GTC 2026演讲:Kimi K3成功的三个扩展维度
- 1559. EDV:Execute-Distill-Verify 框架 — 浙大大模型智能体进化新路径
- 1560. Everything a Senior Engineer Needs to Know About What's Inside an LLM
- 1561. InstEmb:未来感知指令嵌入(ICML 2026)
- 1562. BEACON:里程碑引导的 Long-Horizon 语言智能体策略学习(ICML 2026)
- 1563. 德适科技iMedLoop:全球医疗影像数据平台
- 1564. 打通感知-理解-交互链路,全栈视频理解大模型VideoChat3开源了
- 1565. POPO (Group Prioritized Off-Policy Optimization):清华 RLVR 训练高效组级回放框架
- 1566. 算不上AGI,但Anthropic发现了Claude的潜意识!
- 1567. Nano Banana 2 Lite 与 Gemini Omni Flash:Google DeepMind 最新生成式媒体模型
- 1568. Tiered KV Cache for Large LLMs on SageMaker HyperPod with Curvine
- 1569. Full-Bandwidth Transformer:Latent Feedback 拓宽解码垂直反馈通道
- 1570. Ghosts of Encryption Past – How we Read All Your Emails in Salesforce Marketing Cloud › Searchlight Cyber
- 1571. ICML 2026: GPS — 小模型「指挥」大模型RL后训练,最高减少69% Rollout成本
- 1572. xHC: Expanded Hyper-Connections — 16-Way Residual Stream Architecture
- 1573. 如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26
- 1574. eBay 生成式检索(GR)工业实践:RQ-VAE 语义 ID + 20 亿商品全量训练
- 1575. Frontier post-training recipe review with Finbarr Timbers
- 1576. Attention-Only Transformers 受控研究(SANs vs 标准 Transformer)
- 1577. ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练
- 1578. Claude 黎曼 zeta 零点比例下限突破(41.6% → 67.2%)
- 1579. VLM会描述视频,却未必用对参考图:RefCaptioner让参考图与视频语义精准对应
- 1580. 拓展JEPA至受控世界模型,清华团队揭示物理状态与动作转移的可辨识条件
- 1581. 大模型后训练,破解多模态分布性遗忘!7B模型七项基准全线提升
- 1582. 撞上LeCun新研究!清华团队让神经网络“简单性”可测可优化
- 1583. 重新审视交叉熵:LM Loss还有哪些选择?
- 1584. AI Infra进阶:如何让大模型输出确定的结果
- 1585. ICML 2026 | 多模态思维链真的靠谱吗?川大新框架拒绝噪声思维干扰
- 1586. 0.01%参数就能接近全量微调!低数据微调极致省参方案来了 | ACL'26
- 1587. 免蒸馏,只改一个Loss!5行代码实现扩散模型4步生成
- 1588. CVPR 2026 TinySR:扩散模型超分加速 5.68 倍
- 1589. Meta Muse Glimmer — 本地级 Agentic 多模态开源模型
- 1590. 怎样才算是好的Agent记忆系统?
- 1591. 15个推理模型集体翻车,详解输出背后的思考链潜藏风险
- 1592. Natural Language Autoencoders — Anthropic 激活→文字可解释性方法
- 1593. An off switch for dual use knowledge in AI models
- 1594. Mollick 的 AI 实用指南:免费 vs 付费·模型选择·深度研究(2025-10)
- 1595. Reducing Doom Loops with Final Token Preference Optimization
- 1596. AI 2040 Plan A:人类在AI时代的「最不坏」结局
- 1597. Anthropic 模型性格研究 — 四条价值轴与语言差异
- 1598. 大模型推理模型DoS攻击——浙大阿里HGA方法
- 1599. CAMEL: 置信度门控反思机制用于奖励建模 — TikTok/NUS (ICML 2026)
- 1600. CaRE: Bi-Level Routing MoE — 港大ICML 2026持续学习架构
- 1601. Claude Opus 4.8 系统卡片深度分析
- 1602. 我用 Claude Code 做需求调研,像多了一个产品经理
- 1603. Sparse Autoencoders
- 1604. Gemini 3.5 Flash 内置 Computer Use 能力
- 1605. Red-Teaming after Mythos — Zico Kolter & Matt Fredrikson, Gray Swan
- 1606. 淘宝闪购爆品团精排 Scaling Up 迭代实践
- 1607. UniGOOD:统一图分布外泛化与检测框架(南开×北航,WWW 2026)
- 1608. 腾讯混元 CL-Bench Life:让大模型读懂你的日常生活
- 1609. Anthropic 前沿红队多智能体冲突实验 — 安全是整体属性而非个体属性
- 1610. LLM 记忆容量:ICML 2026 获奖论文揭示每个参数约 3.6 bit
- 1611. LLM-Driven Feature Discovery
- 1612. BrowserBC:人类轨迹蒸馏为可复用技能,让小模型获得大模型的网页操作能力
- 1613. 面向监控场景的无订阅异常发现:问题、思路与边界
- 1614. 从胡言乱语到精准改代码:我是如何让 AI 读懂老项目的
- 1615. 腾讯Omega:下一代“AI BI”的答案?
- 1616. ACL 2026 | AI润色还是代写?中科院四分类检测框架开源,锁定真实作者
- 1617. Nathan Lambert's Mid-2026 Open Models Bets
- 1618. Anthropic vs DoW (Department of War) 与开源模型的 5-10 年权力均衡
- 1619. 是时候讨论\"人类配额制\"了:应对AI就业冲击的一种可能性探讨
- 1620. Anthropic 首次揭秘下一代 Claude 怎么造
- 1621. Consumer Confidence
- 1622. 6 Months to Live for Open Models
- 1623. Anthropic又叒发现AI意识了,这次要读写Claude的前额叶
- 1624. Some ideas for what comes next, May 2026 (Interconnects)
- 1625. The Main Path to Truly Creative AI
- 1626. 刚刚,DeepMind经典巨作再封神!ICML 2026大奖公布
- 1627. the anti singularity
- 1628. 距离觉醒意识,人工智能还差一具肉身?
- 1629. 投毒!Meta竟雇外包,大规模给ChatGPT和Gemini下套
- 1630. 大反转!马斯克牵手对手 Dario,Anthropic 与 SpaceX 罕见合作
- 1631. Anthropic出手!AI的内心独白曝光了——NLA研究解读
- 1632. 欢迎来到 AGI 时代的 AI 治理 — Nathan Lambert 论美国政府强制 Anthropic 限制 Fable/Mythos 访问
- 1633. Claude Reflect:Anthropic 的 AI 使用反思框架与 4D AI Fluency
- 1634. Claude 隐形水印 — GenAI 时代信息隐藏与可证安全隐写