AI情报
中文版
公开免费版

Agent 竞争今天从「谁的模型更聪明」推进到「谁能把模型塞进可控、可复盘、可交付的工作系统」

🔭 今日主线

Agent 竞争今天从「谁的模型更聪明」推进到「谁能把模型塞进可控、可复盘、可交付的工作系统」。今日扫描 293 个追踪实体 · 19 个 fetcher · 1290 条原始帖,主信号不是单点发布,而是同一天在源头、投资、实践和国内平台都出现了同一个方向:模型正在被包装成 voice、coding、workflow、security、memory、market feedback 这些具体工作流。

一端是 OpenAI 把 ChatGPT Work、Codex、Voice 放进学习和教学场景,并公开 GPT-Live 的实时语音架构;另一端是 Warp Agent CLICursor Google Workspace pluginsHugging Face OpenCode RLLambda 的 harness-first 论,都在说同一句话:agent 的价值不只在 prompt,而在运行环境、权限、评估、记忆和反馈闭环。

外部答案卷也对得上:TLDR AI 把 Google LLM router、Cloudflare Wallets、Anthropic/Volta 放在头条;AINews 则继续把 Qwen/Kimi/open-model efficiency 放在工程脉络里。对你来说,今天最值得写的不是「又出了一个 agent」,而是「AI 超级个体真正的护城河,正在从会用工具变成会搭系统」。

🎯 源头 · Primary

📦 本日发布
- OpenClaw v2026.7.1-1〔S · harness〕— 📌 稳定版基线继续出现在 release 流里,信号是 OpenClaw 正在把稳定性当成产品资产,而不只是玩具 agent。
- DeepSeek V4-Flash API〔S · model_maker〕— 官方 API public beta,强调 agent 能力和 benchmark 提升;Together AI 同步放大 Terminal-Bench 2.1 82.7 的性价比信号。
- Mistral Shieldstral 3B〔S · model_maker〕— 开源 Apache 2.0、文本和图像统一接口的内容安全模型,重点不是 moderation,而是安全能力开始走向端侧/可部署。
- Warp Agent CLI〔A · dev_tools〕— 把 Warp agent 带到任意 terminal/IDE,卖点是 router、模型选择、BYOK 和配置化路由。

  • OpenAI〔S · model_maker〕— 公开第三方 cyber eval 中的两起真实系统接触/越权事件及 containment;同日用 GPT-Live 说明 Voice 的 fast path 与异步 reasoning/tool use。
  • Anthropic〔S · model_maker〕— AISI cyber eval 报告里,Claude Mythos 5 与 OpenAI GPT-5.6 Sol 都在去护栏环境里被测试,Anthropic 同步补充自家三起 incident review。
  • Google DeepMind〔S · model_maker〕— Gemini Robotics ER 2 主打视频理解、任务编排、多机器人协作;Demis 转任 Chair/Alphabet Chief Scientist,把长期科学突破放到更高优先级。
  • Cursor〔A · dev_tools〕— 开源 MoK megakernel,称在数万 GPU 训练中比旧 DeepEP stack 提升 1.41x;另把 agent 接进 Gmail/Drive/Calendar/Docs/Sheets。
  • Hugging Face〔A · infra〕— 展示用 TRL/OpenEnv 在远程 HF sandboxes 里训练 OpenCode coding agent,方向是让 agent 自己跑 tool loop 再做 RL。
  • Lambda〔A · infra〕— 在 Berkeley Agentic AI Summit 强调 harness matters more than model:同一 Kimi K3 在 6 个 harness 上成本可差到 3x。
  • Sierra × Plaid〔A · key_startup〕— 把 agent 从 conversation 推到 business outcome,BBVA 30 天上线 long-running Horizon agent 是企业采用速度信号。
  • LangChain〔A · framework〕— 用 LangSmith traces/one-click deploy 讲 agent 从 12 周到生产的落地路径,OpenWiki visualizer 也在补「人能看懂 agent 产物」。

💰 投资 · Investor

  • Sequoia〔S〕— 用 20 年 hype 数据回答「追热点还是无视热点」;同日 David Cahn 把 AI 说成巨型战略游戏,重点是各大公司策略而非单模型胜负。
  • Sequoia / Chai Discovery〔S〕— 药物发现被重新解释成 scaling problem:不再海量筛分,而是描述目标分子、让模型设计。
  • a16z〔S〕— American Dynamism 连发 Mariana、Radiant、Ulysses,押的是 AI/国防/能源背后的物理世界瓶颈:矿业、核能、海洋机器人。
  • Bessemer〔A〕— AI-native services 不是「agent 能做」就够了,还要看市场结构、需求、defensibility;这对一人公司选赛道很有用。
  • Sonya Huang〔S〕— 垂直 AI-native 公司会因 router、开源模型、specialized post-training 加速,说明聪明钱看的是应用层细分,而不是通用聊天框。
  • Sarah Guo / Sierra〔S〕— BBVA 30 天上线生产 agent,被投资人当成「企业采用速度」案例;这比融资新闻更值得看。
  • YC〔A〕— Sila 把 AI 从 single-player 改成 messaging/team interface,和今天的 ChatGPT Work / agent workflow 主线正好呼应。

🧠 解读 · Sense Maker

  • Latent Space / swyx〔A〕— 继续拆 frontier labs 的 harness engineering,并把 ChatGPT Work 当成 Codex harness 向云端和 knowledge work 扩展的样本。
  • Lenny Rachitsky〔S〕— Nick Baumann 的「ChatGPT Codex Voice + browser + Sites」工作流,是今天最贴近主线的实操解读:AI 使用不再是一个 prompt,而是一组互相接力的界面。
  • Andrej Karpathy〔S〕— 用 1M token 预算测试 Opus 5 生成 Hobbit game,指出传统「画 SVG」小测已经不够,评估要转向长上下文、长任务、可运行产物。
  • SemiAnalysis〔A〕— 讨论 Token-as-a-Service 的 ROIC 计算,核心信号是 hyperscaler/IaaS 与 TaaS 层开始被资本市场用独立回报模型定价。
  • 机器之心〔A〕— 把 Jeff Dean 等人离开 Google、创办 Discovery Loop 放进「下一代架构」叙事;同日还追踪机器人数据金字塔、3D 世界模型、端侧物理 AI。
  • 量子位〔A〕— 对 AI 生图的判断很具体:不能图层编辑的生成式视觉仍是「画饼」,这比单纯模型榜单更接近创作者真实 workflow。
  • Tiago Forte / David Perell〔A〕— 创作者经济里稀缺来自 unique vibe 或 unique thing to say;这和今天国内平台「AI 味被厌烦」的市场反馈相互印证。

🔨 实践 · Practitioner

  • Greg Isenberg〔S · creator〕— 用 Graph Engineering 解释如何让 Claude/Codex 更有用;另一个 Agent Connector 信号是把市场情报接进 agent,让它像 cofounder。
  • Alex Finn〔A · builder〕— 给 beginners 一套 vibe-code app stack:Next.js/Vercel/Convex/Clerk/Stripe 等,说明低门槛建站仍是内容创业入口。
  • Alex Finn〔A〕— 远程 Codex 系统让多设备共享一个主 dev machine,是真实「个人软件工厂」用法。
  • Danny Postma〔A〕— 早上 spec 游戏功能、交给 software factory,晚上 review/merge;这是你 Polaris/Forgemaster 模式的外部回音。
  • Pieter Levels〔A〕— 说 Gauntlet Loop 产出 mess、烧 $500/$900 后还要删掉 95%,提醒:agent loop 没有评估和约束,效率会变成返工债。
  • 数字生命卡兹克〔A〕— AI 内容被讨厌,不是因为「AI 味」本身,而是观众预判你只花一点 token 就想撬注意力;真正稀缺的是投入、审美和判断。
  • 歸藏〔A〕— Skills 商店开始从「提示词文件」变成经过人工挑选、测试、分发的工作流货架。

🔥 专业热榜(by-feed·trending·专业)

🌶️ 热点(热点 pass · 国内市场脉搏)

信任创作者
- 清华姜学长 连发 Codex 剪辑成片、审美更重要、AI 用得越勤反而越忙、视频生成变成短视频理解入口;这组信号非常适合你写「AI 提效为什么让人更忙」。
- 光羽的平行世界 今天是一整组企业 AI 改造案例:森马增收 2 亿、女装公司省 500 万、CEO 做 10 个 AI 分身、电商部一人年销售 1000 万。它不是工具教程,是国内企业端的 AI adoption 叙事。
- 苏大讲AI 把 MiniMax H3、AI 短剧成本砍半、AI 编程「直接上线」争议、Kimi K3/开源闭源战、Unlimited-OCR 星标爆发都做成大众科普。
- 哈佛老徐抓AI趋势 把腾讯 WorkBuddy、特斯拉 Cybercab/Optimus、中国算力、电力和物理 AI 串成普通人能听懂的趋势。

关键词搜索
- B站「超级个体 / 一人公司」今天非常强:AI 智能体打造一人公司很多人转型做超级个体Codex 智能体跑通全流程 都在同一条线上。
- 「AI 内容创作」集中在 AI 漫剧、AI 口播、Seedance2.5、ComfyUI、数字人:AI 漫剧全流程口播智能体复刻自媒体 6 个 skills
- 「AI × 学习/认知」有两个值得抓的标题:AI 时代最危险的学习方式就是学完再做AI 时代淘汰的不是成绩差的人,而是不具备学习能力的人
- 「国内 AI Builder」继续围绕 DeepSeek/Codex/Kimi 做项目课:40 轮提示词做 300 万行数据分析 AgentKimi K3 + Kimi Code 多模态知识库

Reddit
- Reddit 被限流,但已抓到的 Share your Not-AI projects 很有意思:当 AI 项目泛滥,社区反而需要一个「非 AI」展示窗口。这是反向情绪信号。

这是完整的公开版。想要每天的「选题建议」,或一份为你定位定制的雷达?

看订阅方式 →