AI情报
中文版
公开免费版

Agent 栈今天从“更聪明”转向“更可运营”:OpenAI 把速度和长期上下文补上,Claude 把浏览器会话接进统一工作区

🔭 今日主线

Agent 栈今天从“更聪明”转向“更可运营”:OpenAI 把速度和长期上下文补上,Claude 把浏览器会话接进统一工作区,DeepSeek/Cursor/Vercel 把 harness、生产修复、模型路由做成工程系统。

今日扫描 321 个追踪实体 · 25 个 fetcher · 1202 条语义候选。最强的线不是某个单点模型,而是“长期任务的操作系统”正在成形:GPT-5.6 Sol Ultrafast 把高质量模型推到最高 750 tokens/s,Computer History 让 ChatGPT 桌面端记住跨 app 工作流,Claude in Chrome 把浏览器动作纳入同一个 Claude 会话。另一边,DeepSeek HarnessVercel AI Gateway coding-agents setupCursor 收 Firetiger 都在解决同一个问题:agent 不是聊天框,是要能记忆、调用、验证、修复、持续运行的系统。

两张外部答案卷也支持这条主线:AINews 把 Gemini 3.7 Flash、GPT-5.6 Sol、Grok 4.6、Qwen3.8-Max 串成“编码/工作流/agentic”竞赛;TLDR AI 直接把 Gemini 3.7、GPT-5.6 Sol Ultrafast、Anthropic IPO 放到同一天头条。对你有用的判断是:内容创业者不需要再追“哪个模型赢”,要追“哪个工作流能把内容、代码、分发、复盘闭环跑起来”。

🎯 源头 · Primary

📦 本日发布:

  • OpenClaw v2026.8.1-beta.2 — 新增 shared-store secret 的目标 host 绑定,CLI/Gateway RPC/Control UI 都在明文出站前 fail closed;这是 agent 系统进入“权限有边界”的信号。

  • OpenClaw stable v2026.7.1-2 — 当前稳定版基线,修 npm plugin metadata singleton-array 兼容。

  • Ollama v0.32.14 — llama-server 支持 WebP 转码,Qwen renderer 容忍非开头 system messages。

模型/产品源头:

  • OpenAI〔S · model_maker〕— GPT-5.6 Sol Ultrafast preview 由 Cerebras 驱动,官方给到最高 14x、750 output tokens/s;安全调查工作流从 1–2 小时压到 10–15 分钟,是“高质量模型也要实时化”的明确动作。

  • OpenAI〔S · model_maker〕— ChatGPT desktop 推 Computer History,可记住跨 app/网站活动,并提供 timeline、清除、排除 app、暂停等控制;这比普通 memory 更接近个人工作流黑匣子。

  • Google DeepMind〔S · model_maker〕— Gemini 3.7 Flash 强调 coding、web layout、知识工作和业务工作流提升,已进 Gemini API、AI Studio、Android Studio、Antigravity。

  • Anthropic〔S · model_maker〕— 解释 Claude 文本水印:为了 EU AI Act 合规,声称不影响输出质量;这会把“AI 内容可识别性”从争论推向基础设施。

  • Claude〔A · key_startup〕— Chrome side panel 与桌面/web/mobile 共用 Claude Cowork 会话,skills/connectors 可随浏览器动作延续;同时提醒 hidden page instruction 风险。

  • DeepSeek〔S · model_maker〕— V4-Pro 发布,主打 agent 升级、reasoning effort 分档、1M context、OpenAI Responses API 兼容,并被 Hugging Face 收录为 trending model。

  • DeepSeek〔S · model_maker〕— Harness v0.1 developer preview 开源,核心口号是 Everything is a plugin;这和 OpenClaw/Codex/Claude Code 的“技能 + 工具 + 会话”方向正面交汇。

  • Qwen〔S · model_maker〕— Qwen3.8-27B / FP8 / GGUF 在 Hugging Face 高热,社区强调 laptop-size、17GB 左右即可本地跑;小模型继续压缩个人 agent 的本地部署门槛。

  • Cursor〔A · dev_tools〕— 宣布加入 SpaceXAI,目标是一起改进 Grok、Grok Build、Grok Bot、Grok API、Cursor;同时 Firetiger 加入 Cursor,方向是让代码 agent 跟到生产并修复故障。

  • Vercel〔A · dev_tools〕— AI Gateway 新增 coding-agents setup,一条命令配置 8 种 coding harness、300+ 模型、30+ provider;agent harness 的模型路由正在产品化。

  • CoreWeave〔A · infra〕— 把 Production AI Factory 写成生命周期:goodput、可靠性、NVIDIA Vera Rubin NVL72 readiness;算力公司也在用“factory”叙事卖运营能力。

  • SambaNova〔A · infra〕— 明确说 agent 会反复 plan/tool/context/generate,因此速度变成产品体验的一部分;premium inference 从 infra 指标变成用户价值。

💰 投资 · Investor

  • a16z〔S · VC〕— 用 Cursor + SpaceXAI 案例强调“fastest iterating team wins”;投资层在押注的不是 IDE,而是高速度组织。

  • Benchmark〔S · VC〕— 祝贺 Cursor 并把 SpaceXAI 合并视为推动 Grok/Cursor 前沿的机会;聪明钱继续把 coding agent 当作 AI 应用层核心入口。

  • Bessemer〔A · VC〕— Agentic Awakening 访谈 20+ AI-pilled 工程团队,结论是工程快了接近 10x,但组织吞吐只涨不到 50%,真正瓶颈在 operating model。

  • Sequoia〔S · VC〕— 提出 Experience Gap:AI 还没扩散到所有知识工作,不是 intelligence 不够,而是缺行业经验、上下文和落地路径。

  • Sarah Wang〔A · investor〕— 用“AGI finally here for the consumer”概括消费 AI 转折;结合 Cursor/Grok/Computer History,看的是 AI 从专业工具流入普通工作日。

🧠 解读 · Sense Maker

  • 36氪 — 把 DeepSeek Harness 解读为“杀死 Agent 黑箱”:边界、插件、运行时改写比单纯 prompt 更重要。

  • 机器之心 — 追 DeepSeek Harness 背后论文,关键词是 agent 在运行中改写自己;这和“技能库/插件生态/自进化”同线。

  • 机器之心 — 斯坦福/MIT 发布全球最大系统提示词库;提示词正在从经验贴变成可比较、可审计的数据集。

  • Lenny — OpenAI Head of Design 说这是设计师最好的时代;在今天的语境里,设计师价值从画界面转向设计 agent 可控体验。

  • The Information — 同时谈 Anthropic 高层、人事和 OpenAI CRO 离职;商业化组织调整正在追赶模型/产品速度。

  • 36氪机器之心 — 都在写 Anthropic 2 万亿美元 IPO/高速收入叙事,说明资本市场已经把 frontier lab 当新一代平台公司定价。

  • Tiago Forte — 分享 smarter AI workflow;不是“让 AI 写更多”,而是把个人知识系统接进工作流。

  • Paul Graham — 观察 YC 申请里 single founders 更多,原因可能是 AI 让一个人能做更多;这直接击中一人公司叙事。

🔨 实践 · Practitioner

  • Greg Isenberg — 给“什么适合做 AI agent”五步测试:重复触发、稳定输入、明确工具、可定义成功、可从小自动化开始;这是内容创业者做内部 agent 的筛选表。

  • Greg Isenberg — 列 agent idea:onboarding rescue、pricing page agent 等,切口都围绕“关闭小循环”;适合一人公司从运营痛点反推产品。

  • Peter Yang — 访谈 Riley 如何用 Codex 跑内容业务,核心判断是“长期质量才是 moat”;这比自动发帖更贴近你的内容飞轮。

  • Jozef Wallis — 写 one-person companies:AI 让小团队也能 build + grow serious business;但真正难的是把获客、交付、运营系统化。

  • Every — 讲 always-on AI employee 需要的不只是 system prompt,还要安全、上下文和工作边界;这和 OpenClaw/DeepSeek Harness 是同一实践命题。

  • jxnl — 说 Codex 已经在 OpenAI 内部做 assistant video editor;内容生产中的“剪辑/解释/复盘”开始进入 agent 工作流。

  • Simon Willison — 记录 Qwen3.8-27B 默认 extra-high reasoning 会“过度思考”;本地模型可用,但默认推理档位会影响体验和成本。

  • dotey — 发现 ChatGPT Pro 能基于代码库改代码、提交 PR;普通用户侧的 coding workflow 正在从 IDE 扩散到 ChatGPT 本体。

🔥 专业热榜

  • MiniMax-H3 登 Hugging Face 热榜高位,image-text-to-video 方向继续升温。

  • Qwen3.8-27BFP8GGUF 同时热,说明“本地可跑的强模型”是今天社区最实用的模型信号。

  • DeepSeek-V4-Pro-0813 进 HF trending,和官方 agent 升级叙事互相验证。

  • DarwinXAutoDesignSkillZip 三篇都在讲 harness/skill/meta-optimization;研究侧也开始把 agent 系统当可进化对象。

  • HN: Claude System Prompts 热度最高;系统提示词公开/版本化正在变成 AI 产品透明度的一部分。

  • HN: The AI Credit Resale Economy 关注 AI credit 转售经济;模型套利已经从 API pricing 进入灰色商业层。

  • GitHub: cordiverse/cordis 与 DeepSeek Harness 的 Cordis meta-framework 呼应;插件化 agent runtime 不只是发布会词汇。

👥 我的 feeds

  • LinkedIn solopreneur post — 算法流推来一个清晰痛点:solopreneur 不是缺 idea,而是缺把 idea 变成持续输出/销售/交付的系统。

  • Peter Yang — Riley 用 Codex 跑内容业务,算法把“内容公司 agent 化”推到你面前,这是高相关信号。

  • William Hanson — AI stack 变复杂反而利好 transformation 服务;你可以卖的不是工具清单,而是判断和系统搭建。

  • High Capacity — 中国 hidden AI economy:transfer stations、AI anxiety、deepfakes;中文市场需求里“焦虑/套利/身份伪造”仍是暗流。

  • Anson Tan — 一个 prompt 生成 20 个 Alpha、成本 $0.92;金融/量化内容侧继续把“低成本批量探索”当卖点。

  • Damian Player — Anthropic 免费 24 分钟 Claude prompting workshop 被算法推到教育流;基础课仍有需求,但需要更高阶的 workflow 包装。

🌶️ 热点

🔥 平台爆款话题:

  • DeepSeek Harness 在中文侧不是“又一个框架”,而是“插件生态 + B站传播 + 技术大佬二次元头像”的文化事件。向阳乔木 写到 DSH 两小时破万 star、两天接近 9 万;歸藏 已经在做界面/交互美化插件。

  • 国产强模型实测进入内容平台:AI超元域 用 5 元开发 5 个复杂项目测试 DeepSeek V4 Pro;清华姜学长 讲 GPT-5.6 模型组合怎么配置。

  • “Agent 入门教程”仍然爆:秋芝2046 的桌面 Agent 教程、豆包 Agent 入门Codex 40 分钟教程 都是高互动信号。

  • 创作者增长侧有硬素材:歸藏 用 Codex 分析 Twitter 开源推荐算法,总结“原创、转发、回复/引用、垂类一致性”比点赞更关键。

  • AI 生产力的企业案例在中文平台继续有效:光羽 讲森马 AI 变革增收 2 亿,女装公司省 500 万 是更适合普通老板理解的版本。

👤 对标账号在讲什么:

  • 秋芝2046 把“桌面 Agent 帮你干活”做成教程爆款;这说明中文用户要的不是模型新闻,而是可跟做路径。

  • 清华姜学长 把 Codex 安装前的注意事项拆成入门内容;你的差异化可以在“工具选择背后的系统判断”。

  • 光羽 讲 CEO 做 10 个 AI 分身;这和你的“外部执行功能/超级个体系统”高度同频。

  • 苏大讲AI 把 GLM5.3 和批量漏洞发现、安全赛道洗牌挂钩;国产模型叙事正在从“能聊天”转为“能做专业活”。

🌱 中文弱信号:

  • DSH 插件生态里,B站 UP 主成为早期贡献者/传播节点;对开源 agent 项目来说,B站可能是中文开发者生态的增长渠道,不只是内容平台。

  • “99 美元拿下 Grok Harvey + Cursor Ultra + Grok Bot + Twitter Premium+”这类教程开始出现,说明模型订阅套利会成为中文 AI 工具内容的高传播题材,但容易滑向价格党。

  • “资产沉淀与复用”开始替代“追新模型”成为设计/内容工作流关键词;这更接近你要讲的系统化,而不是工具测评。

这是完整的公开版。想要每天的「选题建议」,或一份为你定位定制的雷达?

看订阅方式 →