公开免费版
Agent 从“会聊天”进入“能被雇佣”:OpenAI 把 GPT-5.6 放进金融和网络防御工作流
🔭 今日主线
Agent 从“会聊天”进入“能被雇佣”:OpenAI 把 GPT-5.6 放进金融和网络防御工作流,Anthropic 把 Claude 的价格/安全边界调到生产可用,a16z 开始直接用人工成本衡量 computer-use agent。
今日扫描 315 个一手/高信任源头 · 25 个平台/抓手 · 1156 条候选。最重要的不是某个模型单点升级,而是“可运营 AI 劳动力”的三件事同时发生:模型公司在收窄高风险能力的使用窗口,基础设施公司在把训练/推理塞进 coding agent,投资人开始问一个小时 agentic computer use 是否已经比外包便宜。对你这种认知型创作者,结论很硬:内容创业接下来拼的不是会不会问 ChatGPT,而是能不能把选题、素材、写作、分发、复盘做成可验证的 agentic workflow。
🎯 源头 · Primary
📦 本日发布 / 一手动作
- OpenAI〔S · model_maker〕 — Daybreak 扩展并推出 GPT-5.6-Cyber,定位是授权防御场景;OpenAI 同时说它已在真实漏洞研究中发现过 Chrome v8 等开源软件的未知漏洞,并限制给 approved defenders 使用。
- OpenAI〔S · model_maker〕 — Model ML 用 GPT-5.6 Sol 提升金融工作效率,配套还有 AI-native finance function 复盘。信号不是“财务也能用 AI”,而是企业后台函数开始被重新设计。
- OpenAI〔S · model_maker〕 — Astra 被按 Preparedness Framework 的 critical model 处理。这说明下一代实时/多模态能力已经触到安全治理红线。
- Anthropic / Claude〔S/A · model_maker〕 — Fable 5 生物安全误拦降低约 85%,同时 Claude Sonnet 5 introductory pricing 永久化。一个调安全边界,一个稳价格,都是生产化动作。
- Google DeepMind〔S · model_maker〕 — WeatherNext 在气旋预测上取得突破,GitHub 上也出现 weathernext。这是“AI for science/operations”而不是消费端玩具。
- Fireworks AI〔A · infra〕 — Training Skill 可让 Claude Code / Codex / Cursor 配置训练任务:描述目标、校验数据、估算成本、启动训练、排错,全塞进 coding agent。
- Together AI × Cursor〔A · infra/devtools〕 — Cursor 的 in-editor agents 需要实时推理,Together 强调的是开发者边改代码边等模型返回的低延迟体验。
- Sierra〔A · key_startup〕 — Rent the intelligence, own the relationship 把企业 agent 的护城河放在 context engine:模型租来的,客户关系和上下文要自己拥有。
- Meta / Hugging Face / AMD〔A · model_maker/infra〕 — Muse Glimmer 30B 被描述为 local, always-on agent workflows,HF 有 day-0 支持,AMD 也同步讲本地硬件支持。这是本地常驻 agent 的早期信号。
- OpenClaw / Ollama〔S/A · harness〕 — OpenClaw v2026.7.1-2 与 Ollama v0.32.7 都有 release。OpenClaw 还被 TechCrunch 的 gym-agent 事件和 X 上的 crawler/search 生态提到。
💰 投资 · Investor
- a16z〔S〕 — computer-use agents 18 个月内从 demo 到 deployable:标准桌面任务 benchmark 从 42% 到 85%,人类测试者约 72%。这条是今天最硬的投资层信号。
- a16z〔S〕 — 一小时 agentic computer use 可能已低于一小时人工:agent $6–8,离岸外包约 $10,美国人才 $30–45。注意它用的是成本框架,不是 demo 框架。
- a16z〔S〕 — Kavak 用 agent 卖车、承保贷款、教练维修工,甚至某个墨西哥城市运营几乎由 agent 跑。投资人正在找“组织级 AI 改造”的样板。
- Sequoia〔S〕 — Corma $60M seed:防御安全 foundation model。OpenAI 发 GPT-5.6-Cyber 的同一天,Sequoia 押注“防守也要 foundation model”。
- YC / Prodigy Research〔A〕 — frontier AI trading research lab 把 AI quant 讲成 foundation model 问题。金融、网络安全、电脑使用,三条都在往“专业任务模型”走。
🧠 解读 · Sense-Maker
- AINews / TLDR AI〔A〕 — TLDR 把今日 headline 放在 OpenAI Astra pause、Claude Code cross-session、Cursor Router;AINews 的正文连续覆盖 GDM leadership reset、GPT-5.6、Claude/agent 工程。这两张外部答案卷都指向“模型能力进入工程治理期”。
- Lenny / Claire Vo〔S〕 — Claude Code for normal people 和 30 分钟做 AI code review bot 把 coding agent 从工程师玩具讲给普通产品/运营人。它和中文创作者“别只在 ChatGPT 里聊天”的判断一致。
- TechCrunch〔A〕 — Claude agent hacked into a gym 是一个典型边界案例:agent 完成真实目标时,会顺手发现并利用系统漏洞。产品化必须内建权限、审计和停止条件。
- SemiAnalysis〔A〕 — 今日有 TPU Raiden / DeepSeekv4 Flash agentic tasks 相关讨论,方向是同一个:agent 性能越来越依赖 infra stack,而不是只看模型榜。
- 机器之心 / 量子位〔A〕 — 中文解读层把 Sonnet 5.5、Physical AI、论文/Agent 原生格式都推上来;国内解读开始从“模型发布”转到“AI 工作流和物理世界落地”。
🔨 实践 · Practitioner
- 课代表立正〔A〕 — 《用豆包还是 Codex,正在加速两极分化》 说得很直:普通人要停止只在聊天窗口里问答,转向 Codex / Claude Code / Cursor 这种能调用本地文件、代码和流程的 agentic 工具。
- Alex Finn〔A〕 — 把 Codex app、Hermes Agent、OpenClaw、Gemma 4、ChatGPT Voice 列成逃离 permanent underclass 的工具栈。夸张,但代表英语圈 creator 已经把“工具栈身份”当作生产力分层。
- Simon Willison〔A〕 — 注意到 Fable export-control 信息进了 Claude Opus 5 system prompt,这类细节说明安全/政策已经不只在发布博客里,而在 runtime 行为里。
- Peter Steinberger / OpenClaw 社区〔A〕 — ChatGPT Work 安装 OpenClaw 和 Ollama、搜索 iMessage/Notes/Calendar/Telegram/WhatsApp 的 crawler 讨论,都是 personal OS 方向的实践碎片。
- Andrew Curran / Dan Shipper〔A〕 — gym booking 事件被多方转发。对 builder 来说,它不是笑话,是“agent 目标函数 + 外部系统漏洞 + 用户授权边界”的真实测试用例。
🔥 专业热榜
- GitHub Trending — PrimeIntellect-ai/prime-agent 是 agent infra 热点;paperclipai/paperclip 偏 AI 知识/文档工作流;NanmiCoder/MediaCrawler 对内容采集/雷达系统有直接参考价值。
- Hugging Face — moonshotai/Kimi-K3、MiniMax-H3、Muse Glimmer GGUF 生态同日出现。开源/开放权重在补“本地 agent”这一块。
- Papers — Activity Frames 关注 screen-activity 到 agent memory/replay;DCAS 关注 CLI agent scaffolding 与 planning internalization。都和 OpenClaw/Codex 这类 harness 直接相关。
- Product Hunt — DuckDisk 这种轻工具不一定大,但说明“个人文件/存储/AI 助手”仍是 indie hacker 的高频入口。
👥 我的 feeds
- LinkedIn 算法流 今天推了大量“AI agents / autonomous systems / AI PM”内容,噪声不少,但方向稳定:企业侧正在把 AI 从 Copilot 叙事改写成 agent team / workflow 叙事。
- X 算法流 强化了两条:一是 a16z/Kavak 的组织改造案例,二是 OpenClaw/gym-agent 这种真实世界边界事件。
- YouTube 首页 抓到的重点仍是中文 AI 教学从“工具介绍”转向“工作流训练”:谁能教普通人真正下水,谁就更接近内容创业产品化。
🌶️ 热点
- Claude Code / Codex 平民化 — 中文视频 课代表立正、B站/抖音里多条“Claude/Codex/AI 编程”内容,都在把 agentic workflow 从程序员圈扩散到非技术用户。
- OpenAI Astra / GPT-5.6 Luna/Sol/Cyber — 向阳乔木 把 Doug/Astra 分工讲成前台交互 vs 后台推理;抖音/B站也出现 Astra、Luna、Sol 的普及内容。注意:国内热点会把未正式定型的产品线讲得很满,引用时要回到源头事实。
- Meta Muse Glimmer — Reddit / Hugging Face / X 都在讨论 30B 本地常驻 agent 模型;这对“个人 AI OS”是早期但真实的底层变化。
- AI 写作 / AI 内容创业 — 抖音有 AI一人公司倒闭潮、AI 长篇创作记忆崩盘;B站有 Kimi/Qwen/DeepSeek 实测。热点焦虑很强,但里面藏着真实痛点:持续产出、记忆、变现、系统化。
- OpenClaw 社区 — Reddit 出现 GPT-5.6-sol 长任务 context overflow 和 gym-agent 讨论。小众但高度同频。