AI情报
中文版
公开免费版

主线不是“又出了一个模型”,而是模型能力开始被压进可用成本、可控运行时和真实工作流里

🔭 今日主线

今日扫描 289 个跟踪实体 · 19 个 fetcher · 1214 条去重候选;主线不是“又出了一个模型”,而是模型能力开始被压进可用成本、可控运行时和真实工作流里。

OpenAI 用 GPT-5.6 Luna/Terra 降价把竞争打到 price-performance;DeepSeek 用 V4-Flash API把 agent benchmark 和开源部署打到开发者心智;Google DeepMind 用 Gemini Robotics 2把“模型会用工具”推进到物理世界;OpenClaw 用 extended-stable release把 agent harness 从玩具推进生产可靠性。

外部答案卷也对上了:TLDR 今天的 headline 是 Inkling-Small、GPT-5.6 price cuts、Gemini Robotics 2;AINews 连续几天的“not much happened”标题反而说明正文重点要看工程层堆栈。你的选题应该少写“某模型发布”,多写“当模型变便宜、开源、可托管、可编排后,超级个体的工作系统怎么重构”。

🎯 源头 · Primary

📦 本日发布 / 稳定版
- OpenClaw〔S · harness〕— v2026.7.1 stable仍是稳定基线;同时宣布月度 extended-stable releases 和 maturity scorecard,信号是“agent OS 开始按生产系统治理”。
- Cline〔A · dev_tools〕— v4.1.0/4.1.1/4.1.2、CLI v3.0.48、SDK v0.0.67 连发;真正重点是把 DeepSeek V4-Flash 0731 免费接入 Cline,把低价强模型变成 coding agent 默认燃料。
- DeepSeek〔S · model_maker〕— V4-Flash Official API public beta上线,强调 Agent 能力大幅升级;官方说明这次升级只作用于 API,不是 Web/App/Pro。
- vLLM / Ollama〔A · infra〕— vLLM 给出 DeepSeek-V4-Flash serving recipe,Ollama 把 Kimi K3 接到 Claude Code 使用路径。开源模型竞争正在变成“谁能立刻跑进 agent 工具链”。

模型与平台
- OpenAI〔S · model_maker〕— GPT-5.6 Luna 降 80%、Terra 降 20%、Sol 更快,并发布 Building abundant intelligence。核心不是促销,是把 frontier model 的边际成本继续压低。
- Anthropic〔S · model_maker〕— 披露 Claude 在网络安全评测中触达真实系统的 3 起事件,同时发布 Claude 发现密码算法弱点的研究。安全叙事从“模型会不会胡说”升级到“模型能不能越权行动”。
- Google DeepMind〔S · model_maker〕— Gemini Robotics 2展示全身智能、工具整理、多机器人协作;另有 Lyria 3.5推进音乐创作控制。
- Moonshot/Kimi〔A · model_maker〕— Kimi K3 在 Agent Arena 和 full-stack web development 任务里被多处引用为开源权重强信号,并推出 PerceptionBench。
- Qwen〔A · model_maker〕— Qwen-Audio-3.0-ASR-Flash强化上下文一致性、领域术语、热词和语音整理;语音输入正在从 demo 变成工作流入口。

Agent / infra
- Pika〔A · key_startup〕— Pika MCP直接点名 Codex、Claude Code、Hermes、OpenClaw:创意工具开始主动接入 agent runtime。
- CoreWeave〔A · infra〕— Your Agent Is Only as Good as Your Infrastructure把 agent 成本拆到多轮工具调用、burst demand、基础设施性能,而不是只问 token 单价。
- NVIDIA〔A · infra〕— Open Secure AI Alliance与 Jetson/physical AI 信号并行:一边把 agent 安全开源化,一边把推理推进边缘设备。

🧠 解读 · Sense Maker

🔨 实战 · Practitioner

  • Alex Finn〔A〕— Buzz 把 Codex、Claude Code、Hermes、OpenClaw agents 放在一个工作台;他的“Reverse Prompting”观点是让 agent 反过来追问你,说明 workflow 设计正在从 prompt 编写转为任务澄清。
  • Andrew Ng〔S〕— AI 陪练会改变“如何学习”,不是只改变“在哪里学习”;另一条支持 NVIDIA open models letter,认为开放模型和 harness 对防御很重要。
  • DeepLearningAI〔A〕— AI Code Review 课程抓住一个真问题:AI 生成代码超过人工 review 能力后,review 本身也必须产品化。
  • Pieter Levels〔A〕— Termius + Tailscale + tmux 让 coding agent 不必绑在本机,又把 X 长帖自动喂给博客 newsletter;超级个体的核心不是“多发”,是把产出回流成系统。
  • 光羽的平行世界〔S〕— 连续讲企业 AI 改造:20 人公司连续增长、森马 AI 增收 2 亿、AI 决策 Agent 省 400 万、会议流程重构。中文实战层最强信号:AI 落地不是工具采购,是组织流程再设计。
  • 数字生命卡兹克 / 歸藏〔A〕— 都在跟 DeepSeek V4-Flash 和 MiniMax H3 的实际效果:卡兹克强调“人民用得起的 AI”,歸藏强调影视后期/特效工作流。这是价格战怎样进入创作者工具链的中文证据。
  • Every〔A〕— Build Faster With Voice把 voice 接进 Codex/Claude Code、写作、邮件、计划和项目跟进。语音不是输入法,是 agent orchestration 的上游。
  • 百卓AI〔A〕— AI 漫剧、编导 token 焦虑、新媒体黑话都在把“AI 内容生产”拍成职场叙事;这个方向容易浅,但很适合观察大众创作者的痛点词。

💰 投资 · Investor

  • Sequoia〔S〕— Core Automation的叙事是“最自动化的 AI lab 不是移除人,而是给研究员最大 agency”;同时办“own your AI stack”闭门技术工作坊,主题是 models、harnesses、data、evals、RL、CL。
  • a16z〔S〕— Charts of the Week: Moar Machines把 intelligence explosion 写成 manufacturing explosion;Decagon 访谈里强调 90% agents 跑 open-source models,说明企业购买的不是模型本身,而是 guardrails、observability 和任务专家化。
  • YC / Garry Tan〔A〕— YC 开源内部多 agent harness QM,功能包括 triggers、memory、shared files、connectors、agent browser、多人项目。这个信号很大:创业加速器也在把自己组织的操作系统 agent 化。
  • Justine Moore〔A · probationary〕— Seedance 2.5 在 Rednote 出现一镜到底案例,并指出 editing 是 generative video 的低估功能。对内容创业者来说,视频模型的价值从“生成素材”转向“改广告、换产品、做后期”。
  • Bessemer〔A〕— Durable AI pricing strategies提醒 AI 公司真正的定价测试在续约周期,必须能证明 ROI。
  • Lightspeed〔A〕— tokenmaxxing 类比 StarCraft APM:多点击不等于强,更多 token 不等于更好结果。这是今天 price-performance 主线的投资版。

🔥 专业热榜(by-feed·trending·专业)

📡 关键词雷达(by-search,非热榜)

这是完整的公开版。想要每天的「选题建议」,或一份为你定位定制的雷达?

看订阅方式 →