AI情报
中文版
公开免费版

Agent 正在从“会聊/会写代码”进入“能接设备、能改流程、能自我修正”的生产化阶段

🔭 主线

Agent 正在从“会聊/会写代码”进入“能接设备、能改流程、能自我修正”的生产化阶段;与此同时,中文平台正在把同一波技术包装成“普通人也能获得掌控感”的教程和模板。

今日专业侧扫描 1,036 条原始信号,压缩为 584 条语义候选 + 356 条信任召回;viral 侧抓取 624 条 raw / 572 条候选。两边合起来看,主线不是某个模型发布,而是 agent operating loop 的成形:Anthropic 把 Claude 往真实硬件推,Warp/Lambda/论文圈在把 agent 经验写回 workflow 和 skills,a16z 用 11 亿美元 Machine Age Fund 押注芯片、内存、网络、系统软件和物理机器;中文平台则用 Codex/Claude Code/Vibe Coding 教程证明,市场真正买单的是“我也能上手”的确定性。

对你最重要的动作,不是追每一个模型名,而是把内容雷达、写作流、产品流都做成能留痕、能反馈、能复盘、能进化的系统。技术侧的 self-improving agent 和平台侧的“零基础教程爆款”,本质上在讲同一件事:AI 的价值从单次输出,迁移到可重复运行的工作流。

🎯 源头

  • Anthropic 发布 Model Hardware Standard 研究预览,让 Claude 类 agent 通过统一接口操作实验室和制造设备;官方 X 把它定位为安全操作物理设备的标准。
  • Google DeepMind 推 Gemini Omni 1.1 Flash,重点是视频生成/编辑的可控性;Gemini 3.5 Transcribe 则把转录往实时内容理解推进。
  • Z.ai 开放 GLM-5.3 权重,强调 agentic coding 和 cyber defense;vLLM 同日给出支持,参数规模 744B、40B active、1M context。
  • Qwen 预览 Qwen3.8-Flash,称其是 Qwen4 架构早期预览;OpenRouter 与 QwenCloud 同步上架,价格明显打到应用层。
  • NVIDIA 开始交付 Vera CPU,并用 NVHBM 扩展 NVLink Fusion,算力叙事从 GPU 转向整机、内存、互联。
  • Warp 公开 self-improvement loops:用会话评分、失败隔离、Skill PR,把 agent 的经验沉淀回工作流;Lambda 也在写 AgentFlow。
  • Perplexity 发布 Portable Computer,把 orchestrator、subagent、harness 都放到 NVIDIA DGX Spark 本地运行。

💰 投资

  • a16z 宣布 Machine Age Fund,规模 11 亿美元,投向 chips、memory、networking、systems software、power 和 physical machines;这和 Anthropic MHS / NVIDIA Vera 是同一条线:AI 的瓶颈开始下沉到物理栈。
  • Khosla Ventures 继续押 recursive self-improvement,认为 DiscoLoopAI 这类“自我改进”公司可能是下一阶段关键机会。
  • YC 的 Outset 案例把 AI interviews 做成新类别;这类垂直工作流公司比“模型壳”更接近真实价值捕获。
  • Conviction 提到多位 portfolio founder 进入 TIME100 AI,投资圈注意力仍集中在 frontier + 应用公司创始人本身。

🧠 解读

  • TLDR AI 把 Gemini Omni 1.1、Cohere Parse、Codex persistent mode 放在同一天 headline,说明“可控生成 + 文档解析 + 持久工作状态”正在合流。
  • The Rundown AI 把 Anthropic MHS 解读为 agents 进入真实机器世界;机器之心 直接称它是“物理 MCP”。
  • Lenny 记录 Ryan Carson 一个月花 2 万美元用 Devin 的经验,核心不是“贵”,而是 agent 成本必须用业务闭环衡量。
  • 36氪 把两家 AI 巨头吞掉全球新增算力作为焦点,提醒你:模型竞争背后其实是算力采购权、供应链和资本纪律。
  • 机器之心 写 Harness Continual Learning,把持续学习从模型参数转向 agent harness;这正好对应今天的 self-improving agent 主线。

🔨 实践

  • Ben Holmes 说团队几天内合并了 5 个 self-improvement PR,其中一个抓到了 message passing 的 token burn;这是“agent 经验进 Git”的真实工作法。
  • Xudong Han 拆 Warp 的做法:人类给反馈,Improver Agent 定期整理失败模式,改 Skill 并走 PR review。
  • Replit 推 Intelligent Model Routing,让系统按任务自动选模型,应用层开始把“选模型”从用户决策变成运行时决策。
  • Vercel 展示一分钟部署 eve agent;LangChain 则强调 Box 选择 Deep Agents 的原因是模型无关与迭代速度。
  • Jerry Liu 提到 static embeddings 的速度/成本优势和长文本精度问题,适合做“便宜但够用”的系统分层判断。

🔥 专业热榜

  • Hacker News 把 GLM-5.3 open-weight 推上前排,开源大模型仍是专业社区最敏感的信号。
  • Hugging Face Papers 出现 PILOT in the Loop:长程 agent 的 live self-improvement;PapersCool 同时出现 WikiSkill,把 agent 经验编译成持久知识。
  • Hugging Face Papers 的 VoiceMem 关注实时交互里的 streaming dual-brain memory,和 Claude memory / Codex persistent mode 同频。
  • Product Hunt 上 Gemini Omni 1.1 Flash 热度靠前,说明视频生成的“可控性”比纯画质更容易变成 builder 需求。
  • GitHub trending 的 awesome-gpt-image-2、scientific-agent-skills 都指向一个方向:能力爆发后,用户需要可复用范式与技能库。

🌶️ 爆款盘点

  • Douyin · 武侠打斗 AI 提示词〔短视频|2546 万赞|平台 pct 100|AI 内容创作〕:最高热度不是“AI 能做视频”,而是“我把可复用提示词直接送你”。爆点在福利感 + 结果画面 + 模板领取,内容门槛低,转发/收藏动机强。
  • Douyin · Hy4 Preview / workbuddy 免费长任务〔图文|107 万赞|pct 99|新模型/工具〕:新模型借“免费可用 + 补齐 Hy3 短上下文痛点”出圈。它把技术发布翻译成一个明确用户收益:跑长任务不容易乱。
  • Douyin · 12 分钟入门 Claude Code〔长教程短视频|17.1 万赞|pct 98|AI Builder〕:安装、绕登录、接国产模型、VSCode 可视化,一条视频解决“开始用”的所有摩擦。Crossover: 这条和 Codex persistent mode / Warp skills 属同一主线,平台侧给出的是大众化包装。
  • Douyin · Codex 零基础教程第 2 期〔教程短视频|15.3 万赞|pct 97|一人公司〕:Codex 被大众内容化,关键词是“零基础 + 保姆级 + 系列化”。
  • Douyin · Vibe Coding 0 到 1 做软件〔长教程短视频|15 万赞|pct 96|大众情绪〕:核心钩子是“不会代码的人,真的能做软件吗?” 它卖的不是技术,是能力身份跃迁。
  • Rednote · 13 岁满级小孩用 AI 接百万商单〔图文|5.46 万赞|pct 100|AI 创业〕:年龄反差 + 百万商单 + AI 杠杆,三重冲突直接拉满传播。
  • Rednote · 1 小时吃透一个行业〔图文|2.89 万赞|pct 99|AI 学习/认知〕:爆点在“知识库 + 时间压缩”,非常贴认知型创作者的学习焦虑。
  • Bilibili · 比 Cursor 好用 10 倍的 AI 工具〔长视频|1.2 万播放|pct 100|AI Builder〕:B站高位信号仍然吃“工具替代 + 项目管理”这种强功利标题。

这是完整的公开版。想要每天的「选题建议」,或一份为你定位定制的雷达?

看订阅方式 →