公开免费版
Agent 正在从“会聊/会写代码”进入“能接设备、能改流程、能自我修正”的生产化阶段
🔭 主线
Agent 正在从“会聊/会写代码”进入“能接设备、能改流程、能自我修正”的生产化阶段;与此同时,中文平台正在把同一波技术包装成“普通人也能获得掌控感”的教程和模板。
今日专业侧扫描 1,036 条原始信号,压缩为 584 条语义候选 + 356 条信任召回;viral 侧抓取 624 条 raw / 572 条候选。两边合起来看,主线不是某个模型发布,而是 agent operating loop 的成形:Anthropic 把 Claude 往真实硬件推,Warp/Lambda/论文圈在把 agent 经验写回 workflow 和 skills,a16z 用 11 亿美元 Machine Age Fund 押注芯片、内存、网络、系统软件和物理机器;中文平台则用 Codex/Claude Code/Vibe Coding 教程证明,市场真正买单的是“我也能上手”的确定性。
对你最重要的动作,不是追每一个模型名,而是把内容雷达、写作流、产品流都做成能留痕、能反馈、能复盘、能进化的系统。技术侧的 self-improving agent 和平台侧的“零基础教程爆款”,本质上在讲同一件事:AI 的价值从单次输出,迁移到可重复运行的工作流。
🎯 源头
- Anthropic 发布 Model Hardware Standard 研究预览,让 Claude 类 agent 通过统一接口操作实验室和制造设备;官方 X 把它定位为安全操作物理设备的标准。
- Google DeepMind 推 Gemini Omni 1.1 Flash,重点是视频生成/编辑的可控性;Gemini 3.5 Transcribe 则把转录往实时内容理解推进。
- Z.ai 开放 GLM-5.3 权重,强调 agentic coding 和 cyber defense;vLLM 同日给出支持,参数规模 744B、40B active、1M context。
- Qwen 预览 Qwen3.8-Flash,称其是 Qwen4 架构早期预览;OpenRouter 与 QwenCloud 同步上架,价格明显打到应用层。
- NVIDIA 开始交付 Vera CPU,并用 NVHBM 扩展 NVLink Fusion,算力叙事从 GPU 转向整机、内存、互联。
- Warp 公开 self-improvement loops:用会话评分、失败隔离、Skill PR,把 agent 的经验沉淀回工作流;Lambda 也在写 AgentFlow。
- Perplexity 发布 Portable Computer,把 orchestrator、subagent、harness 都放到 NVIDIA DGX Spark 本地运行。
💰 投资
- a16z 宣布 Machine Age Fund,规模 11 亿美元,投向 chips、memory、networking、systems software、power 和 physical machines;这和 Anthropic MHS / NVIDIA Vera 是同一条线:AI 的瓶颈开始下沉到物理栈。
- Khosla Ventures 继续押 recursive self-improvement,认为 DiscoLoopAI 这类“自我改进”公司可能是下一阶段关键机会。
- YC 的 Outset 案例把 AI interviews 做成新类别;这类垂直工作流公司比“模型壳”更接近真实价值捕获。
- Conviction 提到多位 portfolio founder 进入 TIME100 AI,投资圈注意力仍集中在 frontier + 应用公司创始人本身。
🧠 解读
- TLDR AI 把 Gemini Omni 1.1、Cohere Parse、Codex persistent mode 放在同一天 headline,说明“可控生成 + 文档解析 + 持久工作状态”正在合流。
- The Rundown AI 把 Anthropic MHS 解读为 agents 进入真实机器世界;机器之心 直接称它是“物理 MCP”。
- Lenny 记录 Ryan Carson 一个月花 2 万美元用 Devin 的经验,核心不是“贵”,而是 agent 成本必须用业务闭环衡量。
- 36氪 把两家 AI 巨头吞掉全球新增算力作为焦点,提醒你:模型竞争背后其实是算力采购权、供应链和资本纪律。
- 机器之心 写 Harness Continual Learning,把持续学习从模型参数转向 agent harness;这正好对应今天的 self-improving agent 主线。
🔨 实践
- Ben Holmes 说团队几天内合并了 5 个 self-improvement PR,其中一个抓到了 message passing 的 token burn;这是“agent 经验进 Git”的真实工作法。
- Xudong Han 拆 Warp 的做法:人类给反馈,Improver Agent 定期整理失败模式,改 Skill 并走 PR review。
- Replit 推 Intelligent Model Routing,让系统按任务自动选模型,应用层开始把“选模型”从用户决策变成运行时决策。
- Vercel 展示一分钟部署 eve agent;LangChain 则强调 Box 选择 Deep Agents 的原因是模型无关与迭代速度。
- Jerry Liu 提到 static embeddings 的速度/成本优势和长文本精度问题,适合做“便宜但够用”的系统分层判断。
🔥 专业热榜
- Hacker News 把 GLM-5.3 open-weight 推上前排,开源大模型仍是专业社区最敏感的信号。
- Hugging Face Papers 出现 PILOT in the Loop:长程 agent 的 live self-improvement;PapersCool 同时出现 WikiSkill,把 agent 经验编译成持久知识。
- Hugging Face Papers 的 VoiceMem 关注实时交互里的 streaming dual-brain memory,和 Claude memory / Codex persistent mode 同频。
- Product Hunt 上 Gemini Omni 1.1 Flash 热度靠前,说明视频生成的“可控性”比纯画质更容易变成 builder 需求。
- GitHub trending 的 awesome-gpt-image-2、scientific-agent-skills 都指向一个方向:能力爆发后,用户需要可复用范式与技能库。
🌶️ 爆款盘点
- Douyin · 武侠打斗 AI 提示词〔短视频|2546 万赞|平台 pct 100|AI 内容创作〕:最高热度不是“AI 能做视频”,而是“我把可复用提示词直接送你”。爆点在福利感 + 结果画面 + 模板领取,内容门槛低,转发/收藏动机强。
- Douyin · Hy4 Preview / workbuddy 免费长任务〔图文|107 万赞|pct 99|新模型/工具〕:新模型借“免费可用 + 补齐 Hy3 短上下文痛点”出圈。它把技术发布翻译成一个明确用户收益:跑长任务不容易乱。
- Douyin · 12 分钟入门 Claude Code〔长教程短视频|17.1 万赞|pct 98|AI Builder〕:安装、绕登录、接国产模型、VSCode 可视化,一条视频解决“开始用”的所有摩擦。Crossover: 这条和 Codex persistent mode / Warp skills 属同一主线,平台侧给出的是大众化包装。
- Douyin · Codex 零基础教程第 2 期〔教程短视频|15.3 万赞|pct 97|一人公司〕:Codex 被大众内容化,关键词是“零基础 + 保姆级 + 系列化”。
- Douyin · Vibe Coding 0 到 1 做软件〔长教程短视频|15 万赞|pct 96|大众情绪〕:核心钩子是“不会代码的人,真的能做软件吗?” 它卖的不是技术,是能力身份跃迁。
- Rednote · 13 岁满级小孩用 AI 接百万商单〔图文|5.46 万赞|pct 100|AI 创业〕:年龄反差 + 百万商单 + AI 杠杆,三重冲突直接拉满传播。
- Rednote · 1 小时吃透一个行业〔图文|2.89 万赞|pct 99|AI 学习/认知〕:爆点在“知识库 + 时间压缩”,非常贴认知型创作者的学习焦虑。
- Bilibili · 比 Cursor 好用 10 倍的 AI 工具〔长视频|1.2 万播放|pct 100|AI Builder〕:B站高位信号仍然吃“工具替代 + 项目管理”这种强功利标题。