← 返回首页
AI 情报日报 — 2026-05-13
高度相关
- Thinking Machines 发布 TML-Interaction-Small — 翁荔团队首款模型,276B MoE / 12B 激活,把语音、视频、文本切成 200ms"微回合"流式处理,前台即时响应+后台异步长推理。响应延迟比 GPT-realtime-2.0 快 4 倍。对 aiself "全上下文 AI 助手"是直接参考架构——前台轻量响应、后台异步处理工具调用与长推理,正是私人助手的核心交互范式。 来源
- OpenAI 弃用 Finetuning API — Latent Space 评论"Finetuning 时代结束"。模型层把 finetune 路径砍掉,意味着小团队靠 SFT 做差异化基本无路;改走 prompt engineering、RAG、长 context(Claude Constitution 模式)。aiself 不需要考虑微调路线,专注 context + prompt 工程。 来源
- Anthropic 押注异步编程 + 多智能体 — Claude 平台加入"目标导向、模型造梦、多智能体协同"三项能力,Pro/Max/Team 速率限制翻倍,Shopify 全员标配 Claude Code。异步并行 agent 架构成主流,aiself 的"实习生"模式可参照。 来源
中度相关
| 动态 | 相关性 | 来源 |
|---|---|---|
| Claude Code 推出 Agent View,一屏管理多会话 | 团队自身工程效率工具,可评估纳入工作流 | 链接 |
| 谷歌 Gemini Omni 全模态视频模型曝光(10s 720p + 实时编辑) | 多模态能力天花板上移,但与个人助手交互场景间接相关 | 链接 |
| OpenAI 成立 Deployment Company($40 亿初投 + 收购 Tomoro 引入 150 名 FDE) | 大厂走"嵌入企业流程"重型咨询路线,与小团队 PLG 路径形成对照 | 链接 |
| Frontier-Eng Bench:47 任务测 Agent 真实工程优化能力 | "深度比宽度更重要"、Agent 改进呈双重幂律衰减——对 agent 设计有方法论启发 | 链接 |
| LightOn Agent-ModernColBERT:149M 参数检索器在 BrowseComp-Plus 超越大模型 | "小而专"的检索 agent 思路,私人助手做长期记忆检索可借鉴 | 链接 |
背景信息
- 马斯克诉 OpenAI 案进入第三周,纳德拉、苏茨克维、泰勒出庭,披露穆拉蒂 52 页备忘录、董事会曾考虑与 Anthropic 合并等内幕。
- 宇树科技发布载人变形机甲 GD01,390 万元起,对标《阿凡达》AMP。
- SOAP-Muon 优化器在 Modded-NanoGPT 创新纪录(3150 步),训练成本继续压缩。
- 研究层评测加码:Soohak 发布 439 道研究级数学题(64 名数学家原创),AI Co-Mathematician 在 FrontierMath Tier 4 达 48%。
Action Items
- 深读 TML-Interaction-Small 技术细节:尤其是"200ms 微回合 + 前后台异步分工"机制,评估是否能映射到 aiself 的实时对话 + 长期任务架构。
- 架构决策中明确放弃 finetuning 路线:在产品方向决策(5/24)前,把"context 工程 + RAG + 长 prompt"作为模型层默认假设写入方案。
- 跟进 Claude Code Agent View 上手成本:如适合现有 2 人协作模式,可纳入下周工作流试用。
相关研究简报
Anthropic "Code w/ Claude" 大会:Agent 范式从被动响应迈向主动长跑协同
深度调研:Anthropic「Code w/ Claude 2026」全景与对 aiself 的范式压力
Untitled
Anthropic "Code with Claude" 2026 大会深度调研
Untitled
深度调研:Thinking Machines「Interaction Model + Background Model」双脑范式与 aiself 的影响
Thinking Machines TML-Interaction-Small:个人助手的范式分叉点
Untitled
Thinking Machines 发布 TML-Interaction-Small:交互范式的范式转移
Untitled
TML-Interaction-Small:商业数据与 aiself 架构选择