aiself AI 情报站
← 返回首页
2026-05-11·腾讯研究院AI速递·AI

AI 速递 2026-05-11 — aiself 团队关注点

来源:腾讯研究院AI速递 20260511

高度相关

Claude Code 团队力推 HTML 替代 Markdown:Agent 输出格式在进化

  • 来源The Unreasonable Effectiveness of HTML via 腾讯研究院
  • 关键信息:Anthropic Claude Code 工程负责人 Thariq Shihipar 发文主张用 HTML 替代 Markdown 作为 AI 输出格式,支持表格、SVG、脚本嵌入和交互组件。帖子获 440 万阅读、8200 赞。Anthropic 内部已将 HTML 作为计划、代码审查、设计原型、报告的默认格式。
  • 对 aiself 的含义:Anthropic 正在重新定义 agent 的输出层——从纯文本向富交互演进。aiself 的 agent 输出设计不应局限于 Markdown,HTML/交互式输出可能成为差异化能力。值得关注 Thariq 的 20 个示例 作为参考。

DeepSeek 首轮融资 500 亿,V4.1 定档 6 月发布并支持 MCP

  • 来源量子位报道IT之家 via 腾讯研究院
  • 关键信息:DeepSeek 首轮融资目标 500 亿元(估值 3500 亿),梁文锋个人出资 200 亿占 40%。V4.1 定档 6 月发布,将原生支持 MCP 协议,新增图片和音频理解能力。
  • 对 aiself 的含义:V4.1 原生 MCP 支持意味着 aiself 可以用 DeepSeek 作为后端模型并直接走 MCP 工具调用链路,无需自己适配。这可能大幅降低调用成本(相比 Claude/GPT)。6 月发布后应第一时间评估性能和价格。

OpenAI 研究员翁家翌提出 Heuristic Learning:coding agent 的新范式

  • 来源36氪报道翁家翌博客 via 腾讯研究院
  • 关键信息:OpenAI 后训练核心工程师翁家翌提出 Heuristic Learning 框架——让 coding agent 持续维护手写规则系统,不训练神经网络,通过读日志、改代码、加测试迭代。在 Atari Breakout 达到 864 分理论最高分。翁认为这是继预训练、RLHF、大规模 RL 之后的下一个范式。
  • 对 aiself 的含义:这与 aiself 的 agent 架构直接相关——agent 通过代码自我改进而非重训模型。如果 HL 范式成立,aiself 可以让 agent 通过维护自己的"规则代码库"来持续提升,而不依赖模型微调。值得深入研究这个框架的可行性。

中度相关

动态来源与 aiself 的关系
Hermes Agent 登顶 OpenRouter,单日调用 2710 亿 Token腾讯研究院开源 agent 框架需求爆发,aiself 可关注 Hermes 的 agent 调度机制
阶跃 StepAudio 2.5 Realtime 发布,主打"活人感"语音对话腾讯研究院实时语音交互竞争加剧,aiself 若做语音交互可评估 StepAudio 作为选项
菲尔兹奖得主测试 GPT-5.5 Pro,2 小时完成博士级证明腾讯研究院GPT-5.5 Pro 推理能力再验证,2026 年已有 15 个 Erdős 问题被解,11 个有 AI 贡献

背景信息

动态来源类别
AI 重新激活无屏手环,WHOOP 估值 101 亿美元、Oura 110 亿美元腾讯研究院硬件/健康
英伟达 Jim Fan:机器人物理 AI 将复制 LLM 突破路径,EgoScale 用 2.1 万小时视频预训练腾讯研究院机器人
Figure 创始人:AGI 最后一块拼图是真实世界互动,Figure 04 将是 iPhone 1 时刻腾讯研究院机器人

Action Items

  1. 【高优】评估 DeepSeek V4.1 + MCP:6 月发布后立即测试,对比 Claude/GPT 的工具调用能力和成本,评估作为 aiself 后端模型的可行性
  2. 【中优】研究 Heuristic Learning 框架:翁家翌的 HL 范式与 aiself agent 自我改进机制高度相关,安排一次专题学习
  3. 【低优】参考 Claude Code HTML 输出模式:浏览 Thariq 的 20 个示例,评估 aiself agent 输出是否应支持富交互格式