← 返回首页
AI 情报日报 — 2026-05-14
高度相关
- OpenAI 弃用 Finetuning API — Latent Space 解读:finetuning 正式退场,行业转向"超长 prompts + 上下文工程"路线(如 Claude Constitution),仅 Cursor/Cognition 等 top 1% 玩家仍在加大开源模型 RLFT。对 2 人团队意味着:私人 AI 不要押注 finetuning 路线,应聚焦上下文管理与 prompt 工程能力 Latent Space
- 微信聊天记录一键转发元宝做 AI 总结 — 腾讯把"碎片化对话→结构化输出"做进了微信生态,支持单次 100 条消息、阅后即焚临时模式、可处理图像/视频/文件。这正面切入 aiself "All-in-One 助理"方向的核心场景(信息整理 / 待办提取),且对手有亿级用户分发 腾讯研究院
- Google 发布 Gemini Intelligence,安卓从 OS 变 Intelligent System — 跨手机/手表/汽车/XR/笔记本统一智能层,支持多步任务自动化、跨 App 调用完成购物下单、Chrome 内置助手。系统级助手正在挤压第三方个人 AI 产品的生存空间,aiself 需要明确"为什么用户要装一个独立 app 而不是用系统自带" 腾讯研究院
- 面壁开源 MiniCPM-V 4.6 端侧多模态模型 — 1.3B 参数、6G 内存即可端侧运行,token 吞吐为同尺寸竞品 1.5 倍,已在汽车/PC/手机落地。端侧能力是隐私敏感型个人 AI(尤其"自我认知/日记"方向)的关键,可关注是否纳入技术选型 腾讯研究院
中度相关
| 动态 | 相关性 | 来源 |
|---|---|---|
| Anthropic 推 20+ 款法律行业 MCP 连接器 + 12 个执业领域插件,Claude 在 Office 全家桶内保持上下文连贯 | 垂直行业打法 + MCP 生态成熟,对小团队"做某个细分场景的助手"是参考样本 | 链接 |
| MiniMax Agent 升级为 Mavis,Agent Teams 多 Agent 协作,Leader-Worker-Verifier 架构解决"单 Agent 越跑越笨" | Agent 长任务的工程方案,对 aiself 后续做"主动行为"有架构参考 | 链接 |
| Cursor 创始人:AI 编程进入 Team 纪元,企业 75% 代码由 AI 生成,内部 30% PR 由 Agent 端到端完成 | "AI 自主完成长任务"的行业拐点信号,反向印证 Agent 产品路线可行 | 链接 |
| 前 Qwen 负责人林俊旸创办 AI Lab,融资中估值或达 20 亿美元,方向疑为"推理式思考→智能体式思考" | 头部人才单点切入 Agent 方向,可关注其后续研究产出 | 链接 |
背景信息
- GPT-5.5 在 ProgramBench 上首次破零(200 道从零重写程序任务),Opus 4.7 因细节错误败北。推理算力 Scaling Law 仍在前进
- 研究级基准持续变难:439 道由 64 位数学家原创的数学题、Medmarks v1.0 医学评测扩到 30 个 benchmark
- LightOn Agent-ModernColBERT(149M 参数)在 BrowseComp-Plus 上超越大模型方案——小专用模型在 agentic 检索场景仍有价值
- 训练侧 SOAP-Muon、MuLoCo 等优化器持续压缩训练成本
Action Items
- 把"微信聊天记录→元宝"作为竞品深度体验对象之一,重点观察:信息整理输出形态、用户实际使用频率、临时模式的隐私设计——这与 aiself "All-in-One 助理"方向高度重叠
- 在产品方向决策前补一份调研:iOS/Android 系统级 AI 在"日记/自我认知"和"生活助手"两个场景下的覆盖边界,明确 aiself 的差异化锚点
- 评估 finetuning 退场对产品技术栈的影响——确认"长上下文 + prompt 工程 + 记忆系统"是否已是默认路线,避免在错误方向投入