跳到主要内容

证据简报

DeepSeek:智能体记忆并非越多越好:八款模型评测显示剂量需按能力校准

智能体记忆并非可随意开启的功能,而是需按模型能力校准的剂量。强模型适合注入完整指南集,DeepSeek-V3.2(671B MoE)任务完成率提升+9.5 个百分点;较弱模型采用精选检索效果最佳,gpt-oss-120b(117B MoE)提升+16.1pp 且仅增加+5% token。该方法无需更新权重或人工标注,通过从智能体过往轨迹中蒸馏指南并在推理时注入实现。

发布
更新
编辑
Frontline Lab
来源
Hugging Face:Blog(RSS)
来源作者
Hugging Face:Blog(RSS)
相关主题
0
采集时间
2026-08-19

Frontline Lab 摘要与来源

编辑摘要

智能体记忆并非可随意开启的功能,而是需按模型能力校准的剂量。强模型适合注入完整指南集,DeepSeek-V3.2(671B MoE)任务完成率提升+9.5 个百分点;较弱模型采用精选检索效果最佳,gpt-oss-120b(117B MoE)提升+16.1pp 且仅增加+5% token。该方法无需更新权重或人工标注,通过从智能体过往轨迹中蒸馏指南并在推理时注入实现。

这份简报保留原始来源,摘要和编辑判断都可以回到原文独立核验。

来源署名Hugging Face:Blog(RSS) · Hugging Face:Blog(RSS)

打开原始来源

相关已发布证据

相关关系来自共同主题、实体、分类、标签与社区语境;每条结果仍保留独立来源回链。

OpenAI:官网动态(RSS · 排除企业/客户案例)

OpenAI 因关键网络能力阈值放缓模型扩展

OpenAI 因 OpenAI-Hugging Face 事件及 Astra 模型可能达到关键网络安全能力阈值,暂时放缓模型扩展,暂停最新部署模型的强化学习训练两周并搁置最大规模前沿 RL 运行。

为什么重要该措施显示前沿模型训练节奏正受到网络安全能力评估约束。

原始来源
X

DeepSeek Harness 桌面端套壳预装功能做法

发帖作者称 DeepSeek Harness 桌面端开源近期较热,并认为 DSH 理念应是极简和一切皆插件,质疑部分桌面端套壳把功能硬编码进壳里。

为什么重要该观点指向桌面 Agent 工具的插件化边界和产品形态选择。

原始来源
X

豆包「工作任务」支持手机查看并指挥电脑 Agent

发帖者介绍自己用豆包手机端连接电脑,在 PC 端「工作任务」中远程指挥电脑 Agent 找文件、查看任务进度,并建议让 Agent 自行检查反馈。

为什么重要手机远程控制电脑 Agent 可利用本机文件、代码库和已配置环境完成任务。

原始来源
X

Google Agents CLI 用自然语言串起 Agent 交付流程

作者表示,Google's Agents CLI + skills 可把脚手架、部署、身份与网络治理、评估和发布等 Agent 交付环节压缩进 coding agent,并用普通英文提示操作。

为什么重要开发者可用同一 coding agent 串联 Agent 从搭建到发布的流程。

原始来源