GavinZ - personal vault
/ EN
← ~以产品视角,畅想后续 Agent 端到端模型的能力

以产品视角,畅想后续 Agent 端到端模型的能力

以产品视角,思考(乱想)后续 Agent 端到端模型可能有哪些能力?会怎么训练?

1、和人的交互,也就是提问的能力,。模型在适当的时候提出问题,等待人类给到答案 2、和世界的交互,使用工具的能力,s。目前各种工具已经井喷了,且现在看起来Anthropic 的 MCP ,就是专门为了给模型训练设计的,不管是什么工具,通过一个让模型自己找就行了。

加上目前已经具备的,似乎好像也什么其他需要的了。(硬要说的话,从提升用户体验上,生成 GUI ,通过 GUI 和用户交互的能力可能是一个,但这可能是再下一步才需要考虑的)

这些都会被构建进数据集,和人类偏好对齐(可选),再通过 RL 生成long cot,后面再反过来作为 pre-train 阶段的语料来训练 base model,让 model “天生”具备”和人的交互“以及”和世界的交互“? 不知道会不会是这样的一个发展路径🤔。

如果是这样的话,以后将模型作为插件的产品,和将模型作为主体的产品,两者的差异可能会越来越大了。前者越来越难,后者则潜力无限。没有自己的模型,可能会慢慢等于从 PC 进入互联网时代,只有web,而没有自己的移动端产品。

⎇ main live · gavinz.space
§ 以产品视角,畅想后续 Agent 端到端模型的能力built with Claude CodeMarkdown中文