llm-to-agent/docs/features/model-agent.md
2026-08-21 16:33:23 +08:00

2.1 KiB
Raw Blame History

模型、聊天与 Agent

DeepSeek Adapter 与流式聊天

实现阶段P1

  • 通过 Model Port 接入 DeepSeek API支持流式文本生成和基础请求配置。
  • 将模型增量传递给客户端,并在完成后保存用户可见消息。
  • 处理网络失败、API 错误、中途取消和未完成回复。

DefaultAgent 文本执行

实现阶段P1

  • 实现单一 DefaultAgent Behavior完成输入、上下文组装、模型调用和最终回答。
  • Behavior 运行在 Microkernel 中,通过端口使用模型,不直接写入 Repository。
  • 保持纯聊天 Run 与后续行动 Run 使用一致的执行入口。

系统提示词与上下文组装

实现阶段P1

  • 组合系统提示词、当前 Space、Conversation 历史和用户输入。
  • 定义消息角色、顺序和客户端可见内容与模型内部消息的边界。
  • 为 Project 规则、记忆、附件和子 Agent 上下文预留明确装配位置。

单 Agent Tool Calling

实现阶段P2

  • 将可用 Tool 描述交给模型,解析 Tool Call 并通过 Tool Gateway 执行。
  • 将结构化 Tool 结果送回模型,循环直至生成最终回答。
  • 对未知 Tool、无效参数、执行失败和循环上限给出可恢复反馈。

上下文裁剪与压缩

实现阶段P4

  • 在超过模型上下文限制前选择、裁剪或压缩历史内容。
  • 保留关键用户要求、Tool 结果和来源,避免摘要悄然改变任务意图。
  • 向用户展示发生过的上下文压缩,并允许查看原始历史。

多模型管理与路由

实现阶段P5

  • 接入多个 Model Adapter按 Space、Profile、Behavior 或具体 Run 选择模型。
  • 支持模型能力匹配、失败降级和角色级模型路由。
  • 统一记录模型标识、Token、延迟和调用结果。

多模态模型能力

实现阶段P7

  • 支持图片、截图、文件等多模态输入和相应模型能力声明。
  • 将附件、屏幕内容和浏览器截图安全地组装进模型上下文。
  • 对不支持某种输入的模型进行能力降级或路由。