58 lines
2.1 KiB
Markdown
58 lines
2.1 KiB
Markdown
# 模型、聊天与 Agent
|
||
|
||
## DeepSeek Adapter 与流式聊天
|
||
|
||
**实现阶段:P1**
|
||
|
||
- 通过 Model Port 接入 DeepSeek API,支持流式文本生成和基础请求配置。
|
||
- 将模型增量传递给客户端,并在完成后保存用户可见消息。
|
||
- 处理网络失败、API 错误、中途取消和未完成回复。
|
||
|
||
## DefaultAgent 文本执行
|
||
|
||
**实现阶段:P1**
|
||
|
||
- 实现单一 DefaultAgent Behavior,完成输入、上下文组装、模型调用和最终回答。
|
||
- Behavior 运行在 Microkernel 中,通过端口使用模型,不直接写入 Repository。
|
||
- 保持纯聊天 Run 与后续行动 Run 使用一致的执行入口。
|
||
|
||
## 系统提示词与上下文组装
|
||
|
||
**实现阶段:P1**
|
||
|
||
- 组合系统提示词、当前 Space、Conversation 历史和用户输入。
|
||
- 定义消息角色、顺序和客户端可见内容与模型内部消息的边界。
|
||
- 为 Project 规则、记忆、附件和子 Agent 上下文预留明确装配位置。
|
||
|
||
## 单 Agent Tool Calling
|
||
|
||
**实现阶段:P2**
|
||
|
||
- 将可用 Tool 描述交给模型,解析 Tool Call 并通过 Tool Gateway 执行。
|
||
- 将结构化 Tool 结果送回模型,循环直至生成最终回答。
|
||
- 对未知 Tool、无效参数、执行失败和循环上限给出可恢复反馈。
|
||
|
||
## 上下文裁剪与压缩
|
||
|
||
**实现阶段:P4**
|
||
|
||
- 在超过模型上下文限制前选择、裁剪或压缩历史内容。
|
||
- 保留关键用户要求、Tool 结果和来源,避免摘要悄然改变任务意图。
|
||
- 向用户展示发生过的上下文压缩,并允许查看原始历史。
|
||
|
||
## 多模型管理与路由
|
||
|
||
**实现阶段:P5**
|
||
|
||
- 接入多个 Model Adapter,按 Space、Profile、Behavior 或具体 Run 选择模型。
|
||
- 支持模型能力匹配、失败降级和角色级模型路由。
|
||
- 统一记录模型标识、Token、延迟和调用结果。
|
||
|
||
## 多模态模型能力
|
||
|
||
**实现阶段:P7**
|
||
|
||
- 支持图片、截图、文件等多模态输入和相应模型能力声明。
|
||
- 将附件、屏幕内容和浏览器截图安全地组装进模型上下文。
|
||
- 对不支持某种输入的模型进行能力降级或路由。
|