llm-to-agent/docs/features/model-agent.md
2026-07-23 17:49:50 +08:00

58 lines
2.1 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# 模型、聊天与 Agent
## DeepSeek Extension 与流式聊天
**实现阶段P1**
- 由 DeepSeek Extension 注册模型生成能力,支持流式文本和基础请求配置。
- Kernel 将模型增量转为 Run Event并在完成后保存用户可见消息。
- 处理网络失败、API 错误、中途取消和未完成回复。
## 默认 Agent 文本执行
**实现阶段P1**
- 在 Kernel 中跑通输入、上下文组装、模型能力调用和最终回答的默认执行流程。
- 具体模型实现来自 Extension不直接取得 Repository 写入权。
- 保持纯聊天 Run 与后续行动 Run 使用一致的执行入口。
## 系统提示词与上下文组装
**实现阶段P1**
- 组合系统提示词、当前 Space、Conversation 历史和用户输入。
- 定义消息角色、顺序和客户端可见内容与模型内部消息的边界。
- 为 Project 规则、记忆、附件和子 Agent 上下文预留明确装配位置。
## 单 Agent Tool Calling
**实现阶段P2**
- 将可用 Tool 描述交给模型,解析 Tool Call 并通过 Tool Gateway 执行。
- 将结构化 Tool 结果送回模型,循环直至生成最终回答。
- 对未知 Tool、无效参数、执行失败和循环上限给出可恢复反馈。
## 上下文裁剪与压缩
**实现阶段P4**
- 在超过模型上下文限制前选择、裁剪或压缩历史内容。
- 保留关键用户要求、Tool 结果和来源,避免摘要悄然改变任务意图。
- 向用户展示发生过的上下文压缩,并允许查看原始历史。
## 多模型管理与路由
**实现阶段P5**
- 通过多个模型 Extension 接入不同服务,按 Space、能力预设、Agent 策略或具体 Run 选择模型。
- 支持模型能力匹配、失败降级和角色级模型路由。
- 统一记录模型标识、Token、延迟和调用结果。
## 多模态模型能力
**实现阶段P7**
- 支持图片、截图、文件等多模态输入和相应模型能力声明。
- 将附件、屏幕内容和浏览器截图安全地组装进模型上下文。
- 对不支持某种输入的模型进行能力降级或路由。