IntegrationsChat
AnythingLLM
用 RouteMux 作为 AnythingLLM 工作区背后的 LLM 供应商。
AnythingLLM 有一个 Generic OpenAI 供应商类型,正是为这种场景设计的。
配置
| 字段 | 值 |
|---|---|
| LLM Provider | Generic OpenAI |
| Base URL | https://api.routemux.com/v1 |
| API Key | 你的 RouteMux key(sk-...) |
| Chat Model Name | GET /v1/models 返回的 slug |
| Token 上下文窗口 | 填该模型的真实上下文 —— 见模型页 |
上下文窗口要如实填
AnythingLLM 用这个数字决定往提示里塞多少检索内容。填得比模型真实支持的大,长文档会在 上游报错;填得小则会静默削减你的检索质量。
嵌入是独立的
AnythingLLM 的嵌入供应商与对话供应商分开配置。如果你选的嵌入模型不在 GET /v1/models 里,
就把嵌入指到别处,不要假设对话那把 key 会覆盖它。
成本提示
RAG 场景每轮都会重发检索到的片段,所以 token 用量随分块大小与 top-k 增长,不只随对话长度。 每次请求的用量在控制台日志里可见。