本机 Ollama,搭配你自己的网页搜索

本地模式的宗旨是提供尽量私有化、并且对用户友好的 AI 使用方式:提示词发给你本机运行的模型(通常跑在 Ollama 引擎里),对话以 Markdown 文件只保存在本机(你选择的 TeeChat 文件夹),不经过 TeeChat 托管归档。

然而,为了让 AI 更有用,有时候 网页搜索 必不可少。本地模式不能使用服务器执行模式;请自行配置客户端搜索(见后面第 4 节)。应用将调用你的搜索 URL 与 API 密钥 — Brave Search API,或你订阅的任意 JSON 搜索 API。

chat.teechat.ai 网页应用只提供托管机密推理。要用本地模式,请用桌面应用。

各跑在哪里

部分本地推理机密(托管)
对话模型本机或局域网上的 Ollama / vLLM / LM StudioTeeChat 机密引擎
后台辅助(任务模型)你在 设置 → 模型与 API → 后台辅助 的 本机 槽位选择TeeChat 托管默认(或你的 托管对话 槽位)
网页搜索你在 设置 → 网页搜索 → 端点 填写客户端 URL 和 API 密钥(本机执行)TeeChat 网关搜索
对话文件无论哪种推理,都在你的 TeeChat 文件夹同一文件夹

本地推理没有 OPE 加密。提示词只提供给本地服务。提示词将经过任务模型改写后发给您配置的搜索引擎,这是为了搜索更具有针对性,同时能在一定程度上缓解通过搜索引擎泄露的数据或信息。

1. 安装 Ollama 并拉取模型

  1. 从 ollama.com 安装并启动 Ollama。
  2. 按内存拉取合适的对话模型,例如:
ollama pull qwen2.5
ollama list
  1. 确认 API 可访问:
curl -s http://127.0.0.1:11434/api/tags

应返回模型列表的 JSON。若你改跑 vLLM(:8000)、LM Studio(:1234)或 llama.cpp,TeeChat 也会自动探测。

2. 让 TeeChat 连上本地引擎

  1. 打开桌面应用 → 设置 → 推理 → 本机。
  2. 服务器地址留空以自动检测 http://127.0.0.1:11434,或手动填写。
  3. 点 测试连接。应显示 **已连接 — Ollama(http://127.0.0.1:11434)**。
  4. 选择 本机。引擎可达后,顶部栏也会出现 本地 | 机密。

本地对话不需要登录。新安装默认仍是 机密,需在设置 | 推理 | 本机 中切换。

3. 为本机选后台辅助(任务模型)

搜索准备、对话标题和文件夹建议用的是 后台辅助模型,不是顶栏里的对话模型。本机与机密在本设备上各有一份槽位。

  1. 如需更小、更快的辅助模型,可另拉一个标签(也可以复用对话模型):
ollama pull qwen2.5:7b
  1. 打开 设置 → 模型与 API → 后台辅助。
  2. 展开 高级:更改后台辅助模型。
  3. 在 本机 下,从本机 Ollama / vLLM 的模型列表里选一个 — 不要用托管默认。除非你也要改机密侧的辅助模型,否则不要动 托管对话。

若 本机 仍是 未设置 — 请选择本机模型…,本地网页搜索无法准备查询(「未配置用于搜索准备的任务模型」)。之后 TeeChat 会按 设置 → 网页搜索 → 概览 里的 任务模型准备失败时 询问是否发送脱敏回退,或直接跳过搜索。

4. 配置你自己的网页搜索

  1. 设置 → 网页搜索 → 概览,将 执行模式 设为 客户端(浏览器调用搜索 URL)。本地模式下 服务器(POST 到配置的 URL) 不可选。
  2. 打开 端点。
  3. 填写 客户端 URL 与 搜索 API 密钥(作为 {{apiKey}} 合并;仅保存在本设备)(POST JSON 或 GET 模板)。
  4. 保存搜索设置。
  5. 在输入区为需要出处的对话打开 网页搜索。

本地模式下若客户端 URL 为空,TeeChat 会跳过搜索并提示你配置端点,不会代你调用 api.teechat.ai 或区域网关搜索。

目前自带的命名模板是 Brave Search API。自定义 可接任意返回 { "results": [{ "title", "url", "snippet" }] }(或 TeeChat 已能解析的其他 JSON 形状)的搜索 API。

5. 检查清单

隐私

发往搜索的字符串会经尽力 PII 脱敏,这不构成合规保证。

若使用经核验的托管引擎(不用本地模型),请切到 机密 并阅读如何在 TeeChat 上验证机密对话。

修订记录

  1. 补充本地后台辅助(任务模型)配置,供搜索准备使用。

← 全部文章