操作 · AI 深度对比

操作 · AI 深度对比 / 多模型

设置入口(右侧标签)

打开 PC /ai/ 或手机 /wap/ai/设置,右侧标签:

标签作用
基本设置流式、温度、系统提示词等
网页版(PC)网页模型登录状态
单任务多模型同一问题并行问 1~10 个模型;先「综合」再「综合评分」
多任务多模型多个问题 × 多个模型;每任务有「综合」+「评分」,最后有总评

工具栏 多模型 按钮会打开设置并切到对应标签。

单任务多模型

  1. 右侧点「单任务多模型」→ 勾选 启用
  2. 勾选 1~10 个模型(可只选 1 个)
  3. 输入一个问题发送
  4. 提问框上方分页:各模型回答 → 综合(一页汇总全部回答,标题为模型名)→ 综合评分(本机 Ollama)

若 5 个模型都答了但综合评分只评 2 个:多为本机 Ollama 上下文 num_ctx 默认 2048 装不下多路长回答。请到后台 AI 设置 → 上下文长度 num_ctx 调到 16384+;代码已对综合评分自动拉高上下文并缩短每路摘要。

  1. 每条回答下方元信息形如:模型: 智谱 · 字数/tokens: … · 耗时: …ms
  2. 分页标签用汉字品牌简称(如 文心 / 月之 / 豆包 / 千问 / 智谱),悬停可看完整模型名

多任务多模型

  1. 右侧点「多任务多模型」→ 勾选 启用
  2. 任务列表每行一条(也可用 ||);再勾选 1~10 个模型
  3. 点发送
  4. 标签形如 1·豆包1·综合1·评分 … 最后 综合 + 总评

网页版注意

  • 前台提问默认 无头 浏览器,服务器上不再每问弹窗;需登录时请到后台「账号会话」用 窗口登录 一次
  • 智谱等页脚「网信算备…」备案文案会被过滤,不应再当正文返回
  • 多模型各自独立请求;网页版在桥内按会话排队,互不取消

评分失败排查

  • 提示含 HTTP 504/413:网关超时或正文过大 → 减少模型数或缩短回答后再评
  • 提示「Ollama」相关:确认本机 Ollama 已启动且有可用文本模型
  • 综合评分依赖本机 Ollama,与网页版是否弹窗无关

其它

  • 两种模式互斥,且暂不支持识图同发
  • 每个模型回答与每次评分各计额度
  • 模板须 UTF-8;勿用 PowerShell 默认编码改 ai/index.html