// 11

模型管理

概述

模型管理页面是 DeepSeno AI 引擎的控制中心,负责管理本地和云端的语言模型、语音识别模型的安装和配置。页面顶部的就绪指示器显示 Ollama、LLM 和 Sherpa 三个组件的状态。

Ollama 安装与状态检测

DeepSeno 使用 Ollama 作为本地大语言模型的运行引擎:

  • 自动检测: 启动时自动检测 Ollama 是否已安装和运行
  • 一键安装: 如果未检测到 Ollama,提供一键自动下载和安装功能
  • 连接状态: 实时显示 Ollama 服务的连接状态(已连接/未连接/检测中)

模型列表与下载

LLM 模型

DeepSeno 根据你的硬件配置推荐合适的语言模型。支持的模型系列包括 Qwen3 的多个规格:

  • qwen3:8b — 基础版(约 5.2 GB,16 GB 内存推荐)
  • qwen3:14b — 进阶版(约 9.3 GB,32 GB 内存推荐)
  • qwen3:30b — 高级版(约 19 GB,64 GB 以上内存推荐)

每个模型显示下载状态(等待中/下载中/已完成/错误)和下载进度。点击下载按钮开始拉取,支持取消正在进行的下载。

嵌入模型

bge-m3(约 1.2 GB)是向量检索的核心组件,用于将文本转化为语义向量。必须安装才能使用智脑问答功能。

ASR 模型管理

SenseVoice ONNX 模型(约 263 MB)提供语音识别、语音活动检测和说话人嵌入能力:

  • 状态检测: 自动检查模型文件是否完整
  • 镜像选择: 下载时可选择 CDN 加速(推荐国内)、HF Mirror 镜像、GitHub 加速代理或 GitHub 直连
  • 下载管理: 支持开始下载、查看进度和取消下载
  • 重新下载: 即使模型已就绪,也可以强制重新下载以更新版本

视觉模型

DeepSeno 支持配置视觉模型(Vision LLM)来处理图片内容:

  • 支持的模型: Qwen3.5-vision 等支持图像输入的模型
  • 使用场景: 图片内容分析、文字识别(OCR)、视频关键帧分析
  • 配置方式: 在云端 API 或本地 Ollama 中安装支持视觉的模型
  • 视觉模型为可选功能,未配置时图片仅作为附件存储

云端 API 配置

除了本地 Ollama 模型,DeepSeno 还支持连接 OpenAI 兼容的云端 API:

  • API 地址: 输入 OpenAI 兼容接口的 URL
  • API 密钥: 输入对应的 API Key
  • 连接测试: 点击测试按钮验证 API 是否可用
  • 切换到云端模式后,Ollama 不再需要运行
  • 云端 API 同样支持视觉模型,可用于图片分析

预置云服务商

服务商推荐模型说明
火山方舟 (Volcengine)ark-code-latest官方推荐,支持 Doubao 系列
DeepSeekdeepseek-chat高性价比
智谱 (GLM)glm-4-flash国产大模型
Kimi (月之暗面)moonshot-v1-8k长上下文
OpenAIgpt-4o-mini国际服务

所有支持 OpenAI 兼容接口的服务商均可接入,只需填写 API 地址、API Key 和模型名称。

硬件信息与推荐

页面展示当前设备的硬件信息:

  • 内存: 总物理内存容量
  • CPU: 处理器核心数
  • 平台: 操作系统和架构(macOS Apple Silicon / Windows x86_64 等)
  • 推荐等级: 根据硬件自动评估为 basic(基础)、good(良好)或 excellent(优秀)
  • 推荐模型: 基于硬件配置自动推荐最适合的 LLM 模型