核心能力

从模型接入到用量审计,完整覆盖 AI 平台所需的每一环

打字机流式对话

SSE 实时推送 + 跨 chunk 解析,回答逐字呈现;Markdown 渲染、代码高亮、一键复制。

基于 Server-Sent Events 的逐字输出,配合跨 chunk 缓冲区解析,即使上游把 Markdown 语法拆散也能正确渲染。支持代码块语法高亮、一键复制,可随时中断生成。

  • 逐字流式输出
  • Markdown + 代码高亮
  • 一键复制代码块
  • 随时中断生成

多模型自由切换

AetherMind Pro、Qwen-Max、DeepSeek-V3 等别名一键切换,底层可指向任意 OpenAI 兼容服务。

通过模型别名层解耦前端与底层供应商,别名可指向阿里云百炼、SiliconFlow、vLLM、Ollama 等任意 OpenAI 兼容端点。对话中随时切换,互不干扰。

  • 别名层解耦
  • 对话中即时切换
  • 兼容任意 OpenAI 服务
  • 无需改代码

上下文记忆

自动携带历史消息形成多轮记忆,会话持久化存储,随时回到之前的对话继续交流。

每次请求自动携带最近 N 轮历史消息构建上下文,配合持久化会话存储,关闭页面后再次打开仍可无缝继续之前的对话。支持无限轮记忆。

  • 多轮上下文携带
  • 会话持久化存储
  • 历史随时回溯
  • 支持无限轮

Token 额度管理

每次调用精确记录输入/输出 Token,自动扣减额度,用量流水清晰可查。

新用户注册即赠 50 万 Token。每次调用按上游返回的 usage 精确计量,原子扣减额度并生成流水记录,个人中心随时查看消耗趋势与剩余额度。

  • 精确 Token 计量
  • 原子额度扣减
  • 用量流水可查
  • 注册赠 50 万 Token

全链路 SSE 推送

Nginx 关闭缓冲、后端显式刷包、上游真流式请求,端到端保证实时性,可随时停止。

从上游推理服务到浏览器全链路流式:Nginx 关闭代理缓冲、Express 显式 flush、Fetch ReadableStream 逐块解析,首字延迟毫秒级,生成过程可随时中止。

  • 端到端真流式
  • 首字延迟毫秒级
  • 显式刷包无缓冲
  • 可随时中止

响应式 & 桌面扩展

移动到桌面全尺寸适配,同套代码可通过 Tauri / Electron 扩展为桌面客户端。

移动端、平板、桌面全尺寸自适应布局。基于 Web 技术栈,可通过 Tauri 或 Electron 低成本打包为 Windows / macOS / Linux 桌面客户端,体验与 Web 版完全一致。

  • 全尺寸自适应
  • Web 技术栈
  • Tauri/Electron 打包
  • 跨平台一致体验

多会话管理

侧边栏多会话切换,会话自动命名、可重命名、可删除,历史会话随时回溯。

支持创建多个独立会话,每个会话有独立的上下文记忆。系统自动根据首条消息生成会话标题,也可手动重命名。会话列表按更新时间倒序,随时切换或清理。

  • 多会话隔离
  • 自动命名标题
  • 手动重命名
  • 一键清理历史

企业级安全

JWT 鉴权、密码加盐哈希、额度原子扣减,所有接口经过角色鉴权与输入校验。

用户密码使用 bcrypt 加盐哈希存储,JWT Token 签发与会话鉴权,管理后台接口双重角色校验。所有用户输入经 Zod Schema 校验,额度扣减采用数据库原子操作避免并发超扣。

  • bcrypt 密码哈希
  • JWT 会话鉴权
  • 角色权限校验
  • Zod 输入校验

提示词模板库

内置写作、编程、翻译等场景模板,一键套用快速开始,支持自定义保存个人模板。

预置覆盖写作、编程、翻译、分析等高频场景的提示词模板,一键填入即可开始高质量对话。你也可以把常用的提示词保存为个人模板,下次直接调用,避免重复输入。

  • 多场景内置模板
  • 一键套用
  • 自定义保存
  • 团队模板共享
立即体验全部能力