从模型接入到用量审计,完整覆盖 AI 平台所需的每一环
SSE 实时推送 + 跨 chunk 解析,回答逐字呈现;Markdown 渲染、代码高亮、一键复制。
基于 Server-Sent Events 的逐字输出,配合跨 chunk 缓冲区解析,即使上游把 Markdown 语法拆散也能正确渲染。支持代码块语法高亮、一键复制,可随时中断生成。
AetherMind Pro、Qwen-Max、DeepSeek-V3 等别名一键切换,底层可指向任意 OpenAI 兼容服务。
通过模型别名层解耦前端与底层供应商,别名可指向阿里云百炼、SiliconFlow、vLLM、Ollama 等任意 OpenAI 兼容端点。对话中随时切换,互不干扰。
自动携带历史消息形成多轮记忆,会话持久化存储,随时回到之前的对话继续交流。
每次请求自动携带最近 N 轮历史消息构建上下文,配合持久化会话存储,关闭页面后再次打开仍可无缝继续之前的对话。支持无限轮记忆。
每次调用精确记录输入/输出 Token,自动扣减额度,用量流水清晰可查。
新用户注册即赠 50 万 Token。每次调用按上游返回的 usage 精确计量,原子扣减额度并生成流水记录,个人中心随时查看消耗趋势与剩余额度。
Nginx 关闭缓冲、后端显式刷包、上游真流式请求,端到端保证实时性,可随时停止。
从上游推理服务到浏览器全链路流式:Nginx 关闭代理缓冲、Express 显式 flush、Fetch ReadableStream 逐块解析,首字延迟毫秒级,生成过程可随时中止。
移动到桌面全尺寸适配,同套代码可通过 Tauri / Electron 扩展为桌面客户端。
移动端、平板、桌面全尺寸自适应布局。基于 Web 技术栈,可通过 Tauri 或 Electron 低成本打包为 Windows / macOS / Linux 桌面客户端,体验与 Web 版完全一致。
侧边栏多会话切换,会话自动命名、可重命名、可删除,历史会话随时回溯。
支持创建多个独立会话,每个会话有独立的上下文记忆。系统自动根据首条消息生成会话标题,也可手动重命名。会话列表按更新时间倒序,随时切换或清理。
JWT 鉴权、密码加盐哈希、额度原子扣减,所有接口经过角色鉴权与输入校验。
用户密码使用 bcrypt 加盐哈希存储,JWT Token 签发与会话鉴权,管理后台接口双重角色校验。所有用户输入经 Zod Schema 校验,额度扣减采用数据库原子操作避免并发超扣。
内置写作、编程、翻译等场景模板,一键套用快速开始,支持自定义保存个人模板。
预置覆盖写作、编程、翻译、分析等高频场景的提示词模板,一键填入即可开始高质量对话。你也可以把常用的提示词保存为个人模板,下次直接调用,避免重复输入。