填写 Endpoint 与 Key 后点击连接,可从列表选择模型,也可手动输入 Model ID
列表选择会写入 Model ID;也可只手填任意模型名
开启后会在发送前合并/降级多条 system 消息,避免部分本地模型的 Jinja 模板报错。
Use an OpenAI-compatible /audio/speech API. Browser speech is used as fallback.
Pure frontend calls may be blocked by CORS. Fish Audio usually needs a proxy or backend relay.
首次使用需下载模型文件,建议 Wi-Fi 环境。需要浏览器支持 WebGPU。
默认 20 条。建议至少设为 12~30 以上。数值太小会导致自动总结很难正常工作(需要给最近消息留缓冲空间)。
This will be injected into the prompt as your character setting / background (similar to a character's Description).
第一阶段专注正文;第二阶段独立生成选项与小提示。
关闭更适合生成选项或小提示;开启会额外发送上一轮主回复/第二阶段回复、当前用户消息和本轮正文,适合状态栏或记忆模块。
开启后会尝试解析兼容模型返回的 reasoning_content / thinking / <think> 内容。
如果消息保存了 cot 字段,会在助手回复旁以折叠块显示。
Prompts and dynamic markers follow the selected SillyTavern prompt order.
开启后,当对话气泡数量达到下方“触发阈值”时自动总结旧内容并移除原始注入。
建议值:设为上下文长度的 50%~70% 左右(例如上下文 20 条,阈值建议 12~14)。 中途修改阈值后会尝试立即响应(尤其是调低时)。阈值太接近或超过上下文长度,效果会变差。
0为不限制(内部请求约6k token输出预算)。设置数值时会在总结提示末尾追加字数约束。若填写自定义总结提示词,将覆盖内置基础提示词。过长片段仍可能受模型输出上限影响,建议搭配阈值使用或选支持长输出的模型。
留空时使用内置总结提示词;填写后覆盖内置提示词,字数限制仍会追加到末尾。
IndexedDB 保存主数据;小型快照会定期镜像到 OPFS / localStorage。
移除已导入的聊天背景图,恢复默认背景动画。不影响对话、角色卡与其它设置。
数据找不到了?点击扫描可检测 OPFS / localStorage / 旧版 IndexedDB(仅主动扫描时读取旧 IDB)。
Limit total tokens injected from World Book entries per generation
选择聊天界面的视觉风格,不影响聊天、总结、世界书或模型设置。
开启后暂停背景动画、关闭玻璃模糊效果,可显著降低手机 GPU 负载与发热。随时可关闭。
启用后在助手消息气泡上方显示角色小头像(头像在左、名字在右,与导航栏相同图片);无图片时显示名称首字母。默认关闭。
启用后在助手气泡下方显示本轮输入/输出 Token 与生成速度。仅控制界面显示;有 API 数据时仍会写入消息,旧消息无数据则不显示。默认关闭。
启用后,按 Cmd+Enter(或 Ctrl+Enter)提交消息;单独按 Enter 会换行。默认开启。
仅对「新出现的 token」播放进入动画(不重播已有文字)。效能模式或系统「减少动态效果」开启时自动关闭。含状态栏/选项卡等结构化内容时回退为普通渲染。
Token 批次:每个流式增量整段动画一次。字符:增量内逐字 stagger。
生成过程中若超过该时间未收到新内容,将自动中断并尽量保存已生成部分。设为 0 可关闭超时。默认 45 秒。
连接本机 ComfyUI,通过导入 API workflow 手动生成图片并附加到聊天。
点击对应模型按钮后将开始下载(首次较慢,建议 Wi-Fi)。
请保持页面打开,不要锁屏或切换标签页过久。下载完成后即可使用本地推理。
Supports SillyTavern chara_card_v1 / v2 / v3 format JSON and PNG (embedded data) files.
只处理 extensions.regex_scripts,不执行卡片脚本;首次启用会要求确认。
使用本网站前,请阅读并确认以下内容
请先勾选“我已阅读并理解上述免责声明”后再关闭。
在卡片库直接点击角色卡也可开始新对话或群聊
角色变更从下一次回复开始生效,不会修改已有消息。
请至少保留一个角色。