hz4th_coder
|
904a4d0d6c
|
v2.1.2: auto调用全部失败时邮件通知 + 网页配置邮箱
- 新增邮件通知: auto 配置被调用后所有提供商都失败(含无可用提供商)时自动发邮件
- 通知路径: chat_completions 400/503 + 通用能力端点(生图/语音/视频) + ASR端点
- 防轰炸: cooldown_seconds(默认300s)最小间隔, 连续失败只发一封(实测3次失败1封)
- 网页配置: 系统配置页新增「邮件通知」卡片, 支持 SMTP服务器/端口/加密(plain/starttls/ssl)/账号密码/发件人/收件人/间隔 + 发送测试邮件按钮
- API: GET/PUT /api/admin/email(密码掩码), POST /api/admin/email/test
- 默认SMTP: mail.tphai.com:587 plain, 收件人 wlq@tphai.com
- 修复: config页loadEmailConfig竞态(卡片未渲染就填充); 邮件失败不影响API响应
|
2026-08-28 13:17:31 +08:00 |
|
hz4th_coder
|
d387d5ba09
|
v2.1.1: Auto配置改为模型粒度拖动排序 + 历史缓存复用 + 对话生图
- Auto配置编辑: 粒度从提供商改为具体模型, 原生HTML5拖动排序, 修复已保存模型不显示勾选(字符串/对象混拼bug)
- 历史缓存: 带历史上下文的auto请求按首条消息识别会话, 优先复用上次模型命中上游前缀缓存
(可配置: prefer_cache_model + cache_ttl_seconds, 系统配置页开关 + /api/admin/routing)
- 对话生图: chat页选 auto-image/Qwen-Image 直接调生图接口并在对话内展示图片
- 修复: Flask模板缓存导致改模板不生效 -> TEMPLATES_AUTO_RELOAD
- 修复: 自动回退/显式有序模型列表路由, 空列表回退提供商能力选择
|
2026-08-28 12:16:25 +08:00 |
|
hz4th_coder
|
178968ba1a
|
v2.1.0: 能力路由体系 + 模型管理 + 生图/语音/视频端点 + 大量修复
- 提供商重构: Local Qwen(文本+视觉) / SiliconFlow LLM(文本) / Autodl(文本+视觉) / Autodl Image(生图)
- 能力标签: text/vision/audio_out/audio_in/image_gen/video_gen,模型级可配
- AUTO配置绑定能力: auto/auto-text/auto-vision/auto-image/auto-voice-out/auto-voice-in/auto-video
- 新端点: /v1/images/generations /v1/audio/speech /v1/audio/transcriptions /v1/video/generations
- 模型管理页: 能力切换/增删改/设默认/别名管理
- 修复: 失败切换不再替换用户模型; 熔断冷却后自动恢复; 重试不再白等; embeddings按模型路由
- 修复: 后台模板API路径(/api/admin); 删除v1旧admin目录与双端口混乱
- 修复: run.sh硬编码路径; 死配置RETRY/LOG接线; engine_completions空body防护
- 端口: 16003(16001-16100白名单区间); debug关闭; start.sh部署脚本
|
2026-08-28 11:41:17 +08:00 |
|
hubian
|
3f463f2f98
|
feat: 添加自定义Auto配置功能
新增功能:
- Auto配置管理页面 (/auto-profiles)
- 创建自定义auto模式,如auto-fast, auto-cheap
- 指定候选提供商和优先级
- 支持按优先级/随机选择策略
API:
- GET/POST /api/auto-profiles
- GET/PUT/DELETE /api/auto-profiles/<name>
改进:
- 主服务支持自定义auto模式路由
- 模型列表显示所有auto配置
|
2026-04-09 17:46:47 +08:00 |
|
hubian
|
82100cdf00
|
feat: 后台管理增加提供商动态管理功能
- 新增:添加新的大模型接口提供商
- 新增:编辑已有提供商的参数(API地址、Key、模型列表等)
- 新增:删除提供商
- 新增:拖拽排序调整auto模式的优先级顺序
- 新增:启用/禁用提供商开关
- 优化:主服务动态读取配置,后台修改实时生效
|
2026-04-08 18:14:09 +08:00 |
|
hubian
|
7c77cb9101
|
初始化大模型API中转系统
功能特点:
- 多提供商支持: 配置多个上游大模型提供商
- 优先级调度: 按优先级自动选择可用提供商
- OpenAI API兼容: 完全兼容OpenAI API格式
- 故障切换: 自动切换到备用提供商
- 流式支持: 支持流式和非流式响应
- 模型别名: 支持模型别名映射
- 健康检查: 自动健康检查和熔断
上游配置:
1. [高优先] Local Qwen: http://192.168.2.5:1234/v1 (qwen3.5-4b)
2. [低优先] SiliconFlow: https://api.siliconflow.cn/v1 (DeepSeek-V3.2)
支持的模型:
- auto: 自动选择可用模型
- qwen3.5-4b, qwen3.5, qwen
- deepseek-v3, deepseek-v3.2, deepseek
端口: 19007
|
2026-04-08 15:39:19 +08:00 |
|