-
v0.2.0 Stable
released this
2026-07-12 17:48:28 +08:00 | 34 commits to main since this releaseAdded
- AI 网关模型黑名单:面板集中拉黑模型,全渠道剔除(模型列表 / 路由 / 探测候选不再出现,同步不入库),移除条目并重新同步后恢复;新表
ai_model_blacklists(启动自动迁移),管理接口/api/v1/ai-blacklist - AI 密钥模型白名单:密钥可限定放行的模型列表(空 = 不限),白名单外调用 404,模型列表只返回交集
- 推理力度(effort)直通:Responses
reasoning.effort与 Anthropic Messagesoutput_config.effort原样透传上游、不做档位校验;grok-4.3 五档(none完全关闭思考)、gpt-ossminimal-high、multi-agentxhigh(控制并行 agent 数)实测生效 - xAI Grok 服务端工具:
/ai/v1/responses的tools支持{"type":"web_search"}/{"type":"x_search"}(官方 Agent Tools 格式,可与function混用,仅非流式),响应保留web_search_call输出项与引用
Changed
- AI 网关对话链路整体切换到 OCI OpenAI 兼容面(
/actions/v1/responses),typed chat 面全链路移除:/ai/v1/responses请求体原样直通(仅强制store:false),流式为上游原生事件流,gpt-oss 推理增量直达客户端;/ai/v1/messages转换为 Responses 请求直通,流式经事件桥转回标准 Anthropic 事件序列,stop_sequences/top_k等无兼容面对应物的字段改为静默忽略,思考输出不转thinking块;渠道探测改用兼容面最小请求;流式建立后绑定渠道,中断不重试不计熔断 - 后台任务「立即执行」改异步触发:接口立即返回 202,执行结果经任务日志轮询呈现;同一任务在途时重复触发返回 409「任务正在执行中」,与 cron 重叠触发静默跳过(此前同步阻塞数十秒且同一任务可并发重复执行)
- 渠道探测候选跨厂商分散(上限 8,voice 等不可对话形态排除):单一厂商在区域内全为微调基座时不再拖垮整个渠道的探测结论
- 网关调用遇「模型不可按需调用」类错误(微调基座 400 / 实体不存在 404)自动换渠道重试且不计入渠道熔断,错误信息带模型名便于加入黑名单;仅鉴权类错误才判定租户无配额
- 同名模型多条目去重优先保留非微调基座条目,降低缓存到不可调用 OCID 的概率
Removed
/ai/v1/chat/completions端点移除(404):OpenAI 官方新能力已集中到 Responses 且本面板真实流量为零,请迁移/ai/v1/responses或/ai/v1/messages- google / cohere 对话模型不再供给(OCI OpenAI 兼容面不承接,上游 400;cohere embed 向量模型不受影响),模型目录按
xai./meta./openai.厂商前缀过滤
Fixed
- 渠道「同步模型成功但探测报错不可用」:法兰克福等区域的微调基座模型占满探测候选导致的误报(探测状态与真实可用性不符的根因)
- 租户删除:告警命中清理改子查询,日志事件数万条时不再超出 SQL 绑定变量上限导致删除失败;无法解析的任务 payload 记警告跳过并保留原任务,不再永久阻断租户删除
Downloads
- AI 网关模型黑名单:面板集中拉黑模型,全渠道剔除(模型列表 / 路由 / 探测候选不再出现,同步不入库),移除条目并重新同步后恢复;新表