前提:
同一个 session id 默认有 5 分钟的 TTL,5 分钟内下次同 session id 的请求会直接使用之前使用的上游渠道,超过 5 分钟后会重新按照评分来选择。
今天遇到一个问题,某次 claude desktop 的请求,在从低价到高价轮询了好几个上游后,才遇到了一个能正确处理的上游,轮询过程化了好几分钟。但由于我中途干别的去了,导致会话超过了 5 分钟的 TTL,等我接着对话时,Optaris 又轮询了一次。
从体验上来说很不好,需要想办法解决。
备注:报错内容是 messages.24.content.0.thinking.citations: Extra inputs are not permitted,检查了下发现 messages 里有一段这个内容:
{
"citations": null,
"text": "",
"type": "thinking",
"signature": "xxxxx",
"thinking": "",
"data": "",
"id": "",
"input": null,
"name": "",
"content": {
"OfWebSearchResultBlockArray": null,
"error_code": "",
"type": "web_search_tool_result_error"
},
"tool_use_id": ""
},
thinking 块按预期是只有三个字段的,不知道为什么 claude desktop 发的内容里多了这些
前提:
同一个 session id 默认有 5 分钟的 TTL,5 分钟内下次同 session id 的请求会直接使用之前使用的上游渠道,超过 5 分钟后会重新按照评分来选择。
今天遇到一个问题,某次 claude desktop 的请求,在从低价到高价轮询了好几个上游后,才遇到了一个能正确处理的上游,轮询过程化了好几分钟。但由于我中途干别的去了,导致会话超过了 5 分钟的 TTL,等我接着对话时,Optaris 又轮询了一次。
从体验上来说很不好,需要想办法解决。
备注:报错内容是
messages.24.content.0.thinking.citations: Extra inputs are not permitted,检查了下发现 messages 里有一段这个内容:thinking 块按预期是只有三个字段的,不知道为什么 claude desktop 发的内容里多了这些