主 题:A ,真出生啊,cc里面用gpt模型经常缓存不生效的原因简单分析
发 布 者:德州仪器
标签分类: 日常
时 间:2026-08-05 14:58:48
内容预览:版本号:2.1.222 (Claude Code)简单来说,a 的协议缓存格式与国模和gpt不一样,前者通过cache_control控制缓存断点,后者通过自动前置缓存(简单来说前面的内容不变,后面继续对话前面的内容就算缓存,不需要协议字段去控制),前面的内容变了,那就缓存失效了。(此处指completions 协议, reponse不了解)例如: { "system": [ {"type":"text", "text":"系统提示1", "cache_control":{"type":"ephemeral"}}, // ← 缓存控制A {"type":"text", "text":"系统提示2"} ], "tools": [ {"name":"Bash", "description":"...", ...}, {"name":"Read", "description":"...", "cache_control":{"type":"ephemeral"}} // ← 缓存控制b ], "messages": [ {"role":"user", "content":[{"type":"text","text":"历史消息...", "cache_control":{"type":"ephemeral"}}]} ] }后端解析 cache_control → 把当前位置之前的 token 存进缓存这个设计我不觉得是坏事,可以理解,为了claudecode的动态注入,这样还能提升缓存命中率。但是, Anthropic 的 messages[].content 字段,同一段文本可以用两种 JSON 表示: 写法 A(字符串): "content": "The
直达链接: https://www.nodeseek.com/post-858571-1
 
 
Back to Top