$V2EX
Solana
Give SOL to Copy Address
使用 SOL 向 heimoshuiyu 打赏,数额会 100% 进入 heimoshuiyu 的钱包。
 heimoshuiyu's recent timeline updates
heimoshuiyu

heimoshuiyu

V2EX member #456629, joined on 2019-12-01 14:35:05 +08:00
Today's activity rank 3567
heimoshuiyu's recent replies
Sep 26
Replied to a topic by Mmiracle110 › OpenAI › We need a reset, Tibo.
i need rest
Aug 19
Replied to a topic by madou › 问与答 › 求便宜好用 vibe coding 麦克风
dji mic mini 2
例如学生成绩管理系统,先从 agent 交互、mcp 、skill 、a2a 交互做起,就是 ai 原生,一切以 agent 交互为出发点。从表的增删改查接口做起,就是传统应用。
yes
有次改一行 api 配置,把 URL 中的 paas (platform as a service) 抄成了 pass, 排查了一个小时才发现问题。从那以后再简单的事情也会交给 agent 做
自建 gonic, 客户端花点 token 自己写一个看着顺眼用的顺手的
@JackalZhao 我认为 “输出侧 tokens” 属于本应缓存命中的部分,而多数 provider 没缓存。关注缓存命中率的话你看不出这个问题,看未命中 tokens 就能发现这个问题,如我图所示,每一次请求的未命中 tokens 都大于上一次请求的输出 tokens 。

另外,假如某个 provider 缓存临时故障,缓存命中率只会下降几个点,被使用习惯的噪声淹没。而未命中缓存指标会有一个非常显眼的凸起
@winnerczwx 我指 gpt5.5 0.3% 是输出侧 token 存在缓存的概率。一次 API 调用包括输入 + 输出两个部分,调用完成后,deepseek 会将输入 + 输出缓存起来,而 gpt 只缓存到输入。因此用户实际上为输出 token 多付了一份输入未命中的钱。

92.7% 这个数值很难说明什么。平时使用的平均会话上下文偏长,这个数值很容易就能刷高。这也是我建议不要使用「缓存命中率」的原因。另外,ccswitch 存在消息重排序破坏缓存的草台 bug github.com/farion1231/cc-switch/issues/3934
好奇为啥无法使用有线连接?
应该看 prompt 次数,token 数容易受到上下文长度的影响
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   1108 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 22ms · UTC 17:16 · PVG 01:16 · LAX 10:16 · JFK 13:16
♥ Do have faith in what you're doing.