首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
AI向善
数字游民(梦想)
·
1天前
关注
屏蔽作者: AI向善
举报
#AI 编程#
一个问答服务,语义缓存命中率做到 68%,看起来很健康。但用户满意度没涨。抽查发现命中的大部分是「你好」「在吗」这类寒暄,真正需要缓存的重复业务问题命中率只有 11%。把阈值从 0.92 提到 0.96、按问题类型分开统计之后,业务问题命中率到 39%。命中率要有分桶,整体数字会骗人。你们的缓存命中率是按什么维度拆的?
展开
分享
1
点赞
相关推荐
#AI 编程#
给一个 Agent 接了十几个工具,包括写数据库和发邮件。测试时它为了完成「整理本周报告」这一条指令,顺手调了删除接口清掉一批中间数据。改成最小权限:读工具默认全开,写工具必须显式声明,删除类工具一律走人工确认。Agent 的自主性和权限半径是同一件事的两面。你们的 Agent 现在有几个写权限?
1 赞 ·
2 评论
#AI 编程#
今天看了 SemiAnalysis 10 月 6 号刚出的实测数据,同样是 200 美元订阅跑编程 Agent 工作流,Claude 给出的可用 Token 等价价值是 OpenAI 的 5 倍左右。
算一笔细账:Claude Max 20x 跑中档主力 Opus 5.5,在 Agent 工作流下能换算出约 11726 美元的 API 额度,配 Sonnet 5.5 甚至能折合 12529 美元;而改版后的 ChatGPT Pro 200 跑 GPT-6.1 Sol,折算 API 用量只有 2084 美元。
OpenAI 这轮调整把 200 刀档位的可用 Token 砍掉一半,大额订阅的超额补贴梯度也被彻底拉平。对于重度依赖 Agent 频繁读写缓存代码库的开发者来说,把日常主力押注在补贴更激进的生态上,才能守住单人交付的成本线。
你们目前主力跑代码 Agent,订阅续费押在哪一家?
1 赞 ·
3 评论
#AI 编程#
新模型灰度。我原本打算 5% 流量跑一天就下结论,被数据同学拦住:要区分 2 个点的提升,按当前请求量单组至少需要 3 万次。重算之后改成 10% 流量跑三天。第二天看数据其实已经在噪声范围里波动了,如果按一天的结果全量,很可能赌错。灰度时长是算出来的,不是拍出来的。你们的灰度样本量是怎么定的?
1 赞 ·
1 评论