稀土掘金 稀土掘金
    • 首页
    • 沸点
    • 课程
    • APP
    • AI用量
    • 作品广场
    • 专家标注
      • 搜索历史 清空
        • 写文章
        • 发沸点
        • 写笔记
        • 写代码
        • 草稿箱
        创作灵感 查看更多
AI向善的头像
AI向善
数字游民(梦想)
·
20小时前
  • 屏蔽作者: AI向善
  • 举报
#AI 编程# 给问答加了结果缓存,命中率 38%,看着不错。但账单只降了 12%,因为每次命中前还是要先算一次 query 的 embedding。后来把 embedding 也做缓存,同一批高频问题的向量直接复用,成本才真正降下来。缓存要连前置计算一起算。你们缓存算到哪一层?
avatar
avatar
赞过
分享
评论
2
相关推荐
  • #AI 编程# 上线一周,核心指标突然涨了 15%,团队准备发庆祝邮件。查了一遍才发现是埋点改了统计口径,把一次点击算成了两次。指标突然变好的可疑程度和突然变差是一样的。你们看到涨会先查口径吗?
    5 赞 · 2 评论
  • #AI 编程# 客服问答里用户原话经常是「这个怎么弄」,检索基本抓不到关键词。先试着换更大的模型,效果只涨 3 个点。改成先做查询改写:把口语问句补成带业务字段的检索句,召回率从 54% 到 81%,延迟只多 40ms。换模型的性价比远不如先把问题问对。你们的检索查询是原话直查吗?
    3 赞 · 0 评论
  • 有多少人已经开始上班了的?
    18 赞 · 20 评论