首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
zed_23
掘友等级
iOS高级菜鸟
|
清风酒馆
自律
获得徽章 0
动态
文章
专栏
沸点
收藏集
关注
赞
19
文章 19
沸点 0
赞
19
返回
|
搜索文章
最新
热门
RAG 全链路串起来:一个能答专业问题的问答接口
前面三篇分别解决了:是什么、怎么切、怎么找。 今天把它们焊成一个接口:POST /rag/query——问一句设备运维问题,返回有依据的答案。 一、今天要做出什么 返回里至少有: answer:回答正
向量检索是怎么回事:Embedding + FAISS/pgvector
切片有了,下一步是让计算机「觉得两段话像不像」。 Embedding(嵌入)把文本变成定长浮点向量;向量库负责存和近邻搜索。 一、Embedding 一句话 例子(设备运维场景): 「单体过压告警怎么
从 PDF 到可检索:文档解析与分块实战
RAG 的第一公里不是向量,是干净的文本。 PDF 抽出来乱码、表格碎成渣、手册切成互不相关的半句话——后面 Embedding 再强也是「垃圾进、垃圾出」。 今天两件事:解析(ingest)和分块(
什么是 RAG:让大模型「读懂」你自己的资料
chat-api 阶段解决的是:会说话的后端。 但一问到「我们手册第几页怎么写的」「这个故障码怎么处置」,通用大模型就容易开始编——它训练语料里未必有你的私有文档。 RAG(Retrieval-Aug
给接口加把锁:Bearer Token 鉴权(附冒烟验收)
上一篇用 Docker Compose 把整栈拉起来了。你会发现:几乎每条 curl 都带着这一行—— 却很少有人单独讲清楚:这把锁是怎么挂上的?漏带会发生什么?如何用脚本证明「鉴权真的生效」? ch
一条命令跑通整个后端:Docker Compose 入门
到上一篇,你的对话服务已经有了:接口、分层、统一错误、PostgreSQL 历史、Redis 缓存。 但「在我电脑上能跑」和「别人(或未来的你)十分钟能跑」之间,还差一口气。本机装数据库、改端口、环境
重复问题不花冤枉钱:Redis 缓存怎么加
大模型按 token 计费。同一个问题被问十次,你就付十次——如果每次都老老实实打到模型。 更现实的场景:演示时反复点同一句、前端重试、用户复制粘贴只多打了两个空格……这些都该命中缓存。 今天目标:用
给对话加记忆:用 PostgreSQL 存历史
到现在为止,每次对话都是「问完就忘」。刷新一下、换个客户端,什么都没有。 聊天产品要有历史;排障也要有历史;以后做多轮上下文,更要有历史。 今天目标:用 PostgreSQL 把每次问答落库,并提供
统一异常 + 统一响应,让接口「说人话」
分层之后,下一个痛点很快出现: 成功时你返回: 失败时 FastAPI 默认给你: 参数校验失败又是另一套: 前端要写三套解析;你自己用 curl 排查也难受。更糟的是:有的错误把堆栈、SQL、厂商原
别把代码全塞一个文件:接口分层怎么分
上一篇你已经能 curl 通 /chat 了。庆祝完,问题马上出现: 所有逻辑都在一个 main.py 里——鉴权、校验、调模型、拼返回值。现在还能看懂;等你加「存历史」「做缓存」「失败重试」,这个文
下一页
个人成就
文章被点赞
6
文章被阅读
2,100
掘力值
226
关注了
6
关注者
4
收藏集
4
关注标签
9
加入于
2017-08-04