「从零到 AI 应用工程师」专栏 · 第 17 篇 RAG 比纯聊天多了检索,但大头费用往往仍在大模型 token。演示时同一句问十遍、前端重试...
「从零到 AI 应用工程师」专栏 · 第 16 篇 「我觉得挺准」不是工程结论。换个 chunk_size、拧一下阈值,你需要同一套题目告诉你:...
「从零到 AI 应用工程师」专栏 · 第 15 篇 向量检索快,但「向量近」≠「真能回答这个问题」。常见尴尬:涂装标准、待机功耗之类的片段,距离...
「从零到 AI 应用工程师」专栏 · 第 14 篇 RAG 不是幻觉免疫。噪声切片进了 Prompt、模型自作主张补全流程、超纲问题硬聊——都会...
「从零到 AI 应用工程师」专栏 · 第 13 篇 能答还不够。工业场景还要回答:你这话从哪份手册、哪一页来的? references 和 ci...
「从零到 AI 应用工程师」专栏 · 第 12 篇 前面三篇分别解决了:是什么、怎么切、怎么找。今天把它们焊成一个接口:POST /rag/qu...
「从零到 AI 应用工程师」专栏 · 第 11 篇 切片有了,下一步是让计算机「觉得两段话像不像」。Embedding(嵌入)把文本变成定长浮点...
「从零到 AI 应用工程师」专栏 · 第 10 篇 RAG 的第一公里不是向量,是干净的文本。PDF 抽出来乱码、表格碎成渣、手册切成互不相关的...
「从零到 AI 应用工程师」专栏 · 第 9 篇阶段 2 · 储能 RAG 开篇 chat-api 阶段解决的是:会说话的后端。但一问到「我们手...