稀土掘金 稀土掘金
    • 首页
    • 沸点
    • 课程
    • APP
    • AI用量
    • 作品广场
    • 专家标注
      • 搜索历史 清空
        • 写文章
        • 发沸点
        • 写笔记
        • 写代码
        • 草稿箱
        创作灵感 查看更多
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
  • 全部
  • 面试
  • 前端
  • Python
  • 产品
  • 设计
  • 微服务
  • 后端
  • Agent
  • 人工智能
  • 展开
  • 全部
  • 面试
  • 前端
  • Python
  • 产品
  • 设计
  • 微服务
  • 后端
  • Agent
  • 人工智能
  • Linux
  • 程序员
  • GitHub
  • AI编程
  • LLM
  • JavaScript
  • 暂无数据
    • 推荐
    • 最新
  • Text2SQL 实战:自然语言直连数据库,让 AI 自动写 SQL 完成 CRUD 与多表联查
    Text2SQL 实战:自然语言直连数据库,让 AI 自动写 SQL 完成 CRUD 与多表联查 一、Text2SQL 是什么? 1.1 从"会写代码"到"会说话" 1.2 Text2SQL 的本质
    • Darling噜啦啦
    • 61
    • 2
    SQL Server LLM
  • LLM 结构化输出进阶:withStructuredOutput 一行封装 Tool Call,从流式输出到 MySQL 落地
    LLM 结构化输出进阶:withStructuredOutput 一行封装 Tool Call,从流式输出到 MySQL 落地 一、回顾:结构化输出的四种方案 1.1 为什么需要结构化输出 1.2 四
    • Darling噜啦啦
    • 23
    • 3
    LLM LangChain
  • 从 SSE 到 LLM 流式输出:搞懂前端实时通信的两种姿势
    从 SSE 到 LLM 流式输出:搞懂前端实时通信的两种姿势 一、为什么需要流式输出? 1.1 传统 HTTP 的痛点 1.2 流式输出的本质 1.3 两种流式输出场景 二、SSE:Server-Se
    • Darling噜啦啦
    • 227
    • 10
    前端 后端 LLM
  • LLM 记忆管理三剑客:截断、总结、检索,彻底搞懂 Agent 的 Memory 系统
    LLM 记忆管理三剑客:截断、总结、检索,彻底搞懂 Agent 的 Memory 系统 一、为什么需要 Memory? 1.1 大模型是无状态的 1.2 Agent 的完整公式 1.3 Memory
    • Darling噜啦啦
    • 123
    • 5
    Agent LangChain LLM
  • AI Agent如何降本?从五层技术栈到三种推理服务
    近日,在白鲸出海主办的全球 AI 出海大会上,卓普云科技解决方案架构师丁可受邀发表主题演讲《AI Agent 落地的 5 层技术栈:Serverless vs Dedicated,全球部署的两种姿势怎
    • DigitalOcean
    • 129
    • 点赞
    LLM Agent
  • GPT-5.6 意味着什么?从 Benchmark 跑分到模型分层,读懂 AI 行业的三个真相
    GPT-5.6 意味着什么?从 Benchmark 跑分到模型分层,读懂 AI 行业的三个真相 前置知识 了解 LLM(大语言模型)的基本概念 了解 Benchmark(基准测试)的基本含义 了解 A
    • Darling噜啦啦
    • 80
    • 8
    LLM
  • 揭秘 LLM 的随机性黑盒:从 Temperature + Top-K 到 LangChain Chain 工作流实战
    揭秘 LLM 的随机性黑盒:从 Temperature + Top-K 到 LangChain Chain 工作流实战 前置知识 了解 LLM 的基本概念(Transformer、Token 生成)
    • Darling噜啦啦
    • 82
    • 9
    LangChain LLM
  • 多款模型最高直降 50%:DigitalOcean 无服务器推理大降价
    对于正在把大模型接入应用的团队来说,模型能力固然重要,但 API 调用成本仍是团队最关心的一项。尤其是 AI 编程、客服机器人、内容生成、代码辅助和 AI Agent 这类高频场景,单次请求便宜几厘钱
    • DigitalOcean
    • 135
    • 点赞
    Agent LLM
  • 从零手写 AI Agent:LLM + Tool + LangChain,打造能干活的大模型
    从零手写 AI Agent:LLM + Tool + LangChain,打造能干活的大模型 前言 ChatGPT 很强大,但当你让它"帮我创建一个 React + Vite 的 TodoList 项
    • Darling噜啦啦
    • 152
    • 7
    LangChain LLM Agent
  • 拆解 LLM 的内部黑盒:从 Token 到 Self-Attention 的逐层解码之旅
    拆解 LLM 的内部黑盒:从 Token 到 Self-Attention 的逐层解码之旅 前言 LLM(大语言模型)看起来像个"黑盒":你输入一段话,它输出一段话。但这个黑盒内部到底发生了什么? 其
    • Darling噜啦啦
    • 141
    • 6
    LLM AIGC
  • LLM 分词与向量化:大模型是如何"读懂"文字的?——Tokenization × Embedding 原理与实战
    LLM 分词与向量化:大模型是如何"读懂"文字的?——Tokenization × Embedding 原理与实战 前言 我们每天都在和 LLM 对话,但有没有想过这样一个问题: 答案藏在两个关键步骤
    • Darling噜啦啦
    • 169
    • 7
    LLM
  • LLM 编排 vs 多 Agent 编排:拆解 Sakana Fugu
    拆解 Sakana Fugu 的原理(Trinity / Conductor / AB-MCTS),厘清多 LLM 编排和多 Agent 编排的边界,以及它能替一套多 agent 系统简化什么。
    • ZzT
    • 289
    • 点赞
    AI编程 LLM
    LLM 编排 vs 多 Agent 编排:拆解 Sakana Fugu
  • LLM 无状态本质与上下文工程:从 Prompt 到 Context 的进化——为什么 AI 总是"失忆"?
    LLM 无状态本质与上下文工程:从 Prompt 到 Context 的进化——为什么 AI 总是"失忆"? 前言 你有没有遇到过这样的困惑: 这不是 AI 笨,而是 LLM 的本质是无状态的。每次调
    • Darling噜啦啦
    • 142
    • 8
    LLM
  • RAG 语义搜索全栈实战:用 Node.js + Embedding 从零构建智能搜索引擎
    RAG 语义搜索全栈实战:用 Node.js + Embedding 从零构建智能搜索引擎 前言 传统搜索靠关键词匹配:搜 "Vue" 只能找到包含 "Vue" 这个词的结果。但如果你搜"前端框架推荐
    • Darling噜啦啦
    • 71
    • 6
    AI编程 LLM
  • RAG实操教程: langchain+Milvus向量数据库创建你的本地知识库
    RAG实操教程: langchain+Milvus向量数据库创建你的本地知识库 本篇文章是 Milvus 向量数据库学习的总结篇,打造自己的知识库系统。 RAG是什么 RAG 是retrieval-a
    • demo007x
    • 7.2k
    • 32
    LLM 程序员 人工智能
    RAG实操教程: langchain+Milvus向量数据库创建你的本地知识库
  • 上下文工程实战:从 Prompt 到 Harness 的三次 AI 工程化浪潮
    上下文工程实战:从 Prompt 到 Harness 的三次 AI 工程化浪潮 前言 这是 2022-2023 年每个 Prompt Engineering 实践者的痛。那时我们以为,只要提示词写得足
    • Darling噜啦啦
    • 185
    • 6
    AI编程 LLM
  • 一篇文章带你学会向量数据库Milvus(二)
    一篇文章带你学会向量数据库Milvus(二) 上一篇文章 一篇文章带你学会向量数据库Milvus(一)我们我们学习了 Milvus 向量数据库的数据库管理,集合管理,schema 管理。这一篇文章我们
    • demo007x
    • 5.9k
    • 5
    后端 LLM 程序员
    一篇文章带你学会向量数据库Milvus(二)
  • DeepSeek V4 Pro + Flash 分工编程:成本骤降 60%+ 的混合模型工作流
    DeepSeek V4 Pro + Flash 分工编程:成本骤降 60%+ 的混合模型工作流 Pro 和 Flash 到底怎么选?全用 Pro 太贵,全用 Flash 怕质量不行。这篇就来聊聊如何用
    • 叫我少年
    • 190
    • 点赞
    LLM
  • Tool Use 底层原理:当"缸中大脑"遇上物理世界——LLM 工具调用的认知哲学与技术实现
    Tool Use 底层原理:当"缸中大脑"遇上物理世界——LLM 工具调用的认知哲学与技术实现 前言 那个在显卡里疯狂跑的 LLM,本质上还是词语接龙的游戏。它是被困在服务器里的缸中大脑——看不见屏幕
    • Darling噜啦啦
    • 86
    • 7
    LLM Agent
  • DigitalOcean 推出大模型自动化评估功能,上线前精准避坑
    在选择投入生产的模型或推理路由器时,光看性能榜单(Leaderboard)远远不够。真正稳妥的做法是:在上线之前,用自己的数据、自己的提示词、自己的评估标准,在同一平台内同时对比质量、延迟和成本,验证
    • DigitalOcean
    • 83
    • 点赞
    Agent LLM
    • 用户协议
    • 营业执照
    • 隐私政策
    • 关于我们
    • 使用指南
    • 友情链接
    • 更多阅读文章
    • 举报邮箱: juejin@bytedance.com
    • 座机电话: 010-83434395
    • 京ICP备18012699号-3
    • 京ICP证:京B2-20191272
    • police 京公网安备11010802026719号
    • ©2026 稀土掘金