稀土掘金 稀土掘金
    • 首页
    • 沸点
    • 课程
    • APP
    • AI用量
    • 作品广场
    • 专家标注
      • 搜索历史 清空
        • 写文章
        • 发沸点
        • 写笔记
        • 写代码
        • 草稿箱
        创作灵感 查看更多
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
  • 全部
  • 面试
  • 前端
  • Linux
  • Python
  • 产品
  • 设计
  • 微服务
  • Agent
  • 人工智能
  • 展开
  • 全部
  • 面试
  • 前端
  • Linux
  • Python
  • 产品
  • 设计
  • 微服务
  • Agent
  • 人工智能
  • 后端
  • Java
  • GitHub
  • 程序员
  • LLM
  • 算法
  • 暂无数据
    • 推荐
    • 最新
  • RK3588 使用 rk-llama.cpp + RKNPU2 部署 Qwen3.5:从零开始的 NPU 本地大模型实战
    一块 8GB 的 RK3588 开发板,可以把 Qwen3.5-2B 做成局域网里的模型服务:浏览器直接聊天,程序通过 `/v1/chat/completions` 调用,部分计算交给板载 NPU。
    • 刘马想放假
    • 310
    • 点赞
    LLM 人工智能 开源
    RK3588 使用 rk-llama.cpp + RKNPU2 部署 Qwen3.5:从零开始的 NPU 本地大模型实战
  • DeepSeek V4.1 Flash 现已上线 DigitalOcean:更强 Agent,更低推理成本
    DeepSeek 最新发布的 DeepSeek-V4.1-Flash 现已上线 DigitalOcean AI 推理平台,开发者可以直接通过 DigitalOcean 无服务器推理(Serverles
    • DigitalOcean
    • 293
    • 点赞
    LLM
  • 闪学it-Linux云计+AIOps大模型
    一、Linux:云计算的母语 Linux 不是一门需要“学完”的课,而是一种需要养成的手感。 真正要刻进肌肉记忆的,只有四件事: 文件:一切皆文件,包括设备和网络套接字 进程:谁在跑,谁在等,谁在吃
    • 闪学it_学ke
    • 55
    • 点赞
    LLM
  • 从 SSE 到 LLM 流式输出:搞懂前端实时通信的两种姿势
    从 SSE 到 LLM 流式输出:搞懂前端实时通信的两种姿势 一、为什么需要流式输出? 1.1 传统 HTTP 的痛点 1.2 流式输出的本质 1.3 两种流式输出场景 二、SSE:Server-Se
    • Darling噜啦啦
    • 349
    • 13
    前端 后端 LLM
  • Text2SQL 实战:自然语言直连数据库,让 AI 自动写 SQL 完成 CRUD 与多表联查
    Text2SQL 实战:自然语言直连数据库,让 AI 自动写 SQL 完成 CRUD 与多表联查 一、Text2SQL 是什么? 1.1 从"会写代码"到"会说话" 1.2 Text2SQL 的本质
    • Darling噜啦啦
    • 159
    • 3
    SQL Server LLM
  • LLM 结构化输出进阶:withStructuredOutput 一行封装 Tool Call,从流式输出到 MySQL 落地
    LLM 结构化输出进阶:withStructuredOutput 一行封装 Tool Call,从流式输出到 MySQL 落地 一、回顾:结构化输出的四种方案 1.1 为什么需要结构化输出 1.2 四
    • Darling噜啦啦
    • 76
    • 4
    LLM LangChain
  • LLM 记忆管理三剑客:截断、总结、检索,彻底搞懂 Agent 的 Memory 系统
    LLM 记忆管理三剑客:截断、总结、检索,彻底搞懂 Agent 的 Memory 系统 一、为什么需要 Memory? 1.1 大模型是无状态的 1.2 Agent 的完整公式 1.3 Memory
    • Darling噜啦啦
    • 159
    • 5
    Agent LangChain LLM
  • AI Agent如何降本?从五层技术栈到三种推理服务
    近日,在白鲸出海主办的全球 AI 出海大会上,卓普云科技解决方案架构师丁可受邀发表主题演讲《AI Agent 落地的 5 层技术栈:Serverless vs Dedicated,全球部署的两种姿势怎
    • DigitalOcean
    • 152
    • 点赞
    LLM Agent
  • GPT-5.6 意味着什么?从 Benchmark 跑分到模型分层,读懂 AI 行业的三个真相
    GPT-5.6 意味着什么?从 Benchmark 跑分到模型分层,读懂 AI 行业的三个真相 前置知识 了解 LLM(大语言模型)的基本概念 了解 Benchmark(基准测试)的基本含义 了解 A
    • Darling噜啦啦
    • 99
    • 9
    LLM
  • 揭秘 LLM 的随机性黑盒:从 Temperature + Top-K 到 LangChain Chain 工作流实战
    揭秘 LLM 的随机性黑盒:从 Temperature + Top-K 到 LangChain Chain 工作流实战 前置知识 了解 LLM 的基本概念(Transformer、Token 生成)
    • Darling噜啦啦
    • 91
    • 9
    LangChain LLM
  • 多款模型最高直降 50%:DigitalOcean 无服务器推理大降价
    对于正在把大模型接入应用的团队来说,模型能力固然重要,但 API 调用成本仍是团队最关心的一项。尤其是 AI 编程、客服机器人、内容生成、代码辅助和 AI Agent 这类高频场景,单次请求便宜几厘钱
    • DigitalOcean
    • 160
    • 点赞
    Agent LLM
  • 从零手写 AI Agent:LLM + Tool + LangChain,打造能干活的大模型
    从零手写 AI Agent:LLM + Tool + LangChain,打造能干活的大模型 前言 ChatGPT 很强大,但当你让它"帮我创建一个 React + Vite 的 TodoList 项
    • Darling噜啦啦
    • 181
    • 7
    LangChain LLM Agent
  • LLM 分词与向量化:大模型是如何"读懂"文字的?——Tokenization × Embedding 原理与实战
    LLM 分词与向量化:大模型是如何"读懂"文字的?——Tokenization × Embedding 原理与实战 前言 我们每天都在和 LLM 对话,但有没有想过这样一个问题: 答案藏在两个关键步骤
    • Darling噜啦啦
    • 180
    • 7
    LLM
  • LLM 编排 vs 多 Agent 编排:拆解 Sakana Fugu
    拆解 Sakana Fugu 的原理(Trinity / Conductor / AB-MCTS),厘清多 LLM 编排和多 Agent 编排的边界,以及它能替一套多 agent 系统简化什么。
    • ZzT
    • 301
    • 点赞
    AI编程 LLM
    LLM 编排 vs 多 Agent 编排:拆解 Sakana Fugu
  • 拆解 LLM 的内部黑盒:从 Token 到 Self-Attention 的逐层解码之旅
    拆解 LLM 的内部黑盒:从 Token 到 Self-Attention 的逐层解码之旅 前言 LLM(大语言模型)看起来像个"黑盒":你输入一段话,它输出一段话。但这个黑盒内部到底发生了什么? 其
    • Darling噜啦啦
    • 160
    • 6
    LLM AIGC
  • RAG实操教程: langchain+Milvus向量数据库创建你的本地知识库
    RAG实操教程: langchain+Milvus向量数据库创建你的本地知识库 本篇文章是 Milvus 向量数据库学习的总结篇,打造自己的知识库系统。 RAG是什么 RAG 是retrieval-a
    • demo007x
    • 7.2k
    • 32
    LLM 程序员 人工智能
    RAG实操教程: langchain+Milvus向量数据库创建你的本地知识库
  • LLM 无状态本质与上下文工程:从 Prompt 到 Context 的进化——为什么 AI 总是"失忆"?
    LLM 无状态本质与上下文工程:从 Prompt 到 Context 的进化——为什么 AI 总是"失忆"? 前言 你有没有遇到过这样的困惑: 这不是 AI 笨,而是 LLM 的本质是无状态的。每次调
    • Darling噜啦啦
    • 152
    • 8
    LLM
  • RAG 语义搜索全栈实战:用 Node.js + Embedding 从零构建智能搜索引擎
    RAG 语义搜索全栈实战:用 Node.js + Embedding 从零构建智能搜索引擎 前言 传统搜索靠关键词匹配:搜 "Vue" 只能找到包含 "Vue" 这个词的结果。但如果你搜"前端框架推荐
    • Darling噜啦啦
    • 76
    • 6
    AI编程 LLM
  • 一篇文章带你学会向量数据库Milvus(二)
    一篇文章带你学会向量数据库Milvus(二) 上一篇文章 一篇文章带你学会向量数据库Milvus(一)我们我们学习了 Milvus 向量数据库的数据库管理,集合管理,schema 管理。这一篇文章我们
    • demo007x
    • 5.9k
    • 5
    后端 LLM 程序员
    一篇文章带你学会向量数据库Milvus(二)
  • 上下文工程实战:从 Prompt 到 Harness 的三次 AI 工程化浪潮
    上下文工程实战:从 Prompt 到 Harness 的三次 AI 工程化浪潮 前言 这是 2022-2023 年每个 Prompt Engineering 实践者的痛。那时我们以为,只要提示词写得足
    • Darling噜啦啦
    • 204
    • 6
    AI编程 LLM
    • 用户协议
    • 营业执照
    • 隐私政策
    • 关于我们
    • 使用指南
    • 友情链接
    • 更多阅读文章
    • 举报邮箱: juejin@bytedance.com
    • 座机电话: 010-83434395
    • 京ICP备18012699号-3
    • 京ICP证:京B2-20191272
    • police 京公网安备11010802026719号
    • ©2026 稀土掘金