稀土掘金 稀土掘金
    • 首页
    • 沸点
    • 课程
    • APP
    • AI用量
    • 作品广场
    • 专家标注
      • 搜索历史 清空
        • 写文章
        • 发沸点
        • 写笔记
        • 写代码
        • 草稿箱
        创作灵感 查看更多
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
  • 全部
  • 人工智能
  • AI编程
  • Agent
  • 后端
  • 前端
  • LLM
  • AIGC
  • OpenAI
  • 架构
  • 展开
  • 全部
  • 人工智能
  • AI编程
  • Agent
  • 后端
  • 前端
  • LLM
  • AIGC
  • OpenAI
  • 架构
  • 算法
  • 开源
  • GitHub
  • Claude
  • LangChain
  • JavaScript
  • 暂无数据
    • 推荐
    • 最新
  • 别再背 Chain、Agent、Memory 了:用一条“智能流水线”学会 LangChain
    一上来就被术语砸懵了?很正常 😵 刚接触 LangChain 时,我脑子里大概是这样的: “Chain 是链,Agent 是智能体,Memory 是记忆……每个英文单词我都认识,为什么放在一起就看不懂
    • Dragon_xjy
    • 52
    • 点赞
    Python LangChain LLM
    别再背 Chain、Agent、Memory 了:用一条“智能流水线”学会 LangChain
  • MCP 入门实战:Tool 和 LLM 解耦?跨进程跨语言调用工具原来是这么回事
    你有没有遇到过这样的窘境:用 LangChain 写了一堆 Tool,结果发现只能在当前项目里用?换个项目就得重新拷一遍?更糟糕的是,团队里有人用 Java、有人用 Python···
    • 溴化钾
    • 38
    • 1
    MCP LLM Agent
  • 拆开 Pi Monorepo:改模型、循环、产品和 UI 时,代码应该放在哪一层
    拆开 Pi Monorepo:改模型、循环、产品和 UI 时,代码应该放在哪一层 团队准备给 Coding Agent 增加一个新 Provider。最省事的做法,是在主应用里直接写认证、请求体转换和
    • 武子康
    • 33
    • 点赞
    人工智能 Agent LLM
    拆开 Pi Monorepo:改模型、循环、产品和 UI 时,代码应该放在哪一层
  • 一次 Agent 失败后,到底该改模型、Prompt 还是 Router?
    一次 Agent 失败后,到底该改模型、Prompt 还是 Router? 关键词:Agent 失败归因、Run Trace、Prompt、Router、Regression Eval 目录 Trac
    • 武子康
    • 36
    • 1
    人工智能 Agent LLM
    一次 Agent 失败后,到底该改模型、Prompt 还是 Router?
  • 看不见的 Reasoning State,为什么不能拥有看得见的工具权限
    看不见的 Reasoning State,为什么不能拥有看得见的工具权限 一次 Agent 工具调用结束后,系统把模型返回的 reasoning、signature 或 encrypted_conte
    • 武子康
    • 46
    • 1
    人工智能 Agent LLM
    看不见的 Reasoning State,为什么不能拥有看得见的工具权限
  • 我让本地 Qwen3.8 27B 搭了一个内网穿透服务
    最近看到不少关于 Qwen3.8 的讨论,我也想试一下,于是把 BF16 版本的 Qwen3.8 27B 下载到本地,通过 DeepSeek Harness 调用,并把推理档位设为 xhigh。 我给
    • jump_jump
    • 52
    • 2
    LLM AI编程 人工智能
  • Claude 已经给文本加水印了吗?真正缺的不是声明,而是逐模型状态
    Claude 已经给文本加水印了吗?真正缺的不是声明,而是逐模型状态 Anthropic 已经公开确认:支持标记的 Claude 模型会把不可见水印嵌入生成文本。这个变化覆盖 Claude API、C
    • 武子康
    • 57
    • 1
    人工智能 Agent LLM
    Claude 已经给文本加水印了吗?真正缺的不是声明,而是逐模型状态
  • 实测:25 万条数据只花 7.04 美元,LLM 批量推理到底有多省?
    7 个 JSONL 文件、一个模型访问密钥,以及计算出来的 7.04 美元成本——这就是我们通过 DigitalOcean 统一的 批量推理(Batch Inference)API 对 25 万条真实
    • DigitalOcean
    • 36
    • 点赞
    LLM Agent
  • Agent 怎么测试:mock LLM + 状态机表驱动,不调真模型的测试策略(第96篇-E82)
    上一篇 讲了 Callbacks 回调机制,可以在 Agent 执行的每个环节注入监控。但有一个更根本的问题:怎么测试 Agent? 调真模型太贵、太慢,而且结果不确定。Eino 的测试策略是mock
    • leeyi
    • 36
    • 点赞
    Agent AIGC LLM
    Agent 怎么测试:mock LLM + 状态机表驱动,不调真模型的测试策略(第96篇-E82)
  • 国产模型越来越强了:DeepSeek V4、Kimi K3 与 GLM 最新进展
    DeepSeek V4正式发布,Kimi K3带来原生视觉与百万上下文,GLM Coding Plan全面开放订阅。本文结合官方资料和第三方评测,梳理国产模型最新进展及其与海外头部模型的真实差距。
    • Shepherd
    • 878
    • 5
    LLM AI编程 人工智能
    国产模型越来越强了:DeepSeek V4、Kimi K3 与 GLM 最新进展
  • 262K 跑过,128K 却被脚本拦下:A6000 跑分里的三种“失败”不能混为一谈
    262K 跑过,128K 却被脚本拦下:A6000 跑分里的三种“失败”不能混为一谈 同一个单卡 A6000 服务,较早的超长上下文探针跑到了目标 262K;几个阶段之后,一次目标 128K 的测试却
    • 武子康
    • 39
    • 1
    人工智能 Agent LLM
    262K 跑过,128K 却被脚本拦下:A6000 跑分里的三种“失败”不能混为一谈
  • 质检系统:Agent的自我审查 — 不自检的Agent就像没有编辑的报社
    先说结论 LLM 能写出流畅的文章,但不代表文章没问题 — 夸大宣传、敏感词、AI味书面语、内容重复,这些坑 LLM 自己看不见。 没有质检的 Agent,就像一家没有编辑的报社 — 记者写完直接付印
    • 修远客
    • 25
    • 点赞
    Agent LLM
    质检系统:Agent的自我审查 — 不自检的Agent就像没有编辑的报社
  • 自动扩缩容:KPA/HPA/KEDA 三条路径
    第 6 篇你追着请求走完了整条路:VirtualService → ksvc → 推理 Pod。但有个问题一直悬着:Pod 的数量是谁定的?流量翻倍时谁来加 Pod?夜里没人调用时谁来把 GPU 腾出
    • 众人皆醒我独醉
    • 36
    • 点赞
    面试 LLM Kubernetes
  • 大模型本地部署神器的瘦身进阶原理,就这两招?
    想本地跑大模型却显存告急?llama.cpp 的量化优化算法藏着一门精妙的平衡艺术:混合精度加双重量化,又瘦又精。凭啥又轻又能打?咱们来一探究竟!
    • 蛋先生DX
    • 50
    • 点赞
    Ollama LLM LLaMA
    大模型本地部署神器的瘦身进阶原理,就这两招?
  • 长程任务 Agent 为什么总半途而废?PLAN-AND-ACT 用"先规划后动手"给出 SOTA 答案
    ICML 2025论文PLAN-AND-ACT提出“规划-执行”双角色分离框架,解决长程Agent因兼顾策略与操作而崩溃的问题。
    • 殷紫川
    • 30
    • 2
    Agent LLM AI编程
    长程任务 Agent 为什么总半途而废?PLAN-AND-ACT 用"先规划后动手"给出 SOTA 答案
  • 机器人接入 AI 连续语音后,端云架构要改什么?
    机器人接入连续语音后,端云架构要改什么 关键词:机器人语音、WebRTC、端云协同、播放确认、动作安全、Voice Agent 一、先拆三个平面:媒体、交互控制、物理动作 1. 媒体面回答“声音在哪里
    • 武子康
    • 40
    • 1
    人工智能 Agent LLM
    机器人接入 AI 连续语音后,端云架构要改什么?
  • 流量路由:Istio 与 Knative 的集成
    第 5 篇结束时,模型已经躺进 Pod 的 /mnt/models:storage-initializer 下载完,推理容器就绪。但集群外面一条 curl,凭什么能精确命中这个 Pod?中间隔着一整套
    • 众人皆醒我独醉
    • 39
    • 点赞
    面试 Kubernetes LLM
  • DeepSeek Harness 为什么不用 messages 数组保存一切
    DeepSeek Harness 为什么不用 messages 数组保存一切 很多 Agent 最初只有一个 messages[]:用户消息追加进去,模型回答追加进去,工具结果也追加进去。上下文太长时
    • 武子康
    • 77
    • 1
    人工智能 Agent LLM
    DeepSeek Harness 为什么不用 messages 数组保存一切
  • 对话式修改:Agent的人机协作模式 — Chat as Interface,对话不是聊天,是最高效的人机协作方式
    先说结论 生成一篇文章只需要一次 LLM 调用,但改好一篇文章往往需要多轮对话。 很多人做内容生成 Agent,生成完就结束了 — 用户不满意只能"重新生成",结果每次都是一篇全新的文章,之前的风格、
    • 修远客
    • 24
    • 点赞
    Agent LLM
    对话式修改:Agent的人机协作模式 — Chat as Interface,对话不是聊天,是最高效的人机协作方式
  • 寻找不花钱的AI算力,看这一篇就够了
    现如今,调用各种主流大语言模型(LLM)的API早已成为开发者、科研人员乃至AI爱好者的刚需。不过,对于预算有限的个人开发者或者需要快速验证想法的团队来说,频繁按 Token 计费的小账本积少成多,也
    • 卷无止境
    • 96
    • 点赞
    LLM
  • 上午好!
    点亮在社区的每一天
    • 用户协议
    • 营业执照
    • 隐私政策
    • 关于我们
    • 使用指南
    • 友情链接
    • 更多人工智能文章
    • 举报邮箱: juejin@bytedance.com
    • 座机电话: 010-83434395
    • 京ICP备18012699号-3
    • 京ICP证:京B2-20191272
    • police 京公网安备11010802026719号
    • ©2026 稀土掘金