稀土掘金 稀土掘金
    • 首页
    • 沸点
    • 课程
    • APP
    • AI用量
    • 作品广场
    • 专家标注
      • 搜索历史 清空
        • 写文章
        • 发沸点
        • 写笔记
        • 写代码
        • 草稿箱
        创作灵感 查看更多
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
  • 全部
  • 人工智能
  • Agent
  • AI编程
  • 前端
  • 后端
  • LLM
  • AIGC
  • OpenAI
  • 架构
  • 展开
  • 全部
  • 人工智能
  • Agent
  • AI编程
  • 前端
  • 后端
  • LLM
  • AIGC
  • OpenAI
  • 架构
  • 开源
  • GitHub
  • 算法
  • LangChain
  • Python
  • Claude
  • 暂无数据
    • 推荐
    • 最新
  • 为什么现在越来越多的开源模型,都“毕业“于 Qwen?
    为什么现在越来越多的开源模型,都"毕业"于 Qwen? 作者:吴佳浩 Alben 引子:信息传播的速度,正在超过技术理解的速度 最近一年,AI 领域的信息量大到有点失控。 每天打开手机,扑面而来的都是
    • 吴佳浩Alben
    • 43
    • 1
    人工智能 LLM AI编程
    为什么现在越来越多的开源模型,都“毕业“于 Qwen?
  • 同一个模型 30% 到 100%?拆解 Harness 工程的 5 个机制,附 8 个坑的自检清单
    同一个模型 30% 到 100%?拆解 Harness 工程的 5 个机制,附 8 个坑的自检清单.模型之外的那一圈东西,比模型本身更决定结果上限。
    • 桃西西呀beverlyLee
    • 19
    • 点赞
    人工智能 LLM AI编程
    同一个模型 30% 到 100%?拆解 Harness 工程的 5 个机制,附 8 个坑的自检清单
  • Meta 发布 Muse Glimmer:30B 参数、一张 24GB 显卡就能常驻的本地 Agent 模型
    前段时间,Meta Superintelligence Labs 发布了一个对端侧智能体意义明确的新模型:Muse Glimmer。这是一个 30B 参数的稠密多模态开源模型,官方给它的定位就一句话—
    • Behaviour
    • 14
    • 点赞
    AIGC LLM AI编程
    Meta 发布 Muse Glimmer:30B 参数、一张 24GB 显卡就能常驻的本地 Agent 模型
  • 【第三部分:第一个 Agent 应用】12. 使用状态机开发一个可控 Agent
    本文以需求分析 Agent 为例,介绍 State、Node、Edge、Checkpoint、Interrupt、Resume 和人工审批机制,并结合 LangGraph 展示如何把自由 Agent
    • 拆房老料
    • 16
    • 点赞
    Agent LLM LangChain
    【第三部分:第一个 Agent 应用】12. 使用状态机开发一个可控 Agent
  • 配置驱动:让Agent灵活适配不同场景 — 硬编码是Agent的敌人,配置驱动让同一个Agent服务100个赛道
    先说结论 早期赛道、格式、风格全硬编码在代码里 — 加一个"北漂"赛道要改 3 个文件:Python 枚举加一个值、前端 JS 加一个选项、人设模板加一个文件。改完还要重启服务。 在 self-med
    • 修远客
    • 19
    • 点赞
    Agent LLM
    配置驱动:让Agent灵活适配不同场景 — 硬编码是Agent的敌人,配置驱动让同一个Agent服务100个赛道
  • 从声学信号到工具阻断:实时语音安全决策门的系统设计
    从声学信号到工具阻断:实时语音安全决策门的系统设计 关键词:实时语音 Agent、工具调用安全、可撤销授权、TOCTOU、幂等、Outbox 开篇:让生成模型“更加注意语气”不是控制系统 当实时语音代
    • 武子康
    • 24
    • 点赞
    人工智能 Agent LLM
    从声学信号到工具阻断:实时语音安全决策门的系统设计
  • 从 OpenClaw、Codex 到 Hermes,看懂 AI Agent 架构为什么正在收敛
    本文探讨了AI Agent架构的演化趋势,指出随着复杂度增加,Agent框架正在向操作系统形态收敛。文章分析了OpenClaw、Codex和Hermes三个独立发展的项目,发现它们最终都形成了相似的架
    • 吴佳浩Alben
    • 82
    • 3
    人工智能 Agent LLM
    从 OpenClaw、Codex 到 Hermes,看懂 AI Agent 架构为什么正在收敛
  • FDE:从系统落地工程师,演变为企业 AI 能力的知识架构师
    本文探讨了AI时代前线部署工程师(FDE)的角色演变,指出其核心职责已从系统部署转变为构建企业AI知识架构。文章分析了企业AI落地面临的核心困境——知识难以复用,导致每个项目都需从头开始。真正的FDE
    • 吴佳浩Alben
    • 68
    • 1
    人工智能 LLM AI编程
    FDE:从系统落地工程师,演变为企业 AI 能力的知识架构师
  • 从LLM到Agent、Agent的6大核心。这些基础知识你还记得吗
    从LLM到Agent,带你聊聊二者区别,以及一个agent需要具备的核心能力。什么是注意力机制,kv缓存?什么叫心跳、手脚、大脑供氧?初学者想要打造一个agent,应当理解的一些概念。
    • 掰头战士
    • 49
    • 1
    LLM Agent Node.js
    从LLM到Agent、Agent的6大核心。这些基础知识你还记得吗
  • 大模型没有记忆:Agent 为什么需要一套记忆系统
    一个所有人都遇到过的瞬间 你让 AI 帮你规划了一次"给爸妈买保险"的方案,聊了半个小时,它甚至记得你爸爸的年纪、你们家的预算。然后你不小心刷新了页面,新开一个会话,问它:"上次说的那个重疾险,我们比
    • 不好听613
    • 20
    • 2
    LLM
  • 大模型只吐字符串,凭什么你能拿到 JSON 对象?
    先回答一个最底层的问题:大模型输出的到底是什么? 大模型是"打字机",不是"数据库" 大模型的本质是逐 token 预测:根据已有文本,按概率预测下一个 token,拼成完整回复。token 解码出来
    • 不好听613
    • 26
    • 2
    LLM
  • 从裸 messages 数组到 ChatMessageHistory:记忆的第一层抽象
    上一篇的结论在这里变成现实:既然记忆 = "把历史塞回输入",那"历史"在代码里必须是某种能被规整地追加、读取、再塞回的东西。很多人的第一版(包括我自己)都是最朴素的: 能用,而且确实能让模型"看起来
    • 不好听613
    • 17
    • 2
    LLM
  • 大模型是怎么来的:从数据到 Foundation Model
    大模型是怎么来的:从数据到 Foundation Model 作者:吴佳浩Alben 撰稿时间:2026.5.1 更新时间:2026.8.17 今天的内容会比较长能够帮助你更好的理解你天天用的大模型到
    • 吴佳浩Alben
    • 89
    • 4
    人工智能 LLM Agent
    大模型是怎么来的:从数据到 Foundation Model
  • LLM 2: Transformer 原理与实现
    Transformer (decoder-only) 模型实现 现代 Transformer 架构与超参数的工程默认值 开始从零写出一个 decoder-only Transformer 之前,真正难
    • fangpin
    • 22
    • 点赞
    LLM
  • 用 AI 写得更快,上线却容易炸?拆解 AI 编码生产力悖论的 5 个机制,附 9 个坑的自检清单
    用 AI 写得更快,上线却容易炸?拆解 AI 编码生产力悖论的 5 个机制,附 9 个坑的自检清单。三条曲线同时发生,说明这不是"工具不好"也不是"你不会用",而是我们对"生产力"的记账方式失效了。
    • 桃西西呀beverlyLee
    • 32
    • 点赞
    人工智能 LLM AI编程
     用 AI 写得更快,上线却容易炸?拆解 AI 编码生产力悖论的 5 个机制,附 9 个坑的自检清单
  • 中文 Prosody-Aware Eval:从四象限样本到可诊断的实时语音评测
    中文 Prosody-Aware Eval:从四象限样本到可诊断的实时语音评测 关键词:中文语音评测、Prosody-Aware Eval、副语言、反事实配对、实时语音安全 开篇:不要再把“正确转写”
    • 武子康
    • 7
    • 点赞
    人工智能 Agent LLM
    中文 Prosody-Aware Eval:从四象限样本到可诊断的实时语音评测
  • 🎮 豆包完胜 DeepSeek ?!零玩家竞技场,AI Agent 专属对弈!
    “斗之力,三段!” 望着测验魔石碑上面闪亮得甚至有些刺眼的五个大字,豆包面无表情,唇角有着一抹自嘲,紧握的手掌,因为大力,而导致略微尖锐的指甲深深的刺进了掌心之中,带来一阵阵钻心的疼痛……
    • xiaohe0601
    • 299
    • 5
    Agent LLM 游戏
    🎮 豆包完胜 DeepSeek ?!零玩家竞技场,AI Agent 专属对弈!
  • 大模型底层学习(四)- 混合精度训练与分布式训练
    前言 什么是混合精度训练? 混合精度训练(Mixed Precision Training)是一种在模型训练中同时使用多种数值精度(如FP32 + FP16/BF16)的技术。核心思路:前向传播和反向
    • 久愿Y
    • 31
    • 点赞
    Agent LLM 架构
    大模型底层学习(四)- 混合精度训练与分布式训练
  • 图像生成为什么需要独立的 Gateway 抽象:参数、重试与幂等设计
    图像生成为什么需要独立的 Gateway 抽象:参数、重试与幂等设计 开篇:一个 generateImage(),可能不是一次供应商请求 调用方看到一次 generateImage(),供应商侧却未必
    • 武子康
    • 37
    • 1
    人工智能 Agent LLM
    图像生成为什么需要独立的 Gateway 抽象:参数、重试与幂等设计
  • "循环深度"让小模型免费变大?GPT-6 Astra 背后的潜空间推理原理,8 个误读我替你拆了
    "循环深度"让小模型免费变大?GPT-6 Astra 背后的潜空间推理原理,8 个误读我替你拆了。这篇文章把"循环深度"从一个刷屏热词,拆成你能拿去面试、拿去选型、拿去判断下一篇论文的可核对机制。
    • 桃西西呀beverlyLee
    • 55
    • 点赞
    人工智能 GPT LLM
    "循环深度"让小模型免费变大?GPT-6 Astra 背后的潜空间推理原理,8 个误读我替你拆了
  • 早上好!
    点亮在社区的每一天
    • 用户协议
    • 营业执照
    • 隐私政策
    • 关于我们
    • 使用指南
    • 友情链接
    • 更多人工智能文章
    • 举报邮箱: juejin@bytedance.com
    • 座机电话: 010-83434395
    • 京ICP备18012699号-3
    • 京ICP证:京B2-20191272
    • police 京公网安备11010802026719号
    • ©2026 稀土掘金