稀土掘金 稀土掘金
    • 首页
    • 沸点
    • 课程
    • APP
      • 搜索历史 清空
        • 写文章
        • 发沸点
        • 写笔记
        • 写代码
        • 草稿箱
        创作灵感 查看更多
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
  • 全部
  • 人工智能
  • AI编程
  • Agent
  • 后端
  • 前端
  • LLM
  • AIGC
  • OpenAI
  • 架构
  • 展开
  • 全部
  • 人工智能
  • AI编程
  • Agent
  • 后端
  • 前端
  • LLM
  • AIGC
  • OpenAI
  • 架构
  • 算法
  • Claude
  • 开源
  • LangChain
  • JavaScript
  • GitHub
  • 暂无数据
    • 推荐
    • 最新
  • 大模型内部是怎么运作的?从「一个神经元」拆到「残差流」
    从神经元到残差流拆解大模型黑盒:单个神经元难解释(相关≠因果),一层神经元抽出功能向量可操控行为,一群神经元靠「语言模型的模型」简化理解,再用Logit Lens读出模型内心。
    • Kstheme
    • 7
    • 点赞
    算法
    大模型内部是怎么运作的?从「一个神经元」拆到「残差流」
  • 1.2B 小模型赢过 235B 大模型:NaviDC-OCR 把文档解析卷明白了
    🎯 先问一个做 RAG 的人都懂的问题 你的 RAG 系统里塞进去一份 PDF,检索质量还行。然后用户传了张手机拍的合同照片——页面有点弯、有阴影、表格被透视压扁——chunk 切出来一片狼藉,检索直
    • lucas_AI
    • 25
    • 点赞
    算法 人工智能 深度学习
    1.2B 小模型赢过 235B 大模型:NaviDC-OCR 把文档解析卷明白了
  • 深度解读 Anthropic 多智能体报告:更强的模型 ≠ 更好的协调
    这篇《Patterns and problems in emerging multiagent systems》来自 Anthropic 前沿红队(Frontier Red Team),它不是搭建教程
    • GreenTea
    • 65
    • 点赞
    前端 后端 算法
    深度解读 Anthropic 多智能体报告:更强的模型 ≠ 更好的协调
  • BEVdet模型解析
    BEVDet模型是一种基于鸟瞰图(BEV)特征的3D目标检测方法,其核心架构包含四个处理阶段:图像特征提取、视角转换、BEV特征增强和目标检测。
    • 地平线开发者
    • 33
    • 点赞
    自动驾驶 算法
    BEVdet模型解析
  • 重塑 Agent 度量衡:基于 LLM-as-a-Judge 的离线评估体系与实践
    本文构建基于 LLM-as-a-Judge 的 Agent 离线评估体系,结合外呼场景混合 Reference-based 与 GSB 方案,多维度纠偏 Judge 偏见,形成客观高效的评测基准。
    • 货拉拉技术
    • 124
    • 1
    算法 设计模式
    重塑 Agent 度量衡:基于 LLM-as-a-Judge 的离线评估体系与实践
  • Grok 4.6:追平 GPT-5.6 Sol 的半价旗舰,但别只看跑分
    导语:一天三个旗舰,你选谁? 8 月 12 日是个疯狂的日子。DeepSeek V4-Pro 正式 GA,阿里首个开源 Qwen-Max 上线,SpaceXAI(就是那个被 SpaceX 收购后更名的
    • lucas_AI
    • 129
    • 点赞
    算法 人工智能
    Grok 4.6:追平 GPT-5.6 Sol 的半价旗舰,但别只看跑分
  • 用 NVIDIA Nemotron 3 Super + .NET 构建有记忆的多轮对话
    英伟达免费的大模型Nemotron最大的优点就是免费,可商用以及支持单卡部署,极大降低了大模型私有化的难度,鉴于此,咱们就来尝尝鲜吧。由于我手头没有显卡支持,只好退而求其次,使用英伟达免费的线上模型尝
    • webmote33
    • 41
    • 点赞
    后端 算法
    用 NVIDIA Nemotron 3 Super + .NET 构建有记忆的多轮对话
  • Claude Code 源码分析(十):MCP 外部工具如何进入下一轮 Agent 调用
    先设一个运行场景:项目里接了一个名为 project-tracker 的 MCP Server。用户启动 Claude Code 后输入「查询 SHOP-482 的状态」,这时源码里先能看到的,不是某
    • windliang
    • 53
    • 点赞
    前端 面试 算法
  • 开源!我用SQLite + DuckDB打造了一款可视化AI问数平台
    创业的过程中,业务人员每天会产生大量的数据,但受限于技术门槛,无法像数据分析师一样高效地探查数据。于是我花了一周时间,借助Vibe Coding,打造了一款可视化数据分析工具——灵析(AureKa)
    • 徐小夕
    • 657
    • 8
    前端 GitHub 算法
    开源!我用SQLite + DuckDB打造了一款可视化AI问数平台
  • 科研人的 AI,不该只回答问题:我用字节TraeWork 跑了一遍真实研究任务
    先交代一下这次用的工具。TraeWork 是国内很早就推出的专业 AI 办公平台,和一般"问一句答一句"的 AI 工具不太一样:它背后依托的,是团队早在 2025 年 1 月就推出、并且已经做到行业领
    • 致Great
    • 81
    • 点赞
    算法
  • 【OpenClaw具身硬件】MiniClaw 阅读笔记---(1)基础
    【OpenClaw具身硬件】MiniClaw 阅读笔记---(1)基础 0x00 概要 0x01 基本知识 1.1 MimiClaw 核心特色 1.2 核心定位 1.3 应用场景 0x02 设计理念
    • 罗西的思考
    • 81
    • 点赞
    算法 人工智能 机器学习
  • 大模型参数存储格式揭秘:BF不是男朋友
    大模型的参数一般都用 BF16 存储。BF16 是一种浮点数格式,那它到底是怎么存数据的?今天,我们就来扒一扒浮点数那些精妙设计——小数点会漂移、前导位能省则省,一路看到 BF16 上位的真相
    • 蛋先生DX
    • 37
    • 点赞
    LLM 深度学习 算法
    大模型参数存储格式揭秘:BF不是男朋友
  • vLLM-07|MegaMoE 与 FusedMoE:路由相同,算 expert 完全不同
    vLLM-07|MegaMoE 与 FusedMoE:路由相同,算 expert 完全不同。MoE 一层 forward 里,谁负责选 expert、谁负责算 expert,以及 MegaMoE 与
    • 贵慜_Derek
    • 33
    • 点赞
    人工智能 LLM 算法
  • 【Agentic RL / 强化学习 / OPD】Hermes & OPD 源码阅读笔记
    【Agentic RL / 强化学习 / OPD】Hermes & OPD 源码阅读笔记 0x00 概要 0x01 OPD 机制原理 —— "OPD 是什么,怎么工作" 1.1 OPD 的完整数据流
    • 罗西的思考
    • 82
    • 1
    算法 人工智能 机器学习
  • 从“为什么”理解注意力机制
    本文从神经网络的不可解释性出发,系统阐述了注意力机制的工作原理及其在深度学习中的应用。文章首先指出神经网络改进往往基于启发式思想而非严格理论推导,强调注意力机制虽受生物注意力启发,但并非直接模拟人脑
    • 车压
    • 45
    • 点赞
    算法
    从“为什么”理解注意力机制
  • 【征程6】校准量化中HistogramObserver解析
    HistogramObserver是horizon_plugin_pytorch中一种基于直方图统计的量化Observer。
    • 地平线开发者
    • 27
    • 点赞
    算法
    【征程6】校准量化中HistogramObserver解析
  • 1.8%就够了:K3的896个MoE专家,为什么激活率这么低反而是好事?
    掘金的同学们可能对MoE有个直觉误解——"专家越多越好"。K3用896个expert告诉你:关键不是加专家,而是让每个token只激活必要的那些。本文从架构师角度拆解Stable LatentM
    • AICDragon
    • 44
    • 点赞
    算法 人工智能
    1.8%就够了:K3的896个MoE专家,为什么激活率这么低反而是好事?
  • 征程6工具链模型X86推理方式说明
    X86 推理是指 开发机(X86 CPU/GPU)上针对不同阶段的模型:ONNX模型、Hbir模型和hbm模型,进行相应的推理验证。
    • 地平线开发者
    • 29
    • 点赞
    算法
  • 知识图谱实战(一):数据采集与实体关系抽取(完整代码)
    知识图谱实战(一):数据采集与实体关系抽取(完整代码) 前言 上一篇 RAG 系列用向量检索解决"找相似内容",但遇到"任正非和华为是什么关系""华为的产品有哪些"这种精确关系问题,向量检索就力不从心
    • 橘和柠
    • 64
    • 点赞
    算法
  • OpenClaw:从“19万星标”到“行业封杀”,这只“赛博龙虾”究竟触动了谁的神经?
    最近科技圈最躁动的名字,非 OpenClaw 莫属。 一方面,它在GitHub上狂揽19万星标,被无数极客奉为“自ChatGPT以来最让人兴奋的项目”,仿佛预示着AI权力的下放。另一方面,它接连遭到M
    • CoovallyAIHub
    • 11k
    • 33
    架构 算法 GitHub
    OpenClaw:从“19万星标”到“行业封杀”,这只“赛博龙虾”究竟触动了谁的神经?
  • 晚上好!
    点亮在社区的每一天
    • 用户协议
    • 营业执照
    • 隐私政策
    • 关于我们
    • 使用指南
    • 友情链接
    • 更多人工智能文章
    • 举报邮箱: juejin@bytedance.com
    • 座机电话: 010-83434395
    • 京ICP备18012699号-3
    • 京ICP证:京B2-20191272
    • police 京公网安备11010802026719号
    • ©2026 稀土掘金