稀土掘金 稀土掘金
    • 首页
    • 沸点
    • 课程
    • APP
      • 搜索历史 清空
        • 写文章
        • 发沸点
        • 写笔记
        • 写代码
        • 草稿箱
        创作灵感 查看更多
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
  • 全部
  • 人工智能
  • Agent
  • AI编程
  • 后端
  • 前端
  • LLM
  • AIGC
  • OpenAI
  • Claude
  • 展开
  • 全部
  • 人工智能
  • Agent
  • AI编程
  • 后端
  • 前端
  • LLM
  • AIGC
  • OpenAI
  • Claude
  • 架构
  • 算法
  • LangChain
  • JavaScript
  • 开源
  • GitHub
  • 暂无数据
    • 推荐
    • 最新
  • 从 Prompt 工程到知识库驱动:一次自动化率跌至 6% 后的架构反思
    航司政策解析自动化率跌至6%,根因是静态Prompt硬编码知识。本文复盘四大架构缺陷,论证向RAG知识库驱动转型。
    • 王大大的刀
    • 33
    • 1
    架构 人工智能
  • Claude Opus 5 系统提示词被完整泄露,共 135027 字符、约 3.4 万 token
    Claude 当前运行在 Anthropic 运营的网页或移动聊天界面中,即 claude.ai 或 Claude App。这些是 Anthropic 面向消费者的主要交互界面,用户可以通过它们交流。
    • Cosolar
    • 457
    • 4
    人工智能 架构 后端
    Claude Opus 5 系统提示词被完整泄露,共 135027 字符、约 3.4 万 token
  • 从三条路径到一个 AnalysisSession:一次代码诊断架构的合流实录
    SmartBench 曾同时存在多个完整实验链路。本文复盘如何用共享 AnalysisSession 统一仓库快照与事实边界,以及这次合流解决了什么、仍未解决什么。
    • 闲余生
    • 25
    • 点赞
    架构 人工智能
  • 七月,一个德国开发者在评论区甩了个链接
    AI agent 在长会话里会"漂移"。你说过的规则它忘了,约定的检查它跳过,输出的文件它说写了其实没有。这不是某一个模型的问题。
    • YuhaoLin2005
    • 2.8k
    • 17
    架构 LLM
  • 推荐系统体验的数字化突破:得物自动化评测平台的技术实践|AICon 文章整理
    「得物推荐 AI Harness 工程化实践系列」的末篇内容,本系列共三篇连载。本篇(末篇)详解得物推荐评测平台的完整技术体系:从主观体验量化到大模型自动化评测流水线,涵盖多维度指标设计、人机协作提示
    • 得物技术
    • 92
    • 点赞
    算法 架构 LLM
    推荐系统体验的数字化突破:得物自动化评测平台的技术实践|AICon 文章整理
  • RAG 核心概念与原理:Chunking、Embedding、相似度、HNSW 与多路召回|得物技术
    决定 RAG 效果的关键不在大模型,而是文本切块、查询改写、多路召回与精排。合理切块存好知识库内容,向量匹配抓语义、BM25 匹配关键词互补。先优化用户提问,快速召回一批相关文档,再用精排模型精细筛选
    • 得物技术
    • 372
    • 8
    LLM 算法 架构
    RAG 核心概念与原理:Chunking、Embedding、相似度、HNSW 与多路召回|得物技术
  • 人均配了AI, 为什么公司还是没变快? 🤔 本质还是分布式系统问题
    给个人配AI能加速3到10倍,但组织整体的产出周期几乎不变——问题不在"人"这个节点上,在"人和人之间的协作依赖"这条边上。这篇文章用三条分布式系统的老定律讲清楚原因,再给一套不管你是leader还是
    • HiSt
    • 2.4k
    • 22
    后端 前端 架构
    人均配了AI, 为什么公司还是没变快? 🤔 本质还是分布式系统问题
  • 倒腾2天,我开源了一款AI驱动的实时 3D CAD / 参数化建模工作台
    做这款开源项目的主要目的,是想帮助大家,用大白话就能生成可交互的 Three.js 商业级 3D 模型,同时能支持多模型供应商、在线 API Key、模型导入、贴图上传与实时属性编辑等能力。
    • 徐小夕
    • 853
    • 11
    前端 GitHub 架构
    倒腾2天,我开源了一款AI驱动的实时 3D CAD / 参数化建模工作台
  • MCP 从 stdio 迁到 SSE,踩了 5 个传输层坑
    连不上、连上就断、断了不知道、并发状态串了、报错信息被吃了。从 stdio 换到 SSE,以为只是改个 transport,结果五个坑等着。
    • 独立开发阿平
    • 73
    • 点赞
    后端 人工智能 架构
    MCP 从 stdio 迁到 SSE,踩了 5 个传输层坑
  • 【保姆级实测】llama.cpp Windows 免编译极速部署:下载、运行与核心参数全解析
    很多人在本地跑 `llama.cpp` 时,不是卡在编译,而是卡在“版本选错、DLL 缺失、参数不清、模型来源混乱”。这篇只聚焦 **GitHub Releases 免编译路径**,并补齐 **模型检
    • iDao技术魔方
    • 10k
    • 3
    架构 开源 人工智能
  • MCP Server 权限边界工程实践:OAuth、最小权限与工具沙箱,别让 Agent 拿到整台机器
    MCP 让 Agent 接工具变得很快,但生产风险也随之集中到权限边界上。本文用五层模型拆解入口身份、资源授权、工具白名单、执行沙箱与审计回放,并给出 TypeScript policy engine、scope、manifest 与上线检查清单,帮助团队避免让 Agent 拿到整台机器。
    • AINative软件工程
    • 52
    • 点赞
    AI编程 LLM 架构
    MCP Server 权限边界工程实践:OAuth、最小权限与工具沙箱,别让 Agent 拿到整台机器
  • Agent Harness 越堆越烂?600 次实验推翻"自进化",个人场景下更适合"自驯化"
    很多人给 AI Agent 加规则、加记忆、加 hook,想着靠 Harness 迭代让模型越来越强。但用久了发现不对劲——规则越堆越多,模型反而开始无视约束,管线越来越臃肿。
    • YuhaoLin2005
    • 101
    • 2
    架构 人工智能
  • OpenClaw:从“19万星标”到“行业封杀”,这只“赛博龙虾”究竟触动了谁的神经?
    最近科技圈最躁动的名字,非 OpenClaw 莫属。 一方面,它在GitHub上狂揽19万星标,被无数极客奉为“自ChatGPT以来最让人兴奋的项目”,仿佛预示着AI权力的下放。另一方面,它接连遭到M
    • CoovallyAIHub
    • 11k
    • 33
    架构 算法 GitHub
    OpenClaw:从“19万星标”到“行业封杀”,这只“赛博龙虾”究竟触动了谁的神经?
  • 得物推荐系统诊断 Agent:从 “调接口” 到 “会思考”|AICon 演讲整理
    本文是得物技术专家在 AICon 上海演讲整理的技术实录。 「得物推荐 AI Harness 工程化实践系列」的中篇内容,本系列共三篇连载。本篇(中篇)进一步详解得物推荐复杂业务场景下,AI代码从生成
    • 得物技术
    • 468
    • 1
    算法 人工智能 架构
    得物推荐系统诊断 Agent:从 “调接口” 到 “会思考”|AICon 演讲整理
  • AI Agent 架构原理详解:从一次提问到任务完成的完整闭环
    Agent 到底是什么,它和普通大模型对话有何不同? 很多人第一次接触大模型时,得到的体验是「聊天」:你问一句,模型答一句。这种形态下,大模型(LLM)本质上只是一个会思考、会生成文本的「大脑」
    • Cosolar
    • 142
    • 2
    后端 架构 人工智能
    AI Agent 架构原理详解:从一次提问到任务完成的完整闭环
  • 33 个 AI 专家全票通过?我用真实人物的文档化原则,替代了泛用 Prompt
    用真实人物(Torvalds、Carmack、Norman)的文档化原则替代泛用 prompt 审 AI 输出,建路由表自动调度 33 人专家池,用 Python 脚本机械执法规则。
    • YuhaoLin2005
    • 136
    • 1
    架构 人工智能
  • 从狂野代码到按目标生产:得物推荐 AI Harness 的工程化实践|AICon 演讲整理
    本文是得物技术专家在 AICon 上海演讲整理的技术实录。 「得物推荐 AI Harness 工程化实践系列」的开篇内容,本系列共三篇连载。将系统拆解得物推荐复杂业务场景下,AI代码从生成、防护校验到
    • 得物技术
    • 925
    • 9
    架构 算法 人工智能
    从狂野代码到按目标生产:得物推荐 AI Harness 的工程化实践|AICon 演讲整理
  • 输出层与反分词(Output Layer & Detokenization)
    1. LM Head($W_{\text{out}}$):隐藏状态到词表空间的投影 1.1 四要素概括 要素 内容 为什么 $L$ 层 Transformer 输出的隐藏向量 $(n, d)$ 是模型
    • Kel
    • 39
    • 点赞
    架构 算法 人工智能
  • 先拷问,再开工:grill-me + Trellis 重塑我的 Claude Code 工作流
    先拷问,再开工:grill-me + Trellis 重塑我的 Claude Code 工作流 一、问题:AI 总是带着错误假设狂奔 用过 Claude Code 的同学大概都经历过这样的场景
    • hypoy
    • 1.9k
    • 3
    AI编程 架构
    先拷问,再开工:grill-me + Trellis 重塑我的 Claude Code 工作流
  • 得物 OceanBase 落地实践
    得物是全球领先的集正品潮流电商和潮流生活社区于一体的新一代潮流生活方式平台。复杂的业务场景和极致的用户体验追求,对数据库运维和选型提出了更高要求。
    • 得物技术
    • 472
    • 1
    数据库 架构 分布式
    得物 OceanBase 落地实践
  • 晚上好!
    点亮在社区的每一天
    • 用户协议
    • 营业执照
    • 隐私政策
    • 关于我们
    • 使用指南
    • 友情链接
    • 更多人工智能文章
    • 举报邮箱: juejin@bytedance.com
    • 座机电话: 010-83434395
    • 京ICP备18012699号-3
    • 京ICP证:京B2-20191272
    • police 京公网安备11010802026719号
    • ©2026 稀土掘金