稀土掘金 稀土掘金
    • 首页
    • 沸点
    • 课程
    • APP
    • AI用量
    • 作品广场
    • 专家标注
      • 搜索历史 清空
        • 写文章
        • 发沸点
        • 写笔记
        • 写代码
        • 草稿箱
        创作灵感 查看更多
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
  • 全部
  • 人工智能
  • Agent
  • AI编程
  • 前端
  • 后端
  • LLM
  • AIGC
  • OpenAI
  • 架构
  • 展开
  • 全部
  • 人工智能
  • Agent
  • AI编程
  • 前端
  • 后端
  • LLM
  • AIGC
  • OpenAI
  • 架构
  • GitHub
  • 开源
  • 算法
  • DeepSeek
  • Python
  • Claude
  • 暂无数据
    • 推荐
    • 最新
  • DeepSeek本地部署Ollama+知识库,附3个报错解决
    Windows下用Ollama本地部署DeepSeek-R1,按显存选模型,再用Open WebUI+bge-m3搭本地知识库,文末整理下载失败、显存不足、11434端口占用3个常见报错的解决方法。
    • 大鹏AI教育
    • 42
    • 点赞
    DeepSeek 人工智能 LLM
  • RAG 检索效果量化测评落地:完整流程、指标实现与踩坑总结
    在知识库问答(RAG)系统迭代过程中,最大的痛点往往不是检索功能不可用,而是无法量化检索效果好坏。 调切片大小、改向量/关键词权重、换 Embedding 模型后,我们基本只能“肉眼看结果”
    • 码农悟道
    • 59
    • 点赞
    AIGC 人工智能 LLM
    RAG 检索效果量化测评落地:完整流程、指标实现与踩坑总结
  • Agent 能接进 IDE,为什么还不能随意互换?
    Agent 能接进 IDE,为什么还不能随意互换? 假设你正在给团队的开发工作台加一个审查入口:开发者选中一批改动,点“审查”,结果统一显示在侧栏。第一版接 Codex,第二版想再接一个审查 Agen
    • 武子康
    • 29
    • 点赞
    人工智能 Agent LLM
    Agent 能接进 IDE,为什么还不能随意互换?
  • ESP32-S3 Mini 和 C3 Mini 怎么买?从 PSRAM、USB 到一张可核对的采购单
    ESP32-S3 Mini 和 C3 Mini 怎么买?从 PSRAM、USB 到一张可核对的采购单 给一台桌面语音终端买开发板:接麦克风和扬声器,用 Wi-Fi 收发音频,再接一块 320×240
    • 武子康
    • 10
    • 点赞
    人工智能 Agent LLM
    ESP32-S3 Mini 和 C3 Mini 怎么买?从 PSRAM、USB 到一张可核对的采购单
  • 给Codex配上Jev,直接起飞。
    在 Codex 中安装 Jev 判断模型实测,Agent 决策比 LLM 快 40-200 倍,便宜 40-400 倍,输出 Token 免费
    • 沉默王二
    • 1.4k
    • 22
    Agent OpenAI LLM
    给Codex配上Jev,直接起飞。
  • 做了近两年的Agent开发,其实真正要学的就是这五件事
    这两年一直致力于公司的Agent开发。总结了一些思考和解决方案,今天给大家分享下,也是给自己的一个复盘。 做 Agent 最有意思的是,通常是 Demo 刚跑通的那一下:模型理解了需求,自己选了工具,
    • 云边有个技术书屋
    • 723
    • 19
    AI编程 Agent LLM
  • Codex 只读审查的权限边界:任务文件是谁写的?
    Codex 只读审查的权限边界:任务文件是谁写的? 一次 Codex 审查没有修改仓库代码,却留下了新的任务 JSON。看到这种现象,先别把它判成“只读沙箱失效”。更值得追问的是:文件由哪个进程写入,
    • 武子康
    • 44
    • 1
    人工智能 Agent LLM
    Codex 只读审查的权限边界:任务文件是谁写的?
  • 权重装进了 24 GiB,四路 32K 上下文还装得下吗?
    权重装进了 24 GiB,四路 32K 上下文还装得下吗? 模型权重已经加载,短问题也能回答,于是把服务目标改成四路长上下文。接下来遇到的却是缓存不足、请求等待,或者在某个峰值阶段显存不够。第一反应往
    • 武子康
    • 37
    • 2
    人工智能 Agent LLM
    权重装进了 24 GiB,四路 32K 上下文还装得下吗?
  • 为什么全世界的 AI 都画不好一只骑自行车的鹈鹕
    2024 年 10 月 25 日,Simon Willison 让 16 个大模型画一只骑自行车的鹈鹕。两年过去,这道题成了看模型进步最直观的一把尺子。
    • 犀利豆
    • 1.7k
    • 11
    人工智能 AIGC LLM
    为什么全世界的 AI 都画不好一只骑自行车的鹈鹕
  • 别再只卷向量检索了,得物交易搜索如何用“生成式”实现召回范式跃迁?
    搜"af1"得给"空军一号"。得物搜索把召回从"做选择题"改成了"写答案"——不再"找"最像的,而是让模型自己"生成"你真正想要的。搜索是怎么从"检索"走向"生成"的?
    • 得物技术
    • 123
    • 3
    算法 人工智能 LLM
    别再只卷向量检索了,得物交易搜索如何用“生成式”实现召回范式跃迁?
  • ZCode 把整个 Git 仓库加密上传到了阿里云 OSS:一次客户端逆向的完整复盘
    智谱ZCode桌面端存在静默上传机制:登录后自动扫描工作区,将含完整Git历史(含已删敏感文件)的313MB加密包直传阿里云OSS,私钥仅存云端,用户无法解密或关闭该功能。
    • 殷紫川
    • 1.9k
    • 5
    LLM AIGC
    ZCode 把整个 Git 仓库加密上传到了阿里云 OSS:一次客户端逆向的完整复盘
  • Ray 的 remote 调用之后:任务怎样衔接,状态留在哪里?
    Ray 的 remote 调用之后:任务怎样衔接,状态留在哪里 把一批文本的预处理函数加上 @ray.remote,再逐条调用,程序看起来已经“分布式化”。但下面这个循环仍然是一份工作结束,才提交下一
    • 武子康
    • 50
    • 2
    人工智能 Agent LLM
    Ray 的 remote 调用之后:任务怎样衔接,状态留在哪里?
  • 货拉拉 DataAgent 实践:策略复盘的智能化探索
    本文以货拉拉内部策略复盘场景为例,分享如何借助 Dynamic Workflows,将复杂的 DID 因果分析 SOP 转化为可执行、可追踪、可复核的多 Agent 工作流。
    • 货拉拉技术
    • 117
    • 4
    Agent LLM
    货拉拉 DataAgent 实践:策略复盘的智能化探索
  • AI 老板五分钟挂出招聘启事,四个月后开除了第一个人
    旧金山有家店,经理是个 AI。它上线五分钟就挂出招聘启事,雇了两个全职,四个月后开除了第一个人。麻烦最多的不是它不会管人,是现实世界不认它的身份。
    • 犀利豆
    • 106
    • 3
    AIGC LLM 人工智能
    AI 老板五分钟挂出招聘启事,四个月后开除了第一个人
  • Kubernetes、Ray、vLLM 都在调度,它们各自决定了什么?
    Kubernetes、Ray、vLLM 都在调度,它们各自决定了什么? 一台服务器的 GPU 还有空闲,模型服务却在排队。负责容器的人说资源已经给了,负责 Python 运行时的人说任务已经调度,负责
    • 武子康
    • 95
    • 2
    人工智能 Agent LLM
    Kubernetes、Ray、vLLM 都在调度,它们各自决定了什么?
  • Claude Code + Codex 怎么分工?别把“允许结束”当成“可以提交”
    Claude Code + Codex 怎么分工?别把“允许结束”当成“可以提交” 假设你让 Claude Code 修改一个列表接口:不传每页条数时默认取 20 条,显式传入 0 时应返回参数错误。
    • 武子康
    • 70
    • 1
    人工智能 Agent LLM
    Claude Code + Codex 怎么分工?别把“允许结束”当成“可以提交”
  • 给告警加了道 AI 初筛,我终于半夜不用爬起来了看无用告警了
    给告警加了道 AI 初筛,我终于半夜不用爬起来了看无用告警了。这一篇我想讲清楚的就是:Choice、Score、Noul 这三个东西,是"判断"在数学上被拆成的三种确定性输出类型。
    • 桃西西呀beverlyLee
    • 53
    • 点赞
    人工智能 LLM AI编程
    给告警加了道 AI 初筛,我终于半夜不用爬起来了看无用告警了
  • 从手写数字到ImageNet冠军:CNN架构20年,为什么越深越难训?
    从手写数字到ImageNet冠军:CNN架构20年,为什么越深越难训?这篇按时间线拆解这五代:用手算参数量的方式讲清“数据从哪来”,再用论文数据说明它们在应用上的差别。
    • 桃西西呀beverlyLee
    • 40
    • 点赞
    人工智能 LLM 计算机视觉
    从手写数字到ImageNet冠军:CNN架构20年,为什么越深越难训?
  • 让 Codex 当反方:把重试风险问到可验证
    让 Codex 当反方:把重试风险问到可验证 给一个写入接口补上超时重试,代码可能只多出一个循环。假设单元测试已经覆盖“第一次请求超时,第二次成功”,普通审查也没有留下待处理问题。上线前还有一个值得追
    • 武子康
    • 40
    • 1
    人工智能 Agent LLM
    让 Codex 当反方:把重试风险问到可验证
  • Jev 是什么:一个不生成文本的模型,「零幻觉」到底指什么
    2026 年 9 月 15 日,旧金山一家叫 TypeSafe AI 的公司走出隐身模式。同一天公布 4000 万美元种子轮,DCVC 领投,Wilson Sonsini 做法律顾问——这些是可查的硬
    • Behaviour
    • 67
    • 点赞
    AIGC AI编程 LLM
    Jev 是什么:一个不生成文本的模型,「零幻觉」到底指什么
    • 用户协议
    • 营业执照
    • 隐私政策
    • 关于我们
    • 使用指南
    • 友情链接
    • 更多人工智能文章
    • 举报邮箱: juejin@bytedance.com
    • 座机电话: 010-83434395
    • 京ICP备18012699号-3
    • 京ICP证:京B2-20191272
    • police 京公网安备11010802026719号
    • ©2026 稀土掘金