首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
全部
人工智能
AI编程
Agent
后端
前端
LLM
AIGC
OpenAI
架构
展开
全部
人工智能
AI编程
Agent
后端
前端
LLM
AIGC
OpenAI
架构
算法
开源
GitHub
Claude
LangChain
JavaScript
暂无数据
推荐
最新
别再背 Chain、Agent、Memory 了:用一条“智能流水线”学会 LangChain
一上来就被术语砸懵了?很正常 😵 刚接触 LangChain 时,我脑子里大概是这样的: “Chain 是链,Agent 是智能体,Memory 是记忆……每个英文单词我都认识,为什么放在一起就看不懂
MCP 入门实战:Tool 和 LLM 解耦?跨进程跨语言调用工具原来是这么回事
你有没有遇到过这样的窘境:用 LangChain 写了一堆 Tool,结果发现只能在当前项目里用?换个项目就得重新拷一遍?更糟糕的是,团队里有人用 Java、有人用 Python···
拆开 Pi Monorepo:改模型、循环、产品和 UI 时,代码应该放在哪一层
拆开 Pi Monorepo:改模型、循环、产品和 UI 时,代码应该放在哪一层 团队准备给 Coding Agent 增加一个新 Provider。最省事的做法,是在主应用里直接写认证、请求体转换和
一次 Agent 失败后,到底该改模型、Prompt 还是 Router?
一次 Agent 失败后,到底该改模型、Prompt 还是 Router? 关键词:Agent 失败归因、Run Trace、Prompt、Router、Regression Eval 目录 Trac
看不见的 Reasoning State,为什么不能拥有看得见的工具权限
看不见的 Reasoning State,为什么不能拥有看得见的工具权限 一次 Agent 工具调用结束后,系统把模型返回的 reasoning、signature 或 encrypted_conte
我让本地 Qwen3.8 27B 搭了一个内网穿透服务
最近看到不少关于 Qwen3.8 的讨论,我也想试一下,于是把 BF16 版本的 Qwen3.8 27B 下载到本地,通过 DeepSeek Harness 调用,并把推理档位设为 xhigh。 我给
Claude 已经给文本加水印了吗?真正缺的不是声明,而是逐模型状态
Claude 已经给文本加水印了吗?真正缺的不是声明,而是逐模型状态 Anthropic 已经公开确认:支持标记的 Claude 模型会把不可见水印嵌入生成文本。这个变化覆盖 Claude API、C
实测:25 万条数据只花 7.04 美元,LLM 批量推理到底有多省?
7 个 JSONL 文件、一个模型访问密钥,以及计算出来的 7.04 美元成本——这就是我们通过 DigitalOcean 统一的 批量推理(Batch Inference)API 对 25 万条真实
Agent 怎么测试:mock LLM + 状态机表驱动,不调真模型的测试策略(第96篇-E82)
上一篇 讲了 Callbacks 回调机制,可以在 Agent 执行的每个环节注入监控。但有一个更根本的问题:怎么测试 Agent? 调真模型太贵、太慢,而且结果不确定。Eino 的测试策略是mock
国产模型越来越强了:DeepSeek V4、Kimi K3 与 GLM 最新进展
DeepSeek V4正式发布,Kimi K3带来原生视觉与百万上下文,GLM Coding Plan全面开放订阅。本文结合官方资料和第三方评测,梳理国产模型最新进展及其与海外头部模型的真实差距。
262K 跑过,128K 却被脚本拦下:A6000 跑分里的三种“失败”不能混为一谈
262K 跑过,128K 却被脚本拦下:A6000 跑分里的三种“失败”不能混为一谈 同一个单卡 A6000 服务,较早的超长上下文探针跑到了目标 262K;几个阶段之后,一次目标 128K 的测试却
质检系统:Agent的自我审查 — 不自检的Agent就像没有编辑的报社
先说结论 LLM 能写出流畅的文章,但不代表文章没问题 — 夸大宣传、敏感词、AI味书面语、内容重复,这些坑 LLM 自己看不见。 没有质检的 Agent,就像一家没有编辑的报社 — 记者写完直接付印
自动扩缩容:KPA/HPA/KEDA 三条路径
第 6 篇你追着请求走完了整条路:VirtualService → ksvc → 推理 Pod。但有个问题一直悬着:Pod 的数量是谁定的?流量翻倍时谁来加 Pod?夜里没人调用时谁来把 GPU 腾出
大模型本地部署神器的瘦身进阶原理,就这两招?
想本地跑大模型却显存告急?llama.cpp 的量化优化算法藏着一门精妙的平衡艺术:混合精度加双重量化,又瘦又精。凭啥又轻又能打?咱们来一探究竟!
长程任务 Agent 为什么总半途而废?PLAN-AND-ACT 用"先规划后动手"给出 SOTA 答案
ICML 2025论文PLAN-AND-ACT提出“规划-执行”双角色分离框架,解决长程Agent因兼顾策略与操作而崩溃的问题。
机器人接入 AI 连续语音后,端云架构要改什么?
机器人接入连续语音后,端云架构要改什么 关键词:机器人语音、WebRTC、端云协同、播放确认、动作安全、Voice Agent 一、先拆三个平面:媒体、交互控制、物理动作 1. 媒体面回答“声音在哪里
流量路由:Istio 与 Knative 的集成
第 5 篇结束时,模型已经躺进 Pod 的 /mnt/models:storage-initializer 下载完,推理容器就绪。但集群外面一条 curl,凭什么能精确命中这个 Pod?中间隔着一整套
DeepSeek Harness 为什么不用 messages 数组保存一切
DeepSeek Harness 为什么不用 messages 数组保存一切 很多 Agent 最初只有一个 messages[]:用户消息追加进去,模型回答追加进去,工具结果也追加进去。上下文太长时
对话式修改:Agent的人机协作模式 — Chat as Interface,对话不是聊天,是最高效的人机协作方式
先说结论 生成一篇文章只需要一次 LLM 调用,但改好一篇文章往往需要多轮对话。 很多人做内容生成 Agent,生成完就结束了 — 用户不满意只能"重新生成",结果每次都是一篇全新的文章,之前的风格、
寻找不花钱的AI算力,看这一篇就够了
现如今,调用各种主流大语言模型(LLM)的API早已成为开发者、科研人员乃至AI爱好者的刚需。不过,对于预算有限的个人开发者或者需要快速验证想法的团队来说,频繁按 Token 计费的小账本积少成多,也