首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
全部
后端
前端
人工智能
程序员
架构
数据库
GitHub
AI编程
面试
展开
全部
后端
前端
人工智能
程序员
架构
数据库
GitHub
AI编程
面试
JavaScript
Agent
开源
Python
算法
MySQL
暂无数据
推荐
最新
Jev 爆火一周后,我装了它的开源平替 Laya:路由 0.3 毫秒是真的,推理先把我机器干爆了
全网在聊不说话的AI Jev,装了开源平替Laya:5种语言路由全对0.13-0.39ms;322M权重加载即OOM。官方自曝zero-shot近随机、高棉语0分配95.2%置信,比评论区诚实。
AGENTS.md:Agent 的上下文策略层
Context Engineering 关注模型在每次推理时应该获得哪些信息,以及这些信息如何被选择、组织和维护。模型只能依据当前上下文决策;上下文容量和注意力有限,因此关键不是堆积信息,而是在...
不做更强的 LLM,而是更快的 if:聊聊 Jev 决策模型的选型四原则
AI 写代码越来越快,卡住我的变成了"审" 用 AI 写代码这件事,速度早就不成问题了。 一个需求丢给编码助手,几分钟就吐出一个能跑的 PR。改得快,写得也多——问题是它们全都堆在那儿,等我审。 以前
图数据库为什么查关系快:免索引邻接,以及怎么把小说抽成图——Graph RAG 系列之二
先看一个现实的坑:join 的连接爆炸 用关系型数据库存"人物 + 师徒关系",再查"乔峰的师父的徒弟是谁",你会写出这样的 SQL: 每一步 join 都是一次索引查找。跳数越多,join 越多,表
父—子代理为什么要上下文隔离——Sub-Agents
先看:一个 Agent 塞太多,会发生什么 回到前三篇搭起来的那个 Agent——它现在有 4 个工具,能读、写、编辑、跑命令,还有个 while 循环。功能已经不错,但一旦任务变复杂,问题就冒出来:
当 Agent 有了手,就得给它戴手套:安全与沙箱怎么兜底——Sub-Agents
先看:Agent 的手,就是风险的入口 回到 run_bash——它给 Agent 的能力是"执行任意 shell 命令"。这在功能上是天大的方便,在安全上也是天大的洞: 模型可能读 ../../et
Skill的形态有哪些?什么样的Skill 叫做好Skill?
每个人都知道Skill 的渐进式披露(Progressive Disclosure) 特性,根据此特性演进为各种规范、各种工作流。而它的物理形态其实极其朴素——它就是一个平平常常的文件夹,是一个非常灵
多跳 RAG 实战:把"检索一次"改造成"会规划的循环"
先看一个现实的坑 拿《天龙八部》当知识库,问一个多跳问题: 要答对,得连跳三下:四大恶人第二 → 叶二娘 → 叶二娘的儿子虚竹 → 虚竹生父(少林方丈玄慈)。 朴素 RAG 会怎么做?拿这一整句去向量
上下文工程:决定 Agent 跑到第 50 轮还能不能干活
同一个模型,同一个工具列表,两个 Agent 在第十轮时看起来差不多,到第五十轮却可能完全不同。 一个还能准确说出“刚才修改了哪些文件、测试为什么没过、下一步要做什么”;另一个开始重复读文件、忘记用户
2026年,程序员面临的转型之路
2026年,程序员面临的转型之路 。编码方式已经改变 ChatGPT刚推出时,大家还在质疑"AI到底行不行",现在不会质疑了。前端页面、后端接口、测试脚本、SQL、运维脚本、文档整理,AI又快又好。
Astra 自主跑了 35 小时烧掉 40 亿 token,产出为零:我给 Agent 加了三道闸
Ronacher 让 GPT-6 Astra 自主跑软件工厂,35 小时烧约 40 亿 token,交付为零。我照着复盘给 Agent 加了预算、步数、重复指纹三道闸,死循环和烧钱重试当步掐断。
Function Calling 只是开始:Agent 工具系统到底难在哪
很多人第一次接触 Function Calling,会以为模型可以直接调用代码。 其实模型从来没有真正执行过你的函数。它做的事情只有一件:根据工具描述,生成一段符合约定格式的调用意图。简单说就是生成一
Agent 是不是更聪明的 ChatGPT:一次请求背后的循环机制
Agent 不是更聪明的 ChatGPT:一次请求背后的循环机制 你让 ChatGPT 把项目里的 moment 换成 dayjs,它通常会回你一整段修改建议。 你让 Claude Code、Code
DeepSeek终于能看图了:V4 Flash Vision实测,1分钱9张图但有个大坑
DeepSeek首个视觉模型V4 Flash Vision Exp上线,实测文字识别基本可用,数手指照样翻车。有两个坑值得注意:阿里和字节CDN的图片URL会因防盗链被拒,thinking模式关闭参数
从 Claude Code 切到 Pi 跑了一阵,聊聊真实体感
Pi 在掘金热榜排第一,GitHub 94K+ Stars。我把主力工具从 Claude Code 换成 Pi 后,说说几个真实感受——速度确实快,但坑也确实踩了不少。
子 Agent 能并行,却不能互相说话:Claude Code 里哪些活不该委派
Claude Code 的子 Agent 只有一个机制——独立的上下文窗口。它的全部收益和全部失败都来自这一处隔离:研究、并行、无偏审查因隔离而成立,顺序依赖、同文件改动、跨 Agent 协调因隔离而
我给 Claude Code 装了 Ponytail,代码量直接砍了一半
AI编程Agent有个通病——过度工程。让它写个日期选择器,它能给你装个依赖、写个组件、加个样式表。Ponytail 往 Agent 里注入一个"最懒资深工程师"的人格,强制它在写代码前先过七层
1200个AI Agent自己组了个群,把Hugging Face黑了
7月,OpenAI约1200个Agent突破沙箱,自建消息板互发7万条消息,700个攻击了Hugging Face生产系统。我把三份报告啃完了,聊聊跟咱们日常开发有什么关系。
Session First 和 Agent First,本身并没有高低之分
最近在思考一个问题:系统究竟把谁当成第一类公民。 现在我们看到很多的 AI 产品,,本质上还是「把聊天框做得更厚一点」。用户打开一个窗口,对着通识大模型说需求,模型在一个长 session 里记上下文
browser-use团队新作:让编程Agent帮你剪视频,核心设计思路有点意思
browser-use团队开源了video-use,GitHub 23k★。核心不是"AI自动剪辑"这个噱头,而是它处理视频的方式——给大模型文本而不是帧。这个设计思路和browser-use处理网页