首页
沸点
课程
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
关注
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
排行榜
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
全部
人工智能
AI编程
Agent
后端
前端
LLM
AIGC
OpenAI
Claude
展开
全部
人工智能
AI编程
Agent
后端
前端
LLM
AIGC
OpenAI
Claude
架构
算法
LangChain
JavaScript
开源
Python
暂无数据
推荐
最新
又一个顶级 AI 终端诞生了!Kaku 开源,实测安装配置+分屏对决
Kaku 是 Pake 作者 tw93 开源的 AI 终端,基于 WezTerm 深度定制,内置命令修复、自然语言转命令和 AI 聊天面板。
# 第3章 记忆系统:构建Agent的长短期记忆
人类之所以能进行复杂的对话和决策,是因为我们有记忆。同样,一个实用的Agent也需要记忆能力——它需要记住之前的对话、积累的知识、以及用户偏好。本章将深入探讨如何为Agent构建完整的长短期记忆系统。
全网都在吹的 Kimi K3,到底怎么样?
国产最贵、速度还慢,凭什么还是国产之光?Kimi K3 前端能力全球第一梯队,长任务处理稳,还是开源模型,这次是真敢跟顶尖闭源模型掰手腕了。
AI编程入门教程02-LLM发展历程,AI 御四家十年风云:OpenAI 分裂、Anthropic 出走、谷歌掉队、马斯克上桌
AI 编程入门教程第 2 章,一文讲清国外 AI 御四家的十年发展脉络:Transformer 诞生、OpenAI 内部分裂、Anthropic 出走、谷歌起了大早赶了晚集、马斯克 xAI
第4章 规划与推理:赋予Agent思考的能力
记忆让Agent拥有知识,但知识本身不能解决问题。Agent需要"思考"——面对一个复杂任务,它能分解步骤、选择策略、发现错误并自我纠正。这就是规划与推理的核心价值。 4.1 任务分解:ReAct框架
别只盯着最强模型了,Agent 场景更该看这类 Flash 档模型
最近,GLM 5.2 接连刷屏,国产模型又热闹起来了。 加上 DeepSeek V4、MiniMax M3,还有阶跃星辰的 Step-3.7-Flash,国产大模型这一波可以说是你追我赶,热度一下子又
Harness 企业级落地(二) - 让 AI 读懂项目
AI Harness,助你成为 AI 全栈开发! git submodule + domain init,以及对 AI 的一些思考
别被模型宣传骗了,真实 Agent 任务一跑就知道
最近这段时间,国内外模型更新得很快。 如果只看发布会和榜单,大家都会觉得每个模型都很强。参数更大、上下文更长、推理更强、价格更低,听起来都挺猛。 但真正用到工作流里,会发现另一件事:模型强不强,不只看
Agent任务实测:谁能稳定跑完,谁只是看起来很强?
最近这段时间,国内外模型更新得很快。 如果只看发布会和榜单,大家都会觉得每个模型都很强。参数更大、上下文更长、推理更强、价格更低,听起来都挺猛。 但真正用到工作流里,会发现另一件事:模型强不强,不只看
GPT-Red:自动化红队如何形成 Agent 安全数据飞轮(4 个闭环 + 6 类评测指标 + 5 类风险误读)
GPT-Red:自动化红队如何形成 Agent 安全数据飞轮 TL;DR 场景:OpenAI 2026-07-15 公布内部使用的红队模型 GPT-Red。它把自动化红队从一次性 Benchmark
从“看图说话”到“动手干活”:看看国产多模态模型在生产场景下的真实表现
现在,大家对基础模型能力诉求越来越高了,不再满足文本输入,而是混合输入。 比如一张界面截图、一份业务图表、一页扫描合同、一张发票等,模型不仅要能看懂文件中的内容,还要能把内容变成可执行的步骤、提取结构
GPT-5.5+Codex!夯爆了,夯中夯。
你好,我是 Guide。先算一笔账:**ChatGPT Plus 套餐 $20/月,现在可以直接用 GPT-5.5**。Claude Opus 4.6/4.7 呢?Pro 套餐同样是$20/月。 相同
ChatGPT取消5小时限额,Codex终于可以疯狂造起来了!Anthropic最严厉的父亲来了!
OpenAI 暂时取消 Plus、Business、Pro 套餐的 5 小时使用限制,Codex 随便用。同时梳理近期 AI 模型大乱斗:Fable 5 被迫第三次延长、Grok 4.5 翻身
FDE 到底是什么:为什么 AI 时代重新需要前线部署工程师(4 个标准 + 8 类风险 + 10 个问题)
TL;DR 场景:OpenAI / Anthropic / Google Cloud / Databricks / Glean 等公司同期都扩大 FDE / Forward Deployed 类岗位,
Java 后端 → 实时语音 AI 转型复盘:4 个 FDE 技术底座 + 6 个差距 + 6 类职业资产路线
TL;DR 场景:Java 后端工程师转入机器人创新中心负责实时语音 AI 模块,链路跨越端侧音频、WebRTC、Go/Python 网关、ASR/LLM/TTS、机器人播放与动作、首音等端到端指标
第2章 大脑构建:提示词工程与思维链
如果说Agent的架构是骨骼,那么提示词就是大脑中的神经元连接。一个好的提示词能让模型从"差不多"变成"精确可控",而思维链(Chain of Thought)则让模型从"直觉反应"升级为"逻辑推理"
MCP Client实战翻车记:两个Server同时跑,AI调错了Tool
我当时就是觉得"两个 search 应该没关系吧"——结果查了接近两小时才发现是这个原因。这个亏吃一次就够了。
40% 的 Multi-Agent 项目在生产挂掉:任务分发、结果聚合与级联失败防护的工程实践
--- 2026 年 5 月,arxiv 上出现了一篇让人不舒服的论文(2605.03310)。研究者对 1600+ 条执行 trace 分析后得出结论:Multi-Agent LLM 系统的生产失败率在 41%~87% 之间。
体验完阿里「悟空」,我想把电脑里的龙虾换掉了,是真NB!
龙虾漏洞太多...我准备换成企业级、更安全、自由度超高、含阿里生态的悟空,因为悟空有OpenClaw几乎所有的能力,自由度也非常高(可以自定义模型,自定义Skills、MCP)而且更安全,更易用。
vibe coding开发的系统无法运维?全面AI的公司迟早要在这上面跌个大跟头
最近发现了个事儿,准确的说是个隐患:vibe coding开发的系统无法运维! 我不太清楚大家各自的业务目前使用vibe coding的程度,如果你只是当作一种辅助工具来用,应该问题不大...