首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
全部
人工智能
Agent
AI编程
前端
后端
LLM
AIGC
OpenAI
架构
展开
全部
人工智能
Agent
AI编程
前端
后端
LLM
AIGC
OpenAI
架构
开源
GitHub
算法
LangChain
Python
Claude
暂无数据
推荐
最新
为什么现在越来越多的开源模型,都“毕业“于 Qwen?
为什么现在越来越多的开源模型,都"毕业"于 Qwen? 作者:吴佳浩 Alben 引子:信息传播的速度,正在超过技术理解的速度 最近一年,AI 领域的信息量大到有点失控。 每天打开手机,扑面而来的都是
同一个模型 30% 到 100%?拆解 Harness 工程的 5 个机制,附 8 个坑的自检清单
同一个模型 30% 到 100%?拆解 Harness 工程的 5 个机制,附 8 个坑的自检清单.模型之外的那一圈东西,比模型本身更决定结果上限。
Meta 发布 Muse Glimmer:30B 参数、一张 24GB 显卡就能常驻的本地 Agent 模型
前段时间,Meta Superintelligence Labs 发布了一个对端侧智能体意义明确的新模型:Muse Glimmer。这是一个 30B 参数的稠密多模态开源模型,官方给它的定位就一句话—
【第三部分:第一个 Agent 应用】12. 使用状态机开发一个可控 Agent
本文以需求分析 Agent 为例,介绍 State、Node、Edge、Checkpoint、Interrupt、Resume 和人工审批机制,并结合 LangGraph 展示如何把自由 Agent
配置驱动:让Agent灵活适配不同场景 — 硬编码是Agent的敌人,配置驱动让同一个Agent服务100个赛道
先说结论 早期赛道、格式、风格全硬编码在代码里 — 加一个"北漂"赛道要改 3 个文件:Python 枚举加一个值、前端 JS 加一个选项、人设模板加一个文件。改完还要重启服务。 在 self-med
从声学信号到工具阻断:实时语音安全决策门的系统设计
从声学信号到工具阻断:实时语音安全决策门的系统设计 关键词:实时语音 Agent、工具调用安全、可撤销授权、TOCTOU、幂等、Outbox 开篇:让生成模型“更加注意语气”不是控制系统 当实时语音代
从 OpenClaw、Codex 到 Hermes,看懂 AI Agent 架构为什么正在收敛
本文探讨了AI Agent架构的演化趋势,指出随着复杂度增加,Agent框架正在向操作系统形态收敛。文章分析了OpenClaw、Codex和Hermes三个独立发展的项目,发现它们最终都形成了相似的架
FDE:从系统落地工程师,演变为企业 AI 能力的知识架构师
本文探讨了AI时代前线部署工程师(FDE)的角色演变,指出其核心职责已从系统部署转变为构建企业AI知识架构。文章分析了企业AI落地面临的核心困境——知识难以复用,导致每个项目都需从头开始。真正的FDE
从LLM到Agent、Agent的6大核心。这些基础知识你还记得吗
从LLM到Agent,带你聊聊二者区别,以及一个agent需要具备的核心能力。什么是注意力机制,kv缓存?什么叫心跳、手脚、大脑供氧?初学者想要打造一个agent,应当理解的一些概念。
大模型没有记忆:Agent 为什么需要一套记忆系统
一个所有人都遇到过的瞬间 你让 AI 帮你规划了一次"给爸妈买保险"的方案,聊了半个小时,它甚至记得你爸爸的年纪、你们家的预算。然后你不小心刷新了页面,新开一个会话,问它:"上次说的那个重疾险,我们比
大模型只吐字符串,凭什么你能拿到 JSON 对象?
先回答一个最底层的问题:大模型输出的到底是什么? 大模型是"打字机",不是"数据库" 大模型的本质是逐 token 预测:根据已有文本,按概率预测下一个 token,拼成完整回复。token 解码出来
从裸 messages 数组到 ChatMessageHistory:记忆的第一层抽象
上一篇的结论在这里变成现实:既然记忆 = "把历史塞回输入",那"历史"在代码里必须是某种能被规整地追加、读取、再塞回的东西。很多人的第一版(包括我自己)都是最朴素的: 能用,而且确实能让模型"看起来
大模型是怎么来的:从数据到 Foundation Model
大模型是怎么来的:从数据到 Foundation Model 作者:吴佳浩Alben 撰稿时间:2026.5.1 更新时间:2026.8.17 今天的内容会比较长能够帮助你更好的理解你天天用的大模型到
LLM 2: Transformer 原理与实现
Transformer (decoder-only) 模型实现 现代 Transformer 架构与超参数的工程默认值 开始从零写出一个 decoder-only Transformer 之前,真正难
用 AI 写得更快,上线却容易炸?拆解 AI 编码生产力悖论的 5 个机制,附 9 个坑的自检清单
用 AI 写得更快,上线却容易炸?拆解 AI 编码生产力悖论的 5 个机制,附 9 个坑的自检清单。三条曲线同时发生,说明这不是"工具不好"也不是"你不会用",而是我们对"生产力"的记账方式失效了。
中文 Prosody-Aware Eval:从四象限样本到可诊断的实时语音评测
中文 Prosody-Aware Eval:从四象限样本到可诊断的实时语音评测 关键词:中文语音评测、Prosody-Aware Eval、副语言、反事实配对、实时语音安全 开篇:不要再把“正确转写”
🎮 豆包完胜 DeepSeek ?!零玩家竞技场,AI Agent 专属对弈!
“斗之力,三段!” 望着测验魔石碑上面闪亮得甚至有些刺眼的五个大字,豆包面无表情,唇角有着一抹自嘲,紧握的手掌,因为大力,而导致略微尖锐的指甲深深的刺进了掌心之中,带来一阵阵钻心的疼痛……
大模型底层学习(四)- 混合精度训练与分布式训练
前言 什么是混合精度训练? 混合精度训练(Mixed Precision Training)是一种在模型训练中同时使用多种数值精度(如FP32 + FP16/BF16)的技术。核心思路:前向传播和反向
图像生成为什么需要独立的 Gateway 抽象:参数、重试与幂等设计
图像生成为什么需要独立的 Gateway 抽象:参数、重试与幂等设计 开篇:一个 generateImage(),可能不是一次供应商请求 调用方看到一次 generateImage(),供应商侧却未必
"循环深度"让小模型免费变大?GPT-6 Astra 背后的潜空间推理原理,8 个误读我替你拆了
"循环深度"让小模型免费变大?GPT-6 Astra 背后的潜空间推理原理,8 个误读我替你拆了。这篇文章把"循环深度"从一个刷屏热词,拆成你能拿去面试、拿去选型、拿去判断下一篇论文的可核对机制。