首页
沸点
课程
APP
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
全部
人工智能
AI编程
Agent
后端
前端
LLM
AIGC
OpenAI
架构
展开
全部
人工智能
AI编程
Agent
后端
前端
LLM
AIGC
OpenAI
架构
算法
Claude
开源
LangChain
JavaScript
GitHub
暂无数据
推荐
最新
大模型内部是怎么运作的?从「一个神经元」拆到「残差流」
从神经元到残差流拆解大模型黑盒:单个神经元难解释(相关≠因果),一层神经元抽出功能向量可操控行为,一群神经元靠「语言模型的模型」简化理解,再用Logit Lens读出模型内心。
1.2B 小模型赢过 235B 大模型:NaviDC-OCR 把文档解析卷明白了
🎯 先问一个做 RAG 的人都懂的问题 你的 RAG 系统里塞进去一份 PDF,检索质量还行。然后用户传了张手机拍的合同照片——页面有点弯、有阴影、表格被透视压扁——chunk 切出来一片狼藉,检索直
深度解读 Anthropic 多智能体报告:更强的模型 ≠ 更好的协调
这篇《Patterns and problems in emerging multiagent systems》来自 Anthropic 前沿红队(Frontier Red Team),它不是搭建教程
BEVdet模型解析
BEVDet模型是一种基于鸟瞰图(BEV)特征的3D目标检测方法,其核心架构包含四个处理阶段:图像特征提取、视角转换、BEV特征增强和目标检测。
重塑 Agent 度量衡:基于 LLM-as-a-Judge 的离线评估体系与实践
本文构建基于 LLM-as-a-Judge 的 Agent 离线评估体系,结合外呼场景混合 Reference-based 与 GSB 方案,多维度纠偏 Judge 偏见,形成客观高效的评测基准。
Grok 4.6:追平 GPT-5.6 Sol 的半价旗舰,但别只看跑分
导语:一天三个旗舰,你选谁? 8 月 12 日是个疯狂的日子。DeepSeek V4-Pro 正式 GA,阿里首个开源 Qwen-Max 上线,SpaceXAI(就是那个被 SpaceX 收购后更名的
用 NVIDIA Nemotron 3 Super + .NET 构建有记忆的多轮对话
英伟达免费的大模型Nemotron最大的优点就是免费,可商用以及支持单卡部署,极大降低了大模型私有化的难度,鉴于此,咱们就来尝尝鲜吧。由于我手头没有显卡支持,只好退而求其次,使用英伟达免费的线上模型尝
Claude Code 源码分析(十):MCP 外部工具如何进入下一轮 Agent 调用
先设一个运行场景:项目里接了一个名为 project-tracker 的 MCP Server。用户启动 Claude Code 后输入「查询 SHOP-482 的状态」,这时源码里先能看到的,不是某
开源!我用SQLite + DuckDB打造了一款可视化AI问数平台
创业的过程中,业务人员每天会产生大量的数据,但受限于技术门槛,无法像数据分析师一样高效地探查数据。于是我花了一周时间,借助Vibe Coding,打造了一款可视化数据分析工具——灵析(AureKa)
科研人的 AI,不该只回答问题:我用字节TraeWork 跑了一遍真实研究任务
先交代一下这次用的工具。TraeWork 是国内很早就推出的专业 AI 办公平台,和一般"问一句答一句"的 AI 工具不太一样:它背后依托的,是团队早在 2025 年 1 月就推出、并且已经做到行业领
【OpenClaw具身硬件】MiniClaw 阅读笔记---(1)基础
【OpenClaw具身硬件】MiniClaw 阅读笔记---(1)基础 0x00 概要 0x01 基本知识 1.1 MimiClaw 核心特色 1.2 核心定位 1.3 应用场景 0x02 设计理念
大模型参数存储格式揭秘:BF不是男朋友
大模型的参数一般都用 BF16 存储。BF16 是一种浮点数格式,那它到底是怎么存数据的?今天,我们就来扒一扒浮点数那些精妙设计——小数点会漂移、前导位能省则省,一路看到 BF16 上位的真相
vLLM-07|MegaMoE 与 FusedMoE:路由相同,算 expert 完全不同
vLLM-07|MegaMoE 与 FusedMoE:路由相同,算 expert 完全不同。MoE 一层 forward 里,谁负责选 expert、谁负责算 expert,以及 MegaMoE 与
【Agentic RL / 强化学习 / OPD】Hermes & OPD 源码阅读笔记
【Agentic RL / 强化学习 / OPD】Hermes & OPD 源码阅读笔记 0x00 概要 0x01 OPD 机制原理 —— "OPD 是什么,怎么工作" 1.1 OPD 的完整数据流
从“为什么”理解注意力机制
本文从神经网络的不可解释性出发,系统阐述了注意力机制的工作原理及其在深度学习中的应用。文章首先指出神经网络改进往往基于启发式思想而非严格理论推导,强调注意力机制虽受生物注意力启发,但并非直接模拟人脑
【征程6】校准量化中HistogramObserver解析
HistogramObserver是horizon_plugin_pytorch中一种基于直方图统计的量化Observer。
1.8%就够了:K3的896个MoE专家,为什么激活率这么低反而是好事?
掘金的同学们可能对MoE有个直觉误解——"专家越多越好"。K3用896个expert告诉你:关键不是加专家,而是让每个token只激活必要的那些。本文从架构师角度拆解Stable LatentM
征程6工具链模型X86推理方式说明
X86 推理是指 开发机(X86 CPU/GPU)上针对不同阶段的模型:ONNX模型、Hbir模型和hbm模型,进行相应的推理验证。
知识图谱实战(一):数据采集与实体关系抽取(完整代码)
知识图谱实战(一):数据采集与实体关系抽取(完整代码) 前言 上一篇 RAG 系列用向量检索解决"找相似内容",但遇到"任正非和华为是什么关系""华为的产品有哪些"这种精确关系问题,向量检索就力不从心
OpenClaw:从“19万星标”到“行业封杀”,这只“赛博龙虾”究竟触动了谁的神经?
最近科技圈最躁动的名字,非 OpenClaw 莫属。 一方面,它在GitHub上狂揽19万星标,被无数极客奉为“自ChatGPT以来最让人兴奋的项目”,仿佛预示着AI权力的下放。另一方面,它接连遭到M