首页
沸点
课程
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
关注
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
排行榜
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
全部
后端
前端
人工智能
算法
程序员
JavaScript
GitHub
架构
AI编程
展开
全部
后端
前端
人工智能
算法
程序员
JavaScript
GitHub
架构
AI编程
Agent
面试
Python
Linux
嵌入式
LLM
暂无数据
推荐
最新
React+TS+Tailwind实战:在浏览器里跑DeepSeek-R1端侧模型
React+TS+Tailwind搭建DeepSeek-R1-WebGPU端侧推理。拆解函数组件、JSX、合成事件、useState、Progress封装、组件树,展示AI时代前端工程化实践。
知识蒸馏:大模型教小模型,远不止背答案那么简单
从 DeepSeek 被指控蒸馏 OpenAI 的争议切入,拆解知识蒸馏的核心机制——硬标签只背答案,软标签才是思维方式的传承,用化学蒸馏和米其林大厨带徒弟两个类比,把暗知识的本质讲透。
文档切割与RAG管线:从网页爬取到语义检索的完整闭环
从网页爬取到向量检索,拆解RAG知识库构建链路:cheerio提取网页内容、RecursiveCharacterTextSplitter语义切割、向量存储与相似度检索,理解文档分块背后的设计哲学。
LLM 是怎么"随机"说话的 —— Temperature、Top-K、Top-P 详解
前言 你有没有想过一个问题:大模型每次生成文本,为什么能给出不同的回答?同一个 Prompt 问三遍,回答可能每次都不一样。这种"随机性"不是 bug,而是刻意设计的结果——而控制它的核心,就是三个参
端侧 AI 与 WebGPU:在浏览器里运行大模型
一、云端 AI 的"阿喀琉斯之踵" 2025 年,我们习惯了这样使用 AI: 端侧 AI 试图回答一个问题:能不能不依赖云端,在用户自己的设备上完成 AI 推理? 答案是:可以,但有取舍。 二、端侧模
从等待到流式:LLM 流式输出的原理、协议与工程实践
从等待到流式:LLM 流式输出的原理、协议与工程实践 打开任何一个 AI Chatbot——ChatGPT、Claude、DeepSeek——你输入一个问题,它不像传统网页那样转圈等 10 秒然后啪地
Harness Engineering:给千里马套上缰绳——从 Claude Code 实战看 AI 工程化的终极形态
从Claude Code实战出发,拆解Harness Engineering的四层架构——记忆层、工具层、控制层、上下文层,以及CLAUDE.md如何解决LLM无状态问题。
从踩坑到封装:手把手教你写一个 Claude Code Skill
先找到你的「忍无可忍」 在动笔之前,先问自己一个问题: 如果有,那就是一个 Skill 的种子。 它可能是: 每周合并报表 PDF,每次都要告诉 AI 用哪个库、怎么处理页码 每次写完代码让 AI r
别再把 Prompt 当一次性筷子用了:Claude Code Skills 入门指南
一个你肯定经历过的场景 你打开 Claude Code,想做一件已经做过很多次的事——比如,把两个 PDF 合并成一个: 你很熟练,一气呵成。但你有没有发现一个问题:这件事你每次都要重新说一遍。就像每
Harness Engineering:给千里马套上缰绳
一、AI 工程化的三个时代 2022 到 2026,AI 工程化走了三个阶段,每个阶段回答的问题不同: 阶段 时间 要解决的问题 思路 代表产品 Prompt Engineering 22-23 模型
上下文工程:为什么现在写 Prompt 不用那么费劲了
从Prompt Engineering到Context Engineering的范式迁移:为什么2026年写提示词不用像2023年那样精雕细琢了。
LLM 的底层语言:从分词到向量化,搞懂 AI 是怎么"读"文字的
LLM 的底层语言:从分词到向量化,搞懂 AI 是怎么"读"文字的 v029 搞懂了 Agent 的四块基石——LLM 是大脑,Tools 是手脚,Reasoning 是思考过程,Context 是记
从零搭建一个 RAG 语义搜索系统 —— DEMO的初始阶段
一、为什么要学 RAG? 2024 年以来,RAG(Retrieval-Augmented Generation,检索增强生成)几乎出现在每一个 AI 产品的技术栈里。不管是智能客服、企业知识库问答、
拆解 LLM Tool Use 的完整机制:从缸中大脑到 Agent 觉醒
你用过 ChatGPT 的联网搜索,用过 Claude 分析 Excel 表格,用过豆包查询实时天气。你可能会觉得:这些 AI 真厉害,什么都会。 但真相是—— 那个在显卡里疯狂跑的 LLM,本质上是
Hermes + DeepSeek:AI 真的开始帮我维护 Linux 了
深夜坐在电脑前,看着终端里一行行命令自动执行,问题一个个被解决的时候,我心里挺有感触的。 未来好像来得比我想象的还要快一点。 这个世界太疯狂了。
Tool:让大模型长出手脚
Tool 是 Agent 能从"聊天机器人"升级为"能干活的助理"的关键。没有 Tool,AI 只能空谈;有了 Tool,AI 能读文件、写代码、查数据库、发邮件——真正把手伸进现实世界。
🚀 拯救你的 LM Studio:一键解决连接问题的奇妙之旅
🚀 拯救你的 LM Studio:一键解决网络连接问题的奇妙之旅 📦 项目地址:GitHub - lm-studio-fix ⚠️ 特别提醒: Windows 版本由于设备限制尚未经过测试,欢迎大家测
别用文档约束你的 Agent:聊聊 Agent 开发流程的思想
最近我用一队 AI agent 去"审"了一个开源项目:OpenMontage——一个完全由指令(Markdown + YAML)驱动的 AI 视频生产系统。它的架构相当成熟,但在审查过程中,我亲手验
一篇文章带你学会向量数据库Milvus(一)
一篇文章带你学会向量数据库Milvus(一) 上一篇文章中 LLM 学习之「向量数据库」 中我们介绍了什么是向量数据库,向量数据库有那些用途,向量数据库与 LLM 的关联以及 RAG 中向量数据库的使
Mac Studio M4 通过 vLLM 部署本地大模型,对接 Jeecg-AI
Jeecg-AI 是一套类似 Dify 的 AIGC 应用平台 + 知识库问答 + 零代码应用搭建,是一款基于大型语言模型和 RAG 技术的 AI 应用平台与零代码应用搭建平台,重点提供图文并茂的 A