首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
全部
人工智能
Agent
AI编程
前端
后端
LLM
AIGC
OpenAI
架构
展开
全部
人工智能
Agent
AI编程
前端
后端
LLM
AIGC
OpenAI
架构
GitHub
开源
算法
DeepSeek
Python
Claude
暂无数据
推荐
最新
当沉香之乡遇上 Seed-2.1-pro:我用 AI 给村子做了一个数字门面
当沉香之乡遇上 Seed-2.1-pro:我用 AI 给村子做了一个数字门面 前段实践我在抖音上发过一条视频,内容很简单:免费用 AI 帮 100 个人解决需求。实操记录!
读完 55873 资产钱包的技术栈,我重新理解了 "合规钱包" 应该长什么样
最近在啃 55873 生态的系列文档,读到第 20 篇 "资产钱包" 的时候,我停下来认真看了很久。 为什么?因为市面上叫 "钱包" 的东西太多了 ——MetaMask、Coinbase、Ledger
[Agent Memory / 强化学习] MemPO源码学习笔记 ---(5)--- GRPO
[Agent Memory / 强化学习] MemPO源码学习笔记 ---(5)--- GRPO 0x00 概要 0x01 原理 1.1 现状 1.2 GRPO 1.3 PPO vs GRPO 1.4
流水线运行是否正随时间变得更加集中?
流水线运行是否正随时间变得更加集中? 数据与完整代码来源: 数据集简介 围绕“流水线运行是否正随时间变得更加集中”这一问题,这里使用了一份流水线运行记录数据。数据以逐条运行的形式组织,每条记录对应一次
Jev 入门第一课
2026 年 9 月 15 日,由前 OpenAI InstructGPT 核心作者 Diogo Almeida 创立的 TypeSafe AI 宣布获得 4,000 万美元种子轮融资,并推出了其首个
别再只卷向量检索了,得物交易搜索如何用“生成式”实现召回范式跃迁?
搜"af1"得给"空军一号"。得物搜索把召回从"做选择题"改成了"写答案"——不再"找"最像的,而是让模型自己"生成"你真正想要的。搜索是怎么从"检索"走向"生成"的?
深度拆解 ScienceBuddy:如何用“双层递归自进化”构建高可靠科研 Agent Harness
做过复杂垂直领域(尤其是生命科学、材料、药理等)Agent 的同学,大多踩过一个极度痛苦的坑: 写通用代码或找 Bug,我们有 SWE-bench 和单元测试(Unit Test),跑一次就知道通没通
尼泊尔河流流量:天气驱动的预测与高流量风险
尼泊尔河流流量:天气驱动的预测与高流量风险 数据与完整代码来源 本笔记本使用一个日频数据集,涵盖 2023-01-01 至 2026-08-31 期间 尼泊尔的 10 个河流测站。每一行对应一个站点-
2.46 秒生成 5 秒视频:拆解 H3 Max 的模型、推理栈与硬件协同
fal 公布的一组数据是:H3 Max 生成一段 5 秒、768p 视频,模型推理时间约为 2.46 秒;H3 Max Turbo 又把这个数字降到了约 1.54 秒。 这已经低于视频自身的播放时长,
ART:妆容迁移框架,重新定义高保真妆容迁移 | ECCV 2026
vivo 蓝图实验室提出妆容迁移框架 ART,通过两阶段训练将监督信号从合成伪目标逐步锚定到真实参考图像。该方法有效解决了复杂妆容迁移中的细节丢失与身份漂移问题,在多个数据集上取得 SOTA 效果。
200 行代码写一个能跑的 AI Agent:不依赖任何框架,只靠 tool-calling 原理
200行代码写一个能跑的 AI Agent:不依赖任何框架,只靠 tool-calling 原理。这句话是我一直放在桌面上的一句提醒。现在各种 agent 框架满天飞——LangChain、CrewA
[Agent Memory / 强化学习] MemPO源码学习笔记 ---(4)--- Rollout实现细节
[Agent Memory / 强化学习] MemPO源码学习笔记 ---(4)--- Rollout实现细节 0x00 概要 0x01 回顾 0x02 mem_sys_prompt_ids 2.1
阿里 open-code-review (AI代码审查工具)实战:安装、四层规则链、自定义规则格式与实测避坑
阿里 open-code-review (AI代码审查工具)实战:安装、四层规则链、自定义规则格式与实测避坑 环境:Windows / Node v22.22.2 / Git 2.55.0(它要求 G
机器人 / 物理 Agent Harness 综合分析与对比:从「更强的模型」到「更好的系统」
机器人 / 物理 Agent Harness 综合分析与对比:从「更强的模型」到「更好的系统」 0x00 概要 0x01 面对的难点与核心冲突 1.1 核心冲突的一句话版本 1.2 深挖:难点的四个层
🔥别再死磕压缩了,Codex、NVIDIA、DeepSeek、Uber 给出 Agent 上下文管理的新答案
TL;DR 把 2025~2026 这波 Agent harness 的演进摆在一起看,会发现一条清晰的迁移路径:上下文管理早已不是「窗口快满时裁剪一刀、摘要一发了事」,它变成了一个分层的工程学科。四
OpenClaw:从“19万星标”到“行业封杀”,这只“赛博龙虾”究竟触动了谁的神经?
最近科技圈最躁动的名字,非 OpenClaw 莫属。 一方面,它在GitHub上狂揽19万星标,被无数极客奉为“自ChatGPT以来最让人兴奋的项目”,仿佛预示着AI权力的下放。另一方面,它接连遭到M
vLLM 与 SGLang KV Cache 底层实现机制深度调研报告
一、底层 KV Cache 实现机制(基于 main 分支源码) 1. vLLM:PagedAttention + 哈希链前缀缓存 分层结构:KVCacheManager (vllm/v1/core/
001-Transformer架构与Self-Attention机制深度解析
第1章 LLM基础原理 第1章第1节:Transformer架构与Self-Attention机制深度解析
Speculative Decoding(投机采样):大模型"先猜后验",生成速度翻倍
一、一个反直觉的真相:大模型生成慢,卡的不是算力,是内存带宽 先讲一个很多人不知道、但理解后会觉得"原来如此"的事实:大模型在生成文本(也就是推理)的时候,瓶颈往往不在 GPU 的算力,而在内存带宽。
003-上下文窗口:物理限制、KV Cache 与工程应对策略
当你向一个 LLM 发出请求,无论是简单的问答、复杂的代码生成,还是多轮 Agent 任务,有一条规则始终成立:**模型只能"看到"当前上下文窗口内的内容**。