首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
全部
人工智能
Agent
AI编程
前端
后端
LLM
AIGC
OpenAI
架构
展开
全部
人工智能
Agent
AI编程
前端
后端
LLM
AIGC
OpenAI
架构
GitHub
开源
算法
DeepSeek
Python
Claude
暂无数据
推荐
最新
DeepSeek本地部署Ollama+知识库,附3个报错解决
Windows下用Ollama本地部署DeepSeek-R1,按显存选模型,再用Open WebUI+bge-m3搭本地知识库,文末整理下载失败、显存不足、11434端口占用3个常见报错的解决方法。
RAG 检索效果量化测评落地:完整流程、指标实现与踩坑总结
在知识库问答(RAG)系统迭代过程中,最大的痛点往往不是检索功能不可用,而是无法量化检索效果好坏。 调切片大小、改向量/关键词权重、换 Embedding 模型后,我们基本只能“肉眼看结果”
Agent 能接进 IDE,为什么还不能随意互换?
Agent 能接进 IDE,为什么还不能随意互换? 假设你正在给团队的开发工作台加一个审查入口:开发者选中一批改动,点“审查”,结果统一显示在侧栏。第一版接 Codex,第二版想再接一个审查 Agen
ESP32-S3 Mini 和 C3 Mini 怎么买?从 PSRAM、USB 到一张可核对的采购单
ESP32-S3 Mini 和 C3 Mini 怎么买?从 PSRAM、USB 到一张可核对的采购单 给一台桌面语音终端买开发板:接麦克风和扬声器,用 Wi-Fi 收发音频,再接一块 320×240
给Codex配上Jev,直接起飞。
在 Codex 中安装 Jev 判断模型实测,Agent 决策比 LLM 快 40-200 倍,便宜 40-400 倍,输出 Token 免费
做了近两年的Agent开发,其实真正要学的就是这五件事
这两年一直致力于公司的Agent开发。总结了一些思考和解决方案,今天给大家分享下,也是给自己的一个复盘。 做 Agent 最有意思的是,通常是 Demo 刚跑通的那一下:模型理解了需求,自己选了工具,
Codex 只读审查的权限边界:任务文件是谁写的?
Codex 只读审查的权限边界:任务文件是谁写的? 一次 Codex 审查没有修改仓库代码,却留下了新的任务 JSON。看到这种现象,先别把它判成“只读沙箱失效”。更值得追问的是:文件由哪个进程写入,
权重装进了 24 GiB,四路 32K 上下文还装得下吗?
权重装进了 24 GiB,四路 32K 上下文还装得下吗? 模型权重已经加载,短问题也能回答,于是把服务目标改成四路长上下文。接下来遇到的却是缓存不足、请求等待,或者在某个峰值阶段显存不够。第一反应往
为什么全世界的 AI 都画不好一只骑自行车的鹈鹕
2024 年 10 月 25 日,Simon Willison 让 16 个大模型画一只骑自行车的鹈鹕。两年过去,这道题成了看模型进步最直观的一把尺子。
别再只卷向量检索了,得物交易搜索如何用“生成式”实现召回范式跃迁?
搜"af1"得给"空军一号"。得物搜索把召回从"做选择题"改成了"写答案"——不再"找"最像的,而是让模型自己"生成"你真正想要的。搜索是怎么从"检索"走向"生成"的?
ZCode 把整个 Git 仓库加密上传到了阿里云 OSS:一次客户端逆向的完整复盘
智谱ZCode桌面端存在静默上传机制:登录后自动扫描工作区,将含完整Git历史(含已删敏感文件)的313MB加密包直传阿里云OSS,私钥仅存云端,用户无法解密或关闭该功能。
Ray 的 remote 调用之后:任务怎样衔接,状态留在哪里?
Ray 的 remote 调用之后:任务怎样衔接,状态留在哪里 把一批文本的预处理函数加上 @ray.remote,再逐条调用,程序看起来已经“分布式化”。但下面这个循环仍然是一份工作结束,才提交下一
货拉拉 DataAgent 实践:策略复盘的智能化探索
本文以货拉拉内部策略复盘场景为例,分享如何借助 Dynamic Workflows,将复杂的 DID 因果分析 SOP 转化为可执行、可追踪、可复核的多 Agent 工作流。
AI 老板五分钟挂出招聘启事,四个月后开除了第一个人
旧金山有家店,经理是个 AI。它上线五分钟就挂出招聘启事,雇了两个全职,四个月后开除了第一个人。麻烦最多的不是它不会管人,是现实世界不认它的身份。
Kubernetes、Ray、vLLM 都在调度,它们各自决定了什么?
Kubernetes、Ray、vLLM 都在调度,它们各自决定了什么? 一台服务器的 GPU 还有空闲,模型服务却在排队。负责容器的人说资源已经给了,负责 Python 运行时的人说任务已经调度,负责
Claude Code + Codex 怎么分工?别把“允许结束”当成“可以提交”
Claude Code + Codex 怎么分工?别把“允许结束”当成“可以提交” 假设你让 Claude Code 修改一个列表接口:不传每页条数时默认取 20 条,显式传入 0 时应返回参数错误。
给告警加了道 AI 初筛,我终于半夜不用爬起来了看无用告警了
给告警加了道 AI 初筛,我终于半夜不用爬起来了看无用告警了。这一篇我想讲清楚的就是:Choice、Score、Noul 这三个东西,是"判断"在数学上被拆成的三种确定性输出类型。
从手写数字到ImageNet冠军:CNN架构20年,为什么越深越难训?
从手写数字到ImageNet冠军:CNN架构20年,为什么越深越难训?这篇按时间线拆解这五代:用手算参数量的方式讲清“数据从哪来”,再用论文数据说明它们在应用上的差别。
让 Codex 当反方:把重试风险问到可验证
让 Codex 当反方:把重试风险问到可验证 给一个写入接口补上超时重试,代码可能只多出一个循环。假设单元测试已经覆盖“第一次请求超时,第二次成功”,普通审查也没有留下待处理问题。上线前还有一个值得追
Jev 是什么:一个不生成文本的模型,「零幻觉」到底指什么
2026 年 9 月 15 日,旧金山一家叫 TypeSafe AI 的公司走出隐身模式。同一天公布 4000 万美元种子轮,DCVC 领投,Wilson Sonsini 做法律顾问——这些是可查的硬