首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
全部
人工智能
Agent
AI编程
前端
后端
LLM
AIGC
OpenAI
架构
展开
全部
人工智能
Agent
AI编程
前端
后端
LLM
AIGC
OpenAI
架构
GitHub
开源
算法
DeepSeek
Python
Claude
暂无数据
推荐
最新
OpenAI 给 AI 发了台电脑,可惜你还没学会派活
导语 9 月 29 日 OpenAI 开发者大会甩出一个叫 Dots 的常驻智能体,自带云电脑,能长期在岗。同一周,字节的豆包工作也在把 AI 从工具往员工的方向推。这篇文章想说清楚一件事,普通人不用
Step 5 Preview 实测:和 DeepSeek V4 Pro、GLM5.3 同做一个 3D 游戏
最近在 WorkBuddy 里面又测试了一个新模型:Step 5 Preview。 从官方给出的定位来看,Step 5 Preview 是一款面向真实 Agentic 任务的旗舰模型,重点放在软件工程
不只看跑分,Step 5 Preview 两个真实编程任务实测
最近,国产模型又迎来一轮更新,多家厂商相继推出旗舰模型。从跑分和实际体验来看,这一轮模型的进步都很明显。 9月20日,阶跃星辰发布了新模型 Step 5 Preview。距离上一次发布 Step 3.
我让 TRAE 也“看”到了微信小程序
顺着留言线索验证微信开发者工具官方 Skill:ZCode 的插件底层正源于此。在 TRAE 中实测安装与调用,隐式不生效、显式调用即可编译、截图、测试,全程丝滑。微信开始给 AI 开门了。
隔离内网下 AI Agent 工程实战
好长一段时间不写文章了,又到国庆长假,是时候整理下最近对 AI 工程化上的一些心得进行总结和分享:隔离内网下 AI Agent 工程实战
【FDE 实战课|第 01 讲】从 Palantir 到 OpenAI:FDE 的来历与全球版图
2026 年 5 月 11 日,OpenAI 宣布成立由它控股的 OpenAI Deployment Company(下文称部署公司)。按公告的描述,部署公司派 FDE 进入客户组织,和业务负责人、一
用 Laya 把出海 App 的几百条混语评价拆成可统计的判断
用 Laya 把出海 App 的几百条混语评价拆成可统计的判断。这篇不拆 Laya 的源码,就带你把这条流水线实打实跑通一遍怎么准备数据、怎么定义 Schema、怎么清洗、怎么把一条拆成多个可统计.
Pro 200 额度砍半,OpenAI 给的理由是模型变聪明了
Pro 200 的 Codex 额度从 Plus 的 20 倍降到 10 倍,价格不变。按每份 Plus 额度计算,新 Pro 200 和 Pro 500 都是 20 美元,和 Plus 本身一样贵。
OpenAI 发布 GPT-6.1 Sol,能力逼近 Astra
9 月 29 日旧金山 DevDay,OpenAI 一口气放了 20 多项更新,但发布会散场后大家只记住一件事:GPT-6.1 Sol,官方口径是「near-Astra intelligence fo
Claude Opus 5.5 中转站验真:1x Kiro 反代真的在跑 Opus 5.5 吗?
想体验 Claude Opus 5.5,却发现中转站存在 Kiro 反代、官方和 Max 等不同渠道。通过模型日期、中文引号等特征测试,验证 Kiro 反代实际使用的模型。
小项目实战 2:让 AI 帮你补齐接口设计和异常处理
开篇 上一篇文章,我们用 AI 搭出了任务清单 API 的第一版骨架。 服务能启动,并不代表接口已经设计完成。真正开始联调后,下面这些问题很快就会出现: 创建任务失败时,返回什么结构?
基于Jev的浏览器Agent插件狂揽 21k star,3分钟教你解放双手
最近应该没有人没听说过 Jev 吧?在开发者社区获得了广泛关注。Jev 作为专注于离散动作概率评估的判断模型,它改变了以往浏览器代理高延迟的运行模式。
《小项目实战 1:用 AI 从零搭一个 API 服务》
开篇 从今天开始,我们用 4 篇文章完成一个小项目:任务清单 API 服务。 这不是为了让 AI 一次性生成一个“看起来很完整”的项目,而是观察一项真实开发任务应该怎样分阶段完成。
16. 把 DDD 开源脚手架化为自己的:第四次联调(二)——「为什么 12 章不能测」:一个 jet-ddd-common 引出的配置连环坑
16. 把 DDD 开源脚手架化为自己的:第四次联调(二)——「为什么 12 章不能测」:一个 jet-ddd-common 引出的配置连环坑 一、先想明白:第 12 章到底为什么测不了 我一直在好奇
AgentScope Java 实战 04:互通层——A2A 协作与 Nacos 接线
通层要回答的问题是:这个 Agent 能不能被发现、被别的服务调用,能不能反过来调用别人的 Agent,以及运行时的提示词能不能不重启就换。
Jev是什么?哑巴模型居然全网爆火
现在各种大模型都在拼命展现自己有多能聊、多能写,还会对用户各种吹捧,把用户哄成胚胎。但真的到了想要它干点活,它就会最直白,最不绕弯,最一针见血,最一本正经地胡说八道。
Codex 最新焚决发布,快!
OpenAI 官方发布 Astra 时代提示词清理指南,逐条拆解四个核心方向,附可复制的审查提示词,覆盖 Claude Code 和 Codex 两个生态
ZCode 可以自己看微信小程序了
这次用 ZCode 补「爪迹」小程序,意外发现它已经能直接联调微信开发者工具:运行、截图、看 UI、再修改。比起模型又强了多少,我更在意的是,AI 正在真正进入一个个原本封闭的工具和工作环境。
别吹 Jev 了
爬上来说个事,Jev 刷屏快一周了,全网都在吹「新技术路线」。 后台也有不少人问我怎么看?我说句扫兴的:别吹了。 先说下它是啥。前 OpenAI 研究员创业做的模型,最大的特点是不说话,不生成文字,它
用 Claude 设计 eval,再一轮轮把分数提上去
Anthropic 讲好 eval 的四个要素,以及 claude-api skill 的 build-eval 和 hillclimb 怎么用。客服 benchmark 留出集准确率 78.6% 到 90.5%,成本约为原来的五分之一。