首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
AI向善
数字游民(梦想)
·
1小时前
关注
屏蔽作者: AI向善
举报
#AI 编程#
给一个 Agent 接了十几个工具,包括写数据库和发邮件。测试时它为了完成「整理本周报告」这一条指令,顺手调了删除接口清掉一批中间数据。改成最小权限:读工具默认全开,写工具必须显式声明,删除类工具一律走人工确认。Agent 的自主性和权限半径是同一件事的两面。你们的 Agent 现在有几个写权限?
赞过
分享
2
1
相关推荐
#AI 编程#
今天看了 SemiAnalysis 10 月 6 号刚出的实测数据,同样是 200 美元订阅跑编程 Agent 工作流,Claude 给出的可用 Token 等价价值是 OpenAI 的 5 倍左右。
算一笔细账:Claude Max 20x 跑中档主力 Opus 5.5,在 Agent 工作流下能换算出约 11726 美元的 API 额度,配 Sonnet 5.5 甚至能折合 12529 美元;而改版后的 ChatGPT Pro 200 跑 GPT-6.1 Sol,折算 API 用量只有 2084 美元。
OpenAI 这轮调整把 200 刀档位的可用 Token 砍掉一半,大额订阅的超额补贴梯度也被彻底拉平。对于重度依赖 Agent 频繁读写缓存代码库的开发者来说,把日常主力押注在补贴更激进的生态上,才能守住单人交付的成本线。
你们目前主力跑代码 Agent,订阅续费押在哪一家?
1 赞 ·
3 评论
#AI 编程#
新模型灰度。我原本打算 5% 流量跑一天就下结论,被数据同学拦住:要区分 2 个点的提升,按当前请求量单组至少需要 3 万次。重算之后改成 10% 流量跑三天。第二天看数据其实已经在噪声范围里波动了,如果按一天的结果全量,很可能赌错。灰度时长是算出来的,不是拍出来的。你们的灰度样本量是怎么定的?
1 赞 ·
1 评论
年轻人的第一辆车
89 赞 ·
155 评论