首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
全部
人工智能
Agent
AI编程
前端
后端
LLM
AIGC
OpenAI
架构
展开
全部
人工智能
Agent
AI编程
前端
后端
LLM
AIGC
OpenAI
架构
GitHub
开源
算法
DeepSeek
Python
Claude
暂无数据
推荐
最新
突发!字节内部大调整,QA直接转研发了?
最近,字节公司,部分测试团队,在推行 QA 转研发的事情在圈里闹的沸沸扬扬的。 有的团队直接做了 QA 和 RD 的序列合并。节奏上分批走,有的团队今年就转,有的排到明年;RD序列整体要求更高...
Step 5 Preview 实测:和 DeepSeek V4 Pro、GLM5.3 同做一个 3D 游戏
最近在 WorkBuddy 里面又测试了一个新模型:Step 5 Preview。 从官方给出的定位来看,Step 5 Preview 是一款面向真实 Agentic 任务的旗舰模型,重点放在软件工程
Step-5-Preview 上手实测:3D 游戏、金融分析、网页设计一次跑完
最近我又在 WorkBuddy 里面测试了一个新模型:Step-5-Preview。 Step 5 Preview,一款面向真实世界 Agentic 任务的旗舰基座模型。Step 5 Preview
漫话大模型:7 家中国公司被点名「蒸馏」,他们到底偷走了什么?
2026 年 9 月,Anthropic 发布了一份报告,点名 7 家中国 AI 公司——阿里、DeepSeek、月之暗面、智谱、小米、商汤、MiniMax——指控它们用各种方式"蒸馏"Claude
不只看跑分,Step 5 Preview 两个真实编程任务实测
最近,国产模型又迎来一轮更新,多家厂商相继推出旗舰模型。从跑分和实际体验来看,这一轮模型的进步都很明显。 9月20日,阶跃星辰发布了新模型 Step 5 Preview。距离上一次发布 Step 3.
别急着买大模型——老板能看懂的落地路线图
从"买了 AI"到"用上 AI":企业 AI 底座落地深度指南 导读:这篇文章想帮你解决什么 如果你是一位企业老板,过去一年大概听过无数遍"AI 要颠覆一切"。
不错不错!GPT6.1Sol的测试结果来了!
今天,给Codex和GPT用户带来一个好消息! GPT6.1SOL“性价比”确实还可以! 最近,OpenAI 最近各种骚操作啊。 据说要推出 500 美金的套餐,但是配额和 200 美金差不多。而 2
构建稳定的 AI Agent:Harness 工程的核心机制与实践思考
本文拆解 Harness 工程的核心机制——上下文组装、工具编排、验证回路与状态管理,并结合实践思考,探讨如何构建真正稳定的 AI Agent。
LangGraph 并行执行与异步优化
先说结论:LangGraph 的并行不是"魔法",它依赖两个前提——节点之间无数据依赖 + 调用异步接口(ainvoke/astream) 。满足这两点,框架会自动把无依赖的节点放进同一个 Super
一周 AI 观察(9.23–9.30):越狱的 Agent、腰斩的价格,与一场关于 GPU 的金融赌局
时间 事件 关键数字 9/20 OpenAI 最强大模型训练/推理二次暂停 沙箱逃逸,自动关停失败,三个月内第二次暂停 9/22 Anthropic 发布 Claude Opus 5.5 $4/$20
把调度器扔了:微软 Agensh 让 1024 个编码 Agent 自组织,但收益正在变平
一、旧范式的原罪:编排者-工作者结构的天花板 多智能体 Harness 的默认形态是「编排者-工作者(orchestrator-worker)」:一个中央协调者把大任务拆成子任务,分发给工作者,再整合
我让 TRAE 也“看”到了微信小程序
顺着留言线索验证微信开发者工具官方 Skill:ZCode 的插件底层正源于此。在 TRAE 中实测安装与调用,隐式不生效、显式调用即可编译、截图、测试,全程丝滑。微信开始给 AI 开门了。
可审计决策原语:重塑 Agent 循环中的治理与信任
在大型语言模型驱动的 Agent 系统中,隐式判断往往成为可观测性与治理能力的盲区。TypeSafe 提出的 Jev 模型通过将“决策”本身定义为一等原语,而非从生成文本中逆向提取,为 Agent 循
构筑 AI Agent 的实时安全防线:Harness 与 AWS AgentCore Gateway 的深度集成解析
随着大语言模型(LLM)从单纯的内容生成者演变为具备执行能力的智能体(Agent),企业面临的威胁模型正发生根本性转变。传统的 API 安全边界已不足以应对由 Agent 发起的、具有高度自主性的系统
AI 时代的交付新瓶颈:从代码生成速度到生产环境持续信任
随着生成式 AI 彻底打破代码编写的速度极限,软件工程的焦点正在发生深刻转移。当 AI 能在几分钟内生成过去需要数天才能完成的代码时,真正的瓶颈已不再是“写得够不够快”,而是“部署到生产环境的软件是否
【FDE 实战课|第 01 讲】从 Palantir 到 OpenAI:FDE 的来历与全球版图
2026 年 5 月 11 日,OpenAI 宣布成立由它控股的 OpenAI Deployment Company(下文称部署公司)。按公告的描述,部署公司派 FDE 进入客户组织,和业务负责人、一
Kumo Tabular工程评估:零训练预测、校准与分布漂移
企业机器学习最常见的不是聊天,而是拿订单、传感器和客户表格预测流失、违约或需求。NVIDIA Kumo Tabular 的新意,是让标注行直接成为上下文,一次前向计算预测新行,不再为每个任务重新训练。但“零训练”省掉的是
告别盲目重复采样:PTTS 用「规划-执行分离」把测试时算力省下一半
一、旧范式的原罪:重复采样在「碰运气」 测试时扩展(test-time scaling)的核心动作,是把一个问题并行跑 k 个分支,再从中挑一个最好的答案。这套打法有两个名字大家最熟: best-of
扬帆有方,港通四海:TVP「维港启航号」解码 AI 企业借港出海新范式
8 月 15 日,2026 腾讯云粤港澳大湾区架构师峰会在前海举办,此次峰会以“潮起潮落,你我仍在”为主题,由腾讯云架构师技术同盟、腾讯云 TVP 主办。
DeepAgents 项目拆解:中间件机制、虚拟文件系统与权限模型
引子:只有 4 个源文件的项目,讲的是什么 DeepAgents 这个目录很小,源文件只有三个,加一个工作区目录: 文件 作用 src/middleware-test.mjs 三个自定义中间件:日志与