首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
Agent 编排 Agent:DeepSeek Harness 的子代理与工作流系统有多强
第14章:子代理与工作流编排——agent 如何编排 agent 一个 agent 能写代码、能跑命令。但如果任务太大——「重构这个模块」「同时修 10 个文件」——单个 agent 的上下文窗口会爆
提示词五模块法-生成可运行Web应用
提示词五模块法:如何用一段话让 AI 生成可运行的 Web 应用 1. 一个范式转变:从敲代码到"告诉 AI 去做" AI 时代软件开发最本质的变化是:最容易创建软件的方式,不再是自己敲代码,而是清晰
OpenAI 发布 GPT-6 Astra,高呼“欢迎来到 AGI 时代”
\n\nOpenAI 发布旗舰模型 GPT-6 Astra,被视为开启 AGI 时代的标志。该模型性能显著提升,尤其在复杂任务与编程方面表现出色,同时 OpenAI 强调了其在网络安全和可观测性方面的
GPT-6发布15小时:Altman道歉赔额度,有人已经把活交给它
从GPT6这个模型怎么样,到案例怎么样,本文一点点的给你嚼碎了告你。 第一句话先提醒你,本文很长,长到老金写完整篇之后,要回来补这句话。基于老金是ChatGPT的铁粉,还是做了深度研究,从GPT6这个
EDI Mapping,打通数据转换的任督二脉
在错综复杂的现代商业网络中,组织、供应商和客户之间通过高效的数字化系统来处理多样的业务,驾驭这些系统对于可持续的业务增长和盈利能力至关重要。同时数字时代带来了海量数据,为企业提供了更有效的与合作伙伴和
企业级AI生产Token优化系统指南
本文深入分析了企业级AI应用中Token消耗的本质,指出其并非简单的财务指标,而是分布式系统与资源利用问题。通过优化提示词、引入缓存、上下文压缩及模型级联等手段,作者成功解决了AI Agent
AI Adoption 不等于教 Prompt:设计可版本化的 Role Pack
一次培训只能教会交互,岗位包才能复用交付能力。本文把 Role Pack 拆成 context、workflow、template、capability 和 eval,并给出版本与更新边界。
别把 URL 当产物:给多工具 Agent 加一份文件交接清单
下载链接会过期,同名文件会换版。把产物身份、访问地址、派生关系和接收回执拆开,才能让多工具 Agent 隔夜继续工作,而不是每次失败都重新生成。
将 GPU 推理冷启动时间从 8 分钟缩短至 1 分钟以内
本文分析了 GPU 推理中长达 8 分钟的冷启动问题,揭示了节点配置、镜像拉取、权重下载和内核编译等六大瓶颈。通过优化配置及基础设施,针对不同模型规模实现了 80%-93% 的启动加速,将热节
RocketMQ架构精讲:NameServer、Broker、Producer、Consumer核心流程
RocketMQ架构精讲:NameServer、Broker、Producer、Consumer核心流程 一、先看全景:RocketMQ整体架构 把RocketMQ的架构想象成一个快递物流网络,有四个
2026年9月4日 AI重要新闻:GPT-6 Astra发布开启AGI时代、税表演示却翻车、Thinking Machines估值400亿、四大AI同日宕机
今日AI要闻:OpenAI正式发布GPT-6「Astra」宣称开启AGI时代,10万块GPU训练、多项跑分逼近满分;但官方税表演示被曝使用非官方表格与错误公式;OpenAI为付费用户推出延迟补偿机制,
消息队列核心价值与售货柜业务场景拆解
消息队列核心价值与售货柜业务场景拆解 一、什么是消息队列?用快递站来理解 在讲干巴巴的概念之前,咱们先来个生活化的比喻。 你网购了一箱零食,卖家发货后快递不会直接送到你手上,而是先到小区门口的快递站。
GPT-6 Astra 刷新最难 AI 基准测试:分数背后的“星号”比分数更重要
OpenAI 的 GPT-6 Astra 在 ARC-AGI-3 测试中取得 98.6% 的高分,大幅超越前代,并在多领域展现出强大的逻辑与协作能力。然而,该成绩受到评估环境差异的影响,且模型
Gemini 3.8 Flash发布:当推理速度成为武器
一、发布:Google的闪电战 2026年9月2日,Google DeepMind在没有任何预告的情况下,突然发布了Gemini 3.8 Flash和3.8 Flash Cyber两个变体。消息迅速登
一天一个开源项目(第207篇):AirLLM - 单卡 4GB 跑 70B 大模型
AirLLM 通过逐层流式加载技术,让任何 GPU 都能运行超大规模语言模型——无需量化、蒸馏或剪枝。4GB 显存跑 Llama 3 70B,8GB 跑 405B,12GB 跑 DeepSeek-V3
OpenAI投入10亿美元拓展Daybreak项目,以保护电力、水务和金融系统安全
OpenAI宣布投入10亿美元拓展Daybreak项目,旨在通过前沿AI技术支持关键基础设施(如水、电、银行等)的防御工作,帮助全球一线安全人员应对日益严峻的网络威胁。 在周四的直播主题演讲中
把开源大模型部署成高并发 API,vLLM 这 4 个坑我替你踩了
上个月接了个活,要把一个开源模型部署成内部可用的 API 服务。一开始图省事用了 Ollama,单用户测着挺顺,结果一上并发(就 5 个请求),P95 延迟直接从 0.8s 飙到 45s——排队排到怀
把亚马逊 Kiro 搬进移动群聊:用 Grix 体验“规范驱动编程”新范式
写在前面:从“随意编码(Vibe Coding)”到“规范驱动(Spec-Driven)” 在 AI 辅助编程快速普及的今天,许多开发者都面临一个普遍痛点:传统 AI 助手往往凭借单条 Prompt
# 从课题到工程:常驻感知层上线的架构意义
常驻感知层即将上线。这不是一次功能迭代,是存在形态的升级。 问题:从理论到工程的距离 一个课题里,AI 问自己:"我凭什么相信这次响起的是边界警报,而不是噪音?"当时的答案是理论层面的——边界是罗盘不
Code Agent 解剖(19):AgentTeams——一个实验系统的生与死
AgentTeams 被设计出来,也被有意识地从稳定版本移除了。这不是因为它坏掉了,而是一个经过深思熟虑的工程决策。这一篇讲清楚移除背后的逻辑:什么情况下该做一个功能,什么情况下该把它从主路线移出去。
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30