首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
排行榜
综合
后端
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
综合
后端
排行榜
前端
Android
iOS
人工智能
开发工具
代码人生
阅读
全部
人工智能
Agent
AI编程
前端
后端
LLM
AIGC
OpenAI
架构
展开
全部
人工智能
Agent
AI编程
前端
后端
LLM
AIGC
OpenAI
架构
开源
GitHub
算法
LangChain
Python
DeepSeek
暂无数据
推荐
最新
第 20 章 质量保障 Harness 与评测体系
第 20 章 质量保障:Harness 与评测体系 本章要解决的问题 章节大纲 20.1 Agent 评测指标体系(任务成功率/工具正确率/成本/延迟) 20.2 评测集构建与自动化回归 20.3 防
AI写测试翻车实录:测试全绿,上线还是崩了——一个format函数暴露的盲区
一个format函数,AI写的10条测试全部通过,上线后传入null直接报错。排查发现AI生成的测试用例全部基于函数签名推导,只覆盖了"正常输入"路径,没有null/undefined/边界值。
我用 Qwen3.8-Max 搭了一个电商商品资料包体检助手,6 份资料和 1 张商品图一次查出 27 个问题
我用 Qwen3.8-Max 搭了一个电商商品资料包体检助手,6 份资料和 1 张商品图一次查出 27 个问题 背景:我为什么要搭这个 我平时接触商品上架资料时,最费时间的不是写一个标题
大模型的权重到底怎么用?拆开一个 token 的生成过程
我们已经知道,大模型里有很多参数,训练时会调整它们,平常聊天时通常不会。 但这还没回答一个最直观的问题: 一堆固定的数字,怎么就能变成一句新话? “经过注意力、FFN,最后预测下一个 token”这句
中级开发者用 AI,最容易掉进的 5 个坑
开篇 当 AI 可以生成代码、解释报错、补齐测试时,很多开发者的第一反应是: 答案是:有可能。 但前提是,你没有掉进下面这些常见陷阱: AI 明明生成了代码,为什么接入项目后问题更多了? 同一个问题问
不要先问“用哪个 AI”,先盘点你的开发工作流
开篇 开始使用 AI 编程后,很多开发者最常问的问题是: 哪个 AI 工具更适合写代码? 哪个模型生成代码更准确? 有没有万能 Prompt? 用什么插件能自动帮我完成更多事情? 这些问题当然有价值。
从 ChatGPT 到 Astra:四年走完的路,AGI 真的来了吗?
OpenAI 毫无预告地发布 GPT-6 Astra,以 ARC-AGI-3 满分、Lean 4 验证的数学突破、像素级 Computer Use 和递归自我改进四大跃升,将行业推到 AGI 门槛前。
第 19 章 Agent Skill 能力复用体系
第 19 章 Agent Skill:能力复用体系 本章要解决的问题 章节大纲 19.1 Skill 是什么:可复用流程封装 19.2 Skill 的设计规范与版本管理 19.3 技能编排与组合策略
Kimi K3太牛了!但老板说API太贵,让我本地化部署,我算完成本,他涨红脸沉默不语了!其实成本不高,三千万足矣。
我看着老板的脸色由白转红,又有点儿紫,最后有点儿黑,没说一句话。沉默良久以后老板开口说:小X啊,这个事儿公司需要开会讨论一下,你把材料留下先回去吧。走出办公室的一刻,我看着老板拿起那份账单...
从零训练一个 321 万参数的小模型:用 MLX 看懂 Transformer 的训练过程
前面学习大模型时,我一直有几个疑问: token 到底怎么进入模型? 4 层、256 维、4 个注意力头,分别体现在哪里? 训练时,究竟是哪行代码改了权重? 训练完保存的东西,又怎么拿来回答问题? 光
Deepseek harness 安装配置保姆教程
Deepseek harness 安装配置保姆教程,带来完成新手村的速通, 包含 5 个模型供应商的案例和一个第三方插件案例。
还在找PPT 生成工具?我集成了 GitHub 高星 Skill,自动匹配最优方案
刚好最近小红书训练营新增了 PPT 类目,我就顺着这个需求,重新研究了一遍 PPT 相关 Skill,没想到最后做出来的,不只是一个“生成 PPT 的工具”。
从零搭建你的 AI 编程工作流
前面的文章分别介绍了需求拆分、代码生成、测试、优化和代码审查。 但在真实开发中,我们很少只做其中一件事。一个功能通常要经历: 如果每一步都临时提问,AI 给出的内容可能互相矛盾,自己也容易忘记验证哪些
谷歌发布 Gemini 3.8 Flash,官方跑分很厉害,但又被嘲了?
在六周内连续推出三代 Flash 模型之后,谷歌在大模型领域的迭代频率达到新高,比生产队的驴还能干。
30 天 AI 编程入门总结:接下来应该学什么
这是《AI 编程提效实战》的第 30 篇,也是入门阶段的总结篇。 过去 30 天,我们没有从“让 AI 一次生成完整项目”开始,而是从最基础的问题出发,逐步学习了: 如果你已经读过前面的文章,接下来最
一次面试让我重新认识了 Codex,顺便搞懂了 GPT-6 Astra
上周技术面试,面试官看了我简历上写的「熟练使用 AI 编程工具」,笑了笑问:"那你用过 Codex 吧?你觉得它和 Cursor 最大的区别在哪?" 我当时心里一紧,本来张嘴就想答「都是 AI 写代码
Agent 场景下,谁才是真正好用的 Flash 模型
模型圈一直都很热闹,每月都有各种新的模型出来。 最近一个月,国产大模型不断推出新模型,Step 3.7 Flash、MiniMax M3、GLM-5.2、Kimi K2.7 Code几乎都是前后脚发布
别只盯着最强模型了,Agent 场景更该看这类 Flash 档模型
最近,GLM 5.2 接连刷屏,国产模型又热闹起来了。 加上 DeepSeek V4、MiniMax M3,还有阶跃星辰的 Step-3.7-Flash,国产大模型这一波可以说是你追我赶,热度一下子又
Meta 发布 Muse Glimmer:30B 参数、一张 24GB 显卡就能常驻的本地 Agent 模型
前段时间,Meta Superintelligence Labs 发布了一个对端侧智能体意义明确的新模型:Muse Glimmer。这是一个 30B 参数的稠密多模态开源模型,官方给它的定位就一句话—
GLM-5.3-Flash 发布:追平 Opus 4.8 的智力,1/40 的价格,跑在国产芯片上
智谱开源 GLM-5.3-Flash:320B-A18B 原生多模态模型,AA 智能指数追平 Claude Opus 4.8,限时折扣价约其 1/40,推理流量全部跑在国产芯片上。