首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
Databend
掘友等级
Databend Labs
Databend 是一款基于对象存储云原生开源数仓
获得徽章 0
动态
文章
专栏
沸点
收藏集
关注
赞
0
文章 0
沸点 0
赞
0
返回
|
搜索文章
最新
热门
Databend 原生数据血缘:追溯指标来源,检查变更影响
数据血缘解决什么问题? 表结构变更可能影响下游视图、数据任务和报表;指标异常需要沿加工链路定位源数据或转换逻辑;敏感字段的传播范围也需要持续追踪。 当数据系统规模较小时,这些问题通常依靠经验、SQL
只看 PASS 会骗你,6 条 Agent Trace 里的 Coding Agent 评测真相
GPT-6-Astra 发布那阵子,Benchmark 和代码能力数据刷得很凶。我真正想看的却很具体。把它放进一条真实的 Coding Agent 工作流,和我平时用得最多的 Claude-Fable
AI 时代的数据工程挑战:从复杂链路走向统一数据底座
AI 系统越做越多、开发速度越来越快,为什么数据链路反而越来越长,数据工程也越来越复杂? AI 系统增多,数据工程复杂度为何同步攀升? Databend 今年接触到的一些客户,都在从事 AI 可观测性
Databend 增量物化视图:基于 Change Tracking 的增量刷新与一致性读取
刷新可以延迟,结果不能过期 物化视图(Materialized View,MV)通过预先计算并持久化高频查询结果,以额外的存储空间换取更低的查询延迟和扫描成本。然而,在生产环境中,真正困难的并不是“保
Cluster Key 最佳实践:列怎么选、顺序怎么排与粒度设计
Cluster Key 系列希望帮助数据工程师从“会写 CLUSTER BY”走向“能够解释、设计并验证数据布局”。 原理篇:从传统分区到微分区,Snowflake
从传统分区到微分区,Snowflake 与 Databend 如何减少数据扫描
Cluster Key 专题介绍 Cluster Key 决定了大表中的数据如何在物理层面聚集,也直接影响查询需要扫描多少数据。但从“知道语法”到“真正用对”,中间至少隔着三个问题:它为什么有效、应该
从 Kafka 到 Databend Cloud:万亿级 Agent Trace 接入链路的工程实践
本文面向正在建设 Agent Trace、日志分析、Kafka 入仓或高吞吐半结构化数据管道的数据工程师,重点拆解 Agent Trace 从 Kafka 进入 Databend Cloud 的接入链
从万亿级大模型到全线应用:Databend Cloud 助力头部 AI 企业构建全链路 Trace 数据管道
某中国头部 AI 大模型企业,以突破性的长文本处理能力与高阶推理技术著称,同时也是推动万亿级大模型开源的行业领跑者。随着其开源万亿级强化推理大模型投入应用,模型需要处理百万级超长上下文与 Agent
Databend 产品更新:从 Spatial Index Join 到 Eval 数据管道
过去两个月,Databend 的技术迭代沿着三大方向加速推进:从让优化器更精准地理解数据,到推动空间索引从扫描剪枝跨越至 Join 优化,再到持续扩充 Paimon、Iceberg 等开放湖仓生态。
从全表排序到概率统计:Databend 如何用 KLL、Top-N 与 CMS 改进基数估计
查询优化器既要了解数据的整体分布,也要识别少量高频值,否则就可能在 JOIN 顺序、扫描策略和算子选择上做出错误判断。
下一页
个人成就
优秀创作者
文章被点赞
222
文章被阅读
242,281
掘力值
9,853
关注了
1
关注者
107
收藏集
0
关注标签
5
加入于
2021-10-15