首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
开源技术
阿里云大数据AI技术
创建于2022-05-24
订阅专栏
分享阿里云大数据&AI开源技术
等 12 人订阅
共294篇文章
创建于2022-05-24
订阅专栏
默认顺序
默认顺序
最早发布
最新发布
从向量存储到 Agentic 数据基础设施:Paimon × Milvus 如何构建 AI 原生多模态数据湖
本文讨论 AI 与 Agent 进入生产环境后,数据湖与向量数据库“双系统”架构暴露出的结构性问题,以及Apache Paimon 与 Milvus 围绕同一份湖数据协同的技术路径。
知衣科技 × 阿里云:以MaxCompute 向量检索打通商品与海外社媒内容,让跨境选品看见真实热度
知衣科技与阿里云大数据 AI 平台展开合作,将原有 Proxima 检索方案替换为 MaxCompute 提供的向量检索能力,在保留自研模型链路的前提下完成了检索环节的重构。
从数据平台到智能数据助手:Agentic 数据分析与 API 生产实践
舟谱数据围绕快消流通业务构建了一条从业务问题、指标解析、SQL生成、安全执行到 API 草稿交付的 Agent 链路,并通过版本化 Skill、有界 Context、MCP 权限传播和结构化产物传递。
从 Common Crawl 到可训练语料:用 EMR Serverless Daft 构建清洗、模型标注与向量化管线
阿里云 EMR Serverless Daft 的核心价值,是将批量非结构化数据处理与 ai_query、ai_embedding 这类模型服务调用组合在同一个 DataFrame 作业中。
基于 EMR Serverless Ray 实现 Qwen 模型批量推理实践
本文介绍如何在阿里云EMR Serverless Ray集群上,使用Ray Serve LLM部署Qwen3.5系列模型,并通过Ray Data的ai_query API实现集群内高吞吐批量推理。
一句话即可用好 MaxCompute:AI 全能搭子 MaxAgent 来了——会运维、能分析
阿里云MaxCompute推出全新AI助手MaxAgent,既能做智能运维,也能做数据分析洞察,后续还会支持用自然语言直接完成平台管理操作。
从 VDBBench 到 MMEB 榜首:阿里云 AI Search 从引擎到模型的全栈优化
阿里云AI Search在VDBBench向量检索、Big5与Tantivy传统检索,以及MMEB多模态文档检索等评测中取得一系列突破。
DataWorks Data Agent 实战课堂(五):AI 多模态智能数据处理
DataWorks Data Agent实操,通过本次实操可以看到 DataWorks 数据集成 Agent 能力覆盖了 AI 数据处理任务的核心生命周期。
阿里云PAI发布通用蒸馏框架EasyDistill2.0,提供主流大模型蒸馏场景最佳实践
2025 年,阿里云人工智能平台 PAI 开源了大模型蒸馏框架 EasyDistill,并陆续发布了 DistilQwen 系列蒸馏模型。
Daft 多模态视频抽帧性能优化实践:从抽帧到大模型打标,一条视频理解流水线是怎么跑起来的
EMR Serverless Spark 团队推出了深度优化的 Daft 版本,不仅大幅提升了视频、图片等多模态数据的读取性能,还提供了 ai_query 等大模型调用原语和丰富的内置算子。
免费领票!9月22日-24日,2026云栖大会杭州见
2026云栖大会将以AgenticAl为核心锚点,串起芯片、云基础设施、模型能力与模型服务、Agentic应用的完整链路,直抵生产方式深层变革。
EMR Daft × Qoder:一句话生成并运行智驾数据处理 Pipeline
向 Qoder 描述智驾数据的输入、处理目标和输出位置,Skill 会根据目标 EMR Serverless Spark 发布版本,生成完整的 EMR Daft 作业包。
基于阿里云Milvus 构建电商图文智能搜索平台
本方案基于阿里云向量检索服务 Milvus 版的图文向量化能力,融合多路召回、业务过滤与相关性重排,将"相似图片"真正转化为可运营、可采购的商品结果,帮助企业显著提升搜索准确率与转化效率。
基于阿里云 Milvus 复刻“高德扫街榜”
阿里云Milvus是目前唯一支持AI Native的Milvus云服务。它不仅提供高性能全托管的向量检索能力,更将AI Function与AI-Gateway原生嵌入数据链路。
阿里云 Milvus 知识库开启邀测,助力客户构建企业级 Agent
阿里云 Milvus 知识库现已开启邀测。通过提供一站式企业知识管理应用,企业可以更快地把分散的私有数据转化为 Agent 可调用、可追溯、可持续运营的知识能力。
借助 EMR Serverless StarRocks 实现电商平台图搜图、文搜图场景
通过StarRocks,把多模态模型能力以SQL函数的形式嵌入混合搜索链路,构建了"OSS 图片挂载 → 向量化入库 → ANN 索引 → 图搜图 / 文搜图 → 业务过滤与融合排序"的全链路闭环。
AI Search+ES 9.4.X最佳实践:“更快、更准、更安全的企业级搜索引擎”"为AI Agent提供坚实底座”
本文聚焦Elasticsearch9.4,内容由搜索形态的变化展开,依次进入向量数据库优化、指标数据库优化、ES|QL计算引擎优化,并在最后落到Agent Builder、Skills等AI基础设施。
DataWorks Data Agent 实战课堂(四):对话式数据源管理与智能问数实操
本文详细分享了阿里云 DataWorks Data Agent 实战,对话式数据源管理与智能问数实操。
DataWorks Data Agent 7月升级: Qwen3.8-max 加持、管住 Token、打通 IM、铺向全球
DataWorks Data Agent迎来一系列重大升级。围绕模型能力、成本治理、企业协作、全球部署四大核心方向完成关键能力补齐,同时在数据专业能力、任务执行、工作资产沉淀和体验细节上持续打磨。
阿里云 EMR Daft AI Function:用 DataFrame 表达式搞定大模型调用与多模态向量化
当用户在DataFrame处理链路中需要引入大模型能力,或需要统一处理文本、图片、视频等多模态数据时,推荐在阿里云EMR Serverless Spark上使用 Daft AI Function方案。
下一页