#新人报道# 算法工程师(AI音乐)|35-55K*15薪|音乐生成大模型|codec/tokenizer|多模态
趣丸科技:集兴趣社交、人工智能、电子竞技等业务于一体的创新型科技企业。
【你将负责】
负责音乐大模型前沿技术研发,覆盖音乐生成(歌曲/纯音乐/音效)与音乐理解方向;
负责音乐生成大模型的算法研究、模型训练;
负责音乐音频表征与量化方式研究:音频编解码器(codec/tokenizer)的设计、训练与迭代;
负责多模态音乐生成(本/歌词/图像/视频等条件驱动),与理解-生成一体化方向的算法研究与开发。
【我们期待】
计算机科学、数学、人工智能或相关领域本科及以上学历;
3 年及以上音乐生成(TTM)/ 音频生成(TTA)/ 大模型(NLP/多模态)相关经验;
熟练使用 PyTorch,扎实的 Python 编程功底。
【核心技术】
音频量化与离散化表征:理解连续表征与离散表征,掌握 BEST-RQ / RVQ / FSQ / SimVQ 等;
掌握音乐生成大模型架构:生成条件编码结构、生成网络结构(AR & DiT);

跟进音乐生成前沿开源与商业项目,能分析其技术路线与差距;
熟悉音乐/音频理解模型:音乐自监督表征、音频-文本对齐、音乐结构分析与多模态大模型;
有大模型训练经验,掌握预训练、后训练、强化学习阶段的理论与流程;
了解图像生成、视频合成的技术原理(多模态背景)。
【加分项】
在 ISMIR / ICASSP / NeurIPS / InterSpeech 等顶会有论文发表;
热爱音乐,有音乐背景(乐器/乐理/创作)或音乐领域实际项目经验;
有音乐音频 codec / tokenizer 的实际训练与迭代经验。
【我们提供】
35-55K*15薪,行业竞争力月薪 + 年终奖金;
免费一日三餐 + 下午茶;六险一金;年度健康体检;年度 2000 旅游;带薪年假;打车报销/优惠;
新人 landing 体系 & 1V1 领航员助力融入;清晰职业发展双通道(专家/管理);针对不同人群的学习赋能项目;
周年庆、年会;入职新人大礼包;节日员工礼盒 + 家属礼盒;大玩家 Club;部门团建;健身房、理疗室、艺术课程、瑜伽、普拉提等。
内推优先反馈。期待与你一起,把音乐生成、音频理解与多模态生成推到新的高度。
展开
评论