机器学习数据管道的音频数据工程

last updated June 24, 2026 10:26 UTC

Viva Translate, Inc.

HQ: USA

more jobs in this category:

  • -> Transcriptionist @ Literably
  • -> English Transcript Editor @ 3Play Media
  • -> Freelance Writer @ IAPWE
  • -> IvyMath Online Math Instructor/Tutor - $22/hour - Fully Remote @ IvyMath
  • -> Online English Teacher @ Magic Ears

我们正在寻找一名数据工程师,最好具备一定音频处理经验,加入我们的机器学习团队。你将把原始数据转换为机器学习可使用的格式。该岗位还包括构建所需的基础设施,用于采集并整理进入我们服务器的数据流。你也将与我们的数据科学家协作,应用并评估统计方法。总体而言,你将负责数据汇聚平台。

要在该数据工程岗位上取得成功,你需要能够构建可扩展的平台,并自动化从多个来源采集与整理数据的服务。你是一位编程能力强、注重细节、具备良好分析能力的工程师。具备音频处理方面的知识是加分项。

关于 Viva
Viva Translate 由来自 Google 和斯坦福等领先公司与机构的工程团队领导,他们拥有共同的愿景。我们正在打造一个未来:语言与文化不再成为工作的障碍与机会的门槛,愿景从拉丁美洲开始。

我们的产品核心是技术。Viva 正在创建一款工具,帮助人们在英语、西班牙语和葡萄牙语方面读得更好、写得更好、也说得更好。我们怀揣着一个雄心勃勃、无国界工作的梦想——但我们也知道,伟大的梦想源自伟大的人。

你的故事是什么?如果你是探索者、梦想家和建设者,我们很期待与你相识。

你将要做的事
– 分析并整理原始音频
– 构建数据系统与数据管道
– 为预测建模准备数据
– 寻找提升数据质量、可靠性与安全性的方式
– 开发分析工具
– 与数据科学家、架构师以及人工转录与翻译人员协作
– 与我们的机器学习技术栈协作,包括 Python/Django、AWS、CI/CD、Terraform、BERT 以及 Spacey

必备技能 💪
– 1 年以上数据工程师或类似岗位经验
– 掌握编程语言(例如 Python)
– 具备 SQL 数据库设计的实操经验(例如 Postgres)
– 能够与来自不同技术背景的团队成员有效沟通

加分项 🍒
– 计算机科学、信息技术或相关领域学位
– 使用项目管理工具的经验(例如 GitHub、Asana)
– 处理音频流数据的经验
– 过往构建数据平台的经验
– 云服务提供商经验(例如 AWS、GCP、Azure)
– 具备分布式/流式数据处理技术与框架经验(例如 Scala、Apache Spark、Databricks、Apache Kafka、Redpanda、CockroachDB)
– 西班牙语和/或葡萄牙语流利

我们的价值观 💛
– 持续成长:我们以制定新标准并对自己的工作负责为荣
– 以数据与逻辑为导向:我们共同用证据做决策
– 开放与正直:我们营造低自我中心的环境,强调透明、同理心与反馈
– 充满趣味:我们重视多样性与创造力,并鼓励快速失败

我们提供 ✨
– 完全远程团队 🌎
– 每年 3+ 次线下集训(此前地点包括墨西哥、哥伦比亚和厄瓜多尔)
– 加入早期创业团队(12 人且仍在增长 🚀)
– 家庭办公津贴
– 健康与健身福利
– 学习津贴,用于支持你的个人与职业发展

Apply info ->

To find out more about this job, please visit this link

Shopping Cart
There are no products in the cart!
Total
 0.00
0