0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

Nomad AI计划开发适用于更广泛音频识别的应用

我快闭嘴 来源:36kr网 作者:李子月 2021-01-25 12:52 次阅读

Nomad AI由法国人Vivien Seguy于2018年创立,运营着三个App:和弦自动识别 Chord AI、图片识别词典Yomiwa(日语)和HanYou(中文)。公司注册于爱沙尼亚,得益于其e-residency政策(无论你实际居住在哪里,都可以在爱沙尼亚创建一家公司,并在线管理),Vivien可以一边工作一边旅行。现由于疫情原因回到家乡法国中部的克莱蒙费朗Clermont-Ferrand,办公室设在联合办公空间Turing 22。

Vivien 拥有法国巴黎综合理工学院(École Polytechnique)数学与计算机科学学士学位、英国帝国理工学院应用数学硕士学位,日本京都大学机器学习博士学位。Chord AI、Yomiwa和HanYou的iOS版属于Vivien的公司Nomad AI,他现在全职运营这三个App。Guillaume Bellec现任洛桑联邦理工学院(École Polytechnique Fédérale de Lausanne EPFL)博士后研究员,Chord AI的Android版在他注册的公司Bellec Research名下;Antoine Rolet目前在东京做自由软件工程师,Yomiwa和HanYou的Android版由他注册的公司管理。

进入博士项目前,Vivien已开始着手制作一个日语OCR(光学字符识别)应用。后于博士期间结识Antoine Rolet,正式开始开发日语词典Yomiwa,并进一步将其改编成中文词典HanYou。两个App分别发布于2013年和2014年,是最早的几款具有OCR功能的应用之一,甚至早于谷歌翻译。在Apple Store和Play store上有很多日语和中文词典的应用,以Pleco为代表,Pleco内容更加丰富,得益于其多年来与专业词典编辑的合作关系。Vivien表示,Yomiwa和HanYou是唯一具有光学识别、形态文字分析、手写识别、自动从新闻中获取词表等独特功能的词典应用,并计划进一步充实词典内容。Yomiwa和HanYou可以免费下载使用,一些特殊功能,如相机OCR或全自动每日单词列表,需要通过购买 “专业版 ”来解锁。模式为单次付费,而非会员制。

音频识别是Vivien更感兴趣的领域。博士期间Vivien和Antoine Rolet一起做了一个关于盲源分离的研究项目,目的是将混合的声音从单一的录音中分离出来。同时,Vivien的合伙人又发表了一篇名为 “Spectral Optimal Transport ”的论文,利用Vivien的研究课题--最优传输来建立一个钢琴音符识别算法。后来,Vivien在ICLR2018会议上认识了另一位博士生Guillaume Bellec,他也是一位业余音乐人,他们开始一起讨论如何实现这个想法,Chord AI项目由此才正式开始。

Chord AI利用机器学习算法自动识别音乐中的和弦、调性、节拍等,可以从本地文件、麦克风、甚至在同一设备中播放的YouTube上来获取音频。Vivien强调了大量准确标注数据的重要性。几个创始人最开始在公开的注释数据集(如Isophonics、JAAH和Billboard )训练算法,数据在数量和质量上非常有限,无法达到目标精度,Vivien希望能够实现在和弦识别方面远超最新研究论文中的最先进结果。因此他们很快就开始建立自己的数据库,并自己对音频进行标注,还对音乐进行程序化合成。他们还专门做了一个私人的iOS应用,专门用来简化用和弦和节拍注释歌曲的过程。因此,Vivien表示Chord AI在识别和弦精度上高于同类公司,如Chord Tracker和Chordify;Yamaha的应用 “Chord Tracker ”似乎比Chordify或MyChord精度更高,但它只能从本地文件中获取音频。Chord AI现可以免费下载和使用大部分功能。一些特殊的功能,如高级和弦识别或音高转换,需要解锁 “专业版”才能使用。费用为10美元/次(截至2021年1月),并不是会员模式。

Chord AI的iOS和Android版本共有约15万活跃用户,日下载增量1000次(大约50%在美国,30%在亚洲,20%在欧洲)。每天在这1000个新用户中,约有5%的用户最终购买了 “专业版”。Vivien表示,Chord AI在法国约有200-300万潜在用户,世界范围内潜在用户超过1亿。Yomiwa的iOS和Android版本共有约30万活跃用户,日下载增量300次,约有2%的新用户最终购买了“专业版”。 HanYou的iOS和Android版本拥有约3万活跃用户,日下载增量50次,约有3%的新用户最终购买了“专业版”。2020年,Chord AI、Yomiwa和HanYou的营业总额约为10万美金。Vivien预计三个App的总营业额在2021年至少能翻三倍。

Vivien正在筹划与Guillaume一起围绕Chord AI成立一个初创公司,并开发另一个不仅限于音乐,而是适用于更广泛音频的应用。总部将位于欧洲,但没有确定具体的城市。目前Nomad AI还没有融过资,前期费用都由创始人承担。现计划为新初创公司筹集100万欧元,用于团队建设,增添一名COO、一名CMO、两到三名机器学习工程师。
责任编辑:tzh

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 计算机
    +关注

    关注

    19

    文章

    7409

    浏览量

    87691
  • AI
    AI
    +关注

    关注

    87

    文章

    30072

    浏览量

    268345
  • iOS
    iOS
    +关注

    关注

    8

    文章

    3393

    浏览量

    150427
收藏 人收藏

    评论

    相关推荐

    NVIDIA推出适用于网络安全的NIM Blueprint

    德勤使用适用于容器安全的 NVIDIA NIM Agent Blueprint 帮助企业利用开源软件构建安全的 AI
    的头像 发表于 11-20 09:58 99次阅读

    7MFL5430-2AA10雷达波料位计适用于哪些物料

    雷达波料位计适用于多种物料的测量,包括液体、浆料、颗粒料和固体块状物料等。同时,它还适用于各种恶劣环境和变化环境,广泛应用于多个行业领域。
    的头像 发表于 10-08 16:11 154次阅读

    什么是离线语音识别芯片?与在线语音识别的区别

    离线语音识别芯片适用于智能家电等,特点为小词汇量、低成本、安全性高、响应快,无需联网。在线语音识别功能更广泛识别准确率高,但依赖稳定网络。
    的头像 发表于 07-22 11:33 364次阅读

    如何设计人脸识别的神经网络

    人脸识别技术是一种基于人脸特征信息进行身份识别的技术,广泛应用于安全监控、身份认证、智能门禁等领域。神经网络是实现人脸识别的关键技术之一,本文将介绍如何设计人脸
    的头像 发表于 07-04 09:20 562次阅读

    Arm计划开发人工智能芯片

    近日,据媒体报道,科技巨头软银集团旗下的芯片设计公司Arm正在积极布局人工智能(AI)领域,计划开发AI芯片,以满足市场对高性能计算日益增长的需求。
    的头像 发表于 05-13 10:05 377次阅读

    Uhnder 推出首款适用于更广泛汽车市场的 4D 数字成像雷达芯片

    通道,且基于领先的数字编码调制(DCM),可以为更广泛的汽车市场提供 更具性价比的 4D 数字成像雷达解决方案 。   在自动驾驶领域,4D 成像雷达以其卓越的安全性能备受瞩目,然而,由于技术复杂和成本高昂,目前这一技术仅用于高端车型。为了解决这一问题,Uhnder
    发表于 04-24 09:17 3559次阅读

    开发者手机 AI - 目标识别 demo

    功能简介 该应用是在Openharmony 4.0系统上开发的一个目标识别的AI应用,旨在从上到下打通Openharmony AI子系统,展示Openharmony系统的
    发表于 04-11 16:14

    英特尔宣布AI PC加速计划新增两项AI举措

    首先,“AI PC 开发计划”面向软件研发人员和独立软件开发商,为他们提供便捷的开发环境,助力加速大规模运用新型
    的头像 发表于 03-27 16:03 343次阅读

    NVIDIA cuPQC帮助开发适用于量子计算时代的加密技术

    NVIDIA cuPQC 可为相关开发者提供加速计算支持,帮助开发适用于量子计算时代的加密技术。cuPQC 库可利用 GPU 并行性,为要求严苛的安全算法提供支持。
    的头像 发表于 03-22 09:53 385次阅读

    FP_AI_VISION1工程是否可以适用于stm32f746discovery开发板?

    FP_AI_VISION1工程是否可以适用于stm32f746discovery开发板?使用STM32CUBEIDE打开FP_AI_VISION1工程为什么没有stm32可运行文件,不
    发表于 03-18 07:21

    安达发|APS计划排产软件适用于哪些场景?

    和生产效率的提升。那么,APS计划排产软件适用于哪些场景呢?下面我将从不同的角度来详细解答这个问题。 APS计划排产软件适用于制造业企业。制造业是国民经济的重要支柱产业,其生产过程中涉
    的头像 发表于 02-01 15:24 382次阅读
    安达发|APS<b class='flag-5'>计划</b>排产软件<b class='flag-5'>适用于</b>哪些场景?

    英伟达和AMD发布适用于台式电脑的新型AI芯片

    英伟达和AMD这两家GPU巨头近日宣布,他们将发布适用于台式电脑的新型AI芯片。
    的头像 发表于 01-10 13:59 843次阅读

    芯曜途科技发布适用于MEMS传感器阵列的STN100近感AI推理芯片

    近日,芯曜途科技发布了适用于MEMS传感器阵列的STN100近感AI推理芯片。
    的头像 发表于 12-15 15:51 1042次阅读

    EVAL-AD7386FMCZ是否适用于其他带有FMC接口的FPGA开发板?

    请问EVAL-AD7386FMCZ是否适用于其他带有FMC接口的FPGA开发板,例如Xilinx公司的ML605开发板?
    发表于 12-04 07:30

    IGBT适用于ZVS 还是 ZCS?

    IGBT适用于ZVS 还是 ZCS?
    的头像 发表于 12-01 16:10 1179次阅读
    IGBT<b class='flag-5'>适用于</b>ZVS 还是 ZCS?