音频应用   音频插件联盟,正版插件,欢迎大家选择!

 找回密码
 快速注册

QQ登录

只需一步,快速开始

阅读: 13133|回复: 0

[音频] Nomad AI计划开发适用于更广泛音频识别的应用

[复制链接]

252

积分

2

听众

72

音贝

音频应用

Rank: 1

积分
252
发表于 2021-1-26 | |阅读模式
音频应用公众号资讯免费发布推广
NomadAI由法国人VivienSeguy于2018年创立,运营着三个App:和弦自动识别ChordAI、图片识别词典Yomiwa(日语)和HanYou(中文)。公司注册于爱沙尼亚,得益于其e-residency政策(无论你实际居住在哪里,都可以在爱沙尼亚创建一家公司,并在线管理),Vivien可以一边工作一边旅行。现由于疫情原因回到家乡法国中部的克莱蒙费朗Clermont-Ferrand,办公室设在联合办公空间Turing22。

Vivien拥有法国巴黎综合理工学院(ÉcolePolytechnique)数学与计算机科学学士学位、英国帝国理工学院应用数学硕士学位,日本京都大学机器学习博士学位。ChordAI、Yomiwa和HanYou的iOS版属于Vivien的公司NomadAI,他现在全职运营这三个App。GuillaumeBellec现任洛桑联邦理工学院(ÉcolePolytechniqueFédéraledeLausanneEPFL)博士后研究员,ChordAI的Android版在他注册的公司BellecResearch名下;AntoineRolet目前在东京做自由软件工程师,Yomiwa和HanYou的Android版由他注册的公司管理。
pIYBAGAOWyKAZl8ZAAB1UEadPi8723.jpg

Nomad AI计划开发适用于更广泛音频识别的应用

进入博士项目前,Vivien已开始着手制作一个日语OCR(光学字符识别)应用。后于博士期间结识AntoineRolet,正式开始开发日语词典Yomiwa,并进一步将其改编成中文词典HanYou。两个App分别发布于2013年和2014年,是最早的几款具有OCR功能的应用之一,甚至早于谷歌翻译。在AppleStore和Playstore上有很多日语和中文词典的应用,以Pleco为代表,Pleco内容更加丰富,得益于其多年来与专业词典编辑的合作关系。Vivien表示,Yomiwa和HanYou是唯一具有光学识别、形态文字分析、手写识别、自动从新闻中获取词表等独特功能的词典应用,并计划进一步充实词典内容。Yomiwa和HanYou可以免费下载使用,一些特殊功能,如相机OCR或全自动每日单词列表,需要通过购买“专业版”来解锁。模式为单次付费,而非会员制。

音频识别是Vivien更感兴趣的领域。博士期间Vivien和AntoineRolet一起做了一个关于盲源分离的研究项目,目的是将混合的声音从单一的录音中分离出来。同时,Vivien的合伙人又发表了一篇名为“SpectralOptimalTransport”的论文,利用Vivien的研究课题--最优传输来建立一个钢琴音符识别算法。后来,Vivien在ICLR2018会议上认识了另一位博士生GuillaumeBellec,他也是一位业余音乐人,他们开始一起讨论如何实现这个想法,ChordAI项目由此才正式开始。

ChordAI利用机器学习算法自动识别音乐中的和弦、调性、节拍等,可以从本地文件、麦克风、甚至在同一设备中播放的YouTube上来获取音频。Vivien强调了大量准确标注数据的重要性。几个创始人最开始在公开的注释数据集(如Isophonics、JAAH和Billboard)训练算法,数据在数量和质量上非常有限,无法达到目标精度,Vivien希望能够实现在和弦识别方面远超最新研究论文中的最先进结果。因此他们很快就开始建立自己的数据库,并自己对音频进行标注,还对音乐进行程序化合成。他们还专门做了一个私人的iOS应用,专门用来简化用和弦和节拍注释歌曲的过程。因此,Vivien表示ChordAI在识别和弦精度上高于同类公司,如ChordTracker和Chordify;Yamaha的应用“ChordTracker”似乎比Chordify或MyChord精度更高,但它只能从本地文件中获取音频。ChordAI现可以免费下载和使用大部分功能。一些特殊的功能,如高级和弦识别或音高转换,需要解锁“专业版”才能使用。费用为10美元/次(截至2021年1月),并不是会员模式。

ChordAI的iOS和Android版本共有约15万活跃用户,日下载增量1000次(大约50%在美国,30%在亚洲,20%在欧洲)。每天在这1000个新用户中,约有5%的用户最终购买了“专业版”。Vivien表示,ChordAI在法国约有200-300万潜在用户,世界范围内潜在用户超过1亿。Yomiwa的iOS和Android版本共有约30万活跃用户,日下载增量300次,约有2%的新用户最终购买了“专业版”。HanYou的iOS和Android版本拥有约3万活跃用户,日下载增量50次,约有3%的新用户最终购买了“专业版”。2020年,ChordAI、Yomiwa和HanYou的营业总额约为10万美金。Vivien预计三个App的总营业额在2021年至少能翻三倍。

Vivien正在筹划与Guillaume一起围绕ChordAI成立一个初创公司,并开发另一个不仅限于音乐,而是适用于更广泛音频的应用。总部将位于欧洲,但没有确定具体的城市。目前NomadAI还没有融过资,前期费用都由创始人承担。现计划为新初创公司筹集100万欧元,用于团队建设,增添一名COO、一名CMO、两到三名机器学习工程师。
欢迎厂家入驻,推文!免费!微信:yinpinyingyong
您需要登录后才可以回帖 登录 | 快速注册

本版积分规则

音频应用搜索

小黑屋|手机版|音频应用官网微博|音频招标|音频应用 (鄂ICP备16002437号)

Powered by Audio app

快速回复 返回顶部 返回列表