Fish Audio prikupio 50 miliona dolara za razvoj prirodnijih i upravljivijih AI glasova

Fish Audio je u utorak objavio seed rundu od 50 miliona dolara, koju su predvodili Coreline Ventures i Capital Today. Kompanija iz Palo Alta za godinu dana stigla je do više od 8 miliona korisnika i 21 milion dolara godišnjeg ponavljajućeg prihoda.
Glasovna AI traži kontrolu, ali i poverenje
Autori očekuju izražajan sintetički govor, dok su preduzećima za korisničku podršku, prodaju i glasovne agente važni precizno upravljanje i mala latencija. Fish Audio zato nudi biblioteku sa više od 15.000 kontrola prirodnog jezika.
Platforma je, međutim, bila suočena sa pritužbama autora čiji su glasovi postavljeni bez saglasnosti. Automatizovani postupak sada omogućava uklanjanje glasa za manje od tri minuta nakon dostavljanja kratkog uzorka ili ugovora. To ne sprečava neovlašćeno postavljanje pre nego što vlasnik sazna za zloupotrebu.
Od modela na jednom GPU-u do poslovnog API-ja
Projekat je pokrenuo bivši istraživač kompanije NVIDIA Shijia Liao, trenirajući prvi model na jednom GPU-u. Repozitorijum Fish Speech ima više od 31.000 GitHub zvezdica, a koriste ga nezavisni programeri, dizajneri video-igara i autori sadržaja.
Fish Audio je tokom prethodne godine predstavio četiri modela za generisanje govora i jedan model za pretvaranje govora u tekst. Tri generativna modela su otvorenog koda, dok je S2.1 Pro dostupan isključivo putem plaćenog API-ja. HeyGen, Sanas i Plaud već koriste poslovnu verziju platforme.
Poverenje autora zahteva da saglasnost, transparentnost i atribucija budu ugrađene u proizvod, uz provereno vlasništvo nad glasom, jasne licence i jednostavno prijavljivanje, ocenio je Oskue Honda iz Coreline Ventures.
Kompanija ove godine planira model za razumevanje zvuka, kao i speech-to-speech sistem. Za poslovne korisnike poruka je jasna: kvalitet i brzina glasovne automatizacije postaju konkurentska prednost, ali izbor platforme mora obuhvatiti proveru porekla glasova, licenci i postupaka za zaštitu prava.

