Categories: Open SourceSoftware

Mozilla lanza un gran repositorio de voz de dominio público

Mozilla ha estado recabando muestras de voz a través de su proyecto Common Voice. Y, ahora, ha decidido lanzar la primera versión de una gran colección de voces que se caracteriza por ser de dominio público.

De hecho, sus responsables dicen que “ya es el segundo mayor conjunto de datos de voz disponible para el público que conocemos”. Y a esto habría que añadir que “personas de todo el mundo están añadiendo y validando nuevas muestras todo el tiempo”. Aunque de momento las muestras que se ofrecen están en inglés, Mozilla asegura que pronto se seguirá con “todos los idiomas”.

El repositorio actual cuenta con unas 400.000 grabaciones que pertenecen a 20.000 personas distintas. En total serían 500 horas de discurso.

El objetivo de Mozilla con Common Voice es ayudar a desarrolladores, fabricantes, empresas e investigadores a la hora de trabajar con tecnología habilitada por voz.

“La mayoría de nosotros solamente tenemos acceso a una colección bastante limitada de datos de voz”, explican desde Mozilla, añadiendo que esto es “un componente esencial para crear motores de reconocimiento de voz de alta calidad”. Además, “estos datos de voz pueden costar más de decenas de miles de dólares y su escala es insuficiente para crear un reconocimiento de voz a un nivel que espera la gente”.

“Al proporcionar este nuevo conjunto de datos públicos”, concluye Mozilla, “queremos ayudar a superar estas barreras y facilitar la creación de nuevos y mejores sistemas de reconocimiento de voz”. Entre ellos, su propio Deep Speech.

Mónica Tilves

Licenciada en Xornalismo por la Universidad de Santiago de Compostela en la especialidad de Periodismo Electrónico y Multimedia. Apasionada de los gadgets, la fotografía digital, el diseño web y el arte. Tras un primer contacto con el mundo de la prensa escrita y con la suficiencia investigadora debajo del brazo, me decanto por los medios online. Cubro la actualidad informativa en Silicon Week desde 2011, además de colaborar en otras publicaciones del grupo NetMediaEurope en España como Silicon News. Ahora en Silicon.es.

Recent Posts

Los mensajes RCS, otra vía de acceso para ciberataques

Los mensajes RCS ofrecen muchas más posibilidades que los SMS, pero también abren la puerta…

1 día ago

Telefónica Empresas ayudará a Microsoft a expandir los Copilot+ PC por España

Acompañará a las empresas en sus procesos de equipamiento, desde la elección del hardware hasta…

2 días ago

IBM y Esade promueven el uso de la IA en los Consejos de Administración

Juntos, trabajarán en la formación y la actualización de habilidades para que los consejeros impulsen…

2 días ago

ASUS lanza un Mini PC con inteligencia artificial

Este dispositivo incluye entre sus especificaciones procesador Intel Core Ultra (Serie 2) y botón Copilot.

2 días ago

EasyVisa adquiere una participación mayoritaria en OTRS Group

Ya cuenta en su poder con más del 90 % de las acciones del proveedor…

2 días ago

SoftwareOne y Crayon acuerdan fusionarse

Los actuales consejeros delegados, Raphael Erb y Melissa Mulholland, se convertirán en co-CEOs de la…

2 días ago