Om prosjektet
HANCE utvikler AI-teknologi for lyd. Append bistår med å bygge en pipeline som kjører lydanalysemodeller over store mengder lydfiler i Google Cloud, for automatisk generering av metadata.
Utfordring
Det å analysere et stort lydbibliotek manuelt er ikke praktisk mulig. HANCE trengte en måte å generere metadata automatisk på tvers av store datamengder, noe som krever både riktige modellvalg og en pipeline effektiv nok til at kjøring i skala er økonomisk forsvarlig i skyen.
Løsning
Oppsett av skyinfrastruktur i Google Cloud, med effektiv lesing av lydfiler fra Cloud Storage via Dataflux. Integrasjon og testing av flere lydmodeller – CLAP, AST, Nemo ASR og USAD – i en samlet metadata-pipeline, med optimalisering for kjøring i skala og et enkelt terminalgrensesnitt for å velge datakilde.
Resultater
En fungerende metadata-pipeline med flere integrerte lydmodeller, dokumentasjon, og et terminalgrensesnitt for valg av datakilde.
Teknologi
- Google Cloud (Compute, Cloud Storage)
- Dataflux
- CLAP
- AST
- Nemo ASR
- USAD
- Python
Dato: 27.7.2026

