Alle prosjekter
HANCE-logo

Metadata-pipeline for lydbibliotek

Prosjektperiode:
November 2025 – Desember 2025
  • AI
  • Data Science
  • Systemutvikling

Kort beskrivelse

For HANCE bygget vi en pipeline i Google Cloud som kjører flere lydanalysemodeller over store mengder lydfiler for automatisk generering av metadata.

Om prosjektet

HANCE utvikler AI-teknologi for lyd. Append bistår med å bygge en pipeline som kjører lydanalysemodeller over store mengder lydfiler i Google Cloud, for automatisk generering av metadata.

Utfordring

Det å analysere et stort lydbibliotek manuelt er ikke praktisk mulig. HANCE trengte en måte å generere metadata automatisk på tvers av store datamengder, noe som krever både riktige modellvalg og en pipeline effektiv nok til at kjøring i skala er økonomisk forsvarlig i skyen.

Løsning

Oppsett av skyinfrastruktur i Google Cloud, med effektiv lesing av lydfiler fra Cloud Storage via Dataflux. Integrasjon og testing av flere lydmodeller – CLAP, AST, Nemo ASR og USAD – i en samlet metadata-pipeline, med optimalisering for kjøring i skala og et enkelt terminalgrensesnitt for å velge datakilde.

Resultater

En fungerende metadata-pipeline med flere integrerte lydmodeller, dokumentasjon, og et terminalgrensesnitt for valg av datakilde.

Teknologi

  • Google Cloud (Compute, Cloud Storage)
  • Dataflux
  • CLAP
  • AST
  • Nemo ASR
  • USAD
  • Python

Dato: 27.7.2026

Vil dere ha noe lignende?

Vi hjelper dere gjerne med å finne den beste løsningen for behovet deres.

Snakk med oss om lignende løsning