NieuwsMacroTalksign lanceert marktplaats voor gebarentaaldatasets om AI-infrastructuur voor Doven te bouwen

Talksign lanceert marktplaats voor gebarentaaldatasets om AI-infrastructuur voor Doven te bouwen

Auteur: TechNext24·

Belangrijkste punten

  • Talksign heeft de Talksign Marketplace gelanceerd, een live platform waarmee Dove gemeenschappen, onderzoekers, instellingen en bedrijven hoogwaardige gebarentaaldatasets kunnen bijdragen, annoteren, licentiëren en benaderen.
  • Volgens in het artikel geciteerde WHO-gegevens ervaren wereldwijd meer dan 430 miljoen mensen invaliderend gehoorverlies, een aantal dat tegen 2050 naar verwachting boven de 700 miljoen uitkomt, waarbij deze populaties afhankelijk zijn van tussen de 200 en 300 gedocumenteerde gebarentalen.
  • Bijdragers aan de marktplaats ontvangen directe financiële compensatie voor opgenomen videodata, en betaald annotatiewerk wordt toegewezen aan vloeiende gebarentaligen in plaats van aan niet-moedertaalwerkers.
  • Omdat gebarentaaldata intrinsiek biometrisch en streng gereguleerd is, introduceerde Talksign een open verificatieportaal dat elke dataset koppelt aan de bron en licentievoorwaarden, zodat toestemming en portretrechten controleerbaar zijn.
  • Talksign wijst zijn eigen modellen aan als proof of concept: Palm 1.0 zou 84.2% semantische nauwkeurigheid behalen met ongeveer 29 milliseconden latency, terwijl Echo 1.0 naar verluidt een 0.927 Structural Similarity Index bereikt bij 30 frames per seconde.
Talksign lanceert marktplaats voor gebarentaaldatasets om AI-infrastructuur voor Doven te bouwen

Talksign heeft de Talksign Marketplace gelanceerd, een platform waar Dove gemeenschappen, onderzoekers, instellingen en bedrijven hoogwaardige gebarentaaldatasets kunnen bijdragen, annoteren, licentiëren en benaderen. Het bedrijf positioneert het nieuwe platform als de fundamentele infrastructuurlaag die nodig is om kunstmatige intelligentie te bouwen die echt werkt voor Doven.

De lancering pakt een langdurige lacune in AI-ontwikkeling aan. Moderne kunstmatige intelligentie kan complexe code schrijven, fotorealistische video genereren en gesproken woorden in milliseconden vertalen, maar faalt fundamenteel in het begrijpen van de natuurlijke communicatie van honderden miljoenen mensen. De barrière is niet rekenkracht of algoritmische verfijning; het probleem is een ernstig tekort aan gestructureerde, licentieerbare data.

Terwijl toonaangevende spraakmodellen trainen op decennia aan van het open web geschraapte audio, is de infrastructuur voor multimodale gebarentaaldata vrijwel afwezig gebleven. De meeste publiek beschikbare gebarentaalcorpora zijn klein, opgenomen in steriele studio-omgevingen en beperkt tot een handvol gebarentaligen. Wanneer ontwikkelaars deze smalle datasets in machine-learningmodellen dwingen, falen de resulterende producten onvermijdelijk in de praktijk, omdat ze moeite hebben met regionale dialecten, natuurlijke gebarentempo’s en de complexe gezichtsgrammatica die nodig is om intensiteit uit te drukken of een vraag te stellen.

Edidiong Ekong, oprichter en CEO van Talksign, zei in een exclusieve verklaring aan Technext: “Vandaag lanceren we de Talksign Marketplace, een plek waar Dove gemeenschappen, onderzoekers, instellingen en bedrijven hoogwaardige gebarentaaldatasets kunnen bijdragen, annoteren, licentiëren en benaderen. Het is de ontbrekende infrastructuurlaag onder elke serieuze poging om AI te bouwen die werkt voor Doven, en het is het stuk dat we zelf moesten bouwen om iets anders te kunnen bouwen.”

“Voor de wereldwijde technologiesector, en vooral voor het Afrikaanse ecosysteem voor kunstmatige intelligentie, betekent deze lancering meer dan alleen een toegankelijkheidstool. Het is een commercieel en ethisch kader voor hoe we het probleem van laagbrontalen in AI oplossen,” voegde hij eraan toe.

De omvang van de kloof

Volgens gegevens van de World Health Organisation ervaren wereldwijd meer dan 430 miljoen mensen invaliderend gehoorverlies — een aantal dat volgens de WHO tegen 2050 boven de 700 miljoen zal uitkomen — en deze bevolkingsgroepen zijn afhankelijk van tussen de 200 en 300 gedocumenteerde gebarentalen. Ondanks deze schaal zijn gebarentalen volledig ondervertegenwoordigd in de huidige machine-learninghausse.

Gebarentalen zijn volwaardige natuurlijke talen met een unieke morfologie en syntaxis, die gelijktijdig worden uitgedrukt via de handen, het gezicht, het bovenlichaam en de ruimtelijke omgeving. Ze zijn bovendien wederzijds onverstaanbaar — American Sign Language en British Sign Language verschillen fundamenteel, ondanks dat beide landen gesproken Engels delen — dus er bestaat geen enkele universele ‘gebarentaal’ die een model moet beheersen. AI bouwen die deze talen begrijpt, vereist het oplossen van een werkelijk moeilijk multimodaal computerprobleem, waarbij modellen in realtime over meerdere visuele kanalen moeten redeneren.

De data die nodig is om dergelijke modellen te trainen, bestaat wel, maar is sterk versnipperd. Ze zit opgesloten in universitaire archieven zonder commerciële licentiepaden, of blijft in handen van onafhankelijke Dove organisaties die nooit een financiële prikkel hebben gekregen om die te delen.

Hoe de marktplaats werkt

De marktplaats van Talksign werkt via vier kernpijlers die zijn ontworpen om gebarentaaldata te commercialiseren en te standaardiseren:

Bijdragen: Onafhankelijke gebarentaligen en Dove organisaties kunnen opgenomen videodata indienen en ontvangen daarvoor directe financiële compensatie.

Annoteren: Ruwe video wordt via gloss-annotatie, pose-extractie en taalkundige labeling zwaar verwerkt tot trainingsdata. Talksign leidt dit betaalde werk rechtstreeks naar vloeiende gebarentaligen in plaats van het uit te besteden aan niet-moedertaalsprekers.

Licentiëren: Kopers ontvangen machineleesbare licentievoorwaarden en duidelijke herkomstgegevens, waarmee een grote compliance-uitdaging voor enterprise-AI-bouwers wordt opgelost.

Toegang: Startups en onderzoekers kunnen diverse datasets over meerdere dialecten en opnameomgevingen evalueren en verwerven vanuit één hub.

Een blauwdruk voor Afrikaanse AI

Voor ontwikkelaars en oprichters in Afrika zal het onderliggende probleem dat Talksign oplost zeer herkenbaar klinken. Het continent is de thuisbasis van duizenden gesproken en gebarentalen, waaronder Nigerian Sign Language (NSL), die lijden onder dezelfde dataschaarste die hen buitensluit uit de wereldwijde AI-economie. De World Federation of the Deaf schat dat meer dan 80 procent van de ongeveer 70 miljoen dove mensen ter wereld in ontwikkelingslanden woont, een verdeling die regio’s zoals Afrika onevenredig zwaar laat meewegen bij elke poging om representatieve gebarentaaldata te bouwen.

Afrikaanse technologen die tools voor natuurlijke taalverwerking bouwen voor talen als Hausa, Yoruba of Swahili lopen consequent tegen een datamuur aan. Het Talksign-framework biedt een blauwdruk voor hoe lokale oprichters laagbrontaldata ethisch kunnen bundelen en gelde maken. Door een transparante marktplaats te creëren die moedertaalsprekers en gebarentaligen betaalt voor hun bijdragen, kunnen ontwikkelaars de trage, van subsidies afhankelijke routes van academische dataverzameling omzeilen en robuuste, commercieel inzetbare corpora bouwen.

Toestemming, verificatie en biometrische data

De historische relatie tussen de technologiesector en gemarginaliseerde gemeenschappen is grotendeels extractief geweest: data wordt geschraapt, modellen worden getraind en de gemeenschappen die de grondstof leveren, ontvangen niets.

Gebarentaaldata brengt een extra uitdaging met zich mee. Omdat deze intrinsiek biometrisch is en iemands gezicht en lichaam vastlegt, kan ze niet zoals tekst worden geanonimiseerd. Ze valt bovendien in de zwaarst gereguleerde categorie van persoonsgegevens: de GDPR van de EU classificeert biometrische gegevens die worden verwerkt om een persoon te identificeren bijvoorbeeld als een ‘bijzondere categorie’ waarvoor expliciete toestemming nodig is, en de EU AI Act legt aanvullende regels op voor biometrische systemen. Talksign heeft een open verificatieportaal geïntroduceerd om dit rechtstreeks aan te pakken. Het systeem koppelt elke dataset terug aan de bron en licentievoorwaarden, waardoor controleerbare toestemming en portretrechten worden gewaarborgd. Kopers kunnen de vloeiendheid van de gebarentaligen en de nauwkeurigheid van de annotaties verifiëren voordat ze de data in hun pipelines opnemen.

Proof of concept

Talksign stelt dat de infrastructuur is ontstaan uit eigen interne ontwikkelingshindernissen en verwijst naar zijn eigen modellen als proof of concept. Palm 1.0, een speech-to-sign-model, zou 84.2% semantische nauwkeurigheid bereiken met een latency van ongeveer 29 milliseconden. Het sign-to-speech-tegenhanger, Echo 1.0, zou een 0.927 Structural Similarity Index behalen bij 30 frames per seconde.

Verder dan ondertiteling

Ondertiteling is volgens Talksign een slechte vervanging voor echte toegankelijkheid, omdat het volledig eenrichtingsverkeer is. Doven in staat stellen om native met technologie te communiceren vereist dat gebarentaal wordt behandeld als een primaire taalvorm. Door echte commerciële waarde toe te kennen aan deze data en de gemeenschappen die deze genereren te compenseren, zegt het bedrijf de basis te leggen voor een rechtvaardigere AI-infrastructuur — precies het soort structureel denken dat het bredere tech-ecosysteem moet overnemen.

De Marketplace is nu live. Houders van gebarentaaldata die deze willen aanbieden, gebarentaligen en organisaties die willen bijdragen of annoteren, en bouwers die gelicentieerde multimodale gebarentaaldata nodig hebben, kunnen zich aanmelden op marketplace.talksign.co of rechtstreeks contact opnemen met het team via sales@talksign.co.