AktualnościAkcjeBez lokalnych języków „AI jest zasadniczo bezużyteczna”: hongkoński Votee AI rzuca wyzwanie dominacji angielskiego i mandaryńskiego dzięki modelowi kantońskiemu

Bez lokalnych języków „AI jest zasadniczo bezużyteczna”: hongkoński Votee AI rzuca wyzwanie dominacji angielskiego i mandaryńskiego dzięki modelowi kantońskiemu

Autor: Fortune Crypto·

Najważniejsze informacje

  • Wiodące modele AI nadal są najmocniejsze w języku angielskim i mandaryńskim, przez co wiele innych języków ma słabsze wsparcie.
  • Votee AI doucza modele open-weight na danych kantońskich i sprzedaje je bankom, uczelniom oraz instytucjom rządowym.
  • Kantoński znacząco różni się od mandaryńskiego w gramatyce i słownictwie, a modele głównego nurtu często nie radzą sobie z lokalną i kulturową wiedzą.
  • Votee twierdzi, że powiększyło swój korpus danych kantońskich z 100 milionów tokenów do ponad 500 milionów tokenów.
  • Firma twierdzi, że jest rentowna dzięki kontraktom z klientami i prowadzi aktywne rozmowy z AI Singapore, planując szerszą ekspansję w Azji Południowo-Wschodniej.
Bez lokalnych języków „AI jest zasadniczo bezużyteczna”: hongkoński Votee AI rzuca wyzwanie dominacji angielskiego i mandaryńskiego dzięki modelowi kantońskiemu

Boom na AI jest napędzany przez dwa języki: angielski i mandaryński chiński. Wiodący twórcy AI — OpenAI, Anthropic, DeepSeek, Moonshot AI, Z.ai i inni — mają siedziby niemal wyłącznie w USA lub w Chinach kontynentalnych, więc ich modele działają najlepiej w językach ojczystych. To pozostawia na uboczu niezliczone inne języki i dialekty, nawet te używane przez dziesiątki milionów ludzi.

„Cała rewolucja AI odbywa się w języku angielskim i mandaryńskim” — mówi Pak-Sun Ting, dyrektor generalny Votee AI, startupu z Hongkongu, który stara się budować modele AI dla kantońskiego i innych pomijanych języków. „Tylko bardzo mała część reprezentuje inne języki”.

Votee jest jedną z rosnącej liczby firm próbujących naprawić zaniedbanie innych języków przez AI. Pobiera modele open-weight od twórców takich jak Meta i Alibaba, doucza je na danych kantońskich, a następnie sprzedaje wynik bankom, uczelniom i instytucjom rządowym. W praktyce ma to znaczenie, ponieważ użytkownicy najbardziej potrzebujący wsparcia w kantońskim często pracują w środowiskach kontaktu z publicznością, gdzie precyzyjne rozumienie lokalnego języka wpływa na codzienne działanie, a nie tylko na swobodną rozmowę.

„To coś więcej niż kultura. Kantoński jest używany w edukacji, ochronie zdrowia i komunikacji policyjnej” — mówi Ting. „Jeśli tego nie obejmiemy, to AI jest zasadniczo bezużyteczna.”

Czym kantoński różni się od mandaryńskiego

Kantoński jest często określany jako „dialekt” chińskiego, ale to określenie nie oddaje, jak bardzo różni się od mandaryńskiego, najczęściej używanej odmiany języka chińskiego. Kantoński ma inną gramatykę niż mandaryński, a także inne słownictwo — szczególnie w Hongkongu, gdzie mówiący często przełączają się między angielskimi i kantońskimi słowami, czasem w tym samym zdaniu.

Ponad 80 milionów ludzi mówi po kantońsku, czyli mniej więcej tyle samo, co po koreańsku, i więcej niż po włosku czy tajsku. Mimo to tak duża baza użytkowników nie przełożyła się na porównywalnie głęboki zasób standaryzowanych danych pisanych, zwłaszcza dla kantońskiego potocznego.

Wiodące modele nie są całkowicie bezużyteczne w obsłudze kantońskiego. HKCanto-Eval — zestaw benchmarków opracowany przez badaczy z Kyushu University, Education University of Hong Kong oraz lokalnej społeczności AI hon9kon9ize, sponsorowany przez Votee — podaje, że choć główne modele radzą sobie z codziennym kantońskim na rozsądnym poziomie, regularnie zawodzą, gdy chodzi o wiedzę kulturową i lokalną.

Trening niskim kosztem

Ting mówi, że budowa kantońskiego LLM to „zasadniczo wykonanie tych samych kroków, jak przy trenowaniu modelu od zera” — czyli wzięcie istniejącego modelu open source, takiego jak Llama od Meta czy Qwen od Alibaby, i przeprowadzenie dodatkowego treningu na danych kantońskich.

Votee pozyskuje dane kantońskie z internetowego scrapingu, w tym treści z Radio Television Hong Kong (RTHK), publicznego nadawcy miasta. Startup otrzymuje też dane od społeczności i uczelni, korzysta z treści z wcześniejszej działalności jako firma big data, a także używa danych syntetycznych — tworząc własne zbiory danych kantońskich do treningu modelu.

Łącznie te działania zwiększyły korpus danych kantońskich ze 100 milionów tokenów do ponad 500 milionów.

Modele Votee AI mają około 70 miliardów parametrów, czyli znacząco mniej niż najlepsze modele na rynku. Mimo to Ting twierdzi, że są wystarczająco dobre, by rozumieć i wnioskować po kantońsku. Co ważniejsze, koszty treningu Votee, choć nie są małe, pozostają znacząco niższe niż w czołowych laboratoriach. Ting szacuje, że firma używa od 500 milionów do 1 miliarda tokenów do trenowania swoich modeli, w porównaniu z bilionami używanymi do modeli anglojęzycznych, przy koszcie około $250,000.

Suwerenne AI

Kilka firm pracuje nad modelami dla tzw. „low resource languages”, czyli języków, za którymi nie stoi ogromny korpus opublikowanych prac. Indosat, druga co do wielkości firma telekomunikacyjna w Indonezji, buduje Sahabat AI, otwartoźródłowy duży model językowy skoncentrowany na językach indonezyjskich, takich jak Bahasa. Wspierana przez państwo inicjatywa AI Singapore prowadzi SEA-LION, obejmujący 11 słabiej obsłużonych języków Azji Południowo-Wschodniej. Korea Południowa poszła jeszcze dalej, organizując wspierany przez państwo turniej eliminacyjny — nazwany przez lokalne media „AI Squid Game” — w celu wyłonienia krajowych liderów dla rodzimych modeli bazowych, przy budżecie AI na 2026 rok wynoszącym około $6.8 miliarda.

Wszystko to mieści się pod hasłem „sovereign AI”, czyli ideą, że rządy i firmy będą chciały posiadać własne dane, modele i infrastrukturę, zamiast wynajmować je za granicą.

„AI stała się tak podstawową potrzebą, że nie chcesz być przywiązany do kogokolwiek innego, kto może ją wyłączyć” — mówi Ting. Przyznaje otwarcie, że pełna wersja idei suwerennej AI, w której kraje posiadają każdy element łańcucha dostaw AI, jest „bardzo trudna”. Zamiast tego sugeruje, by państwa skupiły się na posiadaniu modeli bazowych i aplikacji budowanych na ich podstawie.

Rządy zwykle nie potrzebują modelu tak potężnego jak ten z czołówki rynku, aby zautomatyzować kilka zadań; Ting wyjaśnia, że niewielki model, nawet taki z zaledwie 1 miliardem parametrów, może do tego wystarczyć. Jeśli potrzebna jest bardziej zaawansowana funkcjonalność, można przepuścić wyniki potężnego modelu angielsko- lub chińskojęzycznego przez mniejszą warstwę wyjściową w języku lokalnym.

Ting zwraca uwagę, że firma pracuje z modelami MiniMax i SenseTime oraz może używać chipów Nvidia w swoich operacjach. „Możemy używać chipów Nvidia, możemy używać modelu Moonshot albo DeepSeek” — mówi. „Jesteśmy tą osobą w liceum, która przyjaźni się ze wszystkimi”.

Mimo wszystkich wypowiedzi Tinga o ochronie języków Votee jest firmą nastawioną na zysk. Rządy i korporacje są pierwszymi klientami modelu AI w języku takim jak kantoński czy Bahasa. Ting mówi, że Votee jest rentowne „w tym sensie, że nasze przychody przewyższają koszty”, a finansowanie pochodzi głównie z kontraktów z klientami. Startup może też pochwalić się Allanem Zemanem, hongkońskim potentatem odpowiedzialnym za rozwój dzielnicy rozrywki Lan Kwai Fong, jako doradcą.

Ambicje Votee nie ograniczają się do Hongkongu. Ting mówi, że startup prowadzi „aktywne rozmowy” z AI Singapore, krajową inicjatywą badawczą AI, a następnie planuje dalszą ekspansję w Azji Południowo-Wschodniej. Poza tym Ting chce zbadać wykorzystanie AI do ochrony języków zagrożonych w regionach takich jak Azja Wschodnia, Ameryka Północna i Afryka.

Ting określa to, co anglojęzyczne AI robi innym językom, jako „moment maszyny do pisania” — wzrost produktywności tak duży, że ludzie porzucają własny język, by z niego skorzystać. „Ludzie przyjmą angielski tylko dlatego, że produktywność maszyny do pisania jest tak silna w porównaniu z ich własnym językiem” — mówi.

To, czy kantoński model o 70 miliardach parametrów to zmieni, dopiero się okaże. Ting twierdzi jednak, że wciąż motywuje go chęć dania innym językom realnej szansy w świecie zdominowanym przez AI w języku angielskim i mandaryńskim chińskim.

„Każdy język, który umiera, odbiera wam kolejny sposób postrzegania świata” — mówi. „To może być po prostu zachowane w muzeum, gdzie można to jakoś zobaczyć. Ale możemy też odblokować wiele nowej mądrości”.

Pak-Sun Ting wystąpi na Fortune Leaders Forum, które odbędzie się w Makau 8 wrz.

Ta historia została pierwotnie opublikowana na Fortune.com