Sprache sollte niemals ein Hindernis sein

Mar 23 2023
In Indien – einem Land, in dem über 22 Amtssprachen und 19.500 Sprachen oder Dialekte als Muttersprache gesprochen werden – kann Sprache entweder ein Befreier oder ein Hindernis sein. Denjenigen, die eine der am weitesten verbreiteten Sprachen des Landes beherrschen, stehen ungeahnte Möglichkeiten offen.

In Indien – einem Land, in dem über 22 Amtssprachen und 19.500 Sprachen oder Dialekte als Muttersprache gesprochen werden – kann Sprache entweder ein Befreier oder ein Hindernis sein.

Denjenigen, die eine der am weitesten verbreiteten Sprachen des Landes beherrschen, stehen ungeahnte Möglichkeiten offen. Diejenigen, die das nicht tun, stehen in verschiedenen Bereichen ihres Lebens vor einem harten Kampf – von der Bildung über den Handel bis hin zu Recht und Gerechtigkeit. Stellen Sie sich vor, Sie versuchen, Schulunterricht zu entschlüsseln, der entweder auf Hindi oder Englisch verfasst ist, oder sich im Rechtssystem zurechtzufinden, das Urteile in Amtssprachen hat, von denen Sie nicht verstehen, dass sie eine Herausforderung darstellen können.

Für viele Inder, die nicht lesen und schreiben können, könnte das geschriebene Wort genauso gut ein riesiges Metalltor sein, das sie von Informationen abhält, die für ihre Entwicklung wichtig sind.

Lange bevor die von ChatGPT inspirierte KI-Hysterie unser kollektives Bewusstsein erfasste, experimentierten Unternehmer aus dem ganzen Land mit KI, um sprachliche Barrieren zu überwinden. Ihre Arbeit, entweder isoliert oder in Zusammenarbeit, hat zu einer Vielzahl innovativer, hochwertiger Sprach-KI-Lösungen geführt. Jedes davon birgt das Potenzial, Indiens Geschichte durch die Demokratisierung des Zugangs zu Informationen für einige der am stärksten unterversorgten Gemeinschaften des Landes voranzutreiben.

Die indische Regierung ist führend bei der Entwicklung von KI-Technologie, die in der Lage ist, den Menschen alle Arten von Informationen und Dienstleistungen bequem in ihrer bevorzugten Sprache bereitzustellen.

Erst letztes Jahr hat das Ministerium für Elektronik und Informationstechnologie (MeitY) das Bhashini-Projekt ins Leben gerufen. Das Programm beinhaltet eine ehrgeizige Datenerfassungsmaßnahme, bei der Daten in jeder der 22 Amtssprachen Indiens erfasst werden, um umfangreiche Datensätze zu erstellen, anhand derer KI-Modelle trainiert werden können. Darüber hinaus wurde auch die Unified Language Contribution API (ULCA) entwickelt, um die Formate für Sprachdatensätze, Modelle und Benchmarks zu standardisieren.

Das erst letztes Jahr gestartete Bhashini-Projekt hat bereits zur Erstellung von über 380 Open-Source-KI-Modellen in den Bereichen Spracherkennung, maschinelle Übersetzung, Text-zu-Sprache und optische Zeichenerkennung in den 22 Amtssprachen Indiens geführt.

Die National Payments Corporation of India – die Organisation hinter Projekten wie dem Unified Payments Interface (UPI) und IMPS – arbeitet mit Bhashini zusammen, um indische Sprachen in ihre Produkte zu integrieren.

Das Bhashini-Projekt wurde vom Nilekani Centre At AI4Bharat unterstützt. Untergebracht am IIT Madras hat er wichtige Open-Source-Beiträge zu Datensätzen, Modellen und Anwendungen geleistet. Zu den wichtigsten von AI4Bharat offengelegten Datensätzen gehören IndicCorp (Monolingual Data), Samanantar (Parallel Corpora), Dhwani (Audio), IndicSUPERB (Speech Benchmark) und Aksharantar (Transliteration). AI4Bharat leistet außerdem den größten Beitrag zu Modellen für das Bhashini-Projekt, darunter unter anderem IndicTrans (Übersetzung), IndicConformer (ASR), IndicXlit (Transliteration) und IndicTTS (TTS).

Der Weg zur Entwicklung von Anwendungen, die die Modelle in Referenzanwendungen nutzen, hat ebenfalls begonnen. Anuvaad ist ein KI-basiertes Open-Source-Dokumentübersetzungstool, das die Übersetzung von Dokumenten in indische Sprachen in großem Maßstab ermöglicht. Heute werden separate Instanzen von Anuvaad am Obersten Gerichtshof von Indien, am Obersten Gerichtshof von Bangladesch und im NCERT DIKSHA-Projekt eingesetzt. Chitralekha ist ein Videotranskriptionstool zum Konvertieren von Videos von einer Sprache in eine andere. Es unterstützt Eingaben von YouTube und kann englische Untertitel in indische Sprachen übersetzen.

Sunbird, ein von EkStep erstellter Open-Source-Bausteinsatz, der die Erstellung maßgeschneiderter E-Learning-Lösungen ermöglicht, nutzt ebenfalls KI. Eine der ehrgeizigsten dieser Bemühungen war Sunbird Saral, das KI nutzt, um die Einreichung von körperlichen Untersuchungen zu digitalisieren. Dies ermöglicht die Sammlung umfangreicher und wertvoller Lernanalysen, die für den indischen Bildungssektor von entscheidender Bedeutung sein könnten. Saral wird bereits in vielen indischen Bundesstaaten eingesetzt und hat dabei geholfen, über 300 Millionen Schülerbewertungsbögen von Lehrern mit einem einzigen Klick auf ihrem Telefon zu erfassen, wodurch der Digitalisierungsaufwand drastisch reduziert und Unterrichtszeit freigesetzt wird.

Gleichzeitig beginnen andere Organisationen, Sprach-KI zu nutzen, um die Lese- und Schreibfähigkeit von Kindern in großem Umfang zu verbessern, einschließlich der Stimme als Medium zur groß angelegten Beurteilung der Sprachfähigkeiten.

Um diese Modelle nutzen und schnell verbessern zu können, ist es wichtig, eine skalierbare Bereitstellungsarchitektur zu schaffen, in der Modelle über einen einfachen API-Aufruf für Anwendungen von Drittanbietern verfügbar sind. Dhruva ist ein Open-Source-Framework, das eine optimierte Bereitstellung von Sprach-KI-Modellen im großen Maßstab ermöglicht.

Nehmen Sie zum Beispiel den Jugalbandi-Voice-Bot. Als kostenlose Open-Source-Plattform kombiniert sie die Leistungsfähigkeit der KI mit den indischen Sprachübersetzungsmodellen, die von der Bhashini-Mission in Verbindung mit großen Sprachmodellen wie GPT3 hervorgebracht wurden, um Konversationslösungen zu ermöglichen.

Dies könnte eingesetzt werden, um Indern dabei zu helfen, sich in ihrer Muttersprache mit jeder Informationsquelle zu unterhalten – seien es Regierungspläne, Rechtsverordnungen und -mitteilungen, Gesetze usw. Dies hat das Potenzial, Dutzenden Millionen Indern, die bisher auf lokale Vermittler angewiesen waren, die Möglichkeit zu geben, auf solche Informationen zuzugreifen und sie zu verstehen. Ähnliche Systeme werden auch in anderen Bereichen entwickelt, beispielsweise ein Bot, um Indiens Landwirten zu helfen.

JIVA, oder Judges Intelligent Virtual Assistant, ist ein innovatives System, das die Verfassung und andere Rechtsdokumente durchforstet, um Antworten auf rechtliche Fragen zu geben. Da es sowohl indische Sprachen als auch Englisch beherrscht, rationalisiert es den Prozess der juristischen Recherche und führt ein neues Maß an Effizienz in das überlastete Justizsystem Indiens ein.

Sprache hat die Fähigkeit, eine Brücke zu sozialer Stärkung und Inklusion zu sein, die ein so großes und vielfältiges Land wie Indien braucht. Die Entwicklung dieser Instrumente wird Auswirkungen zweiten und dritten Grades auf verschiedene Kategorien haben, wie Bildung, Gesundheitswesen, Recht und Justiz, Landwirtschaft und viele andere, die noch nicht einmal vorstellbar sind.

Sind Sie auf selbst entwickelte Sprach-KI-Bemühungen gestoßen, die Ihrer Meinung nach einen besonderen Moment im Rampenlicht verdienen? Hier können Sie Teil der Bewegung werden und eine Organisation empfehlen, die wir kuratieren können, um gemeinsam diese Community aufzubauen.

Beigetragen von Vivek Raghavan , Chef-KI-Evangelist bei der EkStep Foundation