Mit ML Kit können Sie die Sprache eines Textstrings ermitteln. Sie können die wahrscheinlichste Sprache des Strings sowie Konfidenzwerte für alle möglichen Sprachen des Strings abrufen.
ML Kit erkennt Text in mehr als 100 verschiedenen Sprachen in ihren nativen Schriftsystemen. Außerdem kann romanisierter Text für Arabisch, Bulgarisch, Chinesisch, Griechisch, Hindi, Japanisch und Russisch erkannt werden. Eine vollständige Liste der unterstützten Sprachen und Schriftsysteme finden Sie hier.
| Gebündelt | Nicht gebündelt | |
|---|---|---|
| Name der Bibliothek | com.google.mlkit:language-id | com.google.android.gms:play-services-mlkit-language-id |
| Implementierung | Das Modell wird zur Build-Zeit statisch mit Ihrer App verknüpft. | Das Modell wird dynamisch über die Google Play-Dienste heruntergeladen. |
| Auswirkungen auf die App-Größe | Die Größe nimmt um etwa 900 KB zu. | Die Größe nimmt um etwa 200 KB zu. |
| Initialisierungszeit | Das Modell ist sofort verfügbar. | Möglicherweise müssen Sie warten, bis das Modell heruntergeladen wurde, bevor Sie es zum ersten Mal verwenden können. |
Jetzt ausprobieren
- Probieren Sie die Beispiel-App aus, um ein Anwendungsbeispiel für diese API zu sehen.
Hinweis
In die Datei
build.gradleauf Projektebene muss das Maven-Repository von Google in die Abschnittebuildscriptundallprojectsaufgenommen werden.Fügen Sie die Abhängigkeiten für die ML Kit Android-Bibliotheken der Gradle-Datei auf App-Ebene Ihres Moduls hinzu, in der Regel
app/build.gradle. Wählen Sie je nach Bedarf eine der folgenden Abhängigkeiten aus:So binden Sie das Modell in Ihre App ein:
dependencies { // ... // Use this dependency to bundle the model with your app implementation 'com.google.mlkit:language-id:17.0.6' }So verwenden Sie das Modell in den Google Play-Diensten:
dependencies { // ... // Use this dependency to use the dynamically downloaded model in Google Play Services implementation 'com.google.android.gms:play-services-mlkit-language-id:17.0.0' }Wenn Sie das Modell in den Google Play-Diensten verwenden möchten, können Sie Ihre App so konfigurieren , dass das Modell automatisch auf das Gerät heruntergeladen wird, nachdem Ihre App im Play Store installiert wurde. Fügen Sie dazu der Datei
AndroidManifest.xmlIhrer App die folgende Deklaration hinzu:<application ...> ... <meta-data android:name="com.google.mlkit.vision.DEPENDENCIES" android:value="langid" > <!-- To use multiple models: android:value="langid,model2,model3" --> </application>Sie können die Verfügbarkeit des Modells auch explizit prüfen und den Download über die Google Play-Dienste ModuleInstallClient API anfordern.
Wenn Sie Downloads von Modellen zur Installationszeit nicht aktivieren oder keinen expliziten Download anfordern, wird das Modell beim ersten Ausführen der Kennung heruntergeladen. Anfragen, die Sie vor Abschluss des Downloads stellen, liefern keine Ergebnisse.
Sprache eines Strings ermitteln
Um die Sprache eines Strings zu ermitteln, rufen Sie LanguageIdentification.getClient() auf, um
eine Instanz von LanguageIdentifier abzurufen, und übergeben Sie den String dann an die
identifyLanguage() Methode von LanguageIdentifier.
Beispiel:
Kotlin
val languageIdentifier = LanguageIdentification.getClient() languageIdentifier.identifyLanguage(text) .addOnSuccessListener { languageCode -> if (languageCode == "und") { Log.i(TAG, "Can't identify language.") } else { Log.i(TAG, "Language: $languageCode") } } .addOnFailureListener { // Model couldn’t be loaded or other internal error. // ... }
Java
LanguageIdentifier languageIdentifier = LanguageIdentification.getClient(); languageIdentifier.identifyLanguage(text) .addOnSuccessListener( new OnSuccessListener<String>() { @Override public void onSuccess(@Nullable String languageCode) { if (languageCode.equals("und")) { Log.i(TAG, "Can't identify language."); } else { Log.i(TAG, "Language: " + languageCode); } } }) .addOnFailureListener( new OnFailureListener() { @Override public void onFailure(@NonNull Exception e) { // Model couldn’t be loaded or other internal error. // ... } });
Wenn der Aufruf erfolgreich ist, wird ein
BCP-47-Sprachcode an den Listener für den Erfolg übergeben, der die Sprache des Texts angibt. Wenn keine
Sprache mit Sicherheit erkannt wird, wird der Code
und (unbestimmt) übergeben.
Standardmäßig gibt ML Kit nur dann einen anderen Wert als und zurück, wenn
die Sprache mit einem Konfidenzwert von mindestens 0,5 erkannt wird. Sie können diesen
Schwellenwert ändern, indem Sie ein LanguageIdentificationOptions-Objekt an getClient() übergeben:
Kotlin
val languageIdentifier = LanguageIdentification .getClient(LanguageIdentificationOptions.Builder() .setConfidenceThreshold(0.34f) .build())
Java
LanguageIdentifier languageIdentifier = LanguageIdentification.getClient( new LanguageIdentificationOptions.Builder() .setConfidenceThreshold(0.34f) .build());
Mögliche Sprachen eines Strings abrufen
Um die Konfidenzwerte der wahrscheinlichsten Sprachen eines Strings abzurufen, rufen Sie eine
Instanz von LanguageIdentifier ab und übergeben Sie den String dann an die
identifyPossibleLanguages() Methode.
Beispiel:
Kotlin
val languageIdentifier = LanguageIdentification.getClient() languageIdentifier.identifyPossibleLanguages(text) .addOnSuccessListener { identifiedLanguages -> for (identifiedLanguage in identifiedLanguages) { val language = identifiedLanguage.languageTag val confidence = identifiedLanguage.confidence Log.i(TAG, "$language $confidence") } } .addOnFailureListener { // Model couldn’t be loaded or other internal error. // ... }
Java
LanguageIdentifier languageIdentifier = LanguageIdentification.getClient(); languageIdentifier.identifyPossibleLanguages(text) .addOnSuccessListener(new OnSuccessListener<List<IdentifiedLanguage>>() { @Override public void onSuccess(List<IdentifiedLanguage> identifiedLanguages) { for (IdentifiedLanguage identifiedLanguage : identifiedLanguages) { String language = identifiedLanguage.getLanguageTag(); float confidence = identifiedLanguage.getConfidence(); Log.i(TAG, language + " (" + confidence + ")"); } } }) .addOnFailureListener( new OnFailureListener() { @Override public void onFailure(@NonNull Exception e) { // Model couldn’t be loaded or other internal error. // ... } });
Wenn der Aufruf erfolgreich ist, wird eine Liste von IdentifiedLanguage Objekten an den
Listener für den Erfolg übergeben. Aus jedem Objekt können Sie den BCP-47-Code der Sprache und
die Konfidenz dafür abrufen, dass der String in dieser Sprache ist. Diese Werte geben die Konfidenz dafür an, dass der gesamte String in der angegebenen
Sprache ist. ML Kit erkennt nicht mehrere Sprachen in einem einzelnen String.
Standardmäßig gibt ML Kit nur Sprachen mit Konfidenzwerten von mindestens
0, 01 zurück. Sie können diesen Schwellenwert ändern, indem Sie ein
LanguageIdentificationOptions Objekt an
getClient():
Kotlin
val languageIdentifier = LanguageIdentification .getClient(LanguageIdentificationOptions.Builder() .setConfidenceThreshold(0.5f) .build())
Java
LanguageIdentifier languageIdentifier = LanguageIdentification.getClient( new LanguageIdentificationOptions.Builder() .setConfidenceThreshold(0.5f) .build());
Wenn keine Sprache diesen Schwellenwert erfüllt, enthält die Liste ein Element mit dem Wert
und.