Ab dem 14. September 2026 ist die Video Intelligence API offiziell veraltet und wird nicht mehr unterstützt. Sie können die Video Intelligence API noch bis zum 14. September 2027 verwenden. Danach wird sie eingestellt. Wir empfehlen die Migration zur Gemini-Modellfamilie.
Google verwendet KI-Technologie, um Inhalte in Ihre bevorzugte Sprache zu übersetzen. KI-Übersetzungen können Fehler enthalten.
Texterkennung
Mit Sammlungen den Überblick behalten
Sie können Inhalte basierend auf Ihren Einstellungen speichern und kategorisieren.
Bei der Texterkennung wird die visuelle Zeichenerkennung (OCR) verwendet, um sichtbaren Text aus Frames in einem Video oder Videosegmenten zu erkennen. Der erkannte Text wird zusammen mit Informationen zur Position und zum Zeitstempel auf Frameebene im Video für diesen Text zurückgegeben.
Die Texterkennung ist besonders nützlich für Medien- und Unterhaltungszwecke, z. B. um Besetzungslisten am Ende von Fernsehsendungen und Filmen zu erkennen und zu extrahieren oder um eingebrannte Untertitel zu erkennen.
Die Texterkennung ist für die Sprachen verfügbar, die von der Cloud Vision API unterstützt werden.
Rufen Sie die Methode annotate auf und geben Sie TEXT_DETECTION in das Feld features an, um sichtbaren Text aus einem Video oder Videosegment zu erkennen.
[[["Leicht verständlich","easyToUnderstand","thumb-up"],["Mein Problem wurde gelöst","solvedMyProblem","thumb-up"],["Sonstiges","otherUp","thumb-up"]],[["Schwer verständlich","hardToUnderstand","thumb-down"],["Informationen oder Beispielcode falsch","incorrectInformationOrSampleCode","thumb-down"],["Benötigte Informationen/Beispiele nicht gefunden","missingTheInformationSamplesINeed","thumb-down"],["Problem mit der Übersetzung","translationIssue","thumb-down"],["Sonstiges","otherDown","thumb-down"]],["Zuletzt aktualisiert: 2026-09-18 (UTC)."],[],[]]