Arabischer, thailändischer, vietnamesischer, Hindi-, englischer und chinesischer Sprachdatensatz
Verschiedene Texterkennungsdatensätze für fortgeschrittene OCR-Anwendungen: Schilder, Menüs und mehr
Anwendungsfall: OCR
Format: Bild
Graf: 150K
Anmerkung: Ja
Beschreibung: Arabischer, thailändischer, vietnamesischer, Hindi-, englischer und chinesischer Sprachdatensatz
Anwendungsfall: OCR
Format: Bild
Graf: 1k
Anmerkung: Ja
Beschreibung: Der arabische Textdatensatz enthält eine Sammlung von Textbeispielen in Arabisch. Er umfasst verschiedene Inhaltsformen wie Nachrichtenartikel, Social-Media-Beiträge, Literatur und Dialoge zu verschiedenen Themen und Schreibstilen. Dieser Datensatz wird für Aufgaben wie die Verarbeitung natürlicher Sprache (NLP), Textklassifizierung, Stimmungsanalyse und maschinelle Übersetzung in arabischsprachigen Anwendungen verwendet.
Anwendungsfall: OCR
Format: Bild
Graf: 38K
Anmerkung: Ja
Beschreibung: Chinesischer, englischer, tibetischer und uigurischer Sprachdatensatz
Anwendungsfall: OCR
Format: Bild
Graf: 60K
Anmerkung: Ja
Beschreibung: Der chinesische und englische Menüdatensatz enthält Bilder oder Textbeispiele von Restaurantmenüs in chinesischer und englischer Sprache. Er enthält verschiedene Schriftarten, Layouts und Menüstrukturen und präsentiert zweisprachige Namen, Beschreibungen und Preise von Gerichten. Dieser Datensatz ist nützlich für Aufgaben wie optische Zeichenerkennung (OCR), maschinelle Übersetzung und Menüdigitalisierung in mehrsprachigen Umgebungen.
Anwendungsfall: OCR
Format: Bild
Graf: 3k
Anmerkung: Ja
Beschreibung: Der Datensatz „Chinese Handwritten Composition“ enthält Beispiele handgeschriebener chinesischer Texte, darunter Aufsätze, Essays und andere Langformtexte. Er bietet verschiedene Handschriftstile und Komplexitätsstufen und wird für Aufgaben wie Handschrifterkennung, Textanalyse und das Training von Modellen für maschinelles Lernen verwendet.
Anwendungsfall: OCR
Format: Bild
Graf: 1k
Anmerkung: Ja
Beschreibung: Der chinesische WIFI-Prompt-Datensatz besteht aus Textbeispielen, die in chinesischen WIFI-Prompts und Anmeldebildschirmen zu finden sind. Er enthält normalerweise verschiedene Eingabeaufforderungen, Anweisungen und Fehlermeldungen im Zusammenhang mit der Verbindung zu oder der Verwaltung von WIFI-Netzwerken. Dieser Datensatz wird für Aufgaben wie Texterkennung, Verarbeitung natürlicher Sprache und die Verbesserung von Benutzeroberflächen für die Netzwerkkonnektivität verwendet.
Anwendungsfall: OCR
Format: Bild
Graf: 12K
Anmerkung: Ja
Beschreibung: Der englische und chinesische Handschriftdatensatz enthält handschriftliche Beispiele in Englisch und Chinesisch und zeigt verschiedene Schreibstile und Zeichenkomplexitäten. Er wird normalerweise zum Trainieren und Auswerten von Handschrifterkennungsmodellen verwendet und unterstützt die mehrsprachige Textanalyse und andere damit verbundene Forschung. Der Datensatz enthält eine vielfältige Auswahl an Zeichen, Ziffern, Wörtern und Sätzen in beiden Sprachen.
Anwendungsfall: OCR
Format: Bild
Graf: 30K
Anmerkung: Ja
Beschreibung: Der englische und chinesische Shopsign-Datensatz enthält Bilder von Ladenschildern mit englischem und chinesischem Text. Er erfasst verschiedene Schilderelemente wie Ladennamen, Werbung, Sonderangebote und Wegbeschreibungen, die in verschiedenen Schriftarten, Stilen und Formaten angezeigt werden. Dieser Datensatz wird für Aufgaben wie Texterkennung und -erkennung, mehrsprachiges Szenenverständnis und die Verbesserung von Computervisionsmodellen zur Interpretation zweisprachiger Schilder verwendet.
Anwendungsfall: OCR
Format: Bild
Graf: 50K
Anmerkung: Ja
Beschreibung: Der englische und chinesische Spezialwinkeltext-Datensatz enthält Bilder von Texten, die in verschiedenen Winkeln und Ausrichtungen auf Englisch und Chinesisch angezeigt werden. Er enthält Text aus Quellen wie Schildern, Anzeigen und Dokumenten, die nicht in standardmäßigen horizontalen Formaten vorliegen. Dieser Datensatz wird zum Trainieren und Bewerten von Texterkennungs- und -erkennungsmodellen verwendet, insbesondere von Modellen, die Text in nicht traditionellen Ausrichtungen und Perspektiven verarbeiten können.
Anwendungsfall: OCR
Format: Bild
Graf: 20K
Anmerkung: Ja
Beschreibung: Der englische Menüdatensatz enthält Bilder oder Textbeispiele von Restaurantmenüs in englischer Sprache. Er bietet eine Vielzahl von Schriftarten, Layouts und Formatierungsstilen mit Inhalten von Gerichtnamen bis hin zu Beschreibungen und Preisen. Dieser Datensatz wird häufig für Aufgaben wie optische Zeichenerkennung (OCR), Textextraktion und Menüdigitalisierung in lebensmittelbezogenen Anwendungen verwendet.
Anwendungsfall: OCR
Format: Bild
Graf: 33K
Anmerkung: Ja
Beschreibung: Der Textdatensatz „English Scenes“ besteht aus Bildern mit natürlichen Szenen und eingebettetem englischen Text. Der Text erscheint in verschiedenen Formen, z. B. auf Schildern, Plakaten und Postern, oft in unterschiedlichen Schriftarten, Größen und Ausrichtungen. Dieser Datensatz wird häufig zum Trainieren und Testen von Modellen bei Aufgaben zur Texterkennung, Texterkennung und zum Szenenverständnis verwendet.
Anwendungsfall: Dokumentieren Sie AI
Format: HEIC (Bilder) & .mov (Videos)
Graf: 94053
Anmerkung: Nein
Beschreibung: Live-Fotos mit handgeschriebenem Text für Japanisch, Koreanisch und Russisch
Aufnahmegerät: iPhone- und iPad-Kamera
Aufnahmebedingung: - Aggressive Beleuchtung/Blendung - Kamerablitz an - Farbiges Licht - Wenig Licht, kein Kamerablitz - Normal
Anwendungsfall: OCR
Format: Bild
Graf: 40K
Anmerkung: Ja
Beschreibung: Der japanische und koreanische Sprachdatensatz enthält Textbeispiele sowohl auf Japanisch als auch auf Koreanisch. Er enthält eine Reihe von Inhalten wie Sätze, Phrasen und Wörter, die verschiedene Kontexte und Stile umfassen. Dieser Datensatz wird für Aufgaben wie die Verarbeitung natürlicher Sprache (NLP), maschinelle Übersetzung und Textanalyse in mehrsprachigen Anwendungen verwendet.
Anwendungsfall: Dokumentieren Sie AI
Format: HEIC (Bilder) & .mov (Videos)
Graf: 23930
Anmerkung: Nein
Beschreibung: Live-Fotos mit handgeschriebenem Text für Japanisch, Koreanisch und Russisch
Aufnahmegerät: iPhone- und iPad-Kamera
Aufnahmebedingung: - Aggressive Beleuchtung/Blendung - Kamerablitz an - Farbiges Licht - Wenig Licht, kein Kamerablitz - Normal
Anwendungsfall: Text + Audiovisuell (mehrsprachig / OCR / NLP)
Format: Videos
Graf: Über 100 Vorlesungsvideos + PPT-Videos im Langformat
Anmerkung: Nein
Beschreibung: Chinesische Bücher, englische Bücher, Zeitschriften, öffentliche Ordnung, Romane, Kinder, kantonesisches Audio+Text, Vorlesungsvideo+PPT, Langformatvideo. Eine halbe Milliarde Bücher, Frage-Antwort-Paare, Artikel
Wir verwenden Cookies, um Ihre Erfahrung auf unserer Website zu verbessern. Durch die Nutzung unserer Website stimmen Sie der Verwendung von Cookies zu.
Verwalten Sie unten Ihre Cookie-Einstellungen:
Wesentliche Cookies ermöglichen grundlegende Funktionen und sind für die ordnungsgemäße Funktion der Website erforderlich.
Google Tag Manager vereinfacht die Verwaltung von Marketing-Tags auf Ihrer Website ohne Codeänderungen.
Statistik Cookies erfassen Informationen anonym. Diese Informationen helfen uns zu verstehen, wie unsere Besucher unsere Website nutzen.
Google Analytics ist ein leistungsstarkes Tool, das den Website-Verkehr verfolgt und analysiert, um fundierte Marketingentscheidungen zu ermöglichen.
Service-URL: Policies.google.com (Öffnet in neuem Fenster)
Marketing-Cookies werden verwendet, um Besucher von Websites zu verfolgen. Ziel ist es, Anzeigen zu schalten, die für den einzelnen Benutzer relevant und ansprechend sind.
Google Ads ist eine Online-Werbeplattform, die es Unternehmen ermöglicht, zielgerichtete Anzeigen zu erstellen, die in den Google-Suchergebnissen und auf Partnerseiten angezeigt werden.
Service-URL: Policies.google.com (Öffnet in neuem Fenster)
Weitere Informationen finden Sie in unserem Cookies und Datenschutzbestimmungen.