Google hat eine öffentliche Betaphase für seine im Dezember vorgestellte Cloud Vision API gestartet. Ab sofort kann jedermann die Programmierschnittstelle zur Bilderkennung einsetzen. Zuvor stand sie nur im Rahmen einer eingeschränkten Vorschau zur Verfügung.
Mittels der Cloud Vision API werden Bilder in tausende Kategorien klassifiziert, um etwa Emotionen in Gesichtern abzulesen oder geschriebenen Text in verschiedenen Sprachen zu erkennen. Daraus ergeben sich Google zufolge beispielsweise neue Marketing-Möglichkeiten. Die Cloud Vision API soll sich auch einsetzen lassen, um Metadaten für einen Bilderkatalog zu realisieren oder Verstöße gegen Nutzungsrichtlinien zu ermitteln.
In der jetzt verfügbar gemachten Betaversion wurde laut Produktmanager Ram Ramanathan die Farberkennung nochmals verbessert. Zudem muss eine Anfrage über die API nicht mehr das Bild enthalten, sondern dieses kann jetzt auch in der Google-Cloud gespeichert sein.
Inzwischen stehen auch die Preise für die Nutzung der Cloud Vision API fest, die ab 1. März in Kraft treten. Beispielsweise verlangt Google für die Produktlogoerkennung mindestens 2 Dollar je 1000 Bilder pro Monat, während die Texterkennung bei gleicher Bildermenge mindestens 0,60 Dollar kostet. Bis zu 1000 Anfragen pro Monat sind gratis. Werden für ein Bild mehrere Anfragen gemacht, also etwa Logo- und Gesichtserkennung, addieren sich die Preise der jeweiligen Erkennungstypen.
Programmierer können einen oder mehrere Typen Anmerkungen zu ihren Bildern anfordern. Google unterscheidet sechs dieser Typen. Label Detection ermittelt das zentrale Objekt auf einem Bild – etwa eine Katze oder ein Auto. Optical Character Recognition sucht nach Texten auf dem Bild und versucht, diese zu verstehen. Der dritte Typ ist Facial Detection, also Gesichtserkennung, bei der aber nur geprüft wird, ob ein Gesicht im Bild auftaucht und ob sich daraus einer von acht Gemütszuständen wie Freude oder Sorge ablesen lässt.
Das Webinar “Wie KMUs durch den Einsatz von Virtualisierung Kosten sparen und die Effizienz steigern” informiert Sie über die Vorteile von Virtualisierung und skizziert die technischen Grundlagen, die für eine erfolgreiche Implementierung nötig sind. Jetzt registrieren und Aufzeichnung ansehen.
Landmark Detection identifiziert bekannte Natur- sowie Baudenkmäler und liefert den genauen Standort mit geografischer Länge und Breite. Die Logoerkennung stellt fest, ob ein Bild ein Firmenlogo enthält und zu welcher Marke dieses gehört. Und Safe Search Detection dient der Ermittlung anstößiger Inhalte.
Im Rahmen der Betaphase steht Nutzern ein Kontingent von bis zu 20 Millionen Bildern pro Monat zur Verfügung. Aufgrund dieser Einschränkung sollte Cloud Vision laut Google nicht für geschäftskritische Echtzeit-Anwendungen eingesetzt werden.
Eine Dokumentation mit Beispielen und Tutorials für den Einsatz der API unter Python und Java findet sich auf der Cloud-Platform-Website. Dort stellt Google auch Beispielcode für Android- und iOS-Anwendungen bereit.
[mit Material von Natalie Gagliordi, ZDNet.com]
Tipp: Sind Sie ein Fachmann in Sachen Cloud Computing? Testen Sie Ihr Wissen – mit dem Quiz auf silicon.de.
Ohne Rechteausweitung ist eine Remotecodeausführung möglich. Betroffen sind alle unterstützten Android-Versionen inklusive Android 15.
Sie erlauben unter Umständen das Einschleusen und Ausführen von Schadcode aus der Ferne. Neu ist…
Das Ergebnis bleibt hinter den Erwartungen von Analysten zurück. Offenbar belasten fallende Preise für Speicherchips…
Der Umsatz steigt im laufenden Jahr auf 115 Milliarden Dollar. Der größte Teil davon entfällt…
Die Hintermänner sollen eine Verbindung nach China haben. Als Einfallstor dienen Schwachstellen in einer Remote-Support-Software…
Sophos-Studie: Mehrheit glaubt, dass OT-Systeme auch in Zukunft beliebte Ziele für Cyberangriffe sein werden, insbesondere…