Pegasus 1.6 by TwelveLabs
Videosprachmodell von TwelveLabs, das Videos per API auswertet und dazu Zusammenfassungen, Kapitel und Antworten auf deine Fragen liefert.
Was es kann
Pegasus 1.6 ist ein Videosprachmodell von TwelveLabs: Du übergibst ein Video oder Bild und bekommst Text zurück, etwa Zusammenfassungen, Kapitel, Bildunterschriften oder Antworten auf konkrete Fragen zum Inhalt. Das Modell wertet Bild, gesprochene Sprache, Ton und eingeblendeten Text gemeinsam aus und zerlegt Videos auf Wunsch in einzelne Handlungen oder Ereignisse mit Zeitangaben. Laut Anbieter verarbeitet es Videos bis zu zwei Stunden Länge. Zugriff gibt es über API und SDKs, einen Playground im Browser, einen MCP-Server und AWS Bedrock.
Für wen es passt
Für Medienhäuser, Agenturen, Sportanbieter und Teams mit großen Videoarchiven, die Inhalte automatisch beschreiben, durchsuchbar machen oder auf Vorgaben prüfen wollen. Für die Einbindung in eigene Abläufe brauchst du Entwicklungskenntnisse.
Datenschutz im Unternehmen
TwelveLabs hostet seine Dienste in den USA, Daten können auch in Südkorea verarbeitet werden. Eine Datenhaltung in Europa nennt der Anbieter nicht. Nach den allgemeinen Nutzungsbedingungen werden deine Daten standardmäßig zum Training genutzt; das schaltest du in den Kontoeinstellungen ab. Einen Auftragsverarbeitungsvertrag mit EU-Standardvertragsklauseln gibt es als Anlage zu den Enterprise-Bedingungen. Der Enterprise-Tarif bietet außerdem private oder selbst betriebene Installationen. TwelveLabs gibt an, nach SOC 2 Type II zertifiziert zu sein.
Grenzen
Abgerechnet wird nach Videostunden und Tokens, die Kosten lassen sich deshalb schwer vorab schätzen. Im kostenlosen Plan verfallen Indizes nach 90 Tagen. Der Playground dient vor allem zum Ausprobieren, für den Alltag brauchst du eine eigene Integration. Ergebnisse können Fehler enthalten und solltest du prüfen.