Skip to content

Pegasus 1.5 by TwelveLabs Bewertung

Twelve Labs bietet eine Video-Intelligence-Plattform, die es Maschinen ermöglicht, Videoinhalte wie Menschen zu verstehen, zu durchsuchen und zu analysieren.

shipped 21. Apr. 2026videofreemium
Domain rating69Monthly visits3.9K/mo
videocoderesearch
Pegasus 1.5 by TwelveLabs - AI tool for pegasus twelvelabs. Professional illustration showing core functionality and features.

Warum es wichtig ist

1Pegasus 1.5 by TwelveLabs übertrifft Gemini 3.1 Pro um 13,1 % in der aggregierten Segmentierungsqualität.
2Die Plattform indiziert Videos mit etwa 60-facher Echtzeitgeschwindigkeit und verarbeitet 1 Stunde Video in 1 Minute.
3Pegasus 1.5 ermöglicht die Time-Based Metadata Extraction (TBM) über ganze Videos von bis zu zwei Stunden Länge in einem einzigen API-Aufruf.
4TwelveLabs hat den SOC2-Status erreicht, was die Einhaltung von Sicherheits- und compliance-Standards belegt.

Stork’s verdict on Pegasus 1.5 by TwelveLabs

Pegasus 1.5 bietet präzise Time Based Metadata Extraction mit benutzerdefinierten JSON-Schemas, aber seine API-gesteuerte Natur erfordert Entwicklerressourcen.

Pegasus 1.5 by TwelveLabs reviewed by Stork AI · stork.ai/de/pegasus-1-5-by-twelvelabs

Stork Quadrant

Becomes the API· 27/100

Replaceable as a UI, but kept alive as the API the agents call.

TwelveLabs built a capable multimodal video understanding API before the frontier labs caught up. That window is closing. GPT-4o, Gemini 1.5 Pro, and Claude already handle video natively, and they're getting faster and cheaper. There's no proprietary data, no network, no regulatory gate — just a specialized model that bigger players will commoditize.

Claude Sonnet 4.6, scored 2026-05-30

Defensibility · 0/100

  • Physical-world coupling
  • Regulatory moat
  • Network liquidity
  • Proprietary refreshing data
  • High-trust catastrophic workflows
  • Multi-party coordination
  • Brand / community / taste

An LLM alone could replace

  • Summarize what happens in a video by describing its content
  • Transcribe audio and extract key topics or themes from spoken content
  • Answer questions about a video's subject matter given a transcript or description
  • Generate metadata tags or chapter markers for video content

Agent-Readiness · 60/100

  • Verified MCPStork MCP listing: io-twelvelabs-twelvelabs-mcp-server (untested)
  • Listed on agent surfacesStork:io-twelvelabs-twelvelabs-mcp-server
  • Usage-based pricingpricing page heuristic match: https://www.twelvelabs.io/pricing
  • Headless agent auth
  • Public OpenAPIhttps://docs.twelvelabs.io/v1.3/docs/resources/platform-overview
  • Active changeloghttps://www.twelvelabs.io/blog/introducing-pegasus-1-5 (2026-04-19)
  • llms.txthttps://www.twelvelabs.io/llms.txt

Score history · +5 pts over 3 re-scores

How to defend

Go vertical and own the liability: pick one industry where wrong video analysis has real consequences — insurance claims, legal evidence, broadcast compliance — and become the vendor that signs the contract and bears the risk. That's the only move that creates a moat here.

  • Ship an MCP server and list it on Stork — biggest single point gain (+25).
  • Expose API-key auth with a self-serve sandbox tier; remove sales-call gates (+15).

Über Pegasus 1.5 by TwelveLabs

Hauptsitz
San Francisco, USA
Gegründet
2020
Teamgröße
51-100
Finanzierung
Series A

Spezifikationen

API-Dokumentation

API verfügbar

Ja, öffentliche API

overview

Was ist Pegasus 1.5 by TwelveLabs?

Pegasus 1.5 by TwelveLabs ist ein Video-first language model, das von Twelve Labs entwickelt wurde und es Entwicklern und Unternehmen ermöglicht, strukturierte, zeitbasierte Metadaten aus Videoinhalten zu generieren. Es integriert visuelle, Audio- und Sprachinformationen, um eine umfassende Videoanalyse zu bieten. Dieses Modell stellt eine bedeutende Weiterentwicklung gegenüber seinem Vorgänger, Pegasus 1.2, dar, indem es den Fokus von clip-basierten Fragen und Antworten auf eine umfassende Videoanalyse und die Generierung strukturierter, zeitbasierter Metadaten verlagert. Pegasus 1.5 wurde am 20. April 2026 auf der NAB Show in Las Vegas offiziell angekündigt und allgemein verfügbar gemacht. Seine Kernfunktion ist die Time-Based Metadata Extraction (TBM), die es Benutzern ermöglicht, ein benutzerdefiniertes JSON schema zu definieren und zeitgestempelte, strukturierte Metadaten über ganze Videos von bis zu zwei Stunden Länge in einem einzigen API-Aufruf zu erhalten. Diese Funktionalität automatisiert Video-Tagging-Workflows, die zuvor Tausende von Stunden manueller Überprüfung erforderten.

features

Hauptmerkmale von Pegasus 1.5 by TwelveLabs

Pegasus 1.5 by TwelveLabs bietet eine Reihe von Funktionen, die für fortgeschrittenes Videoverständnis und die Generierung strukturierter Daten entwickelt wurden. Es nutzt multimodal intelligence, um Video-, Audio- und Sprachdaten zu verarbeiten und detaillierte Einblicke sowie Automatisierungsfunktionen für verschiedene Unternehmensanwendungen zu liefern. Die technischen Spezifikationen der Plattform umfassen eine tägliche Videoindizierungskapazität von über 10.000 Stunden und eine multimodal data ingestion speed von etwa 60-facher Echtzeit.

  • Enterprise video AI, angetrieben durch multimodal intelligence über Vision, Audio und Sprache.
  • Semantic video search und Abruf mittels natural language queries.
  • Automatisierte Videozusammenfassung und Erkenntnisgenerierung aus Langform-Inhalten.
  • Time-Based Metadata Extraction (TBM) mit benutzerdefiniertem JSON schema, das zeitgestempelte, strukturierte Daten liefert.
  • Content moderation, compliance und brand safety analysis.
  • Ingestion von multimodal data durch eine einzige Pipeline für effiziente Verarbeitung.
  • Videoindizierung mit etwa 60-facher Echtzeitgeschwindigkeit, Verarbeitung von 1 Stunde Video in 1 Minute.
  • Segmentation von Videoinhalten in narrative units, scenes und topics.
  • Erstellung von highlights und key moments aus Videomaterial.
  • Überlegene multimodal prompting performance, die Gemini 3.1 Pro um 13,1 % in der aggregierten Segmentierungsqualität übertrifft.

use cases

Wer sollte Pegasus 1.5 by TwelveLabs nutzen?

Pegasus 1.5 by TwelveLabs wurde für Organisationen und Einzelpersonen entwickelt, die im großen Maßstab mit Videos arbeiten und fortschrittliche KI-gesteuerte Verständnis-, Such- und Analysefunktionen benötigen. Seine multimodal intelligence und die Generierung strukturierter Metadaten sind besonders vorteilhaft für developers, enterprises und kreative Fachleute in verschiedenen Branchen.

  • Developers und Enterprises: Für die Entwicklung von Anwendungen, die semantic video search, Content discovery und die Umwandlung von Rohmaterial in abfragbare, produktionsreife Daten erfordern.
  • Medien- und Unterhaltungsunternehmen: Für die Segmentierung von Langform-Inhalten in narrative units, Archivierung, Empfehlungssysteme und automatisierte highlight generation.
  • Sportorganisationen: Zum automatischen Erkennen und Beschriften von Spielzügen mit präzisen zeitlichen Grenzen, was die Erstellung von Echtzeit-highlights und performance analytics ermöglicht.
  • Streaming Platforms: Zum Identifizieren von Markenauftritten, Szenenübergängen und kontextuellen Momenten, um gezielte Werbung und content monetization zu erleichtern.
  • Security operators und Regierungsbehörden: Für content analysis, compliance checks, automatisierte Dokumentation und Berichterstellung aus Videomaterial.

pricing

Pegasus 1.5 by TwelveLabs Preise & Pläne

TwelveLabs bietet ein freemium pricing model für Pegasus 1.5 an, das in drei Hauptpläne unterteilt ist: Free, Developer und Enterprise. Für alle Pläne gelten Rate limits, die je nach Nutzungstyp variieren (dauerbasiert für Video-/Audioverarbeitung, token-basiert für Textausgabe und anfragebasiert für endpoints). Das Überschreiten einer anwendbaren Grenze führt zu einem Fehler. Die Preisgestaltung für die spezifische API-Nutzung ist detailliert, wobei input text tokens für das Pegasus-Modell etwa $0.001 pro 1.000 tokens und output text tokens für die Pegasus Analyze API etwa $0.007 pro 1.000 tokens betragen.

  • Free Plan: Ermöglicht bis zu 10 Stunden Indizierung für die Modelle Marengo und Pegasus kostenlos, mit grundlegenden rate limits.
  • Developer Plan: Bietet drei tiers mit steigenden Limits basierend auf monatlichen Ausgaben, die eine umfangreichere Nutzungskapazität für Dauer, tokens und requests bieten.
  • Enterprise Plan: Bietet custom limits und maßgeschneiderte Lösungen für große Organisationen mit spezifischen Anforderungen und hohem Nutzungsvolumen.
  • Usage-based pricing: Input text tokens für das Pegasus-Modell betragen etwa $0.001 pro 1.000 tokens. Output text tokens für die Pegasus Analyze API betragen etwa $0.007 pro 1.000 tokens.

Pros

  • +Achieves high accuracy in video segmentation and time-based metadata extraction.
  • +Provides reliable, schema-compliant JSON outputs for structured data.
  • +Supports processing of long-form videos up to two hours in a single request.
  • +Offers flexible analysis options including synchronous and efficient batch processing.
  • +Multimodal prompting with image references enhances the precision of video queries.
  • +Demonstrates strong competitive performance against leading general-purpose AI models in video understanding tasks.

Cons

  • Not aligned with HIPAA compliance standards, limiting use in certain healthcare contexts.
  • Detailed pricing for all usage dimensions (e.g., video duration processing) requires deeper inquiry beyond publicly listed token costs.
  • Primarily API-driven, which may necessitate developer resources for full implementation and integration.
  • The platform's focus on enterprise and developer use cases might mean a less intuitive out-of-the-box user interface for non-technical users.

Ähnliche Tools

Pegasus 1.5 by TwelveLabs vs. Wettbewerber

TwelveLabs positioniert Pegasus 1.5 als führendes Video reasoning model, das im Vergleich zu Allzweckmodellen eine überlegene Leistung in der Segmentierungsqualität und der Zuverlässigkeit der strukturierten Ausgabe zeigt. In Bewertungen übertraf Pegasus 1.5 Gemini 3.1 Pro Berichten zufolge um 13,1 % in der aggregierten Segmentierungsqualität, mit einer Grenzgenauigkeit von etwa 350 Millisekunden. Es behielt auch eine konsistente Ausgabegenauigkeit über komplexe, mehrfach definierte schemas bei, wo andere Modelle hohe structured JSON failure rates aufwiesen.

1

Mixpeek is designed for teams building video intelligence applications, offering a comprehensive platform that handles ingestion, extraction, indexing, and retrieval of video data.

While both offer video AI, Mixpeek provides an end-to-end solution for building custom video intelligence applications with deep content analysis. TwelveLabs focuses on quick cloud-based video understanding with natural language queries and generative text outputs from its foundation models like Pegasus.

2
Google Video Intelligence API

This API provides robust video annotation and content categorization, deeply integrated with the Google Cloud ecosystem for large-scale analytics and developer-focused applications.

Google Video Intelligence API is a developer-centric service for annotating and categorizing video content within the Google Cloud environment. TwelveLabs offers a more integrated platform for natural language video search and generative text outputs, built on its own multimodal foundation models.

3
Clarifai Video

Clarifai Video is a visual AI platform that provides dedicated video analysis models and a visual workflow builder, enabling non-ML engineers to train and chain custom concept detection models.

Clarifai Video emphasizes customizable concept detection and a user-friendly workflow builder for tailored AI solutions. TwelveLabs, with Pegasus 1.5, focuses on advanced multimodal video understanding, summarization, and the generation of structured, time-based metadata through natural language queries.

4
Memories.ai

Memories.ai is an AI video intelligence platform focused on large-scale search, summarization, and multimodal understanding, with an emphasis on contextual memory and timeline insights for streamlined workflows.

Memories.ai provides a platform for broad video intelligence tasks including search and summarization, leveraging contextual memory. TwelveLabs' Pegasus 1.5 specifically advances video understanding by generating structured, time-based metadata across entire videos, moving beyond clip-based answers to enable schema-first interaction for precise temporal boundaries.

Mehr auf Stork

Verwandte KI-Tools

Weitere Tools dieser Kategorie, über gemeinsame Tags zugeordnet