Skip to content

Avis sur Pegasus 1.5 by TwelveLabs

Pegasus 1.5 by TwelveLabs est un modèle de raisonnement vidéo basé sur l'IA qui transforme le contenu vidéo brut en données structurées et interrogeables en intégrant des informations visuelles, audio et vocales.

shipped 21 avr. 2026videofreemium
Domain rating69Monthly visits3.9K/mo
videocoderesearch
Pegasus 1.5 by TwelveLabs - AI tool for pegasus twelvelabs. Professional illustration showing core functionality and features.

Pourquoi c'est important

1Traite des vidéos d'une durée maximale de deux heures en une seule passe, en maintenant le contexte et la continuité.
2A atteint une qualité de segmentation agrégée supérieure de 13,1 % à celle de Gemini 3 Pro lors de benchmarks internes.
3Indexe une heure de vidéo en environ une minute, prenant en charge plus de 10 000 heures par jour.
4Offre l'extraction de métadonnées basée sur le temps (TBM) avec une sortie de schéma JSON personnalisé.

Stork’s verdict on Pegasus 1.5 by TwelveLabs

Pegasus 1.5 offre une Time Based Metadata Extraction précise avec des schémas JSON personnalisés, mais sa nature axée sur l'API exige des ressources de développement.

Pegasus 1.5 by TwelveLabs reviewed by Stork AI · stork.ai/fr/pegasus-1-5-by-twelvelabs

Stork Quadrant

Becomes the API· 27/100

Replaceable as a UI, but kept alive as the API the agents call.

TwelveLabs built a capable multimodal video understanding API before the frontier labs caught up. That window is closing. GPT-4o, Gemini 1.5 Pro, and Claude already handle video natively, and they're getting faster and cheaper. There's no proprietary data, no network, no regulatory gate — just a specialized model that bigger players will commoditize.

Claude Sonnet 4.6, scored 2026-05-30

Defensibility · 0/100

  • Physical-world coupling
  • Regulatory moat
  • Network liquidity
  • Proprietary refreshing data
  • High-trust catastrophic workflows
  • Multi-party coordination
  • Brand / community / taste

An LLM alone could replace

  • Summarize what happens in a video by describing its content
  • Transcribe audio and extract key topics or themes from spoken content
  • Answer questions about a video's subject matter given a transcript or description
  • Generate metadata tags or chapter markers for video content

Agent-Readiness · 60/100

  • Verified MCPStork MCP listing: io-twelvelabs-twelvelabs-mcp-server (untested)
  • Listed on agent surfacesStork:io-twelvelabs-twelvelabs-mcp-server
  • Usage-based pricingpricing page heuristic match: https://www.twelvelabs.io/pricing
  • Headless agent auth
  • Public OpenAPIhttps://docs.twelvelabs.io/v1.3/docs/resources/platform-overview
  • Active changeloghttps://www.twelvelabs.io/blog/introducing-pegasus-1-5 (2026-04-19)
  • llms.txthttps://www.twelvelabs.io/llms.txt

Score history · +5 pts over 3 re-scores

How to defend

Go vertical and own the liability: pick one industry where wrong video analysis has real consequences — insurance claims, legal evidence, broadcast compliance — and become the vendor that signs the contract and bears the risk. That's the only move that creates a moat here.

  • Ship an MCP server and list it on Stork — biggest single point gain (+25).
  • Expose API-key auth with a self-serve sandbox tier; remove sales-call gates (+15).

À propos de Pegasus 1.5 by TwelveLabs

Siège social
San Francisco, USA
Fondée
2020
Taille de l’équipe
51-100
Financement
Series A

Spécifications

Documentation API

API disponible

Oui, API publique

overview

Qu'est-ce que Pegasus 1.5 by TwelveLabs ?

Pegasus 1.5 by TwelveLabs est une plateforme d'intelligence vidéo développée par Twelve Labs qui permet aux développeurs et aux entreprises de transformer le contenu vidéo brut en données structurées et interrogeables. Elle traite la vidéo comme un volume multidimensionnel, intégrant des informations visuelles, audio et vocales pour générer des métadonnées basées sur le temps. Rendu généralement disponible le 20 avril 2026, Pegasus 1.5 modifie fondamentalement la compréhension vidéo, passant de la réponse à des questions sur des clips à la génération de métadonnées structurées et basées sur le temps sur des vidéos entières. La plateforme propose des modèles de fondation d'IA multimodaux, y compris Pegasus, qui facilitent une compréhension humaine des données vidéo, d'image et audio, permettant aux utilisateurs de rechercher, classer, résumer et extraire des informations du contenu vidéo à grande échelle. Ce modèle est conçu pour convertir les séquences brutes en métadonnées prêtes à être interrogées via un seul appel API, remplaçant les flux de travail de marquage vidéo manuel.

features

Fonctionnalités clés de Pegasus 1.5 by TwelveLabs

Pegasus 1.5 by TwelveLabs offre une suite complète de fonctionnalités conçues pour l'intelligence vidéo avancée et l'extraction de données structurées. Les capacités principales de la plateforme s'articulent autour de ses modèles de fondation d'IA multimodaux, permettant une compréhension et une analyse approfondies du contenu vidéo. Elle prend en charge l'ingestion et le traitement de données à haute vitesse, ce qui la rend adaptée aux applications d'entreprise à grande échelle.

  • Disponibilité de l'API pour l'intégration dans des applications personnalisées.
  • Recherche et récupération vidéo sémantiques à l'aide de requêtes en langage naturel.
  • Résumé vidéo automatisé et génération d'insights.
  • Extraction de métadonnées basée sur le temps (TBM) avec une sortie de schéma JSON personnalisé.
  • Modération de contenu, conformité et analyse de la sécurité de la marque.
  • Ingestion de données multimodales à environ 60 fois la vitesse en temps réel.
  • Capacité à indexer une heure de vidéo en environ une minute.
  • Prompting multimodal, permettant des images de référence pour la détection d'entités.
  • Prise en charge du traitement de vidéos longues, jusqu'à deux heures en une seule passe.
  • Disponibilité du SDK pour la commodité des développeurs.

use cases

Qui devrait utiliser Pegasus 1.5 by TwelveLabs ?

Pegasus 1.5 by TwelveLabs est conçu pour un large éventail d'utilisateurs et d'organisations qui nécessitent des capacités avancées de compréhension vidéo et d'extraction de données structurées. Son approche API-first et son intelligence multimodale le rendent particulièrement précieux pour les entités traitant de grands volumes de contenu vidéo.

  • Développeurs et Entreprises : Pour la création de plateformes d'intelligence vidéo et l'automatisation des flux de travail d'analyse vidéo.
  • Sociétés de médias et de divertissement : Pour la segmentation de contenu long, la recherche sémantique, l'archivage, la recommandation et la génération automatisée de temps forts.
  • Organisations sportives : Pour la détection et l'étiquetage automatiques des actions de jeu, le support de la création de temps forts en temps réel et l'analyse des performances.
  • Plateformes de contenu et agences de publicité : Pour l'identification des apparitions de marques, des transitions de scènes et des moments contextuels pour la publicité ciblée et la monétisation de contenu.
  • Agences gouvernementales et opérateurs de sécurité : Pour la conformité, la modération de contenu, l'identification des risques politiques et l'analyse vidéo détaillée.
  • Marketeurs de marque : Pour la compréhension du contenu vidéo, l'extraction d'insights et la garantie de la sécurité de la marque.

pricing

Tarification et plans de Pegasus 1.5 by TwelveLabs

TwelveLabs propose un modèle de tarification freemium pour Pegasus 1.5, structuré en plans Free, Developer et Enterprise. Le plan Free offre des limites de débit de base sans coût, permettant aux utilisateurs d'explorer les capacités de la plateforme. Le plan Developer est échelonné, avec des limites croissantes basées sur les dépenses mensuelles, offrant trois niveaux distincts pour s'adapter à une utilisation croissante. Pour les opérations à grande échelle, le plan Enterprise offre des limites personnalisées et des solutions sur mesure. Les limites de débit sont mises en œuvre sur diverses dimensions, y compris la durée par jour (DPD), la durée par heure (DPH), les requêtes par jour (RPD), les requêtes par minute (RPM), les tokens par jour (TPD) et les tokens par minute (TPM). Le dépassement de toute limite applicable entraînera une erreur. La tarification spécifique par token pour le modèle Pegasus comprend un coût de texte d'entrée de 0,001 $ par 1 000 tokens et un coût de texte de sortie de 0,007 $ par 1 000 tokens pour l'utilisation de l'API Analyze.

  • Free : Limites de débit de base, sans coût.
  • Developer : Varie selon le niveau, avec des limites croissantes basées sur les dépenses mensuelles à travers trois niveaux disponibles.
  • Enterprise : Limites et tarification personnalisées, adaptées aux besoins organisationnels spécifiques.

Pros

  • +Achieves high accuracy in video segmentation and time-based metadata extraction.
  • +Provides reliable, schema-compliant JSON outputs for structured data.
  • +Supports processing of long-form videos up to two hours in a single request.
  • +Offers flexible analysis options including synchronous and efficient batch processing.
  • +Multimodal prompting with image references enhances the precision of video queries.
  • +Demonstrates strong competitive performance against leading general-purpose AI models in video understanding tasks.

Cons

  • Not aligned with HIPAA compliance standards, limiting use in certain healthcare contexts.
  • Detailed pricing for all usage dimensions (e.g., video duration processing) requires deeper inquiry beyond publicly listed token costs.
  • Primarily API-driven, which may necessitate developer resources for full implementation and integration.
  • The platform's focus on enterprise and developer use cases might mean a less intuitive out-of-the-box user interface for non-technical users.

Outils similaires

Pegasus 1.5 by TwelveLabs vs Concurrents

TwelveLabs positionne Pegasus 1.5 comme une plateforme d'intelligence vidéo de premier plan, notamment pour son extraction de métadonnées basée sur le temps et sa qualité de segmentation supérieure. Lors de benchmarks internes sur du contenu d'actualités, Pegasus 1.5 a démontré une fidélité de sortie constante sur des schémas complexes et multi-définitions, surpassant les principaux modèles à usage général. Il a atteint une qualité de segmentation agrégée supérieure de 13,1 % à celle de Gemini 3 Pro, avec une précision des limites d'environ 350 millisecondes, et a surpassé Gemini 2.5 Pro de 30 % sur les benchmarks de qualité de segmentation agrégée lors des premiers tests. Contrairement aux modèles qui reposent sur le marquage manuel ou l'analyse au niveau des images, Pegasus 1.5 raisonne sur des vidéos entières pour produire des sorties structurées directement applicables aux flux de travail de production, fonctionnant comme un 'raisonneur vidéo' plutôt qu'un 'lecteur de transcription'.

1

Mixpeek is designed for teams building video intelligence applications, offering a comprehensive platform that handles ingestion, extraction, indexing, and retrieval of video data.

While both offer video AI, Mixpeek provides an end-to-end solution for building custom video intelligence applications with deep content analysis. TwelveLabs focuses on quick cloud-based video understanding with natural language queries and generative text outputs from its foundation models like Pegasus.

2
Google Video Intelligence API

This API provides robust video annotation and content categorization, deeply integrated with the Google Cloud ecosystem for large-scale analytics and developer-focused applications.

Google Video Intelligence API is a developer-centric service for annotating and categorizing video content within the Google Cloud environment. TwelveLabs offers a more integrated platform for natural language video search and generative text outputs, built on its own multimodal foundation models.

3
Clarifai Video

Clarifai Video is a visual AI platform that provides dedicated video analysis models and a visual workflow builder, enabling non-ML engineers to train and chain custom concept detection models.

Clarifai Video emphasizes customizable concept detection and a user-friendly workflow builder for tailored AI solutions. TwelveLabs, with Pegasus 1.5, focuses on advanced multimodal video understanding, summarization, and the generation of structured, time-based metadata through natural language queries.

4
Memories.ai

Memories.ai is an AI video intelligence platform focused on large-scale search, summarization, and multimodal understanding, with an emphasis on contextual memory and timeline insights for streamlined workflows.

Memories.ai provides a platform for broad video intelligence tasks including search and summarization, leveraging contextual memory. TwelveLabs' Pegasus 1.5 specifically advances video understanding by generating structured, time-based metadata across entire videos, moving beyond clip-based answers to enable schema-first interaction for precise temporal boundaries.

Plus sur Stork

Outils IA connexes

Autres outils de cette catégorie, rapprochés par tags communs