Skip to content
Herramienta de IABecomes the API

Reseña de Pegasus 1.5 by TwelveLabs

Pegasus 1.5 by TwelveLabs es un modelo de razonamiento de video con AI que transforma metraje de video sin procesar en datos estructurados y consultables utilizando inteligencia multimodal.

shipped 21 abr 2026videofreemium
Domain rating69Monthly visits3.9K/mo
videocoderesearch
Pegasus 1.5 by TwelveLabs - AI tool for pegasus twelvelabs. Professional illustration showing core functionality and features.

Por qué importa

1Lanzado el 20 de abril de 2026, Pegasus 1.5 ofrece disponibilidad general para su plataforma de inteligencia de video.
2El modelo soporta Time-Based Metadata Extraction (TBM) para videos de hasta dos horas de duración en una sola llamada a la API.
3Los puntos de referencia internos indican que Pegasus 1.5 supera a Gemini 3.1 Pro en un 13.1% en calidad de segmentación agregada.
4La indexación de video se logra a una velocidad de 1 hora por minuto, con la ingesta de datos multimodales a aproximadamente 60 veces el tiempo real.

Stork’s verdict on Pegasus 1.5 by TwelveLabs

Pegasus 1.5 ofrece una Time Based Metadata Extraction precisa con esquemas JSON personalizados, pero su naturaleza impulsada por API exige recursos de desarrollador.

Pegasus 1.5 by TwelveLabs reviewed by Stork AI · stork.ai/es/pegasus-1-5-by-twelvelabs

Stork Quadrant

Becomes the API· 27/100

Replaceable as a UI, but kept alive as the API the agents call.

TwelveLabs built a capable multimodal video understanding API before the frontier labs caught up. That window is closing. GPT-4o, Gemini 1.5 Pro, and Claude already handle video natively, and they're getting faster and cheaper. There's no proprietary data, no network, no regulatory gate — just a specialized model that bigger players will commoditize.

Claude Sonnet 4.6, scored 2026-05-30

Defensibility · 0/100

  • Physical-world coupling
  • Regulatory moat
  • Network liquidity
  • Proprietary refreshing data
  • High-trust catastrophic workflows
  • Multi-party coordination
  • Brand / community / taste

An LLM alone could replace

  • Summarize what happens in a video by describing its content
  • Transcribe audio and extract key topics or themes from spoken content
  • Answer questions about a video's subject matter given a transcript or description
  • Generate metadata tags or chapter markers for video content

Agent-Readiness · 60/100

  • Verified MCPStork MCP listing: io-twelvelabs-twelvelabs-mcp-server (untested)
  • Listed on agent surfacesStork:io-twelvelabs-twelvelabs-mcp-server
  • Usage-based pricingpricing page heuristic match: https://www.twelvelabs.io/pricing
  • Headless agent auth
  • Public OpenAPIhttps://docs.twelvelabs.io/v1.3/docs/resources/platform-overview
  • Active changeloghttps://www.twelvelabs.io/blog/introducing-pegasus-1-5 (2026-04-19)
  • llms.txthttps://www.twelvelabs.io/llms.txt

Score history · +5 pts over 3 re-scores

How to defend

Go vertical and own the liability: pick one industry where wrong video analysis has real consequences — insurance claims, legal evidence, broadcast compliance — and become the vendor that signs the contract and bears the risk. That's the only move that creates a moat here.

  • Ship an MCP server and list it on Stork — biggest single point gain (+25).
  • Expose API-key auth with a self-serve sandbox tier; remove sales-call gates (+15).

Sobre Pegasus 1.5 by TwelveLabs

Sede
San Francisco, USA
Fundada
2020
Tamaño del equipo
51-100
Financiación
Series A

Especificaciones

Documentación API

API disponible

Sí, API pública

overview

¿Qué es Pegasus 1.5 by TwelveLabs?

Pegasus 1.5 by TwelveLabs es un modelo de lenguaje centrado en video desarrollado por Twelve Labs que permite a desarrolladores y empresas transformar metraje de video sin procesar en datos estructurados y consultables. Integra información visual, de audio y de voz para generar descripciones textuales detalladas y análisis a partir del contenido de video. Lanzado el 20 de abril de 2026, Pegasus 1.5 se enfoca en Time-Based Metadata Extraction (TBM), permitiendo a los usuarios definir esquemas JSON personalizados y recibir metadatos estructurados y con marca de tiempo de videos de hasta dos horas de duración a través de una sola llamada a la API. Esta funcionalidad elimina la necesidad de pipelines de ingesta, preprocesamiento o indexación, haciendo que el contenido de video sea computable para agentes de AI y sistemas automatizados. Los modelos fundacionales de la plataforma, Marengo y Pegasus, facilitan una comprensión similar a la humana de los datos de video, imagen y audio, soportando la búsqueda semántica, clasificación, resumen y extracción de información a escala.

features

Características Clave de Pegasus 1.5 by TwelveLabs

Pegasus 1.5 by TwelveLabs ofrece un conjunto de características diseñadas para la comprensión y el procesamiento avanzado de video, aprovechando la AI multimodal para convertir metraje sin procesar en datos accionables.

  • Inteligencia multimodal que integra visión, audio y lenguaje para una AI de video integral.
  • Búsqueda y recuperación semántica de video utilizando consultas en lenguaje natural.
  • Resumen automático de video y generación de información a partir de contenido de formato largo.
  • Extracción de metadatos basada en tiempo y etiquetado de contenido con soporte para esquemas JSON personalizados.
  • Moderación de contenido, cumplimiento y análisis de seguridad de marca con AI explicable.
  • Documentación automatizada y generación de informes a partir de metraje de video.
  • Acceso a API y SDK para la integración en flujos de trabajo existentes.
  • Ingesta de datos multimodales de alta velocidad a aproximadamente 60 veces el tiempo real.
  • Indexación de video a escala, procesando 1 hora de video en 1 minuto.
  • Capacidad para segmentar contenido en unidades narrativas (escenas, temas, apariciones de personajes).

use cases

¿Quién debería usar Pegasus 1.5 by TwelveLabs?

Pegasus 1.5 by TwelveLabs está diseñado para una variedad de profesionales y organizaciones que requieren inteligencia de video avanzada para el análisis, la gestión y la monetización de contenido.

  • Desarrolladores: Para integrar inteligencia de video en aplicaciones y plataformas a través del acceso a API y SDK.
  • Empresas: Para la gestión de contenido de video a gran escala, cumplimiento y flujos de trabajo automatizados.
  • Empresas de Medios y Entretenimiento: Para segmentar contenido de formato largo, archivar, sistemas de recomendación y generación automática de momentos destacados.
  • Organizaciones Deportivas: Para detectar y registrar automáticamente jugadas específicas con límites temporales precisos para análisis y creación de momentos destacados en tiempo real.
  • Agencias de Publicidad y Especialistas en Marketing de Marca: Para identificar apariciones de marca, transiciones de escena y momentos contextuales para publicidad dirigida y monetización de contenido.

pricing

Precios y Planes de Pegasus 1.5 by TwelveLabs

TwelveLabs ofrece un modelo de precios freemium para Pegasus 1.5, estructurado en los niveles Free, Developer y Enterprise, con componentes basados en el uso para el acceso a la API. El plan Free proporciona límites básicos sin costo. El plan Developer incluye tres niveles con límites crecientes basados en el gasto mensual. El plan Enterprise ofrece límites personalizados adaptados a las necesidades organizativas específicas. El uso de la API está sujeto a límites de tasa medidos en dimensiones como Duration per day (DPD), Duration per hour (DPH), Requests per day (RPD), Requests per minute (RPM), Tokens per day (TPD) y Tokens per minute (TPM). Exceder cualquier límite aplicable resultará en un error. El texto de entrada para el modelo Pegasus tiene un precio de $0.001 por 1,000 tokens, mientras que los tokens de texto de salida para el uso de la API Pegasus Analyze tienen un precio de $0.007 por 1,000 tokens.

  • Free: Límites básicos sin costo.
  • Developer: Varía según el gasto mensual, ofreciendo tres niveles con límites de uso crecientes.
  • Enterprise: Límites y precios personalizados, negociados según requisitos específicos.

Pros

  • +Achieves high accuracy in video segmentation and time-based metadata extraction.
  • +Provides reliable, schema-compliant JSON outputs for structured data.
  • +Supports processing of long-form videos up to two hours in a single request.
  • +Offers flexible analysis options including synchronous and efficient batch processing.
  • +Multimodal prompting with image references enhances the precision of video queries.
  • +Demonstrates strong competitive performance against leading general-purpose AI models in video understanding tasks.

Cons

  • Not aligned with HIPAA compliance standards, limiting use in certain healthcare contexts.
  • Detailed pricing for all usage dimensions (e.g., video duration processing) requires deeper inquiry beyond publicly listed token costs.
  • Primarily API-driven, which may necessitate developer resources for full implementation and integration.
  • The platform's focus on enterprise and developer use cases might mean a less intuitive out-of-the-box user interface for non-technical users.

Herramientas similares

Pegasus 1.5 by TwelveLabs vs Competidores

TwelveLabs posiciona a Pegasus 1.5 como una solución líder para la comprensión de video de grado de producción, enfatizando su rendimiento en la generación de metadatos estructurados y el razonamiento contextual sobre modelos de propósito general. Los puntos de referencia internos afirman que Pegasus 1.5 supera a Gemini 3.1 Pro en un 13.1% en calidad de segmentación agregada, con una precisión de límite de aproximadamente 350 milisegundos, y es un 30% mejor en AI de video generativa.

1

Mixpeek is designed for teams building video intelligence applications, offering a comprehensive platform that handles ingestion, extraction, indexing, and retrieval of video data.

While both offer video AI, Mixpeek provides an end-to-end solution for building custom video intelligence applications with deep content analysis. TwelveLabs focuses on quick cloud-based video understanding with natural language queries and generative text outputs from its foundation models like Pegasus.

2
Google Video Intelligence API

This API provides robust video annotation and content categorization, deeply integrated with the Google Cloud ecosystem for large-scale analytics and developer-focused applications.

Google Video Intelligence API is a developer-centric service for annotating and categorizing video content within the Google Cloud environment. TwelveLabs offers a more integrated platform for natural language video search and generative text outputs, built on its own multimodal foundation models.

3
Clarifai Video

Clarifai Video is a visual AI platform that provides dedicated video analysis models and a visual workflow builder, enabling non-ML engineers to train and chain custom concept detection models.

Clarifai Video emphasizes customizable concept detection and a user-friendly workflow builder for tailored AI solutions. TwelveLabs, with Pegasus 1.5, focuses on advanced multimodal video understanding, summarization, and the generation of structured, time-based metadata through natural language queries.

4
Memories.ai

Memories.ai is an AI video intelligence platform focused on large-scale search, summarization, and multimodal understanding, with an emphasis on contextual memory and timeline insights for streamlined workflows.

Memories.ai provides a platform for broad video intelligence tasks including search and summarization, leveraging contextual memory. TwelveLabs' Pegasus 1.5 specifically advances video understanding by generating structured, time-based metadata across entire videos, moving beyond clip-based answers to enable schema-first interaction for precise temporal boundaries.

Más en Stork

Herramientas IA relacionadas

Otras herramientas de esta categoría, emparejadas por etiquetas comunes