LongCat
Meituan · Programación · Otro · IA china
LongCat es la familia de modelos fundacionales abiertos de Meituan, creada para el razonamiento de contexto largo y la programación agéntica. Abarca modelos de chat rápidos, variantes de pensamiento profundo y versiones multimodales. Puedes acceder a todos mediante la app de chat LongCat o una API que habla los formatos de OpenAI y de Anthropic. La versión más reciente, LongCat-2.0, reúne 1,6 billones de parámetros. También mantiene una ventana de contexto de 1M de tokens. Esa combinación convierte a este modelo de IA de contexto largo en una herramienta útil para leer repositorios de código completos o documentos largos de una sola pasada.

Acerca de LongCat
Qué es LongCat
La línea de modelos fundacionales LongCat es el nombre paraguas que Meituan usa para un conjunto de modelos de lenguaje grandes que desarrolla y, en su mayoría, publica como código abierto. La línea arrancó en septiembre de 2025 con LongCat-Flash-Chat. Creció hasta incluir un modelo de pensamiento, un modelo omni que maneja audio y vídeo, generadores de imagen y vídeo, y el LongCat-2.0 de un billón de parámetros que llegó en junio de 2026. Para un usuario normal, la puerta más sencilla es la app de chat LongCat y el sitio longcat.chat. Ambos hablan en lenguaje llano. Ninguno pide configuración alguna.
Lo que separa a Meituan LongCat de un chatbot genérico es la mezcla de velocidad y longitud de contexto. Los modelos Flash anteriores activan solo una parte de sus parámetros por token. Las respuestas vuelven rápido, incluso en hardware modesto. El nuevo modelo 2.0 lleva el contexto hasta un millón de tokens. Meituan también entrenó y ejecutó todo el sistema en chips chinos nacionales en lugar de GPU importadas. Ese último punto importa sobre todo a quien se preocupa por las cadenas de suministro. También es la razón de que el precio se mantenga bajo.
La desventaja honesta es que trabajas con un modelo desarrollado en China, y algunas páginas y anuncios oficiales llegan primero en chino. La documentación en inglés existe para la API, pero la ayuda de la comunidad es más escasa que la que encontrarías en torno a GPT o Claude. Además, LongCat no es un líder SOTA absoluto en todos los frentes. Los propios números de Meituan lo sitúan por delante de GPT-5.5 y Claude Opus 4.6 en pruebas de programación como SWE-bench Pro, pero por detrás en conocimiento amplio y pruebas de razonamiento general.
Cómo empezar
- Ve a longcat.chat e inicia sesión con un escaneo de Meituan o un número de teléfono.
- Abre el cuadro de chat y elige un modo: un ajuste ligero para preguntas cortas, o pensamiento profundo para trabajos más largos.
- Pega tu tarea, ya sea un bloque de código, un documento largo o una instrucción de varios pasos.
- Para uso programático, abre la página de claves de API y copia la clave predeterminada.
- Apunta tu SDK de OpenAI o Anthropic al endpoint de LongCat, cambia la clave y empieza a llamarlo.
Información del producto
Un vistazo rápido a los precios, las plataformas compatibles y el rendimiento de LongCat.
Ideal para
Los usuarios, tareas y casos de uso en los que esta herramienta encaja mejor.
Usuarios
- Desarrolladores que quieren un modelo de programación barato que puedan meter en un flujo de OpenAI o Anthropic sin reescribir código.
- Estudiantes y aficionados que prueban tareas de contexto largo. La asignación diaria gratuita de tokens cubre el uso ligero sin tarjeta.
- Equipos que manejan bases de código grandes o documentos largos y necesitan un modelo que no pierda el hilo en medio de una entrada de 1M de tokens.
Tareas
- Refactorización a nivel de repositorio
- Análisis de documentos
- Ejecuciones de agentes automatizadas
- Prototipado rápido
Casos de uso
- Trabajos por lotes nocturnos donde el coste por token importa más que la brillantez pura.
- Un desarrollador en solitario que ha tocado los límites de tasa o los vetos de otro proveedor y necesita un respaldo estable que no desaparezca a mitad de proyecto.
- Equipos de investigación que necesitan ejecutar inferencia en hardware nacional en lugar de aceleradores importados.
Funciones clave
Razonamiento de contexto largo a 1M de tokens
La cifra estrella es una ventana de contexto de un millón de tokens en LongCat-2.0. ¿Por qué importa? Porque basta para guardar un repositorio de código entero o un documento del largo de un libro en una sola petición. Puedes hacer preguntas que abarcan toda la entrada en vez de ir uniendo trozos. Meituan construyó un mecanismo de atención dispersa (LSA) para mantener el coste de cómputo lineal a medida que crece la entrada. Eso es lo que hace que la ventana larga sea práctica y no solo teórica.
Respuestas rápidas de un modelo disperso
Los modelos LongCat-Flash usan un diseño de mezcla de expertos. Solo una fracción de los parámetros se activa para cada token. El modelo 2.0 de 1,6 billones de parámetros activa de media unos 48.000 millones por token. Oscila entre unos 33.000 y 56.000 millones según lo difícil que sea la entrada. Las preguntas simples gastan menos cómputo. Las complejas reciben más. El resultado práctico son respuestas rápidas y una factura más baja que la de un modelo denso del mismo tamaño.
Compatibilidad con las API de OpenAI y Anthropic
No tienes que aprender un SDK nuevo. LongCat expone dos formatos de endpoint, uno que imita las chat completions de OpenAI y otro que imita las de Anthropic. Si ya tienes código corriendo contra cualquiera de los dos proveedores, cambiar suele significar modificar la URL base y el nombre del modelo. Eso abarata la prueba. También convierte a LongCat en un reemplazo realista para herramientas construidas en torno a esos ecosistemas.
Modelos de pesos abiertos
La mayor parte de la familia LongCat se distribuye bajo licencias abiertas, con pesos en Hugging Face y GitHub, así que puedes descargarlos y ejecutarlos tú mismo si prefieres no enviar datos a una API. Esa gama cubre modelos de chat, pensamiento, omni, imagen y vídeo. Autoalojar un modelo de un billón de parámetros no es realista para casi nadie. Las variantes más pequeñas están al alcance de una buena estación de trabajo si quieres probarlas en local.
Enfoque en programación agéntica
Meituan ajustó LongCat-2.0 en concreto para agentes de programación y uso de herramientas, no solo para chat simple. Maneja problemas de varios archivos y planifica secuencias cortas de llamadas a herramientas. También aguanta cuando una tarea se alarga muchos pasos. Meituan informa de una puntuación en SWE-bench Pro que supera por poco a GPT-5.5 y Claude Opus 4.6. Como modelo de programación agéntica, encaja en frameworks como Claude Code y OpenClaw con mínimas complicaciones.
Modelos multimodales y de medios
Más allá del texto, la gama incluye LongCat-Flash-Omni para interacción de audio y vídeo en tiempo real, LongCat-Image para generación de imágenes y LongCat-Video para texto a vídeo y continuación de vídeo. Conviven junto a los modelos de chat en la misma familia, así que no tienes que hacer malabares con cinco proveedores distintos para conseguir texto más medios.
Ventajas y desventajas
Ventajas
- Una ventana de contexto de 1M de tokens hace prácticas las tareas de repositorio completo y documentos largos.
- La asignación diaria gratuita de tokens te deja probar cargas de trabajo reales antes de pagar.
- Los dos formatos de API, OpenAI y Anthropic, reducen el trabajo de migración casi a cero.
- Los pesos abiertos de la mayoría de los modelos te permiten autoalojar o afinar.
- Precio reportado bajo frente a modelos insignia occidentales comparables.
Desventajas
- La documentación en inglés y el apoyo de la comunidad van por detrás de los grandes proveedores occidentales, así que resolver problemas lleva más tiempo.
- Las pruebas de conocimiento general y razonamiento quedan por detrás de los modelos de primera línea, así que no es una mejora universal.
- El modelo más potente es enorme; autoalojarlo exige mucho más hardware del que tiene la mayoría.
- El caudal y los límites de tasa del plan gratuito son modestos, lo que puede frenar la experimentación intensa.
Preguntas frecuentes
LongCat es una familia de modelos de IA de propósito general, con especial énfasis en dos cosas: trabajar con entradas muy largas y actuar como motor detrás de agentes de programación. En la práctica eso significa resumir documentos largos, responder preguntas sobre bases de código grandes y alimentar flujos automatizados de llamadas a herramientas que con otros modelos de contexto más corto se atascan.
Contenido relacionado
Explora herramientas, habilidades y artículos relacionados con LongCat.
Alternativas a LongCat
Forefront
Forefront · ProgramaciónForefront es una plataforma web para construir con IA de código abierto. Te deja ajustar los principales modelos de lenguaje de código abierto con tus propios datos, evaluar cómo rinden y ejecutarlos a través de una API o exportarlos para alojarlos tú mismo. Los desarrolladores que quieren la comodidad de una plataforma cerrada pero insisten en ser dueños de sus modelos y sus datos son el público objetivo.
Startkit
StartKit.AI · ProgramaciónStartkit es un boilerplate para crear productos de SaaS con IA y wrappers de IA. Piénsalo como un boilerplate para startups de IA con las partes aburridas ya conectadas: autenticación, pagos con Stripe y Lemon Squeezy, límites de uso, correo transaccional y un kit de inicio de API de IA que habla con OpenAI, Anthropic, Groq o Llama. Clonas el repositorio, pones tu precio y te dedicas a la parte del producto por la que la gente paga de verdad. Está hecho con Next.js sobre React y Tailwind, así que buena parte del código boilerplate ya te resulta familiar.
Testim
Tricentis · ProgramaciónTestim es una plataforma de automatización de pruebas impulsada por IA para crear y ejecutar pruebas de extremo a extremo en aplicaciones web, móviles y Salesforce. Se apoya en el aprendizaje automático para mantener las pruebas estables cuando cambia una interfaz, así que los equipos dedican menos tiempo a reparar selectores rotos. No está nada mal para una herramienta de pruebas automatizadas que puedes empezar a usar hoy mismo. Creas pruebas grabando acciones en un navegador y luego añades JavaScript cuando necesitas más control. Es una opción sólida para equipos de QA con mucho trabajo.
