LongCat

LongCat

Meituan · Programação · Outros · IA chinesa

O LongCat é a família de modelos fundacionais abertos da Meituan, criada para raciocínio de contexto longo e programação agêntica. Ela cobre modelos de chat rápidos, variantes de pensamento profundo e versões multimodais. Você chega a todos pelo app de chat LongCat ou por uma API que fala os formatos da OpenAI e da Anthropic. A versão mais recente, o LongCat-2.0, reúne 1,6 trilhão de parâmetros. Ele também mantém uma janela de contexto de 1M de tokens. Essa combinação é o que torna este modelo de IA de contexto longo útil para ler repositórios de código inteiros ou documentos longos de uma só vez.

Prévia da interface de LongCat

Sobre LongCat

O que é o LongCat

A linha de modelos fundacionais LongCat é o nome guarda-chuva que a Meituan usa para um conjunto de modelos de linguagem grandes que ela desenvolve e, em sua maioria, publica como código aberto. A linha começou em setembro de 2025 com o LongCat-Flash-Chat. Cresceu até incluir um modelo de pensamento, um modelo omni que lida com áudio e vídeo, geradores de imagem e vídeo, e o LongCat-2.0 de um trilhão de parâmetros que chegou em junho de 2026. Para um usuário comum, a porta mais fácil é o app de chat LongCat e o site longcat.chat. Os dois falam em linguagem simples. Nenhum exige configuração.

O que separa o Meituan LongCat de um chatbot genérico é a mistura de velocidade e comprimento de contexto. Os modelos Flash anteriores ativam só uma fatia dos parâmetros por token. As respostas voltam rápido, mesmo em hardware modesto. O novo modelo 2.0 leva o contexto a um milhão de tokens. A Meituan também treinou e rodou tudo em chips chineses domésticos em vez de GPUs importadas. Esse último ponto importa sobretudo para quem se preocupa com cadeias de suprimento. É também a razão de o preço se manter baixo.

A desvantagem honesta é que você trabalha com um modelo desenvolvido na China, e algumas páginas e anúncios oficiais chegam primeiro em chinês. A documentação em inglês existe para a API, mas a ajuda da comunidade é mais escassa do que a que você encontraria em torno do GPT ou do Claude. Além disso, o LongCat não é um líder SOTA absoluto em todas as frentes. Os próprios números da Meituan o colocam à frente do GPT-5.5 e do Claude Opus 4.6 em testes de programação como o SWE-bench Pro, mas atrás deles em conhecimento amplo e testes de raciocínio geral.

Como começar

  1. Vá a longcat.chat e entre com um escaneamento da Meituan ou um número de telefone.
  2. Abra a caixa de chat e escolha um modo: um ajuste leve para perguntas curtas, ou pensamento profundo para trabalhos mais longos.
  3. Cole sua tarefa, seja um bloco de código, um documento longo ou uma instrução de várias etapas.
  4. Para uso programático, abra a página de chaves de API e copie a chave padrão.
  5. Aponte seu SDK da OpenAI ou da Anthropic para o endpoint do LongCat, troque a chave e comece a chamá-lo.

Informações do produto

Uma visão rápida dos preços, das plataformas compatíveis e do desempenho de LongCat.

Plano gratuitoSim
Planos pagos$0 - $0.56/M tokens
PlataformaWeb, API
DesenvolvedorMeituan
CategoriaProgramação · Outros · IA chinesa
Data de lançamentoSep 2025
Última atualizaçãoJun 2026
Visitas ao site629.1K
Ranking global do site77.5K
Disponibilidade da APISim

Ideal para

Os usuários, tarefas e cenários em que esta ferramenta se encaixa melhor.

Usuários

  • Desenvolvedores que querem um modelo de programação barato para encaixar em um fluxo da OpenAI ou da Anthropic sem reescrever código.
  • Estudantes e curiosos que testam tarefas de contexto longo. A cota diária gratuita de tokens cobre o uso leve sem cartão.
  • Equipes que lidam com bases de código grandes ou documentos longos e precisam de um modelo que não perca o fio no meio de uma entrada de 1M de tokens.

Tarefas

  • Refatoração em nível de repositório
  • Análise de documentos
  • Execuções de agentes automatizadas
  • Prototipagem rápida

Cenários

  • Trabalhos em lote durante a noite, em que o custo por token importa mais que o brilho puro.
  • Um desenvolvedor solo que bateu nos limites de taxa ou levou banimento em outro provedor e precisa de um reserva estável que não suma no meio do projeto.
  • Estruturas de pesquisa que precisam rodar inferência em hardware doméstico em vez de aceleradores importados.

Principais recursos

Raciocínio de contexto longo em 1M de tokens

O número de destaque é uma janela de contexto de um milhão de tokens no LongCat-2.0. Por que isso importa? Porque basta para guardar um repositório de código inteiro ou um documento do tamanho de um livro em uma única requisição. Você pode fazer perguntas que abrangem toda a entrada em vez de juntar pedaços. A Meituan construiu um mecanismo de atenção esparsa (LSA) para manter o custo de computação linear conforme a entrada cresce. É isso que torna a janela longa prática, e não apenas teórica.

Respostas rápidas de um modelo esparso

Os modelos LongCat-Flash usam um design de mistura de especialistas. Só uma fração dos parâmetros dispara para cada token. O modelo 2.0 de 1,6 trilhão de parâmetros ativa em média uns 48 bilhões por token. Ele oscila entre cerca de 33 e 56 bilhões conforme a dificuldade da entrada. Perguntas simples gastam menos computação. As complexas recebem mais. O resultado prático são respostas rápidas e uma conta mais baixa do que a de um modelo denso do mesmo tamanho.

Compatibilidade com as APIs da OpenAI e da Anthropic

Você não precisa aprender um SDK novo. O LongCat expõe dois formatos de endpoint, um que espelha as chat completions da OpenAI e outro que imita as da Anthropic. Se você já tem código rodando contra qualquer um dos dois provedores, trocar costuma significar mudar a URL base e o nome do modelo. Isso baixa o custo de testar. Também faz do LongCat um substituto realista para ferramentas construídas em torno desses ecossistemas.

Modelos de pesos abertos

A maior parte da família LongCat sai sob licenças abertas, com pesos no Hugging Face e no GitHub, então você pode baixá-los e rodá-los por conta própria se preferir não enviar dados para uma API. Essa gama cobre modelos de chat, pensamento, omni, imagem e vídeo. Auto-hospedar um modelo de um trilhão de parâmetros não é realista para quase ninguém. As variantes menores estão ao alcance de uma boa estação de trabalho se você quiser testá-las localmente.

Foco em programação agêntica

A Meituan ajustou o LongCat-2.0 especificamente para agentes de programação e uso de ferramentas, não só para chat simples. Ele lida com problemas de vários arquivos e planeja sequências curtas de chamadas de ferramentas. Também aguenta quando uma tarefa se estende por muitos passos. A Meituan relata uma pontuação no SWE-bench Pro que passa por pouco do GPT-5.5 e do Claude Opus 4.6. Como modelo de programação agêntica, ele encaixa em frameworks como Claude Code e OpenClaw com o mínimo de transtorno.

Modelos multimodais e de mídia

Além do texto, a linha inclui o LongCat-Flash-Omni para interação de áudio e vídeo em tempo real, o LongCat-Image para geração de imagens e o LongCat-Video para texto em vídeo e continuação de vídeo. Eles convivem com os modelos de chat na mesma família, então você não faz malabarismo com cinco fornecedores diferentes para obter texto mais mídia.

Prós e contras

Prós

  • Uma janela de contexto de 1M de tokens torna práticas as tarefas de repositório completo e documentos longos.
  • A cota diária gratuita de tokens deixa você testar cargas de trabalho reais antes de pagar.
  • Os dois formatos de API, OpenAI e Anthropic, reduzem o trabalho de migração a quase zero.
  • Os pesos abertos da maioria dos modelos permitem auto-hospedar ou ajustar.
  • Preço relatado baixo frente a modelos de ponta ocidentais comparáveis.

Contras

  • A documentação em inglês e o apoio da comunidade ficam atrás dos grandes provedores ocidentais, então resolver problemas leva mais tempo.
  • Os testes de conhecimento geral e raciocínio ficam atrás dos modelos de primeira linha, então não é uma melhoria universal.
  • O modelo mais forte é enorme; auto-hospedá-lo exige muito mais hardware do que a maioria das pessoas tem.
  • A vazão e os limites de taxa do plano gratuito são modestos, o que pode frear a experimentação pesada.

Perguntas frequentes

O LongCat é uma família de modelos de IA de propósito geral, com ênfase extra em duas coisas: trabalhar com entradas muito longas e servir de motor por trás de agentes de programação. Na prática, isso significa resumir documentos longos, responder perguntas sobre bases de código grandes e alimentar fluxos automatizados de chamadas de ferramentas que, em modelos de contexto mais curto, travam.

Conteúdo relacionado

Explore ferramentas, skills e artigos relacionados a LongCat.

Alternativas a LongCat

Forefront

Forefront

Forefront · Programação

O Forefront é uma plataforma web para construir com IA de código aberto. Você ajusta os principais modelos de linguagem de código aberto com seus próprios dados, avalia o desempenho deles e os roda por uma API ou os exporta para hospedar por conta própria. Desenvolvedores que querem a conveniência de uma plataforma fechada, mas fazem questão de ser donos dos modelos e dos dados, são o público-alvo aqui.

Grátis / $0 - $99/moVer detalhes
Startkit

Startkit

StartKit.AI · Programação

Startkit é um boilerplate para criar produtos de SaaS com IA e wrappers de IA. Pense nele como um boilerplate para startups de IA com as partes chatas já conectadas: autenticação, pagamentos com Stripe e Lemon Squeezy, limites de uso, e-mail transacional e um kit inicial de API de IA que conversa com OpenAI, Anthropic, Groq ou Llama. Você clona o repositório, define seu preço e começa pela parte do produto que as pessoas realmente pagam. Ele é feito em Next.js sobre React e Tailwind, então boa parte do código boilerplate já parece familiar.

Pago / $99 - $499 one-timeVer detalhes
Testim

Testim

Tricentis · Programação

O Testim é uma plataforma de automação de testes com IA para criar e executar testes de ponta a ponta em aplicações web, mobile e Salesforce. Ele se apoia no aprendizado de máquina para manter os testes estáveis quando uma interface muda, então as equipes gastam menos tempo consertando seletores quebrados. Nada mal para uma ferramenta de testes automatizados que você pode começar a usar hoje. Você cria testes gravando ações no navegador e depois adiciona JavaScript quando precisa de mais controle. É uma escolha sólida para equipes de QA ocupadas.

Grátis / Custom pricing on requestVer detalhes