Edgee

Edgee

Edgee · Programação

O Edgee é um gateway de agentes de IA para equipes de engenharia que fica entre os seus agentes de programação e os provedores de LLM. Ele comprime as cargas de tokens, encaminha solicitações entre mais de 200 modelos de fronteira e de pesos abertos, e rastreia o custo por desenvolvedor, repositório ou pull request. As equipes usam para reduzir o custo de LLM sem mexer no código da aplicação nem perder qualidade nos resultados.

Prévia da interface de Edgee

Sobre Edgee

O que é o Edgee

O Edgee é infraestrutura, não um app que você abre no navegador. É um gateway de agentes de IA que intercepta cada solicitação que o seu agente de programação envia a um provedor de modelos, aplica regras de roteamento e compressão, e então reencaminha a solicitação. Você instala uma CLI. Conecta Claude Code, Codex, Copilot, Cursor ou OpenCode. A partir daí, o gateway assume a medição. O objetivo é simples. Você mantém o mesmo resultado do modelo e paga menos tokens por ele.

Eis o problema que ele resolve. Gastos descontrolados com agentes de programação. Quando uma equipe coloca um agente na máquina de cada desenvolvedor, ninguém consegue dizer qual repositório ou qual pessoa queimou o orçamento até a fatura chegar. Essa falta de visibilidade incomoda. O Edgee dá aos líderes de engenharia o quadro em tempo real, e permite definir orçamentos de tokens por desenvolvedor ou por squad. Quando um orçamento se esgota, as solicitações são redirecionadas para um modelo de pesos abertos no meio da tarefa em vez de parar.

O alcance é o principal limite. O Edgee mira agentes de programação e chamadas de LLM baseadas em API, não produtos de chat para consumidores. Ele não vai gerenciar uma assinatura pessoal do ChatGPT. O plano gratuito cobre um único desenvolvedor, e recursos como SSO, hospedagem privada do gateway e residência de dados personalizada ficam atrás do nível Enterprise, que usa preços personalizados.

Primeiros passos

  1. Instale a CLI do Edgee com curl -fsSL https://install.edgee.ai | bash, o Homebrew no macOS, ou o instalador do PowerShell no Windows.
  2. Inicie o seu agente de programação por meio do gateway, por exemplo edgee launch claude ou edgee launch codex.
  3. Atribua uma política de roteamento e um orçamento de tokens a um desenvolvedor, um squad ou toda a organização pelo painel.
  4. Opcionalmente, conecte as suas próprias chaves de provedor (BYOK) para controlar a cobrança, ou use as chaves fornecidas pelo Edgee e pague uma taxa de plataforma de 5% nas recargas.
  5. Revise o uso e o custo por desenvolvedor, repositório e PR no link de análises de sessão que a CLI imprime ao sair.

Informações do produto

Uma visão rápida dos preços, das plataformas compatíveis e do desempenho de Edgee.

Plano gratuitoSim
Planos pagos$0 - $30/developer/mo (Enterprise custom)
PlataformaWeb, CLI (macOS, Linux, Windows), cloud or self-hosted
DesenvolvedorEdgee
CategoriaProgramação
Data de lançamentoJan 2025
Última atualizaçãoSep 2025
Visitas ao site14.1K
Ranking global do site1.9M
Disponibilidade da APISim

Ideal para

Os usuários, tarefas e cenários em que esta ferramenta se encaixa melhor.

Usuários

  • Desenvolvedores individuais
  • Gerentes de engenharia
  • Equipes de plataforma com necessidades de conformidade

Tarefas

  • Cortar as faturas de tokens em agentes de programação
  • Manter os agentes funcionando durante quedas
  • Atribuir o gasto de LLM

Cenários

  • Uma equipe cuja cota do Claude Pro ou Max acaba no meio da sprint
  • Uma empresa que padroniza muitos agentes sob uma única política
  • Uma organização com regras de residência de dados

Principais recursos

Roteamento inteligente de modelos

O Edgee encaminha cada solicitação com base no orçamento e na política que você define, e mantém uma cadeia configurável de provedores por trás de cada regra. Se um provedor retorna um erro 5xx ou esgota o tempo, a solicitação passa para o próximo modelo em vez de falhar. Quando um teto de gasto é atingido, o roteamento muda para um modelo de pesos abertos no meio da tarefa, então uma sessão de programação não trava, e a solicitação continua em um modelo avaliado para trabalho de programação em vez de abandonar a tarefa por completo. As sessões não quebram. Isso importa durante uma refatoração longa.

Compressão de tokens

O gateway enxuga tokens redundantes em duas camadas. A compressão de entrada lida com cerca de 99% do volume de tokens ao cortar as cargas de resultados de ferramentas, o conteúdo volumoso de arquivos e a saída de comandos que os agentes leem mas raramente precisam de novo, enquanto a compressão de saída mira o fluxo menor mas mais valioso de respostas do modelo. O Edgee descreve isso como sem perdas semânticas para trabalho de programação, o que significa que você obtém o mesmo resultado do modelo com menos tokens cobrados. Nenhuma mudança no código da aplicação é necessária.

Observabilidade de equipe

O custo e o uso são detalhados por desenvolvedor, por repositório, por PR e por modelo. Os líderes de engenharia veem o gasto em tempo real em vez de esperar a fatura mensal. O plano Team adiciona tetos de gasto por assento com alertas quando um desenvolvedor se aproxima do limite, além de integração com o GitHub para atribuição por repositório e PR.

Modelos de pesos abertos

O Edgee serve GLM, Kimi e MiniMax em velocidade turbo por um preço mensal fixo. Esses são os modelos para os quais as políticas de roteamento recorrem, e são avaliados para tarefas de programação. Eles dão às equipes um alvo mais barato que mantém a qualidade próxima o bastante para terminar o trabalho.

Traga suas próprias chaves

Você pode usar as chaves de provedor do Edgee por conveniência, ou conectar as suas próprias chaves para controlar a cobrança e usar modelos personalizados. O Edgee não cobra margem sobre os tokens que você já paga a um provedor, o que mantém as configurações BYOK neutras em custo do lado do gateway.

Implantação no local

O mesmo gateway roda dentro da sua própria infraestrutura via Docker Compose ou Helm, conectado ou isolado. Prompts, respostas e chaves de provedor nunca saem da sua rede, e é isso que torna o produto utilizável para equipes reguladas.

Catálogo de modelos

O catálogo abrange modelos de fronteira e de pesos abertos de todos os principais provedores, com preços ao vivo e tamanhos de contexto. No momento em que escrevo, lista 221 modelos e 974 rotas de provedor, e qualquer um deles é um alvo válido para uma regra de roteamento.

API única para vários provedores

Apps e agentes podem chamar LLMs por uma só API do Edgee em vez de malabarizar SDKs de provedores separados. O uso nesse caminho é pago conforme o uso sem exigir um plano, cobrado com uma taxa de plataforma de 5% quando você recarrega créditos do Edgee.

Prós e contras

Prós

  • Corta o gasto de tokens por meio de compressão sem mudar o código da aplicação.
  • Encaminha entre mais de 200 modelos com fallback e redirecionamento no meio da tarefa quando provedores falham ou limites são atingidos.
  • O rastreamento granular de custos por desenvolvedor, repositório e pull request fecha a lacuna de visibilidade do gasto dos agentes.
  • Suporta BYOK, implantação no local e configurações isoladas para equipes com regras de dados rígidas.
  • Um nível gratuito generoso para um único desenvolvedor com acesso a todos os principais agentes de programação.

Contras

  • O valor de categoria não está disponível no registro do produto, então a tabela Info o lista como N/A.
  • Recursos Enterprise como SSO, hospedagem privada do modelo e residência de dados personalizada exigem preços personalizados, o que implica uma conversa com vendas.
  • O Edgee enquadra a economia da compressão como sem perdas especificamente para tarefas de programação, então equipes que usam agentes para outro trabalho devem verificar a qualidade do resultado por conta própria.

Perguntas frequentes

É um gateway de agentes de IA que intercepta as solicitações entre o seu agente de programação e os provedores de LLM. O Edgee comprime tokens, encaminha entre modelos sob os orçamentos que você define, e informa o custo e o uso por desenvolvedor, repositório e PR. Pense nele como um gateway de API para o tráfego de IA.

Conteúdo relacionado

Explore ferramentas, skills e artigos relacionados a Edgee.

Alternativas a Edgee

Forefront

Forefront

Forefront · Programação

O Forefront é uma plataforma web para construir com IA de código aberto. Você ajusta os principais modelos de linguagem de código aberto com seus próprios dados, avalia o desempenho deles e os roda por uma API ou os exporta para hospedar por conta própria. Desenvolvedores que querem a conveniência de uma plataforma fechada, mas fazem questão de ser donos dos modelos e dos dados, são o público-alvo aqui.

Grátis / $0 - $99/moVer detalhes
Startkit

Startkit

StartKit.AI · Programação

Startkit é um boilerplate para criar produtos de SaaS com IA e wrappers de IA. Pense nele como um boilerplate para startups de IA com as partes chatas já conectadas: autenticação, pagamentos com Stripe e Lemon Squeezy, limites de uso, e-mail transacional e um kit inicial de API de IA que conversa com OpenAI, Anthropic, Groq ou Llama. Você clona o repositório, define seu preço e começa pela parte do produto que as pessoas realmente pagam. Ele é feito em Next.js sobre React e Tailwind, então boa parte do código boilerplate já parece familiar.

Pago / $99 - $499 one-timeVer detalhes
Testim

Testim

Tricentis · Programação

O Testim é uma plataforma de automação de testes com IA para criar e executar testes de ponta a ponta em aplicações web, mobile e Salesforce. Ele se apoia no aprendizado de máquina para manter os testes estáveis quando uma interface muda, então as equipes gastam menos tempo consertando seletores quebrados. Nada mal para uma ferramenta de testes automatizados que você pode começar a usar hoje. Você cria testes gravando ações no navegador e depois adiciona JavaScript quando precisa de mais controle. É uma escolha sólida para equipes de QA ocupadas.

Grátis / Custom pricing on requestVer detalhes