

O Inferock-bench é um proxy local que fica entre o seu aplicativo e chamadas no formato OpenAI, Anthropic, Gemini ou OpenRouter. Ele captura o uso de tokens por chamada, falhas e tentativas de repetição, e então gera um recibo independente mostrando o que você foi cobrado e quanto você está realmente pagando a mais.
Loading comments…
Informações do projeto
Palavras-chave do produto
O Inferock Bench é um proxy de diagnóstico local que fica entre sua aplicação e provedores de IA como OpenAI, Anthropic, Gemini ou OpenRouter. Ele captura o uso de tokens por chamada, falhas e tentativas de repetição, e então gera um recibo independente mostrando o que foi cobrado e quanto você está realmente pagando a mais. Em vez de confiar nos próprios registros de cobrança do provedor, o Inferock Bench oferece uma trilha de auditoria neutra e por chamada que você controla.
O Inferock Bench roteia seu tráfego de API por um proxy localhost, capturando uso informado pelo provedor, evidências de preços, metadados de requisição/resposta, status, tempo e sinais de repetição. Ele mede apenas chamadas que realmente vê, então os dados são baseados no seu tráfego real.
A ferramenta gera recibos usando o código de avaliação @inferock/measure incluído e o Padrão Inferock. Cada recibo separa gastos do provedor, perda de dinheiro limitada pela fatura, perda de tempo e exposição a verificação de fatura, para que você não compare coisas diferentes.
Cada superfície é marcada como watched-clean, signal ou not-openable. Isso significa que verificações não abertas ficam visíveis em vez de serem silenciosamente consideradas limpas, dando a você uma visão honesta do que foi e do que não foi verificado.
Suas chaves de provedor nunca são enviadas ao Inferock pelo benchmark local. O proxy as anexa apenas a requisições ao provedor, e os recibos permanecem locais a menos que você escolha compartilhá-los.
"Provedores não deveriam avaliar suas próprias faturas."
Essa é a filosofia central aqui. O Inferock Bench não apenas registra chamadas — ele ativamente expõe falhas de entrega que afetam sua fatura, como saída vazia cobrada, recusas, truncamento, discrepâncias na contagem de tokens, IDs de requisição duplicados e evidências de risco de desconto de cache. Ele também sinaliza tentativas de repetição por falha do provedor, que muitas vezes são silenciosamente absorvidas em seus custos. A ferramenta é honesta sobre seus limites: ela não pode auditar tráfego que passou fora do proxy, e não declara toda discrepância como cobrança excessiva. Em vez disso, preserva as evidências para que questões de integridade de cobrança possam ser respondidas com dados, não suposições.
Você está gastando significativamente em APIs de IA e suspeita que sua fatura não corresponde à realidade. O Inferock Bench é especialmente útil se você precisa responder perguntas como "fui cobrado por uma chamada de API que falhou?" ou quer medir o uso de tokens do Claude ou GPT localmente. Também é uma ótima opção se você está avaliando vários provedores e quer uma métrica consistente e independente para custos e padrões de falha. A ferramenta é extensível por design, embora apenas quatro planos de provedores sejam medidos hoje: OpenAI, Anthropic, Gemini Developer API e endpoints OpenRouter fixados. Se você se sente confortável com uma configuração de proxy local e quer transparência de cobrança que possa verificar por conta própria, vale a pena dar uma olhada.
Outras ferramentas que você pode considerar
Octopoda é uma camada de infraestrutura de código aberto que oferece aos agentes de IA memória persistente, detecção automática de loops e observabilidade completa. Os agentes esquecem tudo entre as sessões. Octopoda resolve isso com uma API de lembrar/recuperar que sobrevive a reinicializações, falhas e implantações. O sistema de detecção de loops monitora 5 sinais para identificar agentes presos repetindo a si mesmos antes que eles queimem seu orçamento de API, com estimativa de custo em tempo real mostrando exatamente quanto cada loop desperdiça. Um painel integrado exibe a pontuação de saúde de cada agente, um explorador de memória com histórico de versões, um registro de auditoria que registra cada decisão com justificativa, e uma reprodução de linha do tempo que permite percorrer passo a passo tudo o que seu agente fez. Funciona com LangChain, CrewAI, AutoGen e OpenAI Agents SDK com integrações de uma linha. Roda localmente com SQLite ou conecta-se à nuvem com uma variável de ambiente. Camada gratuita, licenciado sob MIT. 177 inscrições, 120 estrelas no GitHub, zero gastos com marketing.
O GitHits dá aos agentes de codificação acesso ao código-fonte aberto do qual sua aplicação depende. Obtenha exemplos reais de implementação, navegação pelo código-fonte das dependências, inspeção de pacotes e documentação. Os agentes podem pesquisar e ler sua base de código. Mas eles não conseguem pesquisar e ler o código-fonte aberto do qual sua aplicação depende. É aí que eles começam a adivinhar, tentar novamente e entrar em loop. O GitHits cria um índice com reconhecimento de versão sob demanda. Os agentes podem pesquisar, navegar e inspecionar o código por trás de suas dependências. CLI: npx githits@latest init
navegação baseada em árvore, refatoração semântica, análise de código e ferramentas de portabilidade de linguagem para agentes de codificação com suporte a 163 gramáticas
Agentes de IA podem ser lançados rapidamente, mas sem o contexto adequado do produto, muitas vezes estão voando às cegas. O Brief oferece às equipes de produto uma fonte viva da verdade que captura decisões, preserva a intenção do produto e fornece contexto relevante para humanos e agentes por meio de chat, Slack, CLI e MCP. Ele mantém estratégia, decisões e execução conectados, da visão ao impacto.
Criador
pixel_pilot
Alternativas
Loading comments…