MnzAI - Token Manager
Stop guessing what your AI coding costs. See the real USD estimate of every Claude Code,
GitHub Copilot Chat and Cursor Chat session — live, per model, per session — 100% local, no
API key, zero data collection.

🇧🇷 Português | 🇺🇸 English
English

▶️ Watch the full walkthrough with sound
The problem
Claude Code, GitHub Copilot and Cursor each hide the same number a little differently: you can
see a quota percentage, but not what a prompt actually costs in dollars, right now, in
the editor. If you mix tools, there's no shared unit to compare them — "73% of premium
requests used" and "$4.20 this session" aren't the same currency.
The solution
MnzAI - Token Manager reads the usage logs your own tools already write on disk — Claude
Code, GitHub Copilot Chat and Cursor Chat — converts every token count to an estimated USD
figure using a versioned local pricing table, and puts it where you're already looking: the
status bar, a full panel, and the Activity Bar.
✨ Features
📊 Real-time cost dashboard — a status-bar figure updates the moment new usage is
written (no click, no refresh), plus a full panel with Today, Sessions, History,
Models, Efficiency, Subscriptions and Consolidated tabs.
🖱️ Hover the status bar for the current session — its tokens, and its cost in the unit
that actually bills you: GitHub Copilot credits where the transcript reports them, our USD
estimate per tool, plus today's total. Any alert you have switched on also shows how close
you are to its limit. No click needed.
🧮 Consolidated by vendor, tool and model — the tools you use (Claude Code, GitHub
Copilot, Cursor) are not the same thing as the vendors whose models actually run (Anthropic,
OpenAI, …): a Copilot request answered by a Claude model is billed by GitHub and built by
Anthropic. The Consolidated tab slices the same spend all three ways, and the three
always add up to the same figures.
🗂️ Activity Bar summary view — an always-available glance from the sidebar, without
opening the full panel: today's cost, the current session, GitHub Copilot credits (the
real billing unit, not our estimate) and Claude Code's 5h / weekly time windows.
🧪 Counterfactual cost — the Efficiency tab re-prices the exact same token volume
against every other model in the table, so "what would this month have cost on Haiku instead
of Opus?" is a number on screen, not a guess. Alongside it: cache-hit rate, cost share per
model, and how your context grows across a session.
🗓️ Filter by day or by month — Sessions, Models, Efficiency and Consolidated all follow
the period you pick; Today, History and Subscriptions keep their own fixed periods.
🔔 Alerts Setup, from the panel — the button in the panel header opens a dialog for the
two cost limits: daily and per session. Tick a box, type a number, Apply. It writes
straight to your VS Code settings, so the Settings UI and the dialog can never disagree.
Notifications fire on their own when a limit is crossed — no hovering, no opening the panel.
Daily fires once per day per threshold, session once per session per threshold.
There is a third, separate alert about context size in tokens
(tokenObserver.sessionSizeAlert.thresholdTokens, default 150,000), which suggests
/compact. It measures how big a conversation has grown, not what it cost — that is why it
is not in the dialog, and why it lives in the Settings UI on its own.
💵 Token → USD conversion, per model — every count is priced against a versioned
pricing table shipped with the extension; a model the table doesn't recognize is shown as
unpriced, never guessed.
🧩 Breakdown by model and by session — the Models tab shows your mix plus a
hierarchy from most premium to most economical, so you can see what a model swap is worth
before making it; the Sessions tab is the core view: which of your last sessions was
expensive, and on what model.
🎟️ Subscriptions tab, for the plans tokens don't measure — GitHub Copilot credits
today and this month (its real billing unit), and Claude Code's rolling 5h / weekly
windows, which is what a Pro/Max plan is actually limited by. Usage intensity, stated as
such — we have no access to your account's real quota and never pretend otherwise.
🌐🎨 Language + 6 color themes — Português/English switch and 6 selectable panel themes,
independent of your editor's own color theme; both choices are remembered.
🔒 Privacy & Security
This runs 100% on your machine. Nothing you type or generate ever leaves it.
- No network calls, ever. MnzAI - Token Manager never proxies, intercepts, or sits in
the path of any AI request — it only reads files your own tools already wrote, after the
fact.
- No login, no API key. Not for you, not for an admin.
- Never reads prompts, responses, or code. By construction, not by filtering: the parser
only ever touches a small fixed set of fields — token counts, model names, timestamps, and
internal request IDs. This is covered by an automated privacy test, including an
adversarial fixture that plants sensitive markers in every field the parser must skip.
- Zero data collection. Nothing is sent anywhere — there is no server behind this
extension.
🤖 Supported models
Priced today via the bundled pricing table:
| Vendor |
Models |
| Anthropic Claude |
claude-fable-5, claude-opus-5, claude-opus-4-8, claude-sonnet-5, claude-sonnet-4-6, claude-haiku-4-5, claude-3-5-haiku-20241022 |
| OpenAI GPT |
gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna, gpt-4o, gpt-4o-mini |
The pricing table is versioned and updated independently of the extension; a model that isn't
in it yet is shown as unpriced rather than assigned an invented price — Cursor's own
composer-* models are the case you're most likely to hit today.
🔌 Where the data comes from
| Tool |
Source read |
Notes |
| Claude Code |
its JSONL session logs |
tokens, model and timestamps |
| GitHub Copilot Chat |
VS Code's workspaceStorage chat logs |
also reports credits, its real billing unit |
| Cursor Chat |
Cursor's local SQLite (state.vscdb) |
tokens and model per session; needs Node 22+, so on older VS Code hosts this one collector disables itself with a warning and the other two keep working |
All three run side by side, and none of them requires setup.
🚀 Installation & quickstart
- Install "MnzAI - Token Manager" from the VS Code Marketplace
or Open VSX — works the same in VS Code, Cursor, and other
compatible editors.
- That's it — no setup step, no key to paste. On first activation you'll see a one-time
notice explaining how it works; after that, the status bar starts showing today's cost as
soon as it finds existing Claude Code / Copilot Chat history on your machine.
- Click the status bar item, the Activity Bar icon, or run "MnzAI - Token Manager: Abrir
painel" from the command palette to open the full panel.
Works identically on an individual plan or inside a company's enterprise account — there is
no admin setup, ever. Every developer who installs it sees only their own data, on their own
machine.
What the cost is — and isn't
The number shown is an estimate, computed locally from your token counts and the bundled
pricing table. It is not your provider's invoice and isn't fetched from any billing API —
real invoices can differ (plan discounts, promotional credits, rounding, billing-cycle
boundaries). For GitHub Copilot specifically, the $ figure is our own per-token estimate, not
the premium request credit unit GitHub bills you on.
License
MnzAI - Token Manager is free to install and use, distributed under a proprietary license — see
LICENSE. The license explicitly authorizes the Visual Studio Marketplace, Open
VSX, and use inside VS Code, Cursor, and other VS Code-compatible editors.
Português

▶️ Assista ao vídeo completo, com som
O problema
Claude Code, GitHub Copilot e Cursor escondem o mesmo número de um jeito diferente cada um:
você vê uma porcentagem de cota, mas não quanto um prompt custa em dólar, agora, no
editor. Se você mistura ferramentas, não existe uma unidade comum pra comparar — "73% dos
premium requests usados" e "$4,20 nesta sessão" não são a mesma moeda.
A solução
O MnzAI - Token Manager lê os logs de uso que suas próprias ferramentas já gravam em disco —
Claude Code, GitHub Copilot Chat e Cursor Chat — converte cada contagem de token numa estimativa
em dólar usando uma tabela de preço local versionada, e mostra onde você já está olhando: a barra
de status, um painel completo, e a Activity Bar.
✨ Funcionalidades
📊 Dashboard de custo em tempo real — um número na barra de status atualiza assim que
novo uso é gravado (sem clique, sem refresh), mais um painel completo com as abas Hoje,
Sessões, Histórico, Modelos, Eficiência, Assinaturas e Consolidado.
🖱️ Passe o mouse na barra de status pra ver a sessão atual — os tokens dela e o custo na
unidade que realmente te cobra: créditos do GitHub Copilot quando o histórico os reporta,
nossa estimativa em dólar por ferramenta, e o total de hoje. Se você tiver algum alerta
ligado, ele mostra também o quanto falta pro limite. Sem precisar clicar.
🧮 Consolidado por fornecedor, ferramenta e modelo — as ferramentas que você usa (Claude
Code, GitHub Copilot, Cursor) não são a mesma coisa que os fornecedores cujos modelos de fato
rodam (Anthropic, OpenAI, …): uma request do Copilot respondida por um modelo Claude é
cobrada pelo GitHub e construída pela Anthropic. A aba Consolidado fatia o mesmo gasto
pelos três eixos, e os três sempre somam os mesmos números.
🗂️ Resumo na Activity Bar — uma olhada sempre disponível direto na barra lateral, sem
abrir o painel completo: o custo de hoje, a sessão atual, os créditos do GitHub Copilot
(a unidade real de cobrança, não a nossa estimativa) e as janelas de 5h / semanal do
Claude Code.
🧪 Custo contrafactual — a aba Eficiência reprecifica exatamente o mesmo volume de
tokens em cada outro modelo da tabela, então "quanto teria custado este mês no Haiku em vez do
Opus?" vira um número na tela, não um chute. Junto dele: taxa de cache hit, participação de
cada modelo no custo, e como seu contexto cresce ao longo da sessão.
🗓️ Filtro por dia ou por mês — Sessões, Modelos, Eficiência e Consolidado seguem o período
que você escolher; Hoje, Histórico e Assinaturas mantêm os períodos fixos deles.
🔔 Alerts Setup, direto do painel — o botão no cabeçalho do painel abre um diálogo com os
dois limites de custo: diário e por sessão. Marque a caixa, digite o número, Apply.
Ele grava direto nas suas settings do VS Code, então a Settings UI e o diálogo nunca
discordam. As notificações disparam sozinhas quando um limite é cruzado — sem hover, sem
abrir o painel. O diário dispara uma vez por dia por limiar; o de sessão, uma vez por sessão.
Existe um terceiro alerta, separado, sobre tamanho de contexto em tokens
(tokenObserver.sessionSizeAlert.thresholdTokens, padrão 150.000), que sugere
/compact. Ele mede o quanto a conversa cresceu, não o que ela custou — por isso não está no
diálogo, e fica só na Settings UI.
💵 Conversão token → dólar, por modelo — cada contagem é precificada contra uma tabela
de preço versionada embutida na extensão; um modelo que a tabela não reconhece aparece como
sem preço, nunca um valor inventado.
🧩 Detalhamento por modelo e por sessão — a aba Modelos mostra seu mix e uma
hierarquia do mais premium ao mais econômico, pra você ver quanto vale trocar de modelo
antes de trocar; a aba Sessões é a visão principal: qual das suas últimas sessões foi
cara, e em qual modelo.
🎟️ Aba Assinaturas, pros planos que token não mede — os créditos do GitHub Copilot
hoje e no mês (a unidade real de cobrança dele), e as janelas rolantes de 5h / semanal do
Claude Code, que é o que de fato limita um plano Pro/Max. É intensidade de uso, dito com todas
as letras — não temos acesso à cota real da sua conta e nunca fingimos ter.
🌐🎨 Idioma + 6 temas de cor — troca Português/English e 6 temas selecionáveis pro painel,
independentes do tema do seu editor; as duas escolhas ficam salvas.
🔒 Privacidade e segurança
Isso roda 100% na sua máquina. Nada que você digita ou gera sai dela.
- Nenhuma chamada de rede, nunca. O MnzAI - Token Manager nunca faz proxy, não
intercepta, não entra no caminho de nenhuma chamada de IA — só lê arquivos que suas
próprias ferramentas já escreveram, depois do fato.
- Sem login, sem API key. Nem pra você, nem pra um admin.
- Nunca lê prompts, respostas ou código. Por construção, não por filtro: o parser só toca
um conjunto pequeno e fixo de campos — contagem de tokens, nomes de modelo, timestamps e
ids internos de request. Isso é coberto por um teste automatizado de privacidade, incluindo
uma fixture adversarial que planta marcadores sensíveis em cada campo que o parser deveria
pular.
- Coleta zero. Nada é enviado a lugar nenhum — não existe servidor por trás desta
extensão.
🤖 Modelos suportados
Precificados hoje pela tabela embutida:
| Fornecedor |
Modelos |
| Anthropic Claude |
claude-fable-5, claude-opus-5, claude-opus-4-8, claude-sonnet-5, claude-sonnet-4-6, claude-haiku-4-5, claude-3-5-haiku-20241022 |
| OpenAI GPT |
gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna, gpt-4o, gpt-4o-mini |
A tabela de preço é versionada e atualizada independente da extensão; um modelo que ainda não
está nela aparece como sem preço em vez de receber um preço inventado — os modelos
composer-* do próprio Cursor são o caso que você tem mais chance de encontrar hoje.
🔌 De onde vêm os dados
| Ferramenta |
Fonte lida |
Observações |
| Claude Code |
os logs JSONL de sessão dele |
tokens, modelo e timestamps |
| GitHub Copilot Chat |
os logs de chat no workspaceStorage do VS Code |
também reporta créditos, a unidade real de cobrança dele |
| Cursor Chat |
o SQLite local do Cursor (state.vscdb) |
tokens e modelo por sessão; exige Node 22+, então em hosts de VS Code mais antigos só esse coletor se desliga com um aviso e os outros dois seguem funcionando |
Os três rodam lado a lado, e nenhum deles precisa de configuração.
🚀 Instalação e primeiros passos
- Instale "MnzAI - Token Manager" pelo VS Code Marketplace
ou Open VSX — funciona igual no VS Code, no Cursor e em outros
editores compatíveis.
- Só isso — sem passo de configuração, sem chave pra colar. Na primeira ativação aparece
um aviso único explicando como funciona; depois disso, a barra de status já mostra o custo
de hoje assim que encontrar histórico do Claude Code / Copilot Chat na sua máquina.
- Clique na barra de status, no ícone da Activity Bar, ou rode "MnzAI - Token Manager:
Abrir painel" na paleta de comandos pra abrir o painel completo.
Funciona igual numa conta individual ou dentro de uma conta enterprise da empresa — nunca
precisa de configuração de admin. Todo dev que instala vê só os próprios dados, na própria
máquina.
Que custo é — e que custo não é
O número mostrado é uma estimativa, calculada localmente a partir da sua contagem de
tokens e da tabela de preço embutida. Não é a fatura do seu provider nem vem de nenhuma API
de billing — faturas reais podem divergir (desconto de plano, crédito promocional,
arredondamento, limites de ciclo de cobrança). Especificamente pro GitHub Copilot, o $
mostrado é nossa estimativa por token, não a unidade de crédito de premium request que o
GitHub de fato cobra.
Licença
O MnzAI - Token Manager é gratuito para instalar e usar, distribuído sob uma licença
proprietária — ver LICENSE. A licença autoriza explicitamente o Visual Studio
Marketplace, o Open VSX, e o uso dentro do VS Code, do Cursor e de outros editores compatíveis
com VS Code.
| |