Pressione o200k_base ou cl100k_base para contar tokens de texto e verifique o ponto de código Unicode, a contagem de bytes UTF-8 e o ID do token ao mesmo tempo. Adequado para comparar comprimentos de texto sem passar os resultados como modelos de faturas.
Texto bruto de estatísticas por codificação selecionada, não um resultado universal para todos os modelos, nem uma conta. Wrappers de bate-papo, definições de ferramentas, imagens e prompts ocultos não contam. A tabela de segmentação de palavras pode demorar um pouco para carregar pela primeira vez.
Caracteres 20 / 20,000
Tecla de atalho: Ctrl/⌘+Enter. Modificar entradas ou opções limpa resultados antigos.
Os limites de segmentação de palavras de diferentes textos e diferentes codificações podem ser diferentes, e uma proporção fixa de contagem de palavras não pode ser usada para substituir a segmentação de palavras real.
Somente o texto original inserido é contado aqui, e embalagens de bate-papo, definições de ferramentas, imagens, prompts ocultos ou conteúdo de saída não são incluídos. O faturamento real é baseado no uso retornado pelo provedor de serviços.
Não. Idioma, espaçamento, pontuação e código afetam a segmentação de palavras. Quando a lista de IDs exceder 200, apenas os primeiros 200 serão exibidos, mas o número total de Tokens ainda será contado e inserido completamente.
Use a codificação o200k_base ou cl100k_base do gpt-tokenizer para tokenizar texto simples, exibindo o número de pontos de código e o número de bytes UTF-8. Não inclui uso adicional para pacotes de chat, imagens ou chamadas de ferramentas.
Verificação de conteúdo:2026-09-08 · Sobre este site e descrição do conteúdo