augustaklug/bertimbau-large-lener_br-onnx
0139
BERTimbau-large LeNER-Br — ONNX FP16 para WebGPU
Conversão FP16, sem fusões proprietárias, do arquivo onnx/model.onnx publicado em `rchuluc/bertimbau-large-lener_br-onnx`. O checkpoint original é `Luciano/bertimbau-large-lener_br`.
O modelo reconhece seis categorias do corpus LeNER-Br: ORGANIZACAO, PESSOA, TEMPO, LOCAL, LEGISLACAO e JURISPRUDENCIA.
Arquivo
O nome do arquivo segue a convenção do Transformers.js para dtype: "fp16".
Origem e conversão
- Repositório ONNX de origem:
rchuluc/bertimbau-large-lener_br-onnx - Revisão fixada:
110f94773a712371a92e10e1edf39f3418d0a54c - SHA-256 do FP32 de origem:
dd368d9dc3747c81f4adb5cf74b96abb0aab8d2028623c66d848c0a57d6161b9 - SHA-256 do FP16:
8e790d238d2ac83b93dc371859dec2e319ca15b050181ac01ac6f855ac04f20f - ONNX opset: 14
- Conversor:
onnxruntime.transformers.float16.convert_float_to_float16 keep_io_types=True- Inferência de formas habilitada
- Nenhuma otimização ou fusão de Transformer aplicada
Validação
onnx.checker.check_model: aprovado para FP32 e FP16.- Grafo FP16: 2.439 nós, todos no domínio ONNX padrão.
- Inicializadores: 391
FLOAT16e zeroFLOAT. - Operadores fundidos
Attention,BiasGelueSkipLayerNormalization: zero. - Paridade em dez frases jurídicas: 160/160 tokens com o mesmo
argmaxentre FP32 e FP16. - Erro absoluto dos logits: máximo
0.00992024, médio0.000482765.
A validação no ONNX Runtime não substitui o teste no WebGPU do navegador.
Transformers.js
import { pipeline } from '@huggingface/transformers';
const ner = await pipeline(
'token-classification',
'augustaklug/bertimbau-large-lener_br-onnx',
{ device: 'webgpu', dtype: 'fp16' },
);O modelo aceita no máximo 512 tokens. Textos maiores devem ser truncados ou divididos em chunks com sobreposição.
