CoolFace
Modelpublic

augustaklug/bertimbau-large-lener_br-onnx

sourceHugging Facemitupdated 23d agoView on Hugging Face
0likes139downloads
Model Card

BERTimbau-large LeNER-Br — ONNX FP16 para WebGPU

Conversão FP16, sem fusões proprietárias, do arquivo onnx/model.onnx publicado em `rchuluc/bertimbau-large-lener_br-onnx`. O checkpoint original é `Luciano/bertimbau-large-lener_br`.

O modelo reconhece seis categorias do corpus LeNER-Br: ORGANIZACAO, PESSOA, TEMPO, LOCAL, LEGISLACAO e JURISPRUDENCIA.

Arquivo

dtypeArquivoTamanho aproximado
FP16onnx/model_fp16.onnx636,5 MiB

O nome do arquivo segue a convenção do Transformers.js para dtype: "fp16".

Origem e conversão

  • —Repositório ONNX de origem: rchuluc/bertimbau-large-lener_br-onnx
  • —Revisão fixada: 110f94773a712371a92e10e1edf39f3418d0a54c
  • —SHA-256 do FP32 de origem: dd368d9dc3747c81f4adb5cf74b96abb0aab8d2028623c66d848c0a57d6161b9
  • —SHA-256 do FP16: 8e790d238d2ac83b93dc371859dec2e319ca15b050181ac01ac6f855ac04f20f
  • —ONNX opset: 14
  • —Conversor: onnxruntime.transformers.float16.convert_float_to_float16
  • —keep_io_types=True
  • —Inferência de formas habilitada
  • —Nenhuma otimização ou fusão de Transformer aplicada

Validação

  • —onnx.checker.check_model: aprovado para FP32 e FP16.
  • —Grafo FP16: 2.439 nós, todos no domínio ONNX padrão.
  • —Inicializadores: 391 FLOAT16 e zero FLOAT.
  • —Operadores fundidos Attention, BiasGelu e SkipLayerNormalization: zero.
  • —Paridade em dez frases jurídicas: 160/160 tokens com o mesmo argmax entre FP32 e FP16.
  • —Erro absoluto dos logits: máximo 0.00992024, médio 0.000482765.

A validação no ONNX Runtime não substitui o teste no WebGPU do navegador.

Transformers.js

javascript
import { pipeline } from '@huggingface/transformers';

const ner = await pipeline(
  'token-classification',
  'augustaklug/bertimbau-large-lener_br-onnx',
  { device: 'webgpu', dtype: 'fp16' },
);

O modelo aceita no máximo 512 tokens. Textos maiores devem ser truncados ou divididos em chunks com sobreposição.