Correção com IA no Teclado
Modelos de IA on-device do Hugging Face para correção ortográfica e predição de palavras em tempo real — 100% offline, 100% privado.
1 Visão Geral
O Kwiq integra modelos de IA on-device via ONNX Runtime para melhorar o teclado com correção ortográfica e predição de palavras em tempo real. Toda a inferência roda localmente — sem necessidade de internet após baixar o modelo.
Arquitetura
O motor de IA suporta três arquiteturas de modelo:
- ONNX Runtime — Runtime de inferência. Roda em CPU com aceleração XNNPACK. Suporta quantização INT8 e FP16 para modelos menores e mais rápidos.
- T5-SEQ2SEQ — Modelos encoder-decoder ajustados para correção de erros gramaticais (GEC). Já convertidos para ONNX com quantização INT8. Rápidos e leves (30-40 MB).
- DECODER-SLM — Modelos de linguagem compactos decoder-only. Usam prompt engineering para predição contextual. Precisam de export ONNX via optimum-cli.
- BYTE-LEVEL — Modelos byte-level que operam diretamente em bytes UTF-8 sem tokenizer. Extremamente robustos a erros de digitação.
2 Modelos Disponíveis
Os modelos são obtidos do Hugging Face Hub. O catálogo inclui várias categorias:
Correção Ortográfica (T5)
Modelos T5 ultra-leves ajustados para correção gramatical e ortográfica. Já em formato ONNX INT8, prontos para uso. 30-40 MB. Ideal para correção de erros de digitação em tempo real.
Predição de Palavras (SmolLM2)
Modelos de linguagem compactos state-of-the-art do Hugging Face. 135M-360M parâmetros. Melhor compreensão contextual. Requer export ONNX.
Byte-Level (ByT5)
Modelos ByT5 do Google que trabalham diretamente com bytes UTF-8. Sem tokenizer. Robusto a ruído e erros de encoding. Multilíngue.
Navegue e baixe modelos diretamente das Configurações do Kwiq → Teclado → Correção com IA. Cada modelo mostra tamanho, idioma suportado e se está pronto para uso.
3 Baixando Modelos
Os modelos são baixados sob demanda do Hugging Face Hub e armazenados em cache no armazenamento interno:
- Abra Configurações do Kwiq → Teclado → Correção com IA.
- Escolha um modelo do catálogo.
- Toque em Baixar. Você verá uma barra de progresso enquanto o modelo é obtido.
- Após o download, ative Correção ortográfica com IA e/ou Predição com IA.
4 Como Funciona
O pipeline de sugestões do teclado combina múltiplas fontes de dados em ordem progressiva:
Quando você digita, as sugestões são geradas nesta ordem:
- Bigramas — Pares de palavras aprendidos do seu histórico de digitação (banco Room). Mais rápido, sempre ativo.
- Prefixo — Correspondência por prefixo no dicionário (Trie + Hunspell). Encontra palavras que começam com o que você digitou.
- IA — Inferência do modelo de IA via ONNX Runtime. Fornece correções ortográficas inteligentes e predições contextuais. Score mais alto, então sugestões de IA aparecem primeiro quando ativadas.
- Levenshtein — Correções clássicas por distância de Levenshtein. Sempre disponível como fallback quando a IA está desativada ou falha.
5 Controle via MCP
Modelos de IA também podem ser gerenciados remotamente através da interface MCP (Model Context Protocol). Isso permite que assistentes de IA naveguem, baixem, selecionem e excluam modelos no seu dispositivo via clientes MCP.
Ferramentas MCP disponíveis: ai_model_list, ai_model_download, ai_model_status, ai_model_select, ai_model_delete. Acesse-as pelo Dashboard Auto-Hospedado em /mcp.