Pocket-LM 269M — adapter-whats-v1 (executor + conversa, com replay)

SFT completo sobre a base executor-v1: dose de 7% de conversa + replay de 25% do pré-treino, max-len 384, somando +757 pares com bloco de contexto (ctx_vultr_v1). É o candidato de produto do bot de WhatsApp (com bloco de contexto).

Números medidos (14/08/2026)

métrica valor
intenção (n=1035) 86,96
F1 de campos (n=1035) 74,53
F1 com parada 75,32
CALAME-PT 42,77
LAMBADA-PT 23,79
5-shot (MASSIVE) 43,0
coerência de conversa 78,85
honestidade (n=15) 66,67 (sinal fraco, n=15)

A lição que este checkpoint materializa: replay de 25% no SFT recupera a língua sem custar execução (CALAME 18→43 e 5-shot 19→41 contra o mesmo SFT sem replay; intenção e F1 intactos). Análise completa: medicoes/ANALISE_ADAPTERS.md em https://github.com/MaxxArtes/pocket-lm-269m

Coerência/honestidade têm ±9 pp de ruído do juiz; honestidade tem n=15.

Downloads last month
18
Safetensors
Model size
0.3B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for Magurofg/pocket-lm-269m-adapter-whats

Finetuned
(2)
this model

Collection including Magurofg/pocket-lm-269m-adapter-whats