LoRA

4 posts encontrados

Imagem do post

Como o LoRA especializa IAs gigantes em um computador comum (vídeo)

Vídeo de pouco mais de um minuto que mostra como o LoRA congela o modelo original e treina só um adaptador minúsculo...

Imagem do post

Fine-tuning de LLMs com LoRA e QLoRA: guia atualizado com TRL, PEFT e Unsloth

Aprenda a ajustar um LLM com LoRA e QLoRA usando as versões atuais de Transformers 5, PEFT, TRL 1.x e bitsandbytes...

Imagem do post

GRPO encontra LoRA: Hugging Face torna o treinamento por reforço assíncrono acessível até em hardwares modestos

Treinamento assíncrono com LoRA amplia uso de GRPO em modelos de linguagem na Hugging Face A Hugging Face publicou em...

Imagem do post

IA Alinhada ou Enviesada? Como Auditar Preferências e Ajustar Modelos de Linguagem com DPO, TRL e LoRA

Auditoria de Vieses de Preferência e Ajuste Fino de Modelos de Linguagem com Otimização Direta de Preferências usando...