Optimisation des Préférences au-Delà des Chatbots
Découvre l'optimisation des préférences directes pour surmonter les limitations de SFT dans l'OCR, une avancée audacieuse via DharmaAI.
Découvre l'optimisation des préférences directes pour surmonter les limitations de SFT dans l'OCR, une avancée audacieuse via DharmaAI.
Découvrez l'optimisation spectaculaire de l'inférence de BLOOM par Hugging Face, avec des améliorations de latence et de débit impressionnantes.
Découvrez Mellum2, un modèle Mixture-of-Experts de 12B paramètres par JetBrains, conçu pour des inférences rapides et fiables.
Découvrez comment StackLLaMA utilise RLHF pour optimiser les modèles LLaMA, avec des solutions de fine-tuning et des astuces mémoire.
Étrillez vos performances PyTorch grâce à Torch Profiler. Apprenez à lire et exploiter les données de traçage GPU.
Assisted Generation promet de réduire la latence des modèles de texte jusqu'à 10x. Découvre comment cette méthode change la donne.
Optimise Stable Diffusion sur CPU Intel grâce à NNCF et 🤗 Optimum pour des gains impressionnants.
Découvrez comment Core ML améliore drastiquement la vitesse de Stable Diffusion sur iPhone, iPad et Mac grâce à des techniques d'optimisation avancées.
Stable Diffusion désormais optimisable sur Intel CPUs, booste la création IA générative avec Intel AMX.
Améliore Llama 2 avec DPO pour simplifier le RLHF. Découvre comment cette méthode réduit la complexité de l'ajustement des LLMs.