MedQA : Fine-tuning d'une IA médicale sur AMD ROCm
Rédigé à partir de la source originale; chaque fait est vérifié contre le texte source.
Que faut-il retenir ?
- MedQA utilise le modèle Qwen3-1.7B fine-tuné avec LoRA sur AMD MI300X.
- Le modèle a été entraîné sur 2 000 échantillons de MedMCQA en 5 minutes.
- AMD MI300X dispose de 192 Go de mémoire HBM3, permettant un entraînement en fp16 sans quantification.
- Seulement 2,2 millions de paramètres sur 1,5 milliard sont entraînés avec LoRA.
Pourquoi cette nouvelle compte-t-elle ?
MedQA démontre qu'il est possible de fine-tuner un modèle IA médical efficace sans dépendre de CUDA, ouvrant des possibilités pour les utilisateurs de matériel AMD. Cela réduit les coûts et augmente l'accessibilité des technologies IA en santé.
Public concerné : développeurs, entreprises
Comment MedQA fonctionne-t-il sans CUDA ?
MedQA utilise ROCm d'AMD pour fine-tuner le modèle Qwen3-1.7B avec LoRA, sans nécessiter de dépendance CUDA, grâce à des variables d'environnement spécifiques.