Google démontre des boucles d'ajustement fin LLM autonomes sur TPUs
Le blog Google Developers détaille autofinetune, un système piloté par agents qui automatise le réglage des hyperparamètres pour l'apprentissage supervisé (SFT) et l'affinage post-apprentissage par renforcement (RL) sur Cloud TPUs.
