Apple-Forscher berichten über ein Skalierungsgesetz für Trainingsmodelle mit knappen Daten
Eine Studie mit mehr als 2.000 Sprachmodell-Trainingsläufen ergab, dass knappe Zieldaten in Mischungen 15 bis 20 Mal wiederholt werden können, wobei die beste Rate je nach Maßstab und Berechnung variiert.