Als nächstesNächster Leitfaden
CI/CD für maschinelles Lernen
Technisch
Technischer Leitfaden
Föderiertes Lernen trainiert ein gemeinsames Modell über viele Geräte oder Organisationen hinweg, ohne deren Rohdaten an einem Ort zu sammeln.
Only model updates travel to the server, so the sensitive data stays where it lives.
Im normalen Training werden alle Daten auf zentralen Servern gebündelt. Durch föderiertes Lernen wird dies umgekehrt: Ein globales Modell wird an die Teilnehmer (Telefone, Krankenhäuser, Banken) gesendet, jeder trainiert lokal anhand seiner eigenen Daten und nur die daraus resultierenden Gewichtsänderungen werden zurückgesendet. Der Server mittelt diese Aktualisierungen in ein verbessertes globales Modell und wiederholt sie. Google stellte die Idee für Gboard vor und verbesserte Tastaturvorhersagen von Millionen von Telefonen, ohne die Eingaben der Leute hochzuladen. Der Ansatz glänzt dort, wo Daten privat, reguliert oder zu umfangreich sind, um sie zu übertragen, wie etwa bei über Krankenhäuser verteilten Gesundheitsakten. Zu den Herausforderungen gehören unzuverlässige Geräte, Daten, die sich zwischen den Teilnehmern stark unterscheiden (Nicht-IID-Daten) und die Tatsache, dass Rohaktualisierungen immer noch Informationen preisgeben können, weshalb sie mit Datenschutztechniken kombiniert werden.
Architekturentscheidungen beeinflussen über Jahre hinweg die Leistung und die Betriebskosten.
Technische Schulungen helfen Teams dabei, den richtigen Stack auszuwählen, nicht nur den neuesten.
Bessere technische Entscheidungen reduzieren Zuverlässigkeitsvorfälle in der Produktion.
Föderiertes Lernen verlagert sich von der Tastatur zur organisationsübergreifenden Nutzung im Gesundheitswesen, im Finanzwesen und im IoT, wo Vorschriften wie HIPAA und DSGVO die Zusammenführung von Daten erschweren. Erwarten Sie eine engere Integration mit differenziertem Datenschutz und sicherer Aggregation sowie Frameworks wie TensorFlow Federated, Flower und NVIDIA FLARE, die für die Produktion ausgereift sind. Eine wachsende Herausforderung ist die gemeinsame Feinabstimmung großer Sprachmodelle, die es Organisationen ermöglicht, gemeinsam ein Modell für vertrauliche Texte zu verbessern. Ein besserer Umgang mit ungleich verteilten und unzuverlässigen Teilnehmern bleibt der wichtigste Forschungsanstoß.
Google Gboard verbessert die Vorhersage von nächsten Wörtern und Emojis auf allen Telefonen, ohne dass Tastenanschläge hochgeladen werden müssen.
Krankenhäuser schulen gemeinsam diagnostische Bildgebungsmodelle, ohne geschützte Patientendaten weiterzugeben.
Banken arbeiten an Betrugserkennungsmodellen zusammen und halten gleichzeitig die Transaktionen jedes Instituts vertraulich.
Apple personalisiert Funktionen auf dem Gerät wie QuickType und Siri-Vorschläge mithilfe von lokalem Lernen.
Die Optimierung eines Benchmarks kann umfassendere Systemschwächen verbergen.
Infrastruktur- und Wartungskosten werden oft unterschätzt.
Sicherheits- und Beobachtbarkeitslücken können größer werden, wenn die Systeme komplexer werden.
Definieren Sie vor der Implementierung Latenz-, Qualitäts- und Kostenziele.
Benchmark unter realistischen Last- und Datenbedingungen.
Instrumentenüberwachung auf Fehler, Drift und Benutzereinflüsse.
Bereiten Sie vor der Skalierung Rollback- und Incident-Response-Pfade vor.
Free newsletter
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Föderiertes Lernen trainiert ein gemeinsames Modell über viele Geräte oder Organisationen hinweg, ohne deren Rohdaten an einem Ort zu sammeln. Nur Modellaktualisierungen werden auf den Server übertragen, sodass die sensiblen Daten dort bleiben, wo sie gespeichert sind.
Durch föderiertes Lernen bleiben Rohdaten lokal; Jeder Teilnehmer trainiert anhand seiner eigenen Daten und sendet nur Modellaktualisierungen, die der Server kombiniert.
FedAvg kombiniert die lokal trainierten Gewichtungen der Kunden in einem einzigen verbesserten globalen Modell und gewichtet in der Regel jeden Kunden danach, wie viele Daten er verwendet hat.
Google nutzte föderiertes Lernen in Gboard, um Textvorhersagen von Millionen von Telefonen zu verbessern, ohne zu erfassen, was Benutzer eingegeben haben.
Gesundheitsdaten sind privat und reguliert, daher passt es viel besser zu Gesetzen wie HIPAA, sie lokal zu halten und gleichzeitig ein gemeinsames Modell aufzubauen, als sie zu bündeln.
Farbverläufe und Gewichtsänderungen können Details zu Trainingsbeispielen offenbaren, weshalb sichere Aggregation und differenzielle Privatsphäre hinzugefügt werden.
Lerne weiter
Weitere Leitfäden zu diesem Thema ausgewählt
Als nächstesNächster Leitfaden
CI/CD für maschinelles Lernen
Technisch