Option
Heim
Nachricht
3 Wege Metas Lama 3.1 ist ein Fortschritt für Gen Ai

3 Wege Metas Lama 3.1 ist ein Fortschritt für Gen Ai

15. April 2025
247

3 Wege Metas Lama 3.1 ist ein Fortschritt für Gen Ai

Am Dienstag stellte Meta die neueste Ergänzung zur Llama-Familie großer Sprachmodelle (LLMs) vor: Llama 3.1. Das Unternehmen bezeichnet Llama 3.1 stolz als das erste Open-Source-"Frontiermodell", ein Begriff, der üblicherweise für die fortschrittlichsten KI-Modelle verwendet wird.

Llama 3.1 gibt es in verschiedenen Größen, aber das riesige "405B" sticht besonders hervor. Mit beeindruckenden 405 Milliarden neuronalen "Gewichten" oder Parametern übertrifft es andere bekannte Open-Source-Modelle wie Nvidias Nemotron 4, Googles Gemma 2 und Mixtral. Besonders faszinierend sind die drei zentralen Entscheidungen des Meta-Teams bei der Entwicklung dieses Giganten.

Diese Entscheidungen sind ein Meisterwerk der neuronalen Netzwerktechnik und bilden das Rückgrat für den Aufbau und das Training von Llama 3.1 405B. Sie bauen auf den Effizienzgewinnen auf, die Meta mit Llama 2 demonstriert hat, das vielversprechende Wege zeigte, um das gesamte Rechenbudget für Deep Learning zu reduzieren.

Erstens verzichtet Llama 3.1 405B auf den "Mixture of Experts"-Ansatz, den Google für sein geschlossenes Gemini 1.5 und Mistral für Mixtral verwendet. Diese Methode umfasst das Erstellen verschiedener Kombinationen neuronaler Gewichte, von denen einige deaktiviert werden können, um Vorhersagen zu optimieren. Stattdessen hielten die Meta-Forscher an der bewährten "Decoder-only-Transformer-Modellarchitektur" fest, die seit ihrer Einführung durch Google im Jahr 2017 ein Standard ist. Sie behaupten, dass diese Wahl zu einem stabileren Trainingsprozess führt.

Zweitens entwickelte das Meta-Team einen cleveren mehrstufigen Trainingsansatz, um die Leistung dieses einfachen Transformer-basierten Modells zu steigern. Es ist bekannt, dass die Balance zwischen Trainingsdatenmenge und Rechenleistung die Vorhersagequalität erheblich beeinflusst. Aber traditionelle "Skalierungsgesetze", die die Modellleistung basierend auf Größe und Daten vorhersagen, spiegeln nicht unbedingt wider, wie gut ein Modell bei "nachgelagerten" Aufgaben wie logischen Tests abschneidet.

Daher entwickelte Meta ein eigenes Skalierungsgesetz. Sie steigerten sowohl die Trainingsdaten als auch die Rechenleistung und testeten verschiedene Kombinationen über mehrere Iterationen hinweg, um zu sehen, wie gut das resultierende Modell bei diesen entscheidenden nachgelagerten Aufgaben abschnitt. Dieser sorgfältige Prozess half ihnen, den optimalen Punkt zu finden, was zur Wahl von 405 Milliarden Parametern für ihr Flaggschiffmodell führte. Das endgültige Training wurde von 16.000 Nvidia H100 GPU-Chips auf Metas Grand Teton AI-Server angetrieben, mit einem komplexen System zur parallelen Verarbeitung von Daten und Gewichten.

Die dritte Innovation liegt in der Nach-Trainings-Phase. Nach jeder Trainingsrunde durchläuft Llama 3.1 einen strengen Prozess, der von menschlichem Feedback geleitet wird, ähnlich wie es OpenAI und andere tun, um die Ausgaben ihrer Modelle zu verfeinern. Dies umfasst "überwachtes Feintuning", bei dem das Modell lernt, zwischen erwünschten und unerwünschten Ausgaben basierend auf menschlichen Präferenzen zu unterscheiden.

Meta fügt dann eine Besonderheit hinzu mit "direkter Präferenzoptimierung" (DPO), einer effizienteren Version des verstärkenden Lernens durch menschliches Feedback, die dieses Jahr von KI-Wissenschaftlern der Stanford University entwickelt wurde. Sie trainieren Llama 3.1 auch, "Werkzeuge" wie externe Suchmaschinen zu nutzen, indem sie Beispiele für Aufforderungen zeigen, die mit API-Aufrufen gelöst wurden, was seine "Zero-Shot"-Werkzeugnutzungsfähigkeiten verbessert.

Um "Halluzinationen" zu bekämpfen, kuratiert das Team spezifische Trainingsdaten und erstellt originale Frage-Antwort-Paare, um das Modell so zu optimieren, dass es nur das beantwortet, was es weiß, und ablehnt, was es nicht sicher weiß.

Während der Entwicklung betonten die Meta-Forscher Einfachheit und stellten fest, dass hochwertige Daten, Skalierung und unkomplizierte Ansätze durchweg die besten Ergebnisse lieferten. Trotz der Erkundung komplexerer Architekturen und Trainingsmethoden stellten sie fest, dass die zusätzliche Komplexität die Vorteile nicht rechtfertigte.

Die Größe von Llama 3.1 405B ist ein Meilenstein für Open-Source-Modelle, die normalerweise von ihren kommerziellen, geschlossenen Pendants übertrumpft werden. Metas CEO, Mark Zuckerberg, betonte die wirtschaftlichen Vorteile und wies darauf hin, dass Entwickler Inferenz mit Llama 3.1 405B zu halben Kosten im Vergleich zu Modellen wie GPT-4o durchführen können.

Zuckerberg setzte sich auch für Open-Source-KI ein und verglich sie mit der Entwicklung von Unix von proprietär zu einem fortschrittlicheren, sichereren und breiteren Ökosystem dank Open-Source-Entwicklung.

Wie jedoch Steven Vaughan-Nichols von ZDNET anmerkt, fehlen einige Details in Metas Code-Veröffentlichung auf Hugging Face, und die Codelizenz ist restriktiver als typische Open-Source-Lizenzen. Obwohl Llama 3.1 also gewissermaßen Open Source ist, ist es nicht vollständig so. Dennoch ist das hohe Maß an Details über den Trainingsprozess eine erfrischende Abwechslung, besonders wenn Riesen wie OpenAI und Google zunehmend zurückhaltend über ihre geschlossenen Modelle sind.

Verwandter Artikel
OpenAI lockt Wall-Street-Banker mit hohen Gehältern und Anteilen, um das Finanzwesen neu zu gestalten OpenAI lockt Wall-Street-Banker mit hohen Gehältern und Anteilen, um das Finanzwesen neu zu gestalten OpenAI intensiviert sein Engagement im Investmentbanking, wobei aktuelle Stellenanzeigen darauf hindeuten, dass nach Investmentfachleuten mit mehr als zwei Jahren Berufserfahrung gesucht wird, die als „Fachexperte“ in das angewandte KI-Team von OpenA
Fünf Ministerien starten den „KI-plus-Bildungsplan“, um KI-gestützte MOOCs in allen akademischen Phasen zu entwickeln. Fünf Ministerien starten den „KI-plus-Bildungsplan“, um KI-gestützte MOOCs in allen akademischen Phasen zu entwickeln. Am 10. April veröffentlichten das Bildungsministerium, die Nationale Entwicklungs- und Reformkommission, das Ministerium für Industrie und Informationstechnologie, das Ministerium für Wissenschaft und Technologie sowie die Nationale Datenverwaltung g
ByteDances Seed startet globale Campus-Werbung und bietet virtuelle Aktien, um Top-Talente für große Modelle zu gewinnen ByteDances Seed startet globale Campus-Werbung und bietet virtuelle Aktien, um Top-Talente für große Modelle zu gewinnen Im wettbewerbsintensiven Umfeld der großen Sprachmodelle bleibt die Sicherung erstklassiger Talente das wichtigste strategische Asset.Am 1. April ByteDance gab die Einführung seiner globalen Campus-Rekrutierungsinitiative Seed bekannt, die Teil seine
Empfehlungen zu verwandten Spezialthemen
Datenanalyse Die besten KI-Tools für die Datenanalyse in Excel und SQL
Die besten KI-Tools für die Datenanalyse in Excel und SQL

2026 Neueste Besten Top-bewerteten KI-Datenanalyse-Tools für Excel und SQL sind hier auf XIX.AI! Unsere kuratierte Liste umfasst leistungsstarke, bahnbrechende Lösungen, die Ihnen helfen, die Datenverarbeitung zu beschleunigen, die Produktivität zu steigern und Analyseherausforderungen zu bewältigen. Wir haben reale Tests durchgeführt, um genaue Rankings auf der Grundlage von Leistung, Benutzerfreundlichkeit und Wert zu liefern. Entdecken Sie jetzt das Tool, das perfekt zu Ihren Anforderungen passt, und nutzen Sie Ihren KI-Vorteil in der Datenarbeit.

10 Tools
xix.ai
Text-zu-Sprache KI-Podcast-Tools zum Klonen von Stimmen für längere Episoden, Moderatorenwerbung und Audiokurse
KI-Podcast-Tools zum Klonen von Stimmen für längere Episoden, Moderatorenwerbung und Audiokurse

Hier finden Sie die besten und am besten bewerteten KI-Tools zum Klonen von Stimmen für lange Podcast-Folgen, Moderatorenwerbung und Audiokurse aus dem Jahr 2026. Diese leistungsstarken, bahnbrechenden Lösungen werden in der Praxis getestet, um ihre Zuverlässigkeit zu gewährleisten. Hier finden Sie einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten sowie detaillierte Rankings. XIX.AI bietet eine Auswahl an Tools, die Sie unbedingt ausprobieren sollten und die Ihre Produktivität erheblich steigern. Entdecken Sie jetzt das für Sie perfekte Tool und nutzen Sie Ihren KI-Vorteil.

9 Tools
xix.ai
Design & Kunst KI-basierte Tools zur Referenzierung visueller Stile für Charakterbeschreibungen, Moodboards und Pitch-Präsentationen
KI-basierte Tools zur Referenzierung visueller Stile für Charakterbeschreibungen, Moodboards und Pitch-Präsentationen

Die besten KI-Tools für visuelle Stile im Jahr 2026 – für Charakterbögen, Moodboards und Pitch-Decks – finden Sie hier auf XIX.AI! Diese sorgfältig zusammengestellte Liste der bestbewerteten Tools enthält leistungsstarke, bahnbrechende Lösungen, die strengen Praxistests unterzogen wurden. Hier finden Sie einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten, detaillierte Rankings sowie Optionen, die Sie unbedingt ausprobieren sollten, um Ihre Kreativität zu steigern und Ihren Arbeitsablauf zu optimieren. Stöbern Sie jetzt und entdecken Sie das perfekte Tool zur Steigerung Ihrer Produktivität!

11 Tools
xix.ai
SEO Die besten KI-Tools zur SERP-Analyse für die Suchstrategie
Die besten KI-Tools zur SERP-Analyse für die Suchstrategie

Die besten und am besten bewerteten KI-Tools zur SERP-Analyse für Suchstrategien im Jahr 2026 wurden von XIX.AI anhand strenger Praxistests und wöchentlich aktualisierter Rankings zusammengestellt. Diese leistungsstarken Tools helfen Ihnen dabei, verborgene Optimierungsmöglichkeiten aufzudecken, die Performance Ihrer Inhalte zu steigern und sich einen Wettbewerbsvorteil in der Suche zu verschaffen. Entdecken Sie noch heute das perfekte Tool, um Ihre Suchstrategie auf ein neues Niveau zu heben. Jetzt entdecken!

13 Tools
xix.ai
Datenanalyse Die besten KI-Tools zur Erkennung von Anomalien für das KPI-Monitoring in SaaS- und E-Commerce-Teams
Die besten KI-Tools zur Erkennung von Anomalien für das KPI-Monitoring in SaaS- und E-Commerce-Teams

2026 Neueste Besten Top-bewertete KI-Anomalienerkennungstools für KPI-Monitoring in SaaS- und E-Commerce-Teams! XIX.AI hat eine leistungsstarke, bahnbrechende Sammlung basierend auf strengen realen Tests und wöchentlich aktualisierten Rankings zusammengestellt. Sie finden detaillierte kostenlose vs. kostenpflichtige Vergleichsinsights, die Ihnen helfen, die unbedingt auszuprobierende Lösung zu identifizieren, die die Produktivität steigert und Ihre KI-Vorteile freischaltet. Jetzt erkunden!

10 Tools
xix.ai
Schreiben Die besten KI-Generatoren für Gliederungen von langen SEO-Artikeln
Die besten KI-Generatoren für Gliederungen von langen SEO-Artikeln

Die besten und am besten bewerteten KI-Outline-Generatoren für lange SEO-Artikel im Jahr 2026, sorgfältig zusammengestellt von XIX.AI. Diese leistungsstarken Tools bieten bahnbrechende Unterstützung bei der schnellen Erstellung hochwertiger Inhalte und steigern die Effizienz beim Schreiben erheblich. Erhalten Sie einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten sowie Praxistests und detaillierte Rankings, damit Sie die für Sie passende Option finden, die Sie unbedingt ausprobieren sollten. Entdecken Sie jetzt die Möglichkeiten und sichern Sie sich Ihren KI-Vorteil.

8 Tools
xix.ai
Kommentare (27)
0/500
DavidRodriguez
DavidRodriguez 30. August 2025 18:30:32 MESZ

Interessant, dass Meta Llama 3.1 als erstes Open-Source-Modell bezeichnet. Aber wer kann so ein riesiges Modell eigentlich sinnvoll nutzen? Für kleine Unternehmen bestimmt zu teuer im Betrieb. 🧐

ThomasBaker
ThomasBaker 31. Juli 2025 03:41:20 MESZ

Wow, Llama 3.1 sounds like a game-changer! Open-source and frontier-level? That’s huge for AI devs. Curious how it stacks up against closed models like GPT-4. 😎

AlbertThomas
AlbertThomas 22. April 2025 17:18:49 MESZ

O Llama 3.1 é incrível! Adoro que seja de código aberto, é como ter um superpoder no meu arsenal de programação. No começo pode ser um pouco confuso, mas vale a pena experimentar se você gosta de IA! 🚀

GaryGonzalez
GaryGonzalez 22. April 2025 10:13:48 MESZ

ラマ3.1は本当にすごい!オープンソースで使えるのが最高です。最初は少し圧倒されましたが、慣れると便利です。AIに興味があるなら、ぜひ試してみてください!🚀

AnthonyPerez
AnthonyPerez 22. April 2025 09:26:53 MESZ

¡Llama 3.1 es una bestia! Me encanta que sea de código abierto, es como tener un superpoder en mi arsenal de programación. Al principio puede ser un poco abrumador, pero definitivamente vale la pena probarlo si te interesa la IA! 🚀

JustinAnderson
JustinAnderson 20. April 2025 23:42:32 MESZ

¡Llama 3.1 de Meta es una maravilla! Me sorprende cómo están empujando los límites con la IA de código abierto. El rendimiento es genial, pero desearía que hubiera más documentación para principiantes. De todas formas, ¡es una herramienta que hay que probar! 💪

OR