Option
Heim
Nachricht
Samsungs kompaktes KI-Modell übertrifft größere Konkurrenten beim Denken

Samsungs kompaktes KI-Modell übertrifft größere Konkurrenten beim Denken

3. Dezember 2025
130

Ein neues Papier eines KI-Forschers von Samsung beschreibt, wie ein kompaktes Netzwerk bei der Bewältigung komplexer logischer Aufgaben große Sprachmodelle (LLMs) übertreffen kann.

Im Wettlauf um die Vorherrschaft der KI ist das vorherrschende Mantra der Branche "größer ist besser". Während Tech-Giganten Milliarden in die Entwicklung immer größerer Modelle investieren, schlägt Alexia Jolicoeur-Martineau von Samsung SAIL Montréal einen anderen, effizienteren Ansatz vor: das Tiny Recursive Model (TRM).

Mit nur 7 Millionen Parametern - weniger als 0,01 % der Größe der besten LLMs - erreicht TRM neue Spitzenergebnisse bei bekanntermaßen schwierigen Benchmarks wie dem ARC-AGI-Intelligenztest. Samsungs Ergebnisse stellen die weit verbreitete Annahme in Frage, dass Größe der einzige Weg ist, um KI voranzubringen, und präsentieren eine nachhaltigere und parametereffiziente Alternative.

Die Grenzen des Maßstabs überwinden

LLMs sind zwar hervorragend in der Lage, menschenähnlichen Text zu generieren, doch ihre Fähigkeit, komplexe, mehrstufige Schlussfolgerungen zu ziehen, ist oft nicht ausreichend. Da sie Antworten Token für Token generieren, kann ein Fehler zu Beginn die gesamte Lösung beeinträchtigen und zu einer falschen endgültigen Antwort führen.

Techniken wie die Chain-of-Thought, bei der ein Modell ein Problem Schritt für Schritt aufschlüsselt, sollen dies abmildern. Diese Ansätze sind jedoch sehr rechenintensiv, erfordern oft umfangreiche und qualitativ hochwertige Argumentationsdaten und können immer noch zu fehlerhafter Logik führen. Selbst mit diesen Verbesserungen haben LLMs Schwierigkeiten, Rätsel zu lösen, die eine fehlerfreie logische Ausführung erfordern.

Samsungs Forschung baut auf dem jüngsten Hierarchical Reasoning Model (HRM) auf. Das HRM verwendete zwei kleine neuronale Netze, die Antworten in unterschiedlichen Frequenzen rekursiv verfeinern. Das Modell war zwar vielversprechend, aber komplex und stützte sich auf unsichere biologische Argumente und Festpunkttheoreme, die nicht immer anwendbar waren.

Anstelle der Doppelnetzstruktur von HRM verwendet TRM ein einziges, kompaktes Netz, das sowohl seine interne Argumentation als auch seine vorgeschlagene Antwort rekursiv verbessert.

Das Modell erhält die Frage, einen anfänglichen Antwortvorschlag und ein latentes Argumentationsmerkmal. Anschließend durchläuft es mehrere Schritte, um seine Schlussfolgerungen auf der Grundlage aller drei Eingaben zu verfeinern. Mit dieser verbesserten Schlussfolgerung aktualisiert es seine endgültige Antwortvorhersage. Dieser gesamte Prozess kann sich bis zu 16 Mal wiederholen, so dass das Modell sich auf äußerst parametereffiziente Weise schrittweise selbst korrigieren kann.

Kontraintuitiv stellte die Studie fest, dass ein zweischichtiges Netz viel besser verallgemeinert als eine vierschichtige Version. Das kleinere Design scheint eine Überanpassung zu verhindern - ein häufiges Problem beim Training auf begrenzten, spezialisierten Datensätzen.

TRM beseitigt auch die komplexen mathematischen Annahmen seines Vorgängers. Das ursprüngliche HRM-Modell musste die Konvergenz der Funktion zu einem festen Punkt annehmen, um sein Training zu rechtfertigen. TRM umgeht dies, indem es den gesamten Rekursionsprozess rückwärts durchläuft - eine Änderung, die die Leistung erheblich verbessert und die Genauigkeit des Sudoku-Extreme-Benchmarks von 56,5 % auf 87,4 % in Ablationstests erhöht hat.

Samsungs Modell übertrifft KI-Benchmarks mit weniger Ressourcen

Die Ergebnisse sind beeindruckend. Auf dem Sudoku-Extreme-Datensatz, der nur 1.000 Trainingsbeispiele enthält, erreicht TRM eine Testgenauigkeit von 87,4 % - ein großer Sprung gegenüber den 55 % von HRM. Bei Maze-Hard, bei dem es darum geht, lange Pfade durch 30×30 Labyrinthe zu navigieren, erreicht TRM 85,3 %, verglichen mit 74,5 % bei HRM.

Besonders bemerkenswert ist, dass TRM beim Abstraction and Reasoning Corpus (ARC-AGI), einem Benchmark zur Bewertung echter flüssiger Intelligenz in der KI, deutliche Fortschritte macht. Mit nur 7 Millionen Parametern erreicht TRM eine Genauigkeit von 44,6 % bei ARC-AGI-1 und 7,8 % bei ARC-AGI-2. Das übertrifft HRM, das 27 Millionen Parameter verwendete, und übertrifft sogar viele der weltweit größten LLMs. Zum Vergleich: Gemini 2.5 Pro erreicht bei ARC-AGI-2 nur 4,9 %.

Der Trainingsprozess von TRM wurde ebenfalls optimiert. Ein adaptiver Mechanismus namens ACT - der bestimmt, wann das Modell eine Antwort ausreichend verbessert hat, um weiterzugehen - wurde vereinfacht, so dass bei jedem Trainingsschritt kein kostspieliger zweiter Vorwärtsdurchlauf mehr erforderlich ist. Diese Anpassung hat die Gesamtgeneralisierung nicht beeinträchtigt.

Samsungs Forschungsarbeit bildet einen starken Kontrapunkt zum Trend, immer größere KI-Modelle zu entwickeln. Sie zeigt, dass durch die Entwicklung von Architekturen, die zu iterativem Denken und Selbstkorrektur fähig sind, extrem schwierige Probleme mit nur einem winzigen Bruchteil der Rechenressourcen gelöst werden können.

Siehe auch: Googles neuer KI-Agent schreibt Code um, um die Behebung von Sicherheitslücken zu automatisieren

Möchten Sie mehr über KI und Big Data von Branchenführern erfahren? Besuchen Sie die AI & Big Data Expo in Amsterdam, Kalifornien und London. Diese umfassende Veranstaltung ist Teil der TechEx und findet parallel zu anderen großen Tech-Events wie der Cyber Security Expo statt. Klicken Sie hier für weitere Informationen.

AI News wird von TechForge Media unterstützt. Weitere Veranstaltungen und Webinare zu Unternehmenstechnologien finden Sie hier.

Verwandter Artikel
Ollie setzt auf Datenschutz, um das Rennen um den KI-Assistenten zu gewinnen Ollie setzt auf Datenschutz, um das Rennen um den KI-Assistenten zu gewinnen Um wirklich hilfreich zu sein, muss ein KI-Assistent seinen Nutzer genau verstehen. Ollie, ein für den Alltag konzipierter persönlicher Assistent, basiert auf der Prämisse, dass dies nicht mit der Wei
So wird die „AI LIVE: London“ KI und industrielle Automatisierung beleuchten So wird die „AI LIVE: London“ KI und industrielle Automatisierung beleuchten Auf dem Gipfel werden Führungskräfte der obersten Ebene aus aller Welt zusammenkommen, um dringende Herausforderungen in globalen Branchen zu erörtern – von KI-getriebenen Umbrüchen bis hin zu wirtsch
Anthropic tritt in den Markt für KI-gestützte Rechtstechnologie ein, während der Wettbewerb zunimmt Anthropic tritt in den Markt für KI-gestützte Rechtstechnologie ein, während der Wettbewerb zunimmt Anthropic hat am Dienstag eine Reihe neuer Chatbot-Funktionen vorgestellt, die darauf abzielen, Rechtsanwaltskanzleien automatisierte Unterstützung zu bieten. Diese Verbesserungen erweitern die bereits zu Jahresbeginn eingeführte, mandantenspezifisch
Empfehlungen zu verwandten Spezialthemen
Bildung und Lernen KI-Lernhilfen für Hausaufgaben und Prüfungsvorbereitung
KI-Lernhilfen für Hausaufgaben und Prüfungsvorbereitung

Die besten KI-Lernhilfen für Hausaufgaben und Prüfungsvorbereitung im Jahr 2026! XIX.AI hat eine Liste der besten leistungsstarken, bahnbrechenden Tools zusammengestellt, die Schülern helfen, ihre Produktivität zu steigern, Hausaufgaben effizienter zu erledigen und Prüfungen dank praxisnaher Tests mit Bravour zu meistern. Erhalten Sie einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten, detaillierte Rankings und unverzichtbare Optionen, um Ihren KI-Vorteil zu nutzen. Entdecken Sie es jetzt!

10 Tools
xix.ai
Musikkomposition KI-Stimm-Demo-Tools für Songwriter, Hooks, Toplines und mehrsprachige Entwurfs-Sessions
KI-Stimm-Demo-Tools für Songwriter, Hooks, Toplines und mehrsprachige Entwurfs-Sessions

2026 Neueste und beste KI-Stimm-Demo-Tools für Songwriter, Hook-Ersteller und mehrsprachige Content-Teams! XIX.AI hat eine hochbewertete Liste leistungsstarker, bahnbrechender Tools zusammengestellt, die strengen Praxistests unterzogen wurden. Sie finden detaillierte Vergleichsdaten zu kostenlosen und kostenpflichtigen Optionen, umfassende Rankings und empfehlenswerte Auswahlmöglichkeiten, die Ihnen helfen, Ihre Schreibeffizienz zu steigern und Ihr kreatives Potenzial zu entfalten. Entdecken Sie jetzt das perfekte Tool für all Ihre Content-Bedürfnisse!

9 Tools
xix.ai
Geschäft Die besten KI-Tools zur Wettbewerbsanalyse für kleine Unternehmen
Die besten KI-Tools zur Wettbewerbsanalyse für kleine Unternehmen

Die besten und am besten bewerteten KI-Tools für die Wettbewerbsanalyse für kleine Unternehmen im Jahr 2026! XIX.AI hat eine äußerst leistungsstarke, bahnbrechende Auswahl zusammengestellt, die wöchentlich anhand strenger Praxistests und detaillierter Rankings aktualisiert wird. Hier finden Sie einen umfassenden Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten, der Ihnen dabei hilft, die unverzichtbaren Tools zu identifizieren, die Ihre Produktivität steigern und Ihnen einen Wettbewerbsvorteil verschaffen. Entdecken Sie jetzt das perfekte Tool für sich!

9 Tools
xix.ai
Bildbearbeitung Photoshop-KI-Retuschierungstools für E-Commerce-Bekleidung, Hautbereinigung und Farbkonstanz
Photoshop-KI-Retuschierungstools für E-Commerce-Bekleidung, Hautbereinigung und Farbkonstanz

2026 Neueste beste Photoshop-KI-Retuschierungstools für E-Commerce-Bekleidung, Hautbereinigung und Farbkonsistenz! Diese hoch bewertete kuratierte Liste bietet leistungsstarke, bahnbrechende Lösungen, die Ihnen helfen, die Schreibeffizienz zu steigern, die Content-Erstellung zu optimieren und mühelos perfekte visuelle Ergebnisse zu erzielen. Jedes Tool wurde durch wöchentlich aktualisierte Rankings mit echten Tests geprüft, einschließlich detaillierter Vergleiche zwischen kostenlosen und kostenpflichtigen Versionen. Unterstützt von XIX.AI ist es der unverzichtbare Leitfaden für alle, die ihre KI-Vorteile nutzen möchten. Jetzt entdecken!

10 Tools
xix.ai
Prompt Die besten KI-Prompt-Bibliotheken für ChatGPT-Workflows
Die besten KI-Prompt-Bibliotheken für ChatGPT-Workflows

Die besten und am besten bewerteten KI-Prompt-Bibliotheken des Jahres 2026 zur Optimierung aller Arten von ChatGPT-Workflows. XIX.AI hat eine leistungsstarke, bahnbrechende Sammlung zusammengestellt, die strengen Praxistests unterzogen wird, um Spitzenleistung zu gewährleisten. Hier finden Sie detaillierte Vergleiche zwischen kostenlosen und kostenpflichtigen Angeboten sowie Experten-Rankings, die Ihnen dabei helfen, die unverzichtbaren Tools auszuwählen, mit denen Sie Ihre Produktivität steigern und Ihren KI-Vorteil ausschöpfen können. Entdecken Sie sie jetzt!

11 Tools
xix.ai
Bildung und Lernen AI Quiz Builder Plattformen für Lehrer, Nachhilfelehrer und kohortenbasierte Lernprogramme
AI Quiz Builder Plattformen für Lehrer, Nachhilfelehrer und kohortenbasierte Lernprogramme

2026 Neueste und beste KI-Quiz-Erstellungstools für Lehrer, Nachhilfelehrer und kohortenbasierte Lernprogramme! XIX.AI hat eine hochbewertete Liste leistungsstarker, bahnbrechender Tools zusammengestellt, die realen Tests unterzogen wurden, um genaue Rankings zu liefern. Diese unbedingt auszuprobierenden Plattformen helfen dabei, die Schreibeffizienz zu steigern, die Inhaltserstellung zu optimieren und das Quiz-Design in allen Lernszenarien zu vereinfachen. Entdecken Sie jetzt Ihr perfektes Tool, um Ihren KI-Vorteil im Unterricht voll auszuschöpfen!

13 Tools
xix.ai
Kommentare (0)
0/500
OR