Heim
Der „1.3B Model Dimension Reduction Attack“ von MiniCPM-V 4.6 setzt neue Maßstäbe in der multimodalen Edge-Technologie
Am 11. Mai stellte Mingshi Intelligence gemeinsam mit der Tsinghua-Universität und der Open-Source-Community OpenBMB das neue multimodale Großmodell MiniCPM-V4.6 für den Einsatz am Edge vor. Trotz seiner kompakten Größe – nur 1,3 Milliarden Parameter – setzt dieses schlanke Modell durch seine außergewöhnliche intelligente Dichte und plattformübergreifende Anpassungsfähigkeit neue Maßstäbe für größere Modelle und beschleunigt so den praktischen Einsatz von Edge-KI.

1. Spitzenleistung: 1,3 Milliarden Parameter liefern außergewöhnliche Ergebnisse
MiniCPM-V4.6 ist in zwei Versionen erhältlich – „Instruct“ und „Thinking“ –, die im Vergleich zu Modellen ähnlicher Größe in verschiedenen Benchmarks beeindruckende Schlussfolgerungs- und Verständnisfähigkeiten zeigen.
Weltweite Spitzenposition: Auf der Rangliste von Artificial Analysis (AA) erzielte MiniCPM-V4.6 beeindruckende 13 Punkte und übertraf damit Konkurrenten ähnlicher Größe (z. B. Alibabas Qwen3.5-0.8B und Googles Gemma4-E2B-it) bei weitem, während es fast an die Leistung größerer Modelle wie Qwen3.5-2B heranreichte. Damit wird ein neuer Maßstab für Modelle mit 1 Milliarde Parametern gesetzt.
Fortschrittliche Fähigkeiten: Vom allgemeinen Bild-Text-Verständnis über komplexes mathematisches Schlussfolgern im MINT-Bereich bis hin zu anspruchsvoller Dokumenten-OCR und dem zeitlichen Verständnis von Videos zeigt das Modell eine hohe Intelligenz. Insbesondere die „Thinking“-Version zeichnet sich durch hervorragendes Schlussfolgern bei mehreren Bildern und die Unterdrückung von Halluzinationen aus.
2. Durchbruch bei der Effizienz: Extreme intelligente Dichte am Edge
Um Speicherengpässe beim Edge-Einsatz zu bewältigen, wurde MiniCPM-V4.6 umfassend hinsichtlich Inferenzgeschwindigkeit und Ressourceneffizienz optimiert.
Geringer Speicherbedarf: Der Speicherbedarf sinkt auf nur 6 GB, was einen reibungslosen Betrieb auf gängigen Smartphones, PCs und Smart-Home-Geräten ermöglicht.
Inferenz-Effizienz: Dank vLLM beträgt der Inferenz-Durchsatz das 1,5-Fache des Wertes bei Mitbewerbern. Bei der Verarbeitung eines ultrahochauflösenden Bildes mit einer Größe von 3136² am Edge beträgt die Latenz der ersten Antwort nur 75,7 ms– das ist 2,2-mal schneller als bei Konkurrenzmodellen.
Durchsatz: Eine einzelne GPU liefert eine Textgenerierung von 7.013 Tokens pro Sekunde und kann 1.344² Bilder mit einer Geschwindigkeit von 54,79 Bildern pro Sekunde verarbeiten, was eine bemerkenswerte Effizienz demonstriert.
3. Kerntechnologie: LLaVA-UHD v4 minimiert den Overhead
Das schlanke Design des Modells wird durch LLaVA-UHD v4 ermöglicht, das gemeinsam von Mingshi Intelligence und der Tsinghua-Universität entwickelt wurde.
Neugestaltung der Kodierung: Durch ein überarbeitetes ViT-Bildkodierungs- und flaches Kompressionsmodul wird der Overhead bei der Bildkodierung um 50 % und bei hochauflösenden Gleitkommaoperationen um 55,8 % reduziert .
Hybride Kompression: Es wird eine 4×/16×-Hybrid-Token-Kompression eingeführt, die einen flexiblen Wechsel zwischen den Modi „Performance-First“ und „Speed-First“ ermöglicht. Diese Technologie wurde im Empfehlungsmodell OneRec von Kuaishou validiert, das enormen Datenverkehr bewältigt.
4. Einsatz im Ökosystem: Vom Labor in die Industrie
Die Open-Source-Veröffentlichung von MiniCPM-V4.6 markiert sowohl einen technischen als auch einen Meilenstein für das Ökosystem.
Einfache Entwicklung: Es lässt sich nahtlos in Fine-Tuning-Frameworks wie ms-swift und LLaMA-Factory integrieren und ermöglicht so ein umfassendes Fine-Tuning auf einer einzigen RTX 4090-GPU.
Plattformübergreifende Unterstützung: Kompatibel mit vLLM, Ollama und anderen wichtigen Frameworks bietet es Testversionen für iOS, Android und HarmonyOS und macht KI damit für eine breitere Palette an Hardware zugänglich.
Praktische Auswirkungen: Die Modellreihe wird bereits in den Bereichen Automobil, PC, Smart Home und industrielle Inspektion eingesetzt, unter anderem bei Partnern wie Lenovo, Geely, SAIC Volkswagen, Xiaomi und OPPO.
Verwandter Artikel
U.S.-Aktien erreichen historischen Meilenstein, während KI- und Luft- und Raumfahrtriesen auf ihr Debüt als Billionen-Dollar-Unternehmen vorbereiten
Elon Musk, Sam Altman und Dario Amodei, drei Giganten des Technologiesektors, schreiten den Börsengängen ihrer jeweiligen Unternehmen voran. Mit SpaceX, OpenAI und Anthropic – drei Branchenriesen, die einer Bewertung von einer Billion US-Dollar nahek
Schwedisches KI-Startup Lovable Eyes: Bewertung von 13,2 Milliarden US-Dollar nach großer Finanzierungsrunde
Während KI-gestützte Coding-Tools an Popularität gewinnen, hat das schwedische Startup Lovable eine bedeutende Finanzierungsrunde abgeschlossen. Das Unternehmen strebt danach, 3 Milliarden US-Dollar einzusammeln, was seine Bewertung potenziell auf 13
Google testet den Remy AI Agent für Gemini, da der Fokus auf die Benutzerkontrolle verlagert wird
Laut Business Insider testet Google Remy, einen neuen KI-Personalagenten für Gemini. Dieses Tool soll Aufgaben im Auftrag von Nutzern ausführen und sowohl professionelle Arbeitsabläufe als auch tägliche Routinen optimieren.Derzeit wird Remy in einer
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Am 11. Mai stellte Mingshi Intelligence gemeinsam mit der Tsinghua-Universität und der Open-Source-Community OpenBMB das neue multimodale Großmodell MiniCPM-V4.6 für den Einsatz am Edge vor. Trotz seiner kompakten Größe – nur 1,3 Milliarden Parameter – setzt dieses schlanke Modell durch seine außergewöhnliche intelligente Dichte und plattformübergreifende Anpassungsfähigkeit neue Maßstäbe für größere Modelle und beschleunigt so den praktischen Einsatz von Edge-KI.

1. Spitzenleistung: 1,3 Milliarden Parameter liefern außergewöhnliche Ergebnisse
MiniCPM-V4.6 ist in zwei Versionen erhältlich – „Instruct“ und „Thinking“ –, die im Vergleich zu Modellen ähnlicher Größe in verschiedenen Benchmarks beeindruckende Schlussfolgerungs- und Verständnisfähigkeiten zeigen.
Weltweite Spitzenposition: Auf der Rangliste von Artificial Analysis (AA) erzielte MiniCPM-V4.6 beeindruckende 13 Punkte und übertraf damit Konkurrenten ähnlicher Größe (z. B. Alibabas Qwen3.5-0.8B und Googles Gemma4-E2B-it) bei weitem, während es fast an die Leistung größerer Modelle wie Qwen3.5-2B heranreichte. Damit wird ein neuer Maßstab für Modelle mit 1 Milliarde Parametern gesetzt.
Fortschrittliche Fähigkeiten: Vom allgemeinen Bild-Text-Verständnis über komplexes mathematisches Schlussfolgern im MINT-Bereich bis hin zu anspruchsvoller Dokumenten-OCR und dem zeitlichen Verständnis von Videos zeigt das Modell eine hohe Intelligenz. Insbesondere die „Thinking“-Version zeichnet sich durch hervorragendes Schlussfolgern bei mehreren Bildern und die Unterdrückung von Halluzinationen aus.
2. Durchbruch bei der Effizienz: Extreme intelligente Dichte am Edge
Um Speicherengpässe beim Edge-Einsatz zu bewältigen, wurde MiniCPM-V4.6 umfassend hinsichtlich Inferenzgeschwindigkeit und Ressourceneffizienz optimiert.
Geringer Speicherbedarf: Der Speicherbedarf sinkt auf nur 6 GB, was einen reibungslosen Betrieb auf gängigen Smartphones, PCs und Smart-Home-Geräten ermöglicht.
Inferenz-Effizienz: Dank vLLM beträgt der Inferenz-Durchsatz das 1,5-Fache des Wertes bei Mitbewerbern. Bei der Verarbeitung eines ultrahochauflösenden Bildes mit einer Größe von 3136² am Edge beträgt die Latenz der ersten Antwort nur 75,7 ms– das ist 2,2-mal schneller als bei Konkurrenzmodellen.
Durchsatz: Eine einzelne GPU liefert eine Textgenerierung von 7.013 Tokens pro Sekunde und kann 1.344² Bilder mit einer Geschwindigkeit von 54,79 Bildern pro Sekunde verarbeiten, was eine bemerkenswerte Effizienz demonstriert.
3. Kerntechnologie: LLaVA-UHD v4 minimiert den Overhead
Das schlanke Design des Modells wird durch LLaVA-UHD v4 ermöglicht, das gemeinsam von Mingshi Intelligence und der Tsinghua-Universität entwickelt wurde.
Neugestaltung der Kodierung: Durch ein überarbeitetes ViT-Bildkodierungs- und flaches Kompressionsmodul wird der Overhead bei der Bildkodierung um 50 % und bei hochauflösenden Gleitkommaoperationen um 55,8 % reduziert .
Hybride Kompression: Es wird eine 4×/16×-Hybrid-Token-Kompression eingeführt, die einen flexiblen Wechsel zwischen den Modi „Performance-First“ und „Speed-First“ ermöglicht. Diese Technologie wurde im Empfehlungsmodell OneRec von Kuaishou validiert, das enormen Datenverkehr bewältigt.
4. Einsatz im Ökosystem: Vom Labor in die Industrie
Die Open-Source-Veröffentlichung von MiniCPM-V4.6 markiert sowohl einen technischen als auch einen Meilenstein für das Ökosystem.
Einfache Entwicklung: Es lässt sich nahtlos in Fine-Tuning-Frameworks wie ms-swift und LLaMA-Factory integrieren und ermöglicht so ein umfassendes Fine-Tuning auf einer einzigen RTX 4090-GPU.
Plattformübergreifende Unterstützung: Kompatibel mit vLLM, Ollama und anderen wichtigen Frameworks bietet es Testversionen für iOS, Android und HarmonyOS und macht KI damit für eine breitere Palette an Hardware zugänglich.
Praktische Auswirkungen: Die Modellreihe wird bereits in den Bereichen Automobil, PC, Smart Home und industrielle Inspektion eingesetzt, unter anderem bei Partnern wie Lenovo, Geely, SAIC Volkswagen, Xiaomi und OPPO.
U.S.-Aktien erreichen historischen Meilenstein, während KI- und Luft- und Raumfahrtriesen auf ihr Debüt als Billionen-Dollar-Unternehmen vorbereiten
Elon Musk, Sam Altman und Dario Amodei, drei Giganten des Technologiesektors, schreiten den Börsengängen ihrer jeweiligen Unternehmen voran. Mit SpaceX, OpenAI und Anthropic – drei Branchenriesen, die einer Bewertung von einer Billion US-Dollar nahek
Schwedisches KI-Startup Lovable Eyes: Bewertung von 13,2 Milliarden US-Dollar nach großer Finanzierungsrunde
Während KI-gestützte Coding-Tools an Popularität gewinnen, hat das schwedische Startup Lovable eine bedeutende Finanzierungsrunde abgeschlossen. Das Unternehmen strebt danach, 3 Milliarden US-Dollar einzusammeln, was seine Bewertung potenziell auf 13











