← Alle artikelen

MiniMax H3 open gewichten: wat je daadwerkelijk lokaal kunt draaien

MiniMax H3 open gewichten: wat je daadwerkelijk lokaal kunt draaien

Begin augustus publiceerde MiniMax de gewichten van zijn H3-videomodel op Hugging Face. Clips met stereogeluid kunnen nu op uw eigen machine worden gegenereerd – geen abonnement, geen API-kosten per generatie. Maar voordat u honderden gigabytes downloadt, moet u twee dingen in gedachten houden: de volledige 2K-pijplijn heeft de open release niet gehaald en de licentie staat niet iedereen overal toe.

Wat er precies is vrijgegeven

De MiniMax-H3-repository bevat twee taakspecifieke controlepunten. FL2VA maakt video met geluid uit tekst en kan frames animeren: jij levert de eerste, de laatste of beide aan. Ref2VA bouwt een fragment op van referenties – een enkel verzoek kan maximaal negen afbeeldingen, drie video’s en drie audiobestanden bevatten, dus het uiterlijk, de camerabeweging, de stijl en de stem van een personage worden elk bepaald door hun eigen voorbeeld. De kern is een compacte transformator met 33 miljard parameters, de gewichten worden gepubliceerd in BF16 en de hele repository weegt ongeveer 288 GB.

Wat het model kan doen

H3 neemt tekst, afbeeldingen, video en audio als invoer en produceert clips van 4 tot 15 seconden bij 24 fps – met ingebouwde stereoaudio die het model zelf synthetiseert, synchroon met het beeld. De basisresolutie is 768p aan de korte kant. Audio is hier geen aparte verwerkingsfase, maar onderdeel van hetzelfde model: je kunt op basis van referentie een stem of muzikaal ritme instellen, wat de gebruikelijke workflow merkbaar verandert.

Ongeveer 2K – een belangrijk voorbehoud

De geadverteerde 2K komt niet uit het open deel van de pijpleiding. Een aparte module genaamd Regenerate-2K zorgt voor de resolutieverbetering, en MiniMax heeft deze niet vrijgegeven: de officiële route naar 2K is om uw lokale 768p-resultaat terug te sturen naar de cloud-API van het bedrijf. Context-IR, de module die complexe combinaties van aanwijzingen en verwijzingen parseert, is ook niet open. Dus "alles lokaal draaien" betekent momenteel "basisgeneratie uitvoeren".

Transparent glass cubes with color gradients floating around a graphics card

Kan een gewone computer dit aan?

Het ComfyUI-team voegde ondersteuning toe op dag nul en optimaliseerde de run sterk: modulatiegewichten – ongeveer 40% van alle parameters – werden vervangen door een compacte opzoektabel, en int8-kwantisering verkleinde de totale footprint van 123,6 GB naar 42,5 GB. Gecombineerd met dynamische offloading naar systeem-RAM is dat genoeg om het model te laten draaien op een kaart die zo bescheiden is als de RTX 3060. De gemeenschap ging verder: er zijn WanGP-configuraties verschenen voor kaarten met 5-6 GB VRAM, waarbij gebruik wordt gemaakt van agressieve RAM-offloading, lagere resolutie en lange minuten per korte clip. Houd er rekening mee dat dit gemeenschapsrecepten zijn en geen officiële vereisten: de details komen er zachter uit en de stabiliteit hangt af van uw RAM-grootte en schijfsnelheid. Voor volledige kwaliteit raden de ontwikkelaars kaarten van het hoogste niveau aan, zoals de RTX 5090.

Licenties: dit is geen open source in de gebruikelijke zin

De gewichten zijn open maar worden gedistribueerd onder een Community-licentie met voorwaarden. Commercieel gebruik is toegestaan ​​voor bedrijven met een jaaromzet van minder dan $ 20 miljoen; grotere bedrijven hebben een afzonderlijke overeenkomst nodig. En cruciaal is de geografie: de licentie heeft alleen betrekking op de VS, de Europese Unie, het Verenigd Koninkrijk en Zuid-Korea; Voor gebruik elders is schriftelijke toestemming van MiniMax vereist. ‘Open gewichten’ is de juiste term, niet ‘volledig open source’.

Die echt een lokale run nodig heeft

Een zelf-gehoste instantie is zinvol wanneer privacy, een hoog generatievolume of het afstemmen van uw eigen gegevens ertoe doen – precies wat open gewichten mogelijk maken. Als je gewoon snel een kwaliteitsclip wilt, zonder gedoe met een GPU-farm of omgeving, is de cloud eenvoudiger: in deNeuralSpace-videosectieclips kosten een paar klikken, en we hebben besproken wat H3 zelf kan doen in onzeaparte recensie.

Veelgestelde vragen

Welke GPU heeft MiniMax H3 nodig?

Voor comfortabel werken, kaarten van het hoogste niveau met voldoende geheugen. In de praktijk draaien mensen zelfs basisgeneratie op 6 GB VRAM via ComfyUI en WanGP, waarbij resolutie en snelheid worden ingewisseld: een korte clip kan 10 tot 15 minuten duren.

Kan ik H3 commercieel gebruiken?

Ja, als de jaaromzet van uw bedrijf minder dan $ 20 miljoen bedraagt, is dat een voorwaarde voor een Community-licentie. Grotere organisaties hebben een aparte overeenkomst met MiniMax nodig.

Waarom is H3 niet volledig open source?

Alleen het basisgedeelte van de pijplijn is open: de modules voor het opschalen naar 2K en het parseren van complexe referenties blijven gesloten, en de licentie beperkt commercieel gebruik en regio's.