GEAR: Gemeinsames Training von Tokenizer und Generator für schnellere Bildsynthese1. Juli 20264. Juli 2026AI ModelsEnd-to-End-Training des Tokenizers und Generators mit dualer Codebook-Auslese beschleunigt die ImageNet-Konvergenz um bis zu 10x gegenüber LlamaGen-REPA. Share on:
ARM: Autoregressive Modell für einheitliche Bild- und Textverarbeitung10. Juni 202610. Juni 2026AI ModelsARM kombiniert diskrete visuelle Token mit einem 7-Milliarden-Parameter-Modell, um Bild- und Texttasks einheitlich als Token-Vorhersagen zu lösen. Share on: