Luma Labs ouvre Uni-1.1 API
Luma Labs ouvre l'API REST de son modèle multimodal Uni-1.1, offrant une génération d'images haute résolution deux fois moins chère et plus rapide.
La sortie de l'interface REST donne accès à Uni-1, le modèle multimodal de Luma (decoder-only autoregressive transformer) présenté comme capable d'interpréter l'intention créative, la composition et la logique spatiale avant de générer les pixels. Deux endpoints structurent l'API (raisonnement et génération), accompagnés de SDK Python, JavaScript/TypeScript, Go et d'un CLI, sans liste d'attente.
Les usages couvrent le text-to-image et l'édition d'image en langage naturel, avec jusqu'à neuf références par génération pour garantir la cohérence des personnages, produits, styles ou identités de marque. Luma revendique un entraînement mené en collaboration avec des cinéastes, artistes VFX et créateurs internationaux, qui se traduit par un rendu multilingue natif (chinois, japonais, arabe), une sensibilité aux registres visuels (manga, mode, architecture) et une gestion fine de l'éclairage et des matériaux.
Côté performance, le studio met en avant une latence et un coût inférieurs de moitié à ceux des modèles comparables, avec une image 2048 px générée en 31 secondes environ. Uni-1.1 figure dans le top 3 de l'Image Arena (text-to-image et image edit) et en tête du classement Human Preference Elo. Deux formules tarifaires cohabitent : un plan Build à l'usage (à partir de 0,0404 $ par image 2048 px pour Uni-1.1, autour de 0,10 $ pour la version Max) et un plan Scale à débit garanti destiné aux charges de production, avec SLA et accompagnement dédié. Le modèle reste testable gratuitement sur app.lumalabs.ai avant bascule vers l'API.