Google a introduit Imagen-4 et son frère supérieur, Imagen-4 Ultra, dans un aperçu payant pour les utilisateurs d'API Gemini et des tests gratuits dans Google AI Studio. Google a déjà publié beaucoupOutils d'IA pour les utilisateurs. Mais selon le géant de la technologie, le nouveau modèle Imageen-4 s'améliore avec la typographie sur l'image et offre des visuels plus nets que son prédécesseur, Imagen-3.
Ces deux versions d'imagen incluent des filigranes d'ID synthétique sur toutes les sorties. Imagen-4 facture 0,04 $ par image, tandis que Ultra coûte 0,06 $. Les utilisateurs nécessitant une adhésion rapide plus stricte peuvent opter pour ce dernier. Google prévoit d'ajouter plus de niveaux de prix plus tard et permettra bientôt aux développeurs de demander des limites d'utilisation plus élevées.
Le billet de blog propose des exemples d'images présentant différents cas d'utilisation, des cartes postales rétro et des éditoriaux de la mode cinématographique aux bandes dessinées de science-fiction technologiques, toutes créées à l'aide de la variante Ultra. Ces exemples présentent une fidélité plus forte dans la gestion des détails fins comme les petits texte et les superpositions graphiques.
Autres nouvelles récentes de Google -
Google a intégré les modèles Imagen-4 dans les Gemini API et AI Studio en utilisant une bibliothèque unifiée aux côtés de ses modèles Gemini multimodaux. Les développeurs des régions supportés peuvent générer des images directement via des appels API ou des expériences dans AI Studio. Toutes les images générées porteront des filigranes synthétiques pour assurer la provenance et l'utilisation de confiance.
Plus tôt cette semaine, les notes de publication de l'API Gemini ont confirmé le lancement du 24 juin des modèles ImageN-4 et 4 Ultra Preview. Cela s'aligne sur la stratégie récente de Google de déploiement rapide des outils multimodaux, tels que Veo 3 et Lyria 2, sur des plates-formes comme Vertex Ai au cours de son Keynote d'E / S de mai.
Voir aussi:
En élargissant la bibliothèque API Gemini, Google donne aux développeurs un accès direct aux capacités de génération d'images de pointe. La structure de tarification reflète un modèle Cloud-AI commun: les modèles standard fonctionnent les besoins généraux et les modèles de niveau supérieur des cas d'utilisation cible nécessitant une sortie précise. L'amélioration de l'imagen-4 dans la réactivité de la typographie ouvre des possibilités dans les flux de travail de conception, de marketing et d'éducation.
L'aperçu de l'API Gemini est désormais en direct via des comptes existants, permettant aux développeurs d'intégrer immédiatement les modèles ImageN-4 dans leurs applications.Googleanticipe bientôt un accès plus large et des niveaux supplémentaires, car la disponibilité des modèles et les prix évoluent au cours des prochaines semaines.
Vous pouvez également être intéressé à lire -













