Schlagwort: Nano

  • Google bringt mit Nano Banana 2 Lite sein bisher schnellstes KI-Bildmodell und Gemini Omni Flash in die API

    Google erweitert seine generative KI-Modellfamilie um zwei Neuzugänge: Nano Banana 2 Lite erzeugt Bilder in vier Sekunden für 0,034 US-Dollar pro Bild, Gemini Omni Flash bringt erstmals Videogenerierung per Textbefehl in die API. Google empfiehlt die Verkettung beider Modelle: vom schnellen Bild zum animierten Video.

    Der Artikel Google bringt mit Nano Banana 2 Lite sein bisher schnellstes KI-Bildmodell und Gemini Omni Flash in die API erschien zuerst auf The Decoder.

  • MAI-Image-2.5: Microsofts neues Bildmodell landet auf Augenhöhe mit Googles Nano Banana 2

    Microsoft hat mit MAI-Image-2.5 ein neues Bildmodell veröffentlicht, das auf der Text-zu-Bild-Rangliste von Arena auf Platz drei einsteigt, auf Augenhöhe mit Googles Nano Banana 2, aber noch hinter OpenAIs Image-2. Das Modell soll vor allem bei Textdarstellung in Bildern und kommerziellen Motiven deutlich besser sein als sein Vorgänger.

    Der Artikel MAI-Image-2.5: Microsofts neues Bildmodell landet auf Augenhöhe mit Googles Nano Banana 2 erschien zuerst auf The Decoder.

  • Nvidia veröffentlicht Nemotron-3 Nano Omni samt tiefem Einblick in das Training multimodaler KI

    Nvidia veröffentlicht mit Nemotron 3 Nano Omni ein offenes multimodales Modell für Text, Bild, Video und Audio. Spannend ist nicht nur die Leistung, sondern auch der Blick in die Trainingsdaten: Sie stammen unter anderem aus Qwen, GPT-OSS, Kimi und DeepSeek-OCR.

    Der Artikel Nvidia veröffentlicht Nemotron-3 Nano Omni samt tiefem Einblick in das Training multimodaler KI erschien zuerst auf The Decoder.

  • Freepic ist Geschichte

    freepic durchgestrichen

    Nano Banana

    Kurzfassung

    Quellen

    Freepik hat sich offiziell in Magnific umbenannt und wandelt sich damit von einer klassischen Stock-Plattform zu einem umfassenden Produktionszentrum.
    Das profitable Unternehmen integriert neben 250 Millionen Assets nun aggregiert auch KI-Modelle wie Nano Banana und Google Veo 3.1.
    Für Bestandskunden läuft der Übergang nahtlos, da alle Lizenzen, APIs und aktiven Abonnements unverändert bestehen bleiben.

    Magnific – Freepik becomes Magnific. Here’s what that says about where creativity is headed
    Magnific – Freepik is now Magnific
    The Next Web – Freepik rebrands as Magnific: a bootstrapped, profitable $230M ARR AI creative platform

    Die bekannte Stock-Plattform agiert seit dem 28. April 2026 unter dem Namen Magnific. Damit bündelt das Unternehmen diverse Bild-, Video- sowie Audio-Generatoren und 250 Millionen Stock-Assets in einer zentralen Plattform für kreative Workflows. Ganz wichtig: Es gibt keinerlei Probleme oder finanzielle Schwierigkeiten. Freepic hat bereits im Jahr 2024 den KI-Upscaler Magnific erworben und nun beide Plattformen unter einem Namen zusammengeführt.

    Strategischer Umbau statt reiner Kosmetik Lange Zeit kannten Anwender den Anbieter primär als Suchmaschine für herkömmliche Grafikressourcen. Durch den aktuellen Relaunch verschmelzen die im Mai 2024 übernommene Upscaling-Technologie von Magnific und das alte Kernangebot zu einem gemeinsamen Ökosystem. Der Dienst kommuniziert den Übergang konsequent mit dem Versprechen auf »dasselbe Team, dieselbe Technologie«. Dabei zielt das Unternehmen auf Produktionsweisen ab, bei denen kleine Gruppen hochkarätige Inhalte generieren. Dafür vereint die Plattform etablierte KI-Modelle mit einer knotenbasierten Arbeitsfläche. Menschliche Urteilskraft soll dabei den Takt vorgeben, während die Technik lediglich die Ausführung übernimmt. Finanziell steht der Dienst auf einem bemerkenswert autonomen Fundament, da externe Geldgeber vollständig fehlen. Mit einem jährlich wiederkehrenden Umsatz von 230 Millionen US-Dollar und über einer Million zahlenden Abonnenten operiert der Betrieb hochprofitabel. ANZEIGE Modell-Agnostik und Enterprise-Fokus Anstatt exklusiv eigene Modelle zu trainieren, verfolgt Magnific einen aggregierenden Ansatz. Nutzer steuern über dieselbe Oberfläche direkt immer die neusten und besten KI-Modelle wie ChatGPT-Images-2.0, Nano Banana 2 oder auch den besten Videogenerator Seedance 2.0 an. Übrigens bereits mit 1080p Unterstützung. Diese offene Struktur grenzt das Angebot von stark spezialisierten Konkurrenten wie Higgsfield oder OpenArt ab. Agenturen kombinieren die Generierung unmittelbar mit hauseigenen Stock-Dateien und verwalten komplette Projekte über dedizierte Team-Bereiche. Auch große Firmenkunden wie die BBC oder Guess nutzen die Infrastruktur bereits produktiv. Zertifizierungen wie SOC 2 und der explizite Verzicht auf das Training mit Kundendaten sichern den professionellen Einsatz ab. + Quelle: Magnific Nahtlose Kontinuität für Bestandskunden Für bisherige Nutzer entstehen durch den Namenswechsel keinerlei technische Hürden. Alle bestehenden Zugangsdaten, aktiven Abonnements und erworbenen Lizenzen behalten vollumfänglich ihre Gültigkeit. Selbst auf technischer Ebene bewahrt das System eine hohe Stabilität, da Entwickler alte API-Schnittstellen parallel zu den neuen Endpunkten aufrechterhalten. Entsprechende Warnhinweise geben Programmierern ausreichend Vorlauf für anstehende Migrationen. Wer bisher rein auf den Upscaler oder die klassische Asset-Bibliothek setzte, findet seine Arbeitsumgebung unberührt vor. Das komplett neu gestaltete Portal steht allen Mitgliedern ab sofort zur Verfügung. Anzeige

  • Bildgenerator MAI-Image-2: Microsoft fordert Google heraus

    Mehrere Bilder von MAI-Image-2

    Nano Banana

    Kurzfassung

    Quellen

    Microsoft hat den neuen KI-Bildgenerator MAI-Image-2 veröffentlicht.
    Das System erreicht im weltweiten Benchmark den fünften Platz und schließt zur Konkurrenz auf.
    Besondere Stärken liegen im Fotorealismus und der zuverlässigen Darstellung von Texten in Bildern.
    Nutzer testen das Modell ab sofort im MAI Playground, bevor die Integration in Copilot folgt.

    Microsoft AI: Introducing MAI-Image-2

    Microsoft veröffentlicht mit MAI-Image-2 einen neuen KI-Bildgenerator. Das hauseigene Superintelligenz-Team entwickelte das System. Es schließt im weltweiten Vergleich überraschend zu den aktuellen Marktführern Google und OpenAI auf. Platzierung im weltweiten Benchmark Im bekannten „Text-to-Image Arena“ Benchmark erreicht MAI-Image-2 aus dem Stand den fünften Platz. Das neue KI-Modell von Microsoft erzielt dabei eine Gesamtpunktzahl von 1189. Damit positioniert sich das System direkt hinter der aktuellen Spitze. Ein genauer Blick auf die Grafik zeigt jedoch die tatsächliche Marktsituation. Lediglich zwei Unternehmen besetzen die vorderen Ränge. OpenAI belegt mit dem System GPT-Image-1.5 den zweiten Rang und erreicht 1244 Punkte. Google dominiert den restlichen Spitzenbereich, da das Modell „Nano Banana“ gleich drei Positionen einnimmt. Die Version „Nano Banana 2“ führt das Feld an, während die Pro-Version die Plätze drei und vier belegt. Zieht man diese Mehrfachplatzierungen der Modellfamilien ab, steht Microsoft faktisch auf dem dritten Platz der besten Anbieter. + Quelle: Microsoft

    Foto realistisch

    Copy

    A glacier wall towering like a cathedral interior, deep blue ice with light refracting through layers, tiny human figure at base for scale, cinematic, cold mist in air, hyper-real detail

    Prompt vollständig anzeigen

    Fotorealismus und präzise Typografie Technisch legt Microsoft den Fokus bei der neuen Version auf eine hohe Detailtreue. Nutzer steuern die Ausgabe der Bilder dabei wie gewohnt über einen kurzen Text-Prompt. + Quelle: Microsoft Das System erzeugt laut den Entwicklern besonders realistische Fotos. Das Modell berechnet natürliche Lichtverhältnisse und stellt Hauttöne bei Porträts akkurat dar. Viele generative Modelle haben Probleme mit der fehlerfreien Darstellung von Schriftzeichen in Bildern. MAI-Image-2 adressiert diese Schwachstelle und integriert Texte zuverlässig in die generierten Motive. Das erleichtert die Erstellung von Postern, Infografiken oder Diagrammen. Aufwändige Korrekturen in externen Programmen entfallen dadurch. Testphase für erste Anwender Interessierte Anwender probieren MAI-Image-2 ab sofort im MAI Playground aus. Dort sammelt Microsoft direktes Feedback für das weitere Fine-Tuning des Modells. In naher Zukunft integriert der Konzern das Modell fest in etablierte Dienste wie Copilot oder den Bing Image Creator. Entwickler erhalten über die Plattform Microsoft Foundry zudem einen direkten Zugriff auf die API. So binden externe Firmen den Bildgenerator nahtlos in eigene Anwendungen ein. Über die genauen technischen Details der zugrundeliegenden Architektur schweigt Microsoft bislang. Der Konzern dokumentiert mit diesem Update sachlich den aktuellen technischen Stand der eigenen Systeme auf dem Markt. Anzeige

  • Bildgenerator MAI-Image-2: Microsoft fordert Google heraus

    Mehrere Bilder von MAI-Image-2

    Nano Banana

    Kurzfassung

    Quellen

    Microsoft hat den neuen KI-Bildgenerator MAI-Image-2 veröffentlicht.
    Das System erreicht im weltweiten Benchmark den fünften Platz und schließt zur Konkurrenz auf.
    Besondere Stärken liegen im Fotorealismus und der zuverlässigen Darstellung von Texten in Bildern.
    Nutzer testen das Modell ab sofort im MAI Playground, bevor die Integration in Copilot folgt.

    Microsoft AI: Introducing MAI-Image-2

    Microsoft veröffentlicht mit MAI-Image-2 einen neuen KI-Bildgenerator. Das hauseigene Superintelligenz-Team entwickelte das System. Es schließt im weltweiten Vergleich überraschend zu den aktuellen Marktführern Google und OpenAI auf. Platzierung im weltweiten Benchmark Im bekannten „Text-to-Image Arena“ Benchmark erreicht MAI-Image-2 aus dem Stand den fünften Platz. Das neue KI-Modell von Microsoft erzielt dabei eine Gesamtpunktzahl von 1189. Damit positioniert sich das System direkt hinter der aktuellen Spitze. Ein genauer Blick auf die Grafik zeigt jedoch die tatsächliche Marktsituation. Lediglich zwei Unternehmen besetzen die vorderen Ränge. OpenAI belegt mit dem System GPT-Image-1.5 den zweiten Rang und erreicht 1244 Punkte. Google dominiert den restlichen Spitzenbereich, da das Modell „Nano Banana“ gleich drei Positionen einnimmt. Die Version „Nano Banana 2“ führt das Feld an, während die Pro-Version die Plätze drei und vier belegt. Zieht man diese Mehrfachplatzierungen der Modellfamilien ab, steht Microsoft faktisch auf dem dritten Platz der besten Anbieter. + Quelle: Microsoft

    Foto realistisch

    Copy

    A glacier wall towering like a cathedral interior, deep blue ice with light refracting through layers, tiny human figure at base for scale, cinematic, cold mist in air, hyper-real detail

    Prompt vollständig anzeigen

    Fotorealismus und präzise Typografie Technisch legt Microsoft den Fokus bei der neuen Version auf eine hohe Detailtreue. Nutzer steuern die Ausgabe der Bilder dabei wie gewohnt über einen kurzen Text-Prompt. + Quelle: Microsoft Das System erzeugt laut den Entwicklern besonders realistische Fotos. Das Modell berechnet natürliche Lichtverhältnisse und stellt Hauttöne bei Porträts akkurat dar. Viele generative Modelle haben Probleme mit der fehlerfreien Darstellung von Schriftzeichen in Bildern. MAI-Image-2 adressiert diese Schwachstelle und integriert Texte zuverlässig in die generierten Motive. Das erleichtert die Erstellung von Postern, Infografiken oder Diagrammen. Aufwändige Korrekturen in externen Programmen entfallen dadurch. Testphase für erste Anwender Interessierte Anwender probieren MAI-Image-2 ab sofort im MAI Playground aus. Dort sammelt Microsoft direktes Feedback für das weitere Fine-Tuning des Modells. In naher Zukunft integriert der Konzern das Modell fest in etablierte Dienste wie Copilot oder den Bing Image Creator. Entwickler erhalten über die Plattform Microsoft Foundry zudem einen direkten Zugriff auf die API. So binden externe Firmen den Bildgenerator nahtlos in eigene Anwendungen ein. Über die genauen technischen Details der zugrundeliegenden Architektur schweigt Microsoft bislang. Der Konzern dokumentiert mit diesem Update sachlich den aktuellen technischen Stand der eigenen Systeme auf dem Markt. Anzeige

  • Bildgenerierung mit Nano Banana: Google erklärt die Unterschiede der drei Modelle

    Ein offizieller Leitfaden von Google ordnet die drei Nano-Banana-Bildmodelle ein und zeigt, wann sich welches lohnt. Das günstigere Nano Banana 2 soll 95 Prozent der Pro-Fähigkeiten bieten und kann vor der Bildgenerierung eigenständig im Internet nach Referenzbildern suchen.

    Der Artikel Bildgenerierung mit Nano Banana: Google erklärt die Unterschiede der drei Modelle erschien zuerst auf The Decoder.

  • Googles Nano Banana 2 soll Pro-Qualität für den halben Preis bieten

    Google stellt mit Nano Banana 2 ein neues Bildgenerierungsmodell vor, das die Fähigkeiten des teureren Pro-Modells mit der Geschwindigkeit von Gemini Flash vereinen soll. Es wird zum neuen Standard in der Gemini-App.

    Der Artikel Googles Nano Banana 2 soll Pro-Qualität für den halben Preis bieten erschien zuerst auf The Decoder.

  • Wie Googles KI-Bildmodell „Nano Banana“ zu seinem seltsamen Namen kam

    Googles „Nano Banana“-Bildmodell ist mit Abstand das derzeit mächtigste Bildmodell am Markt. Aber der Name ist seltsam.

    Der Artikel Wie Googles KI-Bildmodell „Nano Banana“ zu seinem seltsamen Namen kam erschien zuerst auf The Decoder.

  • Google TV integriert Gemini: Die Fernbedienung wird bald überflüssig

    Ein Google TV Fernseher

    Nano Banana

    Kurzfassung

    Quellen

    Google integriert die KI-Modelle Gemini Nano und Veo direkt in das Betriebssystem Google TV. Die neue Sprachsteuerung ermöglicht tiefgreifende Änderungen an Systemeinstellungen ohne manuelle Navigation durch komplexe Menüs. Nutzer von TCL-Geräten erhalten zuerst Funktionen zur intelligenten Verwaltung und kreativen Bearbeitung ihrer persönlichen Fotogalerien. Die lokale Verarbeitung der Daten auf dem Fernseher verbessert die Reaktionsgeschwindigkeit und erhöht den Schutz der Privatsphäre.

    Google Blog: Google TV at CES 2026

    TechCrunch: Google previews new Gemini features for Google TV

    t3n.de: KI auf dem Fernseher: Google kündigt neue Gemini-Funktionen an

    Heise Online: CES: Google TV bekommt neue Gemini-Funktionen

    Golem.de: Bild- und Videogenerierung: Google TV wird zur KI-Kreativzentrale

    Google integriert die Sprach-KI Gemini tiefer in das Betriebssystem Google TV. Auf der Technikmesse CES 2026 zeigt der Konzern, wie Nutzer künftig per Sprachbefehl komplexe Systemeinstellungen ändern und persönliche Fotos mithilfe neuer Bildmodelle direkt am Fernseher bearbeiten können. Natürliche Sprache ersetzt verschachtelte Menüs Die Steuerung des Fernsehers erfolgt zunehmend über natürliche Sprache statt durch das Klicken in Untermenüs. Nutzer können Gemini mitteilen, dass das Bild zu dunkel oder der Dialog schwer verständlich ist. Die KI analysiert diese Anfragen und passt die Helligkeit oder die Audioprofile selbstständig an, ohne dass der Zuschauer den aktuellen Film verlassen muss. Zusätzlich wertet Google die Suchergebnisse auf der Plattform optisch auf. Anstatt rein textbasierter Antworten liefert Gemini nun visuelle Frameworks, die Bilder, Videos und Echtzeit-Sportdaten kombinieren. Komplexe Themen bereitet die KI in sogenannten Deep Dives auf, die interaktive Übersichten für die gesamte Familie bieten. Anzeige Kreativ-Werkzeuge für das Wohnzimmer Mit der Integration der Modelle Nano Banana und Veo verwandelt Google den Fernseher in eine Station für Medienbearbeitung. Während Nano Banana als kompaktes Modell für die lokale Bildbearbeitung dient, ermöglicht Veo die Generierung kurzer Videosequenzen. Nutzer können so persönliche Aufnahmen aus ihrer Google Photos Bibliothek per Sprachbefehl in cineastische Diashows oder KI-generierte Kunstwerke verwandeln. Die Zusammenarbeit mit dem Hersteller TCL steht hierbei im Fokus. Diese Geräte erhalten die neuen Funktionen als erste, wobei die Verwaltung der Fotogalerien eine zentrale Rolle spielt. Über einfache Befehle lassen sich Momente nach Personen oder Ereignissen filtern, ohne manuell durch hunderte Bilder scrollen zu müssen. Lokale Verarbeitung und Datenschutz Ein wesentlicher Teil der Rechenleistung wird direkt auf der Hardware ausgeführt. Hierfür nutzt Google das Modell Gemini Nano, das speziell für die Ausführung auf Endgeräten ohne ständige Cloud-Anbindung entwickelt wurde. Dieser Ansatz soll nicht nur die Reaktionsgeschwindigkeit erhöhen, sondern auch die Privatsphäre der Nutzer schützen, da sensible Bilddaten das Gerät seltener verlassen. Der Rollout der neuen Funktionen beginnt unmittelbar auf ausgewählten TCL-Modellen in den USA. In den folgenden Monaten plant Google die Ausweitung auf weitere Marken sowie auf Projektoren, die mit Google TV laufen. Voraussetzung für die Nutzung ist ein aktuelles Betriebssystem ab Version Android TV OS 14.