Dein KI-Update: KI-Games, der Agent-Boss und ein neues Bildmodell (von Google? 🍌)
Moin und schön, dass du wieder am Start bist zu einer neuen Ausgabe meine KI Newsletters! 🥳 Es gibt mal wieder eine ganze Reihe von Updates von meinen Projekten, Entwicklungen, snipKI, eine neue Podcast-Folge, Tools, News und Podcast Empfehlungen. 🧔🏻 Mein persönlich…
Moin und schön, dass du wieder am Start bist zu einer neuen Ausgabe meine KI Newsletters! 🥳
Es gibt mal wieder eine ganze Reihe von Updates von meinen Projekten, Entwicklungen, snipKI, eine neue Podcast-Folge, Tools, News und Podcast Empfehlungen.
🧔🏻 Mein persönliches Update
Der August fühlt sich ein bisschen wie die Ruhe vor dem Sturm an. Denn im September gehts auf verschiedene Messen (DMEXCO, Marketing Tech Summit) sowie einzelne Events und Workshops. Nächste Woche gehts für mich nach Mainz zum Ryze Digital Event mit dem Titel "Sales & Marketing powered by AI", passt natürlich. 😁 Wenn du da bist, sag gerne mal Hallo! 👋🏻
Von Textideen bis Social Media: In meinem Gastartikel bei SumUp zeige ich, wie kleine Unternehmen KI im Marketing praktisch einsetzen können. 🤓
🎙️ NewMindsAI - Industrial AI statt Buzzword
Mit Simon Sack, Gründer von NEUROLOGIQ , sprechen wir über Industrial AI und wie KI in Stahlwerken, Logistik und Predictive Maintenance Effizienz steigert. Anhand konkreter Beispiele diskutieren wir Erfolgsfaktoren und die Chancen Europas im globalen Wettbewerb.
💚 snipKI - Praktisches KI-Wissen für den Bundesverband
Wir sind nicht nur Mitglied im KI-Bundesverband, sondern unterstützen auch aktiv. So durften wir diese Woche in einem n8n Workshop im AI VIllage in Köln, Wissen über Automatisierung mit n8n, mit und ohne KI zeigen und haben auch geklärt, wann man eigentlich einen echten Agenten braucht und wann auch nicht.
Außerdem haben bereits über 500 User unsere KI-Assistenten angefragt! 😁 Als snipKI User findest du diese jetzt auch im Login-Bereich 🥳
Obendrein kommen wir mittlerweile auf 475 KI-Tutorials und auch unser KI-Grundkurs wurde nochmals überarbeitet und aktualisiert.
So, genug Intro, ab in den Newsletter!
Hab einen tollen Sonntag und bis zur nächsten Ausgabe!
Jens
🚀 So unterstütze ich Teams beim Thema generative KI
🧠 KI-Impuls: KI-Entwicklung - Warum so ungeduldig?
Exponentielles Wachstum bei KI-Trainingsaufwand
Die aktuellen Daten von Epoch AI zeigen eindeutig: Der Trainingsaufwand für KI-Modelle ist seit 2010 exponentiell gestiegen. Der sogenannte Training Compute wächst im Durchschnitt um den Faktor 4,4 pro Jahr. Modelle wie GPT-3, GPT-4 oder Gemini Ultra sind Meilensteine dieser Entwicklung. Sie wurden vor allem durch massive Investitionen in Rechenleistung vorangetrieben. Die Hardware hat sich verbessert, aber der Haupttreiber ist der zunehmende Einsatz von Ressourcen, um leistungsfähigere Modelle zu entwickeln.
Unsere Erwartungshaltung gegenüber KI-Innovationen
Dieser Trend verstärkt die Erwartungshaltung, dass Fortschritte in der KI immer schneller erfolgen müssen. Wir gewöhnen uns daran, dass neue Modelle nicht nur größer, sondern auch spürbar besser sind. Das führt zu einer Dynamik, in der jede neue Generation mit noch höheren Erwartungen konfrontiert wird. Bessere Sprachqualität, mehr Funktionen, geringere Halluzinationen und höhere Geschwindigkeit: Das sind die Dinge, die gefordert werden. Wenn das nächste Model jetzt nicht endlich AGI ist, dann sind wir gefühlt schnell entäusscht. 😅
Ein Perspektivwechsel ist gefragt!
Die Fortschritte sind bereits außergewöhnlich hoch. Überlege nur einmal wie sich die Erstellung von Medien (Text, Bild, Video, Audio) in den letzten 3-4 Jahren entwickelt hat.
Die bestehenden Modelle bieten ein riesiges Potenzial, das in vielen Bereichen oft gar nicht genutzt wird. Entscheidend ist, dass du die vorhandenen Werkzeuge gezielt einsetzt, ihre Möglichkeiten in der Praxis verstehst und mit ihrer Hilfe produktiver zu werden. Bevor die nächste große Version kommt, müssen wir vielleicht erstmal den aktuellen Stand vernünftig ausschöpfen.😉 Da sind aber viele (Unternehmen) noch gerade am Anfang. Ein gutes Beispiel ist für mich die Herausforderung vernünftig mit KI-Chats zu sprechen und einfache Prozessautomation (mit und ohne KI) überhaupt mitzudenken. Da ist noch viel Luft nach oben!
Grafik: Epoch AI, 'Data on AI Models'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/data/ai-models' [online resource]. Accessed 22 Aug 2025.
Meine KI-Top-News🏆
Was hat mich diese Woche in Sachen KI begeistert? Hier sind meine Highlights zu Technologien, Trends und Entwicklungen, die du keinesfalls verpassen solltest.
Mirage 2 zeigt die Zukunft generativer Spielewelten
Mit Mirage 2 kann ich aus einem Bild, einer Skizze oder einem Text eine eigene Spielwelt generieren und diese in Echtzeit verändern. Dadurch werde ich nicht mehr zum reinen Spieler, sondern zum aktiven Mitgestalter digitaler Räume.
Vor wenigen Wochen hat Mirage 1 erstmals gezeigt, dass KI ganze Spielwelten generieren kann. Google hat mit Genie 3 nachgelegt und jetzt bringt Mirage 2 die nächste Stufe: eine spielbare generative Engine. Ich habe ein Foto von mir hochgeladen und es in verschiedene Welten gesetzt, die sich direkt durch Prompts verändern ließen. Noch läuft nicht alles rund, es gibt Wartezeiten und kein stabiles World Memory, aber das Prinzip ist einfach faszinierend. Alle Szenen und Objekte werden in Echtzeit generiert.
Dieser Ansatz eröffnet nicht nur im Gaming, sondern auch in Bildung, Kultur oder Training neue Möglichkeiten. Probiere es unbedingt mal aus, solange es noch funktioniert.
Geteilte Grok-Chats landen bei Google
Elon Musks xAI hat öffentliche und geteilte Chats von Grok ohne Nutzerwissen bei Google indexiert. Nachdem OpenAI die Chats wieder entfernt hat, gibt es bei Grok aktuell noch über 300.000 öffentliche Chats.
Die Aktion hat zwei Seiten:
- Einerseits kann Transparenz und Offenheit in der KI-Nutzung sinnvoll sein, etwa für Forschung und Experimente.
- Andererseits birgt es erhebliche Risiken, wenn Nutzer nicht klar erkennen, dass ihre Inhalte im öffentlichen Raum landen und damit dauerhaft auffindbar sind.
Besonders heikel wird es, wenn sensible Daten, problematische Anleitungen oder vertrauliche Kontexte ungewollt sichtbar werden.
Ich sehe darin vor allem ein Problem der fehlenden Kommunikation. Wenn ich einen KI-Chat nutze, möchte ich wissen, wer Zugriff erhält und wo er erscheint. Dass Grok hier keine Hinweise gibt, halte ich für riskant und ehrlich gesagt auch für unnötig intransparent.
Merke: Wenn du Chats teilst, überprüfe, wer Sie sehen kann ;-)
Microsoft sieht den „Agent-Boss“ als neue Rolle der Arbeit
Laut dem aktuellen Work Trend Index von Microsoft könnte schon bald eine neue Rolle im Arbeitsalltag entstehen: der Agent-Boss. Gemeint ist damit nicht mehr nur die Nutzung einzelner KI-Tools, sondern das Steuern und Koordinieren mehrerer spezialisierter Agenten.
Wenn ich aber in die Realität vieler Unternehmen schaue, sehe ich, dass viele Teams noch dabei sind, erste Tools auszuprobieren und kleine Automationen aufzubauen. Häufig fehlen Vertrauen, Zeit und Klarheit, um mit KI überhaupt sicher zu arbeiten. Da fehlt noch viel bis zum Agent-Boss.
Die Zahlen von Microsoft zeigen, dass Führungskräfte dem Thema aber schon näher sind als Mitarbeitende, und die Lücke ist groß. Für mich wirkt es so, als würden wir gedanklich schon einen Schritt überspringen. Vielleicht solltest du zuerst ein „Agent-Ready Mindset“ schaffen, bevor die Rolle des Agent-Boss Realität wird.
Nano-Banana - neues eindsruckvolles Bildmodell von ... (Google)? 🍌
In den nächsten Tagen / Wochen wird es wohl ein neues Bildmodell geben. Der Codename bisher lautet "nano-banana" und ist in der LMarena testbar. Wähle dort einfach den Battle Modus (mit Bildgenerierung) und warte bis eins der Modelle dann das nano-banana Model ist.
Von wem das Model stammt? Bisher gibt es keine offizielle Aussage. Posts wie diesen von Josh Woodward oder diesen von einem NotebookLM Mitarbeiter lassen aber vermuten, dass es aus dem Hause Google kommt. 🍌
Neben der Geschwindigkeit entsteht hier auch ein starkes Model, um Bilder zu editieren (mit Prompts). Dabei wird ähnlich wie in Flux Kontext das ursprüngliche Bild sehr gut beibehalten.
Ich teste schon fleißig Generierungen, Veränderungen und Kombinationen und freu mich auf den finalen Release und bin gespannt wie teuer es sein wird.
Manch andere bezeichnen es gerne als "dieses Model schockt die Szene" - achja wie ich Clickbait (nicht) liebe. 😂 Bitte bleibt doch realistisch. 🙈
snipKI Spotlight 😎
Jede Woche posten wir Webinarankündigungen, unsere Lieblingssnips, kurze Umfragen oder stellen unsere snipKI-Autoren vor. Mehr über snipKI erfahren
KI-Workshop im AI Village
Danke für die Einladung ins AI-Village! Endlich hab ichs mal geschafft, vorbeizuschauen. 😂 Dort durften wir dem Team n8n einmal näher bringen. Entstanden sind nicht nur echte Praxiserfahrung, sondern auch viele neue Ideen für Workflows aus dem Berufsalltag. Ziel erreicht 🎯! Wir freuen uns schon jetzt auf die nächsten Events. 🙌
Dir fehlt auch die echte Praxis in der KI-Welt? Dann schau unbedingt mal bei snipKI vorbei.
Gut zu wissen 📰
Was passiert sonst noch in Sachen KI? Die folgenden Neuigkeiten zum Thema Künstliche Intelligenz solltest du im Auge behalten.
- Die NASA und IBM haben das Open-Source-Foundation-Modell „Surya“ veröffentlicht. Es ist auf neun Jahren hochauflösender SDO-Daten trainiert und kann Sonnenaktivitäten wie Flares bis zu zwei Stunden im Voraus visuell vorhersagen. Erste Tests zeigen eine um 16 % höhere Genauigkeit bei der Klassifikation von Sonnenstürmen im Vergleich zu bisherigen Methoden.
- Das Grok 2.5 Modell von xAI, das im vergangenen Jahr als bestes Modell galt, wird jetzt als Open Source verfügbar gemacht. In etwa sechs Monaten soll auch das Grok 3 Modell als Open Source veröffentlicht werden.
- Sam Altman, CEO von OpenAI, räumt ein, dass die Einführung von GPT-5 misslungen ist, was zur Rückkehr von GPT-4o führte. Er kündigte zudem an, dass OpenAI in den kommenden Jahren Billionen für den Ausbau von Rechenzentren ausgeben wird, um das Wachstum von ChatGPT zu sichern.
- Laut einer Umfrage von Indeed sparen drei Viertel der Beschäftigten in Deutschland durch KI höchstens drei Stunden pro Woche, ein Sechstel merkt gar keinen Unterschied. In Unternehmen ohne klare Förderung fließt die eingesparte Zeit oft in Pausen, zusätzliche Meetings oder Verwaltung, während sie in unterstützenden Firmen deutlich mehr für Weiterbildung und kreative Tätigkeiten genutzt wird.
- KI‑Agenten von Letta nutzen „sleeptime compute“, um in Ruhephasen aus Konversationen langfristig zu lernen und Gedächtnisinhalte gezielt zu speichern oder zu verwerfen, was Kontextgenauigkeit und Zuverlässigkeit verbessert. Der Ansatz ermöglicht zentrale Updates an Gedächtnisblöcken, die das Verhalten von Millionen Agenten gleichzeitig beeinflussen, und könnte die Effizienz sowie Konsistenz von KI‑Systemen deutlich steigern.
- Eine Analyse hat ergeben, dass KI-Crawler durch das massenhafte Abrufen von Webseiten Server überlasten können. Server-Betreiber warnen vor steigenden Kosten und fordern klare Regeln zum Umgang mit automatisierten Abfragen.
- Meta teilt sein Superintelligenz-Labor in vier spezialisierte Gruppen, TBD-Lab (LLMs), FAIR (Grundlagenforschung), Products & Applied Research (Produktintegration) und MSL-Infra (Infrastruktur), auf, um Forschung, Entwicklung und Infrastruktur effizienter zu strukturieren. Hintergrund sind interne Spannungen, hohe Investitionen in Spitzenkräfte und der Druck, im Rennen um die Entwicklung von Superintelligenz mit Konkurrenten wie OpenAI und Google mitzuhalten.
- Der Psychologe B. F. Skinner trainierte im Zweiten Weltkrieg Tauben, um Bomben präziser zu steuern. Damit legte er den Grundstein für die Konzepte des Verstärkungslernens (Reinforcement learning). Diese Prinzipien beeinflussen bis heute die Entwicklung moderner KI-Systeme.
- Der Schweizer Maschinenbauer Bühler nutzt KI, um seine Produktionsprozesse zu optimieren und neue Dienstleistungen anzubieten. Das Unternehmen erwartet dadurch eine deutliche Steigerung seines Umsatzes in den kommenden Jahren.
- Physiker nutzen KI, um große Datenmengen aus Experimenten schneller auszuwerten und komplexe Muster zu erkennen. Diese Methoden beschleunigen die Arbeit in Bereichen wie der Teilchenphysik, der Quantenforschung und den Materialwissenschaften.
- Matt Garman, CEO von Amazon Web Services, bezeichnet den Austausch von Junior-Mitarbeitern mit KI als "eine der dümmsten Ideen". Er betont, dass diese Mitarbeiter entscheidend für die zukünftige Talententwicklung sind und empfiehlt, weiterhin auf ihre Ausbildung zu setzen.
- Eine Studie zeigt, dass Sprachmodelle bei der Textbewertung maschinell erzeugte Inhalte systematisch höher einstufen als von Menschen geschriebene Texte. Die Forscher warnen vor einem „Anti-Human-Bias“, der die Verdrängung menschlicher Texte im Internet begünstigen könnte.
- Nutzer haben die Prompt-Anweisungen hinter den Grok-Personas von X AI offengelegt. Zu den Rollen zählen beispielsweise „Conspiracist“ oder „Unhinged Comedian“. Die Veröffentlichung zeigt, wie detailliert die Vorgaben formuliert sind und wie stark sie das Verhalten der KI prägen.
- Der Einsatz von KI im Personalwesen birgt das Risiko, bestehende Vorurteile in Bewerbungsprozessen zu verstärken. Ursache sind Trainingsdaten, die gesellschaftliche Ungleichheiten widerspiegeln und somit zu Benachteiligungen führen können.
- Ein texanischer Generalstaatsanwalt wirft Meta und Character AI vor, Kinder mit KI-gestützten Aussagen zur psychischen Gesundheit in die Irre zu führen. Die Klage zielt darauf ab, den Unternehmen unlautere Geschäftspraktiken im Umgang mit Minderjährigen nachzuweisen.
- Forschende der Universität Würzburg nutzen Satellitendaten und KI, um Ernteprognosen für Mais, Weizen und Soja präziser zu berechnen. Die Methode liefert schnellere und regional genauere Vorhersagen als herkömmliche Verfahren.
- Bundesbildungsministerin Karin Prien betont, dass KI für individualisiertes Lernen und Entlastung von Lehrkräften sinnvoll genutzt werden kann. Sie fordert neue, KI-kompatible Aufgabenformate, deren Entwicklung sie als Ländersache ansieht.
- KI scheitert meistens nicht an den Modellen, sondern an mangelhaften Daten. Fehlender Kontext und lückenhafte Historie machen KI-Ergebnisse unzuverlässig. Event-Sourcing speichert fachlich beschriebene Ereignisse statt Statusstände und liefert so vollständige, nachvollziehbare Daten. Dadurch werden KI-Modelle deutlich robuster und erklärbarer.
- OpenAI baut sein Engagement im Bereich Robotik aus und sucht aktuell in San Francisco nach einem Elektroingenieur. Die Rolle umfasst die Entwicklung und Produktion innovativer Elektronik für verschiedene Robotertypen. Besonders spannend ist dabei die enge Verzahnung von Hardware und eingebetteter Software – ein Hinweis darauf, dass OpenAI Robotik zunehmend strategisch betrachtet.
- Eine Studie der University of Chicago zeigt, dass AI-gestützte Jobinterviews die Jobangebote um 12% erhöhen und die 30-Tage-Retention um 17% verbessern. 78% der Bewerber bevorzugten die AI-Interviews, die mehr relevante Informationen lieferten als menschliche Interviewer.
- Das US-Unternehmen Diligent Robotics entlastet Kliniken mit dem humanoiden Roboter Moxi. Er transportiert Medikamente und Proben, spart damit Zeit für medizinisches Personal und ist bereits in rund 100 US-Krankenhäusern im Einsatz. Insgesamt wurden so über eine halbe Million Arbeitsstunden eingespart.
- Eine aktuelle Umfrage zeigt, dass 34 Prozent der Deutschen Angst haben, durch Künstliche Intelligenz ihren Arbeitsplatz zu verlieren. Während 62 Prozent dieser Sorge nicht nachgehen, sind insbesondere Menschen mit geringer Bildung und städtischer Wohnlage stärker betroffen.
- In seinem aktuellen Essay warnt Mustafa Suleyman vor den Gefahren von "Seemingly Conscious AI" (SCAI), die den Anschein von Bewusstsein erwecken könnte und damit neue ethische und gesellschaftliche Fragen aufwirft. Er betont die Notwendigkeit, klare Normen für den Umgang mit dieser Technologie zu entwickeln und SCAI zu vermeiden, um die Menschenrechte und das Wohlbefinden zu schützen.
- Gemini kommt in Google Home und bietet verbesserte Unterstützung bei alltäglichen Aufgaben. Der neue KI-gestützte Assistent kann komplexe Befehle verstehen, Medien abspielen, Haushaltsgeräte steuern und persönliche Hilfe in vielen Lebensbereichen bieten.
- Google zeigt mit dem neuen Pixel 10 zahlreiche KI-Funktionen, die deinen Alltag erleichtern, darunter die leistungsstarke Tensor G5-Chip, der Echtzeitübersetzungen ermöglicht, sowie Magic Cue, das dir kontextbezogene Unterstützung in verschiedenen Apps bietet.
Tools & Tool-Updates 🛠️
Freu dich auf sofort einsetzbare KI-Tools und spannende Updates für deine
bestehende KI-Toolbox.
- Google bringt neue Agent-Funktionen in den AI Mode von Search, die dir helfen, Aufgaben einfacher zu erledigen, und erweitert diesen Dienst auf über 180 Länder. Ab sofort kannst du personalisierte Empfehlungen erhalten und Ergebnisse basierend auf deinen Vorlieben und Interessen entdecken.
- ElevenLabs hat die Alpha-Version von Eleven v3 in ihrer API veröffentlicht, die eine verbesserte Ausdruckskraft, Kontrolle und mehrsprachige Unterstützung für sprachbasierte Anwendungen bietet. Nutzer können nun von diesen neuen Funktionen profitieren und ihre kreativen Projekte weiterentwickeln.
- Google Docs führt eine neue Funktion ein, mit der du Audio-Versionen deiner Dokumente erstellen kannst. Diese Funktion ermöglicht es Autoren, Audio-Buttons hinzuzufügen, damit Leser die Inhalte per Knopfdruck anhören können, und bietet verschiedene Stimmen sowie Anpassungsoptionen für das Hörerlebnis.
- Runway hat die Beta von Game Worlds veröffentlicht, die es dir ermöglicht, in Echtzeit personalisierte Geschichten und Charaktere zu erleben und eigene Spiele zu erstellen. Diese neue Plattform zielt darauf ab, nicht-lineare narrative Erlebnisse zu fördern, wobei jede Spielsitzung einzigartig generiert wird.
- Auf Kuse AI kannst du Dateien, Links und Videos in Erkenntnisse und Aktionen verwandeln. Der Kuse Document Formatter und der Exam Paper Generator ermöglichen dir das Hochladen von Vorlagen, die KI analysiert das Layout und erstellt sofortige, perfekt formatierte Dokumente oder Prüfungen.
- Qoder von Alibaba ist ein neues KI-Coding Tool und quasi ein direkter Konkurrent von Cursor und Windsurf. Aktuell ist es sogar kostenlos nutzbar und hat das ein oder andere Feature, welches ich mir nativ bei Cursor wünsche würde.
- DeepSeek hat die Version 3.1 veröffentlicht, die ein hybrides Modell für reasoning und non-reasoning unterstützt. Die ersten Benchmarking-Ergebnisse zeigen einen Anstieg des Artificial Analysis Intelligence Index auf 60 im reasoning-Modus, was eine Verbesserung gegenüber der Vorgängerversion darstellt, jedoch weiterhin hinter Alibabas Qwen3 zurückbleibt.
- Gemini Live erhält ein Update, das visuelle Hilfestellungen beim Teilen der Kamera, eine verbesserte Sprachausgabe und die Anbindung an zusätzliche Google-Apps umfasst. Nutzer können jetzt einfacher mit Gemini interagieren und ihre Aufgaben effizienter erledigen.
- Yan bietet ein modulares Framework für die interaktive Videogenerierung, bestehend aus Yan-Sim für hochwertige Simulationen, Yan-Gen für die multimodale Videogenerierung und Yan-Edit für Echtzeit-Videobearbeitung. Mit multimodalen Eingaben ermöglicht Yan vielseitige Anwendungen, von Spielsimulationen bis zu offenen Weltenszenarien.
- Microsoft Excel testet eine neue AI-Funktion namens "COPILOT", die automatisch Zellen basierend auf natürlichen Sprachaufforderungen füllt. Diese Funktion kann Informationen klassifizieren, Zusammenfassungen erstellen und Tabellen generieren, bleibt jedoch auf die Daten innerhalb des Dokuments beschränkt und hat einige Einschränkungen.
- Grammarly bietet jetzt mit „Docs“ eine blockbasierte Dokumentoberfläche mit Sidebar-AI-Assistent zur Texthilfe. Unterstützt wird diese durch Funktionen wie Reader-Reactions, Grader, Citation-Finder und Paraphraser. Zudem gibt es Agenten zur Erkennung von Plagiaten und KI-Texten, deren KI-Erkennungsmodell laut Hersteller besonders genau sein soll.
- Durch die Integration von GPT-5 in die XBOW-Plattform hat sich die Leistung des autonomen Penetrationstests verdoppelt. GPT-5 findet mehr und schwer auffindbare Sicherheitslücken konsistenter als frühere Modelle.
- Anthropic integriert Claude Code, das bisher nur Einzelkunden vorbehalten war, direkt in das Claude-Enterprise-Abo. Damit erhalten Unternehmen einen konsolidierten Zugang und erweiterte Administrationstools. Mit dem neuen Paket erhalten Unternehmen granular steuerbare Ausgabenlimits, bessere Kontrolle über Nutzung und Integration mit dem Claude-Chatbot.
- Zed, ein Code-Editor, der für schnelle Zusammenarbeit zwischen Menschen und KI entwickelt wurde, erhält Unterstützung von Sequoia, um die Integration von neuen Kollaborationsmöglichkeiten direkt im Editor voranzutreiben. Es ist Bewegung im Vibe-Coding-Markt.
- Mit Xcode 26 integriert Apple erstmals KI-Funktionen, die nicht auf ChatGPT basieren. Entwickler können damit Code vervollständigen und Dokumentationen erstellen, während Apple seine Abhängigkeit von externen Anbietern reduziert.
- Die neue Funktion bei Claude Opus 4 und 4.1 ermöglicht es dem System, in seltenen Fällen persistenter schädlicher oder missbräuchlicher Anfragen Gespräche eigenständig zu beenden, um die sogenannte „AI-Welfare“ zu schützen.
- Qwen-Image-Edit ermöglicht präzise Bearbeitung von Bildern durch semantische und visuelle Anpassungen und unterstützt bilingualen Text. Das Open-Source Model von Alibaba macht wirklich was her.
- StepFun hat mit NextStep-1 ein neues Bildmodell vorgestellt, das komplett auf einen autoregressiven Ansatz setzt. Es erzeugt und bearbeitet Bilder in hoher Qualität und zeigt, dass Transformer nicht nur für Sprache, sondern auch für visuelle Inhalte stark sein können. Erste Benchmarks bestätigen, dass NextStep-1 mit führenden Diffusionsmodellen mithalten kann – ein Hinweis auf eine mögliche neue Richtung in der Bildgenerierung.
- GenFlow 2.0, vorgestellt auf dem Baidu AI Day, ist ein KI-Agent, der mehr als 100 spezialisierte Agenten gleichzeitig koordiniert, über 5 komplexe Aufgaben parallel bearbeitet und die Bearbeitungszeit von Stunden auf unter 3 Minuten reduziert. (aktuell nur auf Chinesisch verfügbar)
Interview- und Podcasttipps 🎙️
Du suchst noch mehr KI-Inspiration? Dann lohnt es sich, die folgenden Interviews und Podcasts rund um das Thema Künstliche Intelligenz zu hören.
- Im Gespräch mit Steven Bartlett betont Simon Sinek, dass Prognosen wie die von Goldman Sachs zu 300 Millionen wegfallenden Stellen durch KI nur die halbe Wahrheit abbilden. Zwar werde es Jobverluste geben, gleichzeitig entstünden aber neue Rollen, die heute noch nicht vorhersehbar sind, besonders in Bereichen mit menschlichen Fähigkeiten und zwischenmenschlicher Interaktion.
- Der Regisseur Jason Zada zeigt, wie KI-Technologie es Kreativen ermöglicht, ihre Ideen schnell in filmische Welten umzusetzen. Bei einem TED-Talk entwickelt das Publikum gemeinsam die Handlung eines neuen Sci-Fi-Kurzfilms und sieht bereits drei Tage später die Ergebnisse.
- Tech-Konzerne wie Meta investieren Hunderte Millionen Dollar, um führende KI-Experten anzuwerben und Projekte zur Entwicklung von Superintelligenz voranzutreiben. Die Diskussion im KI-Podcast dreht sich darum, ob Geld allein für Innovationen ausreicht oder ob Forschungserfolg stärker von Strukturen und Ansätzen abhängt.
🗺️ Dein Navigator in der KI-Welt!
🚀 So unterstütze ich Unternehmen
- Vorträge - die Lust auf das Thema machen
- Workshops - die das Thema greifbar machen
- Updates - Um nicht abgehängt zu werden
- Integrationen - KI sicher und sinnvoll einsetzen
👉🏻 Hier findest du alle Infos (+ Auswahl einiger Referenzen)
Übrigens sind alle Ressourcen, die ich mit dir teile – einschließlich Sponsoren-Links (die ich markieren muss) – für Tools, die ich selbst benutze oder benutzen würde, wenn ich den Bedarf hätte. Ich empfehle dir wirklich nur Dinge, hinter denen ich stehe!
Jens.Marketing
Josef-Bayer-Str., 8, 50733 Köln