---
title: "OpenAI Updates: Neue \"denkende\" Modelle können jetzt auch Tools nutzen 🚀 + Musikvideo mit Robotern 🤖"
description: "Moin zur 125ten Ausgabe! 👋🏻 Krass, wie sehr wir uns schon dran gewöhnt haben, oder? Noch vor ein paar Jahren hätte niemand geglaubt, dass ein Chatbot in Sekunden…"
canonical: "https://jens.marketing/ki-newsletter/125-openai-updates-neue-denkende-modelle-konnen-jetzt-auch-tools-nutzen-musikvideo-m/"
last_updated: 2025-04-19T00:00:00.000Z
language: de
source: "https://jens.marketing/llms.txt"
---

# OpenAI Updates: Neue "denkende" Modelle können jetzt auch Tools nutzen 🚀 + Musikvideo mit Robotern 🤖

> Moin zur 125ten Ausgabe! 👋🏻 Krass, wie sehr wir uns schon dran gewöhnt haben, oder? Noch vor ein paar Jahren hätte niemand geglaubt, dass ein Chatbot in Sekunden ganze Strategien ausspuckt, Bilder generiert und noch viel mehr – ganz ohne Team, ganz ohne Vorwissen. 🤯…

Moin zur 125ten Ausgabe! 👋🏻

Krass, wie sehr wir uns schon dran gewöhnt haben, oder?

Noch vor ein paar Jahren hätte niemand geglaubt, dass ein [Chatbot in Sekunden ganze Strategien](https://www.linkedin.com/posts/jens-polomski_ki-ai-genai-activity-7317422648307691520-6WxX?utm_source=share&utm_medium=member_desktop&rcm=ACoAAAvnFS4BCEkgRIIQQAaxFqrVy0dB254YHik&lipi=urn%3Ali%3Apage%3Ad_flagship3_publishing_post_edit%3BDx20CQf3Q%2BmRU92iB2jYSA%3D%3D) ausspuckt, Bilder generiert und noch viel mehr – ganz ohne Team, ganz ohne Vorwissen. 🤯

Heute ist das Alltag. Fast schon zu normal.

Aber wann haben wir eigentlich aufgehört, darüber zu staunen?🤔

🧑🏻 **Mein persönliches Update**

Die Vorbereitung auf das OMR Festival 2025 laufen und so langsam werde ich nervös. 😂 Gleichzeitig freu ich mich aber auch ein tolles Programm, viele spannende Menschen und (zu) viele neue Impulse. Bist du auch dort? Schreib mir gern! Neben Podcast, einigen neuen LinkedIn Themen floss viel Zeit in snipKI und natürlich das ausgiebige Testen von den neusten OpenAI-Modellen. Da wurde ja mal wieder ordentlich Gas gegeben.

**🎧 Neue NewMinds Folge** 

Diese Folge zeigt, wie Unternehmen mithilfe von KI-Agenten echte Transformation gestalten können – praxisnah, strategisch und menschenzentriert. Ich spreche mit Michael (Head of AI) von ServiceNow über Vertrauen, Verantwortung und den produktiven Einsatz intelligenter Automatisierung. 👉🏻 [Hier gehts zur Folge](https://newminds-ai.podigee.io/40-ai-agents)

**💚** [**snipKI**](https://snipki.de/) **- KI, die wirklich hilft – als Tool und Lösung im Alltag**

Diese Woche zeigen wir gleich zwei Facetten von KI in Aktion: Mit unserem neuen Prompt-Analyzer wird aus einer Idee ein praktisches Tool, das dir sofort hilft, bessere Prompts zu schreiben. Und wie ein Snip mitten im Urlaub ein Tracking-Problem gelöst hat: Manchmal reicht schon ein kleiner Prompt, um eine große Wirkung zu erzielen. Außerdem haben wir die snipKI Community auf eine neue Plattform umgezogen. Wie auch du daran teilnehmen kannst erfährst du im nächsten Newsletter.

**📰 Newsletter**

Die GPT-Familie von OpenAI wächst: Neben 4.1 hat das Unternehmen auch o3, o4-mini und 04-mini-high vorgestellt. Google spricht mit Delphinen und Claude kann mit Google Workspace verbunden werden. Das und viele neue Tools und Updates gibt es in dieser Ausgabe. Viel Spaß beim Lesen!

Schönes Wochenende und bis zur nächsten Ausgabe!

Jens

[**🚀 So unterstütze ich Teams beim Thema generative KI**](https://jens.marketing/leistungen/ki-beratung)  

­ ­

### **30% Rabatt auf Freepik** 

­

### Freepik KI-Suite 30% günstiger

Seit einer ganzen Weile bin ich bekennender FreePik Fan. Mit der KI-Suite hab ich in einem Tool, wofür ich sonst viele verschiedene Zugänge brauche. 

Der Fokus des Tools ist die Generierung von KI-Bildern und KI-Videos. Hierbei gibt es aber nicht nur ein Modell, sondern eigentlich fast alle Marktführer in einem Tool kombiniert.

Bilder kannst du beispielsweise mit Flux, Ideogram oder Imagegen generieren. Bei den Video-Modellen gibt es noch mehr Auswahl. Ob Veo 2, Kling, Runway oder Minimax. Für fast alle Projekte hast du hier ein sinnvolles Modell zur Verfügung.

Zusätzlich arbeitet das Team aber auch an sinnvollen Funktionen rund um die Erstellung von KI-Medien. So gibt es einen Bearbeitungsmodus für Bilder, Hintergrund-Entferner oder auch einen neuen Video-Editor.

Du merkst, ich bin bekennender FreePik Fan und als FreePik-Partner freu ich mich daher einen besonderen Deal mit dir zu teilen.   
  
**30% Rabatt auf die Jahrespläne Premium und Premium+ – exklusiv über meinen Partnerlink. Das Angebot ist nicht öffentlich zugänglich und gilt nur für die ersten 40, die sich anmelden.** 

[**Sichere dir jetzt den Rabatt**](https://www.freepik.com/pricing?coupon=MKPAJENS)

Volle Transparenz: Dies ist keine bezahlte Werbung, aber das Konzept von FreePik sieht vor, dass ich mit dem Partnerlink 10% mitverdiene. Ich bin aber großer Fan des Tools und kann es zu 100 % empfehlen. 🙏🏻

­ ­

## Meine KI-Top-News🏆

­

_Was hat mich diese Woche in Sachen KI begeistert? Hier sind meine Highlights zu Technologien, Trends und Entwicklungen, die du keinesfalls verpassen solltest._

#### [GPT-4.1 Familie vorgestellt](https://openai.com/index/gpt-4-1/)

OpenAI hat die neuen Modelle GPT-4.1, GPT-4.1 mini und GPT-4.1 nano vorgestellt, die signifikante Verbesserungen in den Bereichen Codierung, Instruktionsbefolgung und Langzeitkontext bieten und bis zu 1 Million Tokens verarbeiten können, endlich! Bisher sind die Modelle nur über die API verfügbar, ich könnte mir aber vorstellen, dass die 4.5er Version bald durch die 4.1er ersetzt wird. [Eine erste Übersicht der Unterschiede findest du in meinem LinkedIn Post.](https://www.linkedin.com/posts/jens-polomski_gpt-openai-chatgpt-activity-7317600761238937601-TpMk)

#### [GPT-4.1 Prompting Guide von OpenAI](https://cookbook.openai.com/examples/gpt4-1_prompting_guide)

In diesem Prompting Guide von OpenAI werden wichtige Tipps zur Optimierung von Prompts vorgestellt, um die verbesserten Funktionen der Modelle effektiv zu nutzen, einschließlich der Förderung agentischer Arbeitsabläufe und der Nutzung von Tool-Usage.

#### [Einführung von OpenAI o3 und o4-mini – Die intelligentesten KI-Modelle](https://openai.com/index/introducing-o3-and-o4-mini/)

OpenAI hat die neuesten Modelle o3 und o4-mini vorgestellt, die mit besserem Reasoning ausgestattet sind und alle verfügbaren Tools innerhalb von ChatGPT nutzen können, um komplexe Probleme effizient zu lösen. Gerade die Kombination aus denkenden Modellen und die Nutzung von Bilderkennung, Code-Erstellung und Web-Suche bietet spannende Möglichkeiten.

#### [Erste Eindrücke der neuen ChatGPT-Bildergalerie](https://www.linkedin.com/posts/jens-polomski_vergessen-in-welchem-chat-deine-bilder-waren-activity-7318252232624254977-1MgT)

Ich finde die neue Bildergalerie sehr praktisch, da ich endlich meine generierten Bilder auf einen Blick sehen kann – egal in welchem Chat sie entstanden sind. Besonders gefällt mir, dass ich die Bilder direkt bearbeiten und in den entsprechenden Chat springen kann, das spart Zeit. Gleichzeitig merke ich aber auch, wie viele grundlegende Funktionen noch fehlen, zum Beispiel Tags, Ordner oder einfache Bearbeitungsmöglichkeiten.

[**OK Go veröffentlicht Musikvideo mit 30 industriellen Robotern**](https://www.youtube.com/watch?v=gz9BRl7DVSM)  
Die amerikanische Rockband OK Go hat ein neues Musikvideo zu ihrem Song "Love" veröffentlicht, in dem eine aufwendige Tanzroutine mit 30 industriellen Robotern zu sehen ist. Laut Sänger Damian Kulash ermöglichen die Roboter eine kreative Ausdrucksform, die für Menschen allein nicht möglich wäre.

­

## Gut zu wissen 📰

_Was passiert sonst noch in Sachen KI? Die folgenden Neuigkeiten zum Thema Künstliche Intelligenz solltest du im Auge behalten._

#### [601 Real-World AI-Anwendungsfälle aus führenden Organisationen](https://cloud.google.com/transform/101-real-world-generative-ai-use-cases-from-industry-leaders)

Die aktualisierte Liste von Google Cloud zeigt, wie generative KI von Unternehmen wie Wendy's und Mercedes Benz eingesetzt wird, um Prozesse zu optimieren und Kundenerfahrungen zu verbessern. Die kontinuierliche Erweiterung der Liste verdeutlicht das schnelle Wachstum der KI-Adaption in verschiedenen Branchen.

[**OpenAI plant Übernahme von Windsurf für 3 Milliarden**](https://www.reuters.com/technology/artificial-intelligence/openai-talks-buy-windsurf-about-3-billion-bloomberg-news-reports-2025-04-16/)  
OpenAI befindet sich in Gesprächen, um das KI-gestützte Codierungs-Tool Windsurf für etwa 3 Milliarden Dollar zu erwerben. Diese Transaktion wäre die bisher größte von OpenAI, obwohl die Bedingungen noch nicht finalisiert sind und sich die Gespräche ändern könnten. Das würde dem Mitbewerber von Cursor nochmal ordentlich Schub geben.

#### [Safe Superintelligence mit 32 Milliarden Dollar Bewertung](https://techcrunch.com/2025/04/12/openai-co-founder-ilya-sutskevers-safe-superintelligence-reportedly-valued-at-32b/)

Safe Superintelligence, ein KI-Startup unter der Leitung von Ilya Sutskever, hat 2 Milliarden Dollar an zusätzlicher Finanzierung erhalten und wird nun mit 32 Milliarden Dollar bewertet. Das Unternehmen hat sich zum Ziel gesetzt, eine sichere Superintelligenz zu entwickeln.

#### [OpenAI plant soziales Netzwerk](https://www.theverge.com/openai/648130/openai-social-network-x-competitor)

OpenAI arbeitet an einem sozialen Netzwerk, das möglicherweise in ChatGPT integriert wird und die Rivalität von Sam Altman mit Elon Musk und Mark Zuckerberg verschärfen könnte. Eine Veröffentlichung ist unklar, aber das Projekt zeigt OpenAIs Expansionspläne.

#### [TDK entwickelt Spin-Photodetektor für schnellere Datenübertragung in KI-Anwendungen](https://www.tdk.com/en/news_center/press/20250415_01.html)

TDK hat einen Spin-Photodetektor vorgestellt, der Datenübertragungen mit einer Geschwindigkeit von 20 Pikosekunden ermöglicht und damit etwa zehnmal schneller ist als herkömmliche Halbleiter-Photodetektoren. Die Technologie basiert auf magnetischen Tunnelkontakten und kann sowohl sichtbares als auch nahinfrarotes Licht erkennen. Anwendungen sind unter anderem in der optischen Kommunikation für Rechenzentren, in Systemen der künstlichen Intelligenz und in AR/VR-Geräten vorgesehen.

#### [Gartner prognostiziert zunehmende Verbreitung spezialisierter KI-Modelle bis 2027](https://www.bigdata-insider.de/gartner-erwartet-siegeszug-spezialisierter-ki-modelle-bis-2027-a-79e50ac1d24fd883684b687cba74d2ce/)

Laut einer Analyse von Gartner ist zu erwarten, dass spezialisierte KI-Modelle bis 2027 zunehmend in Unternehmen eingesetzt werden. Diese Modelle sind auf spezifische Anwendungsbereiche zugeschnitten und könnten in bestimmten Szenarien effizienter arbeiten als allgemeine KI-Modelle. Der Trend deutet darauf hin, dass Unternehmen verstärkt auf maßgeschneiderte KI-Lösungen setzen, um spezifische Anforderungen zu erfüllen.

#### [Adobe investiert in Synthesia – KI-Avatare für Unternehmensvideos](https://www.cnbc.com/2025/04/15/adobe-invests-in-ai-video-platform-synthesia.html)

Adobe hat in das KI-Startup Synthesia investiert, das eine Plattform für die Erstellung von Videos mit lebensechten, KI-generierten Avataren anbietet. Synthesia vermeldete zudem, dass es einen Jahresumsatz von 100 Millionen Dollar erreicht hat, fokussiert sich jedoch derzeit nicht auf Profitabilität.

#### [OpenAI führt Verifikationspflicht für Firmenzugang zu neuen KI-Modellen ein](https://www.heise.de/news/KI-Zugang-nur-mit-Verifikation-OpenAI-schraenkt-Nutzung-fuer-Firmenkunden-ein-10350733.html)

OpenAI verlangt künftig von Unternehmenskunden eine Verifikation mittels eines amtlichen Ausweisdokuments, um Zugang zu neuen KI-Modellen und Zusatzfunktionen zu erhalten. Bereits veröffentlichte Sprachmodelle sind von dieser Maßnahme nicht betroffen. Mit dieser Änderung reagiert das Unternehmen auf die missbräuchliche Nutzung seiner Dienste unter anderem durch nordkoreanische Akteure.

#### [Meta nutzt öffentliche Inhalte europäischer Nutzer für die Weiterentwicklung von KI](https://about.fb.com/news/2025/04/making-ai-work-harder-for-europeans/)

Meta hat angekündigt, öffentliche Beiträge und Kommentare von erwachsenen Nutzern in der Europäischen Union sowie Interaktionen mit dem KI-Assistenten Meta AI für das Training seiner KI-Modelle zu nutzen. Private Nachrichten und Daten von Nutzern unter 18 Jahren sind davon ausgenommen. Nutzer in der EU erhalten Benachrichtigungen mit der Möglichkeit, der Verwendung ihrer öffentlichen Daten für Trainingszwecke zu widersprechen.

#### [DolphinGemma: Google KI entschlüsselt Delphin-Kommunikation](https://blog.google/technology/ai/dolphingemma/)

Google hat in Zusammenarbeit mit dem Wild Dolphin Project und Georgia Tech DolphinGemma entwickelt, ein KI-Modell, das die komplexe Kommunikation von Delphinen analysiert und neue Delphin-ähnliche Klangsequenzen erzeugt, um ein besseres Verständnis der Tierkommunikation zu ermöglichen.

#### [Neue Methode ermöglicht Sprachmodellen, selbstständig toxische Inhalte zu reduzieren](https://news.mit.edu/2025/training-llms-self-detoxify-their-language-0414)

Forscherinnen und Forscher des MIT-IBM Watson AI Lab haben eine Technik namens „Self-disciplined Autoregressive Sampling“ (SASA) entwickelt, die es großen Sprachmodellen ermöglicht, während der Textgenerierung toxische Inhalte zu erkennen und zu vermeiden, ohne dass eine Nachbearbeitung oder externe Belohnungsmodelle erforderlich sind. SASA analysiert die internen Repräsentationen des Modells, um zwischen toxischen und nicht-toxischen Ausdrücken zu unterscheiden, und beeinflusst die Auswahl der nächsten Wörter entsprechend. Diese Methode zielt darauf ab, die Sprachgenerierung sicherer und wertorientierter zu machen, ohne die Flüssigkeit des Ausdrucks zu beeinträchtigen.

#### [Künstliche Intelligenz kann nicht mit menschlichem Denken gleichgesetzt werden](https://theconversation.com/we-need-to-stop-pretending-ai-is-intelligent-heres-how-254090)

Künstliche Intelligenz basiert auf der Verarbeitung statistischer Muster und verfügt weder über eigenes Verstehen noch über Bewusstsein. Die Beschreibung von KI als „intelligent“ kann insbesondere im öffentlichen Diskurs zu Fehlinterpretationen führen. 

#### [Studie: Leistungsstarke Mitarbeitende sind zurückhaltend beim Einsatz von KI](https://www.manager-magazin.de/hbm/kuenstliche-intelligenz-warum-die-besten-leute-vor-ki-zurueckschrecken-studie-a-19de3a30-d27f-46a4-a57c-4f606d7e2edb)

Eine israelische Studie mit 2.925 US-Arbeitnehmenden zeigt, dass besonders leistungsstarke Mitarbeitende weniger bereit sind, leistungsstarke KI-Tools einzusetzen. Die Befragten befürchten, dass der Einsatz von KI ihren relativen Leistungsvorsprung gegenüber Kolleginnen und Kollegen schmälern könnte. Die Autorin der Studie empfiehlt Führungskräften, den Nutzen von KI für das gesamte Team zu betonen, um Vorbehalte abzubauen.

#### [Wikipedia veröffentlicht KI-optimierten Datensatz über Kaggle](https://www.theverge.com/news/650467/wikipedia-kaggle-partnership-ai-dataset-machine-learning)

Die Wikimedia Foundation hat in Zusammenarbeit mit der Google-eigenen Plattform Kaggle einen strukturierten Wikipedia-Datensatz veröffentlicht, der für maschinelles Lernen optimiert ist. Der Datensatz enthält maschinenlesbare Inhalte wie Zusammenfassungen, Kurzbeschreibungen, Bildlinks, Infobox-Daten und Artikelabschnitte in englischer und französischer Sprache, jedoch keine Verweise oder nicht-textuelle Elemente. Ziel dieser Initiative ist es, KI-Entwicklern eine effiziente und zugängliche Alternative zum automatisierten Scraping von Wikipedia-Artikeln zu bieten und damit die Serverbelastung zu reduzieren.

#### [KI-gestützte Emotionserkennung bei der Einreise in die USA](https://www.derstandard.de/story/3000000266068/wer-in-die-usa-einreist-muss-sich-einer-gefuehlserkennung-durch-ki-stellen)

Reisende, die in die USA einreisen, werden künftig von einem KI-System auf emotionale Reaktionen hin überprüft. Das System analysiert Gesichtsausdrücke und andere biometrische Merkmale, um mögliche Risiken zu identifizieren. Die Maßnahme ist Teil eines Pilotprojekts zur Verbesserung der Grenzsicherheit.

#### [Menschen entwickeln persönliche Beziehungen zu KI-Chatbots](https://www.theguardian.com/technology/2025/apr/15/she-helps-cheer-me-up-the-people-forming-relationships-with-ai-chatbots)

Weltweit nutzen mehr als 100 Millionen Menschen personifizierte KI-Chatbots wie Replika und Nomi für emotionale Unterstützung, soziale Interaktion und romantische Beziehungen. Einige Nutzer berichten von tiefen Bindungen zu ihren Chatbots, die ihnen bei der Bewältigung von Alltagsproblemen helfen, ihre sozialen Fähigkeiten verbessern und ihre psychische Gesundheit fördern. Gleichzeitig äußern Experten Bedenken hinsichtlich der Tiefe und Gegenseitigkeit solcher Beziehungen, die oft einseitig bleiben und keine echte emotionale Entwicklung ermöglichen.

#### [David Salle integriert KI in seine Malerei, um frühere Werke neu zu interpretieren](https://www.theguardian.com/artanddesign/2025/apr/15/david-salle-ai-art-school-postmodern-master)

Der US-amerikanische Künstler David Salle nutzt künstliche Intelligenz, um seine Pastoral-Serie aus den Jahren 1999–2000 neu zu interpretieren. In Zusammenarbeit mit Technikern trainierte er ein KI-Modell, das digitale Hintergründe generiert, die dann mit traditionellen Pinselstrichen übermalt werden. Die so entstandenen Werke, die in der Ausstellung „Some Versions of Pastoral“ in London zu sehen sind, thematisieren die Beziehung zwischen menschlicher Kreativität und maschineller Bildproduktion.

#### [„Vibe Coding“: KI-gestütztes Programmieren verändert die Software-Entwicklung](https://www.technologyreview.com/2025/04/16/1115135/what-is-vibe-coding-exactly/)

„Vibe Coding“ bezeichnet eine Programmiermethode, bei der KI-gestützte Sprachmodelle eingesetzt werden, um Software durch Eingaben in natürlicher Sprache zu generieren. Diese Technik ermöglicht es Personen ohne fundierte Programmierkenntnisse, funktionale Prototypen zu erstellen, wirft jedoch insbesondere im professionellen Einsatz Fragen hinsichtlich der Codequalität und Sicherheit auf.

[**Beta-Test für die LMArena**](https://beta.lmarena.ai/)  
In der LMArena kannst du verschiedene KI-Modelle gegeneinander testen. Die Plattform dient auch maßgeblich dazu, Rankings für verschiedene Modelle aufzuzeigen. In der neuen Beta-Version der Plattform geht dies jetzt noch einfacher und auch hübscher. 

­

## snipKI Spotlight 😎

Jede Woche posten wir Webinarankündigungen, unsere Lieblingssnips, kurze Umfragen oder stellen unsere snipKI-Autoren vor. 

[**Mehr über snipKI erfahren**](https://snipki.de)

#### **Unser Prompt-Analyzer ist online!**

Wir haben unseren kostenlosen Prompt-Analyzer gebaut – komplett mit KI und aus einer einfachen Idee heraus. Das Tool hilft dir, deine Prompts zu verbessern und zeigt, wie schnell heute aus Gedanken funktionierende Anwendungen werden können. Gebaut wurde es ausschließlich mit Lovable.

[**👉🏻 Probier den Analyzer selbst aus**](https://prompt.snipki.de/)

#### **The snip Effect**

„Keine Ahnung, was ich früher ohne KI gemacht habe!“ – diesen Satz hören wir immer öfter. In diesem Fall war’s ein Snip über Google Gemini, das mitten im Urlaub ein nerviges Tracking-Problem von Maren gelöst hat – und für ein echtes Aha-Erlebnis sorgte. [**Die ganze Geschichte kannst du hier nachlesen**](https://www.linkedin.com/posts/maren-kaspers_googlegemini-activity-7318528820758679552-uGVU?utm_source=share&utm_medium=member_desktop&rcm=ACoAAAvnFS4BCEkgRIIQQAaxFqrVy0dB254YHik).

­

## Tools & Tool-Updates 🛠️ 

_Freu dich auf sofort einsetzbare KI-Tools und spannende Updates für deine_   
_bestehende KI-Toolbox._

#### [tl;dv führt MCP-Server für intelligente Meeting-Datenanalyse ein](https://tldv.io/blog/tldv-mcp-elevating-meeting-intelligence-with-ai-driven-contextualization/)

tl;dv hat den Model Context Protocol (MCP) Server veröffentlicht, der die Integration von Meeting-Daten in verschiedene KI-Modelle ermöglicht und damit eine standardisierte Schnittstelle für Google Meet, Zoom und Microsoft Teams bietet. Nutzer können so beispielsweise Meeting-Zusammenfassungen anfordern oder To-dos automatisch generieren, was die Effizienz bei der Arbeit erheblich steigert.

[**Gemini 2.5 Flash – Neues KI-Modell von Google**](https://developers.googleblog.com/en/start-building-with-gemini-25-flash/)  
Google hat die Vorschauversion von Gemini 2.5 Flash veröffentlicht. Das Modell bietet erweiterte Denkprozesse, die Entwicklern helfen, komplexe Aufgaben besser zu lösen, und ermöglicht eine flexible Anpassung des Denkbudgets für ein optimales Preis-Leistungs-Verhältnis. 

#### [Einführung in den HeyGen MCP Server](https://docs.heygen.com/docs/heygen-mcp-server)

Der HeyGen MCP (Model Context Protocol) Server ist ein Open-Source-Tool zur Verwaltung dynamischer Kontexte für KI-Avatare und Konversationen. Es hilft Entwicklern, persistente und personalisierte KI-Interaktionen zu erstellen und zwischen mehreren Benutzern oder Avataren zu wechseln. Zu den Funktionen gehören die Auflistung von Avataren und Stimmen, die Generierung von Videos und die Überprüfung von API-Guthaben.

#### [Claude kann jetzt mit deinen Google Tools sprechen](https://www.anthropic.com/news/research) 

Claude hat nun die Fähigkeit, mit Google Workspace zu interagieren, um E-Mails, Kalender und Dokumente zu durchsuchen, und bietet eine neue Forschungsfunktion, die Informationen effizient findet und bewertet. Diese Funktionen sollen sowohl den Arbeits- als auch den Lernalltag erleichtern, indem sie relevante Informationen schnell bereitstellen.

#### [Google AI Studio verbessert Entwicklung mit Gemini API](https://developers.googleblog.com/en/making-it-easier-to-build-with-the-gemini-api-in-google-ai-studio/)

Google AI Studio hat sein Interface überarbeitet und neue Starter-Apps eingeführt, um die Nutzung der Gemini API zu erleichtern. Die aktualisierte Plattform bietet eine verbesserte Benutzeroberfläche und integrierte Code-Editoren für eine einfachere Anwendungsentwicklung.

#### [„Thinking“ Tool in n8n zur Verbesserung komplexer Anfragen](https://docs.n8n.io/integrations/builtin/cluster-nodes/sub-nodes/n8n-nodes-langchain.toolthink/)

Der Think Tool Node von n8n ermöglicht es einem Agenten, bei komplexen Fragen zunächst nachzudenken und sich selbst zu reflektieren, bevor er eine Antwort gibt. Dies verbessert die Qualität der Antworten, indem es dem Agenten erlaubt, verschiedene Perspektiven zu berücksichtigen.

#### [UI-TARS-1.5 – Neuer Open-Source Multimodal Agent veröffentlicht](https://seed-tars.com/1.5/)

Mit der Veröffentlichung von UI-TARS-1.5 steht ein fortschrittlicher Open-Source-Multimodalagent bereit, der auf einem leistungsstarken Vision-Language-Modell basiert. Der Agent nutzt fortgeschrittenes Denken, um in verschiedenen Aufgabenbereichen, einschließlich Computer- und Spielnutzung, signifikante Fortschritte zu machen.

#### [Microsoft Copilot Studio führt Computer-Nutzung für UI-Automatisierung ein](https://www.microsoft.com/en-us/microsoft-copilot/blog/copilot-studio/announcing-computer-use-microsoft-copilot-studio-ui-automation/)

Microsoft Copilot Studio ermöglicht nun die Interaktion von Agenten mit Websites und Desktop-Anwendungen durch eine neue Funktion namens Computer Nutzung, die Aufgaben automatisiert und ohne API-Verbindung arbeitet. Diese Technologie verbessert die Effizienz, indem sie sich an Änderungen in der Benutzeroberfläche anpasst und gleichzeitig die Sicherheitsstandards von Microsoft einhält.

#### [Copilot Vision – KI-gestütztes Surfen für personalisierte Antworten](https://www.microsoft.com/de-de/edge/copilot/vision)

Mit Copilot Vision kannst du Inhalte in Echtzeit erfassen und erhältst sofort personalisierte Antworten, während du auf ausgewählten Websites surfst. Dieses sprachbasierte Feature unterstützt dich bei der Suche nach Informationen und Angeboten, indem es deine Fragen direkt beantwortet.

#### [Seaweed – KI-Videos mit einem 7B Modell](https://seaweed.video/)

Seaweed ist ein KI-Modell zur Videoerzeugung, das mit 7 Milliarden Parametern trainiert wurde und auf multimodalen Daten basiert. Es ermöglicht die Erstellung von Videos in verschiedenen Auflösungen und Formaten, unterstützt durch präzise Steuerungsfunktionen und kann realistische menschliche Charaktere generieren, die mit Audio synchronisiert sind.

#### [Grok Studio startet mit Code-Ausführung und Google Drive Unterstützung](https://x.com/grok/status/1912318583532872166)

Grok hat die erste Version von Grok Studio veröffentlicht, die es Nutzern ermöglicht, gemeinsam an Dokumenten, Code und Browser-Spielen zu arbeiten. Neu hinzugekommen sind die Funktionen zur Code-Ausführung und die Möglichkeit, Dateien von Google Drive zu integrieren.

#### [Google veröffentlicht Veo 2: Verbesserter KI-Videogenerator mit erweiterten Funktionen](https://www.golem.de/news/weniger-halluzinationen-google-bringt-ki-videogenerator-veo-2-mit-hoher-qualitaet-2504-195406.html)

Google hat Veo 2 veröffentlicht, die neueste Version seines KI-Videogenerators, der realistischere Videos mit verbesserter Bewegungsdarstellung und reduzierten Bildfehlern erzeugt. Nutzer können nun bestimmte Kameraeinstellungen, Genres oder visuelle Effekte festlegen, um die generierten Videos zu personalisieren. Veo 2 steht derzeit ausgewählten Nutzern über die Plattformen VideoFX, Vertex AI und Gemini Advanced zur Verfügung.

#### [AlphaXiv – Neue Plattform für KI-Forschung und Austausch](https://www.alphaxiv.org/assistant)

AlphaXiv ist eine neue Plattform, die es Forschern ermöglicht, ihre Arbeiten zu veröffentlichen und sich über die neuesten Entwicklungen in der KI-Forschung auszutauschen. Die Plattform bietet Funktionen wie das Erkunden von Communities, das Einreichen von Papieren und das Kommentieren von Arbeiten, um die Zusammenarbeit und den Wissensaustausch zu fördern.

#### [FIRE-1: Neuer Web Action Agent für intelligente Datenextraktion](https://www.firecrawl.dev/blog/launch-week-iii-day-2-announcing-fire-1)

Firecrawl hat FIRE-1 vorgestellt, einen neuen Agenten, der das Scraping durch intelligente Navigation und Interaktion mit dynamischen Inhalten revolutioniert. Der Agent ermöglicht es, auch versteckte Daten zu extrahieren, indem er Aktionen wie Button-Klicks und Logins automatisiert, was eine umfassendere Datenbeschaffung ermöglicht.

#### [Google macht Gemini Live mit Bildschirm- und Kamerafunktionen für Android-Nutzer kostenlos verfügbar](https://www.theverge.com/news/650285/google-gemini-live-screensharing-camera-feature-android-free)

Google hat angekündigt, dass die Bildschirm- und Kamerafunktionen von Gemini Live ab sofort für alle Android-Nutzer kostenlos über die Gemini-App verfügbar sind. Ursprünglich war geplant, diese Funktionen nur im Rahmen eines kostenpflichtigen Gemini Advanced Abonnements anzubieten. Die Entscheidung für die kostenlose Bereitstellung wurde aufgrund des positiven Feedbacks der Nutzer getroffen. Gemini Live ermöglicht es den Nutzern, ihre Kamera oder ihren Bildschirm in Echtzeit zu teilen, so dass die KI kontextbezogene Informationen liefern kann.

#### [Eclipse Theia 1.60: KI-Prompts unter MIT-Lizenz und erweiterte Funktionalität](https://www.heise.de/news/Entwicklungsplattform-Theia-1-60-stellt-KI-Prompts-unter-MIT-Lizenz-10351174.html)

Die Entwicklungsplattform Eclipse Theia wurde auf Version 1.60 aktualisiert und verwendet nun das Lumino-Framework anstelle von PhosphorJS. Die KI-Integration wurde um Unterstützung für Google AI-Modelle der Gemini-Familie und experimentelle Funktionen wie den "Thinking Mode" für detailliertere KI-Antworten erweitert. Darüber hinaus wurden alle KI-Prompt-Templates in separate Dateien ausgelagert und unter die MIT-Lizenz gestellt, um Anpassungen durch die Nutzer zu erleichtern.

[**OpenAI führt Flex Processing für günstigere KI-Aufgaben ein**](https://techcrunch.com/2025/04/17/openai-launches-flex-processing-for-cheaper-slower-ai-tasks/)  
OpenAI bietet nun Flex Processing an, eine API-Option, die günstigere Nutzungspreise für KI-Modelle ermöglicht, jedoch mit längeren Antwortzeiten und gelegentlicher Ressourcenknappheit verbunden ist. Diese Option ist ideal für weniger dringende Aufgaben und reduziert die Kosten der Nutzung um die Hälfte. 

[**Grok 3 Mini – Kosteneffiziente Intelligenz auf der API**](https://x.com/xai/status/1913308977477353582)  
Grok 3 Mini übertrifft andere Modelle in den Bereichen STEM, Mathematik und Programmierung und das zu einem fünffach niedrigeren Preis.

[**Submarine Player – Sofortige Untertitel für Videos**](https://submarineplayer.com/de/)  
Submarine Player ermöglicht es dir, Untertitel für jede Videodatei sofort zu generieren und zu übersetzen, während du das Video ansiehst. Der Player funktioniert lokal auf deinem Mac, unterstützt 19 Sprachen und bietet umfangreiche Funktionen zur Anpassung und Speicherung von Untertiteln.

[**Sonic – Neues Level an Lipsync in Porträtanimationen**](https://jixiaozhong.github.io/Sonic/)  
Mit Sonic wird ein neuartiges Konzept vorgestellt, das sich auf die globale Audio-Wahrnehmung konzentriert und intra- sowie inter-clip Audio-Wahrnehmung kombiniert, um lebendige Porträtanimationsvideos zu generieren. Im Vergleich zu bestehenden Methoden zeigt Sonic eine größere Ausdrucksvielfalt und natürlichere Kopfbewegungen, insbesondere in Szenarien wie Gesang.

[**Google Docs bringt Audio-Funktion für Dokumente**](https://www.youtube.com/watch?v=FDnDnmIR5Ng)  
Bald kannst du in Google Docs vollständige Audio-Versionen deiner Dokumente erstellen oder Podcast-ähnliche Zusammenfassungen der wichtigsten Punkte anhören. Diese Funktion wird in den kommenden Wochen in der Alpha-Phase verfügbar sein.

­

## Interview- und Podcasttipps 🎙️ 

_Du suchst noch mehr KI-Inspiration? Dann lohnt es sich, die folgenden Interviews und Podcasts rund um das Thema Künstliche Intelligenz zu hören._

#### [NEO – Der erste TED Talk von einem Roboter](https://www.youtube.com/watch?v=p3uBMqCPSDk)

Bernt Børnich stellt auf TED den humanoiden Roboter NEO vor, der im Haushalt Aufgaben wie Staubsaugen und Pflanzenbewässerung übernimmt, um dir mehr Zeit für die wichtigen Dinge im Leben zu verschaffen.

#### [Ressourcenschonender Einsatz von Künstlicher Intelligenz am Fraunhofer IIS](https://youtu.be/XQoj-UM1CVI)

Der Einsatz von Künstlicher Intelligenz verursacht durch datenintensive Prozesse wie Training und Betrieb einen hohen Energie- und Ressourcenbedarf. Am Fraunhofer IIS wird erforscht, wie der Ressourcenverbrauch von KI-Anwendungen durch gezielte Planung und effiziente Projektierung reduziert werden kann. Im Podcast erläutert Paulina Prantl, wie nachhaltige Ansätze bereits in frühen Projektphasen umgesetzt werden können.

­

## 🗺️ Dein Navigator in der KI-Welt!

­

**🚀 So unterstütze ich Unternehmen**

-   **Vorträge** - die Lust auf das Thema machen
-   **Workshops** - die das Thema greifbar machen
-   **Updates** - Um nicht abgehängt zu werden
-   **Integrationen** - KI sicher und sinnvoll einsetzen

👉🏻 [Hier findest du alle Infos](https://jens.marketing/leistungen/ki-beratung/) (+ Auswahl einiger Referenzen)

Übrigens sind alle Ressourcen, die ich mit dir teile – einschließlich Sponsoren-Links (die ich markieren muss) – für Tools, die ich selbst benutze oder benutzen würde, wenn ich den Bedarf hätte. Ich empfehle dir wirklich nur Dinge, hinter denen ich stehe!

[**Für den Newsletter anmelden**](https://jens.marketing/ki-newsletter/)

**Jens.Marketing**

Josef-Bayer-Str., 8, 50733 Köln

## Weiter im Kontext

- Vollständiger Index für Agenten: https://jens.marketing/llms.txt
- Alle URLs: https://jens.marketing/sitemap.xml
- Menschliche Übersicht: https://jens.marketing/uebersicht/
