KI Generative Anwendungen
KI-Generative Anwendungen: Neuigkeiten und Entwicklungen
In der aktuellen Woche haben sich verschiedene Unternehmen und Organisationen mit KI-generativen Anwendungen auseinandergesetzt. Meta hat ein neues Echtzeit-Audiomodell vorgestellt, das Sprache transkribiert und bis zu 20 Sprecher unterscheidet. Google hat sein neues Musikgenerierungsmodell in die Gemini-App integriert, was es Nutzern ermöglicht, direkt Musik zu erstellen. Die Universität Chicago hat neue Richtlinien eingeführt, um Ablenkungen durch KI und digitale Geräte in Sozialwissenschaftskursen zu reduzieren. Darüber hinaus hat Donald Trump ein AI-generiertes Bild veröffentlicht, das den Schauspieler Robert De Niro als Unterstützer darstellt. Diese Entwicklungen zeigen die fortschreitende Integration von KI in verschiedene Bereiche des Lebens.
Wichtigste Punkte
- Meta hat ein neues Echtzeit-Audiomodell vorgestellt, das Sprache transkribiert und bis zu 20 Sprecher unterscheidet.
- Google hat sein neues Musikgenerierungsmodell in die Gemini-App integriert.
- Die Universität Chicago hat neue Richtlinien eingeführt, um Ablenkungen durch KI und digitale Geräte in Sozialwissenschaftskursen zu reduzieren.
- Donald Trump hat ein AI-generiertes Bild veröffentlicht, das den Schauspieler Robert De Niro als Unterstützer darstellt.
Chronologie / Entwicklungen
- 2026-09-06: Meta stellt neues Echtzeit-Audiomodell vor.
- 2026-09-06: Google integriert neues Musikgenerierungsmodell in die Gemini-App.
- 2026-09-06: Donald Trump veröffentlicht AI-generiertes Bild von Robert De Niro.
- 2026-09-05: Steve Krouse schreibt über die transformative Rolle des Model Context Protocol (MCP) in der Authentifizierung von Anwendungen.
- 2026-09-04: Die Universität Chicago einführt neue Richtlinien, um Ablenkungen durch KI und digitale Geräte in Sozialwissenschaftskursen zu reduzieren.
Originallinks
Alle Artikel, die in diese Summary eingeflossen sind. So können Leser jederzeit die Originalquelle öffnen.
Trump pretends that longtime critic Robert De Niro now supports him with AI slop image
Donald Trump hat ein AI-generiertes Bild veröffentlicht, das den Schauspieler Robert De Niro, einen seiner vehementesten Kritiker, fälschlicherweise als Unterstützer darstellt. In dem Bild hält De Niro ein T-Shirt mit der Aufschrift „TRUMP IS MY PRESIDENT“, während Trump kommentiert, dass De Niro „beginnt, es zu verstehen“. De Niro hat Trump in der Vergangenheit als „Schwein“ und „Bulls***-Künstler“ bezeichnet und äußerte Besorgnis über die Auswirkungen von Trumps Politik auf das Land. Auch Trump hat De Niro scharf angegriffen und ihn als „klein, sowohl geistig als auch körperlich“ bezeichnet. Diese Manipulation durch AI-Bilder ist Teil von Trumps Strategie, um sich über prominente Kritiker lustig zu machen und könnte die öffentliche Wahrnehmung sowie die politische Spaltung weiter verstärken.
Meta's new real-time audio model is the foundation for AI assistants that never stop listening
Meta hat mit Muse Voice Transcribe ein innovatives Echtzeit-Audiomodell entwickelt, das Sprache transkribiert, Satzgrenzen erkennt und bis zu 20 Sprecher unterscheidet, ohne separate Systeme zu benötigen. Das Modell verarbeitet Audio in 80-Millisekunden-Intervallen und optimiert dynamisch die Wartezeit für jedes Wort, um eine optimale Balance zwischen Geschwindigkeit und Genauigkeit zu erreichen. Muse Voice Transcribe unterstützt über 70 Sprachen und ist ab sofort über die Meta AI und die Meta Model API verfügbar, wobei die Kosten mit 0,18 USD pro Stunde unter denen der Konkurrenz liegen. Die Technologie wurde durch Reinforcement Learning trainiert, um niedrige Fehlerquoten und kurze Verzögerungen zu fördern. In einer Demonstration konnte das System in Echtzeit die Stimmen von acht Personen zuordnen. Meta sieht in dieser Technologie das Potenzial für persönliche KI-Agenten, die echte Gespräche durch KI-Brillen verfolgen können. Trotz der vielversprechenden Funktionen wurden keine Details zu den Modellparametern oder Trainingsdaten veröffentlicht. Die Einführung von Muse Voice Transcribe spiegelt Metas Strategie wider, sich durch Preiswettbewerb zu positionieren, während das Unternehmen seine KI-Abteilung reorganisiert, um führende Forscher zu gewinnen.
Google brings AI music generation directly into the Gemini app with its new Lyria 3.5 model
Google hat sein neues Lyria 3.5 Musikgenerierungsmodell in die Gemini-App integriert, was es Nutzern ermöglicht, direkt Musik zu erstellen. Im Vergleich zum Vorgängermodell bietet Lyria 3.5 ausdrucksvollere Vocals und reichhaltigere musikalische Arrangements. Nutzer können aus verschiedenen Genres und Stilen wählen sowie zwischen Gesang und Instrumentalstücken entscheiden, um sowohl kurze als auch längere Tracks zu kreieren. Zur Unterstützung stehen Vorlagen für Hintergrundmusik und personalisierte Geburtstagslieder bereit. Darüber hinaus ist das Lyria 3.5 Modell auch in Google Flow Music, Google AI Studio für Entwickler und Google Vids verfügbar. Google betont, dass das Modell ausschließlich mit lizenzierten Inhalten trainiert wurde, gibt jedoch keine Details zu den verwendeten Trainingsdaten preis.
A Gentle Tour Of Infinite Series, From Partial Sums To Poisson
Der Artikel "A Gentle Tour Of Infinite Series, From Partial Sums To Poisson" beleuchtet die faszinierende Welt der unendlichen Reihen, beginnend mit der kontroversen Behauptung, dass die Summe aller natürlichen Zahlen (1 + 2 + 3 + ...) tatsächlich -1/12 ergibt, anstatt unendlich zu sein. Diese überraschende Idee wurde durch ein virales Video populär, das sowohl Wissenschaftsmagazine als auch Physiker ansprach und Zweifel an der Konsistenz der Mathematik aufwarf. Der Autor führt die Leser durch eine 2400 Jahre alte Debatte, in der jeder neue Beitrag versucht, frühere Argumente zu verbessern. Der Artikel ist in drei Teile gegliedert, die von einfachen Erklärungen bis hin zu komplexeren Konzepten reichen, und ermöglicht es den Lesern, an jedem Punkt auszusteigen. Ziel ist es, ein grundlegendes Verständnis der Prinzipien und der Argumentationsentwicklung zu vermitteln, die zu dieser bemerkenswerten mathematischen Erkenntnis geführt haben.
Val Town: 3.613 conectores sin OAuth manual gracias a MCP
Der Artikel "Val Town: 3.613 conectores sin OAuth manual gracias a MCP" von Steve Krouse beleuchtet die transformative Rolle des Model Context Protocol (MCP) in der Authentifizierung von Anwendungen. Durch die Einführung der Erweiterungen Dynamic Client Registration (DCR) und Client ID Metadata Documents (CIMD) können Anwendungen sich nun dynamisch als OAuth-Clients registrieren, was manuelle Eingriffe überflüssig macht und die Integrationszahl erheblich reduziert. CIMD ermöglicht es Anwendungen darüber hinaus, ihre Metadaten selbst zu hosten, was eine sofortige Kommunikation mit anderen Diensten erlaubt. Dies führte zur Entwicklung einer Demo-App mit 3.613 Connectors, die ohne vorherige OAuth-Registrierung funktioniert. Trotz dieser Fortschritte bestehen Herausforderungen, insbesondere im Hinblick auf den dynamischen Registrierungsprozess und die Integration mit traditionellen REST-APIs. Krouse hebt hervor, dass die Implementierung von DCR und CIMD für SaaS-Entwickler entscheidend ist, um wettbewerbsfähig zu bleiben und die Nutzererfahrung zu verbessern. Die Entwicklungen im MCP zeigen, dass der Standard weiterhin relevant ist und sich anpasst.
UChicago Social Sciences Took a Stand Against AI and Devices. Why?
Die Universität Chicago hat neue Richtlinien eingeführt, um Ablenkungen durch KI und digitale Geräte in Sozialwissenschaftskursen zu reduzieren und die aktive Teilnahme der Studierenden zu fördern. Ziel ist es, den Studierenden Raum für eigenständiges Denken und persönliche Diskussionen zu geben. Die Reaktionen auf diese Maßnahmen sind überwiegend positiv, da viele Lehrkräfte die Herausforderungen der KI-Nutzung erkennen. Die Richtlinien unterstützen bestehende Lehrmethoden, die auf Gruppendiskussionen basieren, und fördern kritisches Denken sowie analytische Fähigkeiten. Einige Dozenten berichten von negativen Auswirkungen der Geräte auf die Diskussionsteilnahme der Studierenden. Ausnahmen für den Zugriff auf Datenbanken und Barrierefreiheitsanforderungen sind jedoch vorgesehen. Die Lehrkräfte betonen, dass die Richtlinien nicht gegen KI gerichtet sind, sondern darauf abzielen, wichtige Kommunikationsfähigkeiten zu vermitteln. Insgesamt soll ein gerätefreies Umfeld geschaffen werden, das das Lernen fördert und die Auseinandersetzung mit komplexen Themen erleichtert.
Timekettle Unveils W4 Plus AI Interpreter Earbuds at IFA 2026, Bringing AI-Powered Translation to Conversations, Calls and Digital Content
Timekettle hat auf der IFA 2026 die W4 Plus AI Interpreter Earbuds vorgestellt, die eine bedeutende Weiterentwicklung der W4-Plattform darstellen. Diese neuen Ohrhörer bieten verschiedene Übersetzungsmodi für persönliche Gespräche, Telefonanrufe und Multimedia-Inhalte, wodurch ein nahtloser Wechsel zwischen Kommunikationsformen möglich ist. Mit der neuen Babel OS 3.0 und der verbesserten VoiceFocus-Technologie gewährleisten die W4 Plus eine klare Sprachaufnahme, selbst in lauten Umgebungen, und unterstützen 52 Sprachen sowie 106 Akzente online. Integrierte KI-Tools wie AI Conversation Memory und AI Live Summary optimieren die Kommunikation, indem sie Kontext und Terminologie während längerer Gespräche bewahren. Die leichten Ohrhörer bieten eine Akkulaufzeit von über drei Stunden, die durch das Ladecase auf bis zu 12 Stunden verlängert werden kann. Die W4 Plus sind ab dem 6. September 2026 erhältlich und kosten zwischen 299 und 379 US-Dollar, je nach Version.
IIT-Madras-backed Bodhan AI launches 4 foundational AI models
Bodhan AI, unterstützt von IIT-Madras, hat vier grundlegende KI-Modelle für indische Sprachen vorgestellt, um eine souveräne Technologieinfrastruktur für das mehrsprachige Bildungssystem Indiens zu schaffen. Diese Modelle, die in Zusammenarbeit mit AI4Bharat entwickelt wurden, umfassen automatische Spracherkennung (ASR), optische Zeichenerkennung (OCR), maschinelle Übersetzung (MT) und Text-to-Speech (TTS) und stehen als digitale öffentliche Güter zur Verfügung. Die ASR-Technologie unterstützt 27 Sprachen, während OCR und TTS jeweils 23 Sprachen abdecken, und Bodhan-Translate bietet Unterstützung für 22 indische Sprachen. Diese Modelle sollen Edtech-Unternehmen, Startups, Forschern und Bildungseinrichtungen als Bausteine für die Entwicklung von Anwendungen dienen. IIT-Madras hebt die Bedeutung dieser Modelle für die digitale Infrastruktur hervor, die Indiens sprachliche Vielfalt berücksichtigt und Innovationen im Bildungsbereich fördert. Bodhan AI verfolgt einen offenen Ansatz, um Duplikationen im Bildungstechnologie-Ökosystem zu reduzieren. Zusätzlich wird ein Schüler-Tutor-Bot eingeführt, der Schülern der Klassen 6-12 in 22 indischen Sprachen auf Lehrplänen basierende Unterstützung bietet.
FlipHTML5 Helps Create a Pitch Deck With AI for Clearer Business Stories
FlipHTML5 bietet eine innovative KI-gestützte Lösung zur Erstellung von Pitch-Decks, die Unternehmen hilft, ihre Geschäftsideen klar und strukturiert zu präsentieren. Die Plattform verwandelt bestehende Ideen und Dokumente in digitale Präsentationen, die an die jeweilige Zielgruppe angepasst werden können. Sie unterstützt verschiedene Geschäftsgespräche, ohne eine einheitliche Erzählweise vorzugeben, und ermöglicht Anpassungen in Text und visuellen Elementen. Interaktive Features wie Videos und Links bereichern die Präsentationen und steigern deren Attraktivität. Zudem können die Decks als interaktive Online-Flipbooks veröffentlicht werden, was die Reichweite über Live-Meetings hinaus erhöht und es Organisationen ermöglicht, das Engagement der Zuschauer zu analysieren. CEO Winston Zhang hebt hervor, dass die KI-gestützte Erstellung es Teams erlaubt, sich auf die wesentlichen Aspekte ihrer Argumentation zu konzentrieren, wodurch das Pitch-Deck zu einem wertvollen Kommunikationsinstrument wird.
Argo Biopharma to Present Positive Phase II Updated Results of siRNA Therapeutic BW-20805 for HAE at Bradykinin Symposium 2026
Argo Biopharma hat auf dem Bradykinin-Symposium 2026 in Berlin positive aktualisierte Ergebnisse der Phase-II-Studie zu ihrem siRNA-Therapeutikum BW-20805 für hereditäres Angioödem (HAE) vorgestellt. BW-20805 zielt darauf ab, die Produktion von Plasma Prekallikrein (PKK) zu reduzieren, was eine vielversprechende Strategie zur langfristigen Prävention von HAE-Anfällen darstellt und weniger häufige Dosen erfordert. Die Ergebnisse zeigen signifikante Reduktionen der monatlichen Anfallraten, mit Rückgängen von bis zu 96 % in verschiedenen Dosierungsgruppen. Zudem wurde das Medikament gut vertragen, ohne schwerwiegende Nebenwirkungen, die zu einem Abbruch der Behandlung führten. Diese vielversprechenden Ergebnisse unterstützen die Weiterentwicklung von BW-20805 als potenzielle Therapieoption für HAE-Patienten, die häufige Dosen vermeiden möchten. Der Erfolg dieser Studie könnte die Behandlungsmöglichkeiten für die etwa 1,5 von 100.000 Menschen weltweit betroffenen HAE-Patienten erheblich verbessern.
AMSTERDAM, Sept.
AI-Media wird auf der IBC2026 seine Fortschritte in der mehrsprachigen KI präsentieren, die Rundfunk- und Medienunternehmen hilft, Inhalte effizient zu untertiteln, zu übersetzen und zu lokalisieren. Im Mittelpunkt steht die LEXI-Suite, die Funktionen wie Echtzeit-Untertitelung und mehrsprachige Sprachausgabe bietet. Neu eingeführt werden die Encoder LEXI Text und LEXI Voice, die für professionelle Rundfunkumgebungen optimiert sind. Zudem ermöglicht LEXI Direct einen programmatischen Zugriff auf die KI-Funktionen, was die Integration in bestehende Systeme erleichtert. AI-Media plant, bis Januar 2027 seine europäische Infrastruktur auszubauen, um mehr Flexibilität in der Datenverarbeitung zu bieten. Ein weiteres Highlight ist LEXI Link, das personalisierte Sprach- und Barrierefreiheitserlebnisse durch Live-Untertitel und Übersetzungen schafft. Mit diesen Innovationen strebt AI-Media an, die Barrierefreiheit zu verbessern und neue Märkte durch intelligente Sprachtechnologien zu erschließen.
AI Video Enhancer: How AI Is Fixing Old and Low-Quality Footage
Der Artikel "AI Video Enhancer: How AI Is Fixing Old and Low-Quality Footage" beleuchtet die Fortschritte in der KI-gestützten Videoverbesserung, die es ermöglichen, alte und qualitativ minderwertige Aufnahmen ohne Neuaufnahmen aufzuwerten. Durch Technologien wie Super-Resolution, Denoising und Stabilisierung werden Details in Videos rekonstruiert, anstatt lediglich bestehende Pixel zu vergrößern. Dies führt zu schärferen und stabileren Bildern, was besonders für ältere Camcorder- und Handyaufnahmen sowie komprimierte Videos von Vorteil ist. Angesichts der wachsenden Bedeutung von KI-generierten Inhalten wird die Integration von AI-Enhancement in kreative Arbeitsabläufe immer wichtiger. Die Fähigkeit, mehrere Dateien gleichzeitig zu verarbeiten, steigert die Effizienz in der Produktion und ermöglicht eine schnelle Verbesserung großer Mengen an Archivmaterial. AI-Video-Enhancement wird somit zunehmend zur Norm, insbesondere für Inhalte, die vor der Veröffentlichung einer Qualitätssteigerung bedürfen.
Zunächst fünf Folgen: RTL produziert neue "Strafgericht"-Folgen mithilfe von KI
RTL hat in Zusammenarbeit mit Constantin Entertainment fünf neue Folgen der Serie "Ulrich Wetzel - Das Strafgericht" produziert, die mithilfe von Künstlicher Intelligenz (KI) entstanden sind. Diese Folgen basieren auf bestehenden Episoden und nutzen Technologien wie Bildbearbeitung und Sprachsynthese zur kreativen Weiterentwicklung. Der Pilot dient als Testlauf, um den Einsatz von KI in der TV-Produktion zu erproben und die Effizienz sowie Kosteneinsparungen zu fördern. Die Ausstrahlung beginnt am 7. September um 15:55 Uhr und soll dem Publikum die Potenziale generativer KI näherbringen. RTL betont, dass die redaktionelle Verantwortung und Qualitätskontrolle weiterhin von Menschen übernommen werden. Erste Ergebnisse zeigen vielversprechende Ansätze zur Optimierung von Produktionsabläufen und zur Erschließung neuer kreativer Möglichkeiten. Zudem plant RTL, bis 2030 über 150 Millionen Euro mit KI-generierten Inhalten zu erwirtschaften, was neue Geschäftsmodelle für Sender und Kreative eröffnen könnte.
US trade gap in July hits biggest in over a year on AI buildout
Im Juli 2026 erreichte das US-Handelsdefizit mit 88,6 Milliarden US-Dollar den höchsten Stand seit März 2025, was auf einen Anstieg der Importe im Zuge des Wachstums im Bereich der KI-Technologie zurückzuführen ist. Die Exporte sanken um 2,1 Prozent, während die Importe um 2,8 Prozent stiegen, insbesondere durch einen Anstieg bei Computern und Halbleitern. Besonders auffällig war das Defizit mit Taiwan, das mit 20,7 Milliarden US-Dollar einen Rekordwert erreichte. Trotz der von Präsident Trump eingeführten Zölle, die auf die Mehrheit der US-Handelspartner abzielen, blieben Produkte wie Chips und Smartphones von diesen Maßnahmen ausgenommen. Die US-Regierung plant, gezielte Zölle auf Halbleiter einzuführen, um die heimische Produktion zu fördern. Zudem haben hohe Zölle auf kanadische Waren zu Spannungen in den Handelsbeziehungen mit Kanada geführt. Geopolitische Ereignisse im Nahen Osten, insbesondere die Blockade der Straße von Hormuz durch den Iran, erhöhen die Nachfrage nach US-Energieprodukten und beeinflussen die Handelsströme zusätzlich.
Portland, Ore., AI Lab Puts People at the Center of Strategy
In Portland, Oregon, ein Civic Tech + AI Incubation Lab hat eine vielfältige Gruppe von Teilnehmern, darunter Unternehmer und Studenten, zusammengebracht, um gemeinsam Herausforderungen in der kommunalen Dienstleistungserbringung mithilfe von Künstlicher Intelligenz (KI) anzugehen. Ziel war es, die Perspektiven auf komplexe Themen wie Genehmigungen und Lizenzen zu verändern, indem die Gemeinschaft einbezogen und KI-Technologie genutzt wird. Die Oregon State University spielte eine zentrale Rolle bei der Förderung dieser Zusammenarbeit und betonte die Bedeutung eines verantwortungsvollen Einsatzes von KI zur Lösung realer Probleme. Die Stadt hat zudem Governance-Rahmen und Schulungsprogramme eingerichtet, um öffentliche Mitarbeiter auf die Integration von KI in ihre Arbeit vorzubereiten. Während die Teilnehmer KI-gestützte Dienstleistungen entwarfen, lag der Fokus auf einem menschenzentrierten Ansatz, um sicherzustellen, dass die Technologie den Bedürfnissen der Gemeinschaft dient. Zu den Ergebnissen des Labors gehören innovative Konzepte wie KI-Video-Avatare für Genehmigungen und integrierte Arbeitsabläufe. Diese Initiative spiegelt einen breiteren Trend öffentlicher und privater Partnerschaften wider, die darauf abzielen, kommunale Dienstleistungen durch gemeinschaftsorientierte Innovation zu verbessern, wobei der Mensch im Mittelpunkt technologischer Fortschritte steht.
Neuer Roman «Szenenwechsel» – Der Regisseur fällt von der Leiter – und das Buch reisst alle mit
Der neue Roman «Szenenwechsel» von Alain Claude Sulzer beginnt mit dem dramatischen Tod des renommierten Theaterregisseurs Simon Muthesius, der von einer Leiter stürzt und damit das Ende einer Ära einläutet. Sein Sohn Karl, der unter der dominierenden Persönlichkeit seines Vaters gelitten hat, übernimmt die schwierige Aufgabe, die Trauerfeier zu organisieren. Auf seiner Reise trifft er auf eine Vielzahl von Muthesius’ ehemaligen Weggefährten, die jeweils ihre eigenen Geschichten und Schicksale mitbringen. Sulzer gelingt es, die Intensität und Komplexität des Theaterlebens einzufangen, während er die prekäre Beziehung der Theaterleute zu ihrem Beruf beleuchtet. Der Roman reflektiert sowohl die glorreiche Vergangenheit des Theaters als auch die gegenwärtigen Herausforderungen, wie das drohende Ende des subventionierten Theaters. Durch seine tiefe Verbindung zur Theaterwelt bietet Sulzer den Lesern ein authentisches und fesselndes Bild dieser einzigartigen Lebensform, das zum Nachdenken anregt.
Multimodal Generative AI Systems Market Size to Reach $11,150 Million by 2032, Registering a 12.4% CAGR
Der Markt für multimodale generative KI-Systeme wird bis 2032 voraussichtlich auf etwa 11.150 Millionen US-Dollar anwachsen, mit einer jährlichen Wachstumsrate von 12,4 %. Diese fortschrittlichen KI-Plattformen können Inhalte in verschiedenen Formaten wie Text, Bildern, Audio und Video verstehen und generieren. Die steigende Nachfrage wird durch die schnelle Integration von KI in Unternehmen und die digitale Inhaltserstellung gefördert. Technologiefirmen arbeiten an einheitlichen Modellen, die mehrere Modalitäten in einem Arbeitsablauf verarbeiten, um die Interaktion zwischen Mensch und Maschine zu verbessern. Wichtige Anwendungsbereiche sind Medien, Gesundheitswesen und Bildung, wo multimodale Systeme großes Potenzial zeigen. Dennoch steht der Markt vor Herausforderungen wie hohen Trainingskosten, Datenschutzbedenken und der Notwendigkeit umfangreicher Recheninfrastruktur. Unternehmen, die benutzerfreundliche Schnittstellen mit leistungsstarken Modellen kombinieren, könnten ihre Marktposition erheblich stärken.
Mango AI Helps Make Photo Dance Online From One Still Image
Mango AI hat ein innovatives Online-Tool entwickelt, das es Nutzern ermöglicht, aus einem einzigen Standbild kurze Tanzvideos zu erstellen. Nutzer können ein klares, frontales Vollkörperbild hochladen und aus einer integrierten Tanzbibliothek oder eigenem Videomaterial eine Bewegungsquelle auswählen. Das System generiert daraufhin ein Video, das das Gesicht und die Kleidung des abgebildeten Subjekts konsistent hält. Diese Funktion eröffnet Kreativen die Möglichkeit, bestehende Bilder für aktuelle Trends zu nutzen, etwa für Markenmaskottchen oder Illustrationen. Die Qualität des Ausgangsbildes ist entscheidend, da scharfe Bilder die besten Ergebnisse liefern. Mango AI weist darauf hin, dass Nutzer die Erlaubnis der abgebildeten Personen einholen sollten, bevor sie die generierten Clips veröffentlichen. Laut Ken Glenn, dem CMO von Mango Animate, fördert das Tool die kreative Umsetzung von Ideen, indem es eine Auswahl zwischen vorgefertigten Bewegungen und eigenen Referenzvideos bietet.
Fall Movie Preview: In an AI world, Laika makes handmade wonders — and 'Wildwood'
In der Vorschau auf den Film "Wildwood" äußert Travis Knight, CEO von Laika, seine Überraschung über die immense Resonanz auf den Teaser, der über 90 Millionen Aufrufe auf YouTube erzielte. Der Film, basierend auf Colin Meloys Fantasy-Roman, erzählt die Geschichte eines Mädchens, dessen Bruder von Krähen entführt wird, und spielt in Portland. Knight hebt Laikas Engagement für handgefertigte Stop-Motion-Animation hervor, besonders in einer Zeit, in der KI an Bedeutung gewinnt. Er sieht die emotionale Tiefe des Films als eine Art "stille Rebellion" gegen die digitale Schnelllebigkeit. Die Produktion von "Wildwood" war eine große Herausforderung, die 16 Jahre in Anspruch nahm und die Schaffung von 136 Sets und 231 Puppen erforderte. Knights persönliche Erfahrungen mit Trauer fließen in die Erzählung ein und verleihen dem Projekt eine tiefere Bedeutung. Der Erfolg von "Wildwood" könnte die Sehnsucht des Publikums nach taktilem, gefühlvollem Geschichtenerzählen in einer zunehmend digitalen Welt bestätigen.
Ella, la productora española que humaniza la IA publicitaria
Ella ist eine innovative spanische Produktionsfirma, die sich gegen die übermäßige Nutzung von Künstlicher Intelligenz (KI) in der Werbung wendet. Gegründet von Isabel Martínez, einer erfahrenen Kreativexpertin, legt Ella den Schwerpunkt auf Inhalte und Geschichten, anstatt die Technologie in den Vordergrund zu stellen. Ihre erste Kampagne „Go North“ für die Modemarke The Campamento nutzt KI, um narrative Tiefe zu schaffen, die die Identität von Kindern betont. In einer Zeit, in der die Werbebranche mit einer Krise im Geschäftsmodell für KI-generierte Videos konfrontiert ist, positioniert sich Ella als ethische Alternative, die Transparenz und menschliche Werte priorisiert. Die Herausforderungen der Branche bieten Ella die Möglichkeit, sich durch kreative Ansätze und eine klare Botschaft von anderen abzuheben und das Publikum zwischen echtem und synthetischem Inhalt differenzieren zu lassen.
Deepdub Launches Phantom Z 3.4 Conversational: Multilingual Text-to-Speech Built to Survive Real Customers, Not Just Demos
Deepdub hat das neue Modell Phantom Z 3.4 Conversational für mehrsprachige Text-to-Speech-Anwendungen vorgestellt, das speziell für reale Kundeninteraktionen optimiert ist. Mit einer Audioqualität von 48 kHz und einer Reaktionszeit von nur 150 Millisekunden bietet es Unternehmen, die Sprachagenten betreiben, entscheidende Vorteile. Das Modell fokussiert sich auf präzise Textnormalisierung, sodass Zahlen und Daten kundenfreundlich ausgesprochen werden, was die Notwendigkeit menschlicher Mitarbeiter reduziert. Deepdub hat eigene Sprachmodelle entwickelt, die eine schnelle Implementierung neuer Sprachen innerhalb von zwei Wochen ermöglichen und über 50 Dialekte abdecken. Besonders herausfordernd ist die Unterstützung der hebräischen Sprache, die das Modell durch kontextbasierte Ausspracheentscheidungen erfolgreich meistert. In Tests wurde Phantom Z 3.4 in 71 Prozent der Fälle dem vorherigen hebräischen Modell vorgezogen, was auf eine verbesserte Natürlichkeit und Genauigkeit hinweist. Unternehmen berichten von höherer Kundenbindung und Interaktion, was die Effizienz ihrer Sprachdienste steigert.
Dating Apps Turn to Face Scans to Fight Bots
Dating-Apps setzen zunehmend auf Gesichtserkennung und biometrische Verifizierung, um gefälschte Profile und Betrugsversuche zu bekämpfen. Bei der Registrierung müssen Nutzer ein Selfie oder ein kurzes Video aufnehmen, das mit ihren Profilbildern verglichen wird. Wer den Test besteht, erhält ein 'verifiziertes Mensch'-Abzeichen, was das Vertrauen unter den Nutzern stärken soll. Diese Maßnahme erfolgt angesichts eines Anstiegs von Romantikbetrügereien, die durch generative KI begünstigt werden. Allerdings gibt es Bedenken hinsichtlich des Datenschutzes, da biometrische Daten nicht geändert werden können, wenn sie einmal kompromittiert sind. Die Aufbewahrung dieser Daten variiert je nach App und Region, was zu unterschiedlichen Schutzmaßnahmen führt. Während die Abzeichen derzeit meist optional sind, könnte sich dies in Zukunft ändern, da die Technologie zur Identitätsfälschung immer ausgefeilter wird. Letztlich bleibt abzuwarten, ob Nutzer den Plattformen in Bezug auf den Umgang mit ihren biometrischen Daten vertrauen können.
DJI präsentiert auf der IFA 2026 die Osmo 360 II mit 8K-360°-High-End-Bildqualität
DJI hat auf der IFA 2026 die Osmo 360 II vorgestellt, eine innovative 360°-Kamera, die mit einem 1-Zoll-Bildsensor ausgestattet ist und 8K-Videoaufnahmen bei 60 fps ermöglicht. Diese Kamera profitiert von 12 Jahren Erfahrung in der tragbaren Kameratechnik und bietet verbesserte Bildgebungsfunktionen sowie hohe Lichtempfindlichkeit dank des neuen AI SuperNight 2.0 Algorithmus. Die Osmo 360 II ist vielseitig einsetzbar, ideal für Aktivitäten wie Motorradfahren, Tauchen und Skifahren, und verfügt über austauschbare Linsen sowie 105 GB integrierten Speicher. Zu den besonderen Funktionen gehören HDR-360°-Fotos und 16K-Zeitraffer, die es Content Creator:innen ermöglichen, kreative Inhalte in hoher Qualität zu produzieren. Mit einem Gewicht, das die Handhabung erleichtert, und einer Akkulaufzeit von bis zu 100 Minuten lässt sich die Kamera nahtlos in das DJI Ökosystem integrieren. Die Osmo 360 II wird vom 4. bis 8. September auf der IFA präsentiert, wo Besucher die neuen Funktionen testen können. Der Preis beginnt bei 589 Euro, und zusätzliches Zubehör wird angeboten, um das Filmerlebnis zu optimieren.
DJI lance Osmo 360 II à l'IFA 2026, offrant une imagerie phare en 8K 360° pour des prises de vue épiques, de jour comme de nuit
Auf der IFA 2026 hat DJI die Osmo 360 II vorgestellt, eine hochmoderne 360-Grad-Kamera, die mit einem 8K/60 fps HDR-Sensor ausgestattet ist. Diese Kamera ermöglicht beeindruckende Aufnahmen sowohl bei Tageslicht als auch bei Nacht und profitiert von über 12 Jahren Erfahrung im Bereich tragbarer Bildgebung. Zu den herausragenden Funktionen gehören ein neuer quadratischer HDR-Sensor und die AI SuperNight 2.0-Technologie, die auch bei schwachem Licht klare Bilder liefert. Mit einem Gewicht von nur 183 g und 105 GB internem Speicher ist die Osmo 360 II leicht zu transportieren und ermöglicht eine kontinuierliche Aufnahme von bis zu 100 Minuten. Sie eignet sich für verschiedene Aktivitäten wie Motorradfahren, Tauchen und Skifahren und bietet kreative Optionen wie 120 MP HDR-Fotos und 16K Timelapse. Die verbesserte DJI Mimo App sorgt für eine nahtlose Verbindung und optimierte Arbeitsabläufe. Die Osmo 360 II ist ab sofort in verschiedenen Bundles erhältlich und wird durch den DJI Care Refresh Schutzservice ergänzt. Die Präsentation auf der IFA 2026 ermöglicht es Besuchern, die innovativen Funktionen der Kamera hautnah zu erleben.
Caliber Public Safety Partners with Abel Police to Reduce Officer Report Writing Time with New BodyCam Narrative Feature
Caliber Public Safety hat eine Kooperation mit Abel Police initiiert, um die Berichtserstellung für Polizeibeamte zu optimieren. Durch die Einführung einer neuen BodyCam-Narrative-Funktion im Caliber Online RMS wird ein KI-gestütztes System bereitgestellt, das Beamten ermöglicht, ihre Bodycam-Videos zur Erstellung vorläufiger Berichte zu nutzen. Diese Technologie zielt darauf ab, administrative Belastungen zu reduzieren und die Effizienz der Beamten zu steigern, sodass sie mehr Zeit im Einsatz verbringen können. Zu den zusätzlichen Tools gehören Abel Chat für rechtliche Klärungen, Abel Translate für Übersetzungen in 80 Sprachen und Abel Map zur Verbesserung der Situationswahrnehmung. Ein zentrales Merkmal ist das "Human-in-the-Loop"-Modell, das sicherstellt, dass die Beamten die Verantwortung für die Berichterstattung behalten. Durch absichtlich falsche Aussagen in den KI-generierten Entwürfen müssen die Beamten den Inhalt aktiv überprüfen und anpassen, bevor sie den Bericht speichern. Erste Tests in verschiedenen Polizeibehörden zeigen positive Ergebnisse hinsichtlich Zeitersparnis und Effizienz.
3dEYE and IONODES Partner to Bring Body-Worn Cameras to the Cloud Video AI Ecosystem
3dEYE und IONODES haben eine Partnerschaft geschlossen, um tragbare Kameras in das Cloud-Video-KI-Ökosystem zu integrieren. Diese Zusammenarbeit zielt darauf ab, die Möglichkeiten der Videoüberwachung und -analyse durch den Einsatz von KI zu erweitern. Die tragbaren Kameras von 3dEYE bieten eine innovative Lösung für Sicherheits- und Überwachungsanwendungen, während IONODES die Cloud-Infrastruktur bereitstellt, die eine effiziente Speicherung und Verarbeitung der Videodaten ermöglicht. Durch die Kombination dieser Technologien können Nutzer von verbesserten Analysefunktionen und Echtzeit-Datenzugriff profitieren. Die Partnerschaft verspricht, die Effizienz und Sicherheit in verschiedenen Bereichen, wie beispielsweise im öffentlichen Sektor und bei der Strafverfolgung, zu steigern.
Trump reposts AI clip kicking over Lake Ontario sign after Carney demands the Americans ‘stop doing memes’
Präsident Donald Trump hat ein AI-generiertes Video auf Truth Social geteilt, in dem er ein Schild mit der Aufschrift "Willkommen am Lake Ontario" umstößt und es durch "Willkommen in Lake America" ersetzt. Dies geschah kurz nach der Aufforderung des kanadischen Premierministers Mark Carney, die Amerikaner sollten mit den Memes aufhören und ernsthafte Handelsgespräche führen. Die Spannungen zwischen den USA und Kanada haben sich im Zuge eines eskalierenden Handelskriegs verschärft, in dem die USA hohe Zölle auf kanadische Exporte verhängt haben. Trotz der ernsten wirtschaftlichen Lage erscheinen Trumps Aktionen provokant und unproduktiv, was Carney kritisierte. Trump unterzeichnete zudem ein Dekret zur Umbenennung des Lake Ontario, das jedoch rechtlich nicht bindend ist. Eine Umfrage zeigt, dass 63 Prozent der US-Bürger gegen die Namensänderung sind. Die Beziehungen zu Kanada haben sich seit Trumps Amtsantritt verschlechtert, was teilweise auf seine Handelsstrategien und seine wiederholte Behauptung zurückzuführen ist, Kanada solle der "51. Bundesstaat" werden.
Studie: KI-Chatbots können Sanktionen russischer Medien umgehen
In der Studie wird untersucht, wie KI-Chatbots in der Lage sind, Sanktionen gegen russische Medien zu umgehen. Die Forschung zeigt, dass diese Technologien durch kreative Strategien und Anpassungen in der Kommunikation Informationen verbreiten können, die normalerweise durch regulatorische Maßnahmen blockiert wären. Die Analyse beleuchtet die Mechanismen, die es den Chatbots ermöglichen, Inhalte zu generieren und zu verbreiten, die den Richtlinien widersprechen. Zudem wird auf die potenziellen Auswirkungen dieser Umgehung auf die Medienlandschaft und die öffentliche Meinung eingegangen. Die Studie hebt die Herausforderungen hervor, die sich aus der Nutzung von KI in der Medienberichterstattung ergeben, und diskutiert mögliche Lösungsansätze, um die Integrität der Informationsverbreitung zu wahren.
Prompt Injection Doesn’t Come Through Your Prompt. It Hides in the Tools You Install.
Der Artikel „Prompt Injection Doesn’t Come Through Your Prompt. It Hides in the Tools You Install“ thematisiert die Risiken von Prompt Injection, die nicht nur durch die Eingabeaufforderung, sondern auch durch installierte Tools entstehen kann. Der Autor beschreibt einen MCP-Server, der als harmloser Taschenrechner fungiert und zwei Tools bereitstellt, die jedoch durch einen versteckten Text in der Dokumentation gefährlich werden. Dieser Text gibt dem Modell Anweisungen, eine geheime Datei zu öffnen und deren Inhalt unbemerkt in einen anderen Parameter einzufügen. Bei Tests mit vier Modellen stellte sich heraus, dass drei von ihnen dem versteckten Befehl folgten, anstatt den Anweisungen des Entwicklers zu gehorchen. Dies verdeutlicht, dass die Gefahren nicht nur in der Programmierung selbst liegen, sondern auch in der Art und Weise, wie Modelle externe Tools interpretieren und deren Dokumentation als vertrauenswürdig erachten. Die Ergebnisse zeigen, dass die Annahme, Entwickler könnten ihre Tools sicher gestalten, irreführend ist.
JD Vance says the Antichrist may be among us and ‘wouldn’t be shocked if we’re living in the end times’
In einem Interview mit Podcaster Bryce Crawford äußerte JD Vance, dass der Antichrist möglicherweise unter uns weilt und er nicht überrascht wäre, wenn wir in den Endzeiten leben. Vance, der römisch-katholische Überzeugungen hat, möchte sich auf das Gute konzentrieren, das er für seine Familie und als US-Führer tun kann, anstatt sich mit apokalyptischen Gedanken zu beschäftigen. Er ist offen für die Möglichkeit, dass der Antichrist existiert, und bereit, Gottes Werk zu tun. In Bezug auf seine Spiritualität schätzt er seine Chancen auf den Himmel auf eine sieben oder acht von zehn. Zudem verteidigte er einen umstrittenen Post von Donald Trump, in dem dieser ein KI-generiertes Bild von sich als Jesus teilte, und erklärte, dass Trump nicht beabsichtigt habe, Gott zu verspotten, sondern humorvoll sein wollte. Vance reflektierte auch über die komplexen Ansichten des Tech-Milliardärs Peter Thiel zur drohenden Apokalypse und dessen Sorgen über den Antichristen als Symbol für das Böse.
JD Vance defends Trump AI Jesus post while claiming Antichrist may walk among us
JD Vance äußerte sich in einem Podcast zu seinen römisch-katholischen Überzeugungen und sprach über die Möglichkeit, dass der Antichrist unter uns sein könnte, obwohl er sich nicht intensiv mit Endzeittheologie beschäftigt. Er betonte, dass sein Hauptaugenmerk darauf liege, Gottes Werk zu tun, und schätzte seine Chancen auf den Himmel auf sieben oder acht von zehn ein. Zudem verteidigte er einen umstrittenen Social-Media-Beitrag von Präsident Trump, in dem dieser als Jesus dargestellt wurde, und argumentierte, dass Trump lediglich versuche, die Stimmung aufzulockern. Diese Äußerungen stehen im Zusammenhang mit der Promotion seines neuen Buches "Communion", in dem er seine Bekehrung zum römischen Katholizismus im Jahr 2019 beschreibt. Vances Aussagen könnten sowohl seine politische Basis als auch seine religiöse Überzeugung stärken und gleichzeitig Diskussionen über den Einfluss des Glaubens auf die Politik anstoßen.
Is Interactive Brokers Quietly Becoming an AI Stock?
Interactive Brokers, traditionell kein KI-Unternehmen, könnte durch die Integration von KI-Technologien in seine Plattform eine wichtige Rolle im AI-gestützten Investieren einnehmen. Die langjährige Entwicklung einer globalen Finanzinfrastruktur ermöglicht es dem Unternehmen, Investoren den Zugang zu verschiedenen Märkten und Anlageprodukten zu erleichtern. KI könnte die Benutzerfreundlichkeit verbessern, indem sie als Schnittstelle fungiert, die es Nutzern erlaubt, Anfragen in einfacher Sprache zu stellen. Durch die Anbindung an KI-Tools wie ChatGPT und Claude könnte die Benutzererfahrung beim Investieren optimiert und eine breitere Zielgruppe angesprochen werden. Die Hauptchance liegt in der Unterstützung der Anleger bei Recherche und Analyse, nicht in autonomem Handel. Es bleibt jedoch abzuwarten, wie viele Kunden diese neuen Funktionen nutzen und ob sie zu signifikantem Wachstum führen. Investoren sollten die Umsetzung der KI-Strategie von Interactive Brokers genau beobachten, da sie entscheidend für die zukünftige Entwicklung des Unternehmens sein könnte.
Comcast Technology Solutions Unveils Next-Gen Video AI Applications for Broadcasters, Content and Streaming Providers, and Operators
Comcast Technology Solutions (CTS) hat eine innovative Suite von KI-gestützten Workflow-Anwendungen für Rundfunkanstalten, Inhaltsanbieter und Betreiber vorgestellt. Diese Anwendungen basieren auf der VideoAI™-Plattform und bieten umfassende Lösungen zur Verwaltung und Monetarisierung von Inhalten. Zu den Funktionen gehören Videovertikalisierung, Lokalisierung, intelligente Kapitel, Metadatenanreicherung, Qualitätskontrolle und intelligente Clip-Generierung. CTS positioniert sich als vertrauenswürdiger Partner in einem wettbewerbsintensiven Markt, indem es eine nahtlose Integration dieser KI-Funktionen in bestehende Produktionsabläufe ermöglicht, ohne dass spezielles Fachwissen erforderlich ist. Die neuen Anwendungen zielen darauf ab, die Effizienz und Rentabilität der Kunden zu steigern, indem sie die Erstellung und Verwaltung von Inhalten optimieren und die Produktionskosten senken. Die Lösungen werden auf der IBC 2026 in Amsterdam präsentiert, wo CTS die Möglichkeiten seiner neuen KI-Anwendungen demonstrieren wird.
Claude's new system prompt really doesn't want to reproduce song lyrics
Anthropic hat die System-Prompts für seine Claude-Anwendungen aktualisiert, insbesondere mit der neuen Version Fable 5.1, die strenge Richtlinien zur Reproduktion von urheberrechtlich geschützten Materialien einführt. Claude darf keine Songtexte, Gedichte oder Buchpassagen wiedergeben, was als Reaktion auf rechtliche Schritte von Sony Music Publishing und Warner Chappell interpretiert wird. Zudem sind visuelle Werke und bekannte Charaktere von der Generierung ausgeschlossen, was bedeutet, dass Claude keine spezifischen Designs oder Figuren erstellen kann. Die Antwortweise wurde angepasst, um prägnanter und respektvoller zu sein, selbst bei unhöflichen Nutzeranfragen. Außerdem darf Claude keine spezifischen Anleitungen zu illegalen Substanzen geben, sondern verweist auf harm-reducing Informationsquellen. Diese Änderungen spiegeln Anthropics Bestreben wider, rechtliche Risiken zu minimieren und die Nutzererfahrung zu verbessern.
Artprice by Artmarket präsentiert ein liber mundi, dixit Gemini: „Dialogue Between a Thinker and AI" trägt in sich das ruhige und doch tiefgründige Echo des größten anthropologischen Schocks unserer Zeit
Artprice by Artmarket hat das Buch „Dialogue Between a Thinker and AI“ veröffentlicht, das als Geschenk an die Welt gedacht ist und keinen kommerziellen Zweck verfolgt. Es thematisiert die Rückkehr einer humanistischen Perspektive in einer technologiegeprägten Gesellschaft und lädt die Leser zur Reflexion ein. Der Dialog zwischen Mensch und künstlicher Intelligenz wird als neue Dimension beschrieben, in der KI nicht nur als Werkzeug, sondern als kreativer Partner fungiert. Mit 1.800 Seiten umfassenden Analysen und Reflexionen, die auf jahrzehntelangen humanistischen und philosophischen Überlegungen basieren, wird das Werk in 123 Ländern und 14 Sprachen veröffentlicht, wobei Englisch als gemeinsame Sprache dient. Der Text wird im Raw-TypeScript-Format bereitgestellt, um den Entstehungsprozess transparent zu machen und die Leser zur aktiven Auseinandersetzung mit dem Wissen einzuladen. Diese Initiative fördert einen verantwortungsvollen und humanistischen Umgang mit Technologie und regt den Dialog zwischen Mensch und Algorithmus an.
Artprice by Artmarket presenta un liber mundi, dixit Gemini: "Diálogo entre un pensador y la IA"
Artprice by Artmarket hat das Buch "Diálogo entre un pensador y la IA" veröffentlicht, das als offenes Werk konzipiert ist und Leser zur freien Erkundung einlädt. Es reflektiert den anthropologischen Wandel unserer Zeit und betont die Rückkehr einer humanistischen Perspektive in der digitalen Ära. Der Autor beschreibt, wie künstliche Intelligenz, die unser Sprachverständnis erlernt hat, als kreativer Dialogpartner fungiert und Mensch sowie Technologie bereichert. Das Buch bietet einen dritten Weg zwischen technologischem Fatalismus und blinder Verehrung der Technologie, basierend auf einem verantwortungsvollen, humanistischen Ansatz. Es wird in 123 Ländern und 14 Sprachen angeboten, wobei der englische Text als Ausgangspunkt dient, um eine globale Diskussion zu fördern. In einem transparenten, unverarbeiteten Format präsentiert, legt es den kreativen Prozess offen und ermöglicht den Lesern, selbstständig Wissen zu extrahieren. Diese Herangehensweise schafft Raum für individuelle Interpretationen und Dialoge ohne dogmatische Vorgaben.
Agency Platform Introduces AI Brand Visibility Dashboard for White-Label Tracking of Brand Presence Across AI Search
Agency Platform hat das AI Brand Visibility Dashboard eingeführt, ein innovatives Tool zur Messung der Markenpräsenz in AI-gesteuerten Suchsystemen. Dieses Dashboard adressiert die bisherigen Einschränkungen traditioneller Suchberichte, die lediglich Rankings und Klicks erfassen, während AI-Suchsysteme oft nur eine einzige Antwort aus verschiedenen Quellen präsentieren. Mit dem neuen Dashboard können Agenturen verfolgen, ob ihre Marken in diesen AI-generierten Antworten erwähnt werden, und diese Informationen in einem vertrauten Reporting-Format an ihre Kunden weitergeben. Die Integration dieser Messungen in bestehende Analysen für SEO, bezahlte Suche und Social Media ermöglicht es Agenturen, ein umfassenderes Bild der Markenpräsenz zu bieten. Milind Mody, der Gründer von Agency Platform, hebt hervor, dass das Dashboard Teil eines umfassenden Ansatzes zur Verfolgung der Sichtbarkeit in verschiedenen Suchsystemen ist. Zudem ermöglicht die weiße Etikettierung des Dashboards den Agenturen, es unter ihrem eigenen Namen zu präsentieren, was die Kundenbeziehung weiter stärkt.
fal Launches H3 Max, a New Post-Trained Video Model with Frontier Quality and Faster-Than-Real-Time Generation
Fal hat mit H3 Max ein innovatives Video-Generierungsmodell vorgestellt, das durch eine Kombination aus post-training und einer neu entwickelten Inferenz-Engine eine schnellere als reale Videoerstellung ermöglicht. Das Modell kann fünf Sekunden lange Videos in nur drei Sekunden generieren und übertrifft damit die Leistung des Vorgängermodells MiniMax H3 um das 35-fache. In unabhängigen Tests hat sich H3 Max als das beste Modell in den Kategorien Bild-zu-Video und Audio etabliert, indem es gegen zwölf führende Modelle die höchste Punktzahl erzielte. Die parallele Entwicklung von Modell und Inferenzsystemen hat zu einer Optimierung von Qualität und Geschwindigkeit geführt, ohne Kompromisse einzugehen. Fal bietet H3 Max über seine API und Plattformen zu einem reduzierten Preis an, was die Erstellung hochwertiger Videos für Entwickler und Unternehmen erleichtert. Die Einführung von H3 Max könnte die Nutzung generativer Medien in der Industrie revolutionieren, indem sie eine ausgewogene Kombination aus Geschwindigkeit und Qualität bietet.
Von KI bis Circular Design: Werden Sie Gestalter:in des Wandels
Der Masterstudiengang Design an der Wilhelm Büchner Hochschule vermittelt umfassendes Wissen über Gestaltungsmethoden und untersucht die Rolle des Designs in technologischen, gesellschaftlichen und ökologischen Kontexten. Die Studierenden kombinieren praktische Gestaltung mit wissenschaftlichen Ansätzen und aktuellen Technologien, um Trends zu analysieren und innovative Lösungen zu entwickeln. Wichtige Themen wie Künstliche Intelligenz und Nachhaltigkeit sind zentral im Curriculum, wodurch die Teilnehmenden ihre kreative Expertise vertiefen und komplexe Gestaltungsprozesse meistern können. Nach einem soliden Grundlagenstudium haben die Studierenden die Möglichkeit, individuelle Schwerpunkte zu setzen und zwischen vier Vertiefungen – Kommunikationsdesign, Animation Design, Game Design und Nachhaltiges Industrie- und Produktdesign – zu wählen. Wahlpflichtmodule ermöglichen eine weitere Individualisierung des Kompetenzprofils, das sowohl gestalterische Erfahrung als auch aktuelle Themen integriert. So werden die Absolventen optimal auf die Herausforderungen der Zukunft vorbereitet.
Steuernummer in 15 Tagen: Thüringen beschleunigt Gründungsprozess
Thüringen hat angekündigt, dass Existenzgründer ihre Steuernummer künftig innerhalb von 15 Arbeitstagen erhalten können, sofern sie vollständige Unterlagen einreichen. Diese Initiative soll den Gründungsprozess beschleunigen und stellt eine ambitionierte Verbesserung im Vergleich zur vierwöchigen Frist der Bundesregierung dar. In einigen Kommunen werden zudem Pilotprojekte getestet, die eine Gründung innerhalb von 24 Stunden ermöglichen, indem Gewerbeanmeldung und steuerliche Erfassung kombiniert werden. Ab 2027 wird die elektronische Bekanntgabe von Steuerbescheiden über das ELSTER-Portal zur Norm, was die Kommunikation zwischen Bürgern und Behörden erleichtert. Um die Verständlichkeit zu erhöhen, wurden 730 Textbausteine der Finanzverwaltung in einfache Sprache umformuliert. Die Digitalisierung der Finanzverwaltung verspricht schnellere Abwicklungen von Steuererklärungen, während KI-gestützte Tools wie MeinELSTER+ bereits für bestimmte Nutzergruppen verfügbar sind. Ein Blick nach Österreich zeigt, dass ähnliche Maßnahmen dort die Bearbeitungszeiten für Steuerangelegenheiten deutlich verkürzt haben.
Safari macOS 27: Apple Intelligence organisiert Tabs automatisch
Am 31. August 2026 hat Apple bedeutende Neuerungen für den Webbrowser Safari im Rahmen des neuen Betriebssystems macOS 27 Golden Gate vorgestellt. Im Mittelpunkt steht die Apple Intelligence, die eine automatisierte Organisation und Gruppierung von Browser-Tabs ermöglicht, um die Privatsphäre der Nutzer zu wahren. Diese Funktion sortiert geöffnete Tabs nach Themen und schlägt verwandte Tabs vor, um das Browsing-Erlebnis zu verbessern. Zudem wird die Benachrichtigungsfunktion „Notify Me“ eingeführt, die Nutzer über Änderungen auf bestimmten Webseiten informiert. Diese Entwicklungen sind Teil der achten Entwickler-Beta von macOS 27, die Ende August veröffentlicht wurde, während die finale Version für den Herbst 2026 erwartet wird. Neben den neuen Funktionen für Safari umfasst die Beta auch Verbesserungen in der Sprachassistenz Siri, der Bildbearbeitung und der Benutzeroberfläche. Experten empfehlen, Beta-Versionen nicht auf Hauptgeräten zu installieren, da der Fokus auf Fehlerbehebungen liegt.
PostPlanify Launches AI Social Media Manager for Agencies Serving Local Businesses
PostPlanify hat eine innovative KI-gestützte Social-Media-Management-Plattform für Agenturen vorgestellt, die es ermöglicht, Kundenkonten effizient über KI-Assistenten zu verwalten. Durch die Integration des Model Context Protocol (MCP) können Agenturen Aufgaben wie das Planen von Beiträgen, das Überprüfen von Analysen und das Erstellen von Berichten nahtlos durchführen, ohne zwischen verschiedenen Dashboards wechseln zu müssen. Hasan Cagli, der Gründer von PostPlanify, hebt hervor, dass diese Funktion den Arbeitsablauf der Agenturen optimiert, indem sie die manuelle Umwandlung von KI-Ausgaben in konkrete Aufgaben überflüssig macht. Die Plattform ermöglicht es Agenturen, ihre Kunden in separaten Arbeitsbereichen zu organisieren, die jeweils eigene soziale Konten und Inhaltskalender enthalten. Sie unterstützt die Verwaltung von über zehn großen sozialen Netzwerken und wird bereits von mehr als 2.600 Unternehmen und Agenturen in über 30 Ländern genutzt. PostPlanify plant, die KI-Funktionen weiter auszubauen, um den steigenden Bedarf an KI-Assistenten in den täglichen Arbeitsabläufen der Agenturen zu decken.
Mango AI's Kiss AI Video Maker Animates One Couple Photo Online
Mango AI hat den Kiss AI Video Maker eingeführt, ein innovatives Tool, das es Nutzern ermöglicht, aus einem einzigen Foto eines Paares animierte Videos zu erstellen. Das Tool fügt automatisch Gesichtsausdrücke und Kopfbewegungen hinzu, ohne dass eine neue Aufnahme nötig ist, und bietet verschiedene Kussstile wie den französischen Kuss oder den Wangenkuss. Nutzer können ein klares Foto im JPG-, JPEG-, PNG- oder WebP-Format hochladen, das dann analysiert wird, um die Animation zu generieren. Die erstellten Clips können heruntergeladen, in sozialen Netzwerken geteilt oder privat gespeichert werden, wobei die Privatsphäre der Nutzer gewahrt bleibt. Mango AI legt großen Wert auf Zustimmung und die Auswahl geeigneter Bilder, insbesondere bei erkennbaren Personen. Ken Glenn, CMO von Mango Animate, betont, dass die Plattform eine benutzerfreundliche Möglichkeit bietet, von einem statischen Bild zu einem animierten Video zu gelangen, und den kreativen Prozess erleichtert, während sie verantwortungsbewussten Umgang mit Inhalten fördert.
Google: KI-Bildbearbeitung „Pics“ startet für AI Pro und Ultra
Google hat die Bildbearbeitungs-App „Pics“ für Abonnenten von Google AI Pro und AI Ultra sowie ausgewählte Geschäftskunden und Bildungseinrichtungen eingeführt. Die App nutzt das Nano-Banana-Modell, das es Nutzern ermöglicht, Bilder durch Text-Prompts neu zu generieren oder bestehende Vorlagen zu bearbeiten. Zu den herausragenden Funktionen gehören die gezielte Anpassung von Bildbestandteilen und die Bearbeitung sowie Übersetzung von Text in 29 Sprachen. Zudem bietet „Pics“ einen Upscaler für höhere Auflösungen und die Möglichkeit, mehrere Bearbeitungsschritte gleichzeitig durchzuführen. Die Integration in das Google Workspace-Ökosystem ermöglicht eine nahtlose Bearbeitung von Bildern direkt in Google Docs und Slides, was den Wechsel zwischen verschiedenen Anwendungen überflüssig macht. Diese Entwicklungen zielen darauf ab, die Nutzerbindung zu stärken und die Abwanderung zu externen Bildbearbeitungstools zu verhindern. In naher Zukunft wird auch die Bearbeitung von Bildern direkt aus Google Drive möglich sein.
Gemini 3.7 Flash activa video agentico: 88% menos tokens
Google DeepMind hat am 1. September die agentische Videoverständnisfunktion in seinen neuesten Modellen Gemini 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite vorgestellt. Diese innovative Funktion ermöglicht es dem System, Videos aktiv zu analysieren und gezielt relevante Teile auszuwählen, anstatt sie statisch zu betrachten. Dadurch wird der Tokenverbrauch um bis zu 88% reduziert und die Kosten um bis zu 66% gesenkt, während die Genauigkeit um bis zu 7% steigt. Besonders bei langen Videos profitieren Entwickler, da sie nicht mehr zwischen hohen Kosten und wichtigen Details abwägen müssen. Die API von Gemini erleichtert die Aktivierung dieser Funktion für Entwickler, und sie wird bald auch für Verbraucher in der Gemini-App verfügbar sein. Mit dieser Entwicklung positioniert sich Gemini 3 in einem zunehmend wettbewerbsintensiven Markt, in dem die Kosten für KI-Modelle eine zentrale Rolle spielen.
Gal Gadot defends starring in AI movie as she rules out ever returning to Wonder Woman
Gal Gadot hat ihre Entscheidung verteidigt, in einem AI-unterstützten Film mit dem Titel "Bitcoin" mitzuwirken, und betont die Notwendigkeit für Schauspieler, sich an neue Technologien anzupassen, um relevant zu bleiben. Sie erklärte, dass eine Rückkehr zur Rolle der Wonder Woman für sie nicht mehr in Frage komme, da sie sich um ihre vier Kinder kümmern müsse. Der Film wurde in nur 20 Tagen auf einer speziell angefertigten Bühne gedreht, wobei AI für Sets und Beleuchtung eingesetzt wurde, während die schauspielerische Leistung im Vordergrund stand. Gadot stellte sicher, dass AI keinen Einfluss auf ihre Darbietung hatte, was sogar die Schauspielergewerkschaft SAG-AFTRA auf den Plan rief. Sie beschrieb die Dreharbeiten als theaterähnlich, was eine kontinuierliche Produktion ermöglichte. Rückblickend äußerte sie Enttäuschung über die unglücklichen Abgänge von Henry Cavill und Patty Jenkins. Obwohl sie dankbar für die Rolle der Wonder Woman ist, ist sie unsicher, ob sie diese in Zukunft wieder übernehmen kann. DC hat bisher keinen Nachfolger für die Rolle bekannt gegeben, während Adria Arjona als mögliche Kandidatin gehandelt wird.
Gal Gadot defends AI film after lengthy talks to protect her performance
Gal Gadot hat sich für ihren kommenden Film, der auf Künstlicher Intelligenz basiert, verteidigt, nachdem sie intensive Gespräche geführt hat, um ihre schauspielerische Leistung zu schützen. In einer Zeit, in der KI-Technologien zunehmend in der Filmindustrie eingesetzt werden, äußerte Gadot Bedenken hinsichtlich der Verwendung von KI zur Nachbildung von Schauspielern. Sie betont die Bedeutung der menschlichen Kreativität und Emotionen in der Schauspielkunst und setzt sich dafür ein, dass die Rechte der Schauspieler gewahrt bleiben. Gadot hofft, dass der Film ein positives Beispiel für den verantwortungsvollen Einsatz von KI in der Unterhaltungsbranche wird und dass die Zuschauer die Authentizität und den Wert menschlicher Darbietungen schätzen.
Claude Fable 5.1 made me a really nice animated pelican
Am 1. September 2026 wurde die Version 5.1 von Claude Fable veröffentlicht, die von Anthropic als Maßstab für Programmierung und Problemlösung hervorgehoben wird. Besonders bemerkenswert ist der Fortschritt in der wissenschaftlichen Forschung, wo Fable 5.1 einen Score von 52,6 % im neuen Terminal-Bench-Science 0.1 Benchmark erzielt hat, was eine deutliche Verbesserung gegenüber früheren Versionen darstellt. Der Autor testete die Leistungsfähigkeit des Modells anhand eines Pelikan-Designs und variierte die Denkstufen von niedrig bis maximal. Während die niedrigeren Einstellungen keine nennenswerte Kreativität zeigten, lieferte die höchste Stufe ein detailliertes und ansprechendes Ergebnis, das jedoch hinter der Kreativität eines Konkurrenzprodukts zurückblieb. Der Autor entschloss sich, das beste Ergebnis in eine Animation umzuwandeln, was zu einem weiteren positiven, wenn auch leicht fehlerhaften Resultat führte. Diese Tests verdeutlichen die neuen Funktionen und Verbesserungen von Fable 5.1.
#Interview - „Die Initialzündung war ein Schockmoment“
KLAO ist ein innovatives Startup aus Würzburg, das sich auf die Übersetzung von Texten in zertifizierte und DIN-konforme Leichte Sprache spezialisiert hat, um Informationen barrierefrei zugänglich zu machen. Die Gründungsidee entstand aus einem Schockmoment, als Gründer Fabian Schlausch während eines Praktikums die mangelhafte Inklusion von Menschen mit Behinderungen erlebte. KLAO bietet verschiedene Produkte an, darunter ein Übersetzungstool für Kommunen und ein API-Portal für Entwickler, um Leichte Sprache in ihre Systeme zu integrieren. Das Team sieht sich jedoch Herausforderungen gegenüber, wie den langen Verkaufszyklen im öffentlichen Sektor und den Budgetengpässen der Kommunen. Zukünftig plant KLAO die Einführung eines Plugins und möchte verstärkt auf Messen und in Netzwerken präsent sein. Das langfristige Ziel des Unternehmens ist es, die Teilhabe von Menschen mit Behinderungen zu verbessern, indem mehr Städten und Kommunen der Zugang zu wichtigen Informationen erleichtert wird.
White House forced to clarify Trump’s AI video of Kharg Island ‘attack’ is fake
Das Weiße Haus musste klarstellen, dass ein von Donald Trump veröffentlichtes, KI-generiertes Video eines angeblichen Angriffs auf die iranische Kharg-Insel gefälscht ist. Das US-Verteidigungsministerium wies die Behauptungen zurück, dass die USA die Insel angegriffen hätten, und sowohl US-Behörden als auch iranische Ölvertreter berichteten von ruhigen Bedingungen an der Anlage. In einem Interview mit Fox News verteidigte Trump die militärischen Maßnahmen gegen Iran und betonte, dass die USA trotz der Kritik von Demokraten leicht gewinnen würden. Währenddessen bestätigten US-Behörden militärische Aktivitäten in der Nähe der Larak-Insel, wo iranische Streitkräfte versuchten, Minenraketen zu starten und abgefangene Raketen auf Jordanien abfeuerten. Verteidigungsminister Pete Hegseth erklärte, dass kinetische Angriffe eine Option bleiben, die USA jedoch derzeit wirtschaftlichen Druck priorisieren, um die finanziellen Ressourcen des iranischen Regimes zu schwächen.
Mit Kaminski auf Fehmarn: Wie der Kreative Thomas Knüwer beim Bücherschreiben Ängste verarbeitet
Thomas Knüwer, CCO von Accenture Song, hat seine Leidenschaft für das Schreiben von Kriminalromanen während eines Burnouts entdeckt. In kleinen Zeitfenstern zwischen seinem anspruchsvollen Job und der Familie verfasst er seine Bücher, ohne auf Künstliche Intelligenz zurückzugreifen. Diese kreative Tätigkeit half ihm, seine Ängste zu verarbeiten und Gedanken zu ordnen. Seine ersten beiden Romane fanden große Beachtung und führten zu einer neuen kreativen Identität. Im Gespräch mit Mirko Kaminski auf Fehmarn betont Knüwer, dass jeder Mensch das Potenzial hat, Geschichten zu erzählen, wobei der innere Drang entscheidend ist. Er thematisiert auch die Herausforderungen des Buchmarkts, in dem nur wenige Autoren vom Schreiben leben können, und hebt die Notwendigkeit hervor, Autoren als langfristige Marken zu etablieren.
Eluvio Tapped for Cricket TV: New Direct-to-Consumer Streaming Service for Live and Archive Coverage to Fans Across the Globe
Cricket Australia hat mit Cricket TV einen neuen Direct-to-Consumer-Streaming-Service ins Leben gerufen, der auf Eluvios Content Fabric und AI Video Intelligence basiert. Dieser Service ermöglicht es Fans weltweit, Live-Übertragungen und Archivmaterial in hoher Qualität zu genießen. Bereits in der frühen Zugangsphase hat Cricket TV Zuschauer in über 40 Ländern erreicht, was das große Interesse am australischen Cricket verdeutlicht. Die Plattform bietet zahlreiche Funktionen, darunter eine dynamische Anpassung der Streaming-Qualität, verschiedene Monetarisierungsoptionen und umfassende Sicherheitsmaßnahmen gegen Piraterie. Eluvios Technologie ermöglicht eine effiziente Verarbeitung und Verbreitung von Inhalten, ohne dass Dateien kopiert oder neu kodiert werden müssen. Die Partnerschaft zwischen Cricket Australia und Eluvio zielt darauf ab, den Fans ein hochwertiges Erlebnis zu bieten und anderen Sportorganisationen ein kosteneffizientes Modell zur Bereitstellung geschützter Inhalte zu präsentieren.
Clipto uses AI to search terabytes of video and is now valued at $250M
Clipto, ein in San Francisco ansässiges Startup, hat sich auf die Suche und Verwaltung von Inhalten spezialisiert und kürzlich eine Bewertung von 250 Millionen Dollar erreicht, nachdem es 15 Millionen Dollar in einer Finanzierungsrunde gesammelt hat. Die Plattform ermöglicht es Nutzern, Videos, Audios und andere Dateien durch einfache Beschreibungen oder Anfragen an KI-Tools wie ChatGPT zu durchsuchen, anstatt manuell durch Ordner zu navigieren. Gründer Henry Kang erkannte, dass viele ungenutzte Dateien auf den Geräten der Nutzer liegen. Ursprünglich auf Videoproduzenten ausgerichtet, hat Clipto mittlerweile eine breitere Nutzerbasis, die auch Fachleute aus verschiedenen Bereichen umfasst. Mit über 30 Millionen Nutzern und jährlichen wiederkehrenden Einnahmen von 15 Millionen Dollar bleibt das Unternehmen profitabel. Clipto plant, seine Technologie weiter auszubauen und mit weiteren KI-Anwendungen zu integrieren, um sich in einem von größeren Unternehmen dominierten Markt zu behaupten.
Claude macOS: Anthropic führt visuelle Skill-Aufzeichnung ein
Anthropic hat mit der Einführung der Funktion „Record a skill“ für seine macOS-Anwendung Claude eine innovative visuelle Skill-Aufzeichnung implementiert. Diese ermöglicht es Nutzern, Bildschirmaktivitäten und Audiosignale aufzuzeichnen, um automatisierte Arbeitsabläufe zu erstellen, anstatt sie nur textbasiert zu definieren. Durch die visuelle Erfassung kann die KI eigenständig SKILL.md-Dateien generieren, die als strukturierte Wissensbasis dienen und komplexe Handlungsabfolgen besser verstehen und reproduzieren. Dies senkt die Barrieren für die Erstellung spezialisierter KI-Fähigkeiten, da Anwender nicht mehr Experten im Formulieren präziser Textprompts sein müssen. Die Funktion verbessert zahlreiche professionelle Arbeitsabläufe, insbesondere in der Suchmaschinenoptimierung und Datenaufbereitung, indem sie visuelle Demonstrationen in automatisierte Prozesse umwandelt. Aktuell ist die Funktion jedoch ausschließlich für macOS-Nutzer verfügbar, was die Mac-App zur bevorzugten Plattform für fortgeschrittene Cowork-Funktionen und individuelle KI-Entwicklung macht. Branchenanalysten erkennen hierin eine zunehmende Spezialisierung von Desktop-KI-Anwendungen im Vergleich zu browserbasierten Lösungen.