Avatar-Video
Aktuelle Links, Zusammenfassungen und Marktinformationen zu Avatar-Video innerhalb von Video auf JetztStarten.de.
Einordnung
Dieses Cluster bündelt aktuelle Links, Zusammenfassungen und Marktinformationen zu einem klar abgegrenzten Thema.
Rubrik: KI Generative Anwendungen
Unterrubrik: Video
Cluster: Avatar-Video
Einträge: 313
Face AI upgrades its video face swap tool with faster processing and better tracking
Face AI hat sein Video-Gesichtstausch-Tool verbessert, um eine schnellere Verarbeitung und präzisere Gesichtserkennung zu bieten. Die neuen Funktionen ermöglichen es, Warteschlangen-Videos in weniger als einer Minute zu verarbeiten, was besonders für Social-Media-Creator auf Plattformen wie TikTok und Instagram Reels von Vorteil ist. Die Technologie kann nun auch mit Brillen, Hüten und wechselnden Lichtverhältnissen umgehen, was die Stabilität der Videos erhöht. Ziel von Face AI ist es, Nutzern ohne Bearbeitungskenntnisse die Erstellung von Gesichtstausch-Videos zu erleichtern, indem Kopfbewegungen und Mikroausdrücke genau erfasst werden. Allerdings gibt es regulatorische Herausforderungen, da ähnliche Technologien auch für betrügerische Zwecke missbraucht werden können. In diesem Zusammenhang hat China Maßnahmen gegen den Missbrauch von KI-gestütztem Gesichtstausch ergriffen, was die Schwierigkeiten für Unternehmen wie Face AI verdeutlicht, die sich als kreative Werkzeuge positionieren.
Best AI Tools for Branding (2026): CapCut Featured for Creating Branded Video and Visual Content by Expert Consumers
Im Jahr 2026 wurde CapCut von Expert Consumers als eines der besten KI-Tools für Branding ausgezeichnet. Die Plattform bietet eine umfassende Sammlung von KI-gestützten Werkzeugen zur Erstellung von Videos, Bildern und Musik, die Unternehmen dabei helfen, ihre Branding- und Marketingstrategien zu optimieren. Angesichts der steigenden Nachfrage nach kreativen Lösungen ermöglicht CapCut Marketingteams, Inhalte schneller und konsistenter über verschiedene digitale Kanäle zu produzieren. Zu den herausragenden Funktionen gehört der Seedance 2.0 AI-Video-Generator, der die Erstellung von Videos aus Textvorgaben ermöglicht und so die Produktionszeiten verkürzt. Zudem unterstützt CapCut die Bildgenerierung und -bearbeitung, was die Entwicklung visueller Konzepte erleichtert. Die Plattform bietet auch die Möglichkeit, Originalmusik zu erstellen und Bilder in 3D-Visuals umzuwandeln, was die Gestaltung reichhaltiger Multimedia-Erlebnisse fördert. Insgesamt zeigt die Anerkennung von CapCut, dass Unternehmen zunehmend auf KI-gestützte Plattformen setzen, um ihre Inhalte effizient zu erstellen und eine konsistente visuelle Identität zu wahren.
In2ition AI Brings Its Always-On Intelligence Layer to Every Video Meeting with Iris Listen
In2ition AI hat mit Iris Listen eine innovative Funktion für seine KI-Mitarbeiterin Iris eingeführt, die es ermöglicht, in Echtzeit über Plattformen wie Zoom, Microsoft Teams, Google Meet und Webex zuzuhören. Diese Funktion schließt eine wichtige Lücke in der Datenerfassung von Geschäftsgesprächen, indem sie alle Video-Meetings in eine einheitliche Intelligenzschicht integriert. Iris Listen analysiert nicht nur die Inhalte der Gespräche, sondern bewertet auch Tonfall und Stimmung, um gezielte Empfehlungen zur Leistungsverbesserung zu geben. Dies ermöglicht Unternehmen, wertvolle Erkenntnisse aus Meetings zu gewinnen, die zuvor in isolierten Notizen festgehalten wurden. CEO Joseph Lepordo hebt hervor, dass Iris Listen nicht nur Informationen bereitstellt, sondern auch die Mitarbeiterleistung steigern soll. Die Funktion wird ab dem 1. August 2026 für bestehende Kunden als Zusatzangebot und für Neukunden als Teil des Pakets verfügbar sein. Durch die Integration aller Kommunikationskanäle schafft In2ition AI eine umfassende Plattform für kontinuierliches Lernen in Unternehmen.
Philippines condemns China for ‘racist’ AI video depicting Filipinos as monkeys
Die Philippinen haben China für ein als rassistisch empfundenes, KI-generiertes Video verurteilt, das Filipinos als Affen darstellt. Das am 10. Juli veröffentlichte Video, das mit dem zehnten Jahrestag eines wichtigen Schiedsspruchs zur Südchinesischen See zusammenfiel, zeigt einen Affen in philippinischer Kleidung, der von Figuren, die die USA und Japan repräsentieren, dirigiert wird. Die philippinische Regierung bezeichnete die Darstellung als "tief beleidigend" und forderte die sofortige Entfernung des Videos, das sie als "verachtenswerte Propaganda" einstuft. Verteidigungsminister Gilberto Teodoro kritisierte das Video als Schande für China und wies darauf hin, dass es die Schwäche der chinesischen Regierung offenbare. Diese Vorfälle ereignen sich vor dem Hintergrund zunehmender Spannungen zwischen den Philippinen und China, insbesondere hinsichtlich des Zugangs zur Südchinesischen See. Filipinische Fischer berichten von Übergriffen durch chinesische Kräfte, und die Installation einer Barriere am Scarborough Shoal hat die Situation weiter verschärft. Bisher hat Peking auf die Kritik der Philippinen nicht reagiert.
Alibaba's Amap Unveils ABot-World AI Models That Generate Interactive Video and 3D Scenes for Hours on a Single GPU
Amap, die standortbasierte Plattform von Alibaba, hat zwei innovative KI-Modelle, ABot-World-0 und ABot-3DWorld-0, vorgestellt, die interaktive Videos und 3D-Szenen generieren können. Diese Modelle ermöglichen eine kontinuierliche Erstellung von Inhalten über eine Stunde hinweg auf einem einzigen Verbraucher-Grafikprozessor, was eine bedeutende Verbesserung gegenüber bestehenden Systemen darstellt. Das ABot-World-Modell integriert Szenennavigation und Charakterkontrolle, um die Stabilität der Videos zu erhöhen, während ein Algorithmus zur zeitlichen Konsistenz Fehler während der Generierung minimiert. Das ABot-3DWorld-0-Modell erzeugt hochrealistische 3D-Assets und nutzt eine modulare Pipeline zur Qualitätssicherung. Amap hat diese Modelle in ein Produkt integriert, das eine gemeinsame Speicherung und Umwandlung von Videoausgaben und 3D-Assets ermöglicht. Zudem wird ein "Spatial Teleport"-Mechanismus eingeführt, der nahtlose Übergänge zwischen verschiedenen 3D-Welten ermöglicht. Alle Inferenzaufgaben können lokal auf einem einzelnen GPU ausgeführt werden, was die Notwendigkeit für verteilte Systeme oder Cloud-Beschleuniger überflüssig macht. Die Anwendungen dieser Technologie reichen von KI-Simulationen bis hin zu immersiven Erlebnissen in Bildung und Kultur.
Google Vids Adds Gemini Omni AI and Personal Avatars
Google hat mit den neuen Funktionen Gemini Omni und persönlichen Avataren die Videoproduktion für Workspace-Nutzer revolutioniert. Diese Updates ermöglichen es, professionelle Videos ohne Kamera zu erstellen und zu bearbeiten, was Google als strategischen Schritt zur Förderung von Wissensarbeitern sieht. Gemini Omni nutzt konversationelle KI, um Nutzern zu ermöglichen, ihre Wünsche in einfacher Sprache zu äußern, während die KI das Video erstellt. Die persönlichen Avatare bieten die Möglichkeit, digitale Versionen der Nutzer zu erstellen, die in ihrer Stimme und Erscheinung narrativ unterstützen, ohne neue Aufnahmen zu benötigen. Diese Innovationen zielen darauf ab, die Effizienz in Marketing, Training und Vertrieb zu steigern, indem sie aufwendige Produktionen reduzieren. Google positioniert sich damit als zentrale Anlaufstelle für Unternehmensvideoproduktion und bindet Nutzer durch die Integration in die Workspace-Umgebung. Es bleibt jedoch abzuwarten, wie gut die Funktionen in der Praxis funktionieren und ob sie die Nutzer überzeugen können, ohne in die "uncanny valley"-Falle zu tappen. Die kommenden Monate werden zeigen, ob diese Entwicklungen tatsächlich zu einer signifikanten Produktivitätssteigerung führen.
Google Vids now lets you star in your own AI videos
Google hat ein Update für Google Vids eingeführt, das es Nutzern ermöglicht, eigene AI-Videos zu erstellen. Dabei können sie einen digitalen Avatar basierend auf einem hochgeladenen Selfie und einer Sprachaufnahme kreieren. Mit dem neuen multi-modalen AI-Modell Gemini Omni können Videos aus schriftlichen Vorgaben und Referenzbildern generiert werden, wobei Omni diese Eingaben kombiniert. Nutzer haben die Möglichkeit, Hintergründe auszutauschen, die Beleuchtung zu verbessern und Effekte hinzuzufügen, während sie schrittweise Anpassungen vornehmen können. Diese Funktionen erweitern Google Vids über ein einfaches Präsentationstool hinaus und positionieren es als umfassende Videoproduktionsplattform. Google plant zudem, Vids in Google Workspace zu integrieren, um es als Geschäftsinstrument für Unternehmensupdates und Schulungsvideos zu nutzen. Die neuen Avatare sind an das Erscheinungsbild der Nutzer gebunden und mit einem unsichtbaren Wasserzeichen versehen, um Missbrauch zu verhindern. Der Zugang zu diesen personalisierten Avataren ist jedoch auf Nutzer ab 18 Jahren und in bestimmten Regionen beschränkt.
AI avatars are reshaping society in China – the law is trying to catch up
In China transformieren KI-Avatare zunehmend verschiedene Lebensbereiche, darunter Bildung, Gesundheitswesen und soziale Interaktionen. An Universitäten wie der Hong Kong University of Science and Technology interagieren Studierende mit KI-Avataren, die historischen Persönlichkeiten wie Albert Einstein nachempfunden sind, um das Lernen zu bereichern. Über 1,3 Millionen Unternehmen bieten Dienstleistungen im Zusammenhang mit diesen digitalen Menschen an, was die chinesische Regierung dazu veranlasst hat, Vorschriften zur Regulierung ihrer Entwicklung und Nutzung zu erlassen. Diese Maßnahmen sind Teil eines umfassenderen Plans, KI in das soziale und wirtschaftliche Gefüge des Landes zu integrieren. Im Gesundheitswesen werden virtuelle Ärzte durch Simulationen wie das Agent Hospital ausgebildet, während KI-gestützte Gesundheits-Apps Patienten den Zugang zu digitalen Versionen realer Ärzte ermöglichen. In der Bildung fungieren KI-Avatare als interaktive Dozenten und könnten sich zu persönlichen Tutoren entwickeln. Zudem ermöglichen soziale Medien Nutzern, KI-Klone für die Interaktion zu erstellen. Mit dem Fortschritt der Technologie werden ethische Überlegungen und Rahmenbedingungen notwendig sein, um eine verantwortungsvolle Nutzung sicherzustellen.
Video game AI opponents boost play time, gaming with friends
In der heutigen Gaming-Welt haben KI-Gegner einen signifikanten Einfluss auf die Spielzeit und das Spielerlebnis, insbesondere beim Spielen mit Freunden. Diese intelligenten Systeme bieten nicht nur herausfordernde Gegner, sondern fördern auch die Interaktion und den Wettbewerb unter den Spielern. Durch die Anpassungsfähigkeit der KI können Spiele dynamischer und spannender gestaltet werden, was zu längeren Spielsitzungen führt. Zudem ermöglichen KI-Gegner, dass Spieler auch ohne menschliche Mitspieler spannende Partien erleben können. Dies trägt dazu bei, die soziale Komponente des Gamings zu stärken, da Freunde gemeinsam gegen die KI antreten können. Insgesamt zeigen Studien, dass die Integration von KI in Videospiele sowohl die Spielzeit verlängert als auch das Gemeinschaftsgefühl unter den Spielern fördert.
AI Media Buyer By Creatify
Der Artikel über die AI Media Buyer-Plattform von Creatify schlägt mehrere Verbesserungen vor, um die Nutzererfahrung zu optimieren. Eine zentrale Empfehlung ist die Einführung detaillierterer Bearbeitungsfunktionen, die es ermöglichen, Szenen, Zeitabläufe und Übergänge präzise anzupassen, ohne das gesamte Video neu generieren zu müssen. Zudem wird die Notwendigkeit betont, die Vielfalt und Natürlichkeit der KI-Stimmen und Avatare zu erhöhen, um emotionale Bandbreite und unterschiedliche Sprechstile zu integrieren, was die Werbeanzeigen realistischer und zielgruppenspezifischer macht. Ein weiteres Anliegen ist die Verbesserung der Konsistenz in Kampagnen, da derzeit manuelle Anpassungen erforderlich sind, um Branding und Stil über verschiedene Anzeigen hinweg abzustimmen. Schließlich wird die Einführung schnellerer Vergleichswerkzeuge vorgeschlagen, die es Nutzern erleichtern, verschiedene Versionen nebeneinander zu betrachten und schnellere Entscheidungen zu treffen. Diese Verbesserungen könnten die Plattform sowohl für Anfänger als auch für Marketingteams attraktiver gestalten.
AI companies are creating "generative ghosts" of deceased loved ones
Jack Manning, ein Doktorand an der University of Colorado Boulder, erforscht die Nutzung von Künstlicher Intelligenz zur Schaffung von "generativen Geistern" verstorbener Angehöriger. Diese AI-Chatbots werden mit Daten aus sozialen Medien, E-Mails sowie Audio- und Videoaufnahmen trainiert, um digitale Simulationen zu erzeugen, mit denen Hinterbliebene interagieren können. Unternehmen wie Séance AI und Re;memory bieten bereits solche Dienste an, wobei Re;memory es Nutzern ermöglicht, realistische Avatare ihrer Liebsten zu erstellen. Studien zeigen, dass Nutzer von der Fähigkeit der KI fasziniert sind, mit minimalen Informationen authentische Darstellungen zu erzeugen. Diese generativen Geister können nicht nur die Stimme und Kommunikationsweise des Verstorbenen nachahmen, sondern auch auf Fragen reagieren, die der Verstorbene zu Lebzeiten möglicherweise nicht beantwortet hat. Die Kosten für diese Dienste variieren, wobei Re;memory 24 Dollar pro Monat für drei benutzerdefinierte Avatare verlangt. Nutzer bevorzugen es, in der ersten Person mit dem AI-Geist zu kommunizieren, und reagieren empfindlich auf unpassende Begriffe. Im Gegensatz zu Deepfakes zielen generative Geister nicht darauf ab, zu täuschen, sondern bieten eine Form der Interaktion mit den Erinnerungen an Verstorbene.
AI job rejections felt least fair when avatars shared just one trait
In der Studie "AI job rejections felt least fair when avatars shared just one trait" wird untersucht, wie die Wahrnehmung von Fairness bei Jobabsagen durch Künstliche Intelligenz beeinflusst wird. Die Forschung zeigt, dass Bewerber besonders dann das Gefühl haben, ungerecht behandelt worden zu sein, wenn die abgelehnten Bewerber-Avatare nur ein gemeinsames Merkmal mit ihnen teilen, wie beispielsweise Geschlecht oder ethnische Zugehörigkeit. Diese Erkenntnisse deuten darauf hin, dass die Wahrnehmung von Fairness stark von der Ähnlichkeit zwischen dem Bewerber und den abgelehnten Avataren abhängt. Die Ergebnisse könnten wichtige Implikationen für die Gestaltung von KI-gestützten Rekrutierungssystemen haben, um Diskriminierung zu vermeiden und die Akzeptanz solcher Technologien zu erhöhen. Die Studie fordert dazu auf, die Transparenz und die Entscheidungsprozesse von KI-Systemen zu verbessern, um ein gerechteres Bewerbungsverfahren zu gewährleisten.
Malaysia’s PM is sending an autonomous AI double out to serve citizens, payment links and all
Der malaysische Premierminister Anwar Ibrahim plant die Einführung eines autonomen KI-Avatars namens PMX AI, der als digitale Kopie seiner selbst fungieren soll, um den Bürgern zu dienen. Entwickelt von Zetrix AI Bhd., wurde der Avatar auf Anwars eigenen Schriften und Reden trainiert, um ihm möglichst ähnlich zu sein. PMX AI kann nicht nur sprechen, sondern auch eigenständig Aufgaben wie die Erneuerung von Führerscheinen oder die Beratung zu Ausbildungsplätzen übernehmen. Die Einführung des Avatars erfolgt im Vorfeld der nationalen Wahlen, die bis spätestens 2028 stattfinden müssen, und zielt darauf ab, insbesondere jüngere Wähler anzusprechen. Trotz der als fortschrittlich angesehenen Technologie gibt es Bedenken hinsichtlich Sicherheit und möglicher Manipulation, da der Avatar auch falsche Informationen verbreiten könnte. Anwar und sein Team sind jedoch optimistisch, dass die Bürger den Avatar als nützlichen Dienst und nicht als politische Manipulation wahrnehmen werden.
Mango AI's Talking Photo Generator Creates Lifelike Speaking Avatars
Mango AI hat den Talking Photo Generator vorgestellt, ein innovatives Tool, das es Nutzern ermöglicht, aus einem einzelnen Porträt lebensechte, sprechende Avatare zu erstellen. Dieses Produkt reagiert auf die wachsende Nachfrage nach charaktergetriebenem Videoinhalt, indem es statische Bilder in dynamische Videos mit synchronisierten Lippenbewegungen und natürlichen Gesichtsausdrücken verwandelt. Die Nutzung ist einfach: Nutzer laden ein Bild hoch, wählen ein Modell, geben Text ein und wählen eine Stimme aus einer umfangreichen Bibliothek. Alternativ können sie auch eigene Audio-Dateien hochladen oder ihre Stimme direkt im Browser aufnehmen. Mango AI bietet zwei Modelle an: eines für schnellere Ergebnisse und ein anderes für höhere Videoqualität und flüssigere Animationen. Die erstellten Videos können leicht über verschiedene Plattformen geteilt oder heruntergeladen werden, was sie ideal für Marketing und soziale Medien macht. CEO Winston Zhang hebt hervor, dass der Generator auf Geschwindigkeit, Benutzerfreundlichkeit und ausdrucksstarke Ergebnisse ausgelegt ist, sodass Kreative in wenigen Minuten ansprechende Videos erstellen können.
Video Remix: Google Fotos bekommt KI-Videoeditor für unterwegs
Google hat die Funktionen von Google Fotos mit einem neuen KI-Videoeditor namens Video Remix erweitert, der es Nutzern ermöglicht, Videos unterwegs zu bearbeiten. Dieser Editor nutzt die Gemini Omni-Technologie, um gleichzeitig Video, Bild und Ton zu bearbeiten. Anstelle einer klassischen Zeitleiste können Nutzer durch verschiedene Vorlagen navigieren, um ihre Videos zu gestalten. Die KI passt Beleuchtung an, tauscht Hintergründe aus und wendet künstlerische Filter an, um einfache Handyvideos in kreative Kunstwerke zu verwandeln. Die Bearbeitung erfolgt in der Cloud, was eine Synchronisation mit einem Google-Konto erfordert. Fertige Clips erhalten ein SynthID-Wasserzeichen, und die Nutzung des Video Remix ist an kostenpflichtige Abonnements wie Google AI Plus, Pro oder Ultra gebunden. Der Dienst wird zunächst in den USA und einigen anderen Ländern eingeführt und steht nur volljährigen Nutzern zur Verfügung, wobei die Anzahl der KI-Generierungen pro Konto begrenzt ist.
Can we use AI to speak to animals?
Der Artikel untersucht die Möglichkeit, künstliche Intelligenz (KI) zur Kommunikation mit Tieren einzusetzen. Er hebt hervor, dass es Fortschritte im Verständnis tierischer Kommunikation gibt, die durch KI-Technologien unterstützt werden könnten. Diese Diskussion wird durch ein begleitendes Video ergänzt, das jedoch nur abspielbar ist, wenn JavaScript im Browser aktiviert ist. Die Thematik ist besonders relevant, da sie auf einer Nachrichtenplattform veröffentlicht wurde, die sich mit den neuesten Entwicklungen im Bereich der KI beschäftigt. Die potenziellen Auswirkungen einer solchen Technologie könnten unser Verständnis von Tieren und deren Verhalten revolutionieren und neue Perspektiven auf die Interaktion zwischen Mensch und Tier eröffnen.
Prime Craft Media Launches Healthcare's First AI-Avatar Content Engine, Turning a Single Shoot Day Into a Year of Patient-Generating Content
Prime Craft Media hat eine bahnbrechende AI-Avatar-Content-Engine für das Gesundheitswesen eingeführt, die es Ärzten ermöglicht, aus nur einem Drehtag ein ganzes Jahr an Inhalten für soziale Medien zu erstellen. Diese innovative Technologie kombiniert authentische Inhalte von Ärzten mit AI-Avataren, um die Reichweite zu maximieren und die Umwandlung von Followern in Patienten zu verbessern. Der Prozess beginnt mit einer NeuroPrint-Sitzung, die die Stimme und Philosophie des Arztes erfasst, gefolgt von strategischer Planung und einem umfassenden Fahrplan. An einem einzigen Drehtag wird umfangreiches Filmmaterial produziert, das in eine Content-Bibliothek umgewandelt wird, während der AI-Avatar mehrsprachige Bildungsinhalte erstellt. Dies ermöglicht es Ärzten, sich auf ihre medizinische Praxis zu konzentrieren, während die Inhalte online aktiv bleiben und potenzielle Patienten anziehen. Prime Craft Media berichtet monatlich über das Wachstum und die Buchungen der Kunden und hat bereits über 60 Gesundheitsdienstleister unterstützt, die zusammen eine Reichweite von über fünf Millionen Followern und einen Umsatz von mehr als 4,5 Millionen Dollar erzielt haben.
Mango AI Expands Its Image to Video Generator with Multiple AI Models
Mango AI hat seine Bild-zu-Video-Generator-Funktion erweitert, die es Nutzern ermöglicht, aus statischen Fotos und Textprompts kurze Videos zu erstellen. Diese innovative Funktion richtet sich an Content-Ersteller, Vermarkter, Pädagogen und alltägliche Nutzer, die schnell Videomaterial benötigen, ohne über Film- oder Bearbeitungskenntnisse zu verfügen. Der gesamte Prozess findet im Browser statt: Nutzer laden ein Bild hoch und geben eine Beschreibung der gewünschten Bewegung ein. Der Generator interpretiert das Bild und den Text, fügt Bewegungen und visuelle Übergänge hinzu und erstellt die Clips in der Regel innerhalb weniger Minuten. Verschiedene KI-Modelle bieten unterschiedliche Prioritäten in Bezug auf Geschwindigkeit, Kosten und Detailgenauigkeit, sodass Nutzer die passende Option für ihr Projekt wählen können. Nach der Erstellung können die Clips als Dateien heruntergeladen oder auf sozialen Medien geteilt werden. Mango AI zielt darauf ab, die Lücke zwischen statischen Bildern und bewegten Clips zu schließen, damit Nutzer sich auf ihre kreativen Ideen konzentrieren können.
»Deadly Patient«: Amazon löscht vergurkte KI-Synchro
Amazon hat den Film "Deadly Patient" von seiner Plattform entfernt, nachdem eine missratene KI-Synchronisation für Aufsehen sorgte. Die neue deutsche Synchronisation war von gravierenden Mängeln geprägt, darunter Grammatikfehler und eine unnatürliche Sprachführung, die dem Psychodrama unfreiwillige Komik verlieh. Besonders viral wurden einige Dialoge, in denen Synchronsprecher die mangelhafte Qualität der Synchronisation humorvoll kommentierten. Diese Clips verbreiteten sich schnell auf sozialen Medien wie TikTok, was Amazon dazu veranlasste, den Film vorübergehend nicht mehr anzubieten. Ein Sprecher von Prime Video erklärte, dass die Synchronisation nicht den Qualitätsstandards entsprach. Der Film war über Prime Video Direct auf die Plattform gelangt, was anderen Anbietern die Veröffentlichung ihrer Produktionen ermöglichte. Der Vorfall wirft Fragen über den Einfluss von KI auf die Synchronsprecherbranche auf und verstärkt die Diskussion über die Qualität von KI-generierten Inhalten.
Best AI Content Creation Tools (2026): CapCut Recognized for AI-Powered Video and Image Creation by Software Experts
CapCut wurde von Software Experts als eines der besten AI-Content-Creation-Tools des Jahres 2026 ausgezeichnet. Die Plattform bietet umfassende Funktionen zur Erstellung von Video-, Bild- und Audioinhalten und ermöglicht Nutzern eine effiziente Produktion. Mit Tools wie Seedance für Videos, Seedream für Bilder und SeedMusic für Audio können einfache Eingaben in ansprechende Medien umgewandelt werden. Dies ist besonders vorteilhaft für Kreative, kleine Unternehmen und Bildungseinrichtungen. CapCut unterstützt den gesamten Produktionsprozess, von der Ideenentwicklung bis zur finalen Exportierung, und macht die Nutzung mehrerer Plattformen überflüssig. Die Software bietet zudem Funktionen wie automatische Untertitel und Text-zu-Sprache, die die Benutzerfreundlichkeit erhöhen. Insgesamt zeigt die Anerkennung von Software Experts, dass CapCut eine leistungsstarke Lösung für die Erstellung vielfältiger Inhalte darstellt.
Chinese AI video maker Kling raises $2 billion as it gears up for Hong Kong IPO
Kuaishou hat erfolgreich etwa 2 Milliarden Dollar von Investoren für seine AI-Video-Sparte Kling gesammelt, was die Bewertung der Einheit auf 18 Milliarden Dollar anhebt. Zu den führenden Investoren gehören CPE, Guofang Investment, BlueFive, Tencent und Citic Securities, wobei die Gesamtsumme möglicherweise auf bis zu 3 Milliarden Dollar steigen könnte. In diesem Fall würde Kuaishous Anteil an Kling auf 68,33 Prozent sinken. Das Unternehmen plant, Kling an der Hongkonger Börse zu listen, was im Einklang mit dem Trend steht, dass mehrere chinesische AI-Firmen IPOs in Hongkong anstreben. Obwohl Kling als zentraler Bestandteil des Geschäfts gilt, befindet sich die Einheit noch in einer frühen Phase der Monetarisierung. Im wettbewerbsintensiven Markt tritt Kling gegen Produkte wie Googles Veo 3.1 und ByteDance's Seedance an und hat kürzlich sein Modell Kling 3.0 vorgestellt.
KI-Update: Deutschland-App, OpenAI bietet Beteiligung, KI als Chef, Git-KI-Tool
In einem aktuellen KI-Update wird die geplante Deutschland-App des Bundesdigitalministeriums vorgestellt, die ab 2027 den Zugang zu Verwaltungsleistungen durch verschiedene Bedienmodi wie Chatbots und KI-generierte Video-Avatare erleichtern soll. Die Nutzung der App ist freiwillig. Zudem plant die Bundesregierung eine Taskforce, um Deutschland als „KI-Nation“ zu positionieren. Microsoft investiert in ein viertes KI-Rechenzentrum im Rheinischen Revier, um den Strukturwandel nach dem Kohleausstieg zu unterstützen, während Umweltverbände wegen des hohen Strombedarfs Bedenken äußern. OpenAI verhandelt mit der US-Regierung über eine fünfprozentige Beteiligung am Unternehmen, um die Gewinne aus der KI-Entwicklung gerechter zu verteilen. In der Unternehmenswelt zeigen Firmen wie Citi und Amazon eine Kehrtwende in der KI-Nutzung, indem sie den Zugriff auf neuere Modelle einschränken, um Kosten zu senken. Zudem haben Forschende von Meta ein KI-System entwickelt, das Text aus Hirnsignalen rekonstruiert, was für Menschen mit schweren Lähmungen von Bedeutung sein könnte.
Rosie O’Donnell fires back after being featured in Trump’s bizarre doctor AI video
Rosie O'Donnell hat auf ein von Donald Trump veröffentlichtes AI-Video reagiert, in dem sie und andere Prominente als Beispiele für das angebliche "Trump Derangement Syndrome" (TDS) herangezogen werden. In dem Video tritt Trump als Arzt auf und präsentiert gefälschte Testimonials, in denen die Stars über ihre Abneigung gegen ihn sprechen. O'Donnell, die seit fast zwei Jahrzehnten in einem Konflikt mit Trump steht, bezeichnete ihn als "ziemlich krank" und forderte seine Absetzung. Ihre Feindschaft begann 2006, als O'Donnell Trump für seine moralischen Ansprüche kritisierte, was zu einem öffentlichen Streit führte. Trotz der jahrelangen Auseinandersetzungen hat Trump nie rechtliche Schritte gegen sie unternommen. O'Donnell lebt mittlerweile in Irland und hat die US-Staatsbürgerschaft beantragt, was Trump dazu veranlasste, mit der Entziehung ihrer Staatsbürgerschaft zu drohen. Diese Auseinandersetzung verdeutlicht die tiefen politischen und persönlichen Gräben in der amerikanischen Gesellschaft.
ShengShu Technology Unveils Vidu S1, Bringing Real-Time Interactive Generation to AI Video
ShengShu Technology hat auf der Global Digital Economy Conference das Vidu S1 vorgestellt, ein innovatives Modell für die Echtzeit-Interaktion in der KI-Videoerstellung. Dieses System ermöglicht es Nutzern, AI-Avatare durch Sprachsteuerung in Echtzeit zu steuern, was eine dynamische Interaktion fördert. Im Gegensatz zu traditionellen Modellen, die Videos offline generieren, passt Vidu S1 Inhalte sofort an die Sprachbefehle der Nutzer und den aktuellen visuellen Kontext an. Die Technologie basiert auf einer autoregressiven Diffusionsarchitektur, die eine langfristige Interaktivität der Charaktere gewährleistet. Nutzer können zudem mit nur einem Bild individuelle interaktive Charaktere erstellen, was die Charaktererstellung erheblich vereinfacht. Vidu S1 bietet eine Auflösung von 540P bei 25 FPS und ist auf handelsüblichen GPUs lauffähig, was die Hardwareanforderungen reduziert. Diese Entwicklungen eröffnen neue Anwendungsmöglichkeiten in Bereichen wie interaktive Livestreams, AI-Begleiter und Online-Bildung, und transformieren die KI-Videoerstellung von statischen Inhalten zu dynamischen Erlebnissen.
What’s the Best Open-Source AI Video Model You Can Actually Run? (8GB → 24GB VRAM)
Im Jahr 2026 gewinnt die Nutzung von Grafikkarten zur Videoerstellung an Bedeutung, da sie in der Lage sind, Videos in 720p oder 1080p zu generieren. Die Renderzeiten variieren je nach Modell, jedoch herrscht Unklarheit über das beste Open-Source-AI-Video-Modell. Die ersten sechs Suchergebnisse liefern unterschiedliche Informationen, was die Transparenz in der aktuellen Landschaft der Open-Source-Modelle infrage stellt. Viele Aggregator-Websites und Ranglisten verwenden ungenaue Daten, insbesondere hinsichtlich der VRAM-Anforderungen, was zu Verwirrung führt. Modelle wie Wan 2.2 und Open-Sora 2.0 bieten zwar hohe visuelle Qualitäten, doch bleibt unklar, welche Modelle für Nutzer mit 12GB VRAM geeignet sind. Diese Unsicherheiten könnten dazu führen, dass Nutzer auf kommerzielle Lösungen zurückgreifen, die eine klarere Preis-Leistungs-Bewertung bieten.
Best AI Video Generator Tools (2026): CapCut Recognized for Fast AI-Powered Video Creation by Software Experts
CapCut wurde von Software Experts als eines der besten AI-Video-Generator-Tools des Jahres 2026 ausgezeichnet. Die Plattform bietet eine schnelle und benutzerfreundliche Lösung zur Erstellung von Videos, die sich an Kreative, kleine Unternehmen und Bildungseinrichtungen richtet. Sie erleichtert den gesamten Prozess von der Idee bis zum fertigen Video und reduziert Produktionsbarrieren. Mit innovativen Funktionen wie Text-zu-Video- und Bild-zu-Video-Generierung können Nutzer ihre Konzepte schnell in nutzbare Entwürfe umsetzen, ohne die Kontrolle über den Bearbeitungsprozess zu verlieren. Besonders hervorzuheben ist die Seedance 2.0-Funktion, die AI-Video-Generierung mit Bearbeitungswerkzeugen kombiniert, um Inhalte für verschiedene Plattformen zu optimieren. Die Anerkennung von Software Experts verdeutlicht den wachsenden Trend, dass AI-Tools die Videoproduktion effizienter gestalten und gleichzeitig die Qualität der Inhalte verbessern.
Doctor Trump MD: President posts AI video diagnosing celebrities with derangement syndrome
Präsident Trump hat ein A.I.-generiertes Video veröffentlicht, in dem er sich als Arzt präsentiert, der Prominente mit dem sogenannten „Trump Derangement Syndrome“ (TDS) diagnostiziert. In dem Clip erscheinen Nachbildungen von Hollywood-Stars wie Whoopi Goldberg und Robert De Niro, die Trump in der Vergangenheit kritisiert haben. Der A.I.-Trump fragt die Zuschauer, ob sie oder jemand, den sie kennen, an TDS leiden, und bietet eine „Behandlung“ an, die darin besteht, „Fake News“ abzuschalten und einen Diet Coke zu trinken. Die gefälschten Patienten schildern Symptome wie Schlaflosigkeit und ständige Wut. Trump nutzt den Begriff TDS, um seine Kritiker zu diskreditieren, und bezieht sich dabei auf eine frühere Bezeichnung, die für Kritiker von George W. Bush geprägt wurde. Das Video zeigt Trumps humorvolle, aber auch provokante Art, mit Kritik umzugehen und seine politischen Gegner ins Lächerliche zu ziehen.
HitPaw Unveils VikPea V5.4.0 With New AI Video Stylization, Face Tracking Beauty and Smart Import
HitPaw hat die neueste Version seiner AI-Video-Enhancement-Plattform, VikPea V5.4.0, vorgestellt, die zahlreiche innovative Funktionen zur Verbesserung der Videoerstellung bietet. Zu den Highlights gehört die AI Video Stylization, die es Nutzern ermöglicht, herkömmliche Aufnahmen in stilisierte Videos zu verwandeln, während die Bewegungsstabilität gewahrt bleibt. Das Face Tracking im Video Beauty-Modul wurde optimiert, sodass Effekte gezielt auf ausgewählte Gesichter angewendet werden können, was besonders in dynamischen Szenen von Vorteil ist. Die neue Smart Video Import-Funktion erlaubt es, Videos direkt von Plattformen wie YouTube und TikTok sowie von DVDs zu importieren, was den Workflow erheblich vereinfacht. Zudem verbessert ein aktualisiertes AI Generative Model die Klarheit von Texten in Videos, was für Tutorials und Präsentationen von Bedeutung ist. Die Exportgeschwindigkeit wurde um bis zu 20 % gesteigert, was eine schnellere Bearbeitung von Portraits und stabileren Videos ermöglicht. VikPea V5.4.0 stellt somit einen bedeutenden Fortschritt in der Videoverarbeitung dar.
Mango AI's Baby AI Video Generator Turns Photos into Talking Baby Videos
Mango AI hat einen innovativen Baby AI Video Generator entwickelt, der es Nutzern ermöglicht, Babyfotos in realistische, sprechende Videos zu verwandeln. Der einfache Prozess umfasst das Hochladen eines Frontfotos des Babys und das Hinzufügen einer Audioaufnahme, woraufhin das Tool das Bild animiert und die Mundbewegungen synchronisiert. Es stehen zwei Modelle zur Verfügung: Mango AI 1.0, das auf schnelle Verarbeitung mit Standardqualität abzielt, und Mango AI 2.0, das verbesserte Videoqualität und Körperbewegungen bietet. Die erstellten Videos können über soziale Medien oder QR-Codes geteilt werden. Zusätzlich hat Mango AI ein Tool für Baby-Podcasts eingeführt, das Fotos in animierte Babycharaktere verwandelt, die Podcast-Inhalte präsentieren. Laut CEO Winston Zhang erleichtert der Generator die Erstellung personalisierter Videos aus alltäglichen Babyfotos für kreative und soziale Anwendungen.
OCBC unveils AI avatar wealth app
Die Oversea-Chinese Banking Corp (OCBC) hat die Einführung einer KI-basierten App namens OCBC WoW angekündigt, die vermögenden Kunden rund um die Uhr vermögensbezogene Dienstleistungen bietet. Im Rahmen ihrer Next Frontier Strategy plant die Bank, in den nächsten drei Jahren 600 zusätzliche Relationship Manager einzustellen, um diese Innovation zu testen. Die App nutzt zwei Avatare, Wendy und Wayne, und wird zunächst ausgewählten Mitarbeitern sowie Kunden mit einem verwalteten Vermögen von mindestens 1,5 Millionen S$ zur Verfügung stehen. In der ersten Version bietet die Anwendung aktuelle Nachrichten, Marktupdates und Preisdaten zu sieben Indizes und Rohstoffen, basierend auf einer komplexen Technologiearchitektur. Zudem hat OCBC ein Schulungsprogramm für generative KI für seine Vermögensberater in Singapur eingeführt, um die Integration von KI in den Kundenservice zu fördern.
Pollo AI Launches Pollo API with Access to 300+ AI Video and Image Models
Pollo AI hat die Pollo API eingeführt, eine umfassende Plattform, die Entwicklern den Zugang zu über 300 KI-Modellen für Video und Bild ermöglicht. Die API unterstützt bekannte Modellfamilien wie Veo, Seedance und GPT Image und erleichtert die Integration kreativer Funktionen in Anwendungen. Durch eine einmalige Verbindung können Produktteams das beste Modell für ihren spezifischen Anwendungsfall auswählen, was die Flexibilität und Effizienz erhöht. Die Plattform bietet umfangreiche Funktionen zur Medienbearbeitung, einschließlich der Generierung, Bearbeitung und Verbesserung von Inhalten. Mit transparenten Preisstrukturen und benutzerfreundlicher Dokumentation zielt die Pollo API darauf ab, den Entwicklungsprozess zu optimieren. CEO Bill Zhu hebt hervor, dass die API Entwicklern die Freiheit gibt, das passende Modell für jedes Projekt auszuwählen, ohne sich um mehrere Integrationen kümmern zu müssen. Die Pollo API ist ab sofort unter api.pollo.ai verfügbar und stellt eine wertvolle Ressource für Kreative und Entwickler dar, die mit KI arbeiten möchten.
Trump posts AI video as a doctor diagnosing celebrities with derangement syndrome
In einem neuen, humorvollen Clip hat Donald Trump ein KI-generiertes Video veröffentlicht, in dem er als Arzt auftritt und Hollywood-Stars mit dem sogenannten "Trump Derangement Syndrome" (TDS) diagnostiziert. Der 90-sekündige Clip zeigt Nachbildungen von Prominenten wie Whoopi Goldberg, Robert De Niro und Julia Roberts, die Trump in der Vergangenheit kritisiert haben. Trump fragt die Zuschauer, ob sie oder jemand, den sie kennen, an TDS leiden, und listet vermeintliche Symptome wie Schlaflosigkeit und Verzweiflung auf. Seine "Behandlung" umfasst das Abschalten von "Fake News", Gebet und gelegentlich eine Diät-Cola. Der Begriff TDS ist eine Anspielung auf den früheren Begriff "Bush Derangement Syndrome", der eine übertriebene Reaktion auf George W. Bush beschreibt. Das Video, das im Kontext des bevorstehenden Präsidentschaftswahlkampfs 2024 veröffentlicht wurde, verstärkt die satirische Auseinandersetzung mit Trumps Kritikern.
Trump prescribes Diet Coke to treat Trump Derangement Syndrome in bizarre AI video
In einem skurrilen AI-Video empfiehlt Donald Trump, Diet Coke als Heilmittel gegen das sogenannte Trump Derangement Syndrome (TDS) zu konsumieren. In der Rolle eines Arztes spricht er direkt die Zuschauer an und beschreibt die quälenden Symptome von TDS. Das Video zeigt AI-generierte Prominente, die sich kritisch über Trump geäußert haben, als fiktive Patienten, die an TDS leiden. Eine gefälschte Whoopi Goldberg äußert, sie fühle sich wie ein "verlorener Fall", während ein AI-Robert De Niro angibt, er mache die Menschen um sich herum unglücklich. Trump verspricht, dass der Konsum von Diet Coke das Leben der Betroffenen erheblich verbessern wird. Diese bizarre Darstellung könnte sowohl als Satire als auch als Versuch gewertet werden, seine Kritiker zu belächeln und gleichzeitig seine Marke zu stärken.
Trump turns doctor in bizarre AI video to treat celebrities with Trump Derangement Syndrome
In einem skurrilen AI-Video tritt Donald Trump als 'Dr. Trump' auf und bietet eine vermeintliche Behandlung für das sogenannte 'Trump Derangement Syndrome' (TDS) an. In diesem Clip verschreibt er Diet Coke als Heilmittel für prominente Kritiker wie Whoopi Goldberg und Robert De Niro, die in fiktiven Szenen ihre 'Leiden' aufgrund von TDS äußern. Trump behauptet, dass der Konsum von Diet Coke eine 'bemerkenswerte Veränderung' im Leben der Betroffenen bewirken würde. Das Video nutzt Humor und Satire, um Trumps politische Gegner zu persiflieren und gleichzeitig seine eigene Marke zu stärken. Diese bizarre Inszenierung zeigt, wie Trump moderne Technologien und kreative Ansätze einsetzt, um seine Botschaften zu verbreiten und seine Anhängerschaft zu mobilisieren.
Trump’s new AI ‘doctor’ video diagnosing celebrities is raising eyebrows
Donald Trump hat ein AI-generiertes Video auf Truth Social veröffentlicht, in dem er sich als "Doctor Trump" präsentiert und Hollywood-Stars mit "Trump Derangement Syndrome" (TDS) diagnostiziert. In dem Clip erscheinen KI-Versionen von Prominenten wie Whoopi Goldberg, Robert De Niro, Julia Roberts und Rosie O'Donnell, die Symptome wie Wut und Schlaflosigkeit äußern. Trump bietet als Arzt einen "Behandlungsplan" an, der das Abschalten von "Fake News", Gebete und den Konsum von Diet Coke umfasst. Mit dieser Darstellung verspottet Trump seine Kritiker, da er den Begriff TDS häufig für Gegner verwendet. Die Verwendung von KI in diesem Kontext wirft Fragen auf und sorgt für Aufsehen, da sie die Grenze zwischen Satire und politischer Propaganda verschwimmen lässt.
Why the next leap in AI video is teaching avatars to see and listen
Die Entwicklung von KI-Video-Technologien wandelt sich von der Verbesserung der Bildqualität hin zu interaktiven Erlebnissen mit Avataren. Diese Avatare werden in drei Stufen klassifiziert: Level 1 kann nur sprechen, Level 2 kann sprechen und zuhören, während Level 3 zusätzlich visuelle Informationen verarbeitet. Der Übergang von Level 1 zu Level 2 ist entscheidend, da er es Avataren ermöglicht, in Echtzeit auf menschliche Interaktionen zu reagieren und so die Illusion eines echten Gesprächspartners zu erzeugen. Diese Interaktionen umfassen visuelle Signale wie Nicken und akustische Hinweise wie zustimmendes Murmeln, was die Komplexität der Kommunikation erhöht. Level 3-Modelle nutzen sogar Kamerabilder, um Gesten und Gesichtsausdrücke zu interpretieren, was die Kommunikation noch realistischer macht. Eine der größten Herausforderungen besteht darin, Audio und Bewegung gemeinsam zu modellieren, um authentische Interaktionen zu gewährleisten. Unternehmen wie Synthesia zeigen vielversprechende Ansätze, um diese ambitionierten Ziele zu erreichen.
Creating Virtual Tour Guide Videos With AI Avatars for National Parks and Adventure Brands
Der Artikel "Creating Virtual Tour Guide Videos With AI Avatars for National Parks and Adventure Brands" beschreibt, wie KI-Avatare genutzt werden, um emotionale Verbindungen zwischen potenziellen Gästen und Nationalparks sowie Abenteuermarken herzustellen. Diese virtuellen Guides bieten individuelle, fesselnde Erzählungen und wichtige Informationen, die über traditionelle Reiseführer hinausgehen. Sie vermitteln historische Kontexte und lokale Legenden, was das emotionale Engagement der Zuschauer erhöht. Zudem präsentieren sie Informationen zu Trails, Sicherheit und Kultur auf ansprechende Weise, was das Vertrauen in die Marken stärkt. Die Plattform Pippit erleichtert die Erstellung solcher Videos, indem sie Nutzern ermöglicht, Avatare auszuwählen und Skripte zu bearbeiten. Die Lokalisierung in verschiedene Sprachen erweitert die Reichweite und Zugänglichkeit der Inhalte. Insgesamt fördern diese interaktiven Erzählungen eine persönliche Verbindung zwischen Reisenden und Destinationen, insbesondere bei jüngeren Zielgruppen, und revolutionieren das Tourismusmarketing, indem sie Menschen zu neuen Abenteuern inspirieren.
Phaser Studio Launches Game Agent: Build a Complete Video Game From a Single Sentence
Phaser Studio Inc. hat den Phaser Game Agent vorgestellt, ein innovatives KI-Tool, das es Nutzern ermöglicht, aus einem einzigen Satz ein vollständiges, spielbares Videospiel zu entwickeln. Der Agent übernimmt sämtliche Aspekte der Spielentwicklung, einschließlich Design, Programmierung, Kunst, Sound und Test, und veröffentlicht das fertige Spiel als teilbaren Browser-Link. Im Gegensatz zu anderen KI-Spieleschaffern liefert der Phaser Game Agent qualitativ hochwertige und funktionale Ergebnisse, da er speziell für die Anforderungen von KI optimiert wurde. Nutzer müssen lediglich ihre Spielidee in einem Satz formulieren und können das gewünschte Design auswählen, während der Agent den Rest übernimmt. Die erste Spielversion ist in der Regel innerhalb von 15 Minuten bereit, und Anpassungen sind schnell umsetzbar. Die neuartige Engine des Agents unterstützt verschiedene Spieltypen, von klassischen 2D-Spielen bis hin zu 3D-Umgebungen, und die Qualität der Spiele wird durch eine ständig wachsende Bibliothek bewährter Komponenten verbessert. Der Phaser Game Agent ist ab sofort verfügbar und richtet sich an Entwickler ohne umfangreiche Programmierkenntnisse.
This AI platform can make video campaigns for you
Flipick, ein Unternehmen aus Pune, hat eine innovative AI-Video-Plattform entwickelt, die den gesamten Produktionsprozess von Videokampagnen automatisiert. Die Plattform folgt einem neunstufigen Pipeline-Prozess, der von der Drehbucherstellung bis zur personalisierten Auslieferung und Analyse des Zuschauerengagements reicht. Im Gegensatz zu herkömmlichen Tools, die lediglich Clips bereitstellen, ermöglicht Flipick die Erstellung maßgeschneiderter Videos, die Konsistenz in Präsentatoren, Kleidung und Markenprodukten gewährleisten. Aus einem Mastervideo können bis zu 500 Varianten generiert werden, was die Kosten erheblich senkt. Die personalisierte Auslieferung ermöglicht es, das Zuschauerverhalten genau zu verfolgen. Die Preisgestaltung erfolgt auf Basis von Credits, wobei die Abrechnung pro fertiger Minute erfolgt. Flipick zielt darauf ab, Unternehmen eine effiziente und kostengünstige Lösung für ihre Video-Marketing-Bedürfnisse zu bieten.
/UPDATE TO VIDEO -- New York Stock Exchange/
Am 30. Juni 2026 kündigte die New York Stock Exchange (NYSE) ein bedeutendes Update an, in dem Klaviyo die Einführung von zwei KI-Agenten zur Umsatzsteigerung für Verbraucherbrands bekanntgab. Diese Agenten, darunter der Marketing-Agent Composer, treten in die öffentliche Beta-Phase ein und sollen die Kundenerfahrungen revolutionieren. CMO Jamie Domenici wird in einer Live-Sendung der NYSE erläutern, wie diese Innovationen das Marketing der Zukunft gestalten können. Gleichzeitig erreichte der Dow Jones Industrial Average mit einem historischen Schluss über 52.000 Punkten einen neuen Rekord, während die Aktien von Alphabet an ihrem ersten Handelstag um 4,8% zulegten. Zudem fand der Zerohash Onchain Brokerage Summit statt, bei dem Experten über digitale Vermögenswerte und Tokenisierung diskutierten. Die NYSE unterstützt Investoren täglich mit Marktanalysen und Einblicken vor Handelsbeginn.
Deutschland-App: KI soll Anträge vereinfachen
Die Deutschland-App des Bundesdigitalministeriums (BMDS) zielt darauf ab, die Antragstellung für Bürger zu vereinfachen und effizienter zu gestalten. Nutzer können über einen KI-Avatar oder im Chatmodus direkt mit der App interagieren, anstatt die bestehenden Online-Dienste der Kommunen zu nutzen. Die App erfasst relevante Formulare durch Crawler und vereinfacht diese mithilfe von Sprachmodellen, wobei sie die Abfragen an die individuelle Situation der Nutzer anpasst. Dadurch können ganze Seiten von Formularen unsichtbar werden, was die Fehlerquote bei Anträgen reduzieren soll. BMDS-Staatssekretär Markus Richter hebt hervor, dass die App Plausibilitätsprüfungen durchführt, um die Nutzer durch den Antragsprozess zu führen. Trotz Bedenken hinsichtlich möglicher Falschaussagen der KI wird die App als potenzieller Fortschritt in der Antragsbearbeitung angesehen. Das BMDS plant, die App als Open Source bereitzustellen, um Transparenz zu fördern. Die Entwicklung des Prototyps wurde an die Telekom und SAP vergeben, was Kritik von mittelständischen Softwarefirmen nach sich zog.
Gemini Omni Flash API: video empresarial a $0.10/segundo
Google hat die Gemini Omni Flash API eingeführt, die es Unternehmen ermöglicht, kostengünstig Videos in 720p für nur 0,10 USD pro Sekunde zu erstellen. Diese innovative Technologie revolutioniert die Videoproduktion, indem sie einen dialogbasierten Ansatz bietet, bei dem Nutzer einfache Textanweisungen zur Bearbeitung von Clips verwenden können. Im Gegensatz zu anderen KI-Video-Tools kann die API mit verschiedenen Eingaben wie Text, Bildern und Audio arbeiten, um qualitativ hochwertige Inhalte zu generieren. Sie ist besonders vorteilhaft für Marketingteams, die schnell Anzeigenvariationen erstellen möchten, sowie für interne Schulungs- und Supportvideos. Allerdings gibt es Einschränkungen, wie eine maximale Clipdauer von 10 Sekunden und eine Auflösung von 720p, die für einige Anwendungen möglicherweise nicht ausreichen. Die Einführung dieser API könnte die Produktionskosten für Startups erheblich senken und ihnen helfen, mit größeren Unternehmen in Bezug auf die Inhaltsqualität zu konkurrieren. Unternehmen sollten strategisch planen, wie sie die API in ihre bestehenden Arbeitsabläufe integrieren, um die Vorteile optimal zu nutzen.
Japan deploys AI ‘police chief’ to tackle record $2bn fraud epidemic
Japan hat einen KI-Polizeichef namens AIko eingeführt, um einer alarmierenden Betrugswelle entgegenzuwirken, die im letzten Jahr über 2 Milliarden Dollar gekostet hat. AIko, ein KI-Avatar mit dem Erscheinungsbild und der Stimme einer jungen Frau, wurde von der Polizei in Osaka ins Leben gerufen und nutzt YouTube, um die Öffentlichkeit über Betrugsgefahren aufzuklären. Die Videos zeigen, wie Betrüger ihre Opfer manipulieren, und geben wichtige Hinweise zur Erkennung von Warnzeichen. Diese Initiative richtet sich besonders an jüngere Menschen, die zunehmend Ziel von Betrügereien über soziale Medien werden. Fast die Hälfte der Betrugsopfer in Osaka ist 64 Jahre oder jünger, was die Notwendigkeit moderner Aufklärung verdeutlicht. Toshinori Hirano, ein Professor für Cybersicherheit, steht hinter AIko und hofft, das Bewusstsein für Kriminalprävention zu schärfen. Zudem arbeiten die japanischen Behörden international zusammen, um gegen organisierte Verbrechensnetzwerke vorzugehen, die oft aus Südostasien operieren. AIko ist Teil eines größeren Plans, Künstliche Intelligenz in der Regierung zu integrieren, um die Effizienz zu steigern und die Arbeitslast der Beamten zu reduzieren.
Telit Cinterion Powers FleetSafe.ai AI Video Telematics for Safer, Data-Driven Fleet Operations at Scale
Telit Cinterion hat seine NExT™-Plattform für die Unterstützung von FleetSafe.ai eingesetzt, um KI-gestützte Video-Telematik für Flottenoperationen bereitzustellen. Diese innovative Technologie ermöglicht die Echtzeitübertragung von Video- und Fahrersicherheitsdaten und bietet eine zuverlässige Konnektivität, die sich an verschiedene Netzwerkbedingungen anpasst. Im Rahmen der British Truck Racing Championship sind die Trucks mit Kameras ausgestattet, die das Fahrverhalten und die Müdigkeit der Fahrer überwachen. Die NExT IoT eSIM-Lösungen ermöglichen eine dynamische Umschaltung zwischen verschiedenen Betreiberprofilen, was eine unterbrechungsfreie Datenübertragung sicherstellt. FleetSafe.ai kann durch die zentrale Verwaltung über die NExT-Plattform den Status der SIM-Karten überwachen, wodurch die Komplexität der Verwaltung mehrerer Anbieter reduziert wird. Diese Integration verbessert die Sicherheit und Effizienz der Flottenoperationen erheblich und zeigt, wie moderne Flottenbetreiber KI-gestützte Technologien zur Optimierung ihrer Betriebsabläufe nutzen können.
VidMage Reports Measured Gains in Realistic Video Face Swap, Motion Stability, and Multi-Face Video
VidMage hat ein bedeutendes Upgrade seiner KI-Engine für Gesichtstausch vorgestellt, das die Realitätsnähe, Bewegungsstabilität und die Handhabung mehrerer Gesichter in Videos erheblich verbessert. Interne Tests zeigen eine Steigerung der menschlich bewerteten Realismuswerte um 32,8% und eine Reduzierung des Frame-to-Frame-Drifts um 68,3%. Zudem stieg die Erfolgsquote bei Multi-Face-Videos von 89,2% auf 93,4%, was die Effizienz für Content-Ersteller, insbesondere für TikTok- und YouTube-Shorts-Produzenten, erhöht. Die neuen Funktionen ermöglichen realistischere Gesichtstausche in Bewegung, einschließlich Anpassungen von Gesichtsstrukturen und Hauttönen sowie verbesserte Stabilität in Gruppenszenen. Diese Fortschritte erleichtern Marketingteams die Arbeit, da sie mehr Gesichter und Szenen testen können, ohne aufwendige Nachbearbeitungen vornehmen zu müssen. VidMage legt zudem Wert auf Datenschutz, indem Dateien innerhalb von zwei Stunden gelöscht werden und keine Nutzerdaten für das Training der KI-Modelle verwendet werden.
Forget Prime Day. Amazon’s AI Empire Makes It the World’s Most Complete Tech Platform
Amazon hat sich zu einer der umfassendsten Technologieplattformen weltweit entwickelt, indem es Cloud-Computing, künstliche Intelligenz, Logistik, Werbung und digitale Handelsdienste integriert. Die über 260 Millionen Prime-Mitglieder tragen entscheidend zur Umsatzsteigerung bei und nutzen die verschiedenen Angebote des Unternehmens, was die Synergien zwischen den Geschäftsbereichen verstärkt. Die AWS-Sparte generiert erhebliche Einnahmen, während die neuen Trainium2-Chips ein verbessertes Preis-Leistungs-Verhältnis bieten und bereits große Kundenverpflichtungen von 225 Milliarden Dollar gesichert haben. Das Projekt Kuiper, ein Netzwerk von Satelliten, wird es Amazon ermöglichen, seine Cloud-Dienste näher an die Kunden zu bringen und die Abhängigkeit von externen Chip-Lieferanten zu reduzieren. Trotz negativer freier Cashflows und hoher Infrastrukturinvestitionen verfügt Amazon über eine solide Liquidität von 153 Milliarden Dollar und eine starke operative Cashflow-Generierung. Diese Faktoren ermöglichen es dem Unternehmen, weiterhin aggressiv in Wachstum zu investieren, was langfristig den Wettbewerbsvorteil erheblich erweitern könnte. Zudem stellen die Werbeeinnahmen aus Prime Video eine zusätzliche Einkommensquelle dar.
Kann Österreich (KI-)Weltmeister werden?
In dieser Woche hat ein österreichisches Start-up mit der Einführung des KI-Begleiters Eustella für Aufsehen gesorgt. Eustella, als Alternative zu bestehenden Lösungen großer Unternehmen, bietet nicht nur Antworten auf Fragen im Stil von ChatGPT, sondern kann auch aktiv bei der Reiseplanung und dem Vergleich von Produktpreisen unterstützen. Um diese Funktionen zu realisieren, hat das Start-up Partnerschaften mit etablierten Firmen wie Geizhals.at und Bitpanda geschlossen. Diese Entwicklungen verdeutlichen, dass Österreich im Bereich der Künstlichen Intelligenz innovative Initiativen vorantreibt. Obwohl die Aussicht auf eine Weltmeisterschaft in diesem Sektor eher unrealistisch erscheint, weckt ein zusätzliches KI-generiertes Video die Hoffnung auf einen Fußball-Weltmeistertitel und steigert das Interesse an der Technologie.
Ora FacePass Launches FP02MY26 8-in-1 AI Biometrics Video Smart Lock
Ora FacePass hat den FP02MY26, einen fortschrittlichen 8-in-1 AI biometrischen Video-Smart-Lock, vorgestellt. Dieses innovative Gerät vereint mehrere Zugangsmethoden, darunter Gesichtserkennung, Palmvenenerkennung, Fingerabdruckauthentifizierung sowie eine integrierte Video-Türklingel. Es richtet sich an Hausbesitzer, Verwalter und Mieter und bietet sowohl biometrische als auch traditionelle Zugangsmöglichkeiten wie PIN-Codes und physische Schlüssel. Sicherheitsmerkmale wie eine stille Alarmfunktion und Anti-Peeking-Technologie erhöhen den Schutz in kritischen Situationen. Der FP02MY26 unterstützt WLAN-Konnektivität und ist mit Smart-Home-Systemen kompatibel, was eine einfache Fernsteuerung ermöglicht. Zudem sorgt die robuste Bauweise mit IP65-Bewertung dafür, dass das Gerät auch unter schwierigen Wetterbedingungen zuverlässig funktioniert.
5 Open Source Omni AI Models That Handle Text, Images, Audio, and Video
In der Künstlichen Intelligenz haben sich omni AI-Modelle, die Text, Bilder, Audio und Video verarbeiten, stark weiterentwickelt. Diese Modelle ermöglichen eine einheitliche Interaktion und vereinfachen die Entwicklung realer Anwendungen. Das NVIDIA Nemotron 3 Nano Omni Modell kann komplexe Aufgaben wie Video- und Sprachanalyse sowie Dokumentenintelligenz bewältigen. Google Gemma 4 12B IT bietet durch seine encoderfreie Architektur eine effiziente lokale Nutzung. Qwen3-Omni 30B A3B Instruct zeichnet sich durch Echtzeit-Interaktion und Mehrsprachigkeit aus, was es für globale Anwendungen prädestiniert. MiniCPM-o 4.5 ermöglicht vollständige Duplexfähigkeit für Live-Streaming und kann kontinuierlich sehen, hören und sprechen. Diese Fortschritte in der multimodalen KI reduzieren die Komplexität der Nutzung mehrerer Modelle und verbessern die Benutzererfahrung, insbesondere für AI-Assistenten und Dokumentenanalysesysteme.
Adobe is buying Topaz Labs, the AI video enhancer
Adobe hat angekündigt, Topaz Labs zu übernehmen, ein Unternehmen, das sich auf KI-gestützte Bild- und Videoverbesserung spezialisiert hat. Diese Übernahme zielt darauf ab, Adobes kreative Tools, wie Photoshop und Premiere, durch die Integration von Topaz' Technologien zu erweitern und den kreativen Prozess für Nutzer zu optimieren. Angesichts der zunehmenden Nutzung von realen und KI-generierten Inhalten ist dies ein strategischer Schritt, um die Marktposition von Adobe zu stärken und sich gegen Wettbewerber wie Freepik abzusichern. Topaz Labs bietet bewährte Lösungen zur Verbesserung der Bild- und Videoqualität, insbesondere die Neurostream-Technologie, die komplexe KI-Modelle lokal auf Endgeräten ausführt und somit Kosten und Wartezeiten reduziert. Adobe plant, Topaz Labs als eigenständige Einheit mit der bestehenden Produktlinie und dem Führungsteam weiterzuführen. Der Abschluss der Transaktion wird für die zweite Hälfte des Jahres 2026 erwartet, nachdem die erforderlichen regulatorischen Genehmigungen eingeholt wurden.
Verwandte Cluster
Weitere Themen innerhalb derselben Unterrubrik zur schnellen Navigation.