Musikgenerierung
Aktuelle Links, Zusammenfassungen und Marktinformationen zu Musikgenerierung innerhalb von Audio & Sprache auf JetztStarten.de.
Einordnung
Dieses Cluster bündelt aktuelle Links, Zusammenfassungen und Marktinformationen zu einem klar abgegrenzten Thema.
Rubrik: KI Generative Anwendungen
Unterrubrik: Audio & Sprache
Cluster: Musikgenerierung
Einträge: 77
ADI and Cadence develop SHARC-FX for automotive AI audio
Cadence und Analog Devices haben den SHARC-FX-Prozessor entwickelt, der die neue ADSP-SC84x/2184x Plattform für Automotive-Audio antreibt. Mit einem Wechsel von einem 28nm- zu einem 16nm-Fertigungsprozess bietet der SHARC-FX eine fünfmal höhere Leistung im Vergleich zur vorherigen SHARC+-Generation. Die Plattform unterstützt LPDDR4-Speicher, erhöhten On-Chip L2-Speicher und ein Hardware-Sicherheitsmodul, was die Cybersicherheit verbessert. Der 16nm-Prozess ermöglicht höhere Betriebsfrequenzen und eine verbesserte Energieeffizienz, was für softwaredefinierte Fahrzeuganwendungen entscheidend ist. Der SHARC-FX-Kern kann sowohl konventionelle Signalverarbeitung als auch Echtzeit-AI-Inferenz durchführen, was Anwendungen wie Straßenlärmminderung und KI-unterstützte Sprachverarbeitung umfasst. Zudem erlaubt die Tensilica Instruction Extension-Architektur die Erstellung benutzerdefinierter Anweisungen zur Beschleunigung von Audio- und Sprachalgorithmen. Die ISO 26262 ASIL-B-Zertifizierung gewährleistet die Sicherheit im Automobilbereich.
Bybit AI Is Live: Een intelligente conversatielaag om financiële ervaring opnieuw vorm te geven
Bybit hat die Einführung von Bybit AI angekündigt, einem intelligenten Conversational Assistant, der die Handelsplattform revolutioniert. Diese Funktion ermöglicht es Nutzern, ihre Anliegen in einfacher Sprache zu äußern, woraufhin Bybit AI die Absichten interpretiert und entsprechende Aktionen ausführt. Durch die Integration von Handel, Kundenservice und Accountmanagement in einer einzigen Chatoberfläche wird die Nutzererfahrung verbessert und fragmentierte Interaktionen werden durch kontinuierliche Gespräche ersetzt. Bybit AI zielt darauf ab, den Zugang zu Finanzdienstleistungen zu erleichtern, indem es Nutzern hilft, passende Produkte und Dienstleistungen zu finden, als hätten sie ein Team von Finanzexperten zur Verfügung. Bei der Einführung umfasst Bybit AI zwei Hauptmodule: einen AI-Assistenten für Handelsbedürfnisse und eine verbesserte Kundenunterstützung. Nutzer müssen die Funktion aktivieren, um ein separates Subkonto zu erstellen, das Sicherheitsrisiken minimiert. Diese Entwicklung unterstreicht Bybits Bestreben, sich als führende Finanzplattform im AI-Zeitalter zu positionieren, wobei künstliche Intelligenz als zentrale Infrastruktur dient.
Claude Fable 5.1's language is less "load-bearing" than its predecessor's
Die Analyse von Arena.ai zeigt, dass die Sprache von Anthropics Claude Fable 5.1 im Vergleich zu seinem Vorgänger Fable 5 weniger "lasttragend" ist. Dies äußert sich in einer reduzierten Verwendung von Einleitungsphrasen, Em-Dashes und Ausdrücken wie "ehrlich gesagt". Gleichzeitig haben sich die Antworten verlängert, mit einer durchschnittlichen Wortanzahl von 414, was einem Anstieg von 30 Prozent entspricht, jedoch 21 Prozent kürzer ist als bei Opus 5. Der Rückgang von Standardphrasen und Hedges deutet auf eine direktere und weniger vage Ausdrucksweise hin. Zudem ist der Anteil an langen Inhaltswörtern und abstrakten Nomen gesunken, was auf eine Veränderung in der Komplexität und Struktur der Antworten hinweist. Diese Entwicklungen deuten darauf hin, dass Fable 5.1 eine klarere und präzisere Kommunikation anstrebt, was die Informationsvermittlung erheblich beeinflussen könnte.
India’s Pocket FM doubles revenue run rate to $500M as AI powers 93% of audio content
Pocket FM, eine indische Plattform für Audioerzählungen, hat ihren jährlichen Umsatzlauf auf 500 Millionen Dollar verdoppelt, indem sie stark auf künstliche Intelligenz (KI) zur Inhaltserstellung setzt. Der Einsatz von KI ermöglicht es, 93% des Katalogs und 99% neuer Inhalte automatisiert zu produzieren, während menschliche Kreatoren weiterhin für die Ideen und Erzählungen verantwortlich sind. Diese Technologie hat die Produktionskosten um das 80-fache gesenkt und die Produktionskapazität von 100.000 Stunden auf über 2,5 Millionen Stunden jährlich erhöht, was die Zuhörerbindung verbessert hat. Pocket FM hat mittlerweile über 250 Millionen Zuhörer in mehr als 20 Ländern und plant, seine KI-gestützte Content-Strategie auf weitere Unterhaltungsformate auszudehnen. Das Unternehmen ist profitabel und generiert positive Cashflows, während es Gespräche über eine Kapitalerhöhung führt, um in KI und neue Formate zu investieren. Ein Börsengang ist jedoch in den nächsten 24 Monaten nicht vorgesehen.
Rokid stellt auf der IFA Berlin 2026 weltweit das AIUI Studio vor und erleichtert allen die Entwicklung von Anwendungen für KI-Brillen
Auf der IFA Berlin 2026 hat Rokid das AIUI Studio vorgestellt, eine innovative Plattform zur vereinfachten Entwicklung von Anwendungen für KI-Brillen. Diese All-in-One-Lösung ermöglicht es Entwicklern, räumliche KI-Anwendungen für die Rokid AI Glasses zu erstellen, ohne tiefgehende Programmierkenntnisse zu benötigen. Die Plattform bietet integrierte Tools wie die AIUI Skills Library und AIUI Code, die dabei helfen, Anwendungen hinsichtlich Latenz, Speicherbedarf und Stromverbrauch zu optimieren. Entwickler können über ihren Webbrowser auf das Studio zugreifen und ihre Ideen in einfacher Sprache umsetzen, was die Kreativität anregt. Zudem hat Rokid seine digitale Präsenz in Europa durch neue Vertriebskanäle gestärkt, die den direkten Zugang zu seinen Technologien ermöglichen. Die Innovationskraft des Unternehmens wurde auf der Messe mit mehreren Preisen ausgezeichnet, und Rokid setzt sich auch für die Unterstützung von Menschen mit Sehbehinderungen durch barrierefreie Führungen ein.
Bybit
Bybit hat die Einführung von Bybit AI angekündigt, einem Dialogassistenten, der Nutzern den Zugang zu Handels-, Kontoverwaltungs- und Kundenservice-Funktionen innerhalb der Bybit-App erleichtert. Durch die Möglichkeit, Anfragen in einfacher Sprache zu formulieren, interpretiert Bybit AI die Wünsche der Nutzer und führt die gewünschten Aktionen aus, was das Handelserlebnis vereinfacht. CEO Ben Zhou hebt hervor, dass Bybit AI Teil einer umfassenden Strategie ist, um Finanzdienstleistungen zentral zugänglich zu machen und das fragmentierte Nutzererlebnis zu verbessern. In der ersten Phase bietet Bybit AI grundlegende Funktionen wie Spot- und Futures-Handel sowie Kundenservice, wobei menschliche Unterstützung weiterhin verfügbar bleibt. Zudem wird ein Sicherheitskonzept implementiert, um Nutzer vor Risiken zu schützen. Mit dieser Innovation positioniert sich Bybit als Vorreiter im Bereich KI-gestützter Finanzdienstleistungen und plant, die Funktionen von Bybit AI kontinuierlich auszubauen.
Bybit AI ist jetzt verfügbar: Eine intelligente Dialogschicht, die das Finanzerlebnis neu definiert
Bybit hat mit Bybit AI einen innovativen Dialogassistenten eingeführt, der das Finanzerlebnis für Nutzer grundlegend verändert. Der Assistent integriert zentrale Dienstleistungen der Börse, wie Handel und Kundenservice, in einer benutzerfreundlichen Chat-Oberfläche innerhalb der Bybit-App. Nutzer können ihre Anliegen in einfacher Sprache formulieren, und Bybit AI erkennt die Absicht, um die gewünschten Aktionen automatisch auszuführen. Dies beseitigt die Notwendigkeit, durch verschiedene Webseiten und Menüs zu navigieren, und sorgt für ein nahtloses Nutzererlebnis. CEO Ben Zhou hebt hervor, dass Bybit AI Teil einer umfassenden Strategie ist, die den Zugang zu Finanzdienstleistungen erleichtert und eine breitere Produktpalette bietet. Die Architektur von Bybit AI ermöglicht eine durchgängige Schnittstelle, die verschiedene Dienste integriert und den Nutzern als ein einheitlicher Assistent dient, was die Effizienz und Benutzerfreundlichkeit im Finanzbereich erheblich steigert.
ANZEIGE RMS Werbewirkungsstudien: Herausforderung KI: Wie Marken künftig relevant bleiben
Im Kontext der generativen KI wird Audiowerbung als Schlüsselkomponente für den Markenaufbau und wirtschaftlichen Erfolg hervorgehoben. Während digitale Plattformen Informationen schnell bereitstellen, bleibt die mentale Verfügbarkeit einer Marke entscheidend für Vertrauen und Wiedererkennung. Aktuelle Studien zeigen, dass Audiowerbung das markenbezogene Suchvolumen nachhaltig steigert und dabei kosteneffizient ist, was für die Mediaplanung von großer Bedeutung ist. Besonders effektiv ist die Kombination von Audio und TV, die zu einem signifikanten Anstieg des Suchvolumens führt und deren Wirkung bis zu 70 Prozent über Wochen anhält. Audiowerbung erreicht Konsumenten in Alltagssituationen, in denen andere Medien oft nicht präsent sind, und verankert Markenbotschaften langfristig. Zudem belegen die RMS-Studien, dass Audiowerbung einen höheren Return on Investment (ROI) erzielt als TV-Werbung, was die Notwendigkeit unterstreicht, Audio im Mediamix angemessen zu berücksichtigen. In einer zunehmend vergleichbaren Produktlandschaft wird die mentale Verfügbarkeit entscheidend dafür sein, welche Marke im Gedächtnis bleibt und bei Kaufentscheidungen eine Rolle spielt.
Google brings AI music generation directly into the Gemini app with its new Lyria 3.5 model
Google hat sein neues Lyria 3.5 Musikgenerierungsmodell in die Gemini-App integriert, was es Nutzern ermöglicht, direkt Musik zu erstellen. Im Vergleich zum Vorgängermodell bietet Lyria 3.5 ausdrucksvollere Vocals und reichhaltigere musikalische Arrangements. Nutzer können aus verschiedenen Genres und Stilen wählen sowie zwischen Gesang und Instrumentalstücken entscheiden, um sowohl kurze als auch längere Tracks zu kreieren. Zur Unterstützung stehen Vorlagen für Hintergrundmusik und personalisierte Geburtstagslieder bereit. Darüber hinaus ist das Lyria 3.5 Modell auch in Google Flow Music, Google AI Studio für Entwickler und Google Vids verfügbar. Google betont, dass das Modell ausschließlich mit lizenzierten Inhalten trainiert wurde, gibt jedoch keine Details zu den verwendeten Trainingsdaten preis.
Meta's new real-time audio model is the foundation for AI assistants that never stop listening
Meta hat mit Muse Voice Transcribe ein innovatives Echtzeit-Audiomodell entwickelt, das Sprache transkribiert, Satzgrenzen erkennt und bis zu 20 Sprecher unterscheidet, ohne separate Systeme zu benötigen. Das Modell verarbeitet Audio in 80-Millisekunden-Intervallen und optimiert dynamisch die Wartezeit für jedes Wort, um eine optimale Balance zwischen Geschwindigkeit und Genauigkeit zu erreichen. Muse Voice Transcribe unterstützt über 70 Sprachen und ist ab sofort über die Meta AI und die Meta Model API verfügbar, wobei die Kosten mit 0,18 USD pro Stunde unter denen der Konkurrenz liegen. Die Technologie wurde durch Reinforcement Learning trainiert, um niedrige Fehlerquoten und kurze Verzögerungen zu fördern. In einer Demonstration konnte das System in Echtzeit die Stimmen von acht Personen zuordnen. Meta sieht in dieser Technologie das Potenzial für persönliche KI-Agenten, die echte Gespräche durch KI-Brillen verfolgen können. Trotz der vielversprechenden Funktionen wurden keine Details zu den Modellparametern oder Trainingsdaten veröffentlicht. Die Einführung von Muse Voice Transcribe spiegelt Metas Strategie wider, sich durch Preiswettbewerb zu positionieren, während das Unternehmen seine KI-Abteilung reorganisiert, um führende Forscher zu gewinnen.
Is Interactive Brokers Quietly Becoming an AI Stock?
Interactive Brokers, traditionell kein KI-Unternehmen, könnte durch die Integration von KI-Technologien in seine Plattform eine wichtige Rolle im AI-gestützten Investieren einnehmen. Die langjährige Entwicklung einer globalen Finanzinfrastruktur ermöglicht es dem Unternehmen, Investoren den Zugang zu verschiedenen Märkten und Anlageprodukten zu erleichtern. KI könnte die Benutzerfreundlichkeit verbessern, indem sie als Schnittstelle fungiert, die es Nutzern erlaubt, Anfragen in einfacher Sprache zu stellen. Durch die Anbindung an KI-Tools wie ChatGPT und Claude könnte die Benutzererfahrung beim Investieren optimiert und eine breitere Zielgruppe angesprochen werden. Die Hauptchance liegt in der Unterstützung der Anleger bei Recherche und Analyse, nicht in autonomem Handel. Es bleibt jedoch abzuwarten, wie viele Kunden diese neuen Funktionen nutzen und ob sie zu signifikantem Wachstum führen. Investoren sollten die Umsetzung der KI-Strategie von Interactive Brokers genau beobachten, da sie entscheidend für die zukünftige Entwicklung des Unternehmens sein könnte.
Steuernummer in 15 Tagen: Thüringen beschleunigt Gründungsprozess
Thüringen hat angekündigt, dass Existenzgründer ihre Steuernummer künftig innerhalb von 15 Arbeitstagen erhalten können, sofern sie vollständige Unterlagen einreichen. Diese Initiative soll den Gründungsprozess beschleunigen und stellt eine ambitionierte Verbesserung im Vergleich zur vierwöchigen Frist der Bundesregierung dar. In einigen Kommunen werden zudem Pilotprojekte getestet, die eine Gründung innerhalb von 24 Stunden ermöglichen, indem Gewerbeanmeldung und steuerliche Erfassung kombiniert werden. Ab 2027 wird die elektronische Bekanntgabe von Steuerbescheiden über das ELSTER-Portal zur Norm, was die Kommunikation zwischen Bürgern und Behörden erleichtert. Um die Verständlichkeit zu erhöhen, wurden 730 Textbausteine der Finanzverwaltung in einfache Sprache umformuliert. Die Digitalisierung der Finanzverwaltung verspricht schnellere Abwicklungen von Steuererklärungen, während KI-gestützte Tools wie MeinELSTER+ bereits für bestimmte Nutzergruppen verfügbar sind. Ein Blick nach Österreich zeigt, dass ähnliche Maßnahmen dort die Bearbeitungszeiten für Steuerangelegenheiten deutlich verkürzt haben.
ClassNK launches “Survey Compass,” an AI assistant supporting survey-related operations
ClassNK hat den AI-Assistenten "Survey Compass" eingeführt, der Schiffseignern und Schiffsmanagementunternehmen bei der Vorbereitung und Durchführung von Klassifizierungsuntersuchungen hilft. Der Assistent ermöglicht es Nutzern, Fragen in natürlicher Sprache zu stellen und liefert prägnante Antworten sowie Links zu relevanten Informationsquellen, was die Effizienz der Umfragevorbereitung steigert und die Arbeitslast verringert. Diese Innovation ist besonders wichtig angesichts der zunehmend komplexen Vorschriften in der maritimen Industrie, insbesondere im Hinblick auf Umweltvorgaben, die eine schnelle Identifizierung der Anforderungen erfordern. Survey Compass nutzt einen abrufbasierten Ansatz, um die Genauigkeit der Antworten zu gewährleisten und Ungenauigkeiten zu minimieren. In der ersten Version deckt der Dienst spezifische Regelungen und technische Informationen ab, mit Plänen für zukünftige Erweiterungen, die internationale Konventionen und spezifische Schiffsdatensätze einbeziehen. ClassNK strebt an, den Service kontinuierlich zu verbessern, indem es auf Nutzerfeedback eingeht und die digitale Effizienz in der maritimen Branche fördert.
Chronograph and Perplexity Announce Integration of Private Capital Data into Perplexity Computer
Chronograph hat eine Partnerschaft mit Perplexity angekündigt, um private Kapitaldaten in die Perplexity Computer-Plattform zu integrieren. Diese Integration ermöglicht es Fachleuten im Bereich privater Kapitalanlagen, ihre validierten Portfoliodaten in einfacher Sprache abzufragen und gleichzeitig auf bereits genutzte Forschungsquellen zuzugreifen. Angesichts der zunehmenden Nutzung von KI durch institutionelle Investoren wird eine gut verwaltete Datenbasis immer wichtiger. Der Chronograph-Connector ermöglicht es Teams, validierte Daten direkt abzurufen, Analysen durchzuführen und Berichte zu erstellen, wobei die Daten auf ihre Ursprungsdokumente zurückverfolgt werden können. Dies verbessert die Zugänglichkeit und Geschwindigkeit der Datenabfrage und stärkt das Vertrauen in die Genauigkeit der Informationen. Die Integration steht Chronograph-Kunden mit einem entsprechenden Perplexity-Abonnement zur Verfügung, ohne dass separate Datenverträge erforderlich sind.
ClassNK launches ‘Survey Compass,’ an AI assistant supporting survey-related operations
ClassNK hat den AI-Assistenten „Survey Compass“ eingeführt, der Schiffseignern und Schiffsmanagementunternehmen bei surveybezogenen Aufgaben hilft. Der Assistent beantwortet Fragen zu Klassifizierungsumfragen in natürlicher Sprache und ermöglicht eine schnelle Bestätigung benötigter Informationen, wodurch die Arbeitslast der Nutzer verringert wird. Zudem fördert er informierte Entscheidungen, indem er Links zu den verwendeten Quellen bereitstellt. Die Entwicklung von Survey Compass erfolgt iterativ, wobei Nutzerfeedback integriert wird, um die Funktionalität zu verbessern. Die erste Version des Dienstes deckt spezifische Regelwerke ab und soll künftig um internationale Konventionen und spezifische Schiffsdatensätze erweitert werden. Diese Einführung erfolgt vor dem Hintergrund komplexer werdender Vorschriften in der maritimen Industrie, die eine präzise und zeitnahe Bearbeitung erfordern. ClassNK plant, die digitale Plattform weiter auszubauen, um die Effizienz und Digitalisierung in der Schifffahrt zu fördern.
Australia's music industry bans AI-generated tracks from official charts
Australien hat beschlossen, vollständig AI-generierte Songs von seinen offiziellen Musikcharts auszuschließen, nachdem ein umstrittener Cover von Madonna's "Like a Prayer" in den Fokus geriet. Die Australian Recording Industry Association (ARIA) legt fest, dass Aufnahmen "substanziell menschlich gemacht" sein müssen, um in die Charts aufgenommen zu werden. Während Songs, die AI unterstützend nutzen, weiterhin erlaubt sind, sind vollständig AI-generierte Tracks ausgeschlossen. Dies betrifft auch die Coverversion von Josh Fawaz, die kürzlich hohe Radioeinschaltquoten erreichte. Kritiker behaupten, dass Fawaz' Musik vollständig mit AI erstellt wurde, was er jedoch zurückweist und betont, dass er AI lediglich als Werkzeug verwendet hat. ARIA behält sich das Recht vor, nicht konforme Aufnahmen nachträglich von den Charts zu entfernen. Die Regelung soll menschliche Kreativität in der Musik fördern und verhindern, dass unlizenzierte AI-Inhalte die Charts dominieren. Diese Entscheidung folgt ähnlichen Maßnahmen in Schweden, wo ein AI-generierter Song ebenfalls ausgeschlossen wurde.
HAVIT to Unveil Industry-Leading 12-Mic AI Audio Innovation at IFA 2026
HAVIT wird auf der IFA 2026 eine bahnbrechende Audio-Innovation mit einem 12-Mikrofon-System präsentieren, das durch KI-Technologie und akustisches Engineering neue Maßstäbe im Hören setzt. Mit über 28 Jahren Erfahrung hat das Unternehmen die SPACE Series entwickelt, die Audio-Geräte in intelligente Begleiter verwandelt und personalisierte Hörerlebnisse bietet. Das fortschrittliche Mikrofon-System verbessert die Geräuschunterdrückung und Sprachqualität, was zu klareren Anrufen und einem immersiven Klangerlebnis führt. HAVIT zielt darauf ab, Audio-Geräte weiterzuentwickeln, um eine harmonische Verbindung zwischen Technologie und Alltag zu schaffen. Das Unternehmen plant, weiterhin in akustische Technologien und Benutzererfahrungen zu investieren, um die Smart-Audio-Branche voranzutreiben. Besucher der IFA 2026 sind eingeladen, die neuesten Innovationen von HAVIT zu entdecken und die Zukunft des smarten Audios zu erleben.
Jamaica Enters the AI Race with the Launch of OpenJM, The Caribbean's First Memory-Centric, Multimodal Agentic Platform
Jamaika hat mit der Einführung von OpenJM, der ersten speicherzentrierten, multimodalen Plattform der Karibik, einen bedeutenden Schritt in der Künstlichen Intelligenz gemacht. Entwickelt von Crimsontide AI Limited, vereint OpenJM Technologien wie Bild- und Musikgenerierung sowie Sprachverarbeitung in einem integrierten System. Die innovative Gedächtnisarchitektur der Plattform ermöglicht es, bedeutungsvolle Informationen zu speichern und irrelevante Daten intelligent zu vergessen, wodurch eine personalisierte Nutzererfahrung geschaffen wird. Zudem bietet OpenJM das OpenJM Harness, das spezialisierten KI-Agenten die Planung und Ausführung von Aufgaben in verschiedenen Branchen wie Bildung, Gesundheitswesen und Medien ermöglicht. Diese Technologie soll die digitale Zukunft der Karibik stärken und Institutionen mehr Kontrolle über ihre KI-gestützten Operationen geben. CEO Anu hebt hervor, dass OpenJM die Innovationskraft der Region demonstriert und die Unabhängigkeit sowie kulturelle Relevanz in der Technologieentwicklung fördert.
Adobe Firefly adds AI audio tools and Google's Gemini Omni Flash
Adobe hat seine Firefly-Plattform um drei neue KI-Audio-Tools erweitert, die es Nutzern ermöglichen, royaltyfreie Musik für Videos zu erstellen, Skripte in Sprachübertragungen umzuwandeln und spezifische Geräusche für Szenen zu generieren. Diese Tools sind für die kommerzielle Nutzung freigegeben, was ihre Anwendung in professionellen Projekten erleichtert. Zudem bietet der Firefly AI Assistant nun kostenlose tägliche Generierungen an, wobei Funktionen wie "Create Storyboard" und "Create Brand Kit" besonders beliebt sind. Ein weiteres Highlight ist die Integration von Googles Gemini Omni Flash, das die Verarbeitung von Video-, Audio- und Bildinhalten in Kombination mit Textaufforderungen ermöglicht. Diese Neuerungen erweitern die kreativen Möglichkeiten für Nutzer und fördern die Integration von KI in den kreativen Prozess.
Does Writing in Another Language Cost You Fewer Tokens. I Tested It
In einem Experiment wurde untersucht, ob das Schreiben in einer anderen Sprache weniger Token kostet als in Englisch. Die Analyse umfasste 997 Sätze in fünf weit verbreiteten Sprachen, wobei Englisch als Referenz diente. Es wurde festgestellt, dass identische Inhalte, die professionell übersetzt wurden, unterschiedlich in der Token-Zählung behandelt werden, abhängig von der verwendeten Sprache und dem jeweiligen Tokenizer. Die Ergebnisse zeigen, dass die Annahme, dass alle Sprachen höhere Token-Kosten verursachen, nicht zutrifft. Stattdessen variieren die Kosten je nach Tokenizer erheblich. Diese Erkenntnisse sind besonders relevant für Nutzer von Sprachmodellen, da die Wahl der Sprache und des Tokenizers entscheidend für die Gesamtkosten ist.
Loan Vision Launches Luna, an AI Teammate Built Directly Into the Platform
Loan Vision hat mit Luna einen neuen KI-Assistenten eingeführt, der direkt in die Loan Vision-Plattform integriert ist. Luna wurde entwickelt, um Mitarbeitern in der Hypothekenbuchhaltung sofortige und fachkundige Unterstützung zu bieten, ohne dass sie auf Kollegen oder umfangreiche Dokumentationen angewiesen sind. Der Assistent hilft, Engpässe zu vermeiden, die durch eine Konzentration des Fachwissens auf wenige Teammitglieder entstehen können. Nutzer können in einfacher Sprache Fragen stellen und erhalten präzise Antworten. Luna ist rund um die Uhr verfügbar und unterstützt in verschiedenen Bereichen der Plattform, darunter Einrichtung, Fehlersuche und Berichterstattung. Diese Einführung unterstreicht Loan Visions Engagement für technologische Innovation, indem KI als zentraler Bestandteil der Plattform betrachtet wird.
New ReSound Sensia™ hearing aids lift the voice you want to hear - not just the loudest
GN hat die ReSound Sensia™, eine neue Familie von Premium-Hörgeräten, vorgestellt, die auf einer innovativen KI-Plattform basieren. Diese Hörgeräte kombinieren einen hochpräzisen Umgebungs-Klassifikator, einen fortschrittlichen 4-Mikrofon-Richtstrahler und eine Deep Neural Network (DNN) Geräuschunterdrückung, um gezielt die Sprache hervorzuheben, auf die sich der Nutzer konzentrieren möchte. Im Gegensatz zu herkömmlichen Hörgeräten, die oft nur die lauteste Stimme verstärken, ermöglicht ReSound Sensia eine präzisere Fokussierung auf gewünschte Gespräche, was besonders in lauten Umgebungen von Vorteil ist. Die AcoustIQ™-Technologie klassifiziert die Klangumgebung in Echtzeit und aktiviert die entsprechenden Funktionen, wodurch die Hörqualität erheblich verbessert wird. Nutzer müssen nicht mehr selbst Programme wechseln, um in schwierigen Hörsituationen besser zu hören. Zudem sind die ReSound Sensia™ Bimodal und ReSound Enzo™ IA Bimodal mit Cochlear® Nucleus® Soundprozessoren kompatibel, was eine nahtlose bimodale Hörerfahrung ermöglicht. Die neuen Produkte sind ab dem 20. August in den USA, Deutschland und Österreich erhältlich, gefolgt von weiteren Märkten.
Dem Publikum gefallen KI-Kurzgeschichten besser als Prosa von Menschen
In einem Experiment in den USA wurden Kurzgeschichten, die von dem KI-Modell ChatGPT verfasst wurden, besser bewertet als solche von menschlichen Autoren. Die Teilnehmenden fühlten sich stärker mit den KI-generierten Erzählungen verbunden und empfanden diese als gelungener. Interessanterweise stiegen die Bewertungen der menschlichen Texte, sobald die Teilnehmenden erfuhren, dass diese von Menschen stammen. Die Ergebnisse deuten darauf hin, dass nicht unbedingt die Kreativität der KI überlegen ist, sondern vielmehr bestehende Vorurteile und eine Vorliebe für klare Sprache eine Rolle spielen. Diese Studie wirft wichtige Fragen zur Psychologie des Lesens auf und verdeutlicht, wie die Wahrnehmung von Autorenschaft die Wertschätzung von Texten beeinflussen kann.
Insta360 Launches AI Voice Assistant for GO Ultra
Insta360 hat ein bedeutendes Software-Update für die GO Ultra Kamera veröffentlicht, das einen AI Voice Assistant integriert und die Kamera zu einem intelligenten Reisebegleiter macht. Nutzer können durch Sprachbefehle oder einen langen Druck auf den Auslöser in Echtzeit Übersetzungen erhalten und Antworten auf Fragen durch Sprach- und Fotoanfragen abrufen. Diese Funktionen helfen Reisenden, Sprachbarrieren zu überwinden und Informationen über ihre Umgebung zu erhalten, ohne ständig auf ihr Handy zugreifen zu müssen. Die Kamera filtert Geräusche, um die Stimme des Nutzers in lauten Umgebungen besser zu erkennen, was die Interaktion erleichtert. Zudem fördert die GO Ultra interaktives Lernen für Familien, indem Kinder Fragen zu ihrer Umgebung stellen können. Das Update wurde am 29. Juli 2026 über die Insta360-App verfügbar gemacht und ermöglicht eine nahtlose Integration von Aufnahme und Informationsabfrage.
Kein Hit: Ö3 wirbt für Menschlichkeit und nutzt dazu KI
Der österreichische Radiosender Ö3 versucht, sich in einer Zeit, in der KI-Inhalte schwer erkennbar sind, als Garant für Authentizität zu positionieren. Mit einer Werbekampagne möchte der Sender das Vertrauen seiner 2,5 Millionen täglichen Hörerinnen und Hörer stärken und betont, dass sein Programm "von Menschen für Menschen" ist. Ironischerweise wird die Kampagne jedoch von einem Werbespot begleitet, der mit KI-generierter Musik unterlegt ist. Diese Entscheidung wird als unglücklich angesehen, da sie den Widerspruch zwischen der Botschaft der Menschlichkeit und dem Einsatz von KI verdeutlicht. Der Faux-Pas könnte zwar amüsant wirken, birgt jedoch die Gefahr, die Glaubwürdigkeit der gesamten Kampagne zu untergraben.
Fish Audio gives its voice AI away, and charges for the latency
Fish Audio, ein Voice-AI-Startup aus Palo Alto, hat in einer Seed-Finanzierungsrunde 52 Millionen Dollar gesammelt und verfolgt ein innovatives Geschäftsmodell: Es bietet seine besten Voice-AI-Modelle kostenlos an, erhebt jedoch Gebühren für Infrastruktur und Latenz. Innerhalb eines Jahres konnte das Unternehmen über 8 Millionen Nutzer gewinnen und erzielt einen jährlichen wiederkehrenden Umsatz von 21 Millionen Dollar. Die Strategie basiert auf einem Open-Source-Ansatz, der Entwicklern den kostenlosen Zugang zu Modellen ermöglicht, während Unternehmen für garantierte Latenzzeiten zahlen. Das neueste Modell, S2.1 Pro, kann Stimmen aus fünfsekündigen Clips klonen und unterstützt 83 Sprachen mit einer Reaktionszeit von etwa 70 Millisekunden. Angesichts der wachsenden Nachfrage nach Voice-AI positioniert sich Fish Audio in einem wettbewerbsintensiven Markt. Das Unternehmen steht jedoch vor Herausforderungen, da Nutzer ihre Stimmen ohne Zustimmung hochladen können. Um diesem Problem zu begegnen, wurde ein nachträglicher Streitbeilegungsprozess eingerichtet. Investoren setzen auf Community-Engagement und betonen die Bedeutung von Vertrauen und Transparenz für den langfristigen Erfolg.
What happens when you put AI to work deciphering lost languages?
Die Entschlüsselung verlorener Sprachen wie Linear A und Etruskisch stellt Linguisten vor erhebliche Herausforderungen, da es an bekannten Bezugspunkten mangelt. Linear A, das Schriftsystem der minoischen Zivilisation, gilt als "Sprachisolat", während Etruskisch nur teilweise durch kurze Inschriften verstanden wird. In diesem Kontext wurde Künstliche Intelligenz (AI) eingesetzt, um Linguisten zu unterstützen und deren Intuitionen zu verstärken, nicht sie zu ersetzen. Ein AI-Ingenieur und Amateurlinguist erzielte im Juni 2026 einen bedeutenden Fortschritt bei Linear A, indem er eine Hypothese über ein unbekanntes Wort formulierte und AI-gestützte Programme zur Überprüfung dieser Hypothese nutzte. Er konnte 40 Zeichen Werte zuordnen und ein Lexikon mit 408 Wörtern erstellen, das seiner Meinung nach Linear A als ausgestorbene Sprache der semitischen Sprachgruppe identifiziert. Dabei ist hervorzuheben, dass die AI nicht die ursprüngliche Idee hatte; diese stammte vom Ingenieur selbst.
Curiosity-powered AI robots learn language faster and behave like children
Ein Forschungsteam am Okinawa Institute of Science and Technology hat KI-gesteuerte Roboter entwickelt, die durch Neugier schneller Sprache lernen als herkömmliche Modelle. Diese Roboter, die auf einem neuartigen, gehirninspirierten Ansatz basieren, bewältigten Sprachaufgaben in der Hälfte der Zeit, die traditionelle Roboter benötigten. Durch die Kombination von verstärkendem Lernen und einem System, das Neugier belohnt, zeigten die Roboter nicht nur kreative Lösungsansätze, sondern auch spielerisches Verhalten, das den Spracherwerb beschleunigte. Die Studie hebt die Bedeutung einer vielfältigen Sprachumgebung hervor, um das Lernen zu fördern, und zeigt, dass Roboter, die mit 180 Sprachkombinationen trainiert wurden, eine höhere Generalisierung erreichten als solche mit weniger Kombinationen. Zudem wiesen die Roboter ein Lernmuster auf, das dem U-förmigen Lernverlauf von Kleinkindern ähnelt, indem sie zunächst Fehler machten, bevor sie die Regeln korrekt anwendeten. Diese Erkenntnisse könnten sowohl die Sprachlernfähigkeiten von Robotern verbessern als auch wertvolle Einblicke in menschliche Kognition und den Spracherwerb bieten.
LG Uplus, Ericsson Unveil Voice AI Pact
LG Uplus hat eine strategische Partnerschaft mit Ericsson ins Leben gerufen, um die Entwicklung von Voice AI und AI-nativen Netzwerken zu fördern. Ziel dieser Zusammenarbeit ist es, die kommerziellen Servicedaten von LG Uplus' AI-Call-Agent "ixi-O" mit Ericssons fortschrittlicher Netzwerktechnologie zu kombinieren. Das geplante Voice-AI-System soll eine "Zero UI"-Umgebung schaffen, in der Nutzer ihre Absichten ausschließlich durch Sprache ausdrücken können, was die Einschränkungen bestehender AI-Dienste überwindet. Die Unternehmen streben an, eine intelligente Telekommunikationsinfrastruktur zu entwickeln, die in der Lage ist, Netzwerkbedingungen in Echtzeit zu erkennen und die Leistung sowie Energieeffizienz autonom zu optimieren. Zu den geplanten Funktionen gehören das Blockieren von Spam-Anrufen und die Unterstützung durch einen AI-Assistenten während Gesprächen. LG Uplus plant, die Technologie noch in diesem Jahr zu verifizieren und eine globale Kommerzialisierung aufzubauen. Die Partnerschaft soll die Effizienz steigern, neue Geschäftsmöglichkeiten erschließen und langfristiges Wachstum sowie Innovation im Kundenerlebnis fördern.
Zahlen, bitte! Von nur noch 24.821 Sprechenden auf zum Wortschatz für Millionen
Sanskrit, eine der ältesten Sprachen der indogermanischen Sprachfamilie, wird in Indien nur noch von 24.821 Menschen gesprochen, wie der Zensus von 2011 zeigt. Die Bharatiya Janata Party hat seit 2014 Maßnahmen ergriffen, um die Sprache wiederzubeleben, darunter die Einführung neuer Begriffe und den Einsatz von KI-gestützten Onlinediensten. Zu den Initiativen gehört die Entwicklung von Text-zu-Sprache-Generatoren wie Vāgdhenu, die für religiöse sowie alltägliche Gespräche und sogar für Sanskrit-Raps genutzt werden. Zudem wurden Bildungseinrichtungen und Lernzentren eingerichtet, um die Verbreitung von Sanskrit zu fördern. Wissenschaftliche Forschungen belegen, dass die Ursprünge des Sanskrit in Gebieten des heutigen Syriens liegen, was die historische Relevanz der Sprache unterstreicht. Es wird erwartet, dass die Zahl der Sprechenden möglicherweise über die 2011 erfassten 24.821 Personen gestiegen ist, was durch die bevorstehende 16. Volkszählung überprüft werden soll.
The AI Stopped Hackers. It Couldn’t Handle O’Brien.
In dem Artikel "The AI Stopped Hackers. It Couldn’t Handle O’Brien" beschreibt der Autor, wie ein KI-System erfolgreich einen SQL-Injection-Angriff abwehren konnte, jedoch an einer einfachen Anfrage nach Mitarbeitern mit dem Nachnamen O’Brien scheiterte. Diese Erfahrung führte zu einem Umdenken in der Sichtweise des Autors auf das Testen von KI-Systemen. Als QA-Architekt erkannte er, dass die Probleme, die er entdeckte, nicht neu oder spezifisch für KI waren, sondern ähnliche Herausforderungen wie bei herkömmlicher Software darstellten. Während der Evaluierung eines lokalen KI-Modells, das SQL aus natürlicher Sprache generiert, wurde ihm bewusst, dass die Testanforderungen für KI-Funktionen zunehmend an Bedeutung gewinnen. Diese Erkenntnisse spiegeln sich auch in Vorstellungsgesprächen wider und verdeutlichen die Notwendigkeit, gängige Fehlerquellen auch bei KI-Anwendungen zu berücksichtigen. Der Artikel plädiert für eine angepasste Herangehensweise an das Testen von KI-Systemen, um deren Zuverlässigkeit zu gewährleisten.
NeuroLexIQ and Canary Speech Partner to Bring AI Voice Analysis to the Personal Injury Intake Process
Die Partnerschaft zwischen Canary Speech und NeuroLexIQ zielt darauf ab, die objektive Stimm-Analyse in den Prozess der persönlichen Verletzungsaufnahme zu integrieren. Dies geschieht, um potenzielle Gehirnverletzungen bereits beim ersten Kontakt mit einem Klienten zu identifizieren. Durch die Einbindung der Stimm-Biomarker-Technologie von Canary Speech in den Concussion Probability Report von NeuroLexIQ wird eine Analyse der Sprachmuster während des ersten Gesprächs durchgeführt. Diese Analyse ermöglicht die Erstellung eines Berichts über die Wahrscheinlichkeit einer Gehirnerschütterung, wodurch Anwälte frühzeitig objektive Hinweise auf mögliche Verletzungen erhalten. Die Kombination von Sprachsignalen mit FDA-zugelassenen neurodiagnostischen Daten schafft eine umfassende, rechtlich verwertbare Dokumentation. Ein Pilotprogramm zur Einführung des integrierten Aufnahmeprozesses startet am 1. Juli 2026 und bietet Anwälten die Möglichkeit, von dieser innovativen Technologie zu profitieren. Diese Entwicklung könnte die Dokumentation und Unterstützung von Gehirnverletzungen in der persönlichen Verletzungsrechtsprechung revolutionieren.
This AI tool doesn't just speak languages—it invents them
Das AI-Tool, das in dem Artikel vorgestellt wird, hat die Fähigkeit, nicht nur bestehende Sprachen zu verstehen und zu sprechen, sondern auch neue Sprachen zu kreieren. Es nutzt fortschrittliche Algorithmen und maschinelles Lernen, um grammatikalische Strukturen und Wortschatz zu entwickeln, die in der menschlichen Kommunikation einzigartig sind. Diese Innovation könnte weitreichende Anwendungen finden, von der Verbesserung der Kommunikation in mehrsprachigen Umgebungen bis hin zur Schaffung von fiktiven Sprachen für Filme und Spiele. Das Tool zeigt das Potenzial der KI, kreative Prozesse zu unterstützen und neue Wege der Interaktion zu ermöglichen. Die Entwicklung wirft jedoch auch Fragen zur Ethik und zum Einfluss auf die menschliche Sprache auf.
Spotify Launches ChatGPT-Style Music Assistant for Premium
Spotify hat einen neuen KI-gestützten Musikassistenten für Premium-Abonnenten eingeführt, der es Nutzern ermöglicht, durch natürliche Sprache personalisierte Empfehlungen für Musik, Podcasts und Hörbücher zu erhalten. Diese Funktion soll die Entdeckung von Inhalten conversationaler gestalten und Spotify helfen, im Wettbewerb mit Apple Music zu bestehen. Der Assistent analysiert Hörgewohnheiten und Stimmungsangaben der Nutzer, um maßgeschneiderte Vorschläge zu liefern. Die Einführung erfolgt in einer Zeit, in der Spotify an Marktanteilen verliert und sich durch exklusive Funktionen von der kostenlosen Version abheben möchte. Während die genauen KI-Modelle nicht offengelegt werden, könnten Bedenken hinsichtlich des Datenschutzes aufkommen, da unklar bleibt, wie mit Nutzerdaten umgegangen wird. Diese Entwicklung könnte entscheidend dafür sein, ob Spotify im gesättigten Streaming-Markt die Führung übernimmt oder zurückfällt.
Databricks Genie: From “Ask a Question” to Production Conversational Analytics
Databricks Genie ist eine innovative Plattform, die es Geschäftsanwendern ermöglicht, Unternehmensdaten in natürlicher Sprache abzufragen, ohne dass SQL-Kenntnisse erforderlich sind. Die Lösung ist nun allgemein verfügbar und hat sich zu einer produktionsreifen Anwendung entwickelt, bleibt jedoch kontinuierlich in der Entwicklung. Genie löst das Problem, dass viele Benutzer bei spezifischen Anfragen auf Analysten angewiesen sind, da traditionelle Dashboards oft nicht ausreichen. Durch den Einsatz großer Sprachmodelle hat sich die Qualität der natürlichen Sprachabfragen verbessert, was die Generierung nützlicher SQL-Abfragen erleichtert, vorausgesetzt, es liegt genügend Kontext zum Datenmodell vor. Dennoch bestehen Herausforderungen hinsichtlich des Vertrauens in die Antworten, insbesondere für nicht-technische Benutzer. Vor der Einführung der Lösung müssen Risiken und Anforderungen sorgfältig berücksichtigt werden, um ihre Effektivität und Zuverlässigkeit zu gewährleisten.
Football clichés rise as World Cup enters knockout stages, AI analysis finds
Mit dem Eintritt in die K.o.-Runden der Fußball-Weltmeisterschaft zeigen Trainer laut einer AI-Analyse von Sinch eine signifikante Zunahme an Klischees in ihrer Kommunikation. Die Verwendung solcher Phrasen stieg um 50%, wobei die durchschnittlichen xC-Werte von 28 auf 42 anstiegen. Dies deutet darauf hin, dass Trainer in Drucksituationen vermehrt auf emotionale Themen wie Herz, Glauben und Zusammenhalt zurückgreifen, anstatt taktische Erklärungen zu liefern. Besonders nach Siegen neigen viele Trainer dazu, vertraute Phrasen zu verwenden, während nach Niederlagen eine differenziertere Kommunikation stattfindet. Trainer mit niedrigeren xC-Werten konzentrieren sich stärker auf Taktik und Teamleistung, während höhere Werte oft allgemeinere, emotionalere Botschaften beinhalten. Diese Tendenz könnte die Wahrnehmung der Fans beeinflussen, da klare, taktische Erklärungen tendenziell mehr Zustimmung finden. Die Analyse verdeutlicht, dass in stressigen Situationen die Sprache der Trainer emotionaler wird und sich von analytischen Ansätzen entfernt.
Scientists use AI to decode sperm whale communication, discovering a possible phonetic alphabet and revealing that Mediterranean sperm whales have different dialects by region
Wissenschaftler haben mithilfe von künstlicher Intelligenz ein komplexes Kommunikationssystem bei Pottwalen entschlüsselt und ein mögliches phonetisches Alphabet identifiziert. Diese Entdeckung zeigt, dass Pottwale im östlichen Mittelmeer regionale Dialekte entwickelt haben, die sich von denen westlicher Populationen unterscheiden. Durch die Analyse von Tausenden von Klickgeräuschen fanden die Forscher Muster, die Ähnlichkeiten mit menschlicher Sprache aufweisen, wie Akzente und Silben. Die Ergebnisse deuten darauf hin, dass Pottwale eine Vielzahl einzigartiger vokaler Signaturen aus einer begrenzten Anzahl von Grundgeräuschen erzeugen können. Während karibische Wale die Komplexität dieser sprachlichen Elemente demonstrieren, zeigen Mittelmeerwale, wie sich Klänge über geografische Entfernungen verändern. Diese Dialektunterschiede könnten auf eine kulturelle Evolution hinweisen, die über Jahrtausende stattgefunden hat. Die Erkenntnisse sind entscheidend für den Schutz der bedrohten Pottwalpopulationen, da ein besseres Verständnis ihrer Kommunikation helfen könnte, effektivere Schutzmaßnahmen zu entwickeln und das öffentliche Engagement für den Meeresschutz zu fördern.
ehamarkets startet ehamarkets AI und bietet Tradern weltweit intelligente Handelsunterstützung rund um die Uhr
ehamarkets hat mit ehamarkets AI einen neuen KI-gestützten Handelsassistenten eingeführt, der auf der OpenClaw/Hermes-Technologie basiert. Dieser Assistent bietet Tradern weltweit rund um die Uhr intelligente Unterstützung, um die dynamischen und datenintensiven Finanzmärkte besser zu beobachten und zu analysieren. ehamarkets AI ermöglicht eine effiziente Kommunikation der Handelsziele in natürlicher Sprache und sendet personalisierte Benachrichtigungen. Nutzer erhalten zeitnahe Informationen und können Handelsaktivitäten automatisiert durchführen, während sie die Kontrolle über ihre Entscheidungen behalten. CEO Markus Weber hebt hervor, dass ehamarkets AI als intelligenter Handelsbegleiter fungiert, der Händlern hilft, ihre Strategien effektiver umzusetzen. Die Einführung dieser Technologie unterstreicht das Engagement von ehamarkets für Innovationen im Finanztechnologiebereich und zielt darauf ab, ein zugänglicheres und intelligenteres Handelserlebnis zu schaffen.
ehamarkets startet ehamarkets AI und bietet Tradern weltweit intelligente Handelsunterstützung rund um die Uhr
ehamarkets hat mit ehamarkets AI einen KI-gestützten Handelsassistenten eingeführt, der auf der OpenClaw/Hermes-Technologie basiert und Tradern weltweit rund um die Uhr Unterstützung bietet. Diese innovative Technologie ermöglicht es Nutzern, Märkte kontinuierlich zu beobachten, Informationen zu analysieren und zeitnahe Benachrichtigungen zu erhalten, um ihre Handelsaktivitäten zu optimieren. Angesichts der steigenden Komplexität der globalen Finanzmärkte bietet ehamarkets AI personalisierte Benachrichtigungen in natürlicher Sprache und automatisierte Handelsausführungen, wobei die Kontrolle beim Nutzer bleibt. CEO Markus Weber betont, dass ehamarkets AI eine wichtige Lücke schließt, indem sie Händlern hilft, ihre Strategien effizienter und selbstbewusster umzusetzen. Die Einführung dieser Technologie zeigt das Engagement von ehamarkets für Innovationen im Finanztechnologiebereich und zielt darauf ab, ein intelligenteres Handelserlebnis zu schaffen.
Former Chief AI Officer Publishes Plain-Language Guide to Everyday Artificial Intelligence
Steven Jones, ehemaliger Chief AI Officer, hat einen 78-seitigen Leitfaden mit dem Titel "The Intelligence We Built" veröffentlicht, der sich an Leser ohne technischen Hintergrund richtet. Der Leitfaden erklärt, wie künstliche Intelligenz (KI) das Geschäftsleben, die Arbeit und alltägliche Entscheidungen beeinflusst. Jones zielt darauf ab, die Kluft zwischen dem allgemeinen Verständnis von KI und ihrer tatsächlichen Funktionsweise zu überbrücken. In verständlicher Sprache beschreibt er, wie KI-Systeme lernen, welche Fortschritte sie gemacht haben und welche Auswirkungen dies auf die Nutzer hat. Der Inhalt beleuchtet sowohl die positiven Aspekte der Automatisierung und kreativen Tools als auch die damit verbundenen Risiken und ethischen Fragestellungen. Jones betont, dass ein grundlegendes Verständnis von KI für Berufstätige zunehmend wichtig wird, da diese Technologien immer mehr in den Alltag integriert werden. Der Leitfaden ist für Manager, Fachkräfte und interessierte Laien zugänglich und erfordert keine tiefgehenden technischen Kenntnisse. Mit über 20 Jahren Erfahrung in der KI und Unternehmensstrategie bietet Jones einen praxisnahen Ansatz, der sich auf reale Anwendungen konzentriert.
Banana Pro AI Rebrands as Pixomi AI, Expanding Into a Broader AI Creative Platform
Pixomi AI, früher bekannt als Banana Pro AI, hat sich neu positioniert und bietet nun eine umfassende kreative Plattform an, die den gesamten kreativen Prozess unterstützt – von der Konzeptentwicklung bis zur finalen Ausgabe. Die Umbenennung und die neue Domain pixomi.ai ermöglichen eine breitere Funktionalität, einschließlich Musikgenerierung und Workflow-Automatisierung. In nur vier Monaten hat die Plattform 200.000 registrierte Nutzer gewonnen und behält alle bestehenden Benutzerkonten und Daten bei. Nutzer können sich weiterhin mit ihren alten Anmeldedaten einloggen und erhalten Upgrade-Geschenkcredits. Die zukünftige Roadmap von Pixomi AI sieht die Erweiterung von Bild- und Video-Generierungsmodellen sowie die Einführung eines AI Workflow Studios vor, um kreative Prozesse weiter zu optimieren.
Experts give warning about AI consciousness
Eine Gruppe von Forschern, darunter Neurowissenschaftler der Université de Montréal und der Johns Hopkins University, warnt davor, künstliche Intelligenz (KI) fälschlicherweise mit echtem Bewusstsein gleichzusetzen. In einem neuen Papier wird hervorgehoben, dass die beeindruckenden Fähigkeiten von KI-Chatbots wie ChatGPT und Claude, insbesondere in Bezug auf Sprache und Empathie, nicht bedeuten, dass sie tatsächlich ein Bewusstsein oder innere Erfahrungen besitzen. Die Forscher ziehen das Konzept der Blindsight heran, bei dem Menschen trotz Schädigungen des visuellen Kortex Informationen verarbeiten, ohne sich dessen bewusst zu sein. Dies verdeutlicht, dass KI-Systeme zwar intelligent erscheinen, jedoch keine echten emotionalen Erfahrungen machen können. Angesichts der zunehmenden Abhängigkeit der Menschen von KI für persönliche und emotionale Unterstützung ist es entscheidend, diese Unterscheidung zu treffen. Derzeit gibt es keine Hinweise darauf, dass Computer jemals ein Bewusstsein entwickeln könnten, und die Forscher betonen, dass aktuelle KI-Systeme keine Gefühle haben.
Gemini Streaming TTS: How Developers Can Make AI Voice Apps Feel Instant
Gemini Streaming TTS revolutioniert die Entwicklung von KI-Sprach-Apps, indem es die Latenz verringert und die Benutzererfahrung verbessert. Durch Streaming-Technologie können Teile der Antwort sofort in Audio umgewandelt und abgespielt werden, was die Interaktion dynamischer und reaktionsschneller gestaltet. Dies ist besonders relevant, da Nutzer bei Sprach-Apps weniger Geduld für Stille haben als bei textbasierten Anwendungen. Die Architektur umfasst einen Antwortplaner und einen Sprachchunker, die sicherstellen, dass die gesprochene Antwort klar und verständlich ist. Entwickler sollten die Audioausgabe optimieren, um die Zeit bis zum ersten hörbaren Ton zu minimieren und eine flüssige Wiedergabe zu gewährleisten. Zudem sind Sicherheitsvorkehrungen zum Schutz sensibler Informationen und Fallback-Optionen für den Fall eines Audioausgabe-Fehlers wichtig. Insgesamt ermöglicht Gemini Streaming TTS eine nahtlose Integration von Sprachfunktionen in KI-Anwendungen, die durch schnellere und intuitivere Interaktionen überzeugen.
DeepL acquires US audio stadium streaming business Mixhalo
DeepL, das deutsche KI-Übersetzungsunternehmen, hat das US-Startup Mixhalo übernommen, das eine innovative Technologie für gleichbleibende Klangqualität bei Konferenzen und Sportveranstaltungen bietet. Diese Akquisition, die nach der Entlassung von etwa 250 Mitarbeitern erfolgt ist, stellt DeepLs ersten Standort in San Francisco dar und zielt darauf ab, die KI-Übersetzungsdienste zu erweitern. Mixhalo, gegründet von Musikern und Technologen, ermöglicht Nutzern über eine App und Kopfhörer, hochwertige Audioerlebnisse in Echtzeit und in mehreren Sprachen zu genießen. Die Technologie wurde bereits bei großen Events wie Metallica-Konzerten und MLB-Spielen eingesetzt. DeepL plant, die Audioinfrastruktur von Mixhalo zu integrieren, um Übersetzungen und Untertitel klar und sofort an große Publikumsmengen zu liefern. CEO Jarek Kutylowski hebt hervor, dass die Zusammenarbeit eine Echtzeit-Sprach-KI-Schicht schaffen soll, die natürliche Kommunikation unabhängig vom Standort ermöglicht.
DoorDash Launches AI Photo Ordering and Voice Reservations
DoorDash hat innovative KI-gestützte Funktionen eingeführt, die das Bestellen von Essen vereinfachen. Kunden können nun einfach ein Foto eines Gerichts machen oder ihre Wünsche in einfacher Sprache äußern, woraufhin Algorithmen passende Gerichte in der Nähe finden und sogar Tischreservierungen ermöglichen. Diese Neuerungen sind Teil eines intensiven Wettbewerbs im Bereich der Essenslieferdienste, da die Kundenbindung und Bestellwerte stagnieren. DoorDash strebt an, den gesamten Entscheidungsprozess beim Essen zu dominieren, was eine Herausforderung für etablierte Reservierungsdienste wie OpenTable darstellt. Die technische Umsetzung erfordert komplexe Modelle für Bild- und Sprachverarbeitung. Für Restaurants ergeben sich sowohl Chancen als auch Herausforderungen, da sie möglicherweise weniger als individuelle Marken wahrgenommen werden. Die psychologischen Effekte könnten die Bestellfrequenz erhöhen, da visuelle Anreize stärkere Impulse auslösen. Der Wettbewerb wird sich verschärfen, da auch Unternehmen wie Amazon und Apple ähnliche Funktionen testen. DoorDash hat durch die frühzeitige Einführung dieser Technologien einen Vorsprung, doch bleibt abzuwarten, ob sie ihre Marktführerschaft sichern können.
AI voice scams can clone your family’s voice
Scammer nutzen zunehmend KI-Technologie, um Stimmen von Familienmitgliedern zu klonen und gezielte Betrugsanrufe durchzuführen. Bereits drei Sekunden Audio aus sozialen Medien genügen, um eine täuschend echte Stimme zu erzeugen. Die Gefahr liegt nicht nur in der gefälschten Stimme, sondern auch in der gründlichen Recherche, die Betrüger anstellen, um persönliche Informationen über ihre Opfer zu sammeln. Sie greifen auf Datenbroker-Websites zurück, um Namen, Adressen und weitere Details zu finden, die sie in ihren Anrufen verwenden, um glaubwürdig zu erscheinen. Diese Betrugsmasche hat in den letzten Jahren zugenommen, und viele Menschen haben bereits hohe finanzielle Verluste erlitten. Um sich zu schützen, sollten persönliche Daten von solchen Websites entfernt, Familiencode-Wortregeln eingeführt und Rückrufregeln etabliert werden. Es ist wichtig, in solchen Situationen ruhig zu bleiben und die Echtheit des Anrufs zu überprüfen, bevor man handelt.
Fourier Analysis from a Linear Algebraic Perspective
Der Artikel "Fourier Analysis from a Linear Algebraic Perspective" untersucht die Fourier-Analyse durch die Linientheorie und deren Anwendungen in Bereichen wie Quantenmechanik und Signalverarbeitung. Der Autor erklärt, dass die Fourier-Reihe und die Fourier-Transformation als spezielle Anwendungen der linearen Algebra in Funktionsräumen betrachtet werden können. Die Theorie wird systematisch aufgebaut, wobei sowohl die komplexen Varianten der Fourier-Reihe als auch die kontinuierliche Fourier-Transformation behandelt werden. Besondere Ergebnisse wie die Parseval-Relation werden ebenfalls diskutiert. Der Autor bietet detaillierte Erklärungen, verzichtet jedoch auf vollständige Ableitungen und gibt stattdessen gezielte Hinweise zur Förderung des Verständnisses. Zudem wird die Rolle von linear unabhängigen orthogonalen Basisfunktionen betont, die bereits in früheren Arbeiten des Autors behandelt wurden.
How to use AI to build mental resilience
Der Artikel „How to use AI to build mental resilience“ beschreibt, wie Künstliche Intelligenz (AI) zur Stärkung mentaler Resilienz eingesetzt werden kann. AI bietet Werkzeuge für Reflexion, Zielsetzung und die Umwandlung von Rückschlägen in umsetzbare Schritte, ohne menschliche Unterstützung zu ersetzen. Durch AI-Journaling-Tools können Nutzer Stressauslöser und Lektionen dokumentieren, was ihnen hilft, emotionale Muster zu erkennen und negatives Selbstgespräch in positive Sprache umzuwandeln. Zudem unterstützt AI bei der Formulierung realistischer SMART-Ziele und der regelmäßigen Überprüfung des Fortschritts, was persönliche Verantwortung und Wachstumsfokus fördert. Rückschläge werden in praktische Schritte umgewandelt, indem Nutzer lernen, aus Herausforderungen zu wachsen. Schließlich bieten mindset-orientierte Apps personalisierte Meditationssitzungen und Stimmungstracking, um emotionale Konsistenz zu fördern und Stress effektiv zu bewältigen.
Apple’s Image Playground doesn’t suck anymore
Auf der WWDC 2026 hat Apple bedeutende Verbesserungen für die Image Playground-App vorgestellt, die durch eine umfassende KI-Überarbeitung nun leistungsfähiger ist. Die App ermöglicht es Nutzern, Bilder in hoher Qualität zu generieren, indem sie einfach in natürlicher Sprache beschreiben, was sie möchten, ohne dass ihre Fotos gespeichert oder mit Apple geteilt werden. Ein Beispiel ist die Erstellung von Einladungen für Geburtstagsfeiern, bei denen Nutzer Bilder von Freunden mit spezifischen Details gestalten können. Die generierten Bilder sind vielseitig einsetzbar, etwa für Webseiten oder Flyer. Zudem erlaubt die Integration über verschiedene Geräte hinweg die Erstellung personalisierter Hintergründe für iMessage oder Sperrbildschirme. Diese Neuerungen könnten die Nutzerzahlen der App steigern und die Qualität der generierten Bilder im Vergleich zur Konkurrenz erheblich verbessern.
Strava: Claude & Co. können künftig eure Trainingsdaten auswerten
Strava hat einen neuen MCP-Connector eingeführt, der es zahlenden Abonnenten ermöglicht, ihre Trainingsdaten über KI-Assistenten wie Claude auszuwerten. Diese Funktion erleichtert den Zugriff auf persönliche Trainingshistorien, da Nutzer keine Exporte oder Tabellen mehr erstellen müssen. Die KI kann auf verschiedene Daten zugreifen, darunter Herzfrequenz, Pace, GPS-Informationen sowie Leistungsdaten beim Radfahren und Details zu Clubs und Events. Nutzer können in normaler Sprache Fragen stellen, um herauszufinden, welche Trainingsarten ihre Fitness verbessern oder wie Cross-Training das Laufen beeinflusst. Der Zugriff auf die Daten ist ausschließlich lesend und auf das eigene Konto beschränkt, wobei Nutzer die Verbindung jederzeit in den Einstellungen widerrufen können. Der Rollout dieser Funktion beginnt weltweit in dieser Woche für Strava-Abonnenten, und die Einrichtung wird im Help Center von Strava erläutert.
Verwandte Cluster
Weitere Themen innerhalb derselben Unterrubrik zur schnellen Navigation.