EVA ist ein End-to-End-Bewertungsframework für mehrturnige gesprochene Interaktionen mit Voice Agents. Es bewertet gemeinsam Genauigkeit und Gesprächserlebnis und wurde mit einem ersten Airline-Datensatz sowie Benchmark-Ergebnissen für 20 Systeme veröffentlicht.
NVIDIA Nemotron 3 Nano Omni ist ein omni-modales Modell für Dokumente, Bilder, Video und Audio. Es ist auf lange Kontexte, multimodales Reasoning, Spracherkennung und agentische GUI-Aufgaben ausgelegt und wird mit offenen Checkpoints auf Hugging Face bereitgestellt.
Adobe führt auf der NAB Show 2026 einen neuen Color Mode für Adobe Premiere als Beta ein. Der direkt in Premiere integrierte Grading-Arbeitsbereich nutzt GPU-Beschleunigung auf NVIDIA GeForce RTX- und RTX PRO-Systemen und arbeitet erstmals mit 32-Bit-Farbtiefe.
Google stellt mit Veo 2 ein neues Videomodell und eine aktualisierte Version von Imagen 3 für die Bildgenerierung vor. Beide Modelle sollen in menschlich bewerteten Vergleichen Ergebnisse auf dem Stand der Technik erreichen und werden über VideoFX, ImageFX und das neue Labs-Experiment Whisk verfügbar gemacht.
In der ersten Folge von „The Shape of Things to Come“ diskutieren Doug Burger, Nicolò Fusi und Subutai Ahmad, ob heutige KI-Systeme als intelligent gelten können. Im Mittelpunkt stehen Unterschiede zwischen transformerbasierten Large Language Models und der verteilten, kontinuierlich lernenden Architektur des menschlichen Gehirns.
In einer Folge des Microsoft-Research-Podcasts „Ideas“ sprechen Jaime Teevan, Jenna Butler, Jake Hofman und Rebecca Janssen über den Microsoft New Future of Work Report 2025. Thema sind vor allem die wachsende, aber ungleich verteilte KI-Nutzung, beobachtete Auswirkungen auf Aufgaben und Produktivität sowie die Frage, wie der Einsatz von KI bewusst gestaltet werden kann.