Simon Willison testet mit Claude Opus 5.5 die Komposition von Spielmusik
Simon Willison bat Claude Opus 5.5, Spielmusik zu schreiben, ein einfaches Textformat dafür zu entwerfen und ein Programm mit Beispielstücken zu bauen。
Simon Willison bat Claude Opus 5.5, Spielmusik zu schreiben, ein einfaches Textformat dafür zu entwerfen und ein Programm mit Beispielstücken zu bauen。
Mistral hat eine öffentliche Vorschau von Mistral Large 4 veröffentlicht. Das Modell hat laut Mistral rund eine Billion Parameter。
Dieselbe Nachricht in der Auswahl《Mistral AI stellt Mistral Large 4 als öffentliche Vorschau vor》
Mistral AI hat Mistral Large 4 (ML4) veröffentlicht。
Mistral AI stellt Mistral Large 4 als öffentliche Vorschau bereit; die API ist über Mistral Studio nutzbar。
Grund für die Empfehlung: Die Vorschau per API und die erst für Monatsende angekündigten offenen Gewichte zeigen, welche Zugangsform bereits verfügbar ist und welche noch aussteht.
Reka AI hat eine Forschungs-Vorschau von Rho-1 veröffentlicht. Das Modell mit 19 Milliarden Parametern verarbeitet und erzeugt Text。
Startups im NVIDIA-Inception-Programm entwickeln KI-Anwendungen für die Brustkrebsversorgung。
Latent Space berichtet über Pi 1.0 und Pi Durable und erinnert an den Ticketverkauf für AI Engineer NYC. Pi 1.0 ergänzt unter anderem native MCP-Unterstützung。
Microsoft Research stellt Quine vor, ein experimentelles Forschungssystem mit einem multimodalen Weltmodell der Biologie und einer Verbindung zu wissenschaftlichen Werkzeugen。
Grund für die Empfehlung: Die Verbindung von Modellvorhersagen und Labortests zeigt am Beispiel von Bauchspeicheldrüsenkrebs, wie Quine die Auswahl von Wirkstoffen für weitere Versuche unterstützt.
Google DeepMind stellt Gemini 3.8 Live mit Live Avatar für visuelle Gespräche nahezu in Echtzeit vor. Die Funktion verbindet Sprache und Video。
Grund für die Empfehlung: Die Kombination aus laufendem Dialog und Video zeigt, wie Unternehmen virtuelle Gesprächspartner einsetzen können, ohne die Unterhaltung bei Datenabfragen zu unterbrechen.
Google Research stellt ein Experiment vor, mit dem Lehrkräfte interaktive Lernsimulationen passend zu ihren Lernzielen erstellen können. Eine englischsprachige Sammlung umfasst über 30 KI-generierte und von Lehrkräften geprüfte Simulationen für MINT-Fächer. Schulen mit Google Workspace for Education können sich für ein Pilotprogramm anmelden; in einer ersten US-Studie bewerteten 12 Lehrkräfte die Qualität der Simulationen im Durchschnitt mit 8 von 10 Punkten.
Google Research beschreibt mit Retrieve-for-Train ein Verfahren。
Google DeepMind stellt Gemini 3.8 Live für skalierbare Sprachdialoge und Gemini 3.8 Live Extended Thinking für komplexe Aufgaben mit mehrstufigem Schlussfolgern vor. Gemini 3.8 Live verarbeitet visuelle Eingaben nahezu in Echtzeit und unterstützt Sprachwechsel zwischen 97 Sprachen während eines Gesprächs. Beide Modelle werden ab heute über die Gemini API und Google AI Studio bereitgestellt; für Unternehmen gibt es eine private Vorschau.
Grund für die Empfehlung: Die Angaben zu Echtzeitdialog, Werkzeugaufrufen und gestaffelter Verfügbarkeit zeigen, welche Bausteine Google DeepMind für sprachgesteuerte Arbeitsabläufe anbietet.
Microsoft Research stellt mit GigaPath-Flash und GigaTIME-Flash zwei offene Forschungsmodelle vor。
MindTopo prüft, ob multimodale Modelle topologische Beziehungen in Bildern erkennen und bei einer Folge von Handlungen erhalten oder verändern können. Die Aufgaben decken Kontinuität。