Zum Inhalt springen
Heute7. Okt.Mi1 Einträge
  1. Microsoft Research52

    Microsoft-Forscherin Jennifer Neville erklärt Fehler von KI in längeren Gesprächen

    Microsoft-Forscherin Jennifer Neville beschreibt, warum KI-Systeme bei längeren Gesprächen und wiederholten Änderungen an Dokumenten Fehler machen können. In Tests ihrer Gruppe sank die Leistung deutlich, wenn Nutzer ihre Anforderungen erst über mehrere Gesprächsschritte erklärten. Sie rät dazu, Antworten zu prüfen und bei Verwirrung die Aufgabe in einem neuen Gespräch vollständig zu formulieren.

4. Okt.So
  1. Hugging Face Blog74

    Microsofts ThinkingBox prüft, was KI-Agenten tatsächlich ändern

    Microsoft hat ThinkingBox entwickelt und über Hugging Face verfügbar gemacht: Der Test prüft gespeicherte Angaben statt nur die Antworten von KI-Agenten. In einem Beispiel schloss ein Agent ein Ticket zur verspäteten Lieferung, obwohl der Lieferfall noch ungeklärt war und das Ticket auf «wartend» stehen sollte. Die 507 künstlich erstellten Aufgaben werden je 20-mal geprüft; ein einmaliger Erfolg zeigt noch nicht, dass der Agent zuverlässig handelt.

    Grund für die Empfehlung: Wer KI-Agenten Geschäftsvorgänge bearbeiten lässt, muss erkennen können, ob sie wiederholt die richtigen Angaben hinterlassen.

1. Okt.Do
29. Sept.Di
  1. Microsoft Research63

    Microsoft Research stellt das KI-Forschungssystem Quine für die Biologie vor

    Microsoft Research stellt Quine vor, ein experimentelles Forschungssystem mit einem multimodalen Weltmodell der Biologie und einer Verbindung zu wissenschaftlichen Werkzeugen。

    Grund für die Empfehlung: Die Verbindung von Modellvorhersagen und Labortests zeigt am Beispiel von Bauchspeicheldrüsenkrebs, wie Quine die Auswahl von Wirkstoffen für weitere Versuche unterstützt.

24. Sept.Do
21. Sept.Mo
1. Sept.Di
21. Aug.Fr
13. Aug.Do