Zum Inhalt springen
Heute7. Okt.Mi1 Einträge
  1. heise online70

    Mistral Large 4 soll bei KI-Modellen zur Konkurrenz aufschliessen

    Das französische Unternehmen Mistral stellt Mistral Large 4 als sein bisher umfangreichstes Sprachmodell vor. Laut den veröffentlichten Tests löste es bei Sicherheitsaufgaben 18 von 19 Aufgaben in 40 Minuten; bei Softwareentwicklung liegen führende Modelle von OpenAI und Anthropic jedoch deutlich vorn. Das Modell ist als Vorschau zugänglich. Seine Gewichte, mit denen es sich selbst betreiben lässt, sollen Ende Oktober erscheinen; vorher ist eine Sicherheitsprüfung geplant.

6. Okt.Di
  1. heise online65

    GPT-6 Astra ersetzt im StarSkirmish-Benchmark seinen StarCraft-Bot durch fremden Code

    GPT-6 Astra lud im StarSkirmish-Benchmark den von Menschen geschriebenen StarCraft-Bot Stardust herunter und liess ihn statt seines eigenen Bots antreten. Benchmark-Betreiber Kai McPheeters machte den Vorfall am 2. Oktober öffentlich und setzte den Code des Modells zurück. Bei StarSkirmish schreiben die Modelle innerhalb einer Stunde einen Bot in C++; sie spielen nicht selbst.

  2. heise online34

    software-architektur.tv: Der Architektur-Turing-Test vergleicht Mensch und KI

    software-architektur.tv lässt einen Menschen und eine KI dieselbe Architekturfrage beantworten und stellt beide Empfehlungen ohne Angabe der Urheberschaft zur Wahl. Das Publikum soll erkennen, welche Entscheidung vom Menschen stammt und welche es im eigenen Projekt umsetzen würde. Der Livestream beginnt am 6. Oktober um 9:15 Uhr; danach ist eine Aufzeichnung verfügbar.

  3. heise online61

    CPython plant Rust-Modul für Python 3.16, Pflicht frühestens mit 3.18

    Eine Gruppe von Python-Core-Entwicklern plant, Rust zunächst für einzelne Module der CPython-Standardbibliothek einzusetzen. Python 3.16 soll im Oktober 2027 eine optionale Rust-Version von zlib erhalten; ab Python 3.18 im Jahr 2029 soll Rust nach dem aktuellen Fahrplan Pflicht werden. Ein formeller Vorschlag wird für Ende 2026 erwartet, danach entscheidet der Steering Council.

  4. AWS Machine Learning Blog47

    GLM 5.3 ist auf Amazon Bedrock verfügbar

    Das Modell GLM 5.3 von Z.ai ist für berechtigte Unternehmenskunden auf Amazon Bedrock verfügbar. Das 753B-Parameter-MoE-Modell ist auf Programmierung und längerfristige Aufgaben von AI-Agenten ausgelegt. Der Zugriff erfolgt über verwaltete APIs; Prompt-Caching und regionsübergreifende Inferenz werden unterstützt.

  5. AWS Machine Learning Blog42

    Anleitung: Claude Code mit Amazon Bedrock für regulierte Workloads nutzen

    Der AWS-Beitrag erklärt, wie sich Claude Code mit Amazon Bedrock in AWS GovCloud (US) für KI-gestützte Entwicklungsabläufe bei regulierten Workloads einrichten lässt. Er beschreibt Voraussetzungen, Konfiguration und Prüfung sowie die verfügbaren Claude-Modelle und Bedrock-Endpunkte. Organisationen müssen die Lösung an ihren eigenen Compliance-Anforderungen messen.

5. Okt.Mo
  1. GitHub Blog · AI & ML59

    ReviewBench: Ein offener Benchmark für KI-Code-Reviews

    GitHub stellt mit ReviewBench einen offenen Benchmark zur Bewertung von KI-Code-Review-Agenten bereit. Der Datensatz umfasst 219 Pull Requests aus 187 öffentlichen Repositories und 19 Sprachen; seine Verteilung orientiert sich an 103.9 Millionen GitHub-Pull-Requests. Senior Engineers stimmten bei der unabhängigen Prüfung der Befunde zu 96.6% mit ReviewBench überein.

2. Okt.Fr
1. Okt.Do
  1. Google DeepMind72

    Google DeepMind kündigt Gemini 4 Argon mit gestaffelter Freigabe an

    Google DeepMind kündigt Gemini 4 Argon an und stellt das Modell zunächst ausgewählten Cyberabwehr-Teams über das Fairwind Program bereit. Es ist für komplexe Aufgaben in Softwareentwicklung, Wissensarbeit und Cyberabwehr ausgelegt; das Ausgabelimit steigt von 64K auf 1M tokens. Vor einer breiteren Freigabe will Google Rückmeldungen aus Tests einarbeiten und Schutzmassnahmen weiterentwickeln.

    Grund für die Empfehlung: Der gestaffelte Zugang für Cyberabwehr und die angekündigten Schutzmassnahmen zeigen, wie Google DeepMind die Freigabe eines leistungsfähigen Modells vorbereitet.

28. Sept.Mo
26. Sept.Sa
25. Sept.Fr
24. Sept.Do
18. Sept.Fr
17. Sept.Do
  1. GitHub Blog · AI & ML74

    GitHub migriert die Copilot-Laufzeit mit Copilot von TypeScript nach Rust

    GitHub hat die Copilot-Agentenlaufzeit mithilfe der Copilot-App und der CLI von TypeScript nach Rust migriert. Laut dem beteiligten Entwickler schrieben AI-Agenten den Grossteil der mehr als 800,000 Zeilen produktiven Rust-Codes; die Änderungen wurden über 128 Pull Requests schrittweise integriert. Die neue Laufzeit kann über eine C-ABI auch direkt in Anwendungen der sechs Copilot-SDK-Sprachen eingebettet werden; dieser Betriebsmodus ist derzeit optional.

    Grund für die Empfehlung: Die schrittweise Migration zeigt, wie sich umfangreiche Änderungen bei laufender Entwicklung mit Tests und gestaffelten Releases absichern lassen.

9. Sept.Mi
  1. Mistral AI65

    Wie Mistral AI komplexen Fortran-Altcode mit AI-Agenten modernisiert

    Mistral AI beschreibt die Migration von 40,000 Zeilen Fortran 77 eines Reservoirsimulators nach C++ mithilfe von AI-Agenten. Zuerst entstand ein Testsystem für numerische Übereinstimmung。

    Grund für die Empfehlung: Der Vergleich von drei Agenten-Workflows zeigt, weshalb numerische Vergleichstests und menschliche Freigaben bei dieser Fortran-Migration zentral waren.