Zum Inhalt springen
5. Okt.Mo
  1. GitHub Blog · AI & ML59

    ReviewBench: Ein offener Benchmark für KI-Code-Reviews

    GitHub stellt mit ReviewBench einen offenen Benchmark zur Bewertung von KI-Code-Review-Agenten bereit. Der Datensatz umfasst 219 Pull Requests aus 187 öffentlichen Repositories und 19 Sprachen; seine Verteilung orientiert sich an 103.9 Millionen GitHub-Pull-Requests. Senior Engineers stimmten bei der unabhängigen Prüfung der Befunde zu 96.6% mit ReviewBench überein.

2. Okt.Fr
26. Sept.Sa
25. Sept.Fr
24. Sept.Do
19. Sept.Sa
18. Sept.Fr
17. Sept.Do
  1. GitHub Blog · AI & ML74

    GitHub migriert die Copilot-Laufzeit mit Copilot von TypeScript nach Rust

    GitHub hat die Copilot-Agentenlaufzeit mithilfe der Copilot-App und der CLI von TypeScript nach Rust migriert. Laut dem beteiligten Entwickler schrieben AI-Agenten den Grossteil der mehr als 800,000 Zeilen produktiven Rust-Codes; die Änderungen wurden über 128 Pull Requests schrittweise integriert. Die neue Laufzeit kann über eine C-ABI auch direkt in Anwendungen der sechs Copilot-SDK-Sprachen eingebettet werden; dieser Betriebsmodus ist derzeit optional.

    Grund für die Empfehlung: Die schrittweise Migration zeigt, wie sich umfangreiche Änderungen bei laufender Entwicklung mit Tests und gestaffelten Releases absichern lassen.