Freigegeben
Eine benannte Software- oder Artefaktversion mit einem öffentlichen Quell- und Vertriebsdatensatz.
Forschungsbuch / Überprüft im September 2026
Lesen Sie Veröffentlichungen, überprüfen Sie die zugrunde liegenden Protokolle und unterscheiden Sie gelieferte Funktionen von gemessenen Ergebnissen und noch kommenden Experimenten.
Eine benannte Software- oder Artefaktversion mit einem öffentlichen Quell- und Vertriebsdatensatz.
Eine Beobachtung unter einem festgelegten Protokoll und einer bestimmten Umgebung; Umfassendere Schlussfolgerungen erfordern mehr Beweise.
Eine Frage oder ein Protokoll für zukünftige Arbeiten. Es handelt sich nicht um ein durchgeführtes Experiment oder eine nachgewiesene Fähigkeit.
Die Version erweitert die begrenzte SQL-Analyse, bedingte Schlüsselraumoperationen sowie die lexikalische und hybride Suche. Die vollständigen Crate-Graph- und Plattform-Archive verfügen über öffentliche Veröffentlichungsbelege. Agent Memory wendet das gemeinsam genutzte Datensubstrat auf nützlichen Kontext über Codierungstools hinweg an.
Der Bericht zur dedizierten Hardware 3 vom September zeichnet SQL-, Keyspace-, Such- und Commit-Workloads auf einem AWS i7i.metal-24xl auf. Die Ergebnisse gehören zur dokumentierten Quelle, Hardware und Arbeitslast; Sie begründen keinen universellen Leistungsvorteil.
Das formale Modell von Hyphae prüft die Eigenschaften Atomizität, Haltbarkeit, Konfliktbehandlung und Wiederherstellung im gesamten modellierten Zustandsraum. Die Spezifikations-, Konfigurations- und Nachweisbelege sind öffentlich.
Dies ist ein Beweis für ein abstraktes Protokollmodell. Es handelt sich nicht um einen formalen Beweis für die Rust-Implementierung oder für jeden Fehler in der realen Welt.
Hytorch zeichnet versuchte interne Schreibvorgänge während des Trainings auf und stellt ihnen dauerhafte Empfangsbestätigungen und eine CPU-Wiedergabereferenz zur Verfügung. Der Vorabdruck präsentiert Instrumentierung, Verifizierung und den beobachteten Zusammenbruch eines Trainingskanals trotz Verbesserung der konventionellen Telemetrie.
Die getestete Architektur ist kostspielig und führt nicht zu einer besseren Qualität des Sprachmodells. Eine Schlagzeilenverbesserung kehrte sich bei einem vorab registrierten Vergleich um; Ein späterer Gradientendefekt schränkt auch das berichtete Kapazitätsexperiment ein. Die korrigierte Kapazitätswiederholung steht noch aus.
V5 hat 2,190-Batches abgeschlossen. Kein Kandidat erfüllte jedes vorab registrierte Vergleichskriterium: no-control-match. Der Bericht veröffentlicht Unterschiede zwischen Fakten und Positionen, reduzierte Tabellen und eine reproduzierbare Auswahl.
V6 spezifiziert experimentelle Arme 17, ohne dass ein Training durchgeführt wird. Der Bericht belegt nicht, dass der Kanaltod während des Lernens Halluzinationen verursacht. Die im September erschienene englische Ausgabe 13 verwendet die gleichen wissenschaftlichen Erkenntnisse wie die spanische Ausgabe.
Die spätere Transformer-Arbeit trainiert kleine Controller über ein eingefrorenes Backbone und veröffentlicht deterministische Steuerungs- und Navigationspakete. Das kalibrierte Navigationspaket v2 zeichnet eine begrenzte zweistufige Auswertung auf.
Diese Ergebnisse gehören zu den veröffentlichten Spielplänen, Zertifikaten und Toren. Sie demonstrieren keinen uneingeschränkten autonomen Agenten oder allgemeine Modellqualität; Fehlgeschlagene externe Schattenversuche bleiben im Forschungsprotokoll erhalten.
Das 13-Protokoll vom August führte 33 Millionen gemessene Beobachtungen über 33 Oberflächen-/Parallelitätszellen in der benannten DigitalOcean C-60-Umgebung durch. Außerdem wurden die Wiederherstellung von 3 Millionen logischen Commits und der ANN-Rückruf@10 von 1.0 in jeder gemessenen Zelle aufgezeichnet.
Dies unterstützt begrenzte Abrechnung, Korrektheit, Rückruf, Parallelität und Wiederherstellung in dieser VM. Dedizierte Hardwaremessungen sind eine separate, spätere Aufzeichnung.
Über acht gepaarte Samen hinweg verbesserte rezero_rms_shared die endgültige Validierung NLL um 2.33% im Vergleich zu pre_rms, mit einem 95%-Intervall von [1.59%, 3.06%]. Das Ergebnis überschritt die vorab registrierte praktische Schwelle der Kampagne 1%.
Der Anspruch ist spezifisch für das Modell, den Korpus, das Budget, die Seeds und das Protokoll. Es begründet keine universelle Überlegenheit einer Reststrategie.
Frühere Tiefenkampagnen und das anfängliche 30M-Ergebnis mit drei Startwerten haben ihre vorregistrierten primären Schwellenwerte nicht erreicht. Sekundäre Beobachtungen zur Trainingsgeschwindigkeit ändern nichts an diesen primären Urteilen. Auch eine aufgezeichnete Cloud-Budgetüberschreitung bleibt Teil der Protokollhistorie.
Die Laufzeit 0.3.2, die unter dem Tag v0.3.3 vertrieben wird, behält das gemessene NEON DOTPROD-Verhalten bei und behandelt ihren gepackten SVE2-Kernel als experimentell. Der aktuelle ARM-Code verwendet gepackte Q1-Panels. Frühere expand-to-int8-Messungen beschreiben ein historisches Layout.
Vorfüllung und Dekodierung werden separat gemeldet. Eine Steigerung in einer Phase, einem Modell oder einer Thread-Anzahl stellt keine allgemeine Laufzeitbeschleunigung dar.
Nicht schlüssige Experimente, korrigierte Behauptungen, abgelehnte Optimierungen und Protokollfehler helfen bei der Bestimmung der nächsten nützlichen Frage. Wir behalten ihren ursprünglichen Umfang und ihre Quellen bei.
Veröffentlichte Hytorch-Tabellen unterstützen die Neuerstellung von Aggregaten und die Auswahl. Der Bericht verteilt nicht jedes rohe historische Artefakt, jeden Kontrollpunkt oder jedes Hauptbuch neu; Die Tabellenüberprüfung ist keine neuronale Wiedergabe.
Der Beweis muss den darüber geschriebenen Satz überdauern.