3 Punkte von shbinx 6 시간 전 | Noch keine Kommentare. | Auf WhatsApp teilen

Ein persönliches Projekt, das Karpathys LLM-Wiki-Pattern (https://gist.github.com/karpathy/442a6bf555914893e9891c11519de94f) auf das Tracking von KI-Trends anwendet. Tägliche Zusammenfassungen sind am nächsten Tag schon verflogen, Trends werden aber erst in kumulierten Daten sichtbar — deshalb habe ich es nicht als Newsletter gebaut, sondern so, dass ein Wiki wächst.

Wie es läuft

  • Jeden Morgen sammelt ein Agent Inhalte von arXiv, HuggingFace Daily Papers, offiziellen Blogs verschiedener Labs, X, chinesischen Labs (DeepSeek, Qwen, Moonshot, Z.ai, MiniMax in Rotation) und dem US Federal Register
  • Die Original-Snapshots werden unveränderlich gespeichert, und Seiten zu Organisationen/Modellen/Konzepten/Papers werden erstellt bzw. aktualisiert (für jede Tatsache wird eine Quellenangabe erzwungen)
  • Mechanisches Feed-Polling übernimmt GitHub Actions stündlich; das LLM kümmert sich nur um Bewertung und Schreiben (Übergabe über eine candidates-Datei)
  • Sonntags laufen separat eine wöchentliche Synthese und ein Lint zur Konsistenz des Wikis

Aktueller Umfang (26.07.2026)

  • 107 Wiki-Seiten / 371 gegenseitige Links — die Startseite ist dieser Link-Graph. Alle Nodes sind echte Seitenlinks, und wenn man mit der Maus über einen Node fährt, werden nur die Seiten hervorgehoben, die diese Seite zitiert hat
  • 51 Einträge in der Timeline für Modell-Releases (mit Unterscheidung zwischen veröffentlichtem und angekündigtem Status)
  • 10 Wochenberichte, 56 tägliche Briefings
  • Seit dem Start am 16.05.2026 seit 72 Tagen unbeaufsichtigt in Betrieb

Ein paar Dinge, die ich beim Bauen gelernt habe

  • Beim Polling von Quellen per Suche lag die Erfassung im Median 6 Tage zu spät. Nach der Umstellung auf direktes RSS-Polling und der Aufnahme chinesischer Labs in die Rotation sank das auf +1 bis +4 Tage (vorher gab es auch Fälle mit +27 bis +46 Tagen Verspätung)
  • Es gab 5 Feeds, die HTTP 200 zurückgaben, tatsächlich aber tot waren (2018 stehen gebliebene Stubs, Soft-404 usw.). Wenn man nicht sowohl die Anzahl der Einträge als auch das neueste Datum misst, kann man „tote Quelle“ und „ruhige Woche“ nicht unterscheiden
  • Betriebslogs der Pipeline (Badges zur Erfassungsverzögerung, Ranking-Scores, Dedup-Listen) waren unverändert auf der Leseroberfläche sichtbar. Ich habe Betreiberprotokolle und Leseransicht getrennt
  • Wenn in der Tabelle mit Modellspezifikationen ein Wert fehlte, wird die Zeile nun nicht mehr gelöscht, sondern als unknown stehen gelassen. Fehlende Zeilen sieht man nicht, unknown lässt sich aber zählen, sodass der wöchentliche Lint die Abdeckung verfolgt

Es gibt auch RSS und ein E-Mail-Abo (Double-Opt-in). Feedback ist willkommen — besonders dazu, welche Informationen noch sichtbarer sein sollten.

Noch keine Kommentare.

Noch keine Kommentare.