Zum Inhalt springen

root / tags / tree-sitter

#tree-sitter

3 Fiches

Tools & Plattformen Automatisch geprüfte Übersetzung

Graphify — Knowledge Graphs for AI Coding Assistants (site graphify.net : vitrine, annuaire d'outils et galerie de dépôts graphifiés)

Website **graphify.net**, abgerufen am **6. August 2026**, betrieben von **Safi Shamsi** — dem Schöpfer des Open-Source-Skills graphify (vgl. [[skill-shamsi-graphify-2026-08-06]]). Die Domain umfasst zwei unterschiedliche Objekte. **Das erste ist eine Produktpräsentation**: Vorstellung von graphify, Nutzungsanleitungen, CLI-Referenz und vor allem eine Galerie von **100 bereits „graphifizierten“ trending GitHub-Repositories** — *„100 repos, 854,079 nodes, 1,932,930 edges“* — filterbar nach Sprache und Graphgröße, jeweils mit Vorschau und Detailseite. **Das zweite, und für eine Veillenotiz interessanteste, ist ein redaktionelles Verzeichnis**: *„30 AI coding client guides“*, ein Verzeichnis von MCP-Servern, verglichen nach *„transport, runtime, client support, setup effort, and access risks“*, strukturierte Vergleiche zwischen Werkzeugen (Cursor versus Codex) sowie ein Strom von Artikeln mit erkennbar auf Long-Tail ausgerichteter Zielsetzung (*„GLM-5.2 Knowledge Graph for Developers“*, *„Trae Context Engineering for Agents“*, *„Symphony Knowledge Graph for Agent Memory“*, *„What Is Cowart? A Codex Plugin for Image Editing“*). Die Seite beansprucht eine Methode — *„source-reviewed“*, *„aligned decision fields, official evidence, and explicit unknowns“* — und ist in sechs Sprachen verfügbar. ⚠️ **Der Punkt, dessentwegen diese Notiz existiert**: Die Seite steht **faktisch nicht im Einklang mit dem Produkt, das sie präsentiert**. Sie gibt **„3.7k+ GitHub Stars“** an, während die GitHub-API am selben Tag **103.187** zählt, eine **MIT-Lizenz**, dreimal genannt, während die `LICENSE`-Datei des Repositories **Apache 2.0** lautet, und hebt die Behauptung der **„71.5× token reduction“** hervor, die zur v1-Generation des READMEs gehört und in der aktuellen Version verschwunden ist. **Eine offizielle Seite, die 3,7 % der tatsächlichen Sternezahl zeigt und die Lizenz falsch angibt**, ist an sich schon ein Signal: Die Kommunikationsebene hat mit dem Repository nicht Schritt gehalten.

#graphify.net#AI-Werkzeugverzeichnis#Verzeichnis

**Safi Shamsi** — mainteneur déclaré en pied de page (*« © 2026 Graphify. Built in the open. Maintained by Safi Shamsi »*) · également créateur de la skill graphify et fondateur de **Graphify Labs** (Y Combinator S26). Le site est donc une **propriété officielle du projet** · non un site tiers.

KI-Coding-Agenten & Skills Automatisch geprüfte Übersetzung

graphify — « Turn any codebase, with its docs, SQL schemas, configs, and PDFs, into a queryable knowledge graph. A /graphify skill for Claude Code, Cursor, Codex, and Gemini CLI: local deterministic AST parsing, every edge explained, no vector store. »

**Skill**-Eintrag (kein Artikel): **graphify** von **Safi Shamsi** (Graphify Labs, **Y Combinator S26**) verwandelt ein gesamtes Projekt — Code, Dokumentation, PDFs, Bilder, Videos — in einen **abfragbaren Wissensgraphen**, aufgerufen über `/graphify` aus Claude Code, Cursor, Codex, Gemini CLI, GitHub Copilot und etwa fünfzehn weiteren Clients. Beobachtet am **6. August 2026**: **103.187 Sterne**, **10.024 Forks**, Repository erstellt am **3. April 2026** — eine außergewöhnliche Entwicklung in vier Monaten. **Apache-2.0**, Python 3.10+, Standardbranch **v8**. **Die drei Gestaltungsprinzipien passen in drei Zeilen der README**: *„Code maps for free, fully local"* (Code wird zu einem **tree-sitter-AST** geparst, deterministisch, ohne LLM, **nichts verlässt die Maschine**); *„Every edge is explained"* (jede Kante wird mit **`EXTRACTED`** — explizit in der Quelle — oder **`INFERRED`** — von graphify hergeleitet — markiert, mit einem dritten Wert `AMBIGUOUS`, der im Report erscheint); und *„Not a vector index"* — *„no embeddings, no vector store: a real graph you traverse"*. **Drei Ausgaben**: `graph.html` (interaktiver Graph), `GRAPH_REPORT.md` (God Nodes, überraschende Verbindungen, vorgeschlagene Fragen) und `graph.json` (persistenter Graph, Wochen später abfragbar, ohne die Dateien erneut zu lesen). **Drei Abfragemodi** ersetzen grep: `query` (Subgraph für eine Frage in natürlicher Sprache), `path A B` (kürzester Pfad zwischen zwei Entitäten) und `explain` (Nachbarschaft eines Konzepts). **Abdeckung**: 36 tree-sitter-Grammatiken (~40 Sprachen), außerdem Terraform, Apex, **MCP-Konfigurationen**, Paketmanifeste, Office, Google Workspace, PDFs, Bilder und Video-/Audiotranskription **lokal** via faster-whisper. Communities erkannt via **Leiden**, beschriftet **ohne LLM**. ⭐ **Das interessanteste Benchmark-Ergebnis ist kein Sieg, sondern ein kostenloser**: bei LOCOMO erreicht graphify einen **Recall@10 von 0,497** gegenüber 0,149 für supermemory und 0,048 für mem0, **verliert aber bei der QA-Genauigkeit** (45,3 % gegenüber 49,7 %); bei LongMemEval-S erzielt es **76 %, gleichauf mit einem dense RAG**; und die entscheidende Zeile lautet *„Graph build — LLM credits: 0"*, wo die Branche üblicherweise pro Token abrechnet. ⚠️ **Festzuhaltende Punkte**: Der `main`-Branch führt noch eine README aus der v1-Ära, die ein anderes Produkt beschreibt (nur Claude-Code-Skill, die Behauptung „71,5× weniger Tokens"); das PyPI-Paket heißt **`graphifyy`** mit zwei *y*, bis der Name `graphify` zurückgewonnen wird; und standardmäßig wird ein **Query-Log** unter `~/.cache/graphify-queries.log` geschrieben, das über eine Umgebungsvariable deaktivierbar ist.

#Skill#Wissensgraph#Wissensgraph

**Safi Shamsi** — créateur et mainteneur de graphify · et de **Graphify Labs** · société passée par **Y Combinator (promotion S26)** selon le badge du dépôt. Il maintient aussi le site d'annuaire `graphify.net` (cf. [[graphify-net-annuaire-ia-coding-2026-08-06]]) et publie un livre · *The Memory Layer* · sur les idées et l'architecture derrière le projet.

Qualität & Sicherheit Automatisch geprüfte Übersetzung

Comparing Context Retrieval Approaches for AI Code Review

Empirische Studie des Engineering-Teams von **Compare the Market** (Meerkat Careers, UK) zur Bewertung von vier Ansätzen für **Context Retrieval beim KI-Code-Review**: Baseline (kein zusätzlicher Kontext), **RAG** (Vektorsuche), **GKG** (GitLab Knowledge Graph, AST-basierter Wissensgraph) und **GKG+RAG** (hybrid). Auswertung anhand von **79 realen Merge Requests** mit **MLflow auf Databricks**. Auffälliges Ergebnis: **RAG schneidet schlechter ab als die Baseline** bei fast allen Metriken — Vektor-Rauschen wirkt sich beim Code-Review kontraproduktiv aus. **GKG übertrifft RAG um +21 %** bei der Inline-Comments-Abdeckung (0,696 vs. 0,577) durch strukturelles AST-Verständnis (Tree-sitter + Kuzu-Graphdatenbank). Code erfordert **strukturelles** Verständnis (Aufrufer, Signaturen, Hierarchien), nicht bloße semantische Ähnlichkeit. GKG kostet das 4-Fache der Baseline, liefert aber messbare Verbesserungen; RAG kostet das 3-Fache ohne Verbesserung. Implementiert als **Docker-Sidecar** in CI/CD, der die GKG-Binary (noch in der GitLab-Beta) mit einem lokalen MCP-Server umschließt.

#Compare the Market#Meerkat Careers#KI-Code-Review

Équipe Engineering Compare the Market (Meerkat Careers, UK — site de comparaison d'assurances et services financiers).