Bruket/Lavett
FORSKNING · KÖRBAR IDAG
ETT BRUKET-FORSKNINGSPROJEKT

Lavett

Minne med riktning.
En semantisk kompilator för språkmodellminne.

Lavett förvandlar en rörig hög av anteckningar, chattar och loggar till ett typat, bevisförankrat minne — och kompilerar sedan den minimala beviskedjan som ett svar behöver, i stället för att dumpa rå historik i prompten.

BYGGD FÖR
De som tror att bättre AI kräver bättre minne, inte bara större modeller.
FIG.01 — MINNESVÄG65 tokens
fråga
”Vad bör eleven öva på härnäst?”
ROLLelev → utelämnat → artikel
KONCEPTengelsk artikelanvändning · gravitation ↑
BEVISsession_03.md:L42 ✓ aktuell
SVAR
Öva på engelsk artikelanvändning — att sätta in ”the” före specifika singulara substantiv som ”store”.
✓ citerar sina källor · 0.0 läckage mellan scope
PROBLEMET

Mot platt kontext.

Ett större kontextfönster skapar inte strukturerat minne. Det skjuter upp samma problem till en högre tokenkostnad. De flesta AI-minnen beter sig fortfarande som en hög — tidigare meddelanden, sammanfattningar eller hämtade textbitar.

Ett återkommande misstag, en korrigerad övertygelse, ett skiftande mål och en stabil preferens bör inte alla leva som likvärdiga textstycken. De behöver struktur, scope, bevis och en livscykel.

—Rå kontext är dyr och växer utan gräns.
—Sammanfattningar sparar plats men tappar tyst detaljer.
—Vektorsökning hittar liknande textbitar men missar relationer.
—Gamla och nya fakta lämnas att tyst motsäga varandra.
—Modeller har svårt att hålla reda på vad som förändrats över tid.
VAD ”LAVETT” BETYDER

En stödstruktur för resonemang.

En lavett är vagnen under kanonen: strukturen som bär, stabiliserar och riktar den. Pipan avfyrar; lavetten avgör vart den pekar. Basmodellen förblir språkets motor — Lavett bygger stödlagret runt den, så att samma modell resonerar utifrån bättre riktad indata.

UTAN LAVETT
frågarå kontextmodell
MED LAVETT
frågarollgrafminnesvägarkompilerad beviskedjamodell
VAD DET ÄR IDAG

En motor, och tre ytor ovanpå den.

En local-first, bevisförankrad minnesmotor — Python, Apache-2.0, offline som standard. Varje lagrat faktum pekar tillbaka till en exakt source_file:Lline, och en kontextkompilator väljer bara de bevis en fråga behöver och renderar dem, med källhänvisning. Tre ytor sitter på motorn.

Nuläge

En offline, skrivskyddad vy av projektets minne: nuläge, vad som ändrats, öppna frågor, uteslutet / ersatt — var och en hänvisad till sin rad. Medvetet ingen chattbot.

Strukturatomer

Ett grep-säkert ID över ett exakt råspann som avkodas till tripplar, livscykelstatus och en integritetshash — och tillbaka till den exakta källan. Råtext muteras aldrig.

Överklaganden

Den första produktvertikalen: ett brittiskt PIP-avslag plus den sökandes bevis, sammanställt till ett källhänvisat granskningspaket för rådgivare — vilka kriterier bevisen stöder, var beslutet motsäger dem, och de ärliga luckorna. Beslutsstöd, inte juridisk rådgivning; det medföljande fallet är fiktivt.

MODELLEN FÖRESLÅR, DEN LÄSBARA VERIFIERAREN AVGÖR

En deterministisk verifierare äger förankring och avvisning. En ogenomskinlig LLM är valfri, grindad, avstängd som standard, och dess förslag godtas bara när verifieraren kan bekräfta dem mot ett ordagrant källcitat. I vertikalen Överklaganden avvisade verifieraren 393/393 systematiska och 4,800/4,800 randomiserat-fuzzade antagonistiska förslag utan ett enda ogrundat godkännande; där det läsbara lagret inte återhämtade något på vardaglig parafras (0.0) lyfte en enda kostnadstakad modellkörning (~$0.017) det till 1.0 genom samma verifierare.

Det här är resultat från antagonistiska set och en syntetisk korpus — angreppstäckning och integrationsträffsäkerhet, inte ett påstående om verklighetsnära noggrannhet. Lovande, inte bevis än.
BEVISEN

Beslutskvalitet, och återskapbart med ett enda kommando.

En deterministisk strängbedömare är sanningskällan — ingen LLM betygsätter sig själv. Huvudsviten på 33 fall, temperatur-0, helt offline. Varje siffra nedan motsvarar en rad i repositoryts bevislogg med ett exakt återskapningskommando.

LÄGESVARSTÄCKNINGKRÄVT BEVISBEVISPRECISIONKONTEXT-TOKENS
rå kontext0.4701.0000.274137
BM25 · tokenmatchad0.2930.4770.52859
Lavett · lavett_tight1.0001.0000.88765
Även verifierat: antagonistiskt aktuellt-mot-inaktuellt (14) rå 0.071 → Lavett 1.000 vid precision 0.905; blandad arbetsyta (9) rå 0.333 i 691 tokens → Lavett 0.963 i 78.
0.000
Bevisläckage mellan projekt
varje benchmark + blind parafras
2.1×
Mindre kontext än rå
upp till 8,85× på brusiga blandade korpusar
1.0 / 0.48
Täckning av krävda bevis vs BM25
tokenmatchad rättvis baslinje

Och på verkliga, fasta modeller.

Live-svarsträffsäkerhet på två modellfamiljer, deterministisk delsträngsbedömare, ~65 mot ~137 tokens. Lavett slår en rättvis BM25-hämtare i varje körning; mot full rå kontext vinner det för en familj och förlorar ärligt för den andra. Total livekostnad över båda körningarna: ~$0.24.

MODELL (33 fall)RÅBM25LAVETTvs RÅvs BM25
google/gemini-2.5-flash-lite0.6770.4750.732+0.055+0.257
z-ai/glm-5.20.7470.5000.687−0.064+0.187
$ make proof — spelar upp varje offline-siffra ovan, ingen API-nyckel, inget nätverk.
ARKITEKTUREN

NodeWeb: språk som sammankopplad betydelse.

Ingen närmaste-granne-klump. Typade betydelsehändelser, korrigeringsbanor, livscykeltillstånd, scope och en bevisförankrad RoleGraph — dirigerade genom explicita minnesvägar. Varje delsystem ablateras oberoende i benchmarken, så dess vikt mäts, inte påstås.

Betydelsehändelsegraf

Språk bryts ner i strukturerade händelser: subjekt, handling, objekt, tid, attribut och bevis.

elev → utelämnat → artikel ("the")

Konceptgravitation

Återkommande eller viktiga koncept får tyngd över tid, så att hämtningen lyfter fram det som faktiskt betyder något.

koncept återkommer → gravitation ↑

Sanningslivscykel

Fakta kan vara aktuella, osäkra, motsagda, korrigerade eller ersatta — och övergången förblir granskbar.

övertygelse → korrigerad → ersatt

Flervägshämtning

Vägar söker minnet på olika sätt — entiteter, tidslinjer, korrigeringar, bevis — körda parallellt och tävlande.

route(roles) ∥ route(evidence)

Korrigeringsbanor

Följer ett misstags båge i stället för en enda ögonblicksbild: misstag → korrigering → återfall → förbättring.

misstag → korrigerat → återkommer

Kontextkompilator

Kompilerar en uppgiftsspecifik briefing uppdelad i beviskontext, bakgrund och vad den valde bort — inte råa textbitar.

textbitar ✗ → beviskedja ✓

Scope-bundet minne

Minnet avgränsas per arbetsyta, så att ett programmeringssvar aldrig förorenas av orelaterade lektionsanteckningar.

svar ⊂ dominant arbetsyta

Förklarbara minnesvägar

Varje svar kan visa minnesvägen bakom sig — rollerna, händelserna och bevisen det faktiskt använde (lavett ask --explain).

svar ⟵ väg ⟵ bevis
DEN ÄRLIGA HALVAN

Jag publicerar anti-resultaten.

Rubriksiffran 1.0 / 0.887 är in-sample och delvis intrimmad mot frågans formulering. Under blind parafras generaliserar den strukturella syntetiseraren fortfarande — svarsträffsäkerhet 0.833 på osedda formuleringar, isolering och komprimering intakta — men en hämtningssidig parafrasskatt kvarstår (krävt-bevis ~0.88–0.91, precision ~0.47–0.55) och hävdas inte. Varje fall där rå kontext eller BM25 slår Lavett (7 respektive upp till 5 fall) bevaras i bevisloggen. Hela testsviten kör 590 godkända, 2 xfailade. Det är det som gör resten trovärdigt.

Konfidensnivåer: beslutskvalitet / vägledande / utforskandeAnti-resultat bevarade i loggenByte-deterministisk, offline-uppspelningIngen LLM betygsätter sig självParafrasskatt: öppen, ohävdad
EN BEGRÄNSNING, INTE EN FUNKTION

Läsbarhet är inte valfritt.

Inget som Lavett lagrar, dirigerar eller sänder ut får finnas utan en deterministisk avkodare tillbaka till trogen människoläsbar text. En representation utan en registrerad avkodare avvisas vid skrivtillfället.

INGEN REPRESENTATION UTAN ÖVERSÄTTNING
Effektivitet köper aldrig dold kognition.
EN STEGVIS PLAN · BEVIS FÖRE HYPE

Vägen härifrån.

NU✔ NU
Bevisförankrad motor

typat minne, källhänvisade beviskedjor, offline-benchmarksvit

NU✔ NU
Första vertikalen: Överklaganden

bidragsavslag → källhänvisat bevispaket för rådgivargranskning

NÄSTAFRAMÅT
Rådgivarvalidering

paket framför 5–10 rådgivare / handläggare

SEDANFRAMÅT
Jurisdiktionsutvidgning

Brittiska PIP vs svenska Försäkringskassan — ett korpusbyte, inte en omskrivning

SENAREFRAMÅT
Minnesnativ modell

månskottet — tränas uttryckligen inte nu

AKTUELL STATUS

Tidigt, med ett verkligt, växande försprång.

NodeWeb körs idag som en Python-forskningsprototyp — en CLI-först-motor med SQLite-lagring, heuristisk extraktion, flervägshämtning, bevismedveten kontextkompilering, ablationsuppbackad utvärdering och 31 registrerade frontlinjediagnostiker. Apache-2.0, offline som standard.

lavett ingestlavett asklavett ask --explainlavett compile-contextlavett evalmake proof
INTE ÄN
×inte en grundmodell
×inte en offentlig chattbot
×inte en universell benchmarkvinnare — rå vinner fortfarande vissa fall
×inte en färdig produkt
×inte ett påstående om modellintern arkitektur

Minne borde ha form.

Språkmodeller behöver mer än längre kontext. De behöver minne med struktur, bevis och riktning — och en representation en människa fortfarande kan läsa. NodeWeb är det första försöket att bygga det.