Skip to main content
CalibraScene

Raziskovalni prototip · validacija v avtomobilizmu

Od dokazov o nesrečah do sledljivih validacijskih scenarijev.

CalibraScene je z dokazi omejen delovni tok umetne inteligence. Heterogene dokaze o nesrečah pretvori v predstavitve scenarijev in odločitve o pokritosti validacije, ki upoštevajo negotovost.

Manjkajoči dokazi ostanejo vidni. Nasprotja ostanejo izrecna. Odločitev lahko zadrži odprto le negotovost, pomembna za ta cilj; odločilne trditve ohranijo svoj izvor.

Dokazi iz virovStrukturiran scenarijOdločitev o validaciji

Zakaj to obstaja

Prepričljiv odgovor ni isto kot podprt odgovor.

Dokazi o nesrečah so nepopolni. To je normalno — zapisi se kodirajo za druge namene, poročila izpuščajo podrobnosti, nekaterih dejstev pa nihče ni izmeril. Tvegano je tisto, kar sledi: generativni sistem, od katerega zahtevamo popoln scenarij, ga običajno tudi ustvari — vrzeli zapolni z verjetnimi namesto s podprtimi vrednostmi.

Pri načrtovanju validacije to šteje bolj, kot se zdi na prvi pogled. Odločitve o pokritosti so primerjave s pasovi parametrov. Izmišljena vrednost je dovolj natančna, da pade znotraj ali zunaj pasu. Ne dodaja torej le šuma — odločitev lahko prevesi iz »nerazrešeno« v prepričljivo ujemanje ali prepričljivo izključitev. Inženir na drugi strani ne more videti, da odločilne vrednosti v dokazih nikoli ni bilo.

Vsiljena dopolnitev

  • Gibanje nasprotnega udeležencaustavljen
  • Razmerje potiisti pas
  • Hitrost ob trku42 km/h
Odločitev o pokritostiMATCH

Odločeno z vrednostjo brez dokazne podlage.

Navidez popolno. Odločilna vrednost ni bila nikoli opažena.

Omejeno z dokazi

  • Gibanje nasprotnega udeležencaustavljenOBSERVED
  • Razmerje potiisti pasDERIVED
  • Hitrost ob trkuni zabeleženaUNKNOWN
Odločitev o pokritostiUNKNOWN

Ostane odprta, dokler dokaza o hitrosti ne pridobimo ali razrešimo.

Vidno nepopolno. Vrzel je ugotovitev in jo je mogoče obravnavati.

Ponazoritvena primerjava. Sintetične vrednosti, ne rekonstrukcija nesreče.

Kako deluje

Tri stopnje, ena dokazna hrbtenica.

Dokazi vstopijo kot zapisi iz različnih virov in izstopijo kot odločitev o pokritosti validacije. Bistveno je, da nič med potjo ne izgubi svoje epistemske identitete: vrednost, sklepana na drugi stopnji, je še vedno označena kot sklepana, ko na tretji stopnji o čem odloča.

  1. C1: Funkcionalni scenarij

    Heterogeni dokazi o nesrečah, normalizirani v ponavljajočo se strukturo scenarijev.

    Strukturirane nacionalne zbirke o nesrečah obdelujejo izrecni adapterji in ne jezikovni model — sheme so znane, zato bi generativno luščenje dodalo tveganje brez dodane informacije. Zapisi se normalizirajo v skupno taksonomijo, da postanejo scenariji iz različnih virov primerljivi.

    • Adapterji virov
    • Normalizacija
    • Ponavljajoča se struktura
  2. C2: Logični scenarij + SSR

    Omejeno bogatenje v strukturirano predstavitev scenarija.

    Nestrukturirani dokazi — opisi, skice, slike — so mesto, kjer generativno luščenje upraviči svoj obstoj. Predlagani kandidati se sprejmejo kot trditve z vlogo vira in epistemskim stanjem, nikoli kot gola dejstva. Udeleženci, cesta in okolje, dogodki ter domene parametrov nastanejo skupaj z negotovostjo in izvorom.

    • Udeleženci
    • Cesta in okolje
    • Dogodki
    • Domene parametrov
    • Negotovost
    • Izvor
  3. C3: Pokritost validacije

    Preverjanje po dimenzijah glede na verzionirane kataložne omejitve.

    Vsak validacijski cilj vrednoti samo dimenzije, ki jih sam omejuje. Manjkajoči ali nasprotujoči si dokazi v zahtevani dimenziji vrnejo UNKNOWN ali CONFLICT namesto ugibanja; nerazrešeni dokazi zunaj tega cilja ne kontaminirajo odločitve, ločeno podprto nasprotje pa lahko še vedno upraviči EXCLUDED.

    • MATCH
    • EXCLUDED
    • UNKNOWN
    • CONFLICT

Hrbtenica dokazov in izvoraVir, epistemsko stanje in izvor spremljajo vsako trditev skozi vse tri stopnje.

Interaktivni prikaz

Spremenite dokaze. Opazujte odločitev.

Delujoč model odločitvene semantike, ki teče v celoti v vašem brskalniku. Izberite scenarij, dodajte ali umaknite dokaze in opazujte, kako se odzove odločitev o pokritosti. Nič od tega ne zapusti te strani.

Ego vehicle approaches a stationary vehicle in the same lane. Impact speed decides whether the case falls inside the target’s tested band.

Spremenite dokaze

Odločitve o pokritosti

  • Target AMATCH

    Same-lane stationary counterpart, low-speed band.

    Podprto ujemanje. Vsaka odločilna dimenzija je pozitivno podprta z dopustnimi dokazi.

    • Odločilno
    • Counterpart road user
    • Counterpart motion
    • Path relation
    • Impact speed
  • Target BEXCLUDED

    Same-lane stationary counterpart, higher-speed band.

    Podprta izključitev. Podprta vrednost nasprotuje temu cilju. Izključitev stoji na dokazih.

    • Odločilno
    • Impact speed

Od kod sistem to ve?

Izberite parameter za sledenje izvora.

Razrešeni parametri

Register dokazov

  • Counterpart road userpassenger carZgodovinsko opažanjeSme odločatiSource A — structured collision record
  • Ego motiontravelling forwardZgodovinsko opažanjeSme odločatiSource A — structured collision record
  • Counterpart motionstoppedZgodovinsko opažanjeSme odločatiSource A — structured collision record
  • Path relationsame lane, same directionDeterministična izpeljavaSme odločatiDerived from ego and counterpart headings
  • Road contextsingle carriagewayZgodovinsko opažanjeSme odločatiSource B — narrative report
  • Visibilitydaylight, clearZgodovinsko opažanjeSme odločatiSource B — narrative report
  • Impact speed28–34 km/hZgodovinsko opažanjeSme odločatiSource A — recorded impact speed band

Sintetični prikaz. Ponazarja dokazno in odločitveno semantiko sistema CalibraScene; ni rekonstrukcija nesreče, varnostna certifikacija ali empirično merilo natančnosti.

Target A: MATCH. Target B: EXCLUDED

Trenutni dokazi

Kaj sistem dokazljivo počne.

Prototip je uresničen in v aktivnem testiranju. Namesto objave številk, ki bodo ob naslednji zamrznitvi raziskave tako ali tako popravljene, ta razdelek opisuje vedenje, ki drži med izdajami — in jasno pove, kje se dokazi končajo.

  • Regresijsko testiranoIzvedba prototipa

    Delujoč prototip, zavarovan s testi

    Zasebno raziskovalno izvedbo pokrivajo samodejni regresijski, shemski in dokazno-pogodbeni pregledi, zato sprememba, ki poruši dokazno semantiko, pade v testni zbirki in ne šele v predstavitvi. Natančne številke izdaj so verzionirane z vsakim zamrznjenim posnetkom dokazov in bodo tu objavljene po naslednji zamrznitvi.

  • DeterminističnoPonovljivost

    Deterministična pot dokazov

    Deterministične stopnje so zgrajene tako, da iz istih pripetih vhodov in iste konfiguracije vrnejo enake strukturirane izhode in enake odločitve o validaciji. Model, poziv, nabor za iskanje in konfiguracija so verzionirani, zato je rezultat mogoče izslediti nazaj do pogojev, ki so ga ustvarili.

  • Omejeno z dokaziRavnanje z dokazi

    Varna odpoved glede na posamezni cilj

    Manjkajoči, nasprotujoči si ali nedopustni dokazi ne morejo odločiti ciljne dimenzije, ki je od njih odvisna. Negotovost drugje ostane vidna, vendar samodejno ne blokira nepovezanih ciljev; vsak rezultat ohrani omejene dimenzije, ki so bile odločilne ali nerazrešene.

  • UresničenoCelovita integracija

    Pot C1 → C2 → C3 teče od začetka do konca

    Zasebni prototip povezuje obdelavo funkcionalnih scenarijev, predstavitev dokazov na ravni scenarija in deterministično sklepanje o pokritosti validacije v eno pot in ne v tri ločene poskuse. Ta stran opisuje to arhitekturo, ne da bi objavljala zasebne podatkovne nabore ali izvedbeno logiko.

Delo na načinu odpovedi

Ali nepodprta dopolnitev ustvari napačne izključitve?

Namerno majhen zamrznjen poskus preverja, ali politika, ki manjkajočo vrednost zapolni z verjetno privzeto, svojo dodatno popolnost plača s samozavestnimi in napačnimi izključitvami — prav s tisto napako, ki naj bi jo ta projekt preprečil. Zasnovan je kot preizkus izvedljivosti in načina odpovedi, ne kot ocena zmogljivosti.

Delo o načinu odpovedi v takem obsegu ne more podpreti trditve o natančnosti na ravni populacije in tudi ni tako predstavljeno. Številke bodo objavljene, ko jih bo nosila odobrena izdaja dokazov.

Podrobne primerjalne številke so verzionirane z zamrznjenimi raziskovalnimi izdajami. Ta stran poroča o izkazanem vedenju sistema in mejah dokazov, ne pa o začasnih glavnih kazalnikih. Širše trditve o pomenski natančnosti in strokovni validaciji ostajajo namerno neobjavljene, dokler ni na voljo neodvisno presojeno vrednotenje.

Arhitektura dokazov

Kaj je scenarij strukturno.

Strukturirana predstavitev scenarija je artefakt, glede na katerega je opredeljeno vse drugo. Njena oblika nosi jamstva: epistemsko stanje se hrani ločeno od vloge vira, medsebojno odvisni parametri pa ostanejo povezani.

Izberite vozlišče za podrobnosti.

  • Scenario

Viri

Vsak vir je registriran z verzijo in pogoji dostopa. Trditev vedno kaže nazaj na enega od njih.

Stanje in vloga sta ločena

Kako prepričani smo in od kod vrednost izvira, sta dve vprašanji. Ločeno hranjenje omogoča, da se protokolarna vrednost zabeleži, ne da bi postala opažanje.

UNKNOWN je vezan na cilj

Parameter brez dopustne podpore blokira samo cilj, katerega omejitve so od tega parametra odvisne. Nepovezani cilji se vrednotijo iz svojih omejenih dimenzij; ločeno podprto nasprotje lahko še vedno upraviči EXCLUDED.

Nasprotje ostane nasprotje

Nasprotujoči si viri se ne povprečijo, ne razvrstijo po zaupanju in ne razrešijo tiho. Nasprotje je rezultat.

Povezano ostane povezano

Odvisni parametri ostanejo n-terice. Njihovo razpiranje v kartezični produkt bi izumilo kombinacije, ki jih noben primer ne podpira.

Kje je generativna UI

Generativno, kjer pomaga. Deterministično, kjer mora biti.

Arhitektura je namerno hibridna. Strukturirane nacionalne zbirke o nesrečah imajo znane sheme, zato jih obdelujejo izrecni adapterji — izročiti jih jezikovnemu modelu bi dodalo načine odpovedi brez dodane zmožnosti. Generativni in večmodalni modeli se uporabijo tam, kjer so dokazi nestrukturirani in je pomensko branje resnično zahtevno.

Delitev dela je bistvo. Generativni modeli predlagajo; dokazna plast odloči, kaj predlog sme postati. Model, ki bere opis, lahko predlaga pas hitrosti, in ta predlog se sprejme kot omejena trditev, sklepana z modelom. Ne more postati opažanje in se ne more zožiti v vrednost, ki je vir nikoli ni podprl.

  1. Generativno luščenje

    Branje opisov, skic in slik z VLM in podporo iskanja.

  2. Sprejem dokazov

    Preverjanje vloge vira, izvora in logične podprtosti. Nepodprto oženje se zavrne.

  3. Predstavitev scenarija

    Trditve se sestavijo v SSR z ohranjenim stanjem in negotovostjo.

  4. Deterministično sklepanje

    Primerjava s katalogom in odločitve o pokritosti, ponovljive med zagoni.

Dokazne in odločitvene plasti, opisane tukaj, so uresničene v trenutnem prototipu. Širša generativna in večmodalna plast luščenja je ciljna arhitektura faze Advance: opisana je kot namera, ne kot izmerjeno. Ne trdimo, da je produkcijska plast VLM ali iskanja na tej stopnji ovrednotena.

Načrtovalske kontrole

Zgrajeno tako, da je preverljivo.

To so inženirske kontrole in ne načela. Vsaka je lastnost predstavitve — zato vzdržijo pod pritiskom, namesto da bi se zanašale na to, da se model vede lepo.

Uporabna negotovost

Sistem vrne UNKNOWN, kadar ciljno pomembna dimenzija nima dopustne podpore. Manjkajoči dokazi zunaj tega cilja ostanejo vidni, vendar ne razveljavijo sicer podprte odločitve.

Vidno nestrinjanje

Nasprotujoči dokazi ostanejo CONFLICTING. Nič se ne povpreči v lažno soglasje niti tiho ne odloči po zadnjem prebranem viru.

Izvor po konstrukciji

Odločilni parameter ohrani sklic na dokaz ali deterministično pravilo za njim. Sledi se ne rekonstruira naknadno.

Izrecno stanje pregleda

Človeška presoja je predstavljena v zapisu, zato se pregledane in nepregledane trditve nikoli ne zamenjajo.

Ločene vloge virov

Sklep modela, zgodovinsko opažanje, zunanji kontekst, deterministična izpeljava in protokolarne vrednosti ostanejo razločljivi za ves čas zapisa.

CalibraScene uporablja načrtovalske kontrole visoke stopnje zagotovila, primerne za varnostno usmerjeno inženirsko rabo. Končna regulativna uvrstitev je odvisna od predvidene uporabe.

Trenutno stanje

TRL3 · v0.21

Raziskovalni prototip TRL3.

CalibraScene je delujoč raziskovalni prototip, ki uresničuje dokazno pot C1 → C2 → C3: obdelavo funkcionalnih scenarijev, predstavitev dokazov na ravni scenarija in deterministično sklepanje o pokritosti validacije. Zasebni raziskovalni paket je v aktivnem tehničnem in strokovnem pregledu.

Trenutno v ospredju

  • Zunanja tehnična kritika zadostnosti dokazov in semantike kataloga.
  • Trdnejše, neodvisno presojeno vrednotenje.
  • Konsolidacija naslednjega zamrznjenega paketa dokazov.
  • Načrtovanje integracije za fazo Advance.

Ne trdimo

CalibraScene ne trdi homologacije, certifikacije Euro NCAP, pooblastila za rekonstrukcijo nesreč, varnosti v uporabi ali celovitega avtomobilskega varnostnega dokazila. Je podpora odločanju pri pripravi validacije — in je v zgodnji fazi.

Kontekst

AI-BOOST Challenge 4

CalibraScene se pripravlja kot prijava na AI-BOOST Challenge 4: Generative AI for Automatic Test Case Generation from Crash Databases & Standards. Izbor še poteka.

CalibraScene je neodvisen projekt in ni predstavljen kot financiran, podprt ali certificiran s strani AI-BOOST, Siemens ali Euro NCAP.

O projektu

Neodvisen raziskovalni in inženirski projekt.

CalibraScene razvija Tomi Šeregi. Izvedba in arhiv dokazov sta zasebna; ta stran opisuje arhitekturo in semantiko, sistema pa ne objavlja.