Effortvergleich high gegen max: Effort wirkt ueber Delegation
Dieselbe TensorX-Matrix ein zweites Mal bei hoechstem Effort. Zwoelf gueltige Laeufe, 2.116 Anforderungen, 127,6 Mio. Tokens, hochgerechnet $10,53 aus der Preisliste vom 02.09.2026. Befund: In den nicht-delegierenden Zellen bewegt sich der Ertrag zwischen minus 18 und plus 44 Prozent ohne erkennbare Richtung - in der Groessenordnung der Streuung. Der eine deutliche Ausschlag ist GLM in custom mit plus 122 Prozent, erreicht mit 78 statt 30 Subagenten. Der hoehere Denkaufwand schlaegt sich in mehr Zerlegung nieder, und die traegt den Ertrag, nicht der Denkaufwand als solcher. Qwens custom-Zelle hat sich qualitativ erholt: bei high 61 Prozent ohne Beleg und 40 Prozent Hypothesen, bei max 3 Prozent ohne Beleg und 96 Prozent Primaerbeleg. Der Einbruch war ein Laufmerkmal, kein Modellmerkmal - ein weiterer Beleg, dass n gleich 1 je Zelle nicht traegt. Skill 13.2.0: analyse-anforderungen.py toleriert jetzt vier Markdown-Fassungen der Feldvorgabe. Jedes der vier eingesetzten Modelle formatierte sie anders, und jede Fassung wurde zunaechst mit null Anforderungen gezaehlt, obwohl Belege und Pruefideen vollstaendig vorlagen. Das ist ein Befund ueber den Versuchsaufbau: Die Formatvorgabe ist fuer Menschen eindeutig, fuer maschinelle Auswertung nicht. Regressionsprobe an sieben Laeufen unveraendert. _matrix.ps1 nimmt zusaetzlich -Effort und -Modi fuer einzelne Zellen. Ein Lauf fiel durch Standby des Rechners aus und wurde wiederholt. Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
This commit is contained in:
co-authored by
Claude Opus 5
parent
e2c3a0e8f8
commit
08d90f1ccb
@@ -43,16 +43,31 @@ UEBERSCHRIFT_KENNUNG = re.compile(
|
||||
)
|
||||
|
||||
|
||||
# Felder als eingerueckte Listenpunkte, z. B. " - ID: StRS-001" unterhalb eines
|
||||
# Bullets. Beobachtet am 04.09.2026 im Lauf Iteration 9/.../v13.0.0-d345: sieben
|
||||
# Dateien, 323 kB, alle Felder korrekt gefuellt - vom Parser mit 0 gezaehlt.
|
||||
# Bewusst auf die Feldnamen des Prompts beschraenkt: Ein allgemeines Entfernen
|
||||
# der Einrueckung wuerde auch "Begruendung:" innerhalb der Belegliste treffen.
|
||||
FELDNAMEN = (
|
||||
'ID|Titel|Ebene|Typ|Qualitätsmerkmal|Qualitaetsmerkmal|Akteur|Vorbedingung|'
|
||||
'Fakt|Aussage|Ergebnis|Belege|Prüfidee|Pruefidee|Tracelinks|Konsolidierung|'
|
||||
'Übernahmewürdigkeit|Uebernahmewuerdigkeit|Status'
|
||||
)
|
||||
EINGERUECKTES_FELD = re.compile(r'(?m)^[ \t]+(?:[-*+][ \t]+)?(?=(?:\*\*)?(?:%s)[:\*])' % FELDNAMEN)
|
||||
|
||||
|
||||
def normalisiere(text):
|
||||
"""Markdown-Auszeichnung der Feldnamen auf die Klartextform zuruecknehmen.
|
||||
|
||||
Modelle setzen die Feldvorgabe des Prompts haeufig als Markdown - fett
|
||||
(``**ID:**``), als Ueberschrift (``### ID:``) oder ganz ohne Feldnamen
|
||||
(``### StRS-001``). Inhaltlich ist der Block dann regelkonform; ohne
|
||||
Normalisierung bleibt er unerkannt.
|
||||
(``**ID:**``), als Ueberschrift (``### ID:``), ganz ohne Feldnamen
|
||||
(``### StRS-001``) oder als eingerueckte Liste (`` - ID: StRS-001``).
|
||||
Inhaltlich ist der Block dann regelkonform; ohne Normalisierung bleibt er
|
||||
unerkannt.
|
||||
"""
|
||||
text = UEBERSCHRIFT_KENNUNG.sub(lambda m: 'ID: ' + m.group(1), text)
|
||||
text = UEBERSCHRIFT_FELD.sub('', text)
|
||||
text = EINGERUECKTES_FELD.sub('', text)
|
||||
return FETTES_FELD.sub(lambda m: m.group(1) + ': ', text)
|
||||
|
||||
|
||||
|
||||
Reference in New Issue
Block a user