ChatMaestro
v2026.08
PN
priya.n

Results

Terse-prompt study · Pilot-20 · nudge B · Jul 16
20
Enrollees
312
Scored rounds
1.4
Avg self-improve passes
73.9
Composite mean · 0–100
$2.52
Run cost
Scores by quality measure
Measure Mean Per person Median Min–Max Distribution
Groundedness78.277.08041–96
Relevance81.580.98452–98
Coherence74.873.17645–95
Instruction-following88.087.69063–99
Composite73.972.47544–94
Chat memory
32K
Smallest window in set-up
34
Rounds truncated
12
Rounds where enrollee alerted
5
Rewinds · 5.8 turns mean
Final Answer per Session
76.8
Composite mean · final answers
20
Sessions that reached an answer
0.7
Turned-back attempts per round · mean
Refusals
14
Appropriate · relevance N/A
3
Unwarranted · still scored
5.4%
Of 312 scored rounds
Your profile
Settings
Sign out