Common evidence states
Bind conclusions to the exact system, task, sources, complete denominator, target workflow and date.
SupportedThe exact system meets answer support, completeness, abstention, reliability, subgroup, human-effort, latency and cost thresholds on representative target questions, with a current review date.
ConditionalSupport holds only for named question types, sources, corpus versions, languages, domains, answer forms or operating controls.
MixedRetrieval, support, completeness, refusal, critical errors, repeated-run reliability, latency or cost vary materially across slices.
InsufficientQuestion or source provenance, answer contract, reference process, support checks, complete denominator, target transfer or expiry is missing.
FUURAA analysisThe minimum decision unit for an AI question-answering capability claim is exact system, model, prompt, retrieval and tool version × QA task, question distribution, language, user and answer contract × source provenance, corpus snapshot, permissions, freshness and reference process × access, retrieval, context, reading, reasoning and evidence localisation × answer support, completeness, critical errors, uncertainty and abstention × all questions, failures, variance, human correction, latency and cost × target-workflow boundary and cut-off date. One correct answer is an observation, not transferable proof of capability.