Values by metric family

Each value as the document printed it. Select a value for its source, its checks and its history. Values from other documents are listed after the model’s own, each marked as the first report of that measure or as a restatement.

KeyVerifiedUnverifiedDisputedCorrected read off a figure or stated in wordsA value opens its source and history.

M5 · Honesty and hallucination 1 value

M5 Honesty and hallucination: values about Grok 4.1
Evaluation and metricValueDocument
From its own documentGrok 4.1 Model Card · 17 Nov 2025
MASKDishonesty rateCondition: reasoningGrok 4.1 Model Card17 Nov 2025

M6 · Sycophancy 2 values

M6 Sycophancy: values about Grok 4.1
Evaluation and metricValueDocument
From its own documentGrok 4.1 Model Card · 17 Nov 2025
SycophancySycophancy rateCondition: non-reasoningGrok 4.1 Model Card17 Nov 2025
SycophancySycophancy rateCondition: reasoningGrok 4.1 Model Card17 Nov 2025

M7 · Harmful compliance and over-refusal 4 values

M7 Harmful compliance and over-refusal: values about Grok 4.1
Evaluation and metricValueDocument
From its own documentGrok 4.1 Model Card · 17 Nov 2025
AgentHarmAnswer rate on harmful agentic tasksCondition: reasoning; no attackGrok 4.1 Model Card17 Nov 2025
RefusalsAnswer rate on should-refuse promptsCondition: non-reasoning; production system promptGrok 4.1 Model Card17 Nov 2025
RefusalsAnswer rate on should-refuse promptsCondition: reasoning; production system promptGrok 4.1 Model Card17 Nov 2025
From other documents
Alignment auditCooperation with misuseCondition: chatGrok 4.20 System Card7 Apr 2026First reportedGrok 4.20 System Card7 Apr 2026First reported

M8 · Jailbreak robustness 2 values

M8 Jailbreak robustness: values about Grok 4.1
Evaluation and metricValueDocument
From its own documentGrok 4.1 Model Card · 17 Nov 2025
JailbreaksAnswer rate on should-refuse promptsCondition: reasoning; user jailbreakGrok 4.1 Model Card17 Nov 2025
Restricted-bio input filterFalse negative rateCondition: with prompt injection attackAbout a system: Grok 4.1 (input filter)Grok 4.1 Model Card17 Nov 2025

M9 · Prompt injection 1 value

M9 Prompt injection: values about Grok 4.1
Evaluation and metricValueDocument
From its own documentGrok 4.1 Model Card · 17 Nov 2025
AgentDojoPrompt-injection attack success rateCondition: reasoning; production system promptGrok 4.1 Model Card17 Nov 2025

M10 · Dangerous capabilities and risk determinations 5 values

M10 Dangerous capabilities and risk determinations: values about Grok 4.1
Evaluation and metricValueDocument
From its own documentGrok 4.1 Model Card · 17 Nov 2025
BioLP-BenchAccuracyCondition: reasoning; without safeguardsGrok 4.1 Model Card17 Nov 2025
CloningScenariosAccuracyCondition: reasoning; without safeguardsGrok 4.1 Model Card17 Nov 2025
CybenchUnguided success rateCondition: reasoning; without safeguardsGrok 4.1 Model Card17 Nov 2025
MakeMeSayPersuasion win rateCondition: reasoningGrok 4.1 Model Card17 Nov 2025
VCTAccuracyCondition: reasoning; without safeguardsGrok 4.1 Model Card17 Nov 2025