Values by metric family

Each value as the document printed it. Select a value for its source, its checks and its history. Values from other documents are listed after the model’s own, each marked as the first report of that measure or as a restatement.

KeyVerifiedUnverifiedDisputedCorrected read off a figure or stated in wordsA value opens its source and history.

M1 · Evaluation awareness 2 values

M1 Evaluation awareness: values about Gemini 3 Pro
Evaluation and metricValueDocument
From its own documentsGemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025
Evaluation awarenessQualitative observationGemini 3 Pro Frontier Safety Framework Report18 Nov 2025
Situational awareness challengesChallenges solvedGemini 3 Pro Frontier Safety Framework Report18 Nov 2025

M2 · Reward hacking 1 value

M2 Reward hacking: values about Gemini 3 Pro
Evaluation and metricValueDocument
From its own documentsGemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025
Reward hacking examplesQualitative exampleGemini 3 Pro Frontier Safety Framework Report18 Nov 2025

M3 · Sabotage and sandbagging 3 values

M3 Sabotage and sandbagging: values about Gemini 3 Pro
Evaluation and metricValueDocument
From its own documentsGemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025
AI R&D sabotage (external)Ability to sabotage AI R&DRun by Unnamed third-party evaluatorGemini 3 Pro Frontier Safety Framework Report18 Nov 2025
Sandbagging checksEvidence of deliberate underperformanceCondition: all domainsGemini 3 Pro Frontier Safety Framework Report18 Nov 2025
Stealth challengesChallenges solvedGemini 3 Pro Frontier Safety Framework Report18 Nov 2025

M4 · Misalignment audits 2 values

M4 Misalignment audits: values about Gemini 3 Pro
Evaluation and metricValueDocument
From its own documentsGemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025
Frontier Safety Framework determination (misalignment)Instrumental reasoningGemini 3 Pro Frontier Safety Framework Report18 Nov 2025
Strategic deception propensity (external)Qualitative propensity findingRun by Unnamed third-party evaluatorGemini 3 Pro Frontier Safety Framework Report18 Nov 2025

M5 · Honesty and hallucination 1 value

M5 Honesty and hallucination: values about Gemini 3 Pro
Evaluation and metricValueDocument
From its own documentsGemini 3 launch post · 18 Nov 2025
SimpleQA VerifiedAccuracyGemini 3 launch post18 Nov 2025

M7 · Harmful compliance and over-refusal 6 values

M7 Harmful compliance and over-refusal: values about Gemini 3 Pro
Evaluation and metricValueDocument
From its own documentsGemini 3 Pro Model Card · 18 Nov 2025
Child safety launch thresholdsLaunch thresholds metGemini 3 Pro Model Card18 Nov 2025
Image to Text SafetyImage-to-text policy-violation rate deltaCondition: vs Gemini 2.5 ProGemini 3 Pro Model Card18 Nov 2025
Multilingual SafetyMultilingual policy-violation rate deltaCondition: vs Gemini 2.5 ProGemini 3 Pro Model Card18 Nov 2025
Text to Text SafetyPolicy-violation rate deltaCondition: vs Gemini 2.5 ProGemini 3 Pro Model Card18 Nov 2025
ToneObjective tone of refusals deltaCondition: vs Gemini 2.5 ProGemini 3 Pro Model Card18 Nov 2025
Unjustified refusalsUnjustified refusals deltaCondition: vs Gemini 2.5 ProGemini 3 Pro Model Card18 Nov 2025

M8 · Jailbreak robustness 1 value

M8 Jailbreak robustness: values about Gemini 3 Pro
Evaluation and metricValueDocument
From its own documentsGemini 3 Pro Model Card · 18 Nov 2025
Jailbreak vulnerability assessmentStated risk vs prior modelGemini 3 Pro Model Card18 Nov 2025

M10 · Dangerous capabilities and risk determinations 10 values

M10 Dangerous capabilities and risk determinations: values about Gemini 3 Pro
Evaluation and metricValueDocument
From its own documentsGemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025
Cyber key skills benchmarkChallenges solved end-to-endGemini 3 Pro Frontier Safety Framework Report18 Nov 2025
Cyber key skills benchmarkHard challenges solvedGemini 3 Pro Frontier Safety Framework Report18 Nov 2025
Frontier Safety Framework determinationCBRN Uplift Level 1Gemini 3 Pro Frontier Safety Framework Report18 Nov 2025
Frontier Safety Framework determinationCyber Uplift Level 1Gemini 3 Pro Frontier Safety Framework Report18 Nov 2025
Frontier Safety Framework determinationHarmful manipulationGemini 3 Pro Frontier Safety Framework Report18 Nov 2025
Frontier Safety Framework determinationML R&DGemini 3 Pro Frontier Safety Framework Report18 Nov 2025
Harmful manipulation efficacy studyParticipants enrolledGemini 3 Pro Frontier Safety Framework Report18 Nov 2025
From other documents
Harmful manipulation efficacy studyMax odds ratio vs non-AI baselineGemini 3.1 Pro Model Card19 Feb 2026First reportedGemini 3.1 Pro Model Card19 Feb 2026First reported
RE-BenchAverage normalised scoreGemini 3.1 Pro Model Card19 Feb 2026First reportedGemini 3.1 Pro Model Card19 Feb 2026First reported
Manipulative cue rateTurns with manipulative cuesGemini 3.7 Flash Frontier Safety Framework Report13 Aug 2026First reportedGemini 3.7 Flash Frontier Safety Framework Report13 Aug 2026First reported

M12 · Chain-of-thought monitorability 2 values

M12 Chain-of-thought monitorability: values about Gemini 3 Pro
Evaluation and metricValueDocument
From its own documentsGemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025
CoT legibilityComprehensible reasoningGemini 3 Pro Frontier Safety Framework Report18 Nov 2025
CoT legibilityInformative of outputGemini 3 Pro Frontier Safety Framework Report18 Nov 2025

Risk determinations

The developer's formal decisions about Gemini 3 Pro under its framework, as printed. Levels from different frameworks do not map onto one another.

Risk determinations about Gemini 3 Pro
DomainLevel as printedFramework and document
Bio/chemnot_reached code, not the printed wording Frontier Safety Framework Gemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025Frontier Safety Framework Gemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025
Cyberalert_threshold_reached code, not the printed wording Frontier Safety Framework Gemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025Frontier Safety Framework Gemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025
AI R&D / autonomynot_reached code, not the printed wording Frontier Safety Framework Gemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025Frontier Safety Framework Gemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025
Manipulationnot_reached code, not the printed wording Frontier Safety Framework Gemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025Frontier Safety Framework Gemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025
Misalignmentnot_reached code, not the printed wording Frontier Safety Framework Gemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025Frontier Safety Framework Gemini 3 Pro Frontier Safety Framework Report · 18 Nov 2025
Othermet code, not the printed wording Internal launch thresholds Gemini 3 Pro Model Card · 18 Nov 2025Internal launch thresholds Gemini 3 Pro Model Card · 18 Nov 2025

“Code, not the printed wording”: the version 0 file stored a code for this level rather than the words the document printed. The wording will be read again from the source.

Revisions

No recorded revision changes a value about Gemini 3 Pro. The Gemini 3 Pro Model Card has a recorded revision that changes no value about Gemini 3 Pro; see the document's page.