近期,一份声称是谷歌Gemini 4模型基准测试结果的图表在社交媒体上广泛传播。这张图展示了Gemini 4在不同基准测试中的预测分数,其中包括Terminal-Bench Science 0.1(72.8%)、AutomationBench(48.7%)、FrontierMath Tier 4 (v2)(99.1%)、Terminal-Bench 4.0(62.3%)、HealthBench Professional(70.2%)、BenchCAD(98.6%)和ARC-AGI-3(超过99.9%)。根据图表,Gemini 4在所有列出的测试中均超越了OpenAI的GPT-6 Astra和Anthropic的Claude Fable 5.1。如果这些数据属实,那么Gemini 4的表现将不只是一次小的改进,而是在科学推理、数学、端到端应用和智能体工作流等竞争激烈的领域取得显著突破。然而,图表中特别标明了“PREDICTED”(预测值),这暗示这些数据并非正式结果。谷歌也证实,Gemini 4仍在训练中,并声明这是其迄今为止雄心勃勃的预训练计划,但尚未发布相关基准测试的正式数据。一些博主在X平台上指出,这一基准测试结果可能是伪造或由AI生成,并不符合任何经过验证的信息或官方数据。谷歌表示该模型依然处于早期阶段,没有公布具体的分数。目前,围绕Gemini 4的官方信息相对有限。谷歌CEO桑达尔·皮查伊在2026年7月的财报会议上提到,公司已经开始了Gemini 4的预训练,并投入了大量计算资源,称之为“最具雄心的预训练计划”。根据历史发布节奏的推测,Gemini 4可能在2026年11月或12月正式发布,但截至2026年8月底,谷歌的API、Vertex AI及AI Studio中都未出现关于其模型的具体信息或发布日期,相关参数、上下文窗口、价格和基准测试结果尚未揭晓。