热点资讯

网传Gemini 4基准测试泄露,全面领先GPT-6和Fable 5.1,遭质疑为假消息

2026-09-05



最近,一张据称是谷歌Gemini 4模型基准测试结果的图表在社交平台流传。 这张图表列出了Gemini 4在多个基准测试中的预测得分,包括Terminal-Bench Science 0.1(72.8%)、AutomationBench(48.7%)、FrontierMath Tier 4 (v2)(99.1%)、Terminal-Bench 4.0(62.3%)、HealthBench Professional(70.2%)、BenchCAD(98.6%)以及ARC-AGI-3(99.9%以上)。图表显示,Gemini 4在所列出的每一项基准测试中都领先于OpenAI的GPT-6 Astra和Anthropic的Claude Fable 5.1。 根据这份流传的信息,如果这些数据接近准确,Gemini 4将不仅仅是又一次小幅升级,其最大的飞跃出现在科学推理、数学、终端使用和智能体工作流等前沿模型竞争日益激烈的领域。 不过, 这张图表本身标注了一个关键信息:Gemini 4这一列的数据明确标记为“PREDICTED”(预测值)。 谷歌官方已确认Gemini 4的训练正在进行中,并称这是其迄今为止最雄心勃勃的预训练运行,但这些基准测试数据尚未由谷歌官方发布。 针对这张流传的图表,有其他博主在X平台添加了附注,指出 该基准测试图片显示的是针对Gemini 4的伪造或AI生成结果,与任何经过验证的泄露信息、官方数据或当前排行榜均不匹配。据谷歌称,该模型仍处于早期预训练阶段,并未发布此类分数。 目前已知的关于Gemini 4的官方信息仍然有限。谷歌CEO桑达尔·皮查伊在2026年7月的财报电话会议上证实,公司已启动Gemini 4的预训练,并投入了大量算力。他将其描述为谷歌“迄今为止最具雄心的预训练计划”。 基于谷歌以往的发布节奏,有预测认为Gemini 4可能在2026年11月或12月正式亮相。但截至2026年8月底,谷歌的API、Vertex AI或AI Studio中均未出现gemini-4的模型字符串,也没有官方公布的发布日期、参数数量、上下文窗口、价格或基准测试结果。 特别

about image