header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
Scan to Download the APP

Google 重回第一梯队:Gemini 4 Argon 追平 GPT-6 Astra 在人工智能领域,竞争从未停歇。近日,Google 发布了其最新一代大语言模型 Gemini 4 Argon,据多方评测显示,该模型在多项核心基准测试中已追平 OpenAI 的 GPT-6 Astra,标志着 Google 重返 AI 第一梯队。 ## 性能表现 Gemini 4 Argon 在推理、代码生成、多模态理解等关键任务上展现出显著提升。与上一代 Gemini 3 相比,Argon 版本在复杂逻辑推理测试中的准确率提升了约 18%,在代码生成任务中的通过率也大幅提高。 ## 技术亮点 - **混合专家架构优化**:Gemini 4 Argon 采用了更高效的 MoE 架构,在保持推理速度的同时大幅增加了有效参数量。 - **多模态融合**:原生支持文本、图像、音频和视频的统一理解与生成。 - **长上下文窗口**:支持超过 200 万 token 的上下文长度,在长文档理解和多轮对话中表现优异。 ## 与 GPT-6 Astra 的对比 | 基准测试 | Gemini 4 Ar

动察 Beating AI 快讯,Artificial Analysis 完成 Gemini 4 Argon 第三方评测。在最高推理档位下,Argon 的 Intelligence Index 得到 53 分,追平 GPT-6 Astra,比 GPT-6.1 Sol 高 1 分。相比 Google 上一款非 Flash 模型 Gemini 3.1 Pro Preview,分数提高了 23 分。


按目前 API 首发半价计算,Argon 每个 Intelligence Index 任务平均花费 1.99 美元,只有 GPT-6 Astra 的约 60%。但它并没有少生成内容,平均每个任务输出约 6.2 万 tokens,Astra 只有 2.7 万。优惠结束后,Argon 单任务成本预计升至 3.98 美元,反而约为 Astra 的 1.2 倍。


Argon 一个比较突出的变化是更少瞎猜。在 AA-Omniscience 中,它的幻觉率只有 15%,是 Intelligence Index 得分 45 以上模型中最低的。GPT-6 Astra 和 GPT-6.1 Sol 分别为 51% 和 54%。不过 Argon 的答案准确率只有 50%,低于 Astra 的 63%。

举报 Correction/Report
Correction/Report
Submit
Add Library
Visible to myself only
Public
Save
Choose Library
Add Library
Cancel
Finish