昊梵体育网

谷歌正式发布Gemini3.8Gemini 3.8 包含两个版本:Gemini

谷歌正式发布Gemini3.8Gemini 3.8 包含两个版本:Gemini 3.8 Flash:高智能通用工作模型(workhorse model)。相比 Gemini 3.7 Flash,它在软件工程、Agent 任务以及专业领域中的关键多步推理能力方面实现了显著提升。该模型采用与 Gemini 3.7 Flash 相同的首发价格:输入 Token:每百万 Token 0.75 美元;输出 Token:每百万 Token 3.75 美元。与此同时,Google 还推出了面向网络安全领域的专用模型 Gemini 3.8 Flash Cyber。该模型被定位为 Google 目前能力最强的网络安全模型之一,重点提升漏洞发现和自动化补丁修复能力,并将通过 Google 推出的 Fairwind Program 向经过认证的安全防御人员开放。Google 表示,两个版本虽然面向不同部署环境,但均基于同一套底层模型能力,并通过长期运行的 Agent 循环机制进一步增强模型表现。谷歌 DeepMind 核心成员姚顺宇表示:对模型而言,这只是迈出了一小步;但对于 RSI(递归自我改进,Recursive Self-Improvement)来说,却是一次巨大的飞跃。Aigora.ai CEO John Ennis 将 Gemini 3.8 Flash 与 Anthropic 的模型进行了比较,称其具备:Opus 5 级别的代码质量,但成本只需一小部分,而且速度非常快。Gemini 3.8 Flash:为长周期代码任务和自主 Agent 打造Gemini 3.8 Flash 相比 Gemini 3.7 Flash 实现了显著提升,在许多任务中,其性能已经接近成本更高的前沿旗舰模型。在 DeepSWE v1.1(长周期软件工程任务)测试中,Gemini 3.8 Flash 能够自主完成复杂工程问题的端到端解决,在性能上超过了大多数参数规模更大的前沿模型,同时成本仅为后者的一小部分。此外,Gemini 3.8 Flash 在专业知识领域中也展现出了支撑关键企业级自主任务所需的可靠性。在需要高级分析和报告能力的定量分析、专业领域任务中,Gemini 3.8 Flash 在 Vals Finance Agent V2 和 Harvey 法律 Agent Benchmark 等测试中均超过了 Gemini 3.7 Flash 以及其他前沿模型。同时,Gemini 3.8 Flash 在 HLE-Verified 测试中取得了 54.9% 的成绩,展现出其处理跨越 STEM(科学、技术、工程、数学)、人文学科以及专业领域的多步骤复杂推理任务的能力。