欢迎回来
登录你的知识库账户
忘记密码?
还没有账户?立即注册
创建账户
注册你的专属知识库
已有账户?去登录
找回密码
输入注册邮箱获取验证码
返回登录
请输入图片中的验证码以继续注册
加载中...
取消
新建收藏
手动添加你喜欢的内容
取消
编辑头像与昵称
上传新头像或修改你的显示昵称
支持 JPG/PNG,最大 2MB
取消

问题反馈

notebasewww.notebase.cn
控制台
内容库
动态
管理
账户
U
用户
--
在线
v0.8.7 · 知识库
笔记
KnowledgeBase
网络无边,知识有迹。
0笔记
0工具
30推荐

分类导航

按主题直达

编辑精选

站内用户贡献 · 真实笔记

最新收录

每日更新
继续浏览全部内容 →
>
笔记
0
加载中...
工具
0
此页用于记录用户反馈问题后的每一次改进
笔记用法

“写笔记”支持四种格式——Word 文档、Excel 表格、Markdown、纯文本,起稿或二次编辑时都能随时切换,同一篇笔记想用哪种形态来记,都由你说了算。

md、txt、csv、json 这类纯文本则原样载入,不做多余加工。拿一张现成的表倒进来、改几笔、再导出去,等于白用一台免费的格式转换器。

要带走就在右上角点“下载”,可导出 PDF、Word、Markdown、Excel、TXT 等格式;列表卡片“⋯”菜单里,也有同样的下载入口。

工具用法

在“工具”页点“+ 上传工具”即可发布:填好名称与链接,再用 Markdown 把使用方法写清楚——能解决什么问题、怎么装、怎么用,比堆介绍实在。

要分发安装包就一并上传压缩包(ZIP、RAR、7Z、TAR.GZ,最大 35MB),别人在详情页一键下载;只放链接不带附件也可以。

工具按大家的收藏热度排序,好用的自然会被顶上来。发布后可在详情页或卡片菜单里编辑、下架。

隐藏笔记

写笔记时勾上“隐藏”,这篇就只存在于你自己的账号里:不进列表、不进搜索、不上首页精选,也不会出现在任何公开的页面,链接发给别人同样打不开。

适合放密码、草稿、日记这类只给自己看的内容;想公开,去“发布”打开它,把“隐藏”的勾去掉再保存,之后编辑会默认保持原状态,不会悄悄变回公开。

数据安全

你的内容会同时保存在多个副本上,系统定期做备份与完整性校验,再配合异地容灾机制:就算某台机器出问题,数据也不会丢,可以长期放心存放;特别重要的资料,仍建议你另外再留一份备份。

技术

全站跑在容器化、模块化的现代架构上,更新、部署、回滚都很快,扩展性和稳定性都按长期运营的标准来设计(Built for reliability, designed to scale)。

理念

这个网站最早只是一个人的笔记仓库,后来慢慢长成现在的知识中枢。设计上很克制——没有广告、没有追踪、没有推荐算法,只是干干净净地存放一些东西;既然做好了,就公开出来,万一有人用得上呢。

原则

不做大而全,不做平台梦,保持简单、保持克制、保持好奇。所有内容都由用户贡献、由用户维护:不会突然冒出付费墙,不会在角落塞广告位,也不会把你的数据卖给第三方。

更多

产品会持续迭代,站内日志页记录着每一次改动,改了什么都有迹可循;想了解这个站是怎么一步步走到今天的,翻翻日志就能看到来龙去脉。

举报

如果在这里看到涉嫌违规的内容,点对应卡片右侧的“举报”按钮就能提交,我们会尽快核实处理;也谢谢你花一点时间,一起把这里维护干净。

趋势
// 点击导航加载发现
归档
// 归档为空
最近浏览
// 暂无浏览记录
发布
// 加载中...
用户发布
// 加载中...
用户管理
// 加载中...
访问统计
// 加载中...
内容审核
// 加载中...
个人信息
// 加载中...
返回首页

Quasar 438B:欧洲最强AI模型的性能深度解析

1970/1/1人工智能

欧洲AI新旗舰Quasar 438B以43分登顶欧洲模型智能指数,速度与长上下文能力接近前沿梯队。

Multiverse Computing 近期发布了其旗舰推理模型 Quasar 438B,定位为企业级智能体(agent)和编程任务设计。这是该公司首次推出大规模语言模型,支持英语和西班牙语,并在 Artificial Analysis 的智能指数 v4.1.1 上取得 43 分,成为该榜单上得分最高的欧洲模型。这一成绩使其超越了 Mistral Medium 3.5(30分)、NVIDIA Nemotron 3 Ultra(38分)和 Inkling(42分),但仍落后于当前领先的 Claude Opus 5(63分)。

智能指数(Intelligence Index)是什么?

Artificial Analysis 的智能指数 v4.1.1 是一个复合评分,整合了 9 项不同的评估基准,包括:

  • GDPval-AA v2:评估通用指令遵循能力
  • τ³-Banking:金融领域任务
  • Terminal-Bench v2.1:在真实终端环境中测试智能体能力
  • SciCode:科学计算与编码
  • Humanity's Last Exam:人类终极考试,考察知识的广度与推理深度
  • GPQA Diamond:研究生水平的物理、化学、生物问题
  • CritPt:批判性思维
  • AA-Omniscience:跨领域知识综合
  • AA-LCR:长上下文推理

该指数试图衡量一个模型的综合智能水平,而非单一能力。Quasar 以 43 分领先所有欧洲模型,尽管其参数量为 438B,低于 NVIDIA Nemotron 3 Ultra(550B),但得分却高出 5 分。这暗示了架构或训练上的优势。

速度:500 token 仅需 15.3 秒

推理模型通常因“思考”过程而响应缓慢,但 Quasar 实现了 500 token(含思考时间)平均 15.3 秒的端到端响应速度。在对比组中,仅有三个模型更快:

  • Nemotron 3.5 Lightning:9.4 秒(智能指数:24)
  • Gemini 3.5 Flash-Lite:10.8 秒(智能指数:37)
  • Gemini 3.7 Flash:11.5 秒(智能指数:56)

值得注意的细节:在三个更快的模型中,只有 Gemini 3.7 Flash 的智能指数(56)高于 Quasar(43),另外两个虽然速度快但能力较弱。而反方向看,Quasar 的优势更明显:Mistral Medium 3.5 得分为 30,却耗时 18.8 秒;Nemotron 3 Ultra 得分为 36,耗时 25.7 秒;Inkling 得分 42,但耗时高达 48.3 秒(是 Quasar 的两倍多)。尤其在与 Mistral Medium 3.5 的比较中,Quasar 在智能和速度两个维度均完胜:得分高 13 分,速度快 3.5 秒。

这种速度对于交互式产品至关重要。如果响应时间过长,智能体无法嵌入实时对话或协同工作中,只能被降级为批量任务。Quasar 的延迟水平使其能够作为实时助手服务。

长上下文推理:逼近前沿组

AA-LCR 测试模型从长文档中提取、连接并推理信息的能力。Quasar 获得 75.0 分,与 Grok 4.6 (high) 持平,并紧咬 Claude Opus 5(75.7)和 Qwen3.8 2.4T A95B(75.3)。它领先 Nemotron 3 Ultra 4 分,领先 Mistral Medium 3.5 9.7 分。

长上下文处理是企业研究、文档分析和智能体工作流的基础能力——例如,一个智能体需要阅读数十页合同,并回答涉及不同条款的关联问题。Quasar 在这一维度上几乎达到了前沿水平,是其最大的亮点之一。

Agentic 编码与终端任务:最大提升空间

Terminal-Bench v2.1 将智能体放入真实终端环境中执行任务,如文件操作、代码调试、运行脚本等。Quasar 得分为 69.3,远超 Mistral Medium 3.5(50.6)和 Nemotron 3 Ultra(53.9),但落后于前沿组(Claude Opus 5 为 89.1)。文章承认这是 Quasar 与前沿差距最大的领域,也是未来优化的重点方向。

综合表现一览

评估维度 Quasar 438B Mistral Medium 3.5 Nemotron 3 Ultra Claude Opus 5
智能指数 43 30 38 63
响应时间(500 token) 15.3s 18.8s 25.7s —
AA-LCR 75.0 65.3 71.0 75.7
Terminal-Bench 69.3 50.6 53.9 89.1

(注:Claude Opus 5 的响应时间未在原文中给出)

设计目标:企业级 Agent 与编码

Quasar 的定位非常明确:为运行软件开发生成式 AI 助手、技术 copilot、研究系统和自动化工作流的企业服务。其长上下文和终端性能使其能胜任需要保持上下文、协调行动和多步任务处理的场景。而 15.3 秒的响应时间意味着它可以嵌入交互式产品中,而非后台批处理。

支持英语和西班牙语双语言,使其成为欧洲及国际企业的实用选择——尤其是那些需要在多语言环境中部署推理能力的企业。西班牙语的覆盖让它能较好地服务西班牙、拉美等市场,但尚未覆盖法语、德语等欧洲主要语言,这可能是有意为之的市场策略(西班牙语拥有近 6 亿母语者)。

可用性与下一步

Quasar 通过 CompactifAI API 提供给开发者,用户可以无需自行搭建基础设施,直接注册并发送请求。Multiverse Computing 的核心优势在于“AI 效率与可部署性”,这次将这一经验带到了 400B+ 参数规模的模型上。作者表示,更进一步的更新将陆续到来。

思考:欧洲 AI 的位置

尽管 Quasar 在欧洲模型中拔尖,但距离 Claude Opus 5(63分)仍有 20 分的差距。这种差距集中在哪些维度?原文并未细说,但结合 Terminal-Bench 的差距,可能是在复杂代码生成和多步骤工具调用上。不过,考虑到 Quasar 首次发布已达此水平,且速度优势明显,它已经为欧洲 AI 阵营赢得了一席地。对于企业级用户而言,若需要兼顾性能与响应时间,Quasar 是一个极其有力的选择。


原文链接:https://multiversecomputing.com/resources/introducing-quasar-438b-europe-s-leading-ai-model

编写使用方法
Markdown 格式 · Ctrl+Enter 确定
新建笔记
预览
数据表格
点击单元格编辑 · Tab 移动
A1fx
Sheet1
BIH1H2≡🔗</>
隐私提醒

取消
编辑工具
取消