Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
测评
媒体Qwen3.8 Max

Qwen3.8-Max:官方发布说明与完整性能结果

原始来源

Qwen 官方博客

作者Qwen Team

原文日期2026-08-03

Tabbit 整理2026-08-19

查看原文

摘要

Qwen 官方把 Qwen3.8-Max 定位为面向编码、办公、科研、长程任务和多模态智能体的旗舰模型,宣称总参数 2.4T、激活参数 95B,并提供 reasoning effort、API 和多种 Agent harness 集成。官方文章给出大量内部基准与端到端案例,优势集中在长链路工具使用、视觉 Agent、文档办公和持续反馈;这些数字属于厂商发布结果,引用时必须同时标注评测框架、运行次数和基准性质。

重点结果(官方口径)

  • Terminal Bench 2.1:86.6;SWE-bench Pro:67.7;PaperBench:93.0;OSWorld-Verified:86.1。

  • CoWorkBench:74.8;WorkSpaceBench:67.7;WideSearch:81.9。

  • GPQA Diamond:92.6;IFBench:82.8;MRCR v2 256K(8-needle):92.9。

  • MMMU-Pro:82.3;MathVision:95.2 / 97.7;VideoMME(含字幕):90.4。

  • 官方案例:约 16 天自主运行留下 265 commits、127 PR、151 issues;论文复现连续约 125 小时、7600 行代码、33 轮 GPU 训练;WWW2025 比赛准确率从 0.60 提升到 0.853。

  • E-Commerce Bench:最终现金 ¥416,252,官方称比第二名 GLM 5.2 高 38%,比 Qwen3.7-Max 高 152%。

读数限制

官方文章混合了内部基准、公开基准和展示性案例;不同模型还使用不同 harness(例如 Claude Code、Codex、OpenCode 或 Qwen-Agent)。不能把所有表格数字视为同一实验条件下的横向排名。文章本身也注明部分外部结果来自排行榜或官方报告。

原文阅读

本站仅展示 Tabbit 编辑摘要和必要节选;完整内容、上下文与最新版本请查看原始来源。

采集说明

以上“文章原文”为 Tabbit 国际版页面提取到的可见正文,包含页面开头的导航文字和结尾的页脚文字;未通过国内版应用或国内站点访问。原文中的内部基准、案例和参数应回到官方页面复核后再用于发布。

Tabbit 小编提醒

本文是第三方资料导航。测试环境、模型版本和主观体验可能不同,请以原文为准。

Qwen3.8 Max

在 Tabbit 中使用并对比模型

Qwen3.8 Max

相关测评

媒体Artificial Analysis

Qwen3.8-Max:Artificial Analysis 独立指数的质量、成本、速度与冗长账本

媒体NYU Shanghai RITS

Qwen3.8-Max:NYU 上海 RITS 对代理指数演化、轮次和幻觉成本的复核

媒体Trilogy AI Center of Excellence(Substack)2026-07-19

Qwen3.8-Max Preview:Trilogy AI 的 StackPerf 代码库架构盲测

媒体BenchLM2026-08-17

Qwen3.8 Max:BenchLM 的来源可核验基准分类账本

Qwen3.8 Max

相关提示词

媒体Qwen 官方博客《Qwen3.8-Max:编程与办公,全面跃升》2026-08-03

Qwen3.8-Max:推理努力、上下文保持与 Agent 接入提示词指南

媒体EvoLink.AI Blog2026-08-03

Qwen3.8-Max 生产路由:EvoLink 的提示词、思考流与工具调用指南

社区Reddit,r/QwenAI

Qwen Studio + MCP:让 Qwen3.8-Max 访问本地文件的提示词与权限边界

社区Reddit,r/QwenAI

Qwen3.8-Max 多轮对话:从“后续提示失忆”反馈提炼上下文恢复提示词