每日签到奶昔超市积分商城奶昔访达
返回列表 发布新帖

你认为 Qwen3.8-Max 目前处于什么水平?

614 16
发表于 2026-8-4 10:03:53 | 查看全部 阅读模式

千问 Qwen3.8-Max 发布:2.4 万亿参数,可自主编程 16 天交付项目
8月3日,阿里巴巴正式上线千问 Qwen3.8-Max 人工智能模型,总参数量达 2.4 万亿,刷新 Qwen 家族的性能上限。据官方介绍,该模型基于 Qwen3.5 架构打造,在编程、真实办公、长程任务与多模态智能体等方向全面升级,可在极少人工介入下端到端完成复杂开放目标,并交付可信赖的成果。
  在编程层面,Qwen3.8-Max 能从一个空文件夹起步,自主完成周期长达十余天的真实项目。官方演示中,仅凭"创建一个自进化的智能体 Harness"一句指令,它便独立编程约 16 天,产出可实际运行的自进化框架"oh-my-cli",能力达到 Hermes Agent 级别。
  办公方面,借助真实环境与算力的联合强化学习(RL)扩展,模型在数百种高频专业任务上实现真实性能提升——能把法务团队一周的审阅量压缩至一小时,也能凭一句话规划复杂动态工作流,并交付一套可盈利的端到端量化策略。
  在长程任务中,Qwen3.8-Max 展现出系统级自主规划与全栈闭环自适应学习能力,无论是严苛的数字芯片设计还是多变的商业模拟运营,都能在"执行—反馈—迭代"的闭环里经历数千轮超长交互,持续重构自身算法与策略。
  多模态上,模型将视觉理解推向新高度:可跨页读懂 200 页财报,把 100 小时长视频整理成可检索、可追溯的 Graph 记忆,并在执行中持续自查中间产物,出错即自主定位、重新规划与修正。
  在当日公布的权威第三方榜单 Arena 中,阿里 Qwen 仅次于 Anthropic 的 Claude 系列,位居全球大模型第一梯队。目前 Qwen3.8 的 API 已上线千问 AI 平台,并接入同日推出的 Agent 产品"千问办公"。

据悉,Qwen3.8-Max 模型权重将于下周开源,同时开源 Qwen3.8-27B。开发者可通过千问 AI 平台调用 API,国内定价为每百万 Tokens 输入 12 元、输出 36 元,隐式缓存命中低至 1.5 元;国际价格分别为 Opus 5 的 40% 与 24%。 photo_2026-08-04_11-02-31.jpg photo_2026-08-04_11-02-32.jpg
单选投票 , 共有 58 人参与投票
您所在的用户组没有投票权限
爱生活,爱奶昔~

评论16

reallyasdLv.2 发表于 2026-8-4 10:10:40 | 查看全部

回帖奖励 +10 点数

在qoder中短暂试用过正式版,感觉不能很好的领会我的意图,干活经常留尾巴;
而且现在luna大降价,找不到使用Qwen3.8-Max的理由
爱生活,爱奶昔~
回复

使用道具 举报

SunovnLv.2 发表于 2026-8-4 10:33:48 | 查看全部

回帖奖励 +10 点数

deepdeek v4有api了,qwen没这么便宜
爱生活,爱奶昔~
回复

使用道具 举报

GodtokooLv.9 发表于 2026-8-4 10:53:29 | 查看全部

回帖奖励 +10 点数

这是面向跑分优化吧
爱生活,爱奶昔~
回复

使用道具 举报

StarryCo6Lv.2 发表于 2026-8-4 11:01:52 | 查看全部

回帖奖励 +10 点数

3. 国产模型第一梯队,但与海外旗舰仍有差距
爱生活,爱奶昔~
回复

使用道具 举报

TheabcLv.1 发表于 2026-8-4 11:06:15 | 查看全部

回帖奖励 +10 点数

水平只要拉齐一线模型就行,多个竞争必然是好事。
爱生活,爱奶昔~
回复

使用道具 举报

ChovyLv.3 发表于 2026-8-4 11:17:25 | 查看全部

回帖奖励 +10 点数

跑分亮眼,属于国产头部梯队
爱生活,爱奶昔~
回复

使用道具 举报

lokesiuLv.2 发表于 2026-8-4 13:02:02 | 查看全部

回帖奖励 +10 点数

之前预览版2% 倍率 每天22点-次日8点。现在消耗速度比K3猛
爱生活,爱奶昔~
回复

使用道具 举报

MJJ在哪里Lv.2 发表于 2026-8-4 13:06:14 | 查看全部

回帖奖励 +10 点数

不知道,但是看隔壁有个贴是,雷霆大思考后把数据库删除
爱生活,爱奶昔~
回复

使用道具 举报

portal6161Lv.4 发表于 2026-8-4 13:16:08 | 查看全部

回帖奖励 +10 点数

看着是挺不错的,但是不知道实际体验怎么样
爱生活,爱奶昔~
回复

使用道具 举报

yanyu1891Lv.3 发表于 2026-8-4 15:03:48 | 查看全部

回帖奖励 +10 点数

看着综合还可以,具体看实际使用
爱生活,爱奶昔~
回复

使用道具 举报

zgwingLv.2 发表于 2026-8-4 15:27:49 | 查看全部
跑分只是参考,实际使用上与codex和opus5区别还是很大的
爱生活,爱奶昔~
回复

使用道具 举报

youngqiLv.1 发表于 2026-8-4 15:45:55 | 查看全部
跑分跟实际体验还是有区别的
爱生活,爱奶昔~
回复

使用道具 举报

mrjiangLv.4 发表于 2026-8-4 16:01:16 | 查看全部
先等开源实测再说
爱生活,爱奶昔~
回复

使用道具 举报

aidsmfhdLv.2 发表于 2026-8-4 16:48:56 | 查看全部
肯定不如 KIMI 咯,只能当做备选方案
爱生活,爱奶昔~
回复

使用道具 举报

sudsLv.1 发表于 2026-8-5 23:32:44 来自手机 | 查看全部
静待测试结果
爱生活,爱奶昔~
回复

使用道具 举报

z1kLv.2 发表于 4 天前 | 查看全部
现在模型就2个极端,模型领先的第一梯队,量大管饱的第二梯队,中间的都得死。
爱生活,爱奶昔~
回复

使用道具 举报

回复

您需要登录后才可以回帖 登录 | 注册

本版积分规则

© 2026 Naixi Networks. 沪ICP备13020230号-1|沪公网安备 31010702007642号手机版小黑屋RSS
返回顶部 关灯 在本版发帖
快速回复 返回顶部 返回列表