搜索
bottom↓
回复: 17
打印 上一主题 下一主题

阿里上新Qwen3.8-Max-Preview,2.4T参数,1M上下文

[复制链接]

出0入42汤圆

跳转到指定楼层
1
发表于 2026-7-21 22:28:17 来自手机 | 只看该作者 回帖奖励 |倒序浏览 |阅读模式
https://developer.aliyun.com/article/1749290

阿莫论坛22周年了!感谢大家的支持与爱护!!

世间万般皆为虚妄,唯有情爱执念最是折磨人心。人心本不可试探,一试便碎;真情更不能考验,一考就断!

出0入42汤圆

2
 楼主| 发表于 2026-7-21 22:29:34 来自手机 | 只看该作者
之前没买成功过套餐,阿里上新的产品我就没机会试了。

出0入349汤圆

3
发表于 2026-7-21 23:23:48 来自手机 | 只看该作者
坚决捂住钱包,啥都不碰,对付过活。真要用钱的时候没有钱是很惨的。

出0入843汤圆

4
发表于 2026-7-21 23:24:00 | 只看该作者
看官方什么时候蒸馏个Qwen3.8 27B和35B出来玩玩。

出110入26汤圆

5
发表于 2026-7-22 03:46:26 | 只看该作者
最近软文很多都说跑分接近顶尖模型,忍不住试了一下,很遗憾干起活来都是智障,浪费时间和金钱。

出0入54汤圆

6
发表于 2026-7-22 09:01:30 | 只看该作者
kinoko 发表于 2026-7-22 03:46
最近软文很多都说跑分接近顶尖模型,忍不住试了一下,很遗憾干起活来都是智障,浪费时间和金钱。 ...
(引用自5楼)

大佬,Deepseek V4 和K3 ,如何?请教。

出0入13汤圆

7
发表于 2026-7-22 10:09:32 | 只看该作者
大家推荐一下,国内最方便用于协助嵌入式编程的,有哪些好用的了?....

出1490入1588汤圆

8
发表于 2026-7-22 10:12:37 | 只看该作者
kinoko 发表于 2026-7-22 03:46
最近软文很多都说跑分接近顶尖模型,忍不住试了一下,很遗憾干起活来都是智障,浪费时间和金钱。 ...
(引用自5楼)

在自媒体眼中  全世界第一   还有第二吗    没有名次啦
第1000名预留几个

出0入0汤圆

9
发表于 2026-7-22 10:20:57 | 只看该作者
liao-ljj 发表于 2026-7-22 10:09
大家推荐一下,国内最方便用于协助嵌入式编程的,有哪些好用的了?....
(引用自7楼)

反正我用Deepseek V4 Pro,配合VSCODE + DS插件用着挺好的,关键是价格便宜效果也说得过去

出110入26汤圆

10
发表于 2026-7-22 13:40:17 来自手机 | 只看该作者
mutoudonggua 发表于 2026-7-22 09:01
大佬,Deepseek V4 和K3 ,如何?请教。
(引用自6楼)

DeepSeek V4 现在还是预览版,我自己实际用下来的感觉可能是GPT-5.1 这个水平。听说已经有人拿到正式版灰度测试资格,说性能可以打 GPT-5.6 Sol,不过这部分我没法验证,先打个折的话,能有 GPT-5.5 左右的水平就已经很不错了。再考虑它的价格,性价比还是很强,可以重点关注正式版。

K3 我没实际测试,看了一圈基本都是宣传和前端展示居多,所以暂时不好评价真实的复杂工程能力。主要还是价格太贵,不差钱的话可以长期用,预算敏感就不太合适。

我还测试了 Qwen 3.8 Max,现在打1折还是2折期间,Token 还是烧得很快,最后问题基本没解决,提交的代码还有各种符号错误。

仅从我最近写小程序这几个复杂任务的体验来看,部分国产模型目前的问题不是完全不会写,而是幻觉比较严重,缺乏自我审查,复杂任务处理能力也一般。工具调用失败后容易直接放弃,继续做后面的任务;Prompt 里明确写了的事项也经常遗漏,通常要来回三四轮才能真正完成,成本就这样上来了。

个人建议是:看重性价比就先用 DS4,愿意花高价买能力上限就试 K3。不过 K3 我没有亲测,这部分只能参考别人的评价。

出0入0汤圆

11
发表于 2026-7-22 16:08:39 | 只看该作者
千问是跑分从来没输过,实干从来没赢过。
kimi k3用来做UI确实很牛。但是速度太慢了。废话很少,基本上可以一次性跑完一个任务。
GLM 5.2也不错,但最近不知道是降智还是咋回事,一直循环输出一段话,陷入死循环

出0入54汤圆

12
发表于 2026-7-22 16:43:29 | 只看该作者
综合各位大师的体验,Hermes我直接用DeepSeek4了。

出0入843汤圆

13
发表于 2026-7-22 16:43:41 | 只看该作者
本帖最后由 gzhuli 于 2026-7-22 16:45 编辑
cqrg 发表于 2026-7-22 16:08
千问是跑分从来没输过,实干从来没赢过。
kimi k3用来做UI确实很牛。但是速度太慢了。废话很少,基本上可以 ...
(引用自11楼)

我最近几个月一直用Qwen3.6 35B作为本地模型开发一个Vue3+FastAPI的项目,配合Qwen Code工作得挺好的。试过配Claude Code表现就很差了,所以还是要看harness的适配度。

当然了,GLM-5.2无论在Claude Code还是Qwen Code里面的表现都远超Qwen3.6,但Qwen3.6作为本地模型性价比是无敌的,于是我现在基本上是方案由GLM-5.2出,实现由Qwen3.6来。

出0入54汤圆

14
发表于 2026-7-22 16:55:18 | 只看该作者
楼上大师,有没有觉得Qwen3.6 35B-A3B,和Qwen3.6 27B比起来,还是蠢一些?我现在本地都是跑27B了,用MTP版,稍微慢丢丢还是感觉错误率少很多。

出0入0汤圆

15
发表于 2026-7-22 17:05:34 | 只看该作者
gzhuli 发表于 2026-7-22 16:43
我最近几个月一直用Qwen3.6 35B作为本地模型开发一个Vue3+FastAPI的项目,配合Qwen Code工作得挺好的。试 ...
(引用自13楼)

Qwen的基座模型还是很牛的,开源模型基本上都是在Qwen模型上微调的。
大师如果在玩本地模型的话,可以试一下Qwable-9B-Claude-Fable-5和Qwythos-9B这两个模型

出0入0汤圆

16
发表于 2026-7-22 17:06:07 | 只看该作者
mutoudonggua 发表于 2026-7-22 16:55
楼上大师,有没有觉得Qwen3.6 35B-A3B,和Qwen3.6 27B比起来,还是蠢一些?我现在本地都是跑27B了,用MTP版 ...
(引用自14楼)

能跑27B就别跑MoE

出0入843汤圆

17
发表于 2026-7-22 17:27:31 | 只看该作者
本帖最后由 gzhuli 于 2026-7-22 17:32 编辑
mutoudonggua 发表于 2026-7-22 16:55
楼上大师,有没有觉得Qwen3.6 35B-A3B,和Qwen3.6 27B比起来,还是蠢一些?我现在本地都是跑27B了,用MTP版 ...
(引用自14楼)


我觉得35B也够用了,我12GB 3060,部分MoE卸载到CPU,约35~40tok/s输出速度,而27B只有个位数,显存不够MTP也没什么帮助(甚至是反效果),这个速度没法用。

我认为Qwen3.6 35B-A3B优化得非常好,我用ollama cloud的线上模型对比过35B和27B的差距并不大,而Qwen3.5的MoE和Dense模型就完全不是一回事。

出0入843汤圆

18
发表于 2026-7-22 17:42:50 | 只看该作者
cqrg 发表于 2026-7-22 17:05
Qwen的基座模型还是很牛的,开源模型基本上都是在Qwen模型上微调的。
大师如果在玩本地模型的话,可以试 ...
(引用自15楼)

有试过这些蒸馏模型,感觉推理能力确实变强,但指令遵循和工具使用都变差了。

我目前使用unsloth的Q4_K_XL量化模型,能够满足开发需求。
回帖提示: 反政府言论将被立即封锁ID 在按“提交”前,请自问一下:我这样表达会给举报吗,会给自己惹麻烦吗? 另外:尽量不要使用Mark、顶等没有意义的回复。不得大量使用大字体和彩色字。【本论坛不允许直接上传手机拍摄图片,浪费大家下载带宽和论坛服务器空间,请压缩后(图片小于1兆)才上传。压缩方法可以在微信里面发给自己(不要勾选“原图),然后下载,就能得到压缩后的图片】。另外,手机版只能上传图片,要上传附件需要切换到电脑版(不需要使用电脑,手机上切换到电脑版就行,页面底部)。
您需要登录后才可以回帖 登录 | 注册

本版积分规则

手机版|Archiver|amobbs.com 阿莫电子技术论坛 ( 粤ICP备2022115958号, 版权所有:东莞阿莫电子贸易商行 创办于2004年 (公安交互式论坛备案:44190002001997 ) )

GMT+8, 2026-9-16 20:00

© Since 2004 www.amobbs.com, 原www.ourdev.cn, 原www.ouravr.com

快速回复 返回顶部 返回列表