一键开用|Qwen3.8-27B 上线 EazyDevelop

8 月 14 日,阿里通义千问正式开源 Qwen3.8-27B。
这个 270 亿参数 的稠密视觉语言模型,在多项智能体基准上追平甚至超越闭源旗舰 Opus 4.6 Max,原生 262K 上下文,Apache 2.0 协议, 单卡 16GB 显存 即可部署。

〔Text Performance 性能对比图〕

〔VL Performance 性能对比图〕
今天,它正式登陆 EazyDevelop 模型广场。模型页一键体验、EazyBot 直接对话、API 立即开通——不用自建推理,打开就能用。
01 这次上新,有什么亮点
过去半年,「27B」一直是社区呼声最高的尺寸:7B 能跑但能力见顶,70B 能力够但显存爆炸。27B 刚好卡在中间—— 性能够用,成本可控,本地可部署 。
但以前的 27B,做不了「真智能体」。Qwen3.8-27B 把这件事改写了。它不是在所有维度都赢过闭源旗舰,而是在「智能体 + 多模态」这条最实用的线上,27B 的尺寸第一次做到了接近前沿。
02 Qwen3.8-27B,到底强在哪
1. 黄金尺寸,本地可跑(但要看上下文长度)
27B 稠密架构,BF16 约 28B 权重。社区已放出 319 个 GGUF 量化版本:
· 短上下文(8K 以内):单卡 16GB 显存 即可跑(RTX 4080 实测 12.6GB 显存);
· 长上下文(262K):需双卡 32GB 或量化 + YaRN 扩展,消费级部署有对应成本。
两者别混为一谈——你能在家跑它,但「读完整份年报」需要按上下文长度配显存。
2. 原生视觉语言模型
开箱即懂图像和视频,从 STEM 图表、合同文档到小时级视频。这是该尺寸首个具备完整多模态输入的 Qwen 模型。
3. 262K 长上下文,可扩到 1M
一口气读完整份年报、招股书、代码库。超长任务用 YaRN 可扩展到 100 万 token 。
4. 思考可控,像人一样「先想再答」
默认开启思考模式, reasoning_effort 支持 xhigh / medium / low 三档——规划用 high,执行用 low,成本自己掌握。
5. 工具调用 + 结构化输出
原生 Function Calling,对接 OpenAI 兼容 API。Kilo Code、Zed、pi、Hermes Agent 已经把它用在生产里。
6. Apache 2.0,可商用
权重免费、允许二次分发。金融、医疗、政企内网想私有化部署,合规无门槛。
03 在 EazyDevelop 上,三种方式立即用起来
方式一:模型广场,立刻体验
打开 EazyDevelop 模型广场,搜「Qwen3.8-27B」,点「在线体验」——在体验中心选模型、调系统提示词、设温度,直接对话。

〔模型广场在线体验截图〕
方式二:API 密钥,接生产
控制台生成密钥,按 OpenAI 兼容协议调用,模型 ID 选 qwen3.8-27b 。智能体任务记得把输出长度给足(推理最大 262K,最终回答最大 131K)。

〔API 密钥生成截图〕
方式三:EazyBot 桌面端,像聊天一样
打开 EazyBot v2.2.10,顶部模型下拉选 qwen3.8-27b ,让它读本地文档、生成代码——Mac / Windows 都能用。

〔此处插图:EazyBot 桌面端截图〕
04 同广场其他模型,怎么选
EazyDevelop 模型广场里不止 Qwen 一个,看看各个模型适合什么场景:
|
如果你的主场景是 |
推荐模型 |
理由 |
|---|---|---|
|
智能体 / 编码 / 多模态一体,要性价比 |
Qwen3.8-27B |
27B 全能 + 262K + 视觉 + 工具调用,单卡可跑 |
|
超长文本(≥1M)+ 纯文本深度推理 |
DeepSeek-V4-Flash |
原生 ≥1M 上下文,推理模型架构 |
|
强中文创作 / 通用对话语感 |
GLM-5 / MiniMax-M2.7 |
中文表达与对话调优更顺 |
|
已在用 EazyBot 工作流 |
直接下拉选 Qwen3.8-27B |
零切换成本,立即可用 |
05 现在,就用起来
👉 立即在线体验: https://eazydevelop.eazytec-cloud.com/models/qwen3.8-27b
👉 申请 API 密钥:EazyDevelop 控制台 → 模型 → API 密钥
👉 下载 EazyBot 桌面端: https://eazydevelop.eazytec-cloud.com/eazybot
你最想用 Qwen3.8-27B 跑什么任务?评论区聊聊,我们挑典型案例做下一期实测。
更多推荐




所有评论(0)