你是否觉得现在使用AI大模型成本太高?是否觉得模型越贵参数越多效果就越好?

下面是一组前端动效的对比视频,分别是我用Qwen3.8-27B和Opus4.6生成的,使用的提示词完全相同:

看完这个对比,不知道你们能否分辨出它们的身份?

说实话,如果这不是我自己测的,我会毫不犹豫的认定第二个是Qwen3.8-27B的成果,因为这个的特效相比第一个要稍逊一筹。

但实际上,第一个才是Qwen3.8-27B生成出来的结果,测试的提示词如下,大家也可以自己去对比看看↓

请帮我设计并编写一个非常炫酷、极具未来科技感(赛博朋克/科幻风格)的“概念科技官网首页”单文件 HTML。页面需要包含完整的 HTML、CSS 和 JavaScript 代码(可使用 CDN 引入 Tailwind CSS 进行基础布局,但核心交互和动效必须编写原生 CSS/JS)。页面必须包含以下核心动效和组件,以展示尖端的前端技术:1. 【全局视觉风格】: - 使用暗黑背景(如深接近黑的墨蓝色 #05050a),搭配霓虹蓝(Cyan)和粉紫(Purple)的渐变发光色彩体系。- 具有极客感的浅色细网格背景图(利用纯 CSS Linear-gradient 实现)。2. 【自定义磁性光标(Custom Cursor)】:- 隐藏浏览器默认光标,使用 JS 实现双层自定义发光光标:内层为快速跟随的实心点,外层为具有延迟与平滑过渡效果(需要使用数学插值 Lerp 算法)的发光光圈。- 当光标悬停在任意可点击元素(如按钮、卡片)上时,光标要有膨胀、变色或融合的微交互。3. 【Canvas 交互粒子引力背景】:- 在全屏背景放置一个 Canvas 粒子系统,初始随机漂移 100 左右个半透明粒子,粒子间距离接近时自动绘制细斜线连接(形成星协网格图)。- 鼠标移动时,粒子需要受到引力/斥力影响向光标靠拢或排开。- 鼠标点击页面时,点击位置瞬间向外爆发喷射出 15-20 个带物理衰减速度的彩色微型粒子。4. 【3D 视差倾斜卡片(3D Hover Card)】: - 包含一到三张采用“毛玻璃(Glassmorphism)”视觉效果的科技感卡片。- 鼠标掠过卡片时,卡片要根据鼠标相对中心点的坐标位置,呈现逼真的 3D 旋转(Tilt)倾斜,且卡片上的虚拟光泽(Sweeping Light)要随鼠标同步移动。5. 【动态终端模拟器(Terminal Terminal)】:- 卡片内叠加一个类似于黑客终端的控制台窗口,窗口内不断自动随机打印、滚动更新类似于“数据加密、套接字握手、核心就绪”的绿色代码日志。6. 【滚动触发渐跃显现(Scroll Animations)】:- 页面下方设计一个特色优势(Features)展示区,利用 JS 的 Intersection Observer(交叉观察器)实现:当滚动条拉到该区域时,卡片以由下往上的位移动画呈递进式(Staggered)渐显。7. 【页面框架完整】:- 包含固定顶部的导航栏(带虚化背景和霓虹发光 Logo)、宽屏的主标题区(Hero Section,带炫光边框按钮)、状态指示器(如不断浮动的 Latency 网络延迟数值),以及页脚。代码质量要求:* 确保动画流畅度,Canvas 绘制必须使用 requestAnimationFrame 保证 60fps。* JS 逻辑必须严谨,不能出现卡顿、卡片边缘不断高频抖动(抖动通常是坐标没处理好)、或者控制台报错。* 打开文件即可在现代浏览器中直接运行,布局需响应式适配移动端和 PC 端。

没想到,Qwen的小模型确实有点东西。

我之前并没有太多关注这类小模型,因为我会凭直觉认为它们的能力会偏弱,但这次的Qwen3.8-27B确实刷新了我的认知,甚至有不少网友戏称它为“本地版Opus4.6”。

 备受追捧的Qwen3.8-27B 

在Artificial Analysis的最新测评中,Qwen3.8-27B得分52,与ChatGPT-luna、DeepSeek-V4-Flash并列,许多海外开发者都认为它的性能已经可以媲美Opus4.6。

图片

要知道,Opus4.6还是四五个月前最强的大尺寸模型,而Qwen3.8-27B却是一个只有270亿参数的开源模型。

最重要的是,它不是那种需要几十万元的设备才能跑起来的模型,一些配置较高的家用电脑就能本地运行。

官方提供的FP8版本用一张5090显卡就可以流畅运行,如果使用一些量化版本,配置需求还可以进一步降低。

斯坦福大学的计算机专家也表示,Qwen3.8-27B的表现非常惊人,甚至有点反常识。

图片

大家都知道,模型参数量越大,往往意味着性能越强。

但从这张表中可以看出,Qwen3.8-27B的参数量远低于其他模型,性能却超过了其中大半。

这感觉就像是AI界的一个奇点:模型参数量和性能不再是简单的正相关关系,当模型的整体智能水位提升后,哪怕是中小尺寸模型,依然会拥有前代旗舰级的水平。

相比之下,Opus4.6是一个使用成本较高的闭源模型。现在家用电脑就能部署一个媲美Opus4.6的模型,每个月还能省下几十美元,这谁能不心动?

正因如此,模型发布仅2天,下载量就突破了100万,不仅登上Hugging Face全球大模型趋势榜第一、最受欢迎的大模型榜第三,还成了近期最受全球AI开发者关注的开源模型之一。

图片

全球热门的编程Agent工具Cline也表示,Qwen3.8-27B是其开发者选择最多的本地模型。

Qwen3.8-27B最擅长的就是编程和Agent任务。通过开头的案例,相信大家已经看到了它的能力,处理复杂的前端页面特效完全没有问题。

我还用它测了几个经典的案例,全程只依赖模型本身能力,没有接入任何Agent,大家可以看看效果如何。

①3D城市街景

这个任务不算很难,主要考验模型的3D能力,可以看到整个街景没有任何变形,建模很稳定,还贴心的提供了一系列参数调节功能。

②生成一个发布页

我的提示词非常简单,就一句话,本以为会生成一个AI风格很重的网页,但实际效果确实有点出乎意料。

可以看到整个UI界面非常简约大气,每个按钮、图片都有响应的鼠标反馈,这审美确实挑不出啥毛病。

说完模型能力的基本测试,下面咱们再来看看它在Agent场景下的表现又如何。

 接入Agent 

还记得之前爆火的小程序游戏“羊了个羊”吗?没想到了两年过去了,今天在医院排队还看到有人在玩

我一直很好奇,这么一个简单的游戏是怎么可以火到这种程度的。

于是我就把Qwen3.8-27B模型接入了Qoder,让它帮我去调研一下这个游戏爆火的原因,并交付给我调研报告,同时数据要使用图表展示。

图片

它会先检索网络,查找相关的信息和数据,并建立一个待办,然后正式开始进行任务。

之后它自己整理数据,并将数据制作成了图表,接着调用相应的工具来编辑Word文档。

图片

最后在验证之后,成功交付了文档。

图片

大家看一下这个报告的效果:

图片

它系统性的展示了相关数据,然后将爆火原因进行了拆解,以及扩展性的介绍,让用户更加容易理解爆火的原因。

最后还额外整理了商业表现以及启示,给用户更进一步的启发。不得不说这个小体量模型在Agent场景的工作能力,也很让人省心。

最后我又直接用Qwen3.8-27B复刻了这个游戏,来看一下实际效果:

图片

不得不说,游戏还原得非常好,图案很精致,动态效果也没有偷工减料,各种道具也都齐全。

而且为了降低难度,它还额外加了一个小设计:在页面两边各放置几个砖块,让玩家陷入苦战时能有更多选择。

 Qwen3.8-27B出现的意义 

它最大的意义,就是让家用电脑等端侧设备也能运行能力媲美旗舰模型的AI。

进而会引发更多模型厂商的思考:当中小参数量的模型智能压缩到极致的时候,被下放的智能究竟能在端侧制造出多少可能?

现在,许多模型已经来到了斩杀线,而Qwen3.8-27B就像是这条线的守门员。达不到这条线的模型,在后续端侧、智能硬件等场景中很可能会被直接淘汰。

图片

未来可能只会有两种模型:一种追求极致性能,另一种追求极致智能密度。Qwen3.8-27B就是第二条路线的开拓者之一。

原文链接在这儿

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐