昨天deepseek-harness发布了,这注定是值得载入史册的一个夜晚,我第一时间就发现了这个消息,同时我也一直在期盼着deepseek-v4-pro正式版
​​在这里插入图片描述
但是我一直在观望,看了好几个相关的评测视频,比如林禾,看完我真感觉这是国产的胜利啊。


今天我也简单的实际测试了一下
使用的是deepseek-v4-flash,在晚上八点半,让它给我生成介绍我的学校的ppt文件
1 轮 · 25 步| LLM 4m0s · 工具调用 1m33s| 首 token 平均 2.1s · 171 tok/s| 缓存命中 94%| 输入 921K tok · 输出 32.3K token 总用时5min33s 0.23元!!

开头的步骤
对应的步骤
效果图效果图
作为一名codex的重度使用患者,我感觉在不额外添加使用skills的情况下,两者完全可以媲美了。况且我在有一次公司的实习过程中,老板让我做一个关于公司项目的ppt,我全权交给gpt5.6sol做,把推理能力调到最高,把要用的资料都给,结果是消耗了我2周的额度,三千多万token,一个多小时,最后生成了依托答辩


现在使用下来的缺点就是:

当前harness生成的文件直接放置在文件夹当中,没有直接在对话框交付,生成文件的相关代码直接放在那里,没有把其删掉。

然鹅也有很多做的好的地方:

而对于很多地方我很想夸夸deepseek的相应开发者,像是使用的量啊,调用工具的轮次啊都是显示出来的,不是像codex那种一样进行无感交换,使用的量需要自己点开设置看,而且使用的npx进行启动也十分方便,底座的语言使用typescript更加有利于开源社区的协作,而相关的cordis架构也把高内聚低耦合发挥到极致,也极致的符合deepseek说的everything is a plugin…


最后说一句:
祝愿国产模型软件越来越好!!!!

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐