文章目录


在这里插入图片描述
P.S. 无意间发现了一个巨牛的人工智能教程,非常通俗易懂,对AI感兴趣的朋友强烈推荐去看看, 传送门https://blog.csdn.net/H1727548

1. 最近AI圈又出了个硬货

DeepSeek跟北大联手放了个大招,一篇八十多页的新论文,直接把黑鲸的核心逻辑全摊开了。

说直白点,整篇论文就围绕一个叫Cordis的东西展开。这玩意儿是黑鲸的核心骨架,说白了就是块万能乐高底板,啥插件都能往上插,插错了拔下来重插也没问题。

算下来这也是DeepSeek今年的第七篇论文,跟北大合作早就轻车熟路了。

1.1 先给你们说点人话版总结

八十多页的论文,满屏公式和术语,普通人翻两页就得犯困。我硬啃完了,给你们提炼成大白话。

核心就俩事儿:一是解决插件装了就拔不下来的毛病,二是解决插件之间乱依赖容易炸的问题。最终目标,就是给自进化AI打地基。

2. 为啥要费这么大劲?还不是现在的插件系统太拉胯

别觉得插件系统是小事儿,这里面的坑能把人逼疯。

2.1 第一个坑:时间维度上,插件插上去就焊死了

不知道你们有没有遇见过这种糟心事儿:装了个软件插件,觉得难用想删掉,系统弹个框告诉你——不行,得重启整个程序。

我就删个几十KB的小插件,你让我重启整个软件?合着我家里扔个空矿泉水瓶,还得把整栋楼断电重启一遍呗?

这还真不是某一家的问题。论文里拿VSCode举例子,截至今年6月,应用商店排名前100的扩展里,87个都带可执行代码,一旦激活就没法单独卸载,禁用或者删掉都得重启整个扩展宿主。

搁普通软件里,大不了重启一下,浪费半分钟也就算了。可放到Agent身上,这事儿就大了。

以后的自进化AI,得自己生成工具、自己装上去、不好用再自己换掉。要是换个工具就得重启一次,之前攒的上下文、缓存全给你清没了,还进化个啥?

2.2 第二个坑:空间维度上,插件依赖乱成一锅粥

现在很多插件的依赖,全靠开发者自己打补丁。今天检查一下有没有A插件,明天猜一猜装没装B插件,全靠默契活着。

这就跟合租似的,你借我洗洁精,我用你卫生纸,互相都不打招呼。哪天其中一个人突然搬走了,剩下的人早上起来发现没洗洁精洗碗,全傻了。

运气不好再整个循环依赖,你靠我我靠他,重载的时候直接给你炸得明明白白。

3. 解法说穿了也简单:俩数学概念改一改

论文的理论根基,是类型论里的两个老概念:效应和余效应。

简单说,效应就是程序对外面的影响,余效应就是外面对程序的约束。但这俩本来是静态类型系统的玩意儿,应付不了动态加载的Agent。

于是团队给它俩升了个级,专门适配Agent运行时。

3.1 可逆效应:专门搞定时间维度的麻烦

核心逻辑一句话:每个修改系统状态的操作,都必须配一个对应的撤销操作。

加载插件的时候,每改一点状态,就把对应的逆函数记下来,按顺序排成一条撤销链,跟叠盘子似的,最后放上去的,最先拿走。

卸载插件的时候,倒着执行这条撤销链,系统就能精准回到插件加载之前的样子,半分都不影响别的插件。

说白了就是给系统装了个精准版Ctrl+Z。不是那种一撤销退三步的糙活儿,每个插件干了啥都记得明明白白,卸载的时候精准撤回,比你P图手滑撤回还稳。

3.2 反应式余效应:专门理顺空间维度的乱局

在这套体系里,插件得明明白白说清楚自己需要啥依赖。缺一个,它就安安静静待着不启动,也不会瞎跑报空指针错误给你添堵。

依赖的东西上线了,它自动激活;依赖的东西要撤走,它先自己停下来,等人家撤完了,自己再歇着。

整个依赖关系的编排,不用开发者手写代码,系统自己从声明里推导。

这就懂事多了。好比拼乐高,缺零件它就乖乖等着,绝不硬拼给你整个残次品。等零件到了自己就拼上,零件拿走了自己就拆开,全程不用你动手,比你那只会喊666的队友靠谱多了。

4. 真不是实验室花架子,已经跑了四年了

别觉得这又是啥纸上谈兵的概念。这套设计早就落地了,还跑了挺久。

4.1 验证项目是个叫Koishi的聊天机器人框架

用来做验证的Koishi,就是基于Cordis搭的,到现在四年了,社区攒了四千多个插件,啥功能都有,GitHub上有5.7K星。

说个有意思的,Koishi这个名字来自东方Project里的古明地恋,就是那个主打无意识行动的角色。拿来给聊天机器人框架当名字,还挺贴。

而Cordis这个词,拉丁语里是“心”的意思,Koishi的一切都是从它开始的。

哦对了,这个Koishi的作者,就是论文的一作。合着人家四年前就开始挖坑了,现在拿论文给补上了。

4.2 实际用起来到底有多爽

先看时间维度:管理员在控制台禁用一个插件,这个插件对系统的所有影响当场撤回,剩下的插件该咋跑咋跑,半毛钱关系没有。

开发的时候更爽,改完插件代码保存,系统自动重载这个插件,缓存、连接啥的全都保留,不用整个项目重启。

搁以前,改两行代码就得等重启,咖啡都能续两杯了。现在倒好,你咖啡还没拧开盖,人家已经重载完了,半点儿不耽误摸鱼。

再看空间维度:比如换个存储后端,或者重连一下消息适配器,只有依赖这些东西的插件会重新激活,别的插件纹丝不动。

要知道这些插件都是不同作者写的,互相之间根本没商量过,全靠这套规则自动协调。能在开放社区里跑通,说明是真好用。

5. 最终的野心:自进化AI的底座

折腾这么多,最终目标就一个——自进化。

以后的Agent,得能根据任务自己生成工具,自己装到运行时里,发现不好用再自己换掉。要是每换一次就重启一次,上下文全丢,那自进化就是个笑话。

现在DeepSeek发布的Harness,说白了就是Koishi Cordis的升级版,奔着自进化Agent的基础设施去的。

5.1 唠唠背后的几位大佬

论文一共三位作者,横跨北大和DeepSeek。

一作叫Yifan Shi,北大学生,同时也是DeepSeek的人。前面说的Koishi就是他写的,Cordis的概念也是他最早提出来的。

说个好玩的,他本名叫Shi Yifan,项目叫Koishi,GitHub ID叫Shigma。名字里翻来覆去都是shi,这执念也是没谁了。

还有一位是北大的张伟副教授,软件工程和程序设计语言方向的专家,跟一作合作好多年了,从2021年就一起发论文。

最后一位是崔添翼,DeepSeek Harness团队的负责人。浙大计算机保送,拿过六次ACM亚洲区域赛金牌,之前在Jane Street干了九年,妥妥的大佬。

5.2 当然也不是完美的

论文自己也说了,目前就Koishi这一个生态、TypeScript一种语言的验证数据,也没跟别的架构做严格的对照实验。

但这都不是最关键的。最关键的是,它给自进化Agent的底座指了条实实在在的新方向,不是空喊概念。

毕竟饭要一口一口吃,能先把一个生态跑明白,就已经比好多光吹PPT的公司强太多了。

P.S. 无意间发现了一个巨牛的人工智能教程,非常通俗易懂,对AI感兴趣的朋友强烈推荐去看看,传送门https://blog.csdn.net/H1727548

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐