dudiskAAAAAAAA.26.09.20

这几天度盘上了一个叫做库库ai的玩意,不清楚为啥叫这名字(可能“库库”是什么拟声词?),但它按照百度自己的说法,也是一个一个一个一个自带容器的webagent啊啊啊啊啊🤔

但最牛批的是只要连续签到三天就能搞到三天度盘会员,连续签到七天就能搞几乎半个月度盘会员,好家伙,我那些已经过期的度盘账号这下不就可以原地复活了吗🤔所以,我哼哼登进去了所有我的度盘账号,除了其中有一个死活登不上去,别的要么已经领了会员要么在领会员的路上,,,然后我随便统计了一番,这些已经塞满文件的号,它们居然还有不少的空间,撅大多数有150GB左右,但也有些还剩小半个TB的,赶紧将我前几天注册的那个号里的部分东西转移过去,不清楚为啥我当时买会员时为什剩那么多没给塞满(恼🤔这些东西看起来不多,但加起来可能有好几个TB(确信🤔我平时花18也就买上5TB而已,所以完全可以用来腾空间(确信🤔

至于这个agent本身,其实也是我比较感兴趣的东西,毕竟我前几天玩的就是这种🤔它默认情况下不会启用容器,需要先新建个项目,然后在项目里面说“在本容器里装dsh”,它才会装dsh🤔然后按照惯例,装好dsh之后就可以埃及吧怎么玩怎么玩力🤔

但问题是,它能装好dsh,却没有任何形式的官方端口映射机制,至少我没发现🤔更别提和workbuddy一样,它也没有终端,文件管理功能也许有,但用处不大,,,🤔目前这种带容器的webagent,还是codemonkey用起来比较稳定🤔至于这个库库ai,容器本身倒是可以访问外网(不然它也装不了dsh),我看能不能部署个cloudflare tunnel之类的给映射出去,只不过用cloudflare tunnel的话那速度肯定没眼看,,,🤔

biko3port

前段时间我提过一嘴将尾行3移植到three.js,但不清楚用什么模型做🤔不知怎么想的我居然开启了qwen3.8 27b然后开始调研,联网搜索有没有啥three.js做的成人游戏🤔它还真找到了几款,既然这都可以,接下来我给了它尾行3的游戏目录,让它给一个移植到three.js的方案🤔我去,它不仅给出了一个像模像样的方案,甚至还开始动手做力🤔

好家伙,难以想象我的尾行3移植之旅居然是从一个一个一个一个私有部署的27b模型开始的,就极其生草🤔在压缩了几次可怜的128k上下文后,它貌似进行不下去力,此时刚好换deepseek v4.1 flash接力(确信🤔先不说模型能力如何,至少上下文管够🤔

epikfail

理论上来说,移植尾行3需要进行如下步骤,至少27b模型规划的步骤如下:

  1. 逆向尾行3的pp包系统,解包出游戏的所有资产(包括模型、贴图、其他图片、音乐语音和声效还有游戏逻辑等
  2. 进行格式转换,将上述所有资产转换为three.js能够读取的格式
  3. 搭建three.js runtime,然后尝试实现游戏的各种组件(比如尾行系统,hentai screne等
  4. 将所有组件串起来,hopefully它能玩起来像尾行3,,,
  5. 像素级复刻原游戏的ui系统,最后再打包发行到我那几个容器之一

现在看来,1和2对于无论是qwen3.8 27b还是deepseek v4.1 flash来说都轻而易举,它几乎没有查任何已经有的pp解包工具就将资源全解了出来🤔但最麻烦的地方在后续几步,比如它拼凑角色模型的步骤就做得极其艰难,拼出来的模型身首异处居然算好的,有几个角色干脆就是一坨肉块,而且他们无论何时无论何地都在蜜汁抽搐(全恼🤔而环境场景方面,我怀疑它压根就不知道什么叫做环境场景,我能看到的只有全黑的背景里几个立方体方块,,,🤔那我寻思它能否理解什么是hentai scene可能也是非常令人生疑的🤔

总之,拿deepseek v4.1 flash做游戏可能真的不是什么好主意,,,况且在我意识到它连读图能力都没有之前,它在dsh里的配置是错误的,它具备视觉能力但我的配置文件定义的它还是纯文本模型,啊?🤔那如果我拿gpt6来接手呢?首先我没有gpt pro账号,其次,,,gpt系列模型的安全护栏真的会让我继续下去吗?🤔

wiebitte.26.09.18

我现在已经很长时间没写任何东西力(撅望🤔但如果我能够想起来,而且我有空闲时间,我尽量写点什么,,,

ds4.1flash

就在这段时间里的某一天,小男梁发布了deepseek v4.1 flash,但这玩意最大的噱头其实是“超越4.0 pro”,为了这个噱头甚至愿意关停pro的推理服务并且以flash代之(包括将4.0 pro的请求直接路由到4.1 flash),而不是它又发明了什么新架构🤔具体来说超不超越4.0 pro那鬼才知道,但我实际用下来的效果是基元律动的号消耗得确实慢了很多,以我转deepseek和dsh之后的极高强度开发方式,以前用4.0 pro一个68的号只能用一天甚至半天,切4.1 flash后居然能坚持半周以上🤔而干活方面居然没有任何降低,反正我之前不是也说过,我干的活也许4.0 flash也能随便干,切到4.0 pro或者4.1 flash那算是升级(确信🤔

这中间发生了一个一个一个一个极其尴尬的小 插 曲,当小南梁宣布它极其逆天的以flash代pro计划时,我居然看错了日期,提前接入了官方api的4.0 pro🤔那它当然不会以flash计价,而是pro,,,最后喜提一个请求算上巨量的未缓存输入花掉字面意义上的十块甚至⑨块,毕竟这是官方api(撅望🤔

现在我测试的一大堆第三方provider,只有基元律动接入了4.1 flash,senseaudio现在还停留在4.0 flash,而且它还下线了4.0 pro🤔至于sensenova,它尽管保留了4.0 pro,但它那个rpm限制基本上没法正常用,,,🤔而在没那么喜闻乐见的本地(?)部署方面,如果4.0 flash可以靠混合推理的申必里技在5090上勉强跑起来,4.1 flash想都别想,首先它的参数量直接上到了500B,这和700B左右的glm 5.2已经区别不大力,,,🤔它还采取了申必新架构,尽管有那么200GB的东西可以放内存里(这个对内存带宽肯定是有要求的,别指望ddr3可以蒙混过关,,,),但那也意味着剩下300GB最好全放显存里,那我只能拜了个拜,,,🤔

cyrenebot evelved

出于某种申必原因(其实也没那么申必,无非是我搞到了一个zzz的角色音频数据集),我这两周甚至一周开始对昔琏bot和端脑云定制节点体系进行多轮重大升级🤔这些升级增强了昔琏bot调度容器的能力,使得最多五个线程的批量rvc训练成为可能🤔而推理方面,由于我训练的角色模型突破了70人大关,现在用一个线程推理实在是慢到吴法接受,我设计了一套多线程推理体系,还加上了一个简单的标签系统,通过预填的标签筛选角色,,,但我觉得最有意义的升级是添加了从本地直接上传原歌曲文件的选项,此时填的是它在本机上的绝对路径,这种用法在discord bot上确实很奇怪,但考虑到这个功能只有我一个人用,,,就这样🤔它有两种上传模式,如果是单线程可以直接将歌曲二进制上传到目标节点,但如果是多线程的话,它会先上传到lanzou,然后我在远端实例加强了lanzou链接的解析能力,它现在可以接受lanzou链接作为输入力,,,🤔

而当lanzou链接可以用来输入,那么它就可以用来处理十分钟甚至⑨分钟的歌曲(比如move的某张专辑里的某些超长trance歌曲),那么它的产物(24bit flac)肯定会超过100MB,这样上传lanzou就必然需要分卷打包、降bitdepth到16bit,换句话说一个角色需要上传一个一个一个文件啊啊啊啊啊🤔这需要同时改三部分东西,远端节点需要支持分卷打包、降bitdepth和上传,并返回新格式响应,bot需要能够解析这些响应并且post新格式json,我的批量下载脚本和解析html也需要能够解析新json🤔

至此,以前我将昔琏bot和端脑云节点分开会话开发(然后用一个api文档交换信息)的搞法完全搞不动,我现在已经授权dsh一次性将其纳入同一个会话开发🤔之前那些旧会话只在额外添加一些支线功能(比如给html加个在线播放的功能)时使用(确信🤔在长达三天啊三天的吉列豆蒸开发后,我终于搞定了所有这些玩意,然后我便可以疯狂制作一些牢登音乐的现代萌妹翻唱力,比如gta vice city的某些电台歌曲(其实move歌曲也算牢登音乐🤔

independent node

除此之外,我还设法创建了一个不受昔琏bot管理的端脑云实例,给它装上了简单的服务模块(比如开机之后自动打开comfyui和监控网页的脚本)并且归另外一个dsh会话管理🤔然后在它上面跑了一系列的测试项目,比如:

AICoverGen

这是一个和我的全自动翻唱差不多类型的项目,只不过没我的玩意自动化程度高,我做的是一个bot操纵的api,但这玩意用的是gradio实现的webui🤔我的rvc模型当然也可以加载到它上面,随便找了一个歌曲测试了下,它的分离流程大概是先分离和声再去混响,约等于我的v2流程(确信🤔但最终产物和我的同歌产物相比,不仅分离的质量不行,我怀疑整首歌质量也不行🤔可能是因为我开启了tta,而它可能还停留在某个旧的分离模型而且没有开tta🤔它唯一能称得上优点的,可能只有显存占用小力,,,🤔

qwen3.8 27b

现在最火的而且也是智能程度最高的小模型,官方模型就已经表现得非常不错,更何况它有无限的后训练提升空间,,,但我既然花5090部署它力,那肯定要部署它的uncensored版本,不然为什么我不去provider用它,而我都花钱用provider力,为什么我不用deepseek v4.1 flash(27b并没有因为它参数量小就收费少很多🤔部署下来效果还行,4bit量化大概占17GB显存,开启上下文到128k占到了22GB,开到256k占用28GB🤔考虑到我还开了mtp,最后我撅腚只开128k🤔mtp对推理的提速取决于这个实例的gpu有没有和别人共享,不共享的情况下它能干到接近100tps,如果有人在用的话就只能达到30甚至20力(悲🤔100tps的体验基本上持平deepseek v4.0 flash🤔

接下来我的其他几个容器都部署了dsh,端脑云实例也是个容器,所以它也可以部署个dsh🤔但它有一系列的坑,比如http路径什么的需要额外折腾,不然就会发生一个请求卡好几秒的逆天bug,一看网络请求,大概十成甚至⑨成的网络请求完全发错了地址,就这样它还有10%甚至⑨%的可能性居然能发出去也是神🤔whatever,它这个dsh被我调教好后,我就可以原汤话原食,让它的dsh使用它自己部署的27b模型做事🤔比如,分析它这个容器的资源🤔

在一顿野兽分析后,它得出了结论,尽管系统内存高达512GB,但它这个容器能够使用的内存资源居然只有96GB,,,那它官网写的128GB内存是何意味啊🤔whatever,现在回头再看deepseek v4.0 flash的混合部署方案,显存+内存至少得有170GB,好,我现在知道端脑云是完全没法部署uncensored版本的deepseek v4.0 flash力(撅望🤔

yolobitte

我还顺便在上面部署了一个之前做的yolo训练推理框架,随便找了个人脸数据集进行训练,实测5090的训练速度大概是我本机矿卡的16倍,反正快的1b🤔不过推理时,同一张图远程实例和本机的推理时间居然几乎完全一致,都是60ms,可还行🤔这个速度基本上意味着5k@30fps的视频也能实时标定人脸框(确信🤔话说yolo这种东西推理时需要gpu吗,,,🤔

next grossprojekt

接下来我希望能够用ai做点后端开发之外的玩意,比如,,,gpt6不是号称它能够随便玩blender或者任意游戏引擎吗,不是可以随便突破closedai的内网然后黑hf偷答案吗,那么我让它将尾行3逆向拆解一番并且在任意现代游戏引擎(比如烂大街的three.js)里重新实现一遍,应该不过分⑧,,,🤔但接下来就有一个一个一个一个问题,gpt这个b模型,它连开发个jiaotu全自动注册脚本都不愿意,让它去逆向,更别提逆向尾行3,,,那它的安全护栏第一个一个一个一个不答应啊啊啊啊啊(全恼🤔而如果我用deepseek或者glm干的话,又感觉不怎么行?🤔

我现在还在构思阶段,大概需要一系列的xx工程,,,比如,我不能上来就将尾行3的目录扔给它然后让它立即用three.js写个浏览器版尾行3,我得先,,,找个逆向专用skill,然后用deepseek v4 pro来先逆向尾行3,分解出它的资源(这一步也没那么难,经常做illusion游戏mod的盆友都知道,我们有114514款解包工具,哪怕它们不见得能用cli调用),分析出它的各种逻辑?然后才能用另外一个模型来写游戏🤔用three.js来写3d游戏已经算是烂大街的llm测试项目力,至少在裸模型时代就已经便乘了一项传统,当然也是llm输学的重要组成部分(至少某些进化未完全的玩意儿叫嚣“评分没输过、实测没赢过”时,它们所谓的实测部分十成甚至⑨成包括拿three.js写游戏,但这和我这种拿ai写discord bot等后端的又有什么鸡巴关系捏,,,),但拿three.js写hentai游戏?这应该是ai游戏史上的第一小步,没有先例,没有任何已知的成功案例,我甚至寻思它能不能过安全护栏这一关,我甚至寻思用ai搜寻关于它的任何信息会不会触发它的安全护栏(悲🤔

所以,这就是为什么我还是需要部署一个uncensored版本的deepseek v4.0 flash的,至少它可以做hentai游戏这一部分?🤔而deepseek v4.0 pro搞逆向其实已经非常成熟力,尽管我还没试过,但已经有很多成熟的skills可以做到这点,它们连gpt都可以雷普(当然,以closedai账号光速被橄榄为代价),雷普个deepseek或者glm又有啥难度?🤔我甚至还看到一个手机版的全自动破解器,它看上去像luckypatcher,但比前者牛批114514倍,前者只会套模板,它可是个破解专精agent,直接使用模型(比如我看到它可以使用deepseek v4.0 pro)干🤔很不幸的是我没有root了的手机,估计没法用它(撅望🤔

der amodaigang

AAAAAAAArene.26.09.07

上一周和申必docker项目、zzz和其他一些玩意展开了吉列的豆蒸🤔在我折腾了不知多少天增量docker镜像(其中包括将几百MB的组件每次更新代码都带进去)后,终于有一天我开始切pro模型,然后让它重新构造docker部署方式🤔然后,它端出了一个除代码外的其他组件全部塞进基础镜像的方案,现在我可以随便爽力,全程基础镜像貌似只更新过一次,之后都只需要将一个400KB左右的代码拷进去构建增量镜像即可(确信🤔

除此之外我闲得鸡巴蛋疼做了个监控抵抗系直播间的玩意,它能向我的discord频道推送xx主播上下播的消息,至于哪些主播是抵抗系主播,,,我让它去迷宫干饭人的视频列表⑧,毕竟录播视频的介绍里就有主播的直播间地址(确信🤔既然它能监控上下播信号,那么用这个信号指导全自动录播也是可行的,况且全自动录制批站视频的cli软件早就有力(🤔在一顿迫真缝合后,现在我也有了抵抗系录播up几乎同款的抵抗系录播系统,我再也不用等直播结束后半天才能看录播,我完全可以在直播开始时就开始看🤔它这些flv格式的录播感觉和youtube的延时直播一样,也可以选择在直播开始一段时间后从或者从任何已经录播的地方开始看(确信🤔

昔琏bot的生图部分没啥进展,但我哼哼改进了端脑云远程实例和昔琏bot调度它的部分,首先我现在有十个甚至⑨个休眠实例,真的用不着每生成一首歌就全鸡巴唤醒一遍,哪怕后面将它们都关掉也得浪费20cep甚至更多(恼🤔取而代之的是它接到任务后会一个一个一个一个检查显存啊啊啊啊啊🤔但在接第二个甚至更多任务时,它才暴露出更多bug,比如明明有⑨个休眠实例,它只会在当前开机的实例后面排队,而不会再唤醒一台(🤔这部分我改了十遍甚至⑨遍,甚至将所有实例全部唤醒然后更新了远程代码十次甚至⑨次,才勉强能并行(悲🤔接下来也许我可以再开几台,开到12或者16🤔只不过我每开一台新的就得多花至少100CEP,毕竟有那么一两分钟它不可避免地要正常计费(全恼🤔

到今天出现了全新的挑战,,,基元律动突然收紧了使用额度,比如它关掉了邀请功能,导致一个手机号只能整一份(大概是68)而非以前的两份,而更蛋疼的是就这一份也没法正常激活,无论是通过dsh还是通过它的agent,无论怎么瞎几把用,余额长期只会停留在⑨左右(全恼🤔差不多就今天早上,某fisch上所有基元律动的普号从之前的1.7左右涨到了3.7🤔看来我得寻找新的provider力,,,🤔

接下来我找到了一个叫做SenseAudio的申必provider,它现在注册起来还是比较容易的,体现在哪怕用0.12的号也能注册,就是邀请注册给的余额比较少,只有20🤔换句话说新号一次性可以薅40,新注册无条件给的20加上邀请的20🤔但这玩意并不需要整什么官方客户端请求才能激活🤔除了llm外它的api还提供tts模型、asr模型甚至生图/生视频模型,但这些东西收费非常滴坑爹,感觉不如端脑云(大嘘)提供的服务,,,🤔我那边可是有传说中的歌曲全自动端到端翻唱,哪怕它做得非常粗糙,处理某些歌曲效果非常差,但我真的没见到别处有任何形式的类似玩意,,,🤔

下一步当然是将其全部署到远程的几个dsh实例上,我之前还真做了几个部署脚本,这玩意也可以做类似脚本,几分钟搞定(确信🤔它看起来比基元律动的key稳定,用量少的话可以一直挂着(确信🤔

aicicd.26.09.01

最近在整一个需要部署到内网docker的项目,我每次完成开发都需要在我的vps上跑一段申必代码构建镜像🤔在我一番迫真折腾后,这套玩意理论上来说包括三部分,第一部分是一个接近2GB的base image,这部分基本上不会动,第二部分是每次更新代码都会变化的上层镜像,第三部分当然是容器,现在我需要在vps上做的就是准备第二部分的文件(这里包括使用npm补全所有依赖包等),打包到生产环境上构建上层镜像🤔

然后,我发现那台vps,居然登不上力(悲🤔我这边倒是有一系列的替代方案,比如那些装dsh的docker容器🤔既然远程公网vps也好docker容器也好需要做的只是搜集内网构建镜像需要的包,所以它本身能不能跑docker没那么重要(确信🤔手工跑命令居然能跑完全程,不错,接下来可以让ai尝试自己干🤔

在114514番摸索后,dsh连上了目标容器的dsh,掌握了启动它上面文件管理和终端插件的方法,哟西,以后每次更新功能后都能触发全自动构建离线包🤔有ai后做ci/cd就是方便,哪怕这种看起来不像vps的玩意都能用(确信🤔如果没有ai的话,想搞这种ci/cd就得依靠github actions,我当然会写它的workflow,但首先这玩意极其麻烦,其次像这种场景得手动执行一次git commit(还得是commit到远程的那种)才能触发,,,现在有ai,甚至都不用额外说明,每更新一次代码就能自动git commit和跑一次ci/cd(确信🤔