这几天我在之前几个白嫖容器的基础上又做了些什么,比如给dsh加了一个文件管理和终端的功能🤔出于某种申必原因,这算是修改webui,所以dsh必须重启才能做任何更改(恼🤔
所以我在部署脚本里添加了一项托管dsh进程的功能,这样它就能跟踪哪个pid对应的哪个端口的dsh(没错,通过启动时添加homedir参数,完全可以同时启动多个dsh进程和对应的多个webui,尽管我不是很清楚启动多个dsh事何意味),然后就可以实现基本管理功能,比如开启/关闭/重启🤔
我还整了另外一个号称是32核128GB内存的白嫖vps,它整得极其玄乎,直接嗯塞过来一个一个一个一个200MB大小的apk,然后写着“装这个”🤔我用dsh解析了它,发现这真没那么玄乎,它就是我在杭州时广告打得到处都是的workbuddy(有一说一我在杭州的114514篇游记还没写捏🤔既然知道它是什么,那么它肯定提供了webui版,就像我们之前整的那玩意一样🤔先试试海外版,直接gituhub登录,然后上来就让它直接装dsh,因为它居然没有终端,也没有文件浏览器,我那些插件啥的部署脚本啥的肯定没法用(而且它映射链接的mcp协议肯定也不一样🤔
这个额度就给得极其慷慨,基本上除非一天重启十次甚至⑨次dsh,它应该用不完,当然也有可能它在这里用的是什么申必自研模型而不是flash v4,智能明显偏低,比如它无论改什么玩意都需要重启dsh,其实很多修改至少改个provider模型列表或者更新key是不用重启的🤔但我好奇如果给它也塞那个文件管理和终端的插件,我要如何载入它?总不能直接在agent聊天框里上传⑧🤔看来,我也许还应该实现一个文件服务器的功能,这样别的在线dsh实例就可以共享文件?(🤔
另外docker容器探测出来的资源基本上是图一乐,毕竟隔壁端脑云连gpu都可以共享,为什么我们不会认为这两家的cpu和内存不是共享的?🤔
cyrenebot.webui
既然我有好几个可以远程使用的agent,那么为什么不尝试让它跑点别的在线服务?除了昔琏bot当然可以在它上面运行,至少在那几个海外实例上运行外,我还可以更进一步,将其重构成webui版,外加支持用api发送请求,做其他agent的生图后端🤔在我本地的dsh上发起重构命令,不到一小时,它就撸出了一个webui版,它移除了所有和生图无关的命令,然后除了使用bot上相同的pls语法外,它还支持参数化json提供生图请求🤔当然后者是给agent用的,而且我怀疑它理解错了我的意思,gui的功能居然是动态拼接pls字符串,而非调用参数化json🤔whatever,反正这个功能我用不着,就这样🤔
实测效果还行,至少我经常用的并发几十个生图请求可以塞进一个任务里面🤔生成图像后它会提供jiaotu cdn的链接,不清楚这个链接有没有时间限制,但至少它能用🤔至于蓝奏上传,在海外版实例里面经常不成功,国内版成功率稍微高些,但也没那么高,,,🤔
现在看来,昔琏bot的脚本进程在这些实例上也没那么稳定,比如那个内存小的是挂在它的终端上跑的,它这个终端有一定的维持会话的能力,但不多🤔而使用我自己插件的终端,那它就完全维持不了,几分钟就断线(估计我得继续开发它,比如加维持终端和多终端的能力),哪怕用screen启动它,对应的screen也会被橄榄🤔估计脚本本身需要实现某种维持自己的能力,比如加个-d参数来以daemon运行,然后就可以使用stop/restart命令关闭或者重启它,,,🤔
但无论如何,这是我第一次用一个一个一个一个参数量连300B都没有的flash模型来执行重构请求,而且它干得还不错🤔下次我们尝试用什么,qwen 3.8 27b?🤔
model update
有一说一,基元律动现在还真上了27b模型,尽管我不是很清楚通过api调用27b模型是何意味啊,,,🤔但有这么一个选项也不是什么坏事,哪怕它现在token多得用不完,至少开发内网系统时可以在开发阶段调用它跑测试(毕竟内网系统里其实使用的模型就是这种类型的,而非什么qwen max之类的🤔与此同时阿里自己的官方api那真是黑心价,一个3.5的35b-a3b模型居然敢要输入0.4输出3.2,啊?🤔
除此之外它还添加了几个别的模型,甚至还加了两个生图模型,我本机的dsh当然光速更新力,但那几个云端实例的dsh需要折腾一番,比如先更新部署provider的脚本,然后它是那边部署全套玩意脚本的一部分,需要用--force参数透传进去才能强行刷新provider,但无论如何这是一条命令能搞定的事(确信🤔但workbuddy的那个实例,,,由于它连终端都没有,我只能将新provider参数粘贴进去让它看着改🤔
ryzathonk
顺便一提,我日后或者就今天,打算开一个一个一个一个叫做“带和llm笑话”的专题,专门用来讲某岛国llm相关的笑话,,,今天是第0篇
制作atelier ryza的某岛国厂商最近制作了一个ryzawaifu主题ai(接下来简称ryzallm),号称使用了他们拥有的巨量ryzawaifu相关数据(比如剧情文本、图像资产甚至语音,,,但这算优势吗?因为你去解包atelier ryza也可以获得这些巨量数据,除非他们录制了没放出来的数据,比如ryzawaifu浪叫啥的,,,)对某阿里开源模型进行了微调啥的,据说能够提供迫真的ryzawaifu体验,甚至还有申必asmr tts环节🤔但最你妈生草的是它的模型定价,据说比牢美最顶尖的模型还要高十倍甚至⑨倍,我们假设这里说的牢美最顶尖模型是a畜的fable 5,那么这个ryzallm的输入高达50美元/Mtoken,输出高达500美元/Mtoken,啊?🤔说得像是真有神人会将ryzallm接入claude code/codex/dsh编程一样,,,等等,如果我们对deepseek v4 flash或者qwen 3.8 27b使用大量ryzawaifu台词进行微调,然后接入dsh,会发生什么?
我们接下来可以大胆假设,假设它是个全模态模型,那么它的asmr tts输出的其实是传说中的音频token?那这个定价就不好说力,比如ryzawaifu说了一句asmr,可能就不是几十token,而是成百上千?而如果它居然还支持用户上传图片,使得岛国incel对着ryzallm上传迪克图片,那么输入token也会高达成千上万,,,有意思🤔
当然我不撅得岛国有任何折腾全模态模型的能力(包括微调),这种东西在扮演二刺螈萌妹方面确实有无限潜力,但也不是岛国能够碰瓷的,它更有可能诞生在米社的实验室里,,,🤔退而求其次的方案现在反倒是多得很,也不是那么需要微调某模型,就套一层系统提示词模板,就可以在酒馆上和ryzawaifu或者别的waifu对话力(确信🤔至于其他模态,,,音频可以用非常成熟的gpt-sovits,只要中等的gpu就可以实现实时或者近实时tts,视频模态也有一系列的数字人模型可以在比如5090上跑,稍微改改就可以将其从3d数字人改成2d数字人?🤔反正效果肯定比暗荣的这套逼玩意好(确信🤔
wait,,,让我看眼云端agent的调研结果,,,🤔什么叫做它定价是一个月50的订阅之外还需要额外按次买对话次数?这还不如按输入输出token收费捏,,,(全恼🤔什么叫做它压根就没有全模态,语音是tts,图像是古法绘画?啊?🤔