dshadvanced.26.08.28

这几天我在之前几个白嫖容器的基础上又做了些什么,比如给dsh加了一个文件管理和终端的功能🤔出于某种申必原因,这算是修改webui,所以dsh必须重启才能做任何更改(恼🤔

所以我在部署脚本里添加了一项托管dsh进程的功能,这样它就能跟踪哪个pid对应的哪个端口的dsh(没错,通过启动时添加homedir参数,完全可以同时启动多个dsh进程和对应的多个webui,尽管我不是很清楚启动多个dsh事何意味),然后就可以实现基本管理功能,比如开启/关闭/重启🤔

我还整了另外一个号称是32核128GB内存的白嫖vps,它整得极其玄乎,直接嗯塞过来一个一个一个一个200MB大小的apk,然后写着“装这个”🤔我用dsh解析了它,发现这真没那么玄乎,它就是我在杭州时广告打得到处都是的workbuddy(有一说一我在杭州的114514篇游记还没写捏🤔既然知道它是什么,那么它肯定提供了webui版,就像我们之前整的那玩意一样🤔先试试海外版,直接gituhub登录,然后上来就让它直接装dsh,因为它居然没有终端,也没有文件浏览器,我那些插件啥的部署脚本啥的肯定没法用(而且它映射链接的mcp协议肯定也不一样🤔

这个额度就给得极其慷慨,基本上除非一天重启十次甚至⑨次dsh,它应该用不完,当然也有可能它在这里用的是什么申必自研模型而不是flash v4,智能明显偏低,比如它无论改什么玩意都需要重启dsh,其实很多修改至少改个provider模型列表或者更新key是不用重启的🤔但我好奇如果给它也塞那个文件管理和终端的插件,我要如何载入它?总不能直接在agent聊天框里上传⑧🤔看来,我也许还应该实现一个文件服务器的功能,这样别的在线dsh实例就可以共享文件?(🤔

另外docker容器探测出来的资源基本上是图一乐,毕竟隔壁端脑云连gpu都可以共享,为什么我们不会认为这两家的cpu和内存不是共享的?🤔

cyrenebot.webui

既然我有好几个可以远程使用的agent,那么为什么不尝试让它跑点别的在线服务?除了昔琏bot当然可以在它上面运行,至少在那几个海外实例上运行外,我还可以更进一步,将其重构成webui版,外加支持用api发送请求,做其他agent的生图后端🤔在我本地的dsh上发起重构命令,不到一小时,它就撸出了一个webui版,它移除了所有和生图无关的命令,然后除了使用bot上相同的pls语法外,它还支持参数化json提供生图请求🤔当然后者是给agent用的,而且我怀疑它理解错了我的意思,gui的功能居然是动态拼接pls字符串,而非调用参数化json🤔whatever,反正这个功能我用不着,就这样🤔

实测效果还行,至少我经常用的并发几十个生图请求可以塞进一个任务里面🤔生成图像后它会提供jiaotu cdn的链接,不清楚这个链接有没有时间限制,但至少它能用🤔至于蓝奏上传,在海外版实例里面经常不成功,国内版成功率稍微高些,但也没那么高,,,🤔

现在看来,昔琏bot的脚本进程在这些实例上也没那么稳定,比如那个内存小的是挂在它的终端上跑的,它这个终端有一定的维持会话的能力,但不多🤔而使用我自己插件的终端,那它就完全维持不了,几分钟就断线(估计我得继续开发它,比如加维持终端和多终端的能力),哪怕用screen启动它,对应的screen也会被橄榄🤔估计脚本本身需要实现某种维持自己的能力,比如加个-d参数来以daemon运行,然后就可以使用stop/restart命令关闭或者重启它,,,🤔

但无论如何,这是我第一次用一个一个一个一个参数量连300B都没有的flash模型来执行重构请求,而且它干得还不错🤔下次我们尝试用什么,qwen 3.8 27b?🤔

model update

有一说一,基元律动现在还真上了27b模型,尽管我不是很清楚通过api调用27b模型是何意味啊,,,🤔但有这么一个选项也不是什么坏事,哪怕它现在token多得用不完,至少开发内网系统时可以在开发阶段调用它跑测试(毕竟内网系统里其实使用的模型就是这种类型的,而非什么qwen max之类的🤔与此同时阿里自己的官方api那真是黑心价,一个3.5的35b-a3b模型居然敢要输入0.4输出3.2,啊?🤔

除此之外它还添加了几个别的模型,甚至还加了两个生图模型,我本机的dsh当然光速更新力,但那几个云端实例的dsh需要折腾一番,比如先更新部署provider的脚本,然后它是那边部署全套玩意脚本的一部分,需要用--force参数透传进去才能强行刷新provider,但无论如何这是一条命令能搞定的事(确信🤔但workbuddy的那个实例,,,由于它连终端都没有,我只能将新provider参数粘贴进去让它看着改🤔

ryzathonk

顺便一提,我日后或者就今天,打算开一个一个一个一个叫做“带和llm笑话”的专题,专门用来讲某岛国llm相关的笑话,,,今天是第0篇

制作atelier ryza的某岛国厂商最近制作了一个ryzawaifu主题ai(接下来简称ryzallm),号称使用了他们拥有的巨量ryzawaifu相关数据(比如剧情文本、图像资产甚至语音,,,但这算优势吗?因为你去解包atelier ryza也可以获得这些巨量数据,除非他们录制了没放出来的数据,比如ryzawaifu浪叫啥的,,,)对某阿里开源模型进行了微调啥的,据说能够提供迫真的ryzawaifu体验,甚至还有申必asmr tts环节🤔但最你妈生草的是它的模型定价,据说比牢美最顶尖的模型还要高十倍甚至⑨倍,我们假设这里说的牢美最顶尖模型是a畜的fable 5,那么这个ryzallm的输入高达50美元/Mtoken,输出高达500美元/Mtoken,啊?🤔说得像是真有神人会将ryzallm接入claude code/codex/dsh编程一样,,,等等,如果我们对deepseek v4 flash或者qwen 3.8 27b使用大量ryzawaifu台词进行微调,然后接入dsh,会发生什么?

我们接下来可以大胆假设,假设它是个全模态模型,那么它的asmr tts输出的其实是传说中的音频token?那这个定价就不好说力,比如ryzawaifu说了一句asmr,可能就不是几十token,而是成百上千?而如果它居然还支持用户上传图片,使得岛国incel能够对着ryzallm上传迪克图片,那么输入token也会高达成千上万,,,有意思🤔

当然我不撅得岛国有任何折腾全模态模型的能力(包括微调),这种东西在扮演二刺螈萌妹方面确实有无限潜力,但也不是岛国能够碰瓷的,它更有可能诞生在米社的实验室里,,,🤔退而求其次的方案现在反倒是多得很,也不是那么需要微调某模型,就套一层系统提示词模板,就可以在酒馆上和ryzawaifu或者别的waifu对话力(确信🤔至于其他模态,,,音频可以用非常成熟的gpt-sovits,只要中等的gpu就可以实现实时或者近实时tts,视频模态也有一系列的数字人模型可以在比如5090上跑,稍微改改就可以将其从3d数字人改成2d数字人?🤔反正效果肯定比暗荣的这套逼玩意好(确信🤔

wait,,,让我看眼云端agent的调研结果,,,🤔什么叫做它一个月980jpy的订阅只能对话45次(估计和某个共享gemini站一样,用户向模型发送一次请求就算一次),还需要额外按次买对话次数?而且这额外的对话次数定价更坑,一句文本生成就得花一块五,语音生成鬼知道多少🤔这还不如按输入输出token收费捏,,,我他妈ai翻唱一首歌都不需要花一块五(全恼🤔什么叫做它压根就没有全模态,语音是tts,图像是古法绘画?啊?🤔还有这他妈是什么?

官方解释:实时AI运算、语音生成的服务器运行成本高昂,高定价是硬件成本所迫。

海外社区曝出案例,有玩家单晚消费超135美元(约合人民币907.29元),刻意引导AI生成挑衅、低俗向剧情,完全偏离官方预设的夏日冒险温馨基调。

哇~如果微调个目测只有文字模态的llm并且跑个推理(我赌5日元这个llm的参数量不会超过T,因为上个擅长角色扮演的开源模型deepseek v3也就671B而已,,,),然后再跑个tts就产生了高昂的服务器运行成本,,,啊?🤔如果这是真的,那我只能说你虹的ai产业算是完鸡巴犊子力,如果这是假的,那十成甚至⑨成是因为暗荣的llm部门全是一群欺上瞒下的佐藤专员,搁那儿玩什么虚报成本十倍甚至⑨倍的狠活,那我寻思你虹的ai产业仍然算是完鸡巴犊子力(吴慈悲🤔还有那个花135美元的送财童子,,,吴语,典型的incel思维(撅望🤔

thonk.26.08.25

最近在某fisch上发现了一个一个一个一个卖或者说介绍一种神奇的白嫖vps的方法🤔它这个0.1的收费基本上算是象征意义,那我们就姑且买下来打开看🤔

它其实是一种将vps和ai agent打包售卖的玩法,在不清楚是vps还是docker容器的玩意里面跑一个opencode,通过某种acp还是mcp来着连接到webui,这样用户在webui的聊天框里发送指令时,指令就会在那台vps里的opencode上执行🤔更神的是,一个会话居然等于一台vps,而且它目测也不会阻止开多台🤔而且目测这些开出来的vps除了需要每两天多在它对应的ai窗口里说两句话保活外,随便用(确信🤔

那么它这个b玩意是怎么盈利的?很简单,它暗扣token🤔先不说别的,它送的所谓10Mtoken,用deepseek v4 flash随便干两三件事就用完力🤔这官方api说不定都比它坚挺🤔

whatever,既然它自带的ai服务不行,那我们就往上面装一个dsh🤔刚好dsh也是以webui形式提供的服务🤔现在我们可以看到dsh采用webui模式的好处力,搭配一个几乎完全免费的docker容器,它将是史上最强agent,,,(确信🤔直接打开它的文本框,输入安装dsh,就能搞定,不仅能装上还能映射出一个外网域名来,这一步就能花掉将近4M🤔然后它肯定没法正常用,因为dsh web不带某个参数的话肯定只能本地访问🤔接下来让它尝试修这个bug,换句话说用另外一个参数重新启动dsh web🤔

接下来没啥好说的,导入我之前的某个脚本塞入基元律动的provider🤔但在key方面又有问题,这个脚本构造的凭据文件是牢dsh格式,但dsh现在用的是新格式,理论上来说重启它肯定会自动做一次转换,但半途更改这个文件,它肯定就没法加载力(撅望🤔改完格式之后终于可以用dsh爽力🤔基本上可以认为dsh比它那个opencode跑的webui可以说是高级114514倍,还不用给它掏模型钱(确信🤔

接下来它和原装webui还差一样东西,那就是将本地的任意服务映射到外网域名的能力🤔在一番挖掘后,它发现这玩意就是里面的opencode的一项mcp,不花多少时间我就将它做成了一个一个一个一个py脚本啊啊啊啊啊🤔

理论上来说,现在我可以将来时路整合一遍,做一个大号py脚本将所有功能缝合起来,这样下次再开个vps,我只需要每天对着那玩意的原装窗口输入output exactly: ojbk即可,然后打开它的终端,执行我的脚本,然后hopefully它能配置好一切,,,

dsh.26.08.24

这段时间实在是没空写东西🤔在我回去的下一个星期一,deepseek api进行了大幅度涨价,现在基本上涨到一天就要用七八块钱的程度,我用的还是deepseek v4 flash,还不是pro(恼🤔

但我已经找到了撅佳的替代品,一个一个一个一个叫做基元律动的第三方provider🤔它已经搞了很长一段时间活动,貌似只要注册+使用它的agent就能获得68块钱的token(它激活的方式居然是拿它默认创建的api key塞进它的官方agent,但我怀疑可能只要它这个api被调用了就算🤔懒得注册也可以买成品号,1.7到2块钱左右🤔不清楚它的deepseek定价,但实测一个号还是能用很长时间的,我基本上用半周到一周才用完余额(确信🤔

dsh

就在deepseek的官方api涨价后几天,它终于推出了官方agent,deepseeek harness🤔我用了它不到一小时,就想将codex里的所有项目都迁移过去,和dsh相比codex简直是垃圾中的垃圾,它居然不支持随便切模型,配置第三方provider居然需要第三方工具,改配置居然需要重启,相比之下dsh埃及⑧加什么provider就能加什么,而且加完后撅大多数情况下不用重启,刷新下webui就能在模型列表里看到新模型,更别提它是个webui,换句话说关掉浏览器它该跑的任务仍然能在后台跑🤔也许现在的chatgpt独立应用也可以做到,但我已经懒得用codex系力,,,

那没啥好说的,直接让dsh来分析基元律动的agent,在消耗了差不多五块钱的官方api后,dsh抓到了它的api endpoint并且光速做了集成,接下来我就可以扔掉官方api开始随便爽力,,,🤔当然它那个agent也不至于一无是处,和dsh相比它可以用多个开源模型来智能路由,甚至有一定的多模型合并撅策功能(可能是什么sakana ai同款能力,,,),但这些东西还是太耗费token力,塞进dsh只用v4 flash也许可以多用几天?🤔

我还接了另外一个provider,貌似叫做SenseNova,它和基元律动相比甚至不要钱,但它可用性更遭,基元律动如果只是间歇性503啥的(被我魔改dsh重试十次甚至⑨次勉强解决),它可能只发送几轮请求就报告耗尽了一天的限额,啊?🤔它还有一个生图模型,接入昔琏bot后发现它完全没法遵循任何指令,反正做aigc肯定是不行的,,,🤔

除此之外,我自建的sub2api中转站也可以接进去,它上面居然还有几个gpt free账号能用,估计是它们存活了超过两个月甚至一个月,触发了月度重置🤔一直以来不是很清楚它这些free号居然支持gpt 5.5是何意味,毕竟如果将它们真的接入codex,估计随便一个小任务就能橄榄它的额度,除非对它下一个长程任务让它跑到负额度这种玩法对free也有效🤔但现在,它们除了5.5和5.4 mini外居然还支持5.6的terra和luna,考虑到luna现在降到了和deepseek官方api的flash差不多的价格,也许free号能用相当长时间的luna?更何况我那里有十个甚至⑨个🤔极其不幸的是我那一个一个一个antigravity号被橄榄力啊啊啊啊啊,不然dsh还可以使用gemini和claude模型(悲🤔

当然一个agent接各种异构模型真的不是什么魔法,毕竟在十年甚至⑨年前(大嘘)claude code就能随便用任何模型,,,只不过我是常用codex的,而codex离了gpt模型表现就像⑩一样,如果不论接入它本身就需要一番魔改的话🤔与此同时deepseek到v4正式版才开始兼容/responses,而目前我可以观测到第三方deepseek的这一兼容层也经常出错(🤔

接下来我就将我的两个主力项目迁移到了dsh上继续开发,用的是flash,它居然能继续开发下去,端脑云的项目添加了两个版本的推理工作流,昔琏bot添加了114514项新功能,和以前用gpt几乎没有啥区别(确信🤔也许我这b活确实用不到什么T级别的模型做,但考虑到v4 flash的参数量居然只有不到300B,比v3还要少一半,我是感到十分甚至⑨分震惊的🤔毕竟上次我在内网里测了235B模型,无论是claude code还是codex都完全没法用,鉴定为参数量不够编程的🤔不清楚是不是dsh对deepseek模型有申必加成,反正它现在居然能用力🤔看来,等我回去要不要说服大模型平台的同事部署个v4 flash上去,替换掉它那儿老掉牙的v3?🤔

现在对于moe模型还有邪修玩法,将它的一大部分放进内存里进行动态调度,据说一个5090就能跑v4 flash,甚至tps还能达到勉强能用级🤔我也许还真有这样的环境,比如端脑云,它就是5090+超大内存(能检测到的有512GB),硬盘不清楚有多少,但装个量化版v4 flash应该随便装(确信🤔问题就是无论官方api还是基元律动这样的第三方都能随便跑100tps以上,这就非常尴尬力🤔这样,私有云部署只有一个用途,那就是部署拆掉安全护栏的版本,,,

deepthonk.26.08.12

终于,在114514天(大嘘)的折腾之后,这b竞赛被我整完力,而且没有任何意外地没有拿到任何奖,,,🤔

但意外的事情也有,在竞赛前几天,在我尝试给未来十成甚至⑨成的没拿奖构造借口时,我可能会说我拿不到奖是因为黑色高级智能体没怎么练,是因为我可能完全做不出它声称的两道难题中的一到两道(指连框架都搭不出来🤔但等我真的到了赛场开始做智能体构建时,我 释 然 力,它这个b参赛机居然只插了一根4GB的ddr4内存,有一种他们某员工偷偷拔掉品牌机预装内存倒卖的美,,,🤔或者我们不妨大胆假设(大嘘),为什么它还能有4GB?那当然是因为ddr4平台的最小内存大小就是4GB,如果这是个ddr3的话,恐怕只给2GB用,,,

再加上它的cpu也非常奇怪,装了一个amd的不知道多少核的玩意,一会儿说四核,一会儿说10核,估计是某种大小核组合但系统居然是win10,反正长期占有率没有低于100%的,评价为甚至不如我的n3150主板或者n5105笔记本,,,总之,当打开百度千帆这个64GB内存也不见得能流畅用的傻逼玩意之后,它卡出了新境界,打开一个工作流agent需要几分钟,创建一个节点或者编辑一个节点需要几秒,我寻思真的部署codex撸工作流或者现场手撸langgraph可能会快些,因为它不用和百度千帆的屎山js代码打交道?🤔

但无论如何,我顶着这种逆天延迟,创建了两个自主规划agent,一个叫做promptgen,一个叫做codegen,然后使用了我上个月花7500(不包含吃饭和吃海鲜还有一天买三回啊三回冰镇饮料的钱)学到的真功夫(大嘘),趁我还没忘掉,光速写了一个元·元系统提示词(其实本质上是一段带关键词的咒语,分别是角色、能力、目标、约束、工作流、预期输出,然后前面随便加点东西后面随便加点东西)进去,它吐出了一长段系统提示词,将其塞进promptgen的系统提示词,然后就可以用它来构造codegen的系统提示词,然后理论上来说接下来就可以横着走,别说三小时四道题,三小时五道题都可以随便整,考虑到它可以使用deepseek v4 pro,我也许可以让它直接生成工作流yaml,,,但实际上,这个b机子最多只能打开一个或者两个标签页,当我同时开启promptgen和codegen时,试题的工作流可能就打不开力(撅望🤔反正到最后,我只有codegen能用,promptgen死活打不开,提示词没法润色,我就瞎鸡巴写了一些看起来像提示词的东西,毕竟作为ai中级高手,我又不是完全不会写提示词,只不过我懒得像刚才提及的申必咒语那样组织它们,,,

最后四道题完成了三道,第四道理论上来说最难的题完全没时间做🤔说是有两道送分题,但为什么我觉得前三道都是送分题捏,,,

wiebitte

到了晚上甚至下午,它们突然在群里通知,用ai写代码 竟 然 不 许🤔啊?你是一个、一个一个一个一个ai竞赛啊啊啊啊啊,不让用ai写代码是何意味啊(全恼🤔要我说就应该全面开启自由搏击模式,codex?装!gpt/claude/deepseek/任意其他模型?接入!32GB内存?插!然后四小时八道难题,埃及吧怎么整怎么整,,,🤔我估计要是真自由搏击的话,我可能在时限内能完成5到6道?比如我之前能用gpt的时候就干过端对端的codex百度千帆工作流yaml生成,效果还不错,能勉强过验收,时间差不多是一道题25到30分钟,如果预设skills优化某些流程+强行开启codex的/fast模式也许能压缩到20分钟内,然后让它实现全自动截图填答题卡,反正肯定比我手动填快(确信🤔

whatever,看来我大概明白为什么我没拿任何奖力,十成甚至⑨成是因为我早上一边使用codegen一边使用promptgen一去主工作流拉 电 线 哈 哈(大嘘),让检查我录屏的哈基米疯狂哈气,,,然后清零了我的智能体实战成绩(全恼🤔

deepseek

与此同时,今天还是waifu impact新版本的更新日,国际服下载速度还是那么感人(全恼🤔我寻思要不要用codex对hoyoplay进行一个一个一个一个逆向,看能不能做个平台无关的cli下载器,重新实现智子下载器但不依赖一个刚需gpu的gui而且能够开启多线程🤔

我可能忘了我已经有很长时间没有给codex接入正经gpt力,我现在接的是deepseek v4 flash,,,它居然真的尝试对hoyoplay的dll进行一番静态分析,但分析到一半它突然使用了一套申必关键词进行联网搜索,发现了一个已经实现了的第三方智子下载器,从github上拖下来它进行了一番分析,然后撸出来了一个单文件🤔它基本上只需要多装一个zstandard就能用,不仅能下国际服,还能下国服,语言包也能随便选,反正比官方gui强十倍甚至⑨倍🤔

在修复了一个下载前预分配空间的bug(这不是官方下载器的行为)之后,我对着国际服安装包进行256线程雷普,现在它终于用完了全部带宽,,,🤔尽管之后可能会无限卡最后几个包,但此时我退出重来,设个比较小的线程数就能彻底搞完,最后我可能只花了三十多分钟就撸完力(确信🤔

最终这个b玩意只花了七毛,还是比较便宜的(确信🤔gpt还能用的时候可能比它还要便宜?但首先现在gpt不能用,其次它遇到这种事恐怕只会无脑拒撅,,,🤔