wiebitte.26.09.18

我现在已经很长时间没写任何东西力(撅望🤔但如果我能够想起来,而且我有空闲时间,我尽量写点什么,,,

ds4.1flash

就在这段时间里的某一天,小男梁发布了deepseek v4.1 flash,但这玩意最大的噱头其实是“超越4.0 pro”,为了这个噱头甚至愿意关停pro的推理服务并且以flash代之(包括将4.0 pro的请求直接路由到4.1 flash),而不是它又发明了什么新架构🤔具体来说超不超越4.0 pro那鬼才知道,但我实际用下来的效果是基元律动的号消耗得确实慢了很多,以我转deepseek和dsh之后的极高强度开发方式,以前用4.0 pro一个68的号只能用一天甚至半天,切4.1 flash后居然能坚持半周以上🤔而干活方面居然没有任何降低,反正我之前不是也说过,我干的活也许4.0 flash也能随便干,切到4.0 pro或者4.1 flash那算是升级(确信🤔

这中间发生了一个一个一个一个极其尴尬的小 插 曲,当小南梁宣布它极其逆天的以flash代pro计划时,我居然看错了日期,提前接入了官方api的4.0 pro🤔那它当然不会以flash计价,而是pro,,,最后喜提一个请求算上巨量的未缓存输入花掉字面意义上的十块甚至⑨块,毕竟这是官方api(撅望🤔

现在我测试的一大堆第三方provider,只有基元律动接入了4.1 flash,senseaudio现在还停留在4.0 flash,而且它还下线了4.0 pro🤔至于sensenova,它尽管保留了4.0 pro,但它那个rpm限制基本上没法正常用,,,🤔而在没那么喜闻乐见的本地(?)部署方面,如果4.0 flash可以靠混合推理的申必里技在5090上勉强跑起来,4.1 flash想都别想,首先它的参数量直接上到了500B,这和700B左右的glm 5.2已经区别不大力,,,🤔它还采取了申必新架构,尽管有那么200B的东西可以放内存里,但那也意味着剩下300GB最好全放显存里,那我们只能拜了个拜,,,🤔

cyrenebot evelved

出于某种申必原因(其实也没那么申必,无非是我搞到了一个zzz的角色音频数据集),我这两周甚至一周开始对昔琏bot和端脑云定制节点体系进行多轮重大升级🤔这些升级增强了昔琏bot调度容器的能力,使得最多五个线程的批量rvc训练成为可能🤔而推理方面,由于我训练的角色模型突破了70人大关,现在用一个线程推理实在是慢到吴法接受,我设计了一套多线程推理体系,还加上了一个简单的标签系统,通过预填的标签筛选角色,,,但我觉得最有意义的升级是添加了从本地直接上传原歌曲文件的选项,此时填的是它在本机上的绝对路径,这种用法在discord bot上确实很奇怪,但考虑到这个功能只有我一个人用,,,就这样🤔它有两种上传模式,如果是单线程可以直接将歌曲二进制上传到目标节点,但如果是多线程的话,它会先上传到lanzou,然后我在远端实例加强了lanzou链接的解析能力,它现在可以接受lanzou链接作为输入力,,,🤔

而当lanzou链接可以用来输入,那么它就可以用来处理十分钟甚至⑨分钟的歌曲(比如move的某张专辑里的某些超长trance歌曲),那么它的产物(24bit flac)肯定会超过100MB,这样上传lanzou就必然需要分卷打包、降bitdepth到16bit,换句话说一个角色需要上传一个一个一个文件啊啊啊啊啊🤔这需要同时改三部分东西,远端节点需要支持分卷打包、降bitdepth和上传,并返回新格式响应,bot需要能够解析这些响应并且post新格式json,我的批量下载脚本和解析html也需要能够解析新json🤔

至此,以前我将昔琏bot和端脑云节点分开会话开发(然后用一个api文档交换信息)的搞法完全搞不动,我现在已经授权dsh一次性将其纳入同一个会话开发🤔之前那些旧会话只在额外添加一些支线功能(比如给html加个在线播放的功能)时使用(确信🤔在长达三天啊三天的吉列豆蒸开发后,我终于搞定了所有这些玩意,然后我便可以疯狂制作一些牢登音乐的现代萌妹翻唱力,比如gta vice city的某些电台歌曲(其实move歌曲也算牢登音乐🤔

independent node

除此之外,我还设法创建了一个不受昔琏bot管理的端脑云实例,给它装上了简单的服务模块(比如开机之后自动打开comfyui和监控网页的脚本)并且归另外一个dsh会话管理🤔然后在它上面跑了一系列的测试项目,比如:

AICoverGen

这是一个和我的全自动翻唱差不多类型的项目,只不过没我的玩意自动化程度高,我做的是一个bot操纵的api,但这玩意用的是gradio实现的webui🤔我的rvc模型当然也可以加载到它上面,随便找了一个歌曲测试了下,它的分离流程大概是先分离和声再去混响,约等于我的v2流程(确信🤔但最终产物和我的同歌产物相比,不仅分离的质量不行,我怀疑整首歌质量也不行🤔可能是因为我开启了tta,而它可能还停留在某个旧的分离模型而且没有开tta🤔它唯一能称得上优点的,可能只有显存占用小力,,,🤔

qwen3.8 27b

现在最火的而且也是智能程度最高的小模型,官方模型就已经表现得非常不错,更何况它有无限的后训练提升空间,,,但我既然花5090部署它力,那肯定要部署它的uncensored版本,不然为什么我不去provider用它,而我都花钱用provider力,为什么我不用deepseek v4.1 flash(27b并没有因为它参数量小就收费少很多🤔部署下来效果还行,4bit量化大概占17GB显存,开启上下文到128k占到了22GB,开到256k占用28GB🤔考虑到我还开了mtp,最后我撅腚只开128k🤔mtp对推理的提速取决于这个实例的gpu有没有和别人共享,不共享的情况下它能干到接近100tps,如果有人在用的话就只能达到30甚至20力(悲🤔100tps的体验基本上持平deepseek v4.0 flash🤔

接下来我的其他几个容器都部署了dsh,端脑云实例也是个容器,所以它也可以部署个dsh🤔但它有一系列的坑,比如http路径什么的需要额外折腾,不然就会发生一个请求卡好几秒的逆天bug,一看网络请求,大概十成甚至⑨成的网络请求完全发错了地址,就这样它还有10%甚至⑨%的可能性居然能发出去也是神🤔whatever,它这个dsh被我调教好后,我就可以原汤话原食,让它的dsh使用它自己部署的27b模型做事🤔比如,分析它这个容器的资源🤔

在一顿野兽分析后,它得出了结论,尽管系统内存高达512GB,但它这个容器能够使用的内存资源居然只有96GB,,,那它官网写的128GB内存是何意味啊🤔whatever,现在回头再看deepseek v4.0 flash的混合部署方案,显存+内存至少得有170GB,好,我现在知道端脑云是完全没法部署uncensored版本的deepseek v4.0 flash力(撅望🤔

yolobitte

我还顺便在上面部署了一个之前做的yolo训练推理框架,随便找了个人脸数据集进行训练,实测5090的训练速度大概是我本机矿卡的16倍,反正快的1b🤔不过推理时,同一张图远程实例和本机的推理时间居然几乎完全一致,都是60ms,可还行🤔这个速度基本上意味着5k@30fps的视频也能实时标定人脸框(确信🤔话说yolo这种东西推理时需要gpu吗,,,🤔

next grossprojekt

接下来我希望能够用ai做点后端开发之外的玩意,比如,,,gpt6不是号称它能够随便玩blender或者任意游戏引擎吗,不是可以随便突破closedai的内网然后黑hf偷答案吗,那么我让它将尾行3逆向拆解一番并且在任意现代游戏引擎里重新实现一遍,应该不过分⑧,,,🤔但接下来就有一个一个一个一个问题,gpt这个b模型,它连开发个jiaotu全自动注册脚本都不愿意,让它去逆向,更别提逆向尾行3,,,那它的安全护栏第一个一个一个一个不答应啊啊啊啊啊(全恼🤔而如果我用deepseek或者glm干的话,又感觉不怎么行?🤔

我现在还在构思阶段,大概需要一系列的xx工程,,,比如,我不能上来就将尾行3的目录扔给它然后让它立即用three.js写个浏览器版尾行3,我得先,,,找个逆向专用skill,然后用deepseek v4 pro来先逆向尾行3,分解出它的资源(这一步也没那么难,经常做illusion游戏mod的盆友都知道,我们有114514款解包工具),分析出它的各种逻辑?然后才能用另外一个模型来写游戏🤔用three.js来写3d游戏已经算是烂大街的llm测试项目力,至少在裸模型时代就已经便乘了一项传统,当然也是llm输学的重要组成部分(至少某些进化未完全的玩意儿叫嚣“评分没输过、实测没赢过”时,它们所谓的实测部分十成甚至⑨成包括拿three.js写游戏,但这和我这种拿ai写discord bot等后端的又有什么鸡巴关系捏,,,),但拿three.js写hentai游戏?我寻思它能不能过安全护栏这一关(悲🤔

所以,这就是为什么我还是需要部署一个uncensored版本的deepseek v4.0 flash的,至少它可以做hentai游戏这一部分?🤔而deepseek v4.0 pro搞逆向其实已经非常成熟力,尽管我还没试过,但已经有很多成熟的skills可以做到这点,它们连gpt都可以雷普(当然,以gpt pro账号光速被橄榄为代价),雷普个deepseek或者glm又有啥难度?🤔我甚至还看到一个手机版的全自动破解器,它看上去像luckypatcher,但比前者牛批114514倍,前者只会套模板,它可是个破解专精agent,直接使用模型(比如我看到它可以使用deepseek v4.0 pro)干🤔很不幸的是我没有root了的手机,估计没法用它(撅望🤔

der amodaigang

AAAAAAAArene.26.09.07

上一周和申必docker项目、zzz和其他一些玩意展开了吉列的豆蒸🤔在我折腾了不知多少天增量docker镜像(其中包括将几百MB的组件每次更新代码都带进去)后,终于有一天我开始切pro模型,然后让它重新构造docker部署方式🤔然后,它端出了一个除代码外的其他组件全部塞进基础镜像的方案,现在我可以随便爽力,全程基础镜像貌似只更新过一次,之后都只需要将一个400KB左右的代码拷进去构建增量镜像即可(确信🤔

除此之外我闲得鸡巴蛋疼做了个监控抵抗系直播间的玩意,它能向我的discord频道推送xx主播上下播的消息,至于哪些主播是抵抗系主播,,,我让它去迷宫干饭人的视频列表⑧,毕竟录播视频的介绍里就有主播的直播间地址(确信🤔既然它能监控上下播信号,那么用这个信号指导全自动录播也是可行的,况且全自动录制批站视频的cli软件早就有力(🤔在一顿迫真缝合后,现在我也有了抵抗系录播up几乎同款的抵抗系录播系统,我再也不用等直播结束后半天才能看录播,我完全可以在直播开始时就开始看🤔它这些flv格式的录播感觉和youtube的延时直播一样,也可以选择在直播开始一段时间后从或者从任何已经录播的地方开始看(确信🤔

昔琏bot的生图部分没啥进展,但我哼哼改进了端脑云远程实例和昔琏bot调度它的部分,首先我现在有十个甚至⑨个休眠实例,真的用不着每生成一首歌就全鸡巴唤醒一遍,哪怕后面将它们都关掉也得浪费20cep甚至更多(恼🤔取而代之的是它接到任务后会一个一个一个一个检查显存啊啊啊啊啊🤔但在接第二个甚至更多任务时,它才暴露出更多bug,比如明明有⑨个休眠实例,它只会在当前开机的实例后面排队,而不会再唤醒一台(🤔这部分我改了十遍甚至⑨遍,甚至将所有实例全部唤醒然后更新了远程代码十次甚至⑨次,才勉强能并行(悲🤔接下来也许我可以再开几台,开到12或者16🤔只不过我每开一台新的就得多花至少100CEP,毕竟有那么一两分钟它不可避免地要正常计费(全恼🤔

到今天出现了全新的挑战,,,基元律动突然收紧了使用额度,比如它关掉了邀请功能,导致一个手机号只能整一份(大概是68)而非以前的两份,而更蛋疼的是就这一份也没法正常激活,无论是通过dsh还是通过它的agent,无论怎么瞎几把用,余额长期只会停留在⑨左右(全恼🤔差不多就今天早上,某fisch上所有基元律动的普号从之前的1.7左右涨到了3.7🤔看来我得寻找新的provider力,,,🤔

接下来我找到了一个叫做SenseAudio的申必provider,它现在注册起来还是比较容易的,体现在哪怕用0.12的号也能注册,就是邀请注册给的余额比较少,只有20🤔换句话说新号一次性可以薅40,新注册无条件给的20加上邀请的20🤔但这玩意并不需要整什么官方客户端请求才能激活🤔除了llm外它的api还提供tts模型、asr模型甚至生图/生视频模型,但这些东西收费非常滴坑爹,感觉不如端脑云(大嘘)提供的服务,,,🤔我那边可是有传说中的歌曲全自动端到端翻唱,哪怕它做得非常粗糙,处理某些歌曲效果非常差,但我真的没见到别处有任何形式的类似玩意,,,🤔

下一步当然是将其全部署到远程的几个dsh实例上,我之前还真做了几个部署脚本,这玩意也可以做类似脚本,几分钟搞定(确信🤔它看起来比基元律动的key稳定,用量少的话可以一直挂着(确信🤔

aicicd.26.09.01

最近在整一个需要部署到内网docker的项目,我每次完成开发都需要在我的vps上跑一段申必代码构建镜像🤔在我一番迫真折腾后,这套玩意理论上来说包括三部分,第一部分是一个接近2GB的base image,这部分基本上不会动,第二部分是每次更新代码都会变化的上层镜像,第三部分当然是容器,现在我需要在vps上做的就是准备第二部分的文件(这里包括使用npm补全所有依赖包等),打包到生产环境上构建上层镜像🤔

然后,我发现那台vps,居然登不上力(悲🤔我这边倒是有一系列的替代方案,比如那些装dsh的docker容器🤔既然远程公网vps也好docker容器也好需要做的只是搜集内网构建镜像需要的包,所以它本身能不能跑docker没那么重要(确信🤔手工跑命令居然能跑完全程,不错,接下来可以让ai尝试自己干🤔

在114514番摸索后,dsh连上了目标容器的dsh,掌握了启动它上面文件管理和终端插件的方法,哟西,以后每次更新功能后都能触发全自动构建离线包🤔有ai后做ci/cd就是方便,哪怕这种看起来不像vps的玩意都能用(确信🤔如果没有ai的话,想搞这种ci/cd就得依靠github actions,我当然会写它的workflow,但首先这玩意极其麻烦,其次像这种场景得手动执行一次git commit(还得是commit到远程的那种)才能触发,,,现在有ai,甚至都不用额外说明,每更新一次代码就能自动git commit和跑一次ci/cd(确信🤔

dshadvanced.26.08.28

这几天我在之前几个白嫖容器的基础上又做了些什么,比如给dsh加了一个文件管理和终端的功能🤔出于某种申必原因,这算是修改webui,所以dsh必须重启才能做任何更改(恼🤔

所以我在部署脚本里添加了一项托管dsh进程的功能,这样它就能跟踪哪个pid对应的哪个端口的dsh(没错,通过启动时添加homedir参数,完全可以同时启动多个dsh进程和对应的多个webui,尽管我不是很清楚启动多个dsh事何意味),然后就可以实现基本管理功能,比如开启/关闭/重启🤔

我还整了另外一个号称是32核128GB内存的白嫖vps,它整得极其玄乎,直接嗯塞过来一个一个一个一个200MB大小的apk,然后写着“装这个”🤔我用dsh解析了它,发现这真没那么玄乎,它就是我在杭州时广告打得到处都是的workbuddy(有一说一我在杭州的114514篇游记还没写捏🤔既然知道它是什么,那么它肯定提供了webui版,就像我们之前整的那玩意一样🤔先试试海外版,直接gituhub登录,然后上来就让它直接装dsh,因为它居然没有终端,也没有文件浏览器,我那些插件啥的部署脚本啥的肯定没法用(而且它映射链接的mcp协议肯定也不一样🤔

这个额度就给得极其慷慨,基本上除非一天重启十次甚至⑨次dsh,它应该用不完,当然也有可能它在这里用的是什么申必自研模型而不是flash v4,智能明显偏低,比如它无论改什么玩意都需要重启dsh,其实很多修改至少改个provider模型列表或者更新key是不用重启的🤔但我好奇如果给它也塞那个文件管理和终端的插件,我要如何载入它?总不能直接在agent聊天框里上传⑧🤔看来,我也许还应该实现一个文件服务器的功能,这样别的在线dsh实例就可以共享文件?(🤔

另外docker容器探测出来的资源基本上是图一乐,毕竟隔壁端脑云连gpu都可以共享,为什么我们不会认为这两家的cpu和内存不是共享的?🤔

cyrenebot.webui

既然我有好几个可以远程使用的agent,那么为什么不尝试让它跑点别的在线服务?除了昔琏bot当然可以在它上面运行,至少在那几个海外实例上运行外,我还可以更进一步,将其重构成webui版,外加支持用api发送请求,做其他agent的生图后端🤔在我本地的dsh上发起重构命令,不到一小时,它就撸出了一个webui版,它移除了所有和生图无关的命令,然后除了使用bot上相同的pls语法外,它还支持参数化json提供生图请求🤔当然后者是给agent用的,而且我怀疑它理解错了我的意思,gui的功能居然是动态拼接pls字符串,而非调用参数化json🤔whatever,反正这个功能我用不着,就这样🤔

实测效果还行,至少我经常用的并发几十个生图请求可以塞进一个任务里面🤔生成图像后它会提供jiaotu cdn的链接,不清楚这个链接有没有时间限制,但至少它能用🤔至于蓝奏上传,在海外版实例里面经常不成功,国内版成功率稍微高些,但也没那么高,,,🤔

现在看来,昔琏bot的脚本进程在这些实例上也没那么稳定,比如那个内存小的是挂在它的终端上跑的,它这个终端有一定的维持会话的能力,但不多🤔而使用我自己插件的终端,那它就完全维持不了,几分钟就断线(估计我得继续开发它,比如加维持终端和多终端的能力),哪怕用screen启动它,对应的screen也会被橄榄🤔估计脚本本身需要实现某种维持自己的能力,比如加个-d参数来以daemon运行,然后就可以使用stop/restart命令关闭或者重启它,,,🤔

但无论如何,这是我第一次用一个一个一个一个参数量连300B都没有的flash模型来执行重构请求,而且它干得还不错🤔下次我们尝试用什么,qwen 3.8 27b?🤔

model update

有一说一,基元律动现在还真上了27b模型,尽管我不是很清楚通过api调用27b模型是何意味啊,,,🤔但有这么一个选项也不是什么坏事,哪怕它现在token多得用不完,至少开发内网系统时可以在开发阶段调用它跑测试(毕竟内网系统里其实使用的模型就是这种类型的,而非什么qwen max之类的🤔与此同时阿里自己的官方api那真是黑心价,一个3.5的35b-a3b模型居然敢要输入0.4输出3.2,啊?🤔

除此之外它还添加了几个别的模型,甚至还加了两个生图模型,我本机的dsh当然光速更新力,但那几个云端实例的dsh需要折腾一番,比如先更新部署provider的脚本,然后它是那边部署全套玩意脚本的一部分,需要用--force参数透传进去才能强行刷新provider,但无论如何这是一条命令能搞定的事(确信🤔但workbuddy的那个实例,,,由于它连终端都没有,我只能将新provider参数粘贴进去让它看着改🤔

ryzathonk

顺便一提,我日后或者就今天,打算开一个一个一个一个叫做“带和llm笑话”的专题,专门用来讲某岛国llm相关的笑话,,,今天是第0篇

制作atelier ryza的某岛国厂商最近制作了一个ryzawaifu主题ai(接下来简称ryzallm),号称使用了他们拥有的巨量ryzawaifu相关数据(比如剧情文本、图像资产甚至语音,,,但这算优势吗?因为你去解包atelier ryza也可以获得这些巨量数据,除非他们录制了没放出来的数据,比如ryzawaifu浪叫啥的,,,)对某阿里开源模型进行了微调啥的,据说能够提供迫真的ryzawaifu体验,甚至还有申必asmr tts环节🤔但最你妈生草的是它的模型定价,据说比牢美最顶尖的模型还要高十倍甚至⑨倍,我们假设这里说的牢美最顶尖模型是a畜的fable 5,那么这个ryzallm的输入高达50美元/Mtoken,输出高达500美元/Mtoken,啊?🤔说得像是真有神人会将ryzallm接入claude code/codex/dsh编程一样,,,等等,如果我们对deepseek v4 flash或者qwen 3.8 27b使用大量ryzawaifu台词进行微调,然后接入dsh,会发生什么?

我们接下来可以大胆假设,假设它是个全模态模型,那么它的asmr tts输出的其实是传说中的音频token?那这个定价就不好说力,比如ryzawaifu说了一句asmr,可能就不是几十token,而是成百上千?而如果它居然还支持用户上传图片,使得岛国incel能够对着ryzallm上传迪克图片,那么输入token也会高达成千上万,,,有意思🤔

当然我不撅得岛国有任何折腾全模态模型的能力(包括微调),这种东西在扮演二刺螈萌妹方面确实有无限潜力,但也不是岛国能够碰瓷的,它更有可能诞生在米社的实验室里,,,🤔退而求其次的方案现在反倒是多得很,也不是那么需要微调某模型,就套一层系统提示词模板,就可以在酒馆上和ryzawaifu或者别的waifu对话力(确信🤔至于其他模态,,,音频可以用非常成熟的gpt-sovits,只要中等的gpu就可以实现实时或者近实时tts,视频模态也有一系列的数字人模型可以在比如5090上跑,稍微改改就可以将其从3d数字人改成2d数字人?🤔反正效果肯定比暗荣的这套逼玩意好(确信🤔

wait,,,让我看眼云端agent的调研结果,,,🤔什么叫做它一个月980jpy的订阅只能对话45次(估计和某个共享gemini站一样,用户向模型发送一次请求就算一次),还需要额外按次买对话次数?而且这额外的对话次数定价更坑,一句文本生成就得花一块五,语音生成鬼知道多少🤔这还不如按输入输出token收费捏,,,我他妈ai翻唱一首歌都不需要花一块五(全恼🤔什么叫做它压根就没有全模态,语音是tts,图像是古法绘画?啊?🤔还有这他妈是什么?

官方解释:实时AI运算、语音生成的服务器运行成本高昂,高定价是硬件成本所迫。

海外社区曝出案例,有玩家单晚消费超135美元(约合人民币907.29元),刻意引导AI生成挑衅、低俗向剧情,完全偏离官方预设的夏日冒险温馨基调。

哇~如果微调个目测只有文字模态的llm并且跑个推理(我赌5日元这个llm的参数量不会超过T,因为上个擅长角色扮演的开源模型deepseek v3也就671B而已,,,),然后再跑个tts就产生了高昂的服务器运行成本,,,啊?🤔如果这是真的,那我只能说你虹的ai产业算是完鸡巴犊子力,如果这是假的,那十成甚至⑨成是因为暗荣的llm部门全是一群欺上瞒下的佐藤专员,搁那儿玩什么虚报成本十倍甚至⑨倍的狠活,那我寻思你虹的ai产业仍然算是完鸡巴犊子力(吴慈悲🤔还有那个花135美元的送财童子,,,吴语,典型的incel思维(撅望🤔

thonk.26.08.25

最近在某fisch上发现了一个一个一个一个卖或者说介绍一种神奇的白嫖vps的方法🤔它这个0.1的收费基本上算是象征意义,那我们就姑且买下来打开看🤔

它其实是一种将vps和ai agent打包售卖的玩法,在不清楚是vps还是docker容器的玩意里面跑一个opencode,通过某种acp还是mcp来着连接到webui,这样用户在webui的聊天框里发送指令时,指令就会在那台vps里的opencode上执行🤔更神的是,一个会话居然等于一台vps,而且它目测也不会阻止开多台🤔而且目测这些开出来的vps除了需要每两天多在它对应的ai窗口里说两句话保活外,随便用(确信🤔

那么它这个b玩意是怎么盈利的?很简单,它暗扣token🤔先不说别的,它送的所谓10Mtoken,用deepseek v4 flash随便干两三件事就用完力🤔这官方api说不定都比它坚挺🤔

whatever,既然它自带的ai服务不行,那我们就往上面装一个dsh🤔刚好dsh也是以webui形式提供的服务🤔现在我们可以看到dsh采用webui模式的好处力,搭配一个几乎完全免费的docker容器,它将是史上最强agent,,,(确信🤔直接打开它的文本框,输入安装dsh,就能搞定,不仅能装上还能映射出一个外网域名来,这一步就能花掉将近4M🤔然后它肯定没法正常用,因为dsh web不带某个参数的话肯定只能本地访问🤔接下来让它尝试修这个bug,换句话说用另外一个参数重新启动dsh web🤔

接下来没啥好说的,导入我之前的某个脚本塞入基元律动的provider🤔但在key方面又有问题,这个脚本构造的凭据文件是牢dsh格式,但dsh现在用的是新格式,理论上来说重启它肯定会自动做一次转换,但半途更改这个文件,它肯定就没法加载力(撅望🤔改完格式之后终于可以用dsh爽力🤔基本上可以认为dsh比它那个opencode跑的webui可以说是高级114514倍,还不用给它掏模型钱(确信🤔

接下来它和原装webui还差一样东西,那就是将本地的任意服务映射到外网域名的能力🤔在一番挖掘后,它发现这玩意就是里面的opencode的一项mcp,不花多少时间我就将它做成了一个一个一个一个py脚本啊啊啊啊啊🤔

理论上来说,现在我可以将来时路整合一遍,做一个大号py脚本将所有功能缝合起来,这样下次再开个vps,我只需要每天对着那玩意的原装窗口输入output exactly: ojbk即可,然后打开它的终端,执行我的脚本,然后hopefully它能配置好一切,,,

dsh.26.08.24

这段时间实在是没空写东西🤔在我回去的下一个星期一,deepseek api进行了大幅度涨价,现在基本上涨到一天就要用七八块钱的程度,我用的还是deepseek v4 flash,还不是pro(恼🤔

但我已经找到了撅佳的替代品,一个一个一个一个叫做基元律动的第三方provider🤔它已经搞了很长一段时间活动,貌似只要注册+使用它的agent就能获得68块钱的token(它激活的方式居然是拿它默认创建的api key塞进它的官方agent,但我怀疑可能只要它这个api被调用了就算🤔懒得注册也可以买成品号,1.7到2块钱左右🤔不清楚它的deepseek定价,但实测一个号还是能用很长时间的,我基本上用半周到一周才用完余额(确信🤔

dsh

就在deepseek的官方api涨价后几天,它终于推出了官方agent,deepseeek harness🤔我用了它不到一小时,就想将codex里的所有项目都迁移过去,和dsh相比codex简直是垃圾中的垃圾,它居然不支持随便切模型,配置第三方provider居然需要第三方工具,改配置居然需要重启,相比之下dsh埃及⑧加什么provider就能加什么,而且加完后撅大多数情况下不用重启,刷新下webui就能在模型列表里看到新模型,更别提它是个webui,换句话说关掉浏览器它该跑的任务仍然能在后台跑🤔也许现在的chatgpt独立应用也可以做到,但我已经懒得用codex系力,,,

那没啥好说的,直接让dsh来分析基元律动的agent,在消耗了差不多五块钱的官方api后,dsh抓到了它的api endpoint并且光速做了集成,接下来我就可以扔掉官方api开始随便爽力,,,🤔当然它那个agent也不至于一无是处,和dsh相比它可以用多个开源模型来智能路由,甚至有一定的多模型合并撅策功能(可能是什么sakana ai同款能力,,,),但这些东西还是太耗费token力,塞进dsh只用v4 flash也许可以多用几天?🤔

我还接了另外一个provider,貌似叫做SenseNova,它和基元律动相比甚至不要钱,但它可用性更遭,基元律动如果只是间歇性503啥的(被我魔改dsh重试十次甚至⑨次勉强解决),它可能只发送几轮请求就报告耗尽了一天的限额,啊?🤔它还有一个生图模型,接入昔琏bot后发现它完全没法遵循任何指令,反正做aigc肯定是不行的,,,🤔

除此之外,我自建的sub2api中转站也可以接进去,它上面居然还有几个gpt free账号能用,估计是它们存活了超过两个月甚至一个月,触发了月度重置🤔一直以来不是很清楚它这些free号居然支持gpt 5.5是何意味,毕竟如果将它们真的接入codex,估计随便一个小任务就能橄榄它的额度,除非对它下一个长程任务让它跑到负额度这种玩法对free也有效🤔但现在,它们除了5.5和5.4 mini外居然还支持5.6的terra和luna,考虑到luna现在降到了和deepseek官方api的flash差不多的价格,也许free号能用相当长时间的luna?更何况我那里有十个甚至⑨个🤔极其不幸的是我那一个一个一个antigravity号被橄榄力啊啊啊啊啊,不然dsh还可以使用gemini和claude模型(悲🤔

当然一个agent接各种异构模型真的不是什么魔法,毕竟在十年甚至⑨年前(大嘘)claude code就能随便用任何模型,,,只不过我是常用codex的,而codex离了gpt模型表现就像⑩一样,如果不论接入它本身就需要一番魔改的话🤔与此同时deepseek到v4正式版才开始兼容/responses,而目前我可以观测到第三方deepseek的这一兼容层也经常出错(🤔

接下来我就将我的两个主力项目迁移到了dsh上继续开发,用的是flash,它居然能继续开发下去,端脑云的项目添加了两个版本的推理工作流,昔琏bot添加了114514项新功能,和以前用gpt几乎没有啥区别(确信🤔也许我这b活确实用不到什么T级别的模型做,但考虑到v4 flash的参数量居然只有不到300B,比v3还要少一半,我是感到十分甚至⑨分震惊的🤔毕竟上次我在内网里测了235B模型,无论是claude code还是codex都完全没法用,鉴定为参数量不够编程的🤔不清楚是不是dsh对deepseek模型有申必加成,反正它现在居然能用力🤔看来,等我回去要不要说服大模型平台的同事部署个v4 flash上去,替换掉它那儿老掉牙的v3?🤔

现在对于moe模型还有邪修玩法,将它的一大部分放进内存里进行动态调度,据说一个5090就能跑v4 flash,甚至tps还能达到勉强能用级🤔我也许还真有这样的环境,比如端脑云,它就是5090+超大内存(能检测到的有512GB),硬盘不清楚有多少,但装个量化版v4 flash应该随便装(确信🤔问题就是无论官方api还是基元律动这样的第三方都能随便跑100tps以上,这就非常尴尬力🤔这样,私有云部署只有一个用途,那就是部署拆掉安全护栏的版本,,,

deepthonk.26.08.12

终于,在114514天(大嘘)的折腾之后,这b竞赛被我整完力,而且没有任何意外地没有拿到任何奖,,,🤔

但意外的事情也有,在竞赛前几天,在我尝试给未来十成甚至⑨成的没拿奖构造借口时,我可能会说我拿不到奖是因为黑色高级智能体没怎么练,是因为我可能完全做不出它声称的两道难题中的一到两道(指连框架都搭不出来🤔但等我真的到了赛场开始做智能体构建时,我 释 然 力,它这个b参赛机居然只插了一根4GB的ddr4内存,有一种他们某员工偷偷拔掉品牌机预装内存倒卖的美,,,🤔或者我们不妨大胆假设(大嘘),为什么它还能有4GB?那当然是因为ddr4平台的最小内存大小就是4GB,如果这是个ddr3的话,恐怕只给2GB用,,,

再加上它的cpu也非常奇怪,装了一个amd的不知道多少核的玩意,一会儿说四核,一会儿说10核,估计是某种大小核组合但系统居然是win10,反正长期占有率没有低于100%的,评价为甚至不如我的n3150主板或者n5105笔记本,,,总之,当打开百度千帆这个64GB内存也不见得能流畅用的傻逼玩意之后,它卡出了新境界,打开一个工作流agent需要几分钟,创建一个节点或者编辑一个节点需要几秒,我寻思真的部署codex撸工作流或者现场手撸langgraph可能会快些,因为它不用和百度千帆的屎山js代码打交道?🤔

但无论如何,我顶着这种逆天延迟,创建了两个自主规划agent,一个叫做promptgen,一个叫做codegen,然后使用了我上个月花7500(不包含吃饭和吃海鲜还有一天买三回啊三回冰镇饮料的钱)学到的真功夫(大嘘),趁我还没忘掉,光速写了一个元·元系统提示词(其实本质上是一段带关键词的咒语,分别是角色、能力、目标、约束、工作流、预期输出,然后前面随便加点东西后面随便加点东西)进去,它吐出了一长段系统提示词,将其塞进promptgen的系统提示词,然后就可以用它来构造codegen的系统提示词,然后理论上来说接下来就可以横着走,别说三小时四道题,三小时五道题都可以随便整,考虑到它可以使用deepseek v4 pro,我也许可以让它直接生成工作流yaml,,,但实际上,这个b机子最多只能打开一个或者两个标签页,当我同时开启promptgen和codegen时,试题的工作流可能就打不开力(撅望🤔反正到最后,我只有codegen能用,promptgen死活打不开,提示词没法润色,我就瞎鸡巴写了一些看起来像提示词的东西,毕竟作为ai中级高手,我又不是完全不会写提示词,只不过我懒得像刚才提及的申必咒语那样组织它们,,,

最后四道题完成了三道,第四道理论上来说最难的题完全没时间做🤔说是有两道送分题,但为什么我觉得前三道都是送分题捏,,,

wiebitte

到了晚上甚至下午,它们突然在群里通知,用ai写代码 竟 然 不 许🤔啊?你是一个、一个一个一个一个ai竞赛啊啊啊啊啊,不让用ai写代码是何意味啊(全恼🤔要我说就应该全面开启自由搏击模式,codex?装!gpt/claude/deepseek/任意其他模型?接入!32GB内存?插!然后四小时八道难题,埃及吧怎么整怎么整,,,🤔我估计要是真自由搏击的话,我可能在时限内能完成5到6道?比如我之前能用gpt的时候就干过端对端的codex百度千帆工作流yaml生成,效果还不错,能勉强过验收,时间差不多是一道题25到30分钟,如果预设skills优化某些流程+强行开启codex的/fast模式也许能压缩到20分钟内,然后让它实现全自动截图填答题卡,反正肯定比我手动填快(确信🤔

whatever,看来我大概明白为什么我没拿任何奖力,十成甚至⑨成是因为我早上一边使用codegen一边使用promptgen一去主工作流拉 电 线 哈 哈(大嘘),让检查我录屏的哈基米疯狂哈气,,,然后清零了我的智能体实战成绩(全恼🤔

deepseek

与此同时,今天还是waifu impact新版本的更新日,国际服下载速度还是那么感人(全恼🤔我寻思要不要用codex对hoyoplay进行一个一个一个一个逆向,看能不能做个平台无关的cli下载器,重新实现智子下载器但不依赖一个刚需gpu的gui而且能够开启多线程🤔

我可能忘了我已经有很长时间没有给codex接入正经gpt力,我现在接的是deepseek v4 flash,,,它居然真的尝试对hoyoplay的dll进行一番静态分析,但分析到一半它突然使用了一套申必关键词进行联网搜索,发现了一个已经实现了的第三方智子下载器,从github上拖下来它进行了一番分析,然后撸出来了一个单文件🤔它基本上只需要多装一个zstandard就能用,不仅能下国际服,还能下国服,语言包也能随便选,反正比官方gui强十倍甚至⑨倍🤔

在修复了一个下载前预分配空间的bug(这不是官方下载器的行为)之后,我对着国际服安装包进行256线程雷普,现在它终于用完了全部带宽,,,🤔尽管之后可能会无限卡最后几个包,但此时我退出重来,设个比较小的线程数就能彻底搞完,最后我可能只花了三十多分钟就撸完力(确信🤔

最终这个b玩意只花了七毛,还是比较便宜的(确信🤔gpt还能用的时候可能比它还要便宜?但首先现在gpt不能用,其次它遇到这种事恐怕只会无脑拒撅,,,🤔

deepsagasu.26.07.20

昨天下午到晚上的时间去了趟西湖🤔它有一个1号线的站叫龙翔桥来着,这是轨道交通唯一一个在西湖边上的站,理论上来说往西边走上个几百米就到了湖边,极其不幸的是这几百米对自行车来说是进不去的🤔

所以我在外面开始一边看地图一边顺时针绕湖,接下来我发现西湖有大概四分之三的地方,自行车是完全进不去的,包括那个叫做苏堤的湖中通道🤔我最后好像是沿着更外面的杨公堤还是啥来着才绕到了北边🤔只有北边有那么一点点地方,确实可以用自行车骑到湖边,哇,它居然一点护栏都没有,那是真滴牛批🤔用现在流行的tierlist的格式,西湖本身可以给到夯,而它对自行车的友好程度简直是拉完力,评价为远远不如我牢家的几个里面没什么水的湖和水库,那儿至少用自行车可以绕一整圈(全恼🤔

whatever,在我折腾了将近三小时后,我又回到了来的那个地铁站🤔回去之后睡到了凌晨两点,突然想起来zzz还有个小活动没打🤔这b活动居然打完有个成就,好家伙,它不是限时活动吗,那错过这个活动后怎么拿这成就?我估计触发成就的应该是另外一套机制(确信🤔

deepsagasu

接下来我看到一个神奇的三值量化模型,貌似将qwen3.6 27b量化到了4GB(只有1和-1)/8GB(只有1,0和-1),想召唤codex装个,结果发现我的那些无论是plus还是k12订阅都被橄榄力(撅望🤔

所以我只能召唤出deepsagasu,不对,deepseek来装模型🤔这玩意还是比较简单的,在花了八毛之后,它在某个目录塞进去了双值模型和llama.cpp套件,还有一个启动脚本🤔接下来让它将三值模型也下下来,然后给它也写启动脚本,再就是激活了它的多模态能力🤔

这玩意在我那个副机上当然也可以运行,但推理速度巨慢,我拷到主机之后也没好到哪儿去,它居然只有十多tps,甚至不如我之前部署的qwen3.6 35b的2bit量化版🤔当然那个模型是moe这个是dense,确实没法直接比,如果35b那个量化到三值估计也能跑到至少40?🤔我估计扔端脑云的5090上肯定会比6900xt快很多倍🤔

fap oriented programming.26.07.16

今天我就不写前情提要力,反正每次只要构思前情提要,那么正文十成甚至⑨成两三周都写不出来,所以,我撅腚直接开始🤔

我要发明(?)一个全新的编程范式,叫做面向撸管编程,fap oriented programming,简称fop🤔定义为为了准备或者由于现在有114514种生图模型,生成撸管材料,而进行的编程行为🤔比如给昔涟bot添加宏定义功能,这样就能将前几天研究的雷霆提示词微缩到一个申必单词里面,免得我在discord里召唤它们时需要输入几乎和原提示词一样长的咒语🤔再举一个例子,在ai时代之前,对某些paysite写拖站脚本也算fop(确信🤔

那么fop的最高境界是什么?那当然是fap while programming,边撸管边编程,简称fwp🤔当然如果有人或者有机器配合,可以升级成sex while programming,一边做爱一边编程,简称swp,但这是后话🤔

总之fwp还是挺你妈爽的,ai时代其实玩起来不是那么的爽,毕竟生图还是有很长延时的,尤其是我那些雷霆提示词,重试几百遍只能憋出不到十张甚至⑨张图🤔但在古法编程时代,那是真你妈爽,可以一边导一边抓取网络请求,一边导一边写最小bash脚本,一边导一边跑批处理,跑下来的视频可以顺便下下来继续导,差不多导出来的时候视频也几乎全拖完力(确信🤔

建议一开始尝试fwp不要写太复杂的代码,也不要尝试太复杂的网站,先从bash开始🤔而且很简单(大嘘),只需要一边导一边打开浏览器,按f12,抓取关键的网络请求,导出成curl(bash格式),然后在cygwin或者vps上尝试,再往它外侧套个循环,把里面的某些字段替换成变量,再尝试在循环外侧遍历所有页面(甚至需要再套循环🤔然后就可以让它直接跑力,如果有追求的话可以将这段原始代码塞给ai,让它加上记录进度、错误处理、多并发和分布式管理的黑色高级功能,然后一键部署到github actions🤔这些步骤几乎都可以一只手写出来,可以边导边做(确信🤔

行,今天的迫真讲课环节就说这么多🤔

cyrenebot

在一番雷霆排查后,我发现昔涟bot开启了图像提示词后没法准确遵循指令的原因可能是原来的提示词太长力,它跑到了另外一张图上,而哪怕在新提示词里指定了读取两张图的内容进行生成,它也有可能不遵循🤔在我大幅度压缩了新增的提示词长度后,它终于表现得稍微正常了些🤔

那么,我现在可以继续优化力🤔比如,让图像提示词功能可以制作一张文字刚好覆盖满的图片,免得留下一大堆空格🤔但我今天做的更多的是彻底优化zerochan相关网络请求🤔这个逼网站动不动429,而在我的昔涟bot正在和X图展开多个角色吉列的豆蒸时,它哪怕每个请求之间隔了四秒,但那也是单次fanout,而多个fanout之间的时序可没那么好控制,所以还是不可避免地会干出429,所以这次我干脆将所有zerochan相关网络请求塞进了一个队列慢慢草🤔顺便完善了zerochan的缓存机制,现在它连某个角色的图片列表也会缓存,而且由于它的原图居然需要访问详情页才能获取,所以只能要么每次随机到某张图片时才能缓存原图链接,要么在不生图的时候慢慢获取详情页,要么两者都做🤔但图片文件的ossid缓存只有真正生图的时候才做🤔

由于zerochan请求全塞进了本身有cd的串行队列,现在它跑起来反而变慢力(悲🤔但如果缓存完成,以后生图时理论上最多只会多访问zerochan的图片cdn,而由于我早就设置了图片ossid缓存,以后某些萌妹生图时搞不好一个请求都不会往zerochan发(确信🤔

现在它基本上每20次请求能够稳定出一张图,有时候可能两张,而X图基本上一个号一个并发,所以我理论上可以整300并发,换算过来可以同时发起15个角色而且在几分钟后每个角色出一张图🤔而由于它低到离谱的成功率,我这些号的积分甚至不会少多少(🤔

但这对fop或者hwp来说,实在是太你妈慢力(全恼🤔

eulaAAAAAAAA.26.07.15

昨天撸出来的终极aigcp提示词,今天居然完全用不了力(恼🤔X图过滤了我的提示词,导致我得切回图像提示词🤔当然我知道图像提示词开启后自然会影响它生图的成功率,但一个小保底只出一张图,这张图还不是aigcp是你妈何意味啊(全恼🤔我记得昨天它成功率至少也得有个十位数百分比啊🤔

whatever,这么折腾下去,我迟早得再次尝试领些5美元的gcp billing account,然后拿它们开通google api整🤔好在它们是明码标价的,一张nano banana的4k图应该是0.24美元,一个这样的白嫖账号大概等于20张图?🤔但首先我可能得先去昔涟bot集成直接使用google api的功能🤔接下来我就可以将这些撸下来的apikey当作X图账号用(确信🤔

wiebitte

我刚试了114514个trygcp的链接,没一个能用的(全恼🤔但更逆天的是X图现在会生成和原图一毛一样的图片,它是不是完全忽视了我的图片提示词🤔草,这就非常离谱力🤔

等等,有没有一种可能它之前出图的成功率高是因为以前每次失败的请求要重试三次,它都失败才算到失败请求里面?而我现在完全关掉了重试?🤔我需要算下这对我的成功率有什么影响🤔

迫真算了一顿之后,发现以我现在这低到离谱的成功率,将三次重试便乘不重试后,成功率能降低四分之三🤔啊?