这段时间实在是没空写东西🤔在我回去的下一个星期一,deepseek api进行了大幅度涨价,现在基本上涨到一天就要用七八块钱的程度,我用的还是deepseek v4 flash,还不是pro(恼🤔
但我已经找到了撅佳的替代品,一个一个一个一个叫做基元律动的第三方provider🤔它已经搞了很长一段时间活动,貌似只要注册+使用它的agent就能获得68块钱的token(它激活的方式居然是拿它默认创建的api key塞进它的官方agent,但我怀疑可能只要它这个api被调用了就算🤔懒得注册也可以买成品号,1.7到2块钱左右🤔不清楚它的deepseek定价,但实测一个号还是能用很长时间的,我基本上用半周到一周才用完余额(确信🤔
dsh
就在deepseek的官方api涨价后几天,它终于推出了官方agent,deepseeek harness🤔我用了它不到一小时,就撅腚codex是垃圾中的垃圾,它居然不支持随便切模型,配置第三方provider居然需要第三方工具,改配置居然需要重启,相比之下dsh想加什么provider就可以加什么,而且加完后撅大多数情况下不用重启,刷新下webui就能在模型列表里看到它,更别提它是个webui,换句话说关掉浏览器它该跑的任务仍然能在后台跑🤔也许现在的chatgpt独立应用也可以做到,但我已经懒得用codex系力,,,
那没啥好说的,直接让dsh来分析基元律动的agent,在消耗了差不多五块钱的官方api后,dsh抓到了它的api endpoint并且光速做了集成,接下来我就可以扔掉官方api开始随便爽力,,,
除此之外,我自建的sub2api中转站也可以接进去,它上面居然还有几个free账号能用,估计是它们存活了超过两个月甚至一个月,触发了月度重置🤔一直以来不是很清楚它这些free号居然支持gpt 5.5是何意味,毕竟如果将它们真的接入codex,估计随便一个小任务就能橄榄它的额度,除非对它下一个长程任务让它跑到负额度这种玩法对free也有效🤔但现在,它们除了5.5和5.4 mini外居然还支持5.6的terra和luna,考虑到luna现在降到了和deepseek官方api的flash差不多的价格,也许free号能用相当长时间的luna?更何况我那里有十个甚至⑨个🤔极其不幸的是我那一个一个一个一个antigravity号被橄榄力啊啊啊啊啊,不然dsh还可以使用gemini和claude模型(悲🤔
接下来我就将我的两个主力项目迁移到了dsh上继续开发,用的是flash,它居然能继续开发下去,和以前用gpt几乎没有啥区别(确信🤔也许我这b活确实用不到什么T级别的模型做,但考虑到v4 flash的参数量居然只有不到300B,比v3还要少一半,我是感到十分甚至⑨分震惊的🤔毕竟上次我在内网里测了235B模型,无论是claude code还是codex都完全没法用,鉴定为参数量不够编程的🤔不清楚是不是dsh对deepseek模型有申必加成,反正它现在居然能用力🤔看来,等我回去要不要说服大模型平台的同事部署个v4 flash上去,替换掉它那儿老掉牙的v3?🤔
现在对于moe模型还有邪修玩法,将它的一大部分放进内存里进行动态调度,据说一个5090就能跑v4 flash,甚至tps还能达到勉强能用级🤔我也许还真有这样的环境,比如端脑云,它就是5090+超大内存(能检测到的有512GB),硬盘不清楚有多少,但装个量化版v4 flash应该随便装(确信🤔问题就是无论官方api还是基元律动这样的第三方都能随便跑100tps以上,这就非常尴尬力🤔这样,私有云部署只有一个用途,那就是部署拆掉安全护栏的版本,,,