惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

IT之家
IT之家
博客园 - 聂微东
雷峰网
雷峰网
Microsoft Azure Blog
Microsoft Azure Blog
WordPress大学
WordPress大学
Hugging Face - Blog
Hugging Face - Blog
S
SegmentFault 最新的问题
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
T
Tailwind CSS Blog
博客园 - 三生石上(FineUI控件)
V
Visual Studio Blog
博客园 - 司徒正美
爱范儿
爱范儿
月光博客
月光博客
阮一峰的网络日志
阮一峰的网络日志
博客园_首页
博客园 - 【当耐特】
Jina AI
Jina AI
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
酷 壳 – CoolShell
酷 壳 – CoolShell
大猫的无限游戏
大猫的无限游戏
小众软件
小众软件
人人都是产品经理
人人都是产品经理
V
V2EX

LINUX DO - 最新话题

谷歌云盘下载700g数据集,求方法 OpenAI推出了100美元的Pro订阅后,plus的Codex 5小时限额大幅缩水 之前买的super grok居然还没掉 关于CPA认证文件周限 佬们,默认CDK的要求是什么等级啊? 最新版本的微信群聊机器人方案 有没有人知道如何free号没有封,那么是否可以循环使用,因为我看主要是周限 L站改版了?吓我一跳,我以为我浏览器崩了 淘宝这种宽带可信吗,500兆移动宽带月费8元到2099年 docker内部应用访问宿主机mysql和redis时被拒绝connection refuse Erp全栈想转行做Ai有什么推荐的吗 boost有bug 佬们,有没有靠谱点的 Plus 购买渠道 大妈,狗妈用的 lg 服务有源头开源项目吗? 有人有能过验证码打码的嘛 上次帖里好像发过通过大模型来打码的 gpt plus 封号似乎也太快了点,一天就给封号了 按流量/token收费的国产官方AI推荐 我算是知道了为什么Oracle总是ABC了 佬友们帮我分析一下 ChatGPT Team账号只有一个人使用和4个席位邀请满了使用的总额度是一样的吗? gpt-free 10个带rt CPA反代claude是默认1m吗? 我终于敢说我做出来windows上tmux的替代了,目标windows/全平台最强的终端Ai编程工具 claude pro升级max,除了原来的$20,好像还能再领一次$100 关于AI agent的知识框架 独乐乐不如众乐乐,分享一下我的的AI对话程序 佬们自建网站支付问题是怎么解决的 怎么能让gpt模仿claude风格输出 codex free已经死了,下一个会是plus或者team吗 请问chatgpt pro里的fast模式,速度快了,降智吗
新人对公益站(绝大部分)祛魅了,,公益站真能帮你省成本吗...
LL7 (LL7) · 2026-06-22 · via LINUX DO - 最新话题

我是一个刚入站不久的小伙伴。应该大部分兄弟都和我有一样的感觉,这里热度最高且最吸引人的就是各种各样的公益站了。最近虽然在期末考试,但主播不到考前两天没有学的欲望哈哈,于是测试了站里的不少公益站。基本感受可以从稳定性和模型能力两方面来看。
先说结论:几乎所有公益站无一列外的有稳定性问题(主播我只测试过GPT,Claude,glm,deepseekv4pro)模型能力方面则几乎可以认为与稳定性成反比的(神秘人any不适用这条规律)。这么说吧如果一个显然站里很多人知道的站,用起来很丝滑,那么模型能力可以理解为不如deepseek。
下面是一些测试:(首先谢谢各位开公益站的佬,这里没有任何责怪的意思,只是为了让跟我一样的新人尽量不要再花费大量的时间研究各种公益站,用简单的方式让像我一样的新人能更明确自己要什么。自然有人需要免费的,有人在意稳定性和能力,所以大家尽量不要在帖子下写什么“免费的还要什么自行车”之类的话哦,大家理性讨论)
1:某地方的GPT 5.5 100 出题人 (疑似看不惯Claude的做题风格给2扣了两分)
2:某地方的Claude opus 4.8 98分 (我给100,裁判扣分理由可以理解为解题过程不够详细,就像高中数学老师总是叫你把做题步骤写详细,但我就喜欢不写那些每个这种类型题都要写的简单且字多的步骤。。。也许这套题目根本没让Claude大人尽兴??)
3:网页deepseek-V4 flash 81 (梁文峰大佬没得喷)
4:月城APIGPTcodex 100 我记得是月城佬把一些用不完的放公益站了,没得说,不过这是佬刚开站时我赶上了抢到了额度,现在也陷入稳定性-模型能力曲线了??

5:君的claude-opus-4.6claudecode 97 (分是AI打的实际按我观察与几个信得过的渠道的顶级AI模型答案对比的话,在其它分数不变的情况下,这个我只能给93,因为他在提交的正式答案文件里先写了一遍错误的然后又在后面说实际上应该是怎样的。同时残留文件也是最多的)

6:星辰中转deepseekclaudecode(到第六题没钱了接了5的模型) 89.5分 (这个我是真疾苦了中转里的deepseek我以为只会比官网贵一点我就直接用了,结果竟然是不降价版本的deepseek吗) 耗时很长忘统计了 耗费巨大6块左右只到第五题。

7:官方正版deepseek v4 proclaudecode 98.5分(第六题有错误) 用时11分钟左右 耗费0.89元(还好是有错误,,不然感觉题得换一份了。不过即使没有错误,他也有大量残余文件,虽然我提示词并未要求最后要干净,但129这三个我完全信得过的顶级渠道最终输出都是完全干净的一份.md正式答案文件,从这方面我觉得还是有不小差距)

8:站内某中转 最便宜的GPT分组 99.5分(说是按严格标准扣0.5,宽松标准可给满分) 用时9分钟多 耗费0.121

9anyrouter 100分 挤进去后用时11分钟多 耗费0 (真的强没得说)
不想看这么多可以只看5789。
问答:
1.为什么只测试这么点公益站??
很简单,绝大多数败在了稳定性这关,这种中等难度的任务断断续续的,基本可以认为不可用了,我确实是试了不少知名的公益站总结出的体会。
2.你不是说测了glm吗?
glm5.2很强,确实感觉是比deepseek强一档的模型,最起码在这种中等难度的任务下,本人没有接触任何工程级长而复杂的任务,在这种条件下我觉得也不会用公益站吧哈哈,这里没有是因为数据丢失了,刚出这个模型的那几天测试的当时没想着发帖,所以当时的测试就随手删了哈哈。
3.中转站的多快好省?这么强?
确实我也没想到最便宜的GPT分组有这么强(虽然我只测一个中转站的,但是站内其它佬的应该也是一样的)如果你的任务不是什么超级复杂且重要的任务,那我推荐大家用就对了。
4.主播自己还会用什么公益站吗?
首先是any没得说,特别是晚上人少的时候。然后是月城佬的,没什么别的原因,我花LDC买了额度呀 :sob:。然后还有一些好玩的站比如津巴布韦币站(希望佬能在站里开发点花津巴布韦币赌博的游戏呀,让我体验一把亿万富翁的感觉哈哈)。

这几天感觉在薅羊毛上花费了不少时间,我也应该好好反思一下自己。说实话这种好用又便宜的东西就看一个缘分,花时间去追求的花实在是没有必要。好好提升自己才是真的,接下来我快要读研了(AI infra相关),要是过程中有什么令我欣喜的发现或者成长也可能会分享到L站来的。再次感谢L站,以及感谢各位愿意花时间和精力经营公益站的佬们。

下面是测试题和提示词,感觉上是不够难,如果再来一次我会让Claude出一份加难版的题目,最好让deepseek-v4-pro上不了90哈哈。(传不了.md直接转的.txt不确定有没有问题)
FRT-CN-v2.0 - 副本.txt (16.4 KB)

image