惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Recent Announcements
Recent Announcements
博客园 - Franky
博客园 - 三生石上(FineUI控件)
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Apple Machine Learning Research
Apple Machine Learning Research
云风的 BLOG
云风的 BLOG
人人都是产品经理
人人都是产品经理
博客园 - 【当耐特】
L
LangChain Blog
Stack Overflow Blog
Stack Overflow Blog
H
Help Net Security
爱范儿
爱范儿
罗磊的独立博客
博客园_首页
美团技术团队
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
月光博客
月光博客
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
量子位
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
博客园 - 叶小钗
V
Visual Studio Blog
T
Tailwind CSS Blog

LINUX DO - 最新话题

谷歌云盘下载700g数据集,求方法 OpenAI推出了100美元的Pro订阅后,plus的Codex 5小时限额大幅缩水 之前买的super grok居然还没掉 关于CPA认证文件周限 佬们,默认CDK的要求是什么等级啊? 最新版本的微信群聊机器人方案 有没有人知道如何free号没有封,那么是否可以循环使用,因为我看主要是周限 L站改版了?吓我一跳,我以为我浏览器崩了 淘宝这种宽带可信吗,500兆移动宽带月费8元到2099年 docker内部应用访问宿主机mysql和redis时被拒绝connection refuse Erp全栈想转行做Ai有什么推荐的吗 boost有bug 佬们,有没有靠谱点的 Plus 购买渠道 大妈,狗妈用的 lg 服务有源头开源项目吗? 有人有能过验证码打码的嘛 上次帖里好像发过通过大模型来打码的 gpt plus 封号似乎也太快了点,一天就给封号了 按流量/token收费的国产官方AI推荐 我算是知道了为什么Oracle总是ABC了 佬友们帮我分析一下 ChatGPT Team账号只有一个人使用和4个席位邀请满了使用的总额度是一样的吗? gpt-free 10个带rt CPA反代claude是默认1m吗? 我终于敢说我做出来windows上tmux的替代了,目标windows/全平台最强的终端Ai编程工具 claude pro升级max,除了原来的$20,好像还能再领一次$100 关于AI agent的知识框架 独乐乐不如众乐乐,分享一下我的的AI对话程序 佬们自建网站支付问题是怎么解决的 怎么能让gpt模仿claude风格输出 codex free已经死了,下一个会是plus或者team吗 请问chatgpt pro里的fast模式,速度快了,降智吗
「LDML」大模型主观排行榜站上线!专门给佬友们讨论评价大模...
markskz (马克MkSaMa) · 2026-05-25 · via LINUX DO - 最新话题

本帖使用社区开源推广,符合推广要求。我申明并遵循社区要求的以下内容:

  • 我的帖子已经打上 开源推广 标签:
  • 我的开源项目完整开源,无未开源部分:
  • 我的开源项目已链接认可 LINUX DO 社区:
  • 我帖子内的项目介绍,AI生成、润色内容部分已截图发出:
  • 以上选择我承诺是永久有效的,接受社区和佬友监督:

以下为项目介绍正文内容,AI生成、润色内容已使用截图方式发出


项目 github 地址(求点个 star):

LDML 网站链接:https://ld-ml.cn

关于给佬友们用的大模型投票排行榜的民意征集 继续讨论:

经过艰苦卓绝 疯狂摸鱼 的vibe开发,我非常高兴的宣布 LDML (LinuxDo Model Leaderboard)大模型排行榜网站上线了!!啪啪啪(鼓掌)

前言

之前看到评论区有佬友问道,能不能出一个属于我们L站自己的大模型排行榜,外面的排行榜要么是数据参假,要么是种类不够繁多,同时L站内信息多且杂,想要迅速的获取大模型的能力信息需要翻遍很多帖子才能得出一个结论。由此我决定制作这个LDML网站,专门用于留存大家对于个别大模型的评价和评分,方便讨论以及给他人做参考。

目前仅上线了几个比较新的模型,欢迎佬友们来测试一下,后面几天我会上一些比较冷门的模型充实网站。

使用方法

各位佬友们可以登录本站后点击模型进去进行评分。最后根据所有人的评分均值会对大模型进行排行,为保证平衡,建议各位尽量多的进行评分。由于模型评分存在时效性,算法会根据评分的时间进行权重的改变,越新的评分占均值中的权重更大,以表明最近对于这个模型的评价。

同时本站开放评论功能,欢迎各位佬友写下来关于这个大模型使用的心得和雷点,以供他人参考。

本站会尽量迅速的更新新模型,每次新模型更新会发布公告和L站帖子,同时模型将放置在置顶观察区,一旦模型投票超过50票或者上线时间大于一周,才会移动至正式榜单中进行排名

小福利

为庆祝本站开放,过两天会放出一个抽奖,从给本站贡献票数的人里面,抽取2-3位发放小红包,具体请等待后续福利活动帖。

欢迎各位股东

本站为保证大模型排行的客观性 (主观评分要啥客观) 需要大家的数据进行支持,每个人宝贵的一票,都是对本站的支持,同时非常希望大家能够给本项目的 github 链接点个 star 就算入股了,我在这里感谢大家的支持 orz

本站刚刚开放,难免会有些bug或者不妥的地方。如果对于本站有任何的问题或者建议,都可以直接私信我来反馈,我会以尽快的速度回复并解决所有人的私信。

声明

本 LDML 网站由 马克MkSaMa 一人维护,属于开源公益项目,与Linuxdo论坛官方没有任何关系。

Xsc15926 (Jeff Dean) 2

加个多模态能力吧,这样排行更全面一点

aayang (阿钖) 3

支持一下,很期待社区共建的模型排行榜项目

markskz (马克MkSaMa) 4

感谢建议,刚刚给多模态能力添加上了

zhongruan (钟阮) 5

怎么没有GLM-5V-Tubro

Tenshi520 (我爱珂朵莉) 6

可以再加个世界知识嘛?进去想给Gemini世界知识打满分的,发现没有 :smiling_face_with_tear:

markskz (马克MkSaMa) 7

暂时只录入了几个基础模型,变体模型都没有添加…

markskz (马克MkSaMa) 8

感谢建议,刚给世界知识加上,我这维度是越撑越多了哈哈…

hwang 9

为什么DeepSeek-4-pro 的多模态还有分数的?这是蜜罐吗?


直接把给DeepSeek-4-pro 多模态评分的整个作废吧,其它模型出现无用选项的一样处理,可以减少一些误差 :rofl:

markskz (马克MkSaMa) 10

默认人均多模态的环境下,直接没管它,只能说求粱圣速度出了:rofl:,不过后续确实可以考虑一个屏蔽维度的功能

maud 11

前排支持!期待佬们的评价,感觉还是比外面的测评真实些。

zhongruan (钟阮) 12

这个也不算是变体模型啊,算是多模态旗舰了吧

gavinwang (盖文) 13

都写主观排行榜了,搞那么专业干嘛,选场景(编码、Agent、智能体问答。。。),选好用,就完了,那么多评分我都不敢评了,当然我觉得还能更简单点。。。

markskz (马克MkSaMa) 14

考虑到确实大家对模型能力可能认知没有那么全面,所以可以只投其中自己认为比较熟悉的几项,其他的可以不填

markskz (马克MkSaMa) 16

有个大兄弟想不开给好多文字模型打了全10 :sweat_smile:,我已经给他投票清掉了