惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

WordPress大学
WordPress大学
小众软件
小众软件
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
博客园 - Franky
Jina AI
Jina AI
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Y
Y Combinator Blog
V
Visual Studio Blog
C
Check Point Blog
阮一峰的网络日志
阮一峰的网络日志
U
Unit 42
量子位
人人都是产品经理
人人都是产品经理
博客园 - 聂微东
M
MIT News - Artificial intelligence
爱范儿
爱范儿
B
Blog RSS Feed
MyScale Blog
MyScale Blog
H
Help Net Security
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
美团技术团队
L
LangChain Blog
D
Docker

LINUX DO - 最新话题

谷歌云盘下载700g数据集,求方法 OpenAI推出了100美元的Pro订阅后,plus的Codex 5小时限额大幅缩水 之前买的super grok居然还没掉 关于CPA认证文件周限 佬们,默认CDK的要求是什么等级啊? 最新版本的微信群聊机器人方案 有没有人知道如何free号没有封,那么是否可以循环使用,因为我看主要是周限 L站改版了?吓我一跳,我以为我浏览器崩了 淘宝这种宽带可信吗,500兆移动宽带月费8元到2099年 docker内部应用访问宿主机mysql和redis时被拒绝connection refuse Erp全栈想转行做Ai有什么推荐的吗 boost有bug 佬们,有没有靠谱点的 Plus 购买渠道 大妈,狗妈用的 lg 服务有源头开源项目吗? 有人有能过验证码打码的嘛 上次帖里好像发过通过大模型来打码的 gpt plus 封号似乎也太快了点,一天就给封号了 按流量/token收费的国产官方AI推荐 我算是知道了为什么Oracle总是ABC了 佬友们帮我分析一下 ChatGPT Team账号只有一个人使用和4个席位邀请满了使用的总额度是一样的吗? gpt-free 10个带rt CPA反代claude是默认1m吗? 我终于敢说我做出来windows上tmux的替代了,目标windows/全平台最强的终端Ai编程工具 claude pro升级max,除了原来的$20,好像还能再领一次$100 关于AI agent的知识框架 独乐乐不如众乐乐,分享一下我的的AI对话程序 佬们自建网站支付问题是怎么解决的 怎么能让gpt模仿claude风格输出 codex free已经死了,下一个会是plus或者team吗 请问chatgpt pro里的fast模式,速度快了,降智吗
解决大模型回复又臭又长:内嵌HTML代替纯Markdown——成本和视...
Eeevan (Eeevan) · 2026-05-09 · via LINUX DO - 最新话题

内嵌HTML代替纯Markdown:让大模型回复不再又臭又长 - 开发调优 - LINUX DO
Claude Code 团队成员发文:是时候用 HTML 替代 Markdown 了 - 前沿快讯 - LINUX DO

前面我发布了两个讨论使用Html内嵌渲染来解决目前简单Markdown格式的信息密度低和仅垂直格式造成长度控制失衡的两个痛点的帖子
(对不起,表达能力不太行,写了个长难句)

但是评论区大多在讨论Html的复杂格式会造成Token大量膨胀,对比获得的效果值不值的问题。

因此本帖统计使用内嵌html的回复和不使用内嵌的纯md格式的效果和token消耗的差距


Q1:Git常用命令汇总分类

Token:1275 vs 3856

查看对比截图

Q2:如何在VPS上搭建临时邮箱

Token:1508 vs 2241

查看对比截图

Q3:缓刑和刑期判断

Token:321 vs 716

查看对比截图

Q4:总结X的文章

Token:680 vs 2189

查看对比截图

汇总

问题 纯 MD 内嵌 HTML
Git常用命令 1275 3856
VPS临时邮箱 1508 2241
缓刑判断 321 716
总结文章 680 2189
3684 9002

模型全部采用Sonnet 4.6,各个模型的表现效果有差异,仅供参考

最后

得出基本结论是token可能膨胀到2到3倍,效果应该相对来说是比较显著的,就看你愿不愿意为了这个效果去承受多出的token。

最后的最后

大多数人最html的流式存在误解和质疑,在这里放个视频
PixPin2026-05-0919-04-48

bonono 2

佬,最佳使用的方式是放在 claude.md 或者 agents.md 文件里面,进行全局的一个套用吗?

还有一个重要因素是 markdown 支持流式渲染,适合 AI 边输出边阅读,html 只有输出完了才能阅读,要是有个工具或者 html 模板可以把 markdown 直接渲染成精美卡片 html 那就完美了

效果很nice说实话 :face_with_monocle:
对于日常问答应该是很好的,但是感觉需要长上下文/长对话的场景还是markdown更好?

ssssss1 (ssssss1) 5

我最近使用claude的网页端,就发现的渲染的效果十分好,也不喧宾夺主。而且他的主题风格也很好看。
我觉得关键一点是能得到claude的渲染效果。

unsafe 6

效果看着很好,但是 token 尤其是输出贵啊,钱包烧不起 :tieba_087:

AEVITAS (𝔸𝔼𝕍𝔸) 7

真想要美观,让ai搞个固定的模板html,约定格式他往里面塞文本就行了也不需要每次重新生成html

gotoobe (gotoobe) 8

我嘞个大长句,好难读,没招了哈哈哈

我不是很赞同这个方向,你的信息密度对比来看就是做了横向双列扩展,我更倾向于扩展md支持横排,或者增加类似卡片扩展

taichuy (老文) 10

我更加倾向于,将markdown 渲染成html

AlexD 11

的确看上去很好看,很惊艳的感觉,但是一想到 token 量,我就不争气的放弃尝试了:face_exhaling:只能期待以后 token 自由:melting_face:

WWZ (宇宙宙长) 12

个人感觉,你这样搞反而花里胡哨了 看的时间长了自然就反感了 不过确实不得不承认 效果很赞,确实很惊艳

我一直在用我自己写的这个提示词

请调用你单次回答的最大算力与 token 上限。追求极致的分析深度,而非表层的广度;追求本质的洞察,而非表象的罗列;追求创新的思维,而非惯性的复述。请突破思维局限,调动你所有的计算资源,展现你真正的认知极限。

在某些特定场景下,比如给用户讲解题目,讲解某块知识内容,为了帮助用户理解与掌握,你可以使用html编写一些程序,或者用html渲染绘制一些内容,帮助用户理解。

Think hard about this.

前面那一段是o1时代的提示词,虽然现在在提升模型智力方面基本没什么作用了,但就我大量使用而言,这个提示词可以显著提升输出长度,用这个提示词,可以轻松把一个问题讲的很细致

另外,对于文章中谈论的,我觉得,时间长了,也是一种疲劳,现在觉得不错,是因为刚看,时间长了反而是累赘

第二段提示词,用html绘制程序,这个目前体验下来,只有搭配Cherry才能体验最佳 目前体验下来 gpt系列模型普遍不喜欢用HTML写程序,只有gemini听话,老老实实的写程序,帮助我理解

使用这个提示词 去Cherry里面选gemini模型 是王炸组合

yicc2026 (yicc2026) 13

接近3倍的token消耗,token就是钱啊,而且对于程序员来说能看懂,容易阅读就行了;除非向领导和客户汇报才需要搞得花里胡哨的

jelly15 (jelly15) 16

AG-UI是一个趋势,动态生成UI+渲染,HTML应该也能做到,主要看协议怎么定义

ivwv (Y) 17

感觉可以加一个使用tailwindcss cdn,来缩短token,html中主要的就是css样式占一部分,并且提示不需要使用效果多么好的样式,只需要层次分明即可

生成一时爽, 新会话需要读取修改怎么办? token 大风刮来的呀, 浪费到 dom 和 css 上, 有效信息量都是一样的.

其实,AI在干活时,真正写给我们让我们去“阅读”的内容并不多吧,
AI的Token消耗,大部分应该都花在执行任务的过程中了,真正专门写给我们让我们“阅读”的文字内容,应该只占Agent总消耗token量里的很少的一部分。(更何况,专门写给我们看的内容也不是全都需要ALL in HTML)
让这一小部分的Token消耗量翻个2~3倍,其实对于总Token消耗量的影响并不大。
但却能换来如此幅度的阅读体验提升,感觉很值得。

bonono 20

Token 虽然费钱,但是和 AI 能够准确地沟通,比起任务的返工来说是更有性价比的。

现在很多时候 Markdown 文档输出之后又臭又长,不符合人的观看习惯。其实很多人也会偷懒不去把它看完。里面的关键信息如果说没有得到有效的确认,最终做出来整个任务的产出都会产生偏差,造成整个任务的返工

相较于那一点点文档性的 Token 消耗来说,这些损耗其实是更大的。