惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - 司徒正美
Google DeepMind News
Google DeepMind News
P
Palo Alto Networks Blog
SecWiki News
SecWiki News
S
Secure Thoughts
P
Privacy International News Feed
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
T
Tenable Blog
W
WeLiveSecurity
Application and Cybersecurity Blog
Application and Cybersecurity Blog
A
Arctic Wolf
D
Darknet – Hacking Tools, Hacker News & Cyber Security
Spread Privacy
Spread Privacy
V2EX - 技术
V2EX - 技术
Project Zero
Project Zero
C
CERT Recently Published Vulnerability Notes
Security Archives - TechRepublic
Security Archives - TechRepublic
Hacker News: Ask HN
Hacker News: Ask HN
Cyberwarzone
Cyberwarzone
Hacker News - Newest:
Hacker News - Newest: "LLM"
S
Schneier on Security
L
Lohrmann on Cybersecurity
阮一峰的网络日志
阮一峰的网络日志
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Scott Helme
Scott Helme
H
Hacker News: Front Page
博客园 - Franky
月光博客
月光博客
D
DataBreaches.Net
Know Your Adversary
Know Your Adversary
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
O
OpenAI News
N
Netflix TechBlog - Medium
G
GRAHAM CLULEY
Engineering at Meta
Engineering at Meta
博客园 - 叶小钗
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
B
Blog
人人都是产品经理
人人都是产品经理
I
Intezer
酷 壳 – CoolShell
酷 壳 – CoolShell
云风的 BLOG
云风的 BLOG
IT之家
IT之家
V
Vulnerabilities – Threatpost
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
L
LangChain Blog
Google Online Security Blog
Google Online Security Blog
博客园 - 聂微东
Hugging Face - Blog
Hugging Face - Blog
雷峰网
雷峰网

thinkingReed

ColPali:使用视觉语言模型的高效文档检索 VisionThink:通过强化学习实现高效的视觉语言模型 ChartMoE:使用混合专家架构的图表理解方法 基于标记级相关性引导的压缩方法以实现高效的多模态文档理解 PACT:基于剪枝和聚类的Token减少方法 DocLayLLM:一种用于富含文本的文档理解的高效多模态大语言模型扩展方法 mPLUG-DocOwl 2:高分辨率文档理解的布局感知压缩方法 mPLUG-DocOwl 1.5 研究报告:模型架构与位置编码机制 mPLUG-DocOwl:面向无OCR文档理解的统一结构学习 QG-VTC:基于问题引导的视觉Token压缩方法 MinerU 技术报告:高精度文档内容提取解决方案 StrucTexT:多模态Transformer的结构化文本理解框架 TabPedia:统一的表格理解视觉语言模型 Pix2Struct:截图解析作为视觉语言理解预训练方法 TextMonkey:用于文档理解的无OCR大型多模态模型 Swin Transformer:分层视觉Transformer DocPedia:频域方法实现高分辨率文档理解 领域特定的大语言模型用于通过有标签数据监督微调的暖通空调系统故障诊断 将知识从大模型迁移到小型下游模型
Vision Transformer:将Transformer应用于图像分类任务
2025-04-29 · via thinkingReed
论文简介 目前,Transformer架构已经广泛的应用于自然语言处理任务,但是在计算机视觉领域的应用任然有限。 目前,视觉领域的主流架构仍然是卷积神经网络(CNN),我们的研究表明,一个纯粹的Transformer模