惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

aimingoo的专栏
aimingoo的专栏
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
小众软件
小众软件
WordPress大学
WordPress大学
宝玉的分享
宝玉的分享
L
LangChain Blog
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
D
Docker
Cyberwarzone
Cyberwarzone
腾讯CDC
V
Vulnerabilities – Threatpost
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
AWS News Blog
AWS News Blog
GbyAI
GbyAI
Stack Overflow Blog
Stack Overflow Blog
MyScale Blog
MyScale Blog
C
CERT Recently Published Vulnerability Notes
T
Threat Research - Cisco Blogs
S
Securelist
C
Cybersecurity and Infrastructure Security Agency CISA
Security Archives - TechRepublic
Security Archives - TechRepublic
Know Your Adversary
Know Your Adversary
Security Latest
Security Latest
N
News and Events Feed by Topic
Attack and Defense Labs
Attack and Defense Labs
V
Visual Studio Blog
博客园 - 司徒正美
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
I
Intezer
P
Privacy International News Feed
爱范儿
爱范儿
T
The Exploit Database - CXSecurity.com
O
OpenAI News
云风的 BLOG
云风的 BLOG
博客园_首页
雷峰网
雷峰网
M
MIT News - Artificial intelligence
Project Zero
Project Zero
I
InfoQ
Hacker News: Ask HN
Hacker News: Ask HN
C
Cyber Attacks, Cyber Crime and Cyber Security
N
News and Events Feed by Topic
S
Security Affairs
S
Secure Thoughts
Y
Y Combinator Blog
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
美团技术团队
The GitHub Blog
The GitHub Blog
B
Blog
H
Hacker News: Front Page

机器学习

llama.cpp 服务开启 embedding 是否稳定? - V2EX 深度学习的 LLM 就像受伤的大脑 大语言模型会被其他技术取代吗? - V2EX llm 训练最 dirty work 的就是数据处理! - V2EX 做机器学习强烈推荐看看 MIT 18.S096 矩阵微积分 - V2EX 求助微信聊天记录训练 ai - V2EX 请问 AI 训练大佬 : 目前大家不写 blog, stackoverflow 等,如何训练新的优质数据,还是拿 AI 数据训练自己? - V2EX 想要真正理解目前的深度学习(不仅是打杂的炼丹师),需要怎样的数学基础 - V2EX 怎样加快 onnx 模型在 cpu 上的推理速度啊 - V2EX AI 公司瞄准的顺序是浏览器、输入法、操作系统 - V2EX 有什么能本地跑的机器学习项目吗? - V2EX 求助 使用 ddddocr 自训练模型场景下,遇到了 onnxruntime.capi.onnxruntime_pybind11_state.InvalidArgument - V2EX BERT 论文复现: 经验 & 教训 - V2EX 求推荐一些 LLM/深度学习方面打基础的书籍或者课程 - V2EX 2025 年底,如果想做一个图像分类模型,用什么模型来微调比较好 - V2EX 目前使用 yolov8 训练了一个目标检测模型,但是上线使用效果不是很好,怎么优化? - V2EX 最近看 1-2 万主机发现 3090 还是能打的 - V2EX 想做有声小说声音克隆, 3060Ti 能扛得住吗? - V2EX [AI Glimpse 科普系列] KV Cache 的原理推导与代码实现(基于 GPT2) - V2EX 关于 OCR 以及以图找图识别 - V2EX 这类型的英语学习视频,是用哪个模型生成? - V2EX 检测画面中存在漏水,给点思路 - V2EX 学习 AI, 跑下模型, 应该用什么 N 卡? - V2EX 有没有大佬了解机器学习的 mlops 框架或者平台 - V2EX 如何把本地文件作为大模型的知识库 - V2EX 使用大语言模型进行文本分类任务需要微调吗? - V2EX lima 和 colima 居然是有关系的 - V2EX gpt4o 图像生成的技术讨论(自回归模型又好起来了?) - V2EX [AI Glimpse 科普系列] 不到 100 行 Python 代码从零实现 LLM 的推测采样算法 - V2EX 什么?唠唠嗑就能生成游戏关卡! Unreal Engine + MCP 来了! - V2EX 大模型是如何执行像数学运算、编程等精确性要求比较高的任务的? - V2EX 有没有 LLM 入门的系统学习教程 - V2EX mtranserver 的翻译效果还是差一点 - V2EX 求助,有没有视觉大模型可以识别一个 UI 设计图中各个模块的划分 - V2EX 多模态大模型的大小远低于单文本模型啊。 - V2EX 利用 deepseek 分析医学影像找出结节这是什么技术原理? - V2EX 大语言模型与深度学习书籍推荐 - V2EX 为什么 LLM 不擅长数饺子? - V2EX 突然冒出一个点子,利用现在热门的 AI 来做 web 外挂工具 - V2EX 请问训练或者调试 yolo 用什么配置性价比较高。 - V2EX 大模型能记住所有它训练过的数据吗? - V2EX 如何从头构建一个自己的大模型呢?从底层最基础的神经网络开始实现 - V2EX LLM 静态批处理和 Continuous Batch 相关疑问的求解 - V2EX 有没有久坐提醒类服务,最好是基于啥啥啥模型的那种活体检测。 - V2EX LLMs 文本标签(分类)任务怎么做比较好? - V2EX 能推荐个偏实战的 tranformer/LLM 的课程么? 模型部署的姿势 深度学习在自己电脑上跑, Linux 环境,选择 WSL 还是物理机 Ubuntu? - V2EX CUDA 搞深度学习, 1TB 的一块硬盘, C 盘留多大合适? - V2EX 怎么理解 RNN 循环神经网络工作原理? ReLU 函数在 x> 0 的时候也是线性的,套 ReLU 函数是怎么实现激活作用的?
怎么实现提取俩个图片的一些特征,然后进行特征比对 - V2EX
hmxxmh · 2025-05-13 · via 机器学习

hmxxmh

怎么实现提取俩个图片的一些特征,然后进行特征比对

 

hmxxmh · 2025 年 5 月 13 日 · 4598 次点击

这是一个创建于 397 天前的主题,其中的信息可能已经有所发展或是发生改变。

第 1 条附言  ·  2025 年 5 月 14 日

需求背景和要求:
识别出俩个发票图片中印章是否一致,需要能从颜色、迷糊、粘贴、形状等特征去比对
进度:
抠图我用了 yolov8 去训练了一版,目前卡在了扣完图之后如何去提取特征和进行比对
感谢楼里大佬提供的建议~有后续我同步更新

  • 颜色
  • 形状
  • 清晰度

    22 条回复    2025-05-14 15:47:45 +08:00

    draymonder

    1

    draymonder      2025 年 5 月 13 日

    是想比对图片是否相似/相同么? 建议直接用多模态 LLM

    pulutom40

    2

    pulutom40      2025 年 5 月 13 日 via iPhone

    图片哈希?机器学习+余弦相似度?你直接上两个 demo 图片吧,这么说谁知道你要干啥啊

    sunnysab

    5

    sunnysab      2025 年 5 月 13 日

    可以问一下 AI ?

    不是做这方面的。我有个思路供参考:找到图片中的红色(或其他彩色)部分(如图有两个),取最大的,裁剪出来。和你要比对的印章图缩放到统一大小,然后进行相似度比对。
    如果税号清晰,可以通过税号去做?用一个小的数字识别模型,去识别印章中间区域。

    mumbler

    6

    mumbler      2025 年 5 月 13 日

    多模态大模型一句 prompt 直接搞定,别自己搞算法了,时代过去了

    yolee599

    8

    yolee599      2025 年 5 月 13 日 via Android   ❤️ 1

    分别提取特征点再计算他们之间的欧氏距离

    paopjian

    9

    paopjian      2025 年 5 月 14 日   ❤️ 1

    训练一个检测模型, 专门找盖章的区域然后截取, 再用另一个模型提取印章的信息, 提取特征比较其他印章形状
    原理类似人脸识别, 但是是否 ps 这玩意可不好判断, 一般是边缘突变什么的人工识别

    jamos

    10

    jamos      2025 年 5 月 14 日   ❤️ 1

    import imagehash
    这个算法我用来查找视频中的重复片段,效果是很满意的。

    Image: image1.jpg, Hash: 123456789abcdef0
    Image: image2.jpg, Hash: 123456789abcdef1
    Distance between image1.jpg and image2.jpg: 1

    0d

    11

    0d      2025 年 5 月 14 日   ❤️ 1

    有个专门研究这个问题的领域叫 cvpr ,一般是梯度对比+欧氏距离

    l4mbda

    13

    l4mbda      2025 年 5 月 14 日   ❤️ 1

    @hmxxmh #12 图像特征提取常用特征点类型可以考虑 sift ,superpoint 这种,匹配可以直接用算距离暴力匹配,或者用基于 AI 的方法,比如 superglue 这种

    312ybj

    14

    312ybj      2025 年 5 月 14 日

    读取向量,算余弦相似度,都有现成的库。 不过你还要先扣图,这个就有点麻烦了

    hmxxmh

    15

    hmxxmh      2025 年 5 月 14 日

    @312ybj 抠图我用 yolov8 训练了一版,主要是我不是算法出生的,不知道怎么提特征

    hmxxmh

    17

    hmxxmh      2025 年 5 月 14 日

    @mumbler 主要是资源不允许,而且多模态,只能提供最终是否一致的结果,像中间特征提取环节就不能暴露出接口出来

    312ybj

    18

    312ybj      2025 年 5 月 14 日

    @hmxxmh 用 clip 模型的 Image Encoder , 这个能提取图片的特征

    lyxxxh2

    19

    lyxxxh2      2025 年 5 月 14 日

    对比好办,但是提取特征,应该没专门为印章训练的模型吧。
    让 curosor 拿电商 行人的模型提取特征测试下?
    (应该有更符合的模型 印章感觉挺好对比的 可能可以直接用)

    Norsl

    20

    Norsl      2025 年 5 月 14 日

    需要自己训练个印章模型 然后提向量 对比余弦相似度,可以拿人脸模型的代码去训练一个 推荐 arcface

    pulutom40

    21

    pulutom40      2025 年 5 月 14 日 via iPhone

    图章都是红色吗?就你这个图片,如果都是红色,直接取 R 通道数据,然后图章就出来了

    pulutom40

    22

    pulutom40      2025 年 5 月 14 日 via iPhone

    如果不全是红色,图章都是圆的吗?都是圆的就变成了找圆算法,也能解决,如果既不是红色,又不是圆的,那就麻烦了