惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

T
The Blog of Author Tim Ferriss
小众软件
小众软件
S
Schneier on Security
S
Securelist
P
Proofpoint News Feed
D
DataBreaches.Net
博客园_首页
S
Security Affairs
Application and Cybersecurity Blog
Application and Cybersecurity Blog
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
博客园 - Franky
C
Check Point Blog
GbyAI
GbyAI
H
Help Net Security
The Register - Security
The Register - Security
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
雷峰网
雷峰网
博客园 - 叶小钗
WordPress大学
WordPress大学
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
T
The Exploit Database - CXSecurity.com
L
LINUX DO - 热门话题
C
Cybersecurity and Infrastructure Security Agency CISA
SecWiki News
SecWiki News
T
Threatpost
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
T
Tenable Blog
H
Hacker News: Front Page
宝玉的分享
宝玉的分享
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Hacker News - Newest:
Hacker News - Newest: "LLM"
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
C
CERT Recently Published Vulnerability Notes
Google Online Security Blog
Google Online Security Blog
P
Privacy & Cybersecurity Law Blog
N
News | PayPal Newsroom
M
MIT News - Artificial intelligence
P
Privacy International News Feed
博客园 - 三生石上(FineUI控件)
美团技术团队
S
SegmentFault 最新的问题
Forbes - Security
Forbes - Security
Last Week in AI
Last Week in AI
Spread Privacy
Spread Privacy
酷 壳 – CoolShell
酷 壳 – CoolShell
IT之家
IT之家
Cyberwarzone
Cyberwarzone
博客园 - 聂微东
Hugging Face - Blog
Hugging Face - Blog
Engineering at Meta
Engineering at Meta

机器学习

llama.cpp 服务开启 embedding 是否稳定? - V2EX 深度学习的 LLM 就像受伤的大脑 大语言模型会被其他技术取代吗? - V2EX llm 训练最 dirty work 的就是数据处理! - V2EX 做机器学习强烈推荐看看 MIT 18.S096 矩阵微积分 - V2EX 求助微信聊天记录训练 ai - V2EX 请问 AI 训练大佬 : 目前大家不写 blog, stackoverflow 等,如何训练新的优质数据,还是拿 AI 数据训练自己? - V2EX 想要真正理解目前的深度学习(不仅是打杂的炼丹师),需要怎样的数学基础 - V2EX 怎样加快 onnx 模型在 cpu 上的推理速度啊 - V2EX AI 公司瞄准的顺序是浏览器、输入法、操作系统 - V2EX 有什么能本地跑的机器学习项目吗? - V2EX 求助 使用 ddddocr 自训练模型场景下,遇到了 onnxruntime.capi.onnxruntime_pybind11_state.InvalidArgument - V2EX BERT 论文复现: 经验 & 教训 - V2EX 求推荐一些 LLM/深度学习方面打基础的书籍或者课程 - V2EX 2025 年底,如果想做一个图像分类模型,用什么模型来微调比较好 - V2EX 目前使用 yolov8 训练了一个目标检测模型,但是上线使用效果不是很好,怎么优化? - V2EX 最近看 1-2 万主机发现 3090 还是能打的 - V2EX 想做有声小说声音克隆, 3060Ti 能扛得住吗? - V2EX [AI Glimpse 科普系列] KV Cache 的原理推导与代码实现(基于 GPT2) - V2EX 关于 OCR 以及以图找图识别 - V2EX 这类型的英语学习视频,是用哪个模型生成? - V2EX 怎么实现提取俩个图片的一些特征,然后进行特征比对 - V2EX 检测画面中存在漏水,给点思路 - V2EX 学习 AI, 跑下模型, 应该用什么 N 卡? - V2EX 有没有大佬了解机器学习的 mlops 框架或者平台 - V2EX 如何把本地文件作为大模型的知识库 - V2EX 使用大语言模型进行文本分类任务需要微调吗? - V2EX lima 和 colima 居然是有关系的 - V2EX gpt4o 图像生成的技术讨论(自回归模型又好起来了?) - V2EX [AI Glimpse 科普系列] 不到 100 行 Python 代码从零实现 LLM 的推测采样算法 - V2EX 什么?唠唠嗑就能生成游戏关卡! Unreal Engine + MCP 来了! - V2EX 大模型是如何执行像数学运算、编程等精确性要求比较高的任务的? - V2EX 有没有 LLM 入门的系统学习教程 - V2EX mtranserver 的翻译效果还是差一点 - V2EX 求助,有没有视觉大模型可以识别一个 UI 设计图中各个模块的划分 - V2EX 多模态大模型的大小远低于单文本模型啊。 - V2EX 利用 deepseek 分析医学影像找出结节这是什么技术原理? - V2EX 大语言模型与深度学习书籍推荐 - V2EX 为什么 LLM 不擅长数饺子? - V2EX 突然冒出一个点子,利用现在热门的 AI 来做 web 外挂工具 - V2EX 请问训练或者调试 yolo 用什么配置性价比较高。 - V2EX 大模型能记住所有它训练过的数据吗? - V2EX 如何从头构建一个自己的大模型呢?从底层最基础的神经网络开始实现 - V2EX LLM 静态批处理和 Continuous Batch 相关疑问的求解 - V2EX 有没有久坐提醒类服务,最好是基于啥啥啥模型的那种活体检测。 - V2EX 能推荐个偏实战的 tranformer/LLM 的课程么? 模型部署的姿势 深度学习在自己电脑上跑, Linux 环境,选择 WSL 还是物理机 Ubuntu? - V2EX CUDA 搞深度学习, 1TB 的一块硬盘, C 盘留多大合适? - V2EX 怎么理解 RNN 循环神经网络工作原理? ReLU 函数在 x> 0 的时候也是线性的,套 ReLU 函数是怎么实现激活作用的?
LLMs 文本标签(分类)任务怎么做比较好? - V2EX
CNYoki · 2025-01-06 · via 机器学习

这是一个创建于 524 天前的主题,其中的信息可能已经有所发展或是发生改变。

现在大概有三组共 100 多个标签,用来对多段文本进行分类,是应该设置三个 prompt 分三次进行生成,还是用一个长 prompt ?

另外现在通用型 LLMs 好像对标签工作都不太完美,经常出现标出其他不在字典的标签,或是标签过多之后分类效果不佳。

有没有朋友在做相关工作有经验的,可以分享下方法嘛

  • llms
  • 标签
  • 分类

    5 条回复    2025-01-06 20:42:36 +08:00

    mumbler

    1

    mumbler      2025 年 1 月 6 日   ❤️ 1

    标签分类是大模型的老本行,你只要把标签整理好,让它在标签库里选择,正确率比人高

    模型用 gemini-exp-1206 ,目前最强大的模型,200 万 token 上下文,一次完成不会有问题

    june4

    2

    june4      2025 年 1 月 6 日

    让模型随便自由标,比如标出 1000 个不在字典的标签,然后你把这些多出来的标签设置一个映射到你的 100 个标签,这个映射是一次性的,可以手工完成或 ai 也行。

    CNYoki

    3

    CNYoki      2025 年 1 月 6 日

    @mumbler #1 我现在用的是 Qwen2.5 110B ,文本太多用商用收费模型成本太高了。现在 Prompt 用列表给出了所有标签,但发现效果不是太好(比如说不在给定字典里的标签)。您说的标签整理好,是有什么格式会好一些?

    CNYoki

    4

    CNYoki      2025 年 1 月 6 日

    @june4 #2 最开始也是用的这个方法,但是现在数据量太大了(上百万段文本),发现不在标签字典的结果就太多了

    mumbler

    5

    mumbler      2025 年 1 月 6 日

    @CNYoki #3 格式当然 json 最好,模型用 gemini-exp-1206 ,完全免费的,200 万上下文,比 gpt4o 还强,所有数据一次处理,用什么 qwen 啊