惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

WordPress大学
WordPress大学
Martin Fowler
Martin Fowler
Schneier on Security
Schneier on Security
S
Schneier on Security
A
Arctic Wolf
L
LangChain Blog
T
Threatpost
GbyAI
GbyAI
V2EX - 技术
V2EX - 技术
Jina AI
Jina AI
U
Unit 42
P
Proofpoint News Feed
M
MIT News - Artificial intelligence
G
GRAHAM CLULEY
T
The Exploit Database - CXSecurity.com
Spread Privacy
Spread Privacy
F
Fortinet All Blogs
Y
Y Combinator Blog
D
Darknet – Hacking Tools, Hacker News & Cyber Security
C
Cybersecurity and Infrastructure Security Agency CISA
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
月光博客
月光博客
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
F
Full Disclosure
博客园 - 【当耐特】
S
Secure Thoughts
美团技术团队
N
News | PayPal Newsroom
爱范儿
爱范儿
Latest news
Latest news
Microsoft Azure Blog
Microsoft Azure Blog
I
InfoQ
S
Security @ Cisco Blogs
V
V2EX
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
腾讯CDC
The Hacker News
The Hacker News
V
Vulnerabilities – Threatpost
Cyberwarzone
Cyberwarzone
Google Online Security Blog
Google Online Security Blog
N
Netflix TechBlog - Medium
I
Intezer
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
The Last Watchdog
The Last Watchdog
N
News and Events Feed by Topic
T
Tor Project blog
博客园 - 三生石上(FineUI控件)
Security Archives - TechRepublic
Security Archives - TechRepublic
大猫的无限游戏
大猫的无限游戏
Security Latest
Security Latest

少数派

派早报:Google 发布 Fitbit Air 等 - 少数派 「新人报到」確認需求,再開始 - 少数派 从 SOLO 独立开发者社区,我看到了越来越多开发者开始做自己的产品 - 少数派 我怎么管理那些"不常做,但总会忘"的生活事项 - 少数派 人形机器人量产元年,数据才是具身智能的“生死线” - 少数派 BuhoLaunchpad 高度还原 Mac 启动台:开发历程与思考 - 少数派 五年陪伴依然不舍,DIY 换壳后让罗技 MX Master 3 继续服役 - 少数派 新玩意 240|少数派的编辑们最近买了啥? - 少数派 一日一技|为什么你应该关闭 iOS 的键盘声音 - 少数派 我做了个插件和 Skills,一键提取任何网站的设计规范 Design.md - 少数派 住在三四线城市的你,该开始录播客了 - 少数派 甘南秘境,大白高国 - 少数派 AI的审美:谁让把我变成川内倫子 - 少数派 返工怎能不烦恼,打工人片单总有一部是你的「嘴替」 - 少数派 为了让「上厕所」更健康,我做了一个小工具 - 少数派 AI + Skill,能够让生成的文章去除 AI 味吗? - 少数派 新玩意|韶音OpenDots ONE 耳夹式耳机 - 少数派 《美满》| 在每一个春天的晚上相爱(362) - 少数派 新玩意|优篮子 PS01 MagSnap 磁吸支架 - 少数派 自我整合手记 | 我开始早睡了:用稳定规则,为自由托底 - 少数派 用龙虾(OpenClaw)两个多月,我最深的12个体会 - 少数派 听歌时间到,12 张你可能错过的 2025 华语乐坛好专辑 - 少数派 承诺能追吗 - 少数派 macOS 26启动台没了? 我做了个不一样的App启动器 - Keboard - 少数派 《四海为家的人》| INTJ对话INTJ(361) - 少数派 你发过的那些黑历史,是时候一次清干净了 - 少数派 新玩意:安安静静玩,越玩越专注:计客密码机 - 少数派 iPad 用户首次体验 Android 平板:vivo Pad6 Pro - 少数派 数据逻辑强 - 少数派 极北行+ | 一路向北,探访日本至北之地 | 001 - 少数派 万字剖析:千问App深度体验报告(2026) - 少数派 在2026年,如何真正防止别人抄袭你的作品 - 少数派 怎么用 50 块搭个 AI 语音助手?我踩了 3 天坑 - 少数派 YeeroAI:让 AI 对话真正成为知识管理的一部分 - 少数派 爬泰山 - 少数派 「旅图显影」 App 更新:这次,我们补上了一点「手感」 - 少数派 假期出门太折磨?我的 23 条经验帮你规划惬意旅行 - 少数派 工作流会变吗 - 少数派 Claude Opus 4.6 怎么用最省钱?我测了 5 种方案 - 少数派 GPT Image 2 让图文并茂不再稀罕 - 少数派 用户侧出发——什么是AI,我要不要学习? - 少数派 找片、转存、整理、播放一条龙!让你的付费网盘值回票价 - 少数派 欢迎试用!日课一问2.0插件 - 少数派 自己做的MDeditor,原本想购买 Typora 试了两次支付不成功,干脆自己做一个 - 少数派 vibe coding了一个 3MB 的小工具,让 ~/Downloads 彻底告别混乱 - 少数派 因为受不了 Mac 的风扇策略,我做了一个风扇控制工具 - 少数派 别只怪模型 - 少数派 Warp 终端的 AI 功能怎么用?我测了一周的体验 - 少数派 AI 写代码老是出 bug?这 5 个配置我后悔没早知道 - 少数派 「新玩意」苹果出相机可能就这样:Sigma BF + 45mm F2.8 DG Contemporary - 少数派 一个面向2030年的AI操作系统是什么样子的:浅谈cola这款有灵魂的Agent - 少数派 别只看写代码 - 少数派 每天解决10个问题,还是一口气攻坚解决400个? - 少数派 AI 交易机器人怎么搭?我用 Claude 跑了一周实盘 - 少数派 Maptoposter Online:把你爱的城市画成艺术海报 - 少数派 Function Calling 怎么用?我测了 3 个模型发现差距真大 - 少数派 Legend Talk:我做了个 AI 圆桌,让 160 位思想家围着你的问题转 - 少数派 如何找到自己的蓝方?在小县城寻找压力测试 - 少数派 语音输入与软件接口|2026年聊AI时,我们都聊些什么(上) - 少数派 混动已经卖爆,纯电又来补刀——钛7闪充版简直“不讲武德” - 少数派 本月玩什么|朋友收藏、识质存在、沙罗周期 - 少数派 为什么要每天坚持输出? - 少数派 Claude API 挂了好几个小时,你的项目有备用方案吗? - 少数派 Function Calling 没你想的复杂——我用它做了个有点用的工具 - 少数派 登录系统立即播放视频或者图片音乐的软件 - 少数派 我为什么创建 FlipHTML5 下载工具 - 少数派 残局没电?多品牌外设电量统一管理软件EasyBluetooth已支持RTSS游戏内显示以及AIDA64 - 少数派 前往通义路的路 - 少数派 太好看了,媲美Sun的个人导航页,NAS部署星云门户 - 少数派 乌黑嘴唇“一键检测”上线了 - 少数派 派早报:Claude AI 接入多个创意软件生态、FILCO 生产方接手品牌等 - 少数派 【更新】BearCLI、Claude 连接器与 MCP 服务器 - 少数派 记了上千条流水,还是看不懂财务?我做了一个让 AI 读懂账本的工作台 - 少数派 MINI R56 升级原厂 Sport 模式 - 少数派 新玩意 | 一棵柠檬树(仿真版) - 少数派 Momenta的“物理AI”野望,需迈过“含摩量”这道关 - 少数派 网页直接投屏控制手机!NAS一键部署PandaScrcpy,流畅丝滑可远程。 - 少数派 众测|邀你一同探索随身 AI 硬件入口 YoooClaw C·ONE - 少数派 2050大会:分享时间是真诚 参会记 - 少数派 iPad 赋能电影创作:国内首部宣纸手绘长片《燃比娃》的幕后故事 - 少数派 AI的审美:我用 8 个大模型给 100 张旅行照片打分 - 少数派 普通人如何破圈?去参加一个本地协会 - 少数派 把极空间的图标全换了,主题DIY全攻略打造你的专属NAS桌面 - 少数派 电子便签墙,帮你实现便签自由 - 少数派 我如何用三个 CLI 工具取代文档创建需求 - 少数派 原来真的有人可以玩一辈子 - 少数派 社区速递 139 | 派友热议三月买了啥、复古单反尼康 Df 体验 - 少数派 06 作品的赏析与评价 - 少数派 TDS REVIEW|索尼 WF-1000XM6 降噪真无线耳机体验 - 少数派 35.98万起售的第二代腾势D9,我看重的不是堆料,而是不凑合 - 少数派 鼠须管 Squirrel 皮肤配置指北 - 少数派 从watch ultra2换到redmi watch6 - 少数派 派早报:阿里巴巴发布视频生成模型 HappyHorse 1.0 等 - 少数派 别迷信1M - 少数派 家人们天塌了!网盘“大封杀”,多个渠道多条路,NAS部署PanHub - 少数派 AI与人勾心斗角!NAS一键部署AI狼人杀,假日休闲必备。 - 少数派 电商必备!Comfyui工作流批量生图插件,一次生成12张!支持Nano banana pro模型 - 少数派 Comfyui工作流配置Gpt-image-2模型教程,0.03/张 - 少数派 OpenClaw第三方APi怎么配置?可使用Gpt-image-2模型 - 少数派 会员社区话题精选 Ep. 103 - 少数派
如何提升 AI 学术检索的质量? - 少数派
2024-10-09 · via 少数派

这些技巧使用前后,结果质量差距显而易见。

困惑

AI 能够帮助你检索资料,这你早就知道了。但从实际使用效果看,很多小伙伴并没有真正享受到 AI 检索资料的便利。甚至,还可能被 AI 「带到了沟里」,检索到过时的、错误的信息,或者错过了重要内容。从此,他们坚决抵制使用 AI 工具完成严肃任务。

AI 辅助检索,其实是有技巧的。如果你了解它们,在检索上便能做到「事半功倍」;反之,则很可能造成不必要的困扰。

学术写作中,资料检索尤其是个重要的工作环节。检索信息的质量,可能会显著影响你的作品水平。今天这篇文章,咱们就针对学术资料检索这个场景来谈谈,你该如何操作才能获得更好的检索结果。

工具

我们以 Perplexity 为例,来说明不同检索方式带来的效果差异。

Perplexity 你应该不陌生。因为我曾经 在这篇文章里给你做过介绍。简要来说,它是一款基于 AI 的搜索和问答引擎,在 2022 年推出。基于自然语言处理技术,它可以通过网络搜索结果生成答案,并且在回答中引用来源出处。

Perplexity 支持不少主流模型。如果你订阅了 Pro 模式,可以使用 GPT-4o, Claude 3.5 Sonnet,Claude 3 Opus, Sonar Large 和 Sonar Huge 等。其中 Sonar Huge 是基于 Llama 3.1 405B 大模型。

除了对话之外,Perplexity 还支持绘图 ——Stable Diffusion XL, DALL-E 3, 甚至是 FLUX 都支持。

顺便说一句,最近我不少文章的题图和 视频的封面,都是用 FLUX 做的。这款模型生成画面(例如机器人)的一致性特别高。

你可以 使用我的邀请链接https://perplexity.ai/pro?referral_code=GCB8DRJT)来注册 Perplexity,首月可以省下一半的钱。

有没有 Perplexity 替代品呢?

有。例如国内的秘塔 AI 搜索和国外的同类产品 You.com 等。但是 Perplexity 还是有自己的特色的。下面我们就来看看 Perplexity 开箱即用的搜索功能。

基础

打开 Perplexity, 你可以直接询问。例如我的问题是「生成式 AI 对教育的影响」。

你会看到,Perplexity 不是直接给出答案,而是先思考,把你的指令拆解为若干的执行步骤,然后一一操作。在本例中,它会先查找生成式 AI 的相关信息,然后分析 AI 在教育领域的应用实例,最后总结积极与消极的影响。

Perplexity 首先提出「生成式 AI 在教育中的影响深远而全面,主要体现在以下几个方面:个性化学习、教学方式创新、教学评估与反馈、教育资源的生成与共享、以及挑战与风险等」。

然后,它针对上面每一个方面,分别介绍生成式 AI 的影响方式。

例如对「个性化学习」,Perplexity 提到:

生成式 AI 可以通过分析学生的学习数据和行为,为每个学生提供个性化的学习内容、路径和建议。具体的功能包括:

  1. 自动调整教学内容:根据学生的学习进度和理解程度,自动调整教学内容的难度和深度。
  1. 推荐适合的学习资源:为学生推荐最适合的学习资源和方法。
  1. 提供实时的智能辅导:提供实时的智能辅导和答疑,及时解决学习中的问题。
  1. 生成针对性的练习题:生成针对性的练习题和测试,帮助学生巩固知识点。

这种高度个性化的学习体验可以大大提高学习效率和效果,激发学生的学习兴趣。

仔细阅读后,我觉得这些回答还是比较靠谱的。其他几方面的内容,我们就不一一详细叙述了。

请你注意,每一个答案后面,Perplexity 都提供了来源链接,便于我们进行验证。

看起来,Perplexity 的最基础检索模式,似乎可以满足我们搜集资料的需求了。

是吗?

不然。Perplexity 默认模式下,信息来源质量参差不齐。使用久了,你会发现有些资料来自权威网站或相关的教育 AI 期刊;另一些则未经过滤,来自没有质量把控的自媒体或根本不知名的网站。倒不是说这些来源给出的信息质量一定低劣,而是作为普通用户着实不好区分。

如果你的目标是给自己的论文搜集资料,那这些信息来源尤其需要谨慎使用,否则难免会被误导。

要解决信息来源质量参差不齐的问题,该怎么办呢?

说起来也非常简单,限定信息来源

学术

我将问题拷贝下来,在新的 Perplexity 对话框中粘贴后,点击 Focus 按钮,然后你会看到下图中的若干选项。

这里包括了多种常见信息来源,你可以参考我在这篇文章中的介绍。本例为学术资料搜索场景,所以建议你选择 "Academic",答案的信息来源将仅限于学术文献

新的结果基本上都是来自 Semantic Scholar 这样的学术资料库。相较于无目的的大海捞针,这样获取的学术信息因为有同行评议制度的筛选,质量更有保障

不过,你千万不要以为,选择一个 academic 来源,就算是完事大吉。

咱们来检视一下。你看文献《构筑 “人工智能 + 教育” 的生态系统》,发布日期为 2017 年。

另一篇《基于 Agent 的智能教学系统(AITs)的开发与研究》,发表年代为 2009 年。

问题来了,2009 年发表的论文,算不算新颖?

其他学科我不敢说。但是放在人工智能领域,2009 年的论文肯定不算新了。这个领域进展可谓「一日千里」。 2009 年的时候,别说我们目前共同想象中的生成式 AI ,就连其雏形 GPT 第一代,甚至是更经典的深度学习模型,还大都没有影子呢。

如果我们希望检索足够新颖的论文,怎么办?

这就需要我们使用一些提示词技巧了。

提示

我的提示词是这样的:

你是一名优秀的科研助手,有十余年的工作经验,成果斐然。请根据我提出的问题,查询与之相关的最新英文资料。全面阅读资料的内容,一步步思考后用简体中文回答该问题。

注意事项:

1. 不要给出平庸的总 - 分 - 总式总结。我希望你从文献中找到能给读者带来信息增量与认知变化的观点、论断、数据和细节。

2. 不要着急,深吸一口气,仔细阅读、理解、反思,甚至找寻新的资料。当你感觉有信心已经找到合适的答案后,再开始回答。

3. 每段首先提出你的论点,接着给出论证过程,最后提供证据(最好包括翔实的数据)以及来源链接。

4. 资料引用要尽量保持多元化,不要轻易忽视任何信息来源。引用资料时,除了标准化的序号链接外,还需采用 APA 格式进行展示。

咱们来解读一下:

首先说「你是一名优秀的科研助手,有十余年的工作经验,成果斐然」。这是在定义角色,赋予大模型一个专业人士的身份。

之后我要求「请根据我提出的问题查询与之相关的最新英文资料」。我们可能只想关注前沿研究,因为生成式 AI 真正的爆发实际上就是最近的事情,找那么久远的文献可能跟我们的目标有偏离。

咱们不仅要求大模型「使用最新的英文资料」,而且还指出「全面阅读资料的内容,一步步思考」。这个「一步步思考」的提示词技巧,叫做思维链(COT, Chain of Thoughts)。它让大语言模型先把一个问题进行拆解,然后反思,之后再执行。

我们在之前的教程里讲过一个非常重要的观念,叫做「欲速则不达」。在我们跟大语言模型沟通的时候,最好让它慢下来。

我说「用简体中文回答该问题」看似有些多余。但如果不明确指明,Perplexity 看资料都是英文,有时会直接用英文来给你回答。

我特别指出,「我不想听任何陈词烂调,所以你不要给我一个平庸的总分总式的总结」。之所以这样要求,是刚才我们看到了,大模型的答案有固定的「AI 味道」—— 一上来先有观点,然后 123 列出分论点,之后在加上个「总的来说……」。

AI 味道越重,「人味儿」就越少。所以我们在和 AI 沟通的时候,更希望它「从文献中找到那些能给读者带来信息增量与认知变化的观点、论断、数据和细节」。

这里我还特别告诉它,「别着急,深吸一口气」。大语言模型当然没法「深吸一口气」,但它知道我其实是对它的思考节奏进行控制。更进一步,我希望它「认真地阅读、理解、反思」,还指出「当你感觉有信心,已经找到合适的答案后,再开始回答」。这句话很重要,因为咱们希望大语言模型输出时候要审慎,不要盲目猜测我们的想法,之后出于迎合目的,输出不存在的内容。

然后我还规定了输出格式 —— 「每一段首先提出论点,之后给出论证过程,后面提供证据,包括详实的数据,以及来源链接」。这样文章段落风格更加符合论证要素。而来源链接的提供,更是为了进一步检验大语言模型的答案是否靠谱。

我提到「资料引用要尽量保持多元化,避免过度依赖单一来源」。这句话也很有用。因为如果不加指明,某些资料可能被大模型「薅羊毛」一般反复使用,而有些资料则被忽略掉,导致引用不均衡。

另外我还对 Perplexity 提出了文献引用的格式要求等。这些比较直白,此处就不再赘述了。

细心的你,可能已经发现,某些提示词的表达很全面,但是并不完全符合语法要求,甚至可能有错别字。别担心,大语言模型的容错能力相当强。只不过,一定要检查确认整体逻辑不能有错误,否则输出结果便会与你的设想「南辕北辙」了。

效果

提示词增强后,Perplexity 这次不仅查找了 Semantic Scholar,还包括了 arXiv (主流预印本平台)的内容。

它提到生成式 AI 正在深刻改变高等教育的评估方式,推动教育者重新思考传统评估的可持续性。

注意这可不是泛泛而谈,下面有详细的数据。「一项针对 389 名学生和 36 名教育者的调查显示……」这样的表述方式着实让我感到兴奋。此外,Perplexity 还给出了来源文献的发表年代等具体信息。

Perplexity 的第二条回答,先给出了论点「生成式 AI 为艺术教育提供了新的机遇,促进学生的批判性分析能力」,之后它又进行了论证(研究表明,教育者可以利用生成式 AI 作为工具,通过体验式方法引导学生积极参与对 AI 生成艺术作品的批判性分析……),之后也给出文献作为证据支撑。

之后,Perplexity 继续给出回答,例如「生成式 AI 工具在教育中的使用,需要考虑社会人口因素的影响」。要确保来自不同社会人口背景的学生能够公平使用数字媒体平台,我觉得伦理是个非常好的研究角度。

另外,答案还提到「在教育中,存在双刃剑效应。我们需要谨慎设计以促进学生主动学习」。我看着答案,频频点头。懒人很容易因为有了更加简便的工具,就陷入过度依赖之中。例如我让学生们使用 immersive translate 工具,原本希望有助于他们学习和掌握专业英语,提升论文阅读效率。结果他们对着中英对照的翻译,往往只看中文部分,英语部分则被完全无视…… 唉。

前面这几个答案的观点以及对应论证分析方式,基本符合提示词的要求。尤其是Perplexity 给出的答案不再是陈词滥调,这点非常重要。答案里提到的文献发表时间基本上都是 2023 年以后。这比起 2009 年的文献,显然更符合咱们对生成式 AI 这个主题的调研要求。

小结

请你回过头来,对比刚刚的答案,和最初采用 Perplexity 「开箱即用」模式的结果,差异是非常显著的。咱们简单小结提升 AI 学术检索质量的几个关键点。

首先,一定要限制来源范围。学术文献库内进行搜索,可谓「在有鱼的地方钓鱼」。

其次,注意调查文献的时间范围。如果不加指明,Perplexity 可能会混入过时陈旧内容,对结果有负面影响。

第三,综合利用提示词技巧(角色定义、思维链等),可以让 AI 思考的节奏更加舒缓,启动大模型的「思维系统 II」,给出的结果更加成熟。

第四,明确给出步骤和要求。这样 AI 答案的风格,更加符合咱们的预期。你最好把 AI 当成一个初级合作者。它能力很强,但是缺乏处理当前任务的经验。你这个「老师傅」得多带带它啊。

希望上述要点介绍,可以帮助你提升 AI 学术搜索的效果。祝学术信息检索顺利愉快!

如果你觉得本文有用,请充电

如果本文可能对你的朋友有帮助,请转发给他们。

欢迎关注我的专栏「科研利器」,以便及时收到后续的更新内容。

点击这个链接加入少数派会员,立享 9 折优惠!获得专属会员内容、会员播客以及会员定制周边。在更多的领域和方向帮你打开脑洞,找到新的兴趣点。与少数派一起洞悉当下,探索新知。

延伸阅读