惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

MongoDB | Blog
MongoDB | Blog
B
Blog
Y
Y Combinator Blog
大猫的无限游戏
大猫的无限游戏
aimingoo的专栏
aimingoo的专栏
B
Blog RSS Feed
博客园 - Franky
V
V2EX
IT之家
IT之家
WordPress大学
WordPress大学
博客园 - 三生石上(FineUI控件)
J
Java Code Geeks
F
Fortinet All Blogs
I
InfoQ
云风的 BLOG
云风的 BLOG
腾讯CDC
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
月光博客
月光博客
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
N
Netflix TechBlog - Medium
宝玉的分享
宝玉的分享
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
P
Proofpoint News Feed
Microsoft Security Blog
Microsoft Security Blog

发音

你们怎么念的? code~x 还是 co~dex - V2EX 怎么这么多人把 prompt 读作/ prəˈmoʊt / ,目前整个组就我一个人还在坚持/ prɑːmpt / 了 - V2EX 很多人把 Claude 读成 cloud 当一个词典的内容和发音都是自然生长出来的 你如何读 codex ?是 code cha,还是 code aikesi iOS/ iPad OS 下有没有好用的英文文本朗读软件, 最好: 1. 发音自然连贯,朗读到的内容即时高亮,就跟歌词滚动一样 2.支持类似 3/5/7 秒的前进后退操作 3.至少支持 txt 文件 我想做一个单词背诵 app 但是单词的发音和解释资源找不到 有没有可以监听日常键盘输入的英文,根据按键识别英文单词并自动发音的软件? 原来 vivo 叫维沃? “尾巴”是读 yǐ还是 wěi? 如何练习发音? “你”和“拟”的读音一样么 ? PaaS IaaS SaaS FaaS 大佬们,这些怎么念才显得不是新手 有能纠正外语口语发音的 ai 应用么? 吴彦祖们,单词拼读拆分并发音,给点思路啊 英语发音,英音 or 美音? lib 库大家是读“里布库"还是“赖不库” 请问一下,有没有教你正确发音的 APP 呢?比如可以慢读的发音。 大家日常口语沟通的时候,会如何读“/usr”这个目录 为了纠正英语发音,我尝试修改了一下 prompt. macOS 自带词典,导入郎文词典文件后,如何长按单词后,在快速预览界面,实现单词发音? 吃饭,你家乡怎么念~ 文盲了打更(geng)人不读打更(jing)人 优惠券读 quan 不读 juan。 谷歌搜索的英语语音识别为什么要发音发得异常准才能识别上,偏差一点就会识别为其它单词? Heil Hitler 与漫威电影里面的 Hail Hydra 发音区别在哪 大佬们,这两个短语 有道的发音,为啥 sth 发音有的正常,有的却不是呢 想为家乡话做一个发音字典, 如何快速收集录音文件? 如何实现播放句子音频,当前发音的单词,突出显示 请问哪个 APP 翻译的发音,比较标准
有没有什么思路可以训练一个纠正口语发音的 AI
yoiteshaw · 2024-07-04 · via 发音

想一改几十年的哑巴英语,希望境外出行的时候避免尴尬,与老外开会的时候避免结巴。
---------------------------------------------------------------
市面上其实已经有很多这样可以练习的成品 AI 了。
目前尝试了一个 Pronounce 的网页,谷歌就能搜到,每天有在练习它的任务,是用 AI 纠正你的发音的,但是比较坑的点在于它能纠正的点太少,我明明感觉一篇短文起码十几个错误,它只给我点出来四五个,再更完全的口语分析需要交费,包月是每个月 8 刀好像。
在手机上也试过一个练习口语的叫 TalkAI ,试了一下确实蛮 nb 的,但是需要收费,而且问题和前面一样,免费版的体验有限,收费也比较贵,不过是买断式。
----------------------------------------------------------------
于是萌生了一个念头,即我猜测这些软件的原理是“录音的分词”+“语库发音的比对”。
那么目前条件如下:
1.我可以随意找到一篇英语短文练习(互联网上到处都是)
2.我可以轻易将这篇英文转为标准的口语语音(无论是翻译 app 还是 chatGPT 帮我朗读、或者有专业的读文章的软件)
那么我需要一个算法:
1.将我的录音以及标准发音的音频进行分词。
2.在 1 的基础上,假设分词的数量是一致的,那么只需要匹配上我发音的单词的置信度,告知我置信度即可告知我的发音是否标准。
我对这块并不是很熟悉,但是愿意稍微花点时间去了解一下,请问大家伙是否有合适的思路或者现有的开源项目可以推荐呢?如果最后实现了,我也可以反馈社区分享给大家。