惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

爱范儿
爱范儿
博客园 - 叶小钗
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
腾讯CDC
S
SegmentFault 最新的问题
D
DataBreaches.Net
Hugging Face - Blog
Hugging Face - Blog
L
LangChain Blog
Recent Announcements
Recent Announcements
阮一峰的网络日志
阮一峰的网络日志
N
Netflix TechBlog - Medium
大猫的无限游戏
大猫的无限游戏
M
MIT News - Artificial intelligence
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - 三生石上(FineUI控件)
F
Fortinet All Blogs
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
Martin Fowler
Martin Fowler
雷峰网
雷峰网
J
Java Code Geeks
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
小众软件
小众软件
云风的 BLOG
云风的 BLOG
T
Tailwind CSS Blog

碎言

不懂就别瞎掰掰:【程序员的常识】写的什么玩意? AI 辅助编程下的程序设计与代码编写 使用 Next.js 和 Tailwind CSS 构建可编辑和删除的 ToDo 待办事项应用 探索编程新境界:MarsCode 助你一臂之力 使用 Next.js 和 Tailwind CSS 搭建静态图片展示站点并部署到 Vercel AI 辅助编程:免费工具的优缺点及官网一览 GitHub push更新总是失败,写个python脚本解决 把博客从GitHub迁移到到了vercel ComfyUI 和 Flux.1 安装与使用教程 Flux.1 入门必知:硬件、环境、模型 Git项目的子文件夹中的内容无法同步到远程仓库的解决方法 blender流体Fluid使用中没有流体、流体穿模等一些问题的解决方法 博客聚合网站:积薪,竟然关闭了! blender日常使用中的一些技巧 虽然只有我自己在用,但还是更新了碎言博客的源代码, 与其在迷茫中困惑,不如在努力中前进 差点忘了我还有一个博客... 秧歌、博客和AI 终于熬到了新手上路 好久没有更新博客了。。。 老妈大腿骨骨折,最近一直在医院护理 Hello, September! Ubuntu开机自动启动Docker容器运行WordPress Docker 简单快速安装部署WordPress Docker下安装MySQL 加碘盐能防核辐射的话,还怕什么核战争? shields.io 一个简洁、一致、清晰的徽章 Ubuntu下使用root登录ssh的设置 GitHub Actions 构建、部署 Next.js项目 我又用回了"IE"--edge
我用大模型写了一个Edge TTS图形化工具
J.sky · 2026-02-26 · via 碎言

前言

因为要用到文字转语音的功能,又不想在终端里敲代码,所以,经过一番尝试,我使用大模型成功创建了一个基于Microsoft Edge TTS API的图形化工具——edge-tts_tk_gui

项目简介

这是一个完全免费的文字转语音工具,基于 Microsoft Edge TTS API 开发,使用 Python 和 Tkinter 构建图形化界面。最大的特点是:无需安装额外的语音引擎或音频处理工具,只要有网络连接即可使用。

主要功能

  • 🎨 图形化界面:操作简单直观,适合各种用户
  • 🗣️ 多种语音选择:支持多种语音和音色
  • 📝 批量处理:支持批量文本转语音处理
  • ⚙️ 自定义参数:可调整语速、音调等语音参数
  • 🎵 音频播放:支持自动播放和保存音频文件(MP3格式)

技术栈

  • 编程语言:Python 3.8+
  • GUI框架:Tkinter
  • TTS服务:Microsoft Edge TTS API(通过 edge-tts 库)
  • 平台支持:Linux / macOS / Windows

项目结构

edge-tts_tk_gui/
├── core/                 # 核心功能模块
│   ├── audio_manager.py  # 音频管理
│   ├── config.py         # 配置管理
│   ├── tts_service.py    # TTS 服务
│   └── validators.py     # 验证器
├── ui/                   # 界面模块
│   ├── main_window.py    # 主窗口
│   ├── controls.py       # 控制组件
│   ├── file_selector.py  # 文件选择器
│   └── voice_selector.py # 语音选择器
├── test/                 # 测试文件和示例
├── main.py               # 程序入口
├── requirements.txt      # 依赖列表
└── README.md            # 项目说明

代码结构清晰,采用模块化设计,便于维护和扩展。

使用方法

安装依赖

# 克隆项目
git clone https://github.com/bosichong/edge-tts_tk_gui.git
cd edge-tts_tk_gui

# 创建虚拟环境
python3 -m venv venv
source venv/bin/activate  # Linux/macOS
# 或
venv\Scripts\activate  # Windows

# 安装依赖
pip install -r requirements.txt

运行程序

python3 main.py

系统要求

  • Python 3.8 或更高版本
  • Linux / macOS / Windows
  • 网络连接(用于访问 Microsoft Edge TTS API)

关于AI编程

这个项目有个特别之处:本程序的构思和创意由我提供,而代码完全由 GLM-4.7 大模型编写

通过与AI模型的交互,我只需描述需求,大模型就能生成完整的代码。从项目结构设计到具体功能实现,整个开发过程非常流畅。这让我深刻体会到了AI辅助编程的强大能力。

项目特点

  1. 完全免费:利用 Microsoft Edge TTS API,无需付费
  2. 跨平台支持:在主流操作系统上都能运行
  3. 零配置:无需复杂的安装和配置过程
  4. 代码质量高:模块化设计,易于维护和扩展
  5. AI生成:展示了大模型在代码生成方面的能力

总结

这个小项目虽然简单,但完整地展示了一个图形化应用的开发流程。更重要的是,它让我验证了大模型在软件开发中的实际应用价值。未来我会继续探索AI辅助编程的可能性,创造更多有趣的项目。

如果你对这个项目感兴趣,欢迎访问 GitHub:https://github.com/bosichong/edge-tts_tk_gui

许可证

本项目采用 MIT 许可证,欢迎学习和使用。