无法在多人游戏或在线聊天中开口说话?输入一条消息,按下 Enter,就能立即通过文字转语音说出来。无论您的配偶正在睡觉、您因冬季寒冷而失声、社交焦虑已蔓延到大厅,还是您只是更喜欢打字而不是说话,Text To Speech 都能为您提供帮助。它专为游戏、流媒体和社区而设计,最初是一个实用的浮动文本框。保持简单或根据需要打开更多工具。对消息进行排队、重播最后一条消息或打开历史记录进行重播、复制有用的行并将其导出为 WAV 文件。成为你一直想成为的键盘战士。您的日常语音工具在您的计算机上本地运行。没有每月订阅,也没有单独的应用程序帐户。使用即时内置 Windows 语音或在需要时下载本地神经和 AI 语音:Microsoft / Windows 语音:即时内置语音,包括支持 32 位 SAPI 5 语音。Piper:可下载的离线神经语音的广泛库。Kokoro:快速、现代的神经网络语音,支持声音混合。还支持 Kokoro 1.1 模型检查点,可额外提供 100 个中文语音!Kitten:轻量级神经语音,质量令人印象深刻。eSpeak NG:经典的机器人声音,具有出色的语言覆盖范围。Qwen3:本地人工智能语音,带有用于设计语音和使用参考语音的工具。Chatterbox:可以使用参考语音的富有表现力的本地人工智能语音。Supertonic 3:覆盖 31 种语言的超高速紧凑型本地语音合成,朗读稳定且资源占用低。VoxCPM2:覆盖 30 种语言的表现力语音合成,支持使用自然语言进行 Voice Design、可控语音克隆和录音棚级音频。Pocket TTS:支持英语、德语、意大利语、葡萄牙语和西班牙语的超轻量本地 Reference Voice。保持最喜欢的声音,快速切换声音并调整音高、速度、音量、情绪、能量、效果和强度,直到感觉合适为止。按年龄、音色、语速、情感和用途描述您想要的声音。Voice Design 会根据描述创建新声音,让您能够快速、方便地尝试创意,并在本地完善角色。为游戏角色和对话创建独特的声音,为更大的项目建立演员阵容,为视频提供旁白或制作游戏画外音,而无需搜索固定的语音库。此功能支持中文、英语、日语、韩语、德语、法语、俄语、葡萄牙语、西班牙语和意大利语。您有权使用的录音可以指导生成的语音风格。在各个场景中重复使用相同的声音,为重复出现的角色提供一致的身份,或者继续使用您已经开发的声音。安装可选组件后,生成过程仍在您的计算机上进行。使用 Text To Sing 将歌词变成歌曲。写下歌词,描述您想要的声音,让本地 AI 生成旋律和演唱表现——从简短的片头音乐到角色歌曲。您可以从自动旋律开始,用哼唱或伴奏音轨引导演唱,也可以转换已有的演唱引导音频。使用可选的 Singing Voice Add-on,您可以将选定的 TTS 声音或经许可使用的 Reference Voice 应用到结果中。安装可选组件后,生成过程仍在您的电脑上完成。需要一个起点?歌唱编辑器中的 AI Assistance 可以优化风格提示词,或将粗略想法整理成结构清晰、适合演唱的歌词。制作直播开场、游戏角色主题曲,或为您的猫咪准备一首大显身手的独唱曲。可选的本地人工智能可以在消息说出或复制之前重写消息。使用现成的说明来修复语法,使措辞专业或随意,缩短长消息,简化它,翻译它或调整标点符号,以便通过文本转语音听起来更自然。对于更具体的内容,请编写您自己的说明。改变语气、翻译成另一种语言、添加一个笑话或根据情况调整信息。选择快速、平衡或质量可选的本地模型,并在使用之前查看重写的结果。使用热键录制音频、修剪开头和结尾、命名剪辑、应用语音效果并保存以供以后重播。导入您有权使用的声音文件,将剪辑组织到播放列表中,保持收藏夹关闭,分配热键并管理播放队列,而无需中断焦点。录下实用台词、提前准备回复,或为不同游戏和社区分别设置不同的音效板布局。连接 Twitch、YouTube Live、Reddit 或 RSS 并将批准的消息发送到正常语音队列中。在命令、链接、提及、重复、重复单词、纯表情消息、不需要的内容和垃圾邮件到达语音输出之前对其进行过滤。为聊天设置自己的语音或速度规则,使其听起来与常规消息不同。 OBS 文本和窗口源可以在说出句子时构建句子,一次显示一个单词或显示完整的消息。通过音高、情绪、能量、效果和强度塑造生成的语音或现场麦克风。使用内置 DSP 变声器或可选的 AI 变声器来实现实时麦克风音频和生成的语音。仅使用您有权使用的语音模型。开启声码器,制作机器人通讯、合唱、重低音广播或其他适合游戏场景的效果。可为生成语音或实时麦克风选择载波类型、音符、和弦和混音比例。宏可以一键触发短语、播放音频文件或重复消息。热键可让您在比赛继续时讲话、暂停、停止、跳过、重复、管理提醒以及在宏页面之间移动。键盘、鼠标和控制器绑定使常见操作保持紧密,包括 Xbox、Steam Input 和 PlayStation 控制器。反复出现的语音提醒可以跟踪冷却时间、增益计时器或任何您在回合中不应忘记的内容。打开音乐键盘实时演奏声码器音符。分配 音效板 剪辑并以不同的音调播放它们,将一个音效变成一个微型乐器。为不同的游戏、社区或可疑的音乐野心准备不同的键盘布局。混音器:组合麦克风音频、生成的语音、音效板 剪辑和应用程序音频。Audio Lab:使用增益、EQ、响度标准化、压缩、限幅、单声道混音和人声频段增强来录制、裁剪、处理并导出音频片段。语音增强:使用可选的本地 Resemble Enhance 组件对允许的语音录音进行降噪和改进。语音历史记录:重播、复制或导出有用的口语台词为 WAV 文件。按应用控制:根据不同游戏或程序加载不同的宏组合和触发设置。MIDI 播放:缓存和播放支持的 MIDI 文件,并具有流畅的时间栏导航。Pet Overlay:在桌面或直播画面中添加一个小巧的屏幕伙伴。安装管理器:下载、修复和管理可选语音、语音集合和本地 AI 组件。要将音频路由到其他软件(包括游戏、语音聊天或流媒体工具),您可能需要安装 VB-CABLE 作为虚拟音频设备。 Text To Speech 在完整应用程序和免费试用版中提供引导式自动化设置。作为一名有社交焦虑的玩家,我最初编写这个工具,是为了帮助自己更好地社交并更充分地享受游戏。我亲自使用它多年,并围绕依赖文字转语音进行游戏时那些细小但真实存在的困难不断打磨它。最重要的是,能够加入比赛、通话、直播,或和朋友的深夜聊天。
发布时间:2026年02月04日
开发商:Banana
发行商:Banana