OpenAI-TTS-Voice-Conversion

Runtime error

App Files Files Community

kevinwang676 commited on Nov 8, 2023

Commit

ad81144

•

1 Parent(s): 2a71b56

Update app.py

Browse files

Files changed (1) hide show

app.py +50 -18

app.py CHANGED Viewed

@@ -2,6 +2,11 @@ import gradio as gr
 import os
 import tempfile
 from openai import OpenAI
 # Set an environment variable for key
 #os.environ['OPENAI_API_KEY'] = os.environ.get('OPENAI_API_KEY')
@@ -23,6 +28,18 @@ enhance_model = SpectralMaskEnhancement.from_hparams(
 knn_vc = torch.hub.load('bshall/knn-vc', 'knn_vc', prematched=True, trust_repo=True, pretrained=True, device='cpu')
 def voice_change(audio_in, audio_ref):
     samplerate1, data1 = wavfile.read(audio_in)
@@ -76,25 +93,40 @@ with app:
     gr.Markdown("# <center>🌟 - OpenAI TTS + AI变声</center>")
     gr.Markdown("### <center>🎶 地表最强文本转语音模型 + 3秒实时AI变声，支持中文！Powered by [OpenAI TTS](https://platform.openai.com/docs/guides/text-to-speech) and [KNN-VC](https://github.com/bshall/knn-vc) </center>")
     gr.Markdown("### <center>🌊 更多精彩应用，敬请关注[滔滔AI](http://www.talktalkai.com)；滔滔AI，为爱滔滔！💕</center>")
-    with gr.Row(variant='panel'):
-      api_key = gr.Textbox(type='password', label='OpenAI API Key', placeholder='请在此填写您的OpenAI API Key')
-      model = gr.Dropdown(choices=['tts-1','tts-1-hd'], label='请选择模型（tts-1推理更快，tts-1-hd音质更好）', value='tts-1')
-      voice = gr.Dropdown(choices=['alloy', 'echo', 'fable', 'onyx', 'nova', 'shimmer'], label='请选择一个说话人', value='alloy')
-    with gr.Row():
-      with gr.Column():
-        inp_text = gr.Textbox(label="请填写您想生成的文本（中英文皆可）", placeholder="想说却还没说的 还很多 攒着是因为想写成歌", lines=5)
-        btn_text = gr.Button("一键开启真实拟声吧", variant="primary")
-      with gr.Column():
-        inp1 = gr.Audio(type="filepath", label="OpenAI TTS真实拟声", interactive=False)
-        inp2 = gr.Audio(type="filepath", label="请上传AI变声的参照音频（决定变声后的语音音色）")
-        btn1 = gr.Button("一键开启AI变声吧", variant="primary")
-      with gr.Column():
-        out1 = gr.Audio(type="filepath", label="AI变声后的专属音频")
-      btn_text.click(tts, [inp_text, model, voice, api_key], inp1)
-      btn1.click(voice_change, [inp1, inp2], out1)
     gr.Markdown("### <center>注意❗：请不要生成会对个人以及组织造成侵害的内容，此程序仅供科研、学习及个人娱乐使用。Get your OpenAI API Key [here](https://platform.openai.com/api-keys).</center>")
     gr.HTML('''
         <div class="footer">

 import os
 import tempfile
 from openai import OpenAI
+from tts_voice import tts_order_voice
+import edge_tts
+import tempfile
+import anyio
 # Set an environment variable for key
 #os.environ['OPENAI_API_KEY'] = os.environ.get('OPENAI_API_KEY')
 knn_vc = torch.hub.load('bshall/knn-vc', 'knn_vc', prematched=True, trust_repo=True, pretrained=True, device='cpu')
+language_dict = tts_order_voice
+async def text_to_speech_edge(text, language_code):
+    voice = language_dict[language_code]
+    communicate = edge_tts.Communicate(text, voice)
+    with tempfile.NamedTemporaryFile(delete=False, suffix=".mp3") as tmp_file:
+        tmp_path = tmp_file.name
+    await communicate.save(tmp_path)
+    return "语音合成完成：{}".format(text), tmp_path
 def voice_change(audio_in, audio_ref):
     samplerate1, data1 = wavfile.read(audio_in)
     gr.Markdown("# <center>🌟 - OpenAI TTS + AI变声</center>")
     gr.Markdown("### <center>🎶 地表最强文本转语音模型 + 3秒实时AI变声，支持中文！Powered by [OpenAI TTS](https://platform.openai.com/docs/guides/text-to-speech) and [KNN-VC](https://github.com/bshall/knn-vc) </center>")
     gr.Markdown("### <center>🌊 更多精彩应用，敬请关注[滔滔AI](http://www.talktalkai.com)；滔滔AI，为爱滔滔！💕</center>")
+    with gr.Tab("🤗 OpenAI TTS")
+        with gr.Row(variant='panel'):
+          api_key = gr.Textbox(type='password', label='OpenAI API Key', placeholder='请在此填写您的OpenAI API Key')
+          model = gr.Dropdown(choices=['tts-1','tts-1-hd'], label='请选择模型（tts-1推理更快，tts-1-hd音质更好）', value='tts-1')
+          voice = gr.Dropdown(choices=['alloy', 'echo', 'fable', 'onyx', 'nova', 'shimmer'], label='请选择一个说话人', value='alloy')
+        with gr.Row():
+          with gr.Column():
+            inp_text = gr.Textbox(label="请填写您想生成的文本（中英文皆可）", placeholder="想说却还没说的 还很多 攒着是因为想写成歌", lines=5)
+            btn_text = gr.Button("一键开启真实拟声吧", variant="primary")
+          with gr.Column():
+            inp1 = gr.Audio(type="filepath", label="OpenAI TTS真实拟声", interactive=False)
+            inp2 = gr.Audio(type="filepath", label="请上传AI变声的参照音频（决定变声后的语音音色）")
+            btn1 = gr.Button("一键开启AI变声吧", variant="primary")
+          with gr.Column():
+            out1 = gr.Audio(type="filepath", label="AI变声后的专属音频")
+          btn_text.click(tts, [inp_text, model, voice, api_key], inp1)
+          btn1.click(voice_change, [inp1, inp2], out1)
+    with gr.Tab("⚡ Edge TTS"):
+        with gr.Row():
+            input_text = gr.inputs.Textbox(lines=5, placeholder="想说却还没说的 还很多 攒着是因为想写成歌", label="请填写您想生成的文本（中英文皆可）")
+            default_language = list(language_dict.keys())[0]
+            language = gr.inputs.Dropdown(choices=list(language_dict.keys()), default=default_language, label="请选择文本对应的语言")
+            btn_edge = gr.Button("一键开启真实拟声吧", variant="primary")
+            output_text = gr.outputs.Textbox(label="输出文本", visible=False)
+            output_audio = gr.outputs.Audio(type="filepath", label="Edge TTS真实拟声")
+        with gr.Row():
+            inp_vc = gr.Audio(type="filepath", label="请上传AI变声的参照音频（决定变声后的语音音色）")
+            btn_vc = gr.Button("一键开启AI变声吧", variant="primary")
+            out_vc = gr.Audio(type="filepath", label="AI变声后的专属音频")
+        btn_vc.click(voice_change, [output_audio, inp_vc], out_vc)
     gr.Markdown("### <center>注意❗：请不要生成会对个人以及组织造成侵害的内容，此程序仅供科研、学习及个人娱乐使用。Get your OpenAI API Key [here](https://platform.openai.com/api-keys).</center>")
     gr.HTML('''
         <div class="footer">