-
Notifications
You must be signed in to change notification settings - Fork 2
/
main.go
99 lines (86 loc) · 3.53 KB
/
main.go
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
package main
import (
"flag"
"fmt"
"github.com/dyike/log"
"github.com/rayboot/tts-go/tts"
"os"
"time"
)
var usageStr = `
Usage: tts-go [options]
资源的目录结构为
─res
├─msc_work_dir
│ └─msc
│ └─msc.cfg (如果不想产生日志,可以把这个文件删掉)
└─tts
└─common.jet
└─xiaofeng.jet
└─xiaoyan.jet
讯飞参数中work_dir 设置为msc_work_dir的绝对路径
资源引用使用 ../../tts/***.jet
注: 如果appid过期,请更换appid 以及 jet文件!!
单次合成模式选项:
-w <work_dir> 讯飞资源工作路径,按照上述目录结构设置为msc_work_dir的绝对路径
-k <appid> 讯飞appid
-t <text> 待合成的文本
-o <file> 音频输出路径
-e <engine_type> 引擎 默认local
-n <voice_name> 发音人 xiaoyan、xiaofeng
-c <text_encoding> 编码 默认UTF8
-j <tts_res_path> 合成资源路径 基于上述树形结构的相对路径 linux默认为 ../../tts/ windows平台默认为 ..\\..\\tts\\
-r <sample_rate> 合成音频采样率 合成音频采样率,支持参数,16000,8000,默认为16000
-s <speed> 语速 合成音频对应的语速,取值范围:[0,100],数值越大语速越快。默认值:50
-v <volume> 音量 合成音频的音量,取值范围:[0,100],数值越大音量越大。默认值:50
-p <pitch> 合成语调 通过此参数,设置合成返回音频的语调,值范围:[0,100],默认:50
-rd <rdn> 数字发音 合成音频数字发音,支持参数, 0 数值优先, 1 完全数值,2 完全字符串,3 字符串优先,默认值:0
-rc <rcn> 1 的中文发音 0(默认):表示发音为yao 1:表示发音为yi
其他:
-h 查看帮助
`
func main() {
var text string
var file string
var help bool
config := tts.TTSConf{}
loginConf := tts.TTSLoginConf{}
flag.StringVar(&loginConf.WorkDir, "w", "", "msc_work_dir工作目录")
flag.StringVar(&loginConf.AppId, "k", "", "appid")
flag.StringVar(&text, "t", "测试文本", "需要转换的文案")
flag.StringVar(&file, "o", "test.wav", "转换后生成的文件名")
flag.StringVar(&config.EngineType, "e", "local", "引擎")
flag.StringVar(&config.VoiceName, "n", "xiaoyan", "发音人")
flag.StringVar(&config.TextEncoding, "c", "UTF8", "编码")
flag.StringVar(&config.TtsResPath, "j", fmt.Sprintf("..%s..%stts%s", string(os.PathSeparator), string(os.PathSeparator), string(os.PathSeparator)), "合成资源路径")
flag.IntVar(&config.SampleRate, "r", 16000, "采样率")
flag.IntVar(&config.Speed, "s", 50, "语速")
flag.IntVar(&config.Volume, "v", 50, "音量")
flag.IntVar(&config.Pitch, "p", 50, "合成语调")
flag.IntVar(&config.Rdn, "rd", 2, "数字发音")
flag.IntVar(&config.Rcn, "rc", 0, "1 的中文发音")
flag.BoolVar(&help, "h", false, "帮帮帮助")
flag.Parse()
if help {
fmt.Printf("%s\n", usageStr)
return
}
log.Debug(loginConf.WorkDir)
if len(loginConf.AppId) == 0 || len(loginConf.WorkDir) == 0 || len(file) == 0 {
log.Debug("appid / work_dir / file 没有输入内容")
return
}
log.Debug("开始合成资源")
t := time.Now()
if err := tts.Login(loginConf.ToTTSLoginParams()); err != nil {
log.Error("%v", err)
panic("登录失败")
return
}
if err := tts.GetTTSWavFile(config.ToTTSParams(), text, file); err != nil {
log.Error("%v", err)
panic("转换失败")
return
}
log.Debug("转换成功 耗时 %d", time.Since(t).Milliseconds())
}