哈喽,各位铁友,大家早上好啊!今天我又要给大家来胡扯胡扯、啰嗦啰嗦啦,来跟大家聊聊这几个月以来我使用豆包工作任务以及音频生成的感受。
这一年AI应用真是发展得很猛,不仅有工作任务,还有音频生成任务,特别是最早6月29号那时候起,我就给大家推荐这个音频生成模型。当时很多铁友就说,嗯,这个模型挺强大的,只不过唯一有点可惜的是它的时长很短很短。
那时有人说,每分钟生成一条音频只需要1块钱。其实站在音频的角度来说呢,这有点小贵啦。但我要说的是,这已经算你阿弥陀佛了,如果放在视频的角度来说,最便宜的价格3元起步,最贵的价格给你干到78元,请问你觉得谁更划算呢?
后来到了8月份的时候,我们盲圈的落墨工具箱抢先上线了音频生成模型。只不过在落墨工具箱那里生成音频的时候,的确有点肉疼,用个三四次,会员积分都给你干没了。我倒还不如在火山引擎那里继续使用我的免费次数,好多了。
只不过火山引擎不是说可以上传音频参考吗?唯一有点遗憾的是,它只能够上传他们官方提供的音色,不可以克隆自己的声音。
正所谓功夫不负有心人,8月中旬之后,豆包APP这里正式上线音频生成模型了。只不过这次我本以为它会直接上架到音乐商城,没想到它直接上架到工作任务。
后来我就想先体验一下豆包APP里面的音频生成。你还别说,比那个什么所谓的落墨工具箱和火山引擎强多了。唯一跟落墨工具箱和火山引擎不一样的地方,那就是你生成完一段音频可以进行拼接。
哎,什么叫做拼接呢?举个例子吧。假如我生成一集10分钟的广播剧,大家也知道目前限制时长为2分钟,对吧?但是呢我只想要10分钟的广播剧,怎么办呢?哎,这个时候你就让豆包APP里面的音频生成来批量生成。那么10分钟的广播剧要分为5段,每一段限制时长为2分钟,对吧?
可有人说,哎哟,这不是驴头不对马嘴吗?生成同样一集广播剧会不会前后接不上啊?譬如第一段生成完,第二段就变成张三那里的故事去了。这个你只要跟它说清楚,用对提示词,命令它第二段延续第一段的内容,它就会接着往下讲。这样一来呢,你就可以轻轻松松生成一集广播剧了。
后来有人说,哎,不对哦,这不是仅限会员可使用吗?是不是生成了三段过后直接给你干没了?一开始我也是这么想的。一开始呢我用的是会员版,有7天会员体验。当7天会员到了过后,我想着完蛋了,今天只能够生成三段了。然后我就一不做二不休,一股脑儿让它生成一集10分钟的广播剧,没想到它直接成功生成了5段。后来我就继续让它生成,一下子就给我生成了五六十段。等五六十段过后呢,它就提醒近7天的会员已用完,我要休息啦。
哎,没想到有一个良心的羊毛,它中间有一个送你一次重置额度的机会,我只要一点击刷新,哎,这次我就可以继续使用音频生成了。怎么样?那个时候是不是让我感到很惊喜、很意外?工作任务可以反复生成。
不光如此,音频生成不仅有拼接功能,还有修剪功能,还有混音功能。譬如我生成某个剧情的台词以及某个人生哲理的话,我想混音混成我说话的时候背景音乐有闪避的效果,哎,你还别说,它真的能干得成。还有我想把那个广播节目的主持人的声音替换成我的声音,哎,你还别说,这也可以。甚至什么音频修剪啊、音频分离呀、什么混响处理啊,统统都搞得定。
这就是这几个月以来,我先后在火山引擎、落墨工具箱,最后到豆包使用音频生成的感受。
说起这个工作任务的音频生成啊,的确挺强大的,人家豆包官方给了我们挺宽松的免费额度。但有些人就说啊,其实我想把这个音频生成好的广播剧做成视频,可惜它不可以。但我要告诉大家一个小秘密,实际上它是可以的。如果你想把自己用AI配音的音频做成视频的话,你就把你的这个配音上传到豆包里,你就跟它说可不可以把这个音频转成视频模式,然后它就迅速给你在视频的画面加上动态配图啊以及视频格式啊,通通一条龙帮你搞定。
因为在那个技能里面有一个功能叫做AI MediaKit视频剪辑工具,这个模型就可以帮你把音频转成视频格式。然后它就调用Seedance2.5模型,帮你根据你配音的那个音频生成动态画面。这样一来呢,不到五六分钟,你的音频就变成视频了。
但我要跟大家说一下,这个2.5仅限专业版可使用,如果不是专业版的话,只是普通版的话,它是用不了的。所以这个时候你想把音频转成视频,它只能够默默地把那个模型调用为Seedance2.0,用2.0模型把你的音频转成视频。只不过用2.0的模型,这也得要看你怎么去转了。如果你上传的是超过1分钟的音频,那直接给你分段生成对应的动态画面;如果你上传超过3分钟的话,那对不起,可能你那视频额度都不够你转的。毕竟如果我没记错的话,好像豆包没有开通会员的情况下,视频模型每日好像有5次生成额度,所以你视频有多少额度,那你的音频也得要好好地控制一下时间进行转换。
比如这个视频额度,它2.0模型生成出来的视频是15秒,对吧?那你这个音频就算超过2分钟,也只能够乖乖地转出75秒的视频,因为每日就5次额度,每次15秒,加起来也就75秒。但我再跟大家说一句,用音频转视频的话,其实一下子把你的整个额度给你哐哐哐地干没了。你没听错,只需要一次性,你的额度就给你哐哐哐干没了。然后这个时候也得让你重置额度了,只不过这次的重置额度最起码要到一个小时后才会显示出来。
这就是今天我给大家分享的,这几个月以来使用工作任务里面的音频生成,以及火山引擎、落墨工具箱里面的音频生成的感受啦。好啦,本期感想就给大家分享到这了。
目录
哈喽,各位铁友,大家早上好啊!今天我又要给大家来胡扯胡扯、啰嗦啰嗦啦,来跟大家聊聊这几个月以来我使用豆包工作任务以及音频生成的感受。
这一年AI应用真是发展得很猛,不仅有工作任务,还有音频生成任务,特别是最早6月29号那时候起,我就给大家推荐这个音频生成模型。当时很多铁友就说,嗯,这个模型挺强大的,只不过唯一有点可惜的是它的时长很短很短。
那时有人说,每分钟生成一条音频只需要1块钱。其实站在音频的角度来说呢,这有点小贵啦。但我要说的是,这已经算你阿弥陀佛了,如果放在视频的角度来说,最便宜的价格3元起步,最贵的价格给你干到78元,请问你觉得谁更划算呢?
后来到了8月份的时候,我们盲圈的落墨工具箱抢先上线了音频生成模型。只不过在落墨工具箱那里生成音频的时候,的确有点肉疼,用个三四次,会员积分都给你干没了。我倒还不如在火山引擎那里继续使用我的免费次数,好多了。
只不过火山引擎不是说可以上传音频参考吗?唯一有点遗憾的是,它只能够上传他们官方提供的音色,不可以克隆自己的声音。
正所谓功夫不负有心人,8月中旬之后,豆包APP这里正式上线音频生成模型了。只不过这次我本以为它会直接上架到音乐商城,没想到它直接上架到工作任务。
后来我就想先体验一下豆包APP里面的音频生成。你还别说,比那个什么所谓的落墨工具箱和火山引擎强多了。唯一跟落墨工具箱和火山引擎不一样的地方,那就是你生成完一段音频可以进行拼接。
哎,什么叫做拼接呢?举个例子吧。假如我生成一集10分钟的广播剧,大家也知道目前限制时长为2分钟,对吧?但是呢我只想要10分钟的广播剧,怎么办呢?哎,这个时候你就让豆包APP里面的音频生成来批量生成。那么10分钟的广播剧要分为5段,每一段限制时长为2分钟,对吧?
可有人说,哎哟,这不是驴头不对马嘴吗?生成同样一集广播剧会不会前后接不上啊?譬如第一段生成完,第二段就变成张三那里的故事去了。这个你只要跟它说清楚,用对提示词,命令它第二段延续第一段的内容,它就会接着往下讲。这样一来呢,你就可以轻轻松松生成一集广播剧了。
后来有人说,哎,不对哦,这不是仅限会员可使用吗?是不是生成了三段过后直接给你干没了?一开始我也是这么想的。一开始呢我用的是会员版,有7天会员体验。当7天会员到了过后,我想着完蛋了,今天只能够生成三段了。然后我就一不做二不休,一股脑儿让它生成一集10分钟的广播剧,没想到它直接成功生成了5段。后来我就继续让它生成,一下子就给我生成了五六十段。等五六十段过后呢,它就提醒近7天的会员已用完,我要休息啦。
哎,没想到有一个良心的羊毛,它中间有一个送你一次重置额度的机会,我只要一点击刷新,哎,这次我就可以继续使用音频生成了。怎么样?那个时候是不是让我感到很惊喜、很意外?工作任务可以反复生成。
不光如此,音频生成不仅有拼接功能,还有修剪功能,还有混音功能。譬如我生成某个剧情的台词以及某个人生哲理的话,我想混音混成我说话的时候背景音乐有闪避的效果,哎,你还别说,它真的能干得成。还有我想把那个广播节目的主持人的声音替换成我的声音,哎,你还别说,这也可以。甚至什么音频修剪啊、音频分离呀、什么混响处理啊,统统都搞得定。
这就是这几个月以来,我先后在火山引擎、落墨工具箱,最后到豆包使用音频生成的感受。
说起这个工作任务的音频生成啊,的确挺强大的,人家豆包官方给了我们挺宽松的免费额度。但有些人就说啊,其实我想把这个音频生成好的广播剧做成视频,可惜它不可以。但我要告诉大家一个小秘密,实际上它是可以的。如果你想把自己用AI配音的音频做成视频的话,你就把你的这个配音上传到豆包里,你就跟它说可不可以把这个音频转成视频模式,然后它就迅速给你在视频的画面加上动态配图啊以及视频格式啊,通通一条龙帮你搞定。
因为在那个技能里面有一个功能叫做AI MediaKit视频剪辑工具,这个模型就可以帮你把音频转成视频格式。然后它就调用Seedance2.5模型,帮你根据你配音的那个音频生成动态画面。这样一来呢,不到五六分钟,你的音频就变成视频了。
但我要跟大家说一下,这个2.5仅限专业版可使用,如果不是专业版的话,只是普通版的话,它是用不了的。所以这个时候你想把音频转成视频,它只能够默默地把那个模型调用为Seedance2.0,用2.0模型把你的音频转成视频。只不过用2.0的模型,这也得要看你怎么去转了。如果你上传的是超过1分钟的音频,那直接给你分段生成对应的动态画面;如果你上传超过3分钟的话,那对不起,可能你那视频额度都不够你转的。毕竟如果我没记错的话,好像豆包没有开通会员的情况下,视频模型每日好像有5次生成额度,所以你视频有多少额度,那你的音频也得要好好地控制一下时间进行转换。
比如这个视频额度,它2.0模型生成出来的视频是15秒,对吧?那你这个音频就算超过2分钟,也只能够乖乖地转出75秒的视频,因为每日就5次额度,每次15秒,加起来也就75秒。但我再跟大家说一句,用音频转视频的话,其实一下子把你的整个额度给你哐哐哐地干没了。你没听错,只需要一次性,你的额度就给你哐哐哐干没了。然后这个时候也得让你重置额度了,只不过这次的重置额度最起码要到一个小时后才会显示出来。
这就是今天我给大家分享的,这几个月以来使用工作任务里面的音频生成,以及火山引擎、落墨工具箱里面的音频生成的感受啦。好啦,本期感想就给大家分享到这了。