首页
学习
活动
专区
圈层
工具
发布
    • 综合排序
    • 最热优先
    • 最新优先
    时间不限
  • 【教程】免费 AIGCPanel➕CosyVoice 声音合成和声音克隆

    AIGCPanel和CosyVoice介绍AIGCPanel是一个功能强大的开源数字人软件,提供直观的用户界面,让用户能够轻松管理和使用各种声音AI模型和视频AI模型。 进入 AIGCPanel 的模型,点击右上角选择导入模型导入完成后,点击启动,等待模型启动完成声音克隆进入我的音色界面,上传被克隆的声音,注意声音保留5-10秒即可,太长的声音反而效果不好。 进入声音克隆界面,选择 CosyVoice 模型,选择被克隆的音色,输入克隆文字,点击提交。等待克隆完成,这时候就可以看到声音克隆的结果,直接点击可以播放。 声音合成进入声音合成界面,选择 CosyVoice 模型,选择需要合成音色,输入合成文字,点击提交。等待合成完成,这时候就可以看到声音合成的结果,直接点击可以播放。

    1.8K10编辑于 2025-07-18
  • 来自专栏MixLab科技+设计实验室

    声音,无限可能

    来自论文: Seeing Voices and Hearing Faces: Cross-modal biometric matching 类似于“相由心生”,声音也是和面相有相关性的。 声音和其他模态信息的关联度,或者互动,真的非常有意思~~ @知识库 shadow 知识库 来啦~~ 我们先从声音与健康说起~~ 国际期刊《柳叶刀》有一篇《通过你的声音能诊断疾病吗?》 关键技术是AI识别和处理人类的各种声音模式,包括音高、音调、节奏,呼吸轻缓、咳嗽等。这将极大改善医疗健康的服务模式,但在实践中仍需大量的数据验证。 VoiceWise 准确率高达95% 第一性原理:如果器官生病了,人的声音就会发生改变。 罗马Tor Vergata大学教授Giovanni Saggio开发了VoiceWise,该系统分析用户的声音,通过AI将6300个声音值与某些病理状态的声音值进行比较,从而诊断所患的病理。

    2.1K20发布于 2021-09-18
  • 来自专栏Helloted

    开发之声音

    部分代码位置Github-VoiceDemo Pre 与图片中默认的格式为PNG格式一样,iOS开发中声音的格式也有默认格式,为wav格式,本文中的产生的格式均为wav格式,其他格式则需要转换。 有第三方的框架,进行转换成amr等格式 一、声音录制 要先引入AVFoundation的框架 #import <AVFoundation/AVFoundation.h> self.voiceRecorder ,Path和Setting Path:声音文件录制后存储的路径 Setting:一个录制参数的字典,设置一些录制的必要的参数,需要进行调整到合适的值 _recorderSetting = AVAudioRecorder在录制的时候可以暂停和恢复 暂停 - (void)pause; /* pause recording */ 恢复/开始 - (void)record; 录制完成 - (void)stop; 二、声音播放 注意:如果在播上一段录音,同时再点播放的话,两个声音会一起播放 if (_player) { // 如果正在播放上一段录音,则停止 [_player stop]; }

    1.8K10编辑于 2022-06-07
  • 来自专栏数据之美

    关于 wubi 安装 Linux Deepin 后,windows 7 没有声音的问题

    问题: 刚 wubi 安装 deepin linux 12.12 正式版后,切换到 windows 7 发现音箱没声音了,然后查了下音箱没问题,内置扬声器也没问题,主板音频接口也没问题,好吧,遇上怪事了 无关),无奈,求助 google:wubi install windows headset no sound 排在前两条的就是答案: 关闭你的笔记本 5 秒左右,然后重新进入 windows 7, 关于这两者有何区别为何会导致 windows7 没有声音具体我也没搞明白,就如 deepin 官方回复一样:怎么可能!两者是两套不同的系统呀! 不过我猜测是热启动的时候两套系统共用了一些注册参数,而刚好 linux 把某些注册参数修改了,windows 无法识别了,而关机后冷启动这些注册参数会丢失,这样 windows 7 重新初始化这些参数就正常了

    3.9K90发布于 2018-02-24
  • 来自专栏linux运维

    系统声音问题:系统声音设置错误,影响使用

    测试音频输出播放测试声音,确保音频设备正常工作。# 播放双声道测试声音speaker-test -c 2 -t wav如果没有声音输出,请检查音量设置或音频服务状态。3. pulseaudio # 查看音频服务日志 journalctl -xe | grep pulseaudio如果服务未启动,可以手动启动:systemctl --user start pulseaudio7. 排查常见问题根据现象排查常见问题:无声音:检查是否选择了正确的输出设备,或是否有其他程序占用音频设备。音量异常:调整音量设置,确保未静音。爆音或杂音:尝试降低音量或更换音频线缆。9.

    2.1K10编辑于 2025-02-09
  • 来自专栏码上就说

    关于声音采集和声音处理的一些建议

    相机录制的过程除了采集画面,还有采集音频数据的过程,我们今天就主要介绍一下声音采集的过程以及采集的声音是怎么处理的。 声音采集 声音采集是系统提供的接口采集环境声,AudioRecord就是Android平台上提供的采集声音的系统API。 在采集声音之前,需要设置声音的采样率和声道数,通常情况下采样率是44100Hz,声道数是2。 avcodec_find_decoder(stream->codecpar->codec_id); if (codec == nullptr) { /// Error, 找不到对应的音频解码器 return; } /// 7. player_object_)->GetInterface(player_object_, SL_IID_BUFFERQUEUE, &buffer_queue_); RESULT_CHECK(result) /// 7.

    2.3K20编辑于 2022-05-25
  • 来自专栏KT148A

    KT148A语音芯片的声音小,如何让喇叭声音变大?声音影响注意点

    客户反馈他们的产品,声音小,提供的信息如下:喇叭参数是8欧姆1W ,包括外壳的出音孔客户声音小是必然的,原因如下:喇叭的尺寸太小了,并且这个选用的喇叭肯定是“薄膜型”的喇叭外壳的发音孔是不对的,太少了这个的声音 ,估计只有手机外放声音的40%左右。 跟KT148A本身的驱动力,是没有任何关系的,哪怕增加功放,声音都大不了,反而容易烧喇叭解决的办法也没有太多,只能从喇叭和腔体两个方面去选择选择稍微尺寸大一点的喇叭,尽可能大一点,尽量选择“纸盆”结构的喇叭外壳的腔体 ,要多的出音孔==》这个我们资料包也有详细的文档描述,路径如下:这里我们多增加一些关于产品的图片示例供您参考一般玩具,声音挺大的,他们选择的喇叭如下:一般外壳的出音孔设计如下:总之:声音的大小是一个系统的工作 ,KT148A本身驱动声音的能力是很大的,达到200mA,通过电流也可以看出来。

    71100编辑于 2025-01-09
  • 来自专栏达摩兵的技术空间

    聆听心灵的声音

    有些外向,声音好听,见多识广,会说话,善于微笑的人。有些特质确实是我们羡慕不来的,比如有些人就是方向感好,有些人就是数学超好,有的人英语很流利没有中国口音等。

    1.3K20发布于 2018-08-28
  • 来自专栏python3

    python 播放声音

    #import winsound #winsound.Beep(600,1000) import os os.system("paplay 1.wav") python使用pygame播放音乐. 链接地址:https://my.oschina.net/lenglingx/blog/183101 # -*- coding: cp936 -*- import pygame pygame.mixer.init() print("播放音乐1") track = pyga

    1.9K20发布于 2020-01-08
  • 来自专栏疯狂学习GIS

    让电脑播放手机的声音:不影响电脑自身声音

      本文介绍在Windows系统的电脑中,基于免费的Bluetooth Audio Receiver软件,实现用电脑播放手机声音,且与电脑自身声音不冲突同时播放的方法。    最近,需要将手机的声音投放至电脑播放,且希望电脑与手机的声音可以实现不冲突的同时播放——即二者不会出现“一个播放,另一个就要被自动暂停”的此消彼长的情况。 现在用手机开启音乐、视频等声音,就可以由电脑来播放啦;同时电脑还可以播放别的声音,做到二者互不冲突。如果出现声音比较小的情况,可以调整手机音量或电脑音量。

    7.2K10编辑于 2024-08-05
  • 来自专栏CreateAMind

    声音图片 多感知论文

    In this work, we show that a model trained to predict held-out sound from video frames learns a visual representation that conveys semantically meaningful information. We formulate our sound-prediction task as a classification problem, in which we train a convolutional neural network (CNN) to predict a statistical summary of the sound that occurred at the time a video frame was recorded.

    88320发布于 2018-08-20
  • 来自专栏鹅厂网事

    OFC上的腾讯声音

    "鹅厂网事"由深圳市腾讯计算机系统有限公司技术工程事业群网络平台部运营,我们希望与业界各位志同道合的伙伴交流切磋最新的网络、服务器行业动态信息,同时分享腾讯在网络与服务器领域,规划、运营、研发、服务等层面的实战干货,期待与您的共同成长。 网络平台部以构建敏捷、弹性、低成本的业界领先海量互联网云计算服务平台,为支撑腾讯公司业务持续发展,为业务建立竞争优势、构建行业健康生态而持续贡献价值! The Optical Fiber Communication Conference and Exhibition(OFC

    1.8K50发布于 2018-04-27
  • 来自专栏Fdu弟中弟

    HTML人工合成声音

    问答系统中可以使用的人工合成声音。 <!

    1.2K20发布于 2021-02-24
  • 来自专栏python3

    Python声音处理入门

    Python声音处理入门 注:本文加入了译者的理解,并非严谨的译作,仅供参考。 ---- 原文Basic Sound Processing with Python描述了怎样在Python中通过pylab接口对声音进行基本的处理。 可得信号持续时长为114ms: >>> 5060.0 / sampFreq 0.11473922902494331 下文我们只处理其中一个通道 s1 = snd[:, 0] python自身不支持播放声音 ,假如你想在python中回放声音,参考pyalsaaudio(Linux)或PyAudio。 用函数fft对声音进行快速傅立叶变换(FFT),得到声音的频谱。

    2.5K41发布于 2020-01-10
  • 来自专栏码客

    Android声音和亮度设置

    声音设置 调整手机的各种音量可以通过AudioManager这个类来操作 注:安卓手机各种音量的最大数值不一样,请通过下面具体的方法获取最大音量值。 STREAM_DTMF 双音多频 不过三方的Rom中 这些类型可能是多对一的 也就是 多种类型调节的是同一种 flags参数:(下面是常用的几个) FLAG_PLAY_SOUND 调整音量时播放声音

    2.7K20发布于 2019-10-22
  • 来自专栏码客

    iOS后台播放声音

    或者在项目的图形化配置界面的Info项添加如下 Required background modes 类型为 Array 添加子项App plays audio or streams audio/video using AirPlay

    2.5K10发布于 2019-10-22
  • 来自专栏新智元

    马斯克:人民的声音,上帝的声音

    他使用了一个拉丁语短语,意思是 「人民的声音,上帝的声音」。 不久,特朗普的账户重新出现在twitter上,他以前的推发布的5.9万推文都还在,但粉丝数大为减少,很可能是在封号期间被清理了。 今年7月12日,马斯克曾发推表示:「特朗普等到下届任期结束都82岁了,这对于任何公司的CEO都太老了,更别当美国总统了。」 特朗普岂能吃这个亏?

    73220编辑于 2023-01-07
  • 来自专栏硬件大熊

    浅析硬件“好声音”: 声学器件

    音视频硬件中,声学器件是必不可少的基础元件,声学器件主要包括麦克风和喇叭,麦克风拾取声音,喇叭播放声音。 麦克风可以将声音的变化通过特定的机制转换为电压或电流的变化,再交给电路系统进行处理。根据不同的声电转换机制,麦克风分为不同的类型,包括动圈式麦克风、电容式麦克风和压电式麦克风等。 又应平行板电容器的计算公式为C=εS/4πkd,其中ε为介电常数,S为极板的面积,k为常数,所以: U=4πkdQ/εS Δd∝ ΔU 当声音变化产生一个变动的声压,麦克风振膜检测到变动的声压后产生振动 ,改变振膜与背极板之间的距离Δd,进而产生一个变化的电压ΔU,经麦克风内部的芯片接收并输出,从而将声音信号转化为电信号,实现声-电的转换。 导体就会在垂直于磁场及电流的方向上受到力作用,在扬声器的磁路的间隙有一个环状磁场,线圈位于这个间隙内,当外界的信号电流发生改变时,根据佛来明左手定则,线圈就会随着电流的大小和方向受力运动,推动与音圈连在一起的振膜向外辐射声音

    1.7K20编辑于 2022-06-23
  • 来自专栏云鼎实验室的专栏

    云的声音|“刺杀”腾讯云

    下午六点半,Rud 的声音准时响起:“下班咯!不要搞了!回家啦!”如此督促,一天不落,就差给 E.m 他们搞来一群真正的程序员鼓励师了。 ? 不过,玩笑归玩笑,操守归操守。

    9.7K20发布于 2021-02-02
  • 来自专栏腾讯大讲堂的专栏

    【Android 音频】“声音”从何而来

    人耳所能听到的声音,最低的频率是 20Hz ~ 20KHZ,因此音频文件格式的最大带宽是 20KHZ。 根据奈奎斯特的理论,只有采样频率高于声音信号最高频率的两倍时,才能把数字信号表示的声音还原成为原来的声音,所以音频文件的采样率一般在 40~50KHZ,比如最常见的 CD 音质采样率 44.1KHZ。 对声音进行采样、量化过程被称为脉冲编码调制(Pulse Code Modulation),简称PCM。 ,也就是说在录音时本地无法播放声音 3、Hook 内录 通过以下 Android 的音频系统架构图可以看出,Android 提供的唯二接口:MediaPlayer 和 AudioTrack,最终都是经过 另外需要注意的就是 wwise 插件需要挂载到 Master Audio Bus 上,并且不能同时挂载多个,否则录制出来的声音会叠加在一起: 前面只是抛砖引玉。 想要实现一个插件远比上面说的复杂。

    3.3K40发布于 2020-08-05
领券