匯幫音頻大師 v4.0.1.0 官方安裝版24.7MB / 12-04
星優(yōu)音頻助手(格式轉(zhuǎn)換/壓縮/分割/變速)V2.1.0 官方安裝版774KB / 06-13
音頻修復iZotope RX 11 Audio Editor Advanced v11.2.0 免安裝綠1.9GB / 11-18
aiXdsp Intuition Compressor(音頻壓縮器) v3.0.3 免費安裝版 附24MB / 03-05
削波效果器插件Yum Audio Crispy Clip Light v1.1.2 官方免費安22.5MB / 02-29
Anemond Factoid(音頻剪輯插件) v2.0.1 免費安裝版 附圖文教程26.3MB / 02-26
TBProAudio ABLM(音頻增益控制插件) v2.2.4 免費安裝版 附圖文安5.30MB / 02-22
伴奏與人聲一鍵分離工具Ultimate Vocal Remover GUI(UVR5) v5.6.8.1GB / 03-13
Steinberg WaveLab Elements(音頻編輯/母帶處理軟件) v12.0.10 368MB / 02-11
JMG Sound BITPUNK(模擬復古數(shù)字音頻失真效果的插件) v1.2 安裝16MB / 02-04
-
-
Taggin MP3(音頻壓縮處理軟件) v1.5 綠色免費版 音頻處理 / 651 KB
-
iZotope RX 12 Audio Editor Advanced v12.0.0 一鍵免費直裝版 6 音頻處理 / 1.0GB
-
-
-
音頻錄制和編輯程序 Cockos REAPER v7.68 漢化安裝版 音頻處理 / 16.23MB
-
Cyberlink AudioDirector Ultra 2026 v16.3.6331.1 多語言安裝版 音頻處理 / 136.8MB
-
金飛翼音頻編輯大師 v10.1.0 官方免費安裝版 音頻處理 / 96.9MB
-
大餅AI變聲 v2.5.11 官方安裝版 音頻處理 / 138MB
-
易譜ziipoo軟件 v2772 免費安裝版 32位 音頻處理 / 276MB
詳情介紹
FasterWhisperGUI是一款帶有 PySide6 的 fast_whisper 的 GUI 軟件,你可以將音頻或視頻文件轉(zhuǎn)錄為srt/txt/smi/vtt/lrc文件,將在線OpenAI-whisper模型轉(zhuǎn)換為ct2格式,并且提供VAD模型和whisper模型的所有參數(shù),目前支持whisperX,Democs 模型,whisper large-v3模型。
聽到Whisper,這個大家可能有點熟悉,這是OpenAI做的一個神經(jīng)網(wǎng)絡模型,可以在本地實時語音轉(zhuǎn)文字,用來翻譯和做字幕等,之前給大家介紹過一款叫做Constme-Whisper的軟件,可以快速進行離線語音文字識別,還有GPU加速等等。
而faster-whisper-GUI增添了更多的特性,可以快速把音視頻文件轉(zhuǎn)成srt/txt/smi/vtt/lrc,支持Demucs、FastWhiper和whisperX、VAD-model這些技術(shù),簡單來說,支持的可調(diào)整的選項要比之前推薦的工具更多一點。
由于這類工具離線處理的特點,所以體積都比較大,faster-whisper-GUI的本體有1.6個G,安裝完之后的占用又是6個多G,而且還不包括后續(xù)添加模型的大小,建議大家體驗的時候,裝在空間富裕的盤里。


如果是分離音頻和背景音樂的話,直接把文件丟進來就行,試了一下效果還不錯,也可以單獨設(shè)置輸出的內(nèi)容。


其他的就需要加載一下額外模型了,把模型加載的時候需要注意,有個處理設(shè)備的選項,CPU還是CUDA,如果你用的不是英偉達的顯卡,選擇自動就好了,不然會提示加載失敗。

模型也有多重選擇,如果上面帶有V3標志,記得把這個開關(guān)打開。

模型也有多重選擇,如果上面帶有V3標志,記得把這個開關(guān)打開。


來試試語音轉(zhuǎn)文字,如果你覺得自己的設(shè)備處理等待時間有點長,在軟件執(zhí)行的時候可以掛在后臺和切換到其他界面,在它的詳情頁面能看到輸出的具體信息,它的正確率還是比較高的,中英文混合與首字母大小寫這些細節(jié)都有。

這類機器識別和人一樣,識別率還不能做到100%正確,識別完之后,會有一些錯誤需要手動調(diào)整,在faster-whisper-GUI里,它會自己跳轉(zhuǎn)到字幕制作的界面,可以快速瀏覽調(diào)整,在這里分割不同說話人的文本等等

在設(shè)置里面,還有許多細節(jié)可以調(diào)整,調(diào)整音頻的默認語言和翻譯,以及各種防止幻聽的參數(shù)。

這個功能在一些視頻編輯軟件還是需要收費的,或者需要云端處理,識別的準確率也就那樣。
更新日志
0.8.0 改動
修復沒有贊助渠道的 bug #126
升級 faster-whisper 到 1.02 版本
添加 distil-large-v3 模型在線模式支持 #130
最新的 Distil-Whisper 模型 distil-large-v3 本質(zhì)上是為與 OpenAI 順序算法配合使用而設(shè)計的。
支持初始化更多 whisper 模型參數(shù)
音頻分段設(shè)置
max_new_tokens: 每個區(qū)塊生成的新令牌的最大數(shù)量。如果未設(shè)置,最大值將通過默認的 max_size 設(shè)置。
chunk_length: 音頻段的長度。如果不是 None,它將覆蓋 FeatureExtractor 的默認chunk_size。
clip_timestamps: 逗號分隔的要處理的剪輯的時間戳列表(以秒為單位)開始,結(jié)束,開始,結(jié)束......。最后一個結(jié)束時間戳默認為文件的結(jié)束。如果使用 clip_timestamps,將忽略 VAD 設(shè)置。
幻聽參數(shù)
hallucination_silence_threshold: 當 word_timestamps 為 True 時,當檢測到可能的幻覺時,跳過長于此閾值(以秒為單位)的靜默期。
其他設(shè)置
hotwords: 為模型提供的熱詞/提示短語。如果 prefix 不是 None,則無效。 你可以輸入提示詞,類似于:“the video is about comfyUI”。
常規(guī)
language_detection_threshold: 如果語言標記的最大概率高于此值,則會檢測為該語言。
language_detection_segments: 語言檢測需要考慮的分段數(shù)量。
其他新特性:https://github.com/SYSTRAN/faster-whisper/releases/tag/v1.0.2
修復 復制字幕 功能的 bug
更新一些 UI 文字
停用 轉(zhuǎn)寫參數(shù) 頁面的 保存參數(shù)、讀取參數(shù) 功能
起止時間、說話人 列居中顯示
升級 pytorch 到 2.3.0 , CUDA12
提示
軟件需要完全卸載舊版之后安裝新版(cache文件夾可不做清理)
需要安裝 ffmpeg
使用 V3 模型時,如果頻繁出現(xiàn)顯存溢出,請嘗試更新顯卡驅(qū)動程序到最新或者回退到上一個穩(wěn)定版本,當前版本(2024.5.29)測試結(jié)果穩(wěn)定。
下載地址
人氣軟件

PreSonus Studio One 6 Professional V6.6.2 中文永久免費版(附
最強伴奏與人聲一鍵分離工具Ultimate Vocal Remover GUI(UVR5) v
PreSonus Studio One Pro 7 v7.2.1 中文完整免費版(附安裝教程)
Studio One6機架效果包插件 V6.0.2 中文免費版(附使用教程)
大餅AI變聲 v2.5.11 官方安裝版
IBM ViaVoice Pro語音識別輸入系統(tǒng) v9.1 簡體中文版
Adobe Audition 2024(Au2024) v24.6.0.069 中文安裝免費版 64位
阿里開源語音模型CosyVoice 0721 整合包 免費版
終極伴奏人聲提取工具 Ultimate Vocal Remover(UVR) v5.5.1 中文
Native Instruments Kontakt 8 v8.9.0 完整安裝免費版(附文件+教
相關(guān)文章
-
智能音頻處理專家(格式轉(zhuǎn)換/壓縮/合并)v1.0.2.0 官方安裝版智能音頻處理專家Smart Audio Expert專業(yè)的音頻處理軟件,提供了音頻轉(zhuǎn)換、合并、壓縮、調(diào)速以及bilibili轉(zhuǎn)音頻等...
-
優(yōu)靈音頻格式轉(zhuǎn)換器 V3.2.5.1 官方安裝版優(yōu)靈音頻格式轉(zhuǎn)換器支持海量格式一鍵轉(zhuǎn)換,支持多種視頻格式轉(zhuǎn)換,一鍵添加視頻文件,批量提取成音頻等,歡迎下載使用...
-
EZ Meta Tag Editor 音頻標簽編輯器 v12.3.4.1 綠色免費版EZ Meta Tag Editor是一款專業(yè)實用的音樂文件編輯軟件,有的時候用戶需要對音樂添加各種標簽,或者編輯音樂的各個參數(shù)進行管理,直接通過該軟件就可以直接進行設(shè)置,歡迎需...
-
廣告配音王(配音軟件) V1.0 免費安裝版廣告配音王是一款真正為廣告行業(yè)量身打造的專業(yè)軟件,它不僅簡化了文字轉(zhuǎn)語音的過程,還大大提高了音頻文件的質(zhì)量...
-
冬瓜配音 v1.4.1 官方安裝版冬瓜配音提供多樣的語音庫,涵蓋各種音色、語調(diào),滿足用戶多樣化的配音需求,歡迎下載使用...
-
優(yōu)聲音頻轉(zhuǎn)換大師 V1.0.1.1 官方安裝版優(yōu)聲音頻轉(zhuǎn)換大師支持音頻格式轉(zhuǎn)換、音頻合并、音頻變速、音頻剪切、音頻變調(diào)、音頻添加封面、音頻音量調(diào)整等功能...
下載聲明
☉ 解壓密碼:m.fzitv.net 就是本站主域名,希望大家看清楚,[ 分享碼的獲取方法 ]可以參考這篇文章
☉ 推薦使用 [ 迅雷 ] 下載,使用 [ WinRAR v5 ] 以上版本解壓本站軟件。
☉ 如果這個軟件總是不能下載的請在評論中留言,我們會盡快修復,謝謝!
☉ 下載本站資源,如果服務器暫不能下載請過一段時間重試!或者多試試幾個下載地址
☉ 如果遇到什么問題,請評論留言,我們定會解決問題,謝謝大家支持!
☉ 本站提供的一些商業(yè)軟件是供學習研究之用,如用于商業(yè)用途,請購買正版。
☉ 本站提供的FasterWhisperGUI(音頻處理工具) v0.8.0 安裝免費版資源來源互聯(lián)網(wǎng),版權(quán)歸該下載資源的合法擁有者所有。



