最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

FasterWhisperGUI(音頻處理工具) v0.8.0 安裝免費版

FasterWhisperGUI下載

  • 軟件大小:1.7GB
  • 軟件語言:簡體中文
  • 軟件類型:國產(chǎn)軟件
  • 軟件授權(quán):免費軟件
  • 軟件類別:音頻處理
  • 應用平臺:Windows平臺
  • 更新時間:2024-07-03
  • 網(wǎng)友評分:
360通過 騰訊通過 金山通過

情介紹

FasterWhisperGUI是一款帶有 PySide6 的 fast_whisper 的 GUI 軟件,你可以將音頻或視頻文件轉(zhuǎn)錄為srt/txt/smi/vtt/lrc文件,將在線OpenAI-whisper模型轉(zhuǎn)換為ct2格式,并且提供VAD模型和whisper模型的所有參數(shù),目前支持whisperX,Democs 模型,whisper large-v3模型。

聽到Whisper,這個大家可能有點熟悉,這是OpenAI做的一個神經(jīng)網(wǎng)絡模型,可以在本地實時語音轉(zhuǎn)文字,用來翻譯和做字幕等,之前給大家介紹過一款叫做Constme-Whisper的軟件,可以快速進行離線語音文字識別,還有GPU加速等等。

而faster-whisper-GUI增添了更多的特性,可以快速把音視頻文件轉(zhuǎn)成srt/txt/smi/vtt/lrc,支持Demucs、FastWhiper和whisperX、VAD-model這些技術(shù),簡單來說,支持的可調(diào)整的選項要比之前推薦的工具更多一點。 

由于這類工具離線處理的特點,所以體積都比較大,faster-whisper-GUI的本體有1.6個G,安裝完之后的占用又是6個多G,而且還不包括后續(xù)添加模型的大小,建議大家體驗的時候,裝在空間富裕的盤里。 

如果是分離音頻和背景音樂的話,直接把文件丟進來就行,試了一下效果還不錯,也可以單獨設(shè)置輸出的內(nèi)容。 

其他的就需要加載一下額外模型了,把模型加載的時候需要注意,有個處理設(shè)備的選項,CPU還是CUDA,如果你用的不是英偉達的顯卡,選擇自動就好了,不然會提示加載失敗。

模型也有多重選擇,如果上面帶有V3標志,記得把這個開關(guān)打開。

模型也有多重選擇,如果上面帶有V3標志,記得把這個開關(guān)打開。

來試試語音轉(zhuǎn)文字,如果你覺得自己的設(shè)備處理等待時間有點長,在軟件執(zhí)行的時候可以掛在后臺和切換到其他界面,在它的詳情頁面能看到輸出的具體信息,它的正確率還是比較高的,中英文混合與首字母大小寫這些細節(jié)都有。

這類機器識別和人一樣,識別率還不能做到100%正確,識別完之后,會有一些錯誤需要手動調(diào)整,在faster-whisper-GUI里,它會自己跳轉(zhuǎn)到字幕制作的界面,可以快速瀏覽調(diào)整,在這里分割不同說話人的文本等等 

在設(shè)置里面,還有許多細節(jié)可以調(diào)整,調(diào)整音頻的默認語言和翻譯,以及各種防止幻聽的參數(shù)。 

這個功能在一些視頻編輯軟件還是需要收費的,或者需要云端處理,識別的準確率也就那樣。

更新日志

0.8.0 改動

修復沒有贊助渠道的 bug #126

升級 faster-whisper 到 1.02 版本

添加 distil-large-v3 模型在線模式支持 #130

最新的 Distil-Whisper 模型 distil-large-v3 本質(zhì)上是為與 OpenAI 順序算法配合使用而設(shè)計的。

支持初始化更多 whisper 模型參數(shù)

音頻分段設(shè)置

max_new_tokens: 每個區(qū)塊生成的新令牌的最大數(shù)量。如果未設(shè)置,最大值將通過默認的 max_size 設(shè)置。

chunk_length: 音頻段的長度。如果不是 None,它將覆蓋 FeatureExtractor 的默認chunk_size。

clip_timestamps: 逗號分隔的要處理的剪輯的時間戳列表(以秒為單位)開始,結(jié)束,開始,結(jié)束......。最后一個結(jié)束時間戳默認為文件的結(jié)束。如果使用 clip_timestamps,將忽略 VAD 設(shè)置。

幻聽參數(shù)

hallucination_silence_threshold: 當 word_timestamps 為 True 時,當檢測到可能的幻覺時,跳過長于此閾值(以秒為單位)的靜默期。

其他設(shè)置

hotwords: 為模型提供的熱詞/提示短語。如果 prefix 不是 None,則無效。 你可以輸入提示詞,類似于:“the video is about comfyUI”。

常規(guī)

language_detection_threshold: 如果語言標記的最大概率高于此值,則會檢測為該語言。

language_detection_segments: 語言檢測需要考慮的分段數(shù)量。

其他新特性:https://github.com/SYSTRAN/faster-whisper/releases/tag/v1.0.2

修復 復制字幕 功能的 bug

更新一些 UI 文字

停用 轉(zhuǎn)寫參數(shù) 頁面的 保存參數(shù)、讀取參數(shù) 功能

起止時間、說話人 列居中顯示

升級 pytorch 到 2.3.0 , CUDA12

提示

軟件需要完全卸載舊版之后安裝新版(cache文件夾可不做清理)

需要安裝 ffmpeg

使用 V3 模型時,如果頻繁出現(xiàn)顯存溢出,請嘗試更新顯卡驅(qū)動程序到最新或者回退到上一個穩(wěn)定版本,當前版本(2024.5.29)測試結(jié)果穩(wěn)定。

  • FasterWhisperGUI(音頻處理工具) v0.8.0 安裝免費版

載地址

下載錯誤?【投訴報錯】

FasterWhisperGUI(音頻處理工具) v0.8.0 安裝免費版

      氣軟件

      關(guān)文章

      載聲明

      ☉ 解壓密碼:m.fzitv.net 就是本站主域名,希望大家看清楚,[ 分享碼的獲取方法 ]可以參考這篇文章
      ☉ 推薦使用 [ 迅雷 ] 下載,使用 [ WinRAR v5 ] 以上版本解壓本站軟件。
      ☉ 如果這個軟件總是不能下載的請在評論中留言,我們會盡快修復,謝謝!
      ☉ 下載本站資源,如果服務器暫不能下載請過一段時間重試!或者多試試幾個下載地址
      ☉ 如果遇到什么問題,請評論留言,我們定會解決問題,謝謝大家支持!
      ☉ 本站提供的一些商業(yè)軟件是供學習研究之用,如用于商業(yè)用途,請購買正版。
      ☉ 本站提供的FasterWhisperGUI(音頻處理工具) v0.8.0 安裝免費版資源來源互聯(lián)網(wǎng),版權(quán)歸該下載資源的合法擁有者所有。

      伊春市| 马山县| 光山县| 克东县| 剑川县| 柳江县| 余庆县| 平泉县| 裕民县| 安国市| 观塘区| 文水县| 云龙县| 金寨县| 襄汾县| 壶关县| 清苑县| 华蓥市| 调兵山市| 诏安县| 淮南市| 云林县| 扎囊县| 梧州市| 望都县| 繁昌县| 遂平县| 邮箱| 资溪县| 铁力市| 遂平县| 西畴县| 洪泽县| 西充县| 大埔区| 天津市| 库伦旗| 安新县| 沁源县| 神池县| 积石山|