發表文章

我們與AI的距離:Google 即時語音辨識應用面面觀,標點符號自動輸入也 OK!

圖片
Google 在語音辨識領域的成就,大家都有目共睹!它也徹底改變人們對於文字輸入的型態,不再需要額外學習倉頡、嘸蝦米…等輸入法,就能達到快速、正確的中文輸入結果!在最近的更新中,Google  語音輸入已經支援標點符號自動輸入,如果你還沒有升級的,記得升級一下喔! 學習輸入法的時代已經過去,語音輸入當道,Google 文件與 SpeechNotes 語音輸入,讓您「用講的嘛會通」!   繼上一篇文章介紹的「 我們與AI的距離:免費開源 pyTranscriber 透過 Google 雲端語音自動辨識,超快速產生影片、錄音檔的文字字幕!(Windows、MAC、Linux) 」工具後,我們再來看看在即時語音辨識上,有哪些 Google AI 工具可以使用! 一、Google  語音輸入  Google  語音輸入整合在「Google」服務中,如果你的 Google 語音輸入還沒有自動加入標點符號的功能,請記得更新一下這個 APP 應用程式! 變更鍵盤為「Google 語音輸入」後,就會自動開始進行語音辨識與自動依據講話語氣,加入適當的標點符號,且在 辨識過程中會有兩次自動辨識 : 第一次:是單一句詞語的即時語音辨識 第二次:針對前後語意進行的詞語修正與標點符號修正 Google Play 版: https://play.google.com/store/apps/details?id=com.google.android.googlequicksearchbox App Store 版: https://apps.apple.com/tw/app/google/id284815942 比較可惜的是,目前 Google 語音輸入除了語音功能外,只有提供倒退刪除的基本功能,沒有任何其他的文字輸入修正或是表情符號…等額外功能,必須在輸入完成後,再切換到其他的輸入法,才能進行後續的編輯動作。 二、Gboard - Google 鍵盤:內建 Google 語音輸入與多字連寫的手寫輸入 Gboard - Google 鍵盤 APP是我目前最推薦的輸入方式,Gboard - Google 鍵盤已經內建 Google 語音輸入的功能,也支援多字...

OBS Studio 虛擬攝影棚開講:Andorid 手機只要開啟 USB 偵錯模式使用 Scrcpy 連線,免買高階網路攝影機,就能在 OBS 中擷取畫面並使用相機美肌功能!

圖片
幾乎每次的 OBS 研習中,都會有人問到:網路攝影機是否可以像手機一樣開啟「美肌功能」!這個要求真的對一般的 Webcam 來說有點困難,畢竟它的價格與功能就是沒有像手機這麼高檔! 有了 Scrcpy 就可以使用你自己的 Andorid 手機,或是拿已經退役「宅在家」的舊手機,拍出更高品質的影像、套用更多喜歡的特效,完全不用額外花費! 註:使用 Scrcpy 僅會將手機上的畫面在電腦上呈現,因此,使用 OBS 錄製影片時,還是需要額外接上麥克風,才能將聲音加入影片中喔! ※ Scrcpy 官方網站 https://github.com/Genymobile/scrcpy ※ Scrcpy Windows 免安裝版下載 scrcpy-win32-v1.16.zip 這次介紹的 Scrcpy 具有以下幾個優點: 可以使用 USB 連線的方式,讓連線時手機畫面更新的流暢性,比起一般透過 Wifi 或是 Internet 來得更順暢! 不用買高階網路攝影機,可以使用手機相機中的所有功能,當然也包括大家想要的美肌功能! 可直接在電腦端使用滑鼠操作手機畫面,不需在手機上面操作 支援 Windows、MAC、Linux 平台  Andorid 手機只需開啟 USB 偵錯模式,不需安裝任何 APP 應用程式 使用 Scrcpy 也有一些需要注意的事項,這裏也一併列出來: 需要 Andorid 5.0 以上的版本 需要開啟「USB 偵錯模式」 USB 連接線建議用具有比較好的傳輸數據功能,或是使用電腦上的 USB 3.0 插頭 手機應用程式 APP 畫面可以「自動旋轉」,但是部份手機的相機畫面只能直式呈現,必須透過 OBS 進行畫面的旋轉 (目前測試 ASUS Zenfen 不行,HTC 是可以自轉旋轉的) ※ 目前在 Windows 7 系統上測試,可能沒辦法正常使用,但在 Windows 10 的系統上是 OK,可能還需要大家自行測試看看喔! ※ 仲佑的網誌: 讓電腦可以控制手機/平板–Scrcpy 如果您想更深入了解 Scrcpy 如何運行在 adb 的機制上,強烈建議可以參考這篇文章! 一、開啟 Andorid 手機的「USB 偵錯模式」 由於不同品牌、...

我們與AI的距離:免費開源 pyTranscriber 透過 Google 雲端語音自動辨識,超快速產生影片、錄音檔的文字字幕!(Windows、MAC、Linux)

圖片
※ 20200520 更新: 我們與AI的距離:AutoSub-AHK 比 pyTranscriber 更有彈性且支援批次轉換的 AutoSub 圖形介面工具,快速產生影片、錄音檔的文字字幕!(Windows)    之前曾介紹過一些影音轉文字,或是透過語音輸入方式,進行語音辨識的文章! Google 文件與 SpeechNotes 線上語音辨識也能協助產生演講影音字幕、會議記錄的文字建檔工作,省時又省力! 學習輸入法的時代已經過去,語音輸入當道,Google 文件與 SpeechNotes 語音輸入,讓您「用講的嘛會通」!  重新認識 Andorid 與 iOS 上的「訊飛語音輸入法」,讓它「更懂我們的心」,為我們提供更好的語音辨識與輸入服務! 善用雲端服務提升工作效率:「網易見外」每天免費兩小時體驗 AI 雲端語音轉文字服務! 不過,都是以即時語音輸入的辨識為主,而「網易見外」因為有時間上的限制,且轉換的速度上需要比較久的時間,使用上確實不是那麼方便! 這次介紹的免費開源 pyTranscriber 針對電腦中的影片、錄音檔處理,不僅快速、精準,它使用 Google 雲端語音自動辨識服務,不用等待太久,就能自動產生影片、錄音檔的 純文字 TXT 與字幕檔 SRT ,更支援 Windows、MAC、Linux 平台! 註:字幕檔 SRT 格式也是文字檔,只是有加上字幕的影片起迄時間,除了可以使用文字編輯軟體開啟外,多數影音剪輯軟體或是 Youtube、Google 雲端硬碟都有支援匯入此格式的功能! 根據 pyTranscriber 官方網站上的說明,它使用 Autosub 免費開源程式,但提供比較友善的視覺化介面,讓使用者更方便使用 Autosub 中的 Google Speech Recognition API 進行語音自動辨識。 相信大家在行動裝置上對於 Google 語音辨識的精準度,都有很不錯的體驗,在一般口語化用語的準確度相當高,如果是專業術語,準確度就會降低一些!當然,語音辨識是否準確有很多的影響因素,包括發音的正確性、說話的速度、錄音的品質、錄音時的環境噪音…等!基本上,盡可能提供高品質的聲音檔案,對於提升語音辨識的正確率會有很大的幫助! ※  pyTrans...

OBS Studio 虛擬攝影棚開講:OBS 如何改變預設影片格式、如何設定錄影相關快速鍵與場景群組設定的匯入、匯出

圖片
如果您已經使用 OBS Studio 一段時間後,可能會有需要更進一步了解關於以下這些設定,才能更加快速靈活使用 OBS: 如何改變預設影片格式? 如何設定錄影相關快速鍵? 場景群組設定的匯入、匯出    一、如何改變預設影片格式?  OBS 預設的錄影影片格式已經從早期的 FLV 改為 MKV 格式,如果想要更改預設的錄影格式,可以從「設定」來調整! ※改成 MP4 格式的缺點 : 改為 MP4 格式若因為 OBS 沒有正常完整儲存,如當機、停電…等,該檔案將無法正常開啟。」 ※改成 MP4 格式的優點 : 錄影後可以直接開啟影片,不需要再進行重新封裝的動作! 二、如何設定錄影相關快速鍵? OBS 可以進行直播,也可以使用它進行單純的錄影,就像一般的錄影軟體一樣,如果能設定一些相關的快速鍵,就可以減少錄影後續影片剪輯的動作,畢竟,OBS 並沒有提供影片剪輯的功能! 1.建議一定要加入「停止串流」或是「停止實況」快速鍵 直播進行時若發生問題,除了按下「停止串流」,最好有設定快速鍵,快速畫面停止輸出。不需要進入 Youtube 管理頁面來結束直播! 2.使用 OBS 的錄影功能,為何開始錄製後,影片無法暫停 (無論是否有設定快速鍵) OBS 「錄影畫質」預設值「與串流同等畫質」會造成「錄影時無法暫停」,必須將「錄影畫質」改為其他選項,錄影時才能暫停喔! 三、場景群組設定的匯入、匯出? 當 OBS 中有愈來愈多的場景時,其實可以透過不同的「場景群組設定」來做切換,也可以將這些設定檔匯出備份。 場景群組設定匯出的檔案格式是 *.JSON 的文字檔,可以使用任何的文字編輯器開啟,裏面包含場景名稱、來源…等的各項設定! 因為此檔案為文字檔,場景中有使用到的所有圖檔、影片…等素材資料,僅以「絕對路徑」方式記錄在此文件中,如果素材檔案有移動位置,或是想要將設定檔轉移到不同電腦中,必須自行修正文件中的路徑,才能正確找到素材喔! ※ 延伸閱讀: 述文老師「OBS Studio 虛擬攝影棚應用」教學總整理 Google 協作平台推出囉!   OBS Studi...