ดาวน์โหลดโปรแกรมฟรี
       
   สมัครสมาชิก   เข้าสู่ระบบ

OmniVoice Studio (โปรแกรมถอดเสียง, พากย์วิดีโอ และโคลนเสียงด้วย AI)

 
OmniVoice Studio (โปรแกรมถอดเสียง, พากย์วิดีโอ และโคลนเสียงด้วย AI)
เมื่อ : วันนี้
ผู้เข้าชม : 356
โปรแกรม OmniVoice Studio เป็น AI ถอดเสียง, พากย์วิดีโอ, โคลนเสียง และทำ E-Book เสียงแบบรันบน PC ฟรี ไม่ต้องต่ออินเทอร์เน็ต

 
 
 
 
 
โหวตให้คะแนน
 
ดาวน์โหลด
 
(ครั้ง)
0
 
(ทั้งหมด)
0
 
(สัปดาห์ก่อน)
 
 

ข้อมูลทั่วไป ก่อน ดาวน์โหลดโปรแกรม

ปรับปรุงเมื่อ
(Last Updated : July 23, 2026)
ผู้เข้าชม 356 ครั้ง
ผู้พัฒนา
แพลตฟอร์ม
Windows Windows    macOS macOS    Linux / FreeBSD Linux / FreeBSD    
Windows, macOS, Linux / FreeBSD
 
 
0 OmniVoice+Studio+%28%E0%B9%82%E0%B8%9B%E0%B8%A3%E0%B9%81%E0%B8%81%E0%B8%A3%E0%B8%A1%E0%B8%96%E0%B8%AD%E0%B8%94%E0%B9%80%E0%B8%AA%E0%B8%B5%E0%B8%A2%E0%B8%87%2C+%E0%B8%9E%E0%B8%B2%E0%B8%81%E0%B8%A2%E0%B9%8C%E0%B8%A7%E0%B8%B4%E0%B8%94%E0%B8%B5%E0%B9%82%E0%B8%AD+%E0%B9%81%E0%B8%A5%E0%B8%B0%E0%B9%82%E0%B8%84%E0%B8%A5%E0%B8%99%E0%B9%80%E0%B8%AA%E0%B8%B5%E0%B8%A2%E0%B8%87%E0%B8%94%E0%B9%89%E0%B8%A7%E0%B8%A2+AI%29
A- A+
แชร์หน้าเว็บนี้ :

โปรแกรม OmniVoice Studio

OmniVoice Studio (โปรแกรมถอดเสียง, พากย์วิดีโอ และโคลนเสียงด้วย AI)

OmniVoice Studio (โปรแกรมถอดเสียง, พากย์วิดีโอ และโคลนเสียงด้วย AI) : โปรแกรม OmniVoice Studio คือโปรแกรมสำหรับประมวลผล และสร้างเสียงพูดด้วย ปัญญาประดิษฐ์ (AI) ที่ถูกวางตำแหน่งให้เป็นทางเลือกแบบใช้งานบนเครื่องผู้ใช้เอง (Local) เพื่อทดแทนบริการ คลาวด์ (Cloud) อย่าง ElevenLabs โดยเน้นจุดเด่นเรื่องความเป็นส่วนตัว และความยืดหยุ่นเป็นหลัก เนื่องจากกระบวนการประมวลผลทั้งหมดจะทำงานอยู่บนฮาร์ดแวร์คอมพิวเตอร์ของคุณเอง 100% โดยไม่ต้องส่งข้อมูลเสียงออกไป เซิร์ฟเวอร์ (Server) ภายนอก, ไม่ต้องสมัครสมาชิกรายเดือน, ไม่ต้องใช้ ส่วนต่อประสานโปรแกรมประยุกต์ (API) API Key และสามารถใช้งานได้แบบไม่จำกัดแม้อยู่ในสถานะออฟไลน์

ในด้านความสามารถหลัก โปรแกรม OmniVoice Studio รองรับงานด้านเสียงอย่างครอบคลุม ตั้งแต่ระบบเลียนแบบเสียง หรือ Voice Cloning แบบ Zero-shot ที่สามารถถอดแบบ และจำลองเสียงมนุษย์จากไฟล์ตัวอย่างเสียงสั้น ๆ เพียง 3 วินาที เพื่อนำไปสังเคราะห์เสียงพูดใหม่ในภาษาต่าง ๆ ที่รองรับมากถึง 646 ภาษา นอกจากนี้ยังมีระบบ Voice Design สำหรับออกแบบเสียงใหม่ตั้งแต่เริ่มต้น โดยเปิดให้ปรับแต่งคุณลักษณะได้อย่างละเอียด เช่น เพศ, ช่วงอายุ, สำเนียง, ระดับเสีย,ง โทน, อารมณ์ความรู้สึก และภาษาถิ่น เพื่อสร้างเสียงพากย์คาแรกเตอร์เฉพาะตัวขึ้นมาใช้งาน

สำหรับงานสายคอนเทนต์ และสื่อมวลชน โปรแกรม OmniVoice Studio มีระบบพากย์วิดีโอ (Video Dubbing) แบบครบวงจร ซึ่งสามารถนำเข้าไฟล์วิดีโอ หรือลิงก์วิดีโอเพื่อถอดเสียง, แปลภาษา, สลับเสียงพากย์ใหม่ และปรับจังหวะเวลาเสียงให้ตรงกับภาพก่อนส่งออกเป็นไฟล์ MP4 ได้ทันที อีกทั้งยังมีระบบ Audiobook Editor สำหรับสร้างหนังสือเสียงที่รองรับการนำเข้าไฟล์ข้อความ ePUB หรือ PDF พร้อมจัดการแยกบทอัตโนมัติ และส่งออกเป็นไฟล์ .m4b รวมถึงฟีเจอร์ Stories สำหรับจัดบทพากย์แบบหลายตัวละคร โดยกำหนดเสียงพูดแยกให้แต่ละตัวละครในเรื่องได้พร้อมกัน

ด้านการใช้งานทั่วไปประจำวัน โปรแกรม OmniVoice Studio มาพร้อมวิดเจ็ตพิมพ์ด้วยเสียง (Dictation Widget) ที่เรียกใช้งานผ่านคีย์ลัดได้จากทุกแอปพลิเคชัน เมื่อคุณพูด ระบบจะแปลงเสียงเป็นข้อความ และพิมพ์ลงในแอปพลิเคชันให้อัตโนมัติทันที ซึ่งสามารถทำงานร่วมกับ โมเดลภาษาขนาดใหญ่ (LLM) แบบ Local เพื่อช่วยเกลาประโยคให้สละสลวยขึ้นได้ด้วย นอกจากนี้ ยังรองรับการแยกเสียงพูดออกจากดนตรีประกอบด้วย Demucs และการระบุแยกแยะตัวตนผู้พูดด้วย Pyannote และ WhisperX

ในแง่ของสถาปัตยกรรม และการประมวลผล โปรแกรม OmniVoice Studio เป็นโปรแกรมข้ามแพลตฟอร์มที่รองรับทั้ง ระบบปฏิบัติการ (OS) วินโดวส์ (Windows), แมคโอเอส (macOS) และ ลีนุกซ์ (Linux) ตัวระบบรองรับเอนจินสังเคราะห์เสียง (TTS Engines) มากถึง 14 รูปแบบ และเอนจินถอดเสียง (ASR Engines) 10 รูปแบบ พร้อมระบบตรวจเช็กฮาร์ดแวร์เพื่อดึงพลังจาก กราฟิกการ์ด (GPU) ไม่ว่าจะเป็น NVIDIA CUDA, Apple Silicon (MPS) หรือ ROCm บน Linux และยังรองรับ โปรโตคอล (Protocol) MCP (Model Context Protocol) เพื่อให้เครื่องมือ AI อย่าง Claude หรือ Cursor สามารถเชื่อมต่อเข้ามารวมศูนย์การสั่งงานสร้างเสียงได้โดยตรง

คุณสมบัติ และความสามารถของ โปรแกรม OmniVoice Studio

โคลนนิ่งเสียง

  • เลียนแบบเสียงได้ด้วยไฟล์ตัวอย่างความยาวเพียง 3 วินาที
  • รองรับภาษาในการจำลองเสียงมากกว่า 646 ภาษา

ออกแบบเสียง

  • สร้าง และปรับแต่งเสียงใหม่ได้ตั้งแต่เริ่มต้น
  • กำหนดเพศ, อายุ, สำเนียง, ระดับเสียง (Pitch), ความเร็ว, อารมณ์ และภาษาถิ่น ได้อย่างละเอียด

ระบบพากย์เสียงวิดีโอ

  • นำเข้าจากลิงก์ YouTube หรือไฟล์วิดีโอได้
  • ทำงานครบวงจรตั้งแต่ ถอดความ (Transcribe) > แปลภาษา > พากย์เสียงใหม่ > ซิงค์เวลา > ส่งออกเป็นไฟล์วิดีโอ MP4

เครื่องมือทำหนังสือเสียง

  • นำเข้าไฟล์ข้อความ, EPUB หรือ PDF
  • แบ่งบทให้อัตโนมัติ (Auto-chaptering), ปรับระดับความดังเสียงให้สม่ำเสมอ (Loudnorm), จัดการ Meta Data และส่งออกเป็นไฟล์ .m4b

Stories ระบบบรรยายแบบหลายตัวละคร

  • ตัวแก้ไขแบบ Multi-Voice สำหรับบทสคริปต์
  • กำหนดเสียงพากย์แยกรายบรรทัด / รายตัวละคร, ลองฟังพรีวิว และส่งออกไฟล์เสียงของทั้งทีมนักแสดงได้

พิมพ์ด้วยเสียงผ่านคีย์ลัด

  • มีปุ่มคีย์ลัดเพื่อพิมพ์จากโปรแกรมไหนก็ได้
  • แปลงเสียงพูดเป็นข้อความ อัปเดตลงตำแหน่งเคอร์เซอร์ให้อัตโนมัติ แล้วซ่อนตัวลงหลังทำงานเสร็จ

ความเป็นส่วนตัว

  • ประมวลผลทุกอย่างบน ฮาร์ดแวร์ ของผู้ใช้เอง
  • ไม่เสียค่าบริการรายเดือน และไม่มีข้อมูลหลุดออกจากเครื่อง

รองรับ MCP Server

  • รองรับ Model Context Protocol (MCP) สามารถเชื่อมต่อใช้งาน OmniVoice Studio ร่วมกับ Claude, Cursor หรือแอป AI อื่น ๆ ได้โดยตรง

คุณสมบัติเสริมอื่น ๆ

  • ใช้เทคโนโลยี Demucs ในการแยกเสียงพูดออกจากเสียงเพลงประกอบ โดยยังคงรักษาเสียงเบื้องหลังเอาไว้ได้
  • ใช้ Pyannote + WhisperX ระบุ และแยกแยะว่าผู้พูดคนไหนกำลังพูดในคลิปเสียง
  • ระบบคิวประมวลผลไฟล์จำนวนมากพร้อมกัน เช่น ใส่ไฟล์วิดีโอ 50 ไฟล์แล้วปล่อยให้ระบบทยอยทำ
  • ใช้ AudioSeal (จาก Meta) ฝังลายน้ำดิจิทัลแบบล่องหนลงในไฟล์เสียง ซึ่งทนทานต่อการบีบอัดไฟล์

GPU Auto-Detect และ Engine Routing

  • ตรวจสอบฮาร์ดแวร์อัตโนมัติ รองรับทั้ง Nvidia CUDA, Apple Silicon (MPS), AMD ROCm และ CPU
  • มีระบบ Preflight Check ป้องกันไม่ให้แอบไปใช้ หน่วยประมวลผลกลาง (CPU) ประมวลผลโดยไม่แจ้งเตือน
  • รองรับ Engine สร้างเสียง (TTS) ถึง 14 ตัว และ Engine ถอดความ (ASR) ถึง 10 ตัว พร้อมสถาปัตยกรรมที่เขียนโค้ดเพิ่ม Engine ใหม่ได้ง่าย
  • Portable Personas ส่งออกไฟล์โปรไฟล์เสียงที่สร้างขึ้นเป็นแพ็กเกจ .ovsvoice เพื่อนำไปใช้ หรือแบ่งปันต่อได้
  • เจนเสียงได้ไม่จำกัดความยาวข้อความ พร้อมระบบแบ่งประโยคให้อัตโนมัติ และรองรับการสตรีมเสียงผ่าน WebSocket
  • ใช้ LLM ในเครื่องช่วยเกลาข้อความที่ถอดเสียงได้ให้อ่านง่ายและถูกต้องตามหลักไวยากรณ์

และความสามารถอื่น ๆ อีกมากมาย

เงื่อนไขการใช้งาน โปรแกรม OmniVoice Studio

โปรแกรม OmniVoice Studio เป็นซอฟต์แวร์ ฟรี (Free) ที่พัฒนาแบบ โอเพ่นซอร์ส (Open-Source) ที่อยู่ภายใต้เงื่อนไขการใช้งานแบบ  AGPL-3.0 License ซึ่งหมายความว่าผู้ใช้สามารถใช้งาน, ดัดแปลง, แจกจ่าย และเข้าถึง โค้ดต้นฉบับ (Source Code) ได้อย่างเสรี ภายใต้เงื่อนไขที่กำหนด

หากต้องการค้นหาข้อมูลเพิ่มเติม สามารถติดต่อกับทางผู้พัฒนาโปรแกรมนี้ได้ผ่านทางช่องทางเว็บไซต์ (Website) : https://palash.dev/omnivoice/ (ภาษาอังกฤษ) ได้เลย

คำบรรยายภาษาอังกฤษ (English Descriptions)

OmniVoice Studio is an artificial intelligence (AI) voice generation and processing software positioned as a local, privacy-focused alternative to cloud services like ElevenLabs. It prioritizes data privacy and flexibility, running 100% on your own computer hardware. No audio data is ever sent to external servers, requiring no monthly subscriptions, API keys, or active internet connection allowing for completely unlimited offline use.

When it comes to core capabilities, OmniVoice Studio offers a comprehensive suite of audio tools. Its zero-shot Voice Cloning feature can capture and mirror a human voice using just a 3-second sample clip, allowing you to synthesize speech across as many as 646 supported languages. Additionally, its Voice Design tool lets you build brand-new custom voices from scratch with deep control over traits such as gender, age bracket, accent, pitch, tone, emotion, and dialect to create unique character voices.

รูปประกอบ

  OmniVoice Studio (โปรแกรมถอดเสียง, พากย์วิดีโอ และโคลนเสียงด้วย AI) : OmniVoice Studio (โปรแกรมถอดเสียง, พากย์วิดีโอ และโคลนเสียงด้วย AI) :

 
0 OmniVoice+Studio+%28%E0%B9%82%E0%B8%9B%E0%B8%A3%E0%B9%81%E0%B8%81%E0%B8%A3%E0%B8%A1%E0%B8%96%E0%B8%AD%E0%B8%94%E0%B9%80%E0%B8%AA%E0%B8%B5%E0%B8%A2%E0%B8%87%2C+%E0%B8%9E%E0%B8%B2%E0%B8%81%E0%B8%A2%E0%B9%8C%E0%B8%A7%E0%B8%B4%E0%B8%94%E0%B8%B5%E0%B9%82%E0%B8%AD+%E0%B9%81%E0%B8%A5%E0%B8%B0%E0%B9%82%E0%B8%84%E0%B8%A5%E0%B8%99%E0%B9%80%E0%B8%AA%E0%B8%B5%E0%B8%A2%E0%B8%87%E0%B8%94%E0%B9%89%E0%B8%A7%E0%B8%A2+AI%29
แชร์หน้าเว็บนี้ :
Keyword คำสำคัญ
โปรแกรมอัดเสียง
 
 
 
 
Software  

โปรแกรมที่เกี่ยวข้อง !

 
Comment  

ความคิดเห็น ()

Spacer
 
ส่งโปรแกรม
Submit Software

บริการเช็คความเร็วเน็ต (Speedtest) และ เช็คไอพี (Check IP)

บริการเช็คความเร็วเน็ต (Speedtest) ใช้ทดสอบความเร็วเน็ต พร้อมบริการ เช็คไอพี ตรวจสอบความถูกต้องไอพีของคุณ