macOS 14+ · Apple Silicon

พูดกับคอมพิวเตอร์ของคุณ
ไม่ต้องพิมพ์

เห็นเมื่อไมค์พร้อม พูด ปรับ แล้ววาง ถอดเสียงใน Mac และคุยกับ AI เอเจนต์ ไม่ต้องมีบัญชี ไม่มีค่าสมาชิก

ดาวน์โหลดฟรี

เขียนตามคำบอก 100 ครั้งฟรี · 50 บันทึก · 10 บันทึกประชุม · ไม่ต้องใช้บัตรเครดิต

หรือติดตั้งผ่าน brew install muvon/tap/vext

macOS 14+ · Apple Silicon · ไม่ต้องมีบัญชี

วิธีใช้งาน

ปุ่มลัดเดียว แถบเดียว ตั้งแต่เปิดไมค์จนวางข้อความ

1

กดปุ่มลัดค้างไว้

กดปุ่มลัดค้างไว้ พูดเมื่อแถบเป็นสีแดง ไมค์พร้อมแล้ว

2

พูดอย่างเป็นธรรมชาติ

พูดตามปกติ ดูคำปรากฏในแถบด้วย Parakeet ในเครื่อง

3

ปล่อยปุ่มเพื่อวาง

ปล่อยปุ่ม ดูการถอดเสียงและปรับข้อความ Esc ข้าม AI หากพลาด เก็บเสียงไว้ลองใหม่

เห็นทุกขั้นตอนก่อนวางข้อความ

ดูแถบเดียวตั้งแต่เปิดไมค์จนวางข้อความ พบกับแถบเขียนตามคำบอกใหม่ใน Vext 1.5.1

  • พูดเมื่อแถบเป็นสีแดง การลดเสียงไม่หน่วงการบันทึกแล้ว
  • ดูข้อความระหว่างถอดเสียงและปรับ พร้อมเวลาและสถานะบนแถบเมนู
  • กด Esc ข้ามการปรับที่ช้าหรือโหลดโมเดล วางตามที่พูด

ลองใหม่ หากการบันทึกไม่สำเร็จ เสียงจะถูกเก็บไว้ ลองใหม่ได้จากแถบโดยตรง

สิ่งใหม่เพิ่มเติมใน 1.5.1

  • ใช้ Cmd ขวาและ Fn โดยไม่ลั่นเมื่อกด Cmd+C หรือ Fn+Delete
  • ดูปุ่มลัดของคุณในเมนู
  • ใช้สิทธิ์ที่ซื้อไว้แบบออฟไลน์
  • ดาวน์โหลด AI ในเครื่องเมื่อรูปแบบหรือการแปลต้องใช้
  • ใช้ตัวเลือกระบบ จำนวนและเวลาตามภาษา และตั้งค่าผ่านแถบด้านข้าง
  • ส่งออกการเขียนตามคำบอก โน้ต และการประชุม — TXT และ Markdown พร้อม SRT และ VTT สำหรับการประชุม
  • เปิดการตั้งค่าระบบจากขั้นตอนเริ่มต้นหลังปฏิเสธสิทธิ์
  • เห็นราคาในปุ่มซื้อ
อ่านบันทึกประจำรุ่น 1.5.1

สามโหมด หนึ่งแอป

เขียนตามคำบอก บันทึกการประชุม และเก็บโน้ต ใช้ในเครื่องทั้งหมดเป็นค่าเริ่มต้น

เขียนตามคำบอก

กดปุ่มลัด พูด ปล่อย — ข้อความปรากฏที่เคอร์เซอร์ ใช้งานได้กับทุกแอป ทุกช่องข้อความ

การประชุม

บันทึกพร้อมป้ายผู้พูด รับข้อความถอดเสียงเต็ม ภาพหน้าจอ และสรุปจาก AI

บันทึก

บันทึกเสียงสั้น ๆ — ถอดเสียง ทำความสะอาด และเก็บในแอปสำหรับใช้ภายหลัง

เลือกรูปแบบของคุณ
วางข้อความที่ต้องการ

เลือกว่าข้อความจะออกมาอย่างไร ใช้ตามที่พูด จัดให้เรียบร้อย หรือเลือกรูปแบบตามแอป

  • ตามที่พูด หรือ จัดให้เรียบร้อย
  • อีเมล ข้อความ หัวข้อย่อย ทางการ หรือ กำหนดเอง
  • ตั้งรูปแบบการเขียนตามคำบอกแยกสำหรับแต่ละแอป
  • ใช้รูปแบบพร้อมการแปลได้ กด Esc เพื่อข้าม AI ระหว่างปรับข้อความ
สิ่งที่คุณพูด

"เอ่อ ก็คือผมคิดว่าเราควรจะอืมน่าจะเลื่อนกำหนดส่งไปเป็นวันศุกร์หน้าเพราะเอ่อทีมต้องการเวลาเพิ่มเพื่อทำให้ เอ่อ integration test เสร็จ"

สิ่งที่ถูกวาง

"เราควรเลื่อนกำหนดส่งไปเป็นวันศุกร์หน้า — ทีมต้องการเวลาเพิ่มเพื่อทำให้การทดสอบ integration เสร็จ"

รูปแบบการเขียนตามคำบอก

เลือกตามที่พูด จัดให้เรียบร้อย อีเมล ข้อความ หัวข้อย่อย ทางการ หรือกำหนดเอง ตั้งรูปแบบตามแอป Esc ข้ามการปรับด้วย AI

ตามที่พูด

ถ้อยคำเดิม

วางข้อความถอดเสียงต้นฉบับโดยไม่ให้ AI เขียนใหม่

จัดให้เรียบร้อย

ปรับเล็กน้อย

ปรับไวยากรณ์ เครื่องหมายวรรคตอน และคำฟุ่มเฟือย

อีเมล · ข้อความ

รูปแบบแยกตามแอป

เตรียมคำบอกให้เป็นจดหมายหรือคำตอบสั้นในแชต

หัวข้อย่อย · ทางการ · กำหนดเอง

เลือกได้เอง

จัดเป็นรายการ ใช้น้ำเสียงทางการ หรือเขียนคำสั่งของคุณเอง

เสียงของคุณอยู่บน Mac ของคุณ

ทำงานในเครื่องเป็นค่าเริ่มต้น โมเดลเสียงและ AI ทำงานบน Apple Silicon ไม่มีการอัปโหลดเว้นแต่คุณเพิ่มคีย์ API ของตัวเอง

ใช้ในเครื่องเป็นค่าเริ่มต้น

ถอดเสียงด้วย Parakeet TDT v3 ผ่าน FluidAudio หรือเลือก Apple Speech ปรับข้อความด้วยโมเดล MLX ในเครื่อง

ทำงานออฟไลน์ได้

ดาวน์โหลดโมเดลครั้งเดียว แล้วถอดเสียงและปรับข้อความออฟไลน์ การตรวจสอบสิทธิ์ใช้งานเชื่อมต่อกับเซิร์ฟเวอร์ Vext

ไม่ต้องมีบัญชี ไม่มีเทเลเมทรี

เริ่มใช้โดยไม่ต้องมีบัญชี Vext ไม่มี SDK เทเลเมทรีหรือการติดตามการใช้งาน

ลองฟรี จ่ายครั้งเดียว ใช้ตลอดไป

เริ่มต้นด้วยเขียนตามคำบอก 100 ครั้ง 50 บันทึก และ 10 บันทึกประชุมฟรี จากนั้นจ่ายครั้งเดียว ใช้ไม่จำกัด

คุ้มที่สุด

Vext

$49 ครั้งเดียว

$0 ในปีที่ 2

  • ทำงานในเครื่อง
  • ไม่ต้องมีบัญชี
  • ถอดเสียงประชุม
  • เข้าถึงตลอดชีพ
  • อัปเดตฟรีในเวอร์ชัน
ซื้อ Vext

เครื่องมือเสียงบนคลาวด์

$10–30 /เดือน

$120–360/ปี

  • ขึ้นอยู่กับคลาวด์
  • ต้องมีบัญชี
  • มีโควต้าการใช้งาน
  • เฉพาะแบบสมาชิก
  • ต้องแลกความเป็นส่วนตัว

ปลดล็อกจากในแอปเมื่อพร้อม รวมอัปเดตฟรี เวอร์ชันใหม่หลักลด 50% สำหรับเจ้าของปัจจุบัน

Vext เปรียบเทียบอย่างไร

เปรียบเทียบฟีเจอร์ต่อฟีเจอร์กับเครื่องมือเสียงและการประชุมชั้นนำ

Vext $49 ครั้งเดียวWispr Flow $12–15/moGranola $14–35/moOtter.ai $8–17/mo
เขียนตามคำบอก (วางที่เคอร์เซอร์)
ถอดเสียงประชุม
บันทึกเสียง
ป้ายผู้พูด
จดจำเสียงข้ามการประชุมN/A
ทำความสะอาดข้อความด้วย AI
สรุปการประชุม
การแปล
จับภาพหน้าจอ (ทุกโหมด)
ภาพหน้าจอวางตรงไป AIN/AN/A
โหมด YOLO (ส่งอัตโนมัติ)N/AN/A
ข้อความถอดเสียงสดขณะพูด
สไตล์การพูดแยกตามแอป
ทำงานในเครื่องทั้งหมด ไม่ต้องใช้คลาวด์
ทำงานออฟไลน์
ไม่มีบอทเข้าร่วมสายN/A
แสดงเมื่อไมค์รับเสียงจริง · Esc ข้าม AI ระหว่างการเขียนตามคำบอกN/AN/AN/A
ค่าใช้จ่ายหลัง 2 ปี$49$288–360$336–840$200–408

N/A: ไม่เกี่ยวข้องหรือยังไม่ยืนยัน
อัปเดต 5 กันยายน 2026 สำหรับ Vext 1.5.1 และแถวเรื่องบอต ข้อมูลคู่แข่งและราคาอื่นอ้างอิงเมษายน 2026 และอาจเปลี่ยนแปลงได้

เห็นคำพูดขณะกำลังพูด

ดูคำปรากฏด้วย Parakeet ในเครื่อง ติดตามการถอดเสียงและปรับข้อความในแถบเดิมพร้อมเวลาที่ผ่านไป

150x เรียลไทม์

เสียง 60 วินาทีถอดได้ใน ~400ms ในเครื่อง

Parakeet ในเครื่อง
150x
Apple ในเครื่อง
25x
Gemini คลาวด์
23x
OpenAI คลาวด์
22x
AssemblyAI คลาวด์
20x
Alex 00:12

มาทบทวนแผน Q3 และตัดสินใจลำดับความสำคัญกัน

Sarah 00:28

ฉันคิดว่าเราควรโฟกัสที่การออกแบบ API ใหม่ก่อน มันกำลังบล็อกอีกสามทีม

Alex 00:45

เห็นด้วย เราเตรียมร่างให้เสร็จสิ้นสัปดาห์หน้าได้ไหม

ถอดเสียงการประชุม
พร้อมสรุป

บันทึกการประชุมไหนก็ได้ — Zoom, Google Meet, FaceTime หรือพบกันตัวจริง — และรับข้อความถอดเสียงเต็มพร้อมระบุผู้พูด เปิด Summarize เพื่อดึงประเด็นสำคัญและรายการที่ต้องทำ บันทึกทั้งสองเวอร์ชันเสมอ

  • แสตมป์เวลาและการแบ่งตามผู้พูด
  • จับเสียงระบบ + ไมโครโฟน
  • ประเด็นสำคัญและรายการต้องทำด้วย AI
  • ข้อความถอดเสียงดิบถูกเก็บไว้เสมอ
  • รับคำแนะนำให้บันทึกเมื่อไมค์ทำงานกับ Zoom, Microsoft Teams, Slack, FaceTime, Discord, Webex, Skype หรือ Loom

ติดป้ายผู้พูดครั้งเดียว
จดจำตลอดไป

Vext ตรวจจับเสียงที่แตกต่างกันในการประชุมของคุณโดยอัตโนมัติ ตั้งชื่อครั้งเดียว — และตั้งแต่สายต่อไป คนเดิมจะถูกระบุ ติดป้าย และใส่รหัสสีโดยไม่ต้องทำอะไร

  • ตรวจจับผู้พูดอัตโนมัติในทุกการบันทึก
  • ติดป้ายด้วยชื่อกำหนดเอง — เก็บในไลบรารีของคุณ
  • เสียงเดิมถูกติดป้ายอัตโนมัติในการประชุมต่อไป
  • ชิปรหัสสีเพื่อสแกนข้อความถอดเสียงเร็ว ๆ
การประชุม #1 ผู้พูด
พวกเขา Sarah
ฉัน John
ผู้พูด 1 Jack
การประชุม #2 ติดป้ายอัตโนมัติ
Sarah
John
Jack

เสียง + ภาพ
ปลอดมือ

จับภาพพื้นที่ใด ๆ ของหน้าจอระหว่างเขียนตามคำบอกแบบปลอดมือ ภาพหน้าจอจะวางพร้อมพรอมต์ที่ถอดเสียง — ตรงเข้า Claude Code, Cursor หรือเครื่องมือ AI ใด ๆ เขียนโค้ดแบบปลอดมือเต็มรูปแบบ

  • ลากเพื่อจับภาพระหว่างเขียนตามคำบอกหรือบันทึกประชุม
  • ภาพหน้าจอวางอัตโนมัติพร้อมข้อความถอดเสียง — Claude Code, Cursor, ChatGPT
  • รวมเสียง + ภาพโดยไม่ต้องแตะคีย์บอร์ด
ส่วนหลักของเว็บไซต์ Vext ที่แนะนำการแปลงเสียงเป็นข้อความ
2 นาทีที่แล้ว

ตรวจ rate limit ของ API ก่อนปล่อย integration ใหม่ Sarah พูดถึงว่า sandbox มีเกณฑ์ต่างจาก production

18 นาทีที่แล้ว

flow onboarding ต้องการตัวเลือก skip ในหน้าจอที่สอง ผู้ใช้หลุดออกเพราะคิดว่าการตั้งค่าเป็นภาคบังคับ

1 ชั่วโมงที่แล้ว

ลองใช้ SwiftUI NavigationSplitView สำหรับ sidebar แทน implementation ที่เขียนเอง มันจัดการ state restoration อัตโนมัติ

จับความคิด
ก่อนที่มันจะหายไป

กดปุ่ม พูดสิ่งที่อยู่ในใจ และไปต่อ Vext ถอดเสียง ทำความสะอาด และเก็บบันทึกในเครื่อง — พร้อมใช้เมื่อต้องการ

  • เลือกปรับข้อความและแปลด้วย AI ก่อนบันทึกได้
  • บันทึกทุกชิ้นเก็บในเครื่องในแอป
  • ไม่ต้องสลับแอป — ใช้งานได้จากทุกที่บน Mac

พูดภาษาหนึ่ง
พิมพ์อีกภาษา

พูดแล้วแปลก่อนวาง เลือกจาก 29 ภาษาปลายทาง ใช้รูปแบบข้อความในขั้นตอน AI เดียวกัน

  • แปลหลังถอดเสียง
  • 29 ภาษาปลายทางในการตั้งค่า
  • ภาษาต้นทางที่รองรับขึ้นอยู่กับเครื่องมือรู้จำเสียง
  • ใช้ปุ่มลัดเดิม เพียงเลือกภาษาปลายทาง
อังกฤษ

"Let's schedule a meeting for next Tuesday to discuss the project roadmap and assign tasks to the team."

รัสเซีย

"Давайте назначим встречу на следующий вторник, чтобы обсудить план проекта и распределить задачи в команде."

ใช้งานได้ทุกที่ที่คุณพิมพ์

Vext เป็นบริการระดับระบบ ใช้ในช่องข้อความใด ๆ ในแอปใด ๆ — เบราว์เซอร์ บรรณาธิการ เทอร์มินัล อีเมล แชท

เครื่องมือ AI

Claude CodeChatGPTClaude.aiCursorCodex

เบราว์เซอร์

SafariChromeFirefoxArc

บรรณาธิการ

VS CodeXcodeSublime TextVim

เทอร์มินัล

TerminaliTerm2WarpGhostty

การสื่อสาร

SlackDiscordTelegramMessages

ผลิตภาพ

NotionObsidianNotesGmail
ใหม่ใน 1.4

เสียงของคุณ ในมือเอเจนต์ของคุณ

เชื่อม Claude Code, Codex CLI, OpenCode, Cursor/Windsurf, Claude Desktop หรือ Octomind ผ่าน MCP เขียนตามคำบอก ถอดเสียงไฟล์ อ่านการประชุม จัดการโน้ต ผู้พูด และคำศัพท์

  1. 1เปิดเซิร์ฟเวอร์ MCP ในการตั้งค่า
  2. 2คัดลอกการตั้งค่าสำหรับไคลเอนต์ของคุณ
  3. 3บอกเอเจนต์ให้ใช้ Vext
  • พูด: เริ่ม หยุด รับข้อความ — หรือวาง
  • ถอดเสียงไฟล์เสียงใดก็ได้
  • การประชุม: เริ่ม หยุด บันทึกพร้อมชื่อผู้พูด สรุป ส่งออก
  • โน้ตและประวัติการพูด
  • ผู้พูด คำศัพท์ และสไตล์ตามแอป
  • การตั้งค่าและไมโครโฟน

ฟังเฉพาะ 127.0.0.1 ทุกคำขอต้องมีโทเค็นที่ Vext สร้างให้คุณ ปิดไว้เป็นค่าเริ่มต้น

Terminal
claude mcp add --transport http vext http://127.0.0.1:58398/mcp --header "Authorization: Bearer TOKEN"

แทนที่ TOKEN ด้วยโทเค็นจากการตั้งค่า — หรือใช้ปุ่มคัดลอกที่นั่น ซึ่งจะใส่ให้อัตโนมัติ

ปลอดมือ

กดปุ่มหนึ่งครั้งเพื่อเริ่มเขียนตามคำบอก กดอีกครั้งเพื่อหยุด ไม่ต้องค้างปุ่ม — พูดได้นานเท่าที่ต้องการ เหมาะสำหรับข้อความยาว ๆ หรือเมื่อมือไม่ว่าง ตั้งไว้ที่ปุ่มข้างของเมาส์ หรือแตะปุ่มกดเพื่อพูดสั้นๆ เพื่อเปิด/ปิด

มาตรฐาน กดค้าง → พูด → ปล่อย
ปลอดมือ กดปุ่ม → พูดอิสระ → กดปุ่ม

จับภาพหน้าจอระหว่างเขียนตามคำบอก — วางอัตโนมัติพร้อมข้อความ ดูวิธีใช้ →

⌘
กดหนึ่งครั้ง
กำลังพูดอิสระ...
⌘
กดอีกครั้ง

โหมด YOLO

เปิดใช้แล้ว Vext จะกด Return อัตโนมัติหลังวางข้อความ พูด ปล่อย แล้วพรอมต์ของคุณก็ทำงานแล้ว

หยุดแก้ไข หยุดขัด แค่พูด LLM เข้าใจสิ่งที่คุณหมายถึง แม้คำของคุณจะไม่สมบูรณ์แบบ

โหมด YOLO
พูด
ตรวจสอบข้อความ
แก้ไข / ซ่อมข้อผิดพลาด
กด Return
เสร็จ

ลดเสียงอัตโนมัติ

เมื่อคุณเริ่มบันทึก Vext จะลดเสียงระบบโดยอัตโนมัติเพื่อให้เสียงคุณได้ยินชัด ปล่อยปุ่มลัด เสียงกลับมาปกติ ไม่ต้องปรับเอง

กำลังเล่นเพลง
กำลังบันทึก
กลับมาปกติ

เลือกเอนจินของคุณ

ใช้เสียงและ AI ในเครื่อง เพิ่มคีย์ API ของคุณหากต้องการโมเดลคลาวด์ ปิดไว้เป็นค่าเริ่มต้น

สปีชทูเท็กซ์

โมเดลชนิดความเร็วขนาด
Apple Dictation สปีชรีคอกนิชันในตัว macOS ไม่ต้องดาวน์โหลดในเครื่องRealtimeBuilt-in
OpenAI-compatible เลือก API เสียงที่เข้ากันได้กับ OpenAI ด้วยคีย์ของคุณAPIVaries—

การประมวลผล AI รูปแบบข้อความ · แปล · สรุป

โมเดลชนิดขนาด
Gemma 3 1B น้ำหนักเบาเป็นพิเศษ ตัวเลือกในเครื่องที่เร็วที่สุด ความแม่นยำต่ำลงในเครื่อง~1 GB
Qwen 3 4B รองรับหลายภาษาแข็งแกร่ง ดีสำหรับการแปลในเครื่อง~2.5 GB
LLaMA 3.2 3B Meta LLaMA ประสิทธิภาพทั่วไปแข็งแกร่งในเครื่อง~2.4 GB
Phi-3.5 Mini Microsoft Phi-3.5 กระชับ การให้เหตุผลแข็งแกร่งในเครื่อง~2.8 GB
OpenAI-compatible เลือกโมเดล AI ที่เข้ากันได้กับ OpenAI ด้วยคีย์ของคุณAPI—

สร้างโดย Muvon

Vext สร้างโดย Muvon Un Limited สตูดิโอผลิตภัณฑ์เล็ก ๆ เราสร้างเครื่องมือที่เราใช้ทุกวัน — ออกแบบให้ทำงานในเครื่อง เคารพความเป็นส่วนตัว และไม่ขวางทางคุณ

คำถามและคำตอบ