การถอดเสียงดิบจับสิ่งที่คุณพูดอย่างแม่นยำ ทุก "อืม" ทุกเริ่มต้นผิด ทุกประโยคยาว แม่นยำแต่ยุ่งเหยิง

Enhance อยู่ระหว่างการถอดเสียงและคลิปบอร์ดของคุณ หลังจาก Vext แปลงคำพูดเป็นข้อความ Enhance ส่งข้อความนั้นผ่านโมเดล AI ในเครื่องที่ทำความสะอาดเสียงรบกวน — คำเติม โครงสร้างประโยคที่หัก วลีซ้ำซ้อน — โดยไม่เปลี่ยนความหมายที่คุณตั้งใจ

Enhance ทำอะไร

ไปป์ไลน์การประมวลผล:

  1. คุณพูดเข้า Vext
  2. เอนจินถอดเสียงแปลงคำพูดเป็นข้อความ
  3. Enhance ส่งข้อความนั้นไปยัง LLM ในเครื่องพร้อมคำสั่งทำความสะอาด
  4. ผลลัพธ์ที่ประมวลผลคือสิ่งที่ถูกวาง

ก่อน Enhance:

"โอเค คือผมคิดว่าเราน่าจะ อืม น่าจะรีแฟกเตอร์ตัว the authentication middleware เพราะตอนนี้มัน เอ่อ ทำเยอะเกินไป และทดสอบยาก"

หลัง Enhance:

"เราควรรีแฟกเตอร์ authentication middleware มันทำเยอะเกินไปและทดสอบยาก"

ความหมายเดียวกัน น้ำเสียงเดียวกัน สั้นลง สะอาดขึ้น พร้อมส่ง

สิ่งที่ Enhance ไม่ทำ

Enhance ไม่ใช่ตัวเขียนใหม่ มันไม่:

  • เปลี่ยนความหมายหรือเจตนาของคุณ
  • เพิ่มข้อมูลที่คุณไม่ได้พูด
  • เปลี่ยนน้ำเสียงสบาย ๆ เป็นภาษาทางการ
  • ปรับโครงสร้างข้อโต้แย้งของคุณ
  • ลบคำเทคนิคหรือศัพท์เฉพาะ

มันลบเสียงรบกวน การถอดเสียงดิบจะถูกบันทึกควบคู่กับเวอร์ชันที่ปรับแต่งเสมอ เพื่อให้คุณเปรียบเทียบหรือย้อนกลับ

เมื่อไหร่ใช้ Enhance

เปิดสำหรับ:

  • ข้อความ Slack และอีเมล — ลบความรกของวาจา อ่านเหมือนข้อความเขียน
  • พรอมต์ AI — คำเติมไม่ช่วย LLM พรอมต์สะอาดทำงานได้ดีพอ ๆ กัน
  • เอกสารและบันทึก — ข้อความสะอาดอ้างอิงภายหลังง่ายกว่า
  • ความเห็น code review — น้ำเสียงมืออาชีพโดยไม่ต้องใช้ความพยายามเพิ่ม

ปิดสำหรับ:

  • การเขียนเชิงสร้างสรรค์ที่รูปแบบการพูดดิบสำคัญ
  • ความต้องการถอดเสียงแบบคำต่อคำ (กฎหมาย การแพทย์ การสัมภาษณ์)
  • เมื่อคุณต้องการตรวจสอบคำที่แน่นอนก่อนส่ง

Enhance + การแปล

เมื่อทั้ง Enhance และภาษาเป้าหมายเปิดใช้ การทำความสะอาดและการแปลเกิดในขั้นตอนเดียว คุณพูดรัสเซียมั่ว ๆ ข้อความอังกฤษสะอาดปรากฏที่เคอร์เซอร์

นี่มากกว่าการประมวลผลแบบลำดับ — โมเดล AI จัดการทั้งสองงานพร้อมกัน ให้การแปลที่เป็นธรรมชาติมากกว่าไปป์ไลน์ทำความสะอาดแล้วแปล

มันทำงานในเครื่องอย่างไร

Enhance ขับเคลื่อนโดย LLM ในเครื่องที่ทำงานทั้งหมดบน GPU Apple Silicon ของ Mac คุณ:

โมเดล ขนาด หมายเหตุ
Gemma 3 4B 2.8 GB ค่าเริ่มต้น คุณภาพดีที่สุด
Qwen 3 4B 3.2 GB รองรับหลายภาษาแข็งแกร่ง
LLaMA 3.2 3B 2.4 GB วัตถุประสงค์ทั่วไปแข็งแกร่ง
Gemma 3 1B 0.8 GB เร็วที่สุด น้ำหนักเบา
Phi-3.5 Mini 2.8 GB กระชับ การให้เหตุผลแข็งแกร่ง

ไม่ต้องเชื่อมต่ออินเทอร์เน็ต ไม่มีข้อมูลออกจาก Mac โมเดลประมวลผลข้อความของคุณในมิลลิวินาทีบน Apple Silicon

คุณยังสามารถใช้ API ที่เข้ากันได้กับ OpenAI หากคุณต้องการการประมวลผลคลาวด์ — แต่ในเครื่องเป็นค่าเริ่มต้น

สรุปการประชุม

สำหรับการบันทึกการประชุม Enhance ขับเคลื่อนฟีเจอร์สรุป หลังจากการประชุมสิ้นสุด มันจะดึง:

  • ประเด็นสำคัญ — การตัดสินใจหลักและข้อมูลที่อภิปราย
  • รายการที่ต้องทำ — งานที่มอบหมาย พร้อมเจ้าของเมื่อกล่าวถึง

ทั้งข้อความถอดเสียงดิบเต็มและสรุปจะถูกบันทึก สรุปสร้างจากข้อความถอดเสียงเต็ม ดังนั้นจึงจับบริบทจากทั้งการประชุม

เคล็ดลับสำหรับการใช้ Enhance ให้คุ้มที่สุด

ปล่อยให้เปิดเป็นค่าเริ่มต้น การทำความสะอาดอนุรักษ์นิยมพอที่ไม่ค่อยเปลี่ยนความหมาย เริ่มต้นด้วยเปิดทุกที่และปิดเฉพาะกรณีที่คุณต้องการผลลัพธ์คำต่อคำ

พูดอย่างเป็นธรรมชาติ Enhance ทำงานได้ดีกว่ากับการพูดธรรมชาติเมื่อเทียบกับการออกเสียงอย่างระมัดระวัง ยิ่งคุณพูดธรรมชาติเท่าไหร่ ยิ่งมีเสียงรบกวนให้ Enhance ทำความสะอาด — และการปรับปรุงยิ่งดราม่ามากเท่านั้น

อย่าออกเสียงเกินไปเพื่อช่วย Enhance มันไม่ต้องการความช่วยเหลือ พูดแบบที่คุณจะคุยกับเพื่อนร่วมงาน โมเดล AI เข้าใจภาษาสนทนา

ตรวจสอบข้อความถอดเสียงดิบเป็นครั้งคราว โดยเฉพาะในช่วงแรก เปรียบเทียบเวอร์ชันที่ปรับแต่งและดิบเพื่อสร้างความมั่นใจในสิ่งที่ Enhance เปลี่ยนและสิ่งที่รักษา

ลองเลย

Enhance รวมอยู่กับ Vext — ไม่มีการซื้อแยกหรือ add-on ทดลองฟรีรวมถึง 100 การเขียนตามคำบอกพร้อมการสนับสนุน Enhance เต็ม ดาวน์โหลด Vext และลองกับข้อความ Slack ครั้งต่อไป