หยุดอ่านเทอร์มินัล.
พูดคุยกับตัวแทนของคุณ.
โหมดเสียงคือการสนทนาเสียงแบบสองทางกับ AI coding agent ที่ทำงานอยู่ แตะครั้งเดียว พูดในเทิร์นของคุณ และตัวแทนจะตอบกลับเสียงดังในเสียงที่เป็นธรรมชาติ ไม่ต้องพิมพ์คำสั่ง ไม่ต้องเลื่อนดูผลลัพธ์ในเทอร์มินัลเพื่อหาว่าเกิดอะไรขึ้น.
เปิดโหมดไม่ต้องใช้มือและมันจะฟังระหว่างการตอบกลับ ดังนั้นคุณสามารถเดินไปในห้อง ดูการสร้าง หรือดื่มกาแฟในขณะที่คุณพูดคุยเกี่ยวกับแผน ถามว่าสถานะการรีแฟคเตอร์เป็นอย่างไร มันจะบอกคุณ บอกให้รันการทดสอบและรายงานกลับ มันทำได้แล้วพูดผลลัพธ์.

โหมดเสียงในแอ็คชั่น: ตัวแทนกำลังฟัง, โหมดไม่ต้องใช้มือเปิดอยู่, เสียงตอบกลับถูกตั้งค่า, และตัวแทนตอบกลับเสียงดังระหว่างเทิร์นของคุณ.
นี่คือการเปลี่ยนแปลงที่โหมดเสียงตอบกลับ ตัวแทนของคุณทำงานได้นานขึ้นและทำมากขึ้นด้วยตัวเอง: มันแก้ไขไฟล์ รันคำสั่ง เขียนการทดสอบ แก้ไขสิ่งที่มันทำผิด ข้อจำกัดไม่ใช่การเขียนโค้ดอีกต่อไป แต่คือการอยู่ในวงการในขณะที่ตัวแทนทำงาน การอ่านบรรทัดแล้วบรรทัดเล่าของผลลัพธ์ในเทอร์มินัล หรือการพิมพ์คำสั่งอีกครั้งเพื่อถามว่าเกิดอะไรขึ้น จะดึงคุณกลับไปที่คีย์บอร์ดสำหรับทุกเทิร์น.
โหมดเสียงเปลี่ยนวงจรนั้นให้กลายเป็นการสนทนา คุณพูดเทิร์นของคุณออกเสียง ตัวแทนตอบกลับเสียงดัง คุณถามคำถาม ให้การแก้ไข อนุมัติแผน ทั้งหมดด้วยเสียง และคุณได้ยินการตอบกลับพูดกลับมาในเสียงที่เป็นธรรมชาติแทนที่จะต้องแปลมันบนหน้าจอ นี่คือความแตกต่างระหว่างการดูแลกระบวนการและการพูดคุยกับเพื่อนร่วมทีม.
นี่ไม่เหมือนกับการถอดเสียง การถอดเสียงเป็นทางเดียว: คุณพูด มันถอดความคำพูดของคุณไปยังคอมโพสเซอร์ และคุณยังอ่านการตอบกลับของตัวแทน โหมดเสียงเป็นสองทาง: เสียงเข้า เสียงออก การสนทนาสด การถอดเสียงช่วยให้คุณเขียนคำสั่งได้เร็วขึ้น โหมดเสียงให้คุณข้ามคีย์บอร์ดและหน้าจอทั้งหมดในขณะที่คุณทำให้ตัวแทนเคลื่อนไหว.
ทำไมต้องพูดคุยกับตัวแทนของคุณแทนที่จะพิมพ์และอ่าน
อยู่ในวงการแบบไม่ต้องใช้มือ ตัวแทนที่มีความสามารถสามารถทำงานได้นานหลายนาทีจากคำสั่งเดียว ด้วยโหมดเสียงในแบบไม่ต้องใช้มือ คุณจะอยู่ในติดต่ออยู่ตลอดเวลาโดยไม่ต้องนั่งอยู่ที่คีย์บอร์ด ถามสถานะ ควบคุมขั้นตอนถัดไป ยืนยันการตัดสินใจ ทั้งหมดในขณะที่คุณยืนอยู่ที่กระดานไวท์บอร์ดหรือดูแอปโหลดใหม่.
การสนทนาที่เป็นธรรมชาติ การพิมพ์คำสั่ง รอ อ่านผลลัพธ์ พิมพ์อีกครั้งเป็นวงจรที่ไม่เป็นธรรมชาติ การพูดเทิร์นของคุณและฟังคำตอบคือการสนทนา มันเร็วกว่าในเทิร์นสั้นๆ (ใช่เร็วๆ การแก้ไขเล็กน้อย คำถามอีกหนึ่งคำถาม) และน้อยกว่าที่จะทำให้เหนื่อยเมื่ออ่านกำแพงข้อความในเทอร์มินัลสำหรับทุกการอัปเดต.
ไม่ต้องใช้ตา ไม่ต้องใช้หน้าจอ การได้ยินการตอบกลับของตัวแทนหมายความว่าคุณไม่ต้องมองที่เทอร์มินัลเพื่อรู้ว่ามันทำอะไร มองไปที่การสร้าง การทดสอบ การออกแบบของคุณ หรือไม่มองอะไรเลย และให้การอัปเดตที่พูดบอกคุณว่าสถานการณ์เป็นอย่างไร ตัวแทนเล่าเรื่อง คุณเก็บตาของคุณไว้ที่งานจริง.
บนเครดิตเสียงเดียวกัน โหมดเสียงใช้แบ็คเอนด์เสียงของ AgentsRoom การแปลงเสียงเป็นข้อความในระหว่างทางเข้าและข้อความเป็นเสียงในระหว่างทางออก โดยดึงจากยอดเครดิตเสียงเดียวกันกับการถอดเสียง ยอดเครดิตเดียวกันนี้ใช้สำหรับการถอดเสียงคำสั่งและการสนทนาที่พูดเต็มรูปแบบ ดังนั้นจึงไม่มีอะไรเพิ่มเติมที่ต้องเชื่อมต่อ.
โหมดเสียงทำงานอย่างไร
เปิดมันบนตัวแทนที่กำลังทำงานอยู่ พูด ฟัง ทำซ้ำ วงจรที่พูดแทนที่จะพิมพ์และอ่าน.
เปิดโหมดเสียงบนตัวแทนที่กำลังทำงานอยู่
โหมดเสียงจะเปิดสำหรับตัวแทนที่กำลังทำงานอยู่ในเทอร์มินัลของมัน จากคอมโพสเซอร์ของตัวแทนนี้ มันต้องการเซสชันสดเพราะการสนทนาคือกับตัวแทนเฉพาะนี้ ในบริบทปัจจุบันของมัน ไม่ใช่การแชทใหม่.
แตะเพื่อพูด
แตะครั้งเดียวและพูดเทิร์นของคุณ: คำถาม คำสั่ง การแก้ไข สถานะจะเปลี่ยนเป็นการฟังพร้อมตัวบ่งชี้สด ดังนั้นคุณจะเห็นว่าไมค์กำลังจับเสียงอยู่ เลือกโหมดไม่ต้องใช้มือเพื่อให้มันฟังต่อไประหว่างเทิร์น หรือแตะเพื่อพูดเพื่อทำทีละเทิร์น.
มันถอดความและส่งไปยังตัวแทน
เมื่อคุณเสร็จสิ้น คำพูดของคุณจะถูกถอดความและส่งไปยังตัวแทนที่กำลังทำงานเป็นข้อความของคุณ โดยตรงเหมือนกับที่คุณพิมพ์มัน สถานะจะเคลื่อนที่ผ่านการถอดความและการส่ง ดังนั้นคุณจะรู้เสมอว่าคุณอยู่ที่ไหนในกระบวนการ.
ตัวแทนทำงาน
ตัวแทนจะประมวลผลการเล่นของคุณในเซสชันของมันเอง: มันสามารถอ่านไฟล์ รันคำสั่ง แก้ไขโค้ด รันการทดสอบ หรืออะไรก็ตามที่ข้อความของคุณร้องขอ โหมดเสียงจะแสดงสถานะการทำงานพร้อมกับชื่อของตัวแทนในขณะที่มันทำงาน เหมือนกับการเล่นปกติในเทอร์มินัล
ฟังการตอบกลับที่พูดออกมา
เมื่อตัวแทนตอบกลับ การตอบกลับของมันจะถูกอ่านออกเสียงด้วยเสียงที่คุณเลือก คุณจะได้ยินสถานะ ผลลัพธ์ คำถามถัดไป โดยไม่ต้องอ่านเทอร์มินัล เสียงบี๊บที่เลือกได้จะทำเครื่องหมายขอบเขตระหว่างการเล่น เพื่อให้คุณรู้ว่าเมื่อไหร่ถึงตาของคุณอีกครั้ง
เล่นตาถัดไปของคุณ
ในโหมดไม่ต้องใช้มือ มันจะฟังอีกครั้งแล้ว ดังนั้นคุณแค่พูดต่อไป ในโหมดแตะเพื่อพูด คุณแตะเพื่อเริ่มเล่นตาถัดไป การสนทนาจะดำเนินต่อไปตามที่คุณต้องการ จากนั้นคุณปิดโหมดเสียงและตัวแทนจะอยู่ที่ที่คุณทิ้งไว้ในเทอร์มินัลของมัน
ไม่ต้องใช้มือ ดังนั้นคุณจึงอยู่ในวงจรโดยไม่ต้องใช้แป้นพิมพ์
จุดประสงค์ของโหมดเสียงไม่ใช่ความแปลกใหม่ มันคือการตามให้ทันกับตัวแทนที่รวดเร็วโดยไม่ต้องถูกผูกติดอยู่กับโต๊ะของคุณ
ตัวแทนการเขียนโค้ดสมัยใหม่ทำได้มากในแต่ละการเล่น และช่องว่างระหว่างการเล่นของคุณคือที่ที่คุณมักจะสูญเสียบริบท: คุณเดินออกไป ตัวแทนเสร็จสิ้น และคุณกลับมาที่หน้าจอที่เต็มไปด้วยผลลัพธ์ที่คุณต้องอ่าน ตอนนี้โหมดเสียงไม่ต้องใช้มือจะปิดช่องว่างนั้น ตัวแทนจะบอกคุณว่ามันทำอะไรเมื่อมันเสร็จสิ้น ออกเสียง และคุณตอบโดยไม่ต้องนั่งลงอีกครั้ง
ไม่ต้องใช้มือจะเปิดไมโครโฟนระหว่างการเล่น ดังนั้นการสนทนาจะไหลเหมือนการโทรศัพท์: คุณพูด มันทำงาน มันพูด คุณพูดอีกครั้ง ชอบที่จะควบคุมแต่ละการเล่น? แตะเพื่อพูดจะใช้การเล่นทีละหนึ่ง ซึ่งสะดวกในห้องที่มีเสียงดังหรือเมื่อคุณต้องการแวะเข้ามาเป็นครั้งคราว
เสียงบี๊บเป็นสิ่งเล็กน้อยที่สำคัญในทางปฏิบัติ เมื่อคุณไม่ได้มองที่หน้าจอ เสียงบี๊บสั้นจะบอกคุณว่าตัวแทนได้พูดจบแล้วและถึงตาของคุณ ดังนั้นคุณจะไม่พูดทับมันหรือรอในความเงียบสงสัยว่ามันเสร็จแล้วหรือยัง
นี่คือสิ่งที่ทำให้โหมดเสียงมีประโยชน์สำหรับการทำงานจริงและไม่ใช่แค่การสาธิต มันถูกสร้างขึ้นสำหรับช่วงเวลาที่ตัวแทนกำลังทำงานหนักและคุณต้องการควบคุม ตรวจสอบ และอนุมัติ ในขณะที่มือและตาของคุณว่างสำหรับทุกอย่างอื่น
เลือกเสียงของคุณ ติดตามการสนทนา
โหมดเสียงให้คุณควบคุมที่ทำให้การสนทนาที่พูดสบายขึ้น และแสดงให้คุณเห็นว่าการเล่นแต่ละครั้งอยู่ที่ไหนอย่างชัดเจน
เสียงและสัญญาณ
- เสียงตอบกลับ: โลหะผสมและเสียงธรรมชาติอื่นๆ
- ไม่ต้องใช้มือ: ฟังต่อระหว่างการเล่น
- แตะเพื่อพูด: เล่นทีละหนึ่งครั้ง
- สัญญาณบี๊บ: เสียงสั้นทำเครื่องหมายขอบเขตการเล่นแต่ละครั้ง
- ภาษาอัตโนมัติ: พูดในคำของคุณเอง มันตรวจจับภาษา
สถานะการสนทนา
- ฟัง: ไมโครโฟนกำลังจับการเล่นของคุณ
- ถอดความ: คำพูดของคุณกำลังถูกเปลี่ยนเป็นข้อความ
- ส่ง: ข้อความของคุณกำลังไปยังตัวแทน
- ทำงาน: ตัวแทนกำลังทำงาน
- พูด: การตอบกลับของตัวแทนกำลังถูกอ่านออกเสียง
การตรวจจับภาษาอัตโนมัติหมายความว่าคุณไม่ต้องเลือกภาษาเพื่อเริ่มพูด และสถานะที่มองเห็นได้หมายความว่าคุณจะไม่ต้องเดาว่าตัวแทนได้ยินคุณ ทำงาน หรือกำลังจะตอบกลับ
โหมดเสียงทำอะไรจริงๆ ภายใน
โหมดเสียงเป็นชั้นดูเพล็กซ์เต็มรูปแบบที่อยู่บนเซสชันตัวแทนปกติ ในการเล่นของคุณ มันจะบันทึกเสียงของคุณและส่งเสียงไปยังแบ็คเอนด์ของ AgentsRoom ซึ่งทำการแปลงเสียงเป็นข้อความและส่งกลับการถอดความ การถอดความนั้นจะถูกฉีดเข้าไปในตัวแทนที่กำลังทำงานเป็นข้อความของคุณ ดังนั้นจากมุมมองของตัวแทน มันก็แค่การเล่นอีกครั้งในสนทนาที่มันกำลังมีอยู่กับคุณ
ในตาของตัวแทน การตอบกลับข้อความของมันจะถูกส่งกลับไปยังแบ็คเอนด์ของ AgentsRoom สำหรับการแปลงข้อความเป็นเสียงด้วยเสียงที่คุณเลือก และเสียงที่ได้จะถูกเล่นให้คุณ ฟังเสียงเป็นข้อความเข้า ข้อความเป็นเสียงออก โดยที่การทำงานจริงของตัวแทนเกิดขึ้นระหว่างนั้น นี่คือเหตุผลที่โหมดเสียงต้องการบัญชีและตัวแทนที่กำลังทำงาน: แบ็คเอนด์เสียงจะเป็นตัวกลางสำหรับโมเดลเสียงและการสนทนาจะถูกผูกติดอยู่กับเซสชันสด
เพราะตัวแทนเห็นแค่ข้อความ โหมดเสียงจึงเป็นกลางต่อผู้ให้บริการโดยการออกแบบ ไม่ว่าตัวแทนจะเป็น Claude Code, Codex, Antigravity CLI, OpenCode, Aider, Grok Build, Mistral Vibe หรือ Kimi Code การเล่นที่ถูกถอดความของคุณจะมาถึงในฐานะข้อความและการตอบกลับของมันจะถูกพูดกลับมาในลักษณะเดียวกัน ไม่มีอะไรในชั้นเสียงขึ้นอยู่กับว่า CLI ใดกำลังทำงานอยู่ด้านล่าง
โหมดเสียงและการถอดเสียงด้วยเสียงแชร์ยอดเครดิตเสียงเดียวกัน เนื่องจากทั้งสองพึ่งพาเบื้องหลังการพูดเดียวกัน การถอดเสียงใช้เครดิตเพื่อถอดความแบบทางเดียว; โหมดเสียงใช้เครดิตในการถอดความและการตอบกลับที่พูด ซึ่งเป็นแบบเปิดกว้างตามธรรมชาติ เพราะการสนทนาสามารถดำเนินต่อไปได้ตราบใดที่คุณยังพูดอยู่
ที่ที่โหมดเสียงทำงาน
การสนทนาที่พูดแบบสองทางกับตัวแทนเดสก์ท็อปที่ทำงานอยู่ เสียงเข้าและเสียงออก
เดสก์ท็อป บนตัวแทนสด
โหมดเสียงทำงานบน macOS เปิดจากคอมโพสเซอร์ของตัวแทนที่กำลังทำงานอยู่ มันพูดคุยกับตัวแทนเฉพาะในเซสชันปัจจุบัน ดังนั้นการสนทนาจึงมีบริบททั้งหมดที่ตัวแทนได้สร้างขึ้น ไม่ใช่กระดานเปล่า
เสียงเข้า
การพูดของคุณจะถูกจับโดยไมโครโฟนและถอดเสียงโดยเบื้องหลังเสียงของ AgentsRoom จากนั้นส่งไปยังตัวแทนเป็นข้อความของคุณ โหมด hands-free จะเปิดไมโครโฟนระหว่างการพูด; โหมด tap-to-talk จะใช้ทีละเทิร์น การตรวจจับภาษาอัตโนมัติ
เสียงออก
การตอบกลับของตัวแทนจะถูกอ่านออกเสียงด้วยการแปลงข้อความเป็นเสียงในเสียงที่คุณเลือก (alloy และอื่นๆ) เสียงบี๊บที่เลือกได้จะทำเครื่องหมายจุดสิ้นสุดของการตอบกลับที่พูดแต่ละครั้งเพื่อให้คุณรู้ว่านี่คือเทิร์นของคุณ แม้ว่าคุณจะไม่ได้มองที่หน้าจอก็ตาม
การถอดเสียงด้วยเสียง vs โหมดเสียง
ทั้งสองใช้เสียงของคุณ หนึ่งเขียนคำสั่งให้คุณ อีกหนึ่งสนทนา
การถอดเสียงด้วยเสียง (ทางเดียว)
- : คุณพูด มันถอดเสียงคำของคุณไปยังคอมโพสเซอร์
- : คุณยังอ่านการตอบกลับของตัวแทนบนหน้าจอด้วยตัวเอง
- : ยอดเยี่ยมสำหรับการเขียนคำสั่งที่ยาวและแม่นยำอย่างรวดเร็ว
- : คุณยังอยู่ที่แป้นพิมพ์เพื่อส่งและอ่านผลลัพธ์
- : ทิศทางเดียว: เสียงเข้า ข้อความในร่าง คุณจัดการจากที่นั่น
โหมดเสียง (สองทาง)
- : คุณพูดเทิร์นของคุณ ตัวแทนตอบกลับออกเสียง
- : คุณได้ยินการตอบกลับ ไม่จำเป็นต้องอ่านเทอร์มินัล
- : ยอดเยี่ยมสำหรับการควบคุมและตรวจสอบในขณะที่ตัวแทนทำงาน
- : โหมด hands-free ทำให้การสนทนาดำเนินต่อไปโดยไม่ต้องใช้แป้นพิมพ์
- : ทั้งสองทิศทาง: เสียงเข้า ตัวแทนทำงาน เสียงออก
ใช้การถอดเสียงเพื่อเขียนคำสั่งที่ยอดเยี่ยมในไม่กี่วินาที และโหมดเสียงเพื่อพูดคุยกับตัวแทนในขณะที่มันดำเนินการคำสั่ง
เสียงของเทิร์นที่พูดเป็นอย่างไร
คุณไม่ต้องพิมพ์สิ่งนี้ คุณพูดเทิร์นของคุณออกเสียง ตัวแทนทำงาน และมันพูดการตอบกลับกลับมา นี่คือรอบหนึ่งของการสนทนาในโหมดเสียง
รอบของการสนทนา
คุณ: เราอยู่ที่ไหนในเรื่องการปรับปรุงการเข้าสู่ระบบ?
ตัวแทน: ตัวจำกัดอัตราได้ถูกติดตั้งและเส้นทางความสำเร็จไม่ได้ถูกแตะต้อง สองการทดสอบยังคงเป็นสีแดง
คุณ: แก้ไขการทดสอบที่ล้มเหลวสองรายการ จากนั้นรันชุดทั้งหมดและบอกฉันจำนวน
ตัวแทน: เสร็จแล้ว ทั้งสองผ่านตอนนี้ ชุดทั้งหมด: 142 ผ่าน 0 ล้มเหลว
คุณ: ดี ทำการคอมมิตด้วยข้อความสั้นๆ และหยุดที่นั่นFAQ
โหมดเสียงใน AgentsRoom คืออะไร ?
โหมดเสียงคือการสนทนาเสียงสองทางกับตัวแทน AI ที่กำลังเขียนโค้ด คุณแตะและพูดในเทิร์นของคุณ คำพูดของคุณจะถูกถอดความและส่งไปยังตัวแทน ตัวแทนทำงาน และคำตอบของมันจะถูกอ่านกลับให้คุณฟังออกเสียงตามธรรมชาติ มันทำให้คุณสามารถพูดคุยกับตัวแทนและได้ยินคำตอบของมันแทนที่จะพิมพ์คำสั่งและอ่านผลลัพธ์ในเทอร์มินัล
โหมดเสียงแตกต่างจากการถอดความเสียงอย่างไร ?
การถอดความเสียงเป็นทางเดียว: คุณพูดและคำพูดของคุณจะถูกถอดความเป็นคำสั่งในคอมโพเซอร์ จากนั้นคุณอ่านคำตอบของตัวแทนบนหน้าจอ โหมดเสียงเป็นสองทาง: คุณพูดในเทิร์นของคุณและตัวแทนตอบกลับออกเสียง เป็นการสนทนาที่พูดคุยกันสดๆ การถอดความช่วยให้คุณเขียนคำสั่งได้เร็วขึ้น; โหมดเสียงทำให้คุณสามารถสนทนาแบบไม่ต้องใช้มือในขณะที่ตัวแทนทำงาน
ตัวแทนพูดกลับจริงหรือไม่ ?
ใช่ คำตอบของตัวแทนจะถูกแปลงเป็นเสียงด้วยการแปลงข้อความเป็นเสียงและเล่นออกเสียงดังในเสียงที่คุณเลือก คุณจะได้ยินสถานะ ผลลัพธ์ และคำถามถัดไป ดังนั้นคุณไม่จำเป็นต้องอ่านเทอร์มินัลเพื่อทราบว่าตัวแทนทำอะไร
โหมดไม่ต้องใช้มือคืออะไร ?
โหมดไม่ต้องใช้มือจะเปิดไมโครโฟนระหว่างเทิร์น ดังนั้นการสนทนาจะไหลเหมือนการโทรศัพท์: คุณพูด ตัวแทนทำงาน มันพูด และมันก็ฟังสำหรับเทิร์นถัดไปของคุณอยู่แล้ว หากคุณต้องการควบคุมแต่ละเทิร์น การแตะเพื่อพูดจะใช้เทิร์นทีละหนึ่ง ซึ่งสะดวกในห้องที่มีเสียงดัง
ฉันสามารถเลือกเสียงได้ไหม ?
ใช่ คุณเลือกเสียงตอบกลับ (เสียงโลหะและเสียงอื่นๆ) ที่ใช้สำหรับคำตอบที่พูดของตัวแทน คุณยังสามารถเปิดเสียงบี๊บที่เลือกได้ ซึ่งจะเล่นเสียงสั้นๆ ที่ขอบเขตระหว่างเทิร์นเพื่อให้คุณรู้ว่าตัวแทนพูดเสร็จแล้วและถึงเทิร์นของคุณ
โหมดเสียงรองรับภาษาอะไรบ้าง ?
โหมดเสียงตรวจจับภาษาที่คุณพูดโดยอัตโนมัติ ดังนั้นคุณสามารถพูดในคำของคุณเองโดยไม่ต้องเลือกภาษาเสียก่อน การถอดความจะถูกจัดการโดยแบ็คเอนด์เสียงของ AgentsRoom ซึ่งเป็นสแต็กเสียงเดียวกันที่ใช้สำหรับการถอดความ
ฉันต้องการบัญชีและตัวแทนที่กำลังทำงานหรือไม่ ?
ใช่ทั้งสองอย่าง โหมดเสียงต้องการบัญชีที่ลงชื่อเข้าใช้เพราะแบ็คเอนด์เสียงจะเป็นตัวกลางสำหรับโมเดลการพูดและใช้เครดิตเสียงของคุณ และต้องการตัวแทนที่กำลังทำงานอยู่แล้ว เนื่องจากการสนทนาจะผูกพันกับเซสชันสดนั้นและใช้บริบทปัจจุบันของมัน
โหมดเสียงใช้เครดิตหรือไม่ ?
ใช่ โหมดเสียงทำงานบนยอดเครดิตเสียงเดียวกันกับการถอดความ การถอดความใช้เครดิตในการถอดความคำพูดของคุณทางเดียว; โหมดเสียงใช้เครดิตในการเดินทางรอบเต็มของการถอดความบวกคำตอบที่พูด ซึ่งไม่มีขีดจำกัดเพราะการสนทนาสามารถดำเนินต่อไปได้ตราบใดที่คุณยังพูดอยู่
มีให้ใช้งานในเดโมเว็บสดหรือไม่ ?
ไม่ เดโมเว็บสาธารณะเลียนแบบแบ็คเอนด์ ดังนั้นการสนทนาเสียงเรียลไทม์จึงไม่สามารถทำงานที่นั่นได้ การคลิกโหมดเสียงในเดโมจะแสดงประกาศเชิญชวนให้คุณดาวน์โหลด AgentsRoom ซึ่งโหมดเสียงจะพูดคุยกับตัวแทนจริงของคุณ
โหมดเสียงทำงานกับ Claude Code, Codex และ Antigravity หรือไม่ ?
ใช่ กับทั้งหมด รวมถึง OpenCode, Aider, Grok Build, Mistral Vibe และ Kimi Code ตัวแทนจะเห็นเพียงข้อความ ดังนั้นเทิร์นที่คุณพูดจะมาถึงในรูปแบบข้อความและคำตอบของมันจะถูกพูดกลับในลักษณะเดียวกัน ไม่ว่าตัวแทน CLI ใดจะทำงานอยู่ด้านล่าง
เข้ากันได้ดีด้วย
การถอดความเสียง
พี่น้องทางเดียวของโหมดเสียง ถอดความคำสั่งที่ยาวและแม่นยำลงในคอมโพเซอร์ด้วยเสียง จากนั้นพูดคุยกับตัวแทนเมื่อมันดำเนินการ
การควบคุมตัวแทนระยะไกล
ควบคุมตัวแทนเดสก์ท็อปของคุณจากโทรศัพท์ของคุณ เสียงเป็นวิธีที่เป็นธรรมชาติที่สุดในการติดตามตัวแทนในขณะที่คุณอยู่ห่างจากแป้นพิมพ์
การซิงค์มือถือ-เดสก์ท็อป
ลิงก์ที่เข้ารหัสแบบ end-to-end ระหว่างโทรศัพท์ของคุณและตัวแทนบนเดสก์ท็อปของคุณ เพื่อให้คุณเชื่อมต่อกับสิ่งที่กำลังทำงานบน Mac ของคุณ
สถานะตัวแทน
ดูว่ามีใครทำงานอยู่ ใครเสร็จแล้ว และใครติดขัดได้อย่างรวดเร็ว โหมดเสียงช่วยให้คุณถามตัวแทนที่กำลังทำงานเกี่ยวกับสถานะนั้นได้เสียงดัง
ผู้ให้บริการหลายราย
เรียกใช้ Claude, Codex, Antigravity, OpenCode, Aider, Grok Build, Mistral Vibe และ Kimi Code ข้างกัน โหมดเสียงสามารถสื่อสารกับพวกเขาได้ในลักษณะเดียวกัน
Scratchpad
ตัวแก้ไขที่ใหญ่ขึ้นในส่วนท้ายสำหรับบันทึกและการสรุปที่ยาวขึ้น จับคู่กับเสียงเมื่อการพูดคุยยาวเกินไปหรือแม่นยำเกินไปที่จะพูด
พูดคุยกับตัวแทนของคุณ ฟังพวกเขาตอบกลับ
ดาวน์โหลด AgentsRoom และเปิดโหมดเสียงบนตัวแทนที่กำลังทำงาน พูดตามที่คุณต้องการ ฟังการตอบกลับ และอยู่ในวงสนทนาแบบ hands-free ขณะที่ตัวแทนทำงาน การสนทนาเสียงสองทางที่สร้างขึ้นใน IDE การเขียนโค้ด AI ของคุณ
แอปคู่หู: ตรวจสอบตัวแทนของคุณได้ทุกที่
นำของคุณเอง: Claude, Codex, Antigravity CLI, หรือผู้ให้บริการ AI อื่น ๆ
ส่งข้อบกพร่องและคำขอไปยังแบ็คล็อกสาธารณะของคุณโดยตรง
มองเห็น AgentsRoom ในการทำงาน