เอเจนต์พูดได้มาแล้ว: Hermes Agent ครั้งนี้พูดจริงๆ แล้ว
เจาะลึกการอัปเดต Hermes v2026.8.3: คำอธิบายการเปลี่ยนแปลงเวอร์ชันล่าสุด
ข้อมูลเวอร์ชัน
| รายการ | รายละเอียด |
|---|---|
| เวอร์ชัน | v0.20.0 (แท็ก: v2026.8.3) |
| วันที่เผยแพร่ | 3 สิงหาคม 2026 |
| ชื่อรุ่น (Codename) | The Herald Release |
| สรุปหนึ่งบรรทัด | เอเจนต์สามารถ “พูด” ออกมาดัง ๆ ได้แล้ว ส่งต่อข้อความถึงเอเจนต์ตัวอื่น รายงานผลเชิงรุกไปยังระบบของคุณ และอ้างอิงแหล่งที่มาของทุกสิ่งที่พวกเขาพูด |
อธิบายแบบภาษาคน
🎙️ คุยกับ AI เหมือนโทรศัพท์ ไม่ใช่เครื่องวิทยุสื่อสาร
เมื่อก่อน การคุยกับ Hermes รู้สึกเหมือนใช้เครื่องวิทยุสื่อสาร: คุณพูดสิ่งที่อยากพูด มันก็เงียบไปพักใหญ่ แล้วก็ปล่อยบทพูดยาวเหยียดที่อัดไว้พร้อมเสียง “ปี๊บ—” แต่ไม่ใช่อีกต่อไป ตอนนี้มันคิดและพูดไปพร้อม ๆ กัน ส่งคำตอบทีละประโยค เหมือนบทสนทนาจริง ๆ อยากแทรกกลางประโยค? พูดเลย — มันจะหยุดทันทีแล้วฟังคุณ และมัน รู้ ว่าคุณขัดจังหวะ มันเลยไม่พูดพ่นเรื่อยเปื่อยต่อ เหมือนอัปเกรดจากกล่องข้อความเสียงมาเป็นสายโทรศัพท์สด — ไม่ต้องจ้องเพดานรอให้มันพูดจนจบสคริปต์อีกต่อไป
🗣️ แค่พูด “เฮ้ เฮอร์มีส” เพื่อปลุก — ทำงานออฟไลน์เต็มรูปแบบ
คุณตั้งคำปลุกเองได้ เช่น “เฮ้ เฮอร์มีส” หรืออะไรก็ได้ตามใจชอบ พอพูดปุ๊บ มันก็เริ่มฟังทันที จุดสำคัญคือ? การตรวจจับคำปลุกเกิดขึ้นบนอุปกรณ์ของคุณทั้งหมด — ไม่มีการส่งเสียงใด ๆ ไปยังคลาวด์ หมายความว่าทุกอย่างที่คุณพูดก่อนที่มันจะ “ตื่น” ไม่เคยออกจากเครื่องคุณเลย ความเป็นส่วนตัวเต็มขั้น แถมอุปกรณ์แต่ละเครื่องตั้งคำปลุกต่างกันได้ด้วย — เช่น พูด “เฮ้ เฮอร์มีส” ที่ PC ในห้องนั่งเล่น และพูด “เฮ้ บัตเลอร์” ที่แท็บเล็ตในห้องนอน โดยไม่มีการกวนกันเลย
📣 เอเจนต์สามารถ “ส่งข้อความหากัน” ได้แล้ว — ไม่ทำงานแบบแยกส่วนอีกต่อไป
เมื่อก่อน ถ้าคุณให้เอเจนต์ทำงานหนึ่ง มันก็ทำเสร็จแล้วจบ — ไม่มีทางส่งต่องานให้เอเจนต์ตัวอื่น อัปเดตนี้แนะนำ โปรโตคอล A2A v1.0 — เอเจนต์สามารถส่งข้อความหากันและส่งต่องานได้เหมือนเพื่อนร่วมงาน ตัวอย่างเช่น คุณให้เอเจนต์ A สรุปบันทึกการประชุม มันก็จะ “ส่ง” บทสรุปให้เอเจนต์ B โดยตรง แล้วเอเจนต์ B ก็สร้างลิสต์สิ่งที่ต้องทำต่อ กระบวนการทั้งหมดทำงานเหมือนแผนกต่าง ๆ ในบริษัทที่ร่วมมือกัน แทนที่เอเจนต์ทุกตัวจะต้องมาถามคุณตั้งแต่ต้น
🔔 มัน “เคาะประตู” หาคุณเองเมื่อมีอัปเดต — ไม่ต้องรอให้คุณไปเช็คเอง
เมื่อก่อน เอเจนต์จะเงียบหายไปหลังทำงานเสร็จ แล้วคุณต้องไปตรวจสอบเอง ตอนนี้มันรองรับ signed outbound webhooks — พูดง่าย ๆ คือ เมื่อมันทำงานเสร็จ มันจะ “เคาะประตู” แจ้งระบบอื่น ๆ ของคุณเอง (เช่น ส่งข้อความไปที่ WeCom, DingTalk หรือระบบที่คุณสร้างเอง) และการแจ้งเตือนนั้นมาพร้อม ลายเซ็นดิจิทัล เพื่อให้คุณมั่นใจได้ว่ามาจากเอเจนต์จริง ๆ ไม่ใช่ของปลอม เหมือนพนักงานส่งของที่ส่งข้อความหาคุณหลังเซ็นรับพัสดุ แทนที่จะให้คุณรีเฟรชหน้าติดตามพัสดุเอง
📚 ทุกอย่างที่มันพูดมีแหล่งอ้างอิง — ไม่มโนอีกต่อไป
อันนี้ทำให้อุ่นใจที่สุด: ตอนนี้ Hermes อ้างอิงแหล่งที่มา เมื่อทำการค้นคว้าหรือตอบคำถาม ทุกข้อความสำคัญมาพร้อมลิงก์ที่คลิกได้ไปยังต้นทาง และมันยังตรวจสอบข้อเท็จจริงได้ด้วย เมื่อก่อน ถ้าถามว่า “ปีที่แล้วบริษัท X มีรายได้เท่าไหร่?” มันอาจให้ตัวเลขมาโดยไม่รู้ว่ามาจากไหน แต่ตอนนี้มันจะบอกคุณว่า “ข้อมูลนี้มาจากรายงานฉบับนี้ — นี่คือลิงก์” เหมือนการเขียนรายงานที่มีบรรณานุกรม ไม่ใช่การเดาตัวเลขขึ้นมาจากอากาศ
🛠️ เมื่อเครื่องมือพัง มันลุกขึ้นมาเองได้ — ไม่ต้องมานั่งลองใหม่ด้วยมือ
เมื่อก่อน ถ้าเครื่องมือ (เช่น ปลั๊กอินพยากรณ์อากาศ) มีข้อผิดพลาดชั่วคราว Hermes จะหยุดแล้วถามคุณว่า “ฉันควรทำยังไงดี?” หรือให้ข้อความ error งง ๆ ตอนนี้มันเรียนรู้ที่จะ รักษาตัวเองได้ — เมื่อเครื่องมือล้มเหลว มันจะลองวิธีใหม่โดยอัตโนมัติ หรือค่อย ๆ สลับไปใช้แผนสำรอง แทนที่จะโยนปัญหาใส่คุณ เหมือนไรเดอร์ส่งอาหารที่ร้านปิด ก็แค่เปลี่ยนไปสั่งร้านอื่นแทนที่จะโทรมาถามคุณว่า “เปลี่ยนร้านไหมครับ?”
💻 แอปเดสก์ท็อปและ CLI อัปเกรดครั้งใหญ่ทั้งคู่
เวอร์ชันเดสก์ท็อปตอนนี้รองรับ หลายหน้าต่าง, พรีวิวสด (เช่น เห็นชาร์ตเรนเดอร์ขณะที่คุณเขียนโค้ด) และ SDK ปลั๊กอิน แบบเปิด เพื่อให้คุณสร้างส่วนขยายเองได้ ส่วน CLI ได้รับทางลัดสะดวก ๆ เพียบ: กด ! เพื่อเข้าสู่โหมดเชลล์ระบบ, /init เพื่อสร้างโครงโปรเจกต์อย่างรวดเร็ว, /diff เพื่อเปรียบเทียบการเปลี่ยนแปลงของไฟล์, /context เพื่อตรวจสอบคอนเทกซ์ปัจจุบัน และ /focus เพื่อโฟกัสงานเฉพาะด้าน สำหรับสายชอบแกะของเล่น นี่ช่วยเพิ่มความเร็วในการทำงานได้เกือบเท่าตัว
สรุป
ประเด็นสำคัญที่สุดของรุ่นนี้: Hermes วิวัฒนาการจาก “เครื่องมือที่เชื่อฟังคำสั่ง” กลายเป็น “คู่สนทนาที่สื่อสารเป็น” มันไม่ใช่บอทที่คอยตอบเฉพาะเมื่อถูกถามอีกต่อไป — มันพูดเองเชิงรุก รายงานความคืบหน้า ทำงานร่วมกับเอเจนต์ตัวอื่น และแม้แต่อ้างอิงแหล่งที่มาเหมือนเพื่อนร่วมงานที่น่าเชื่อถือ ไม่ว่าจะเป็นความลื่นไหลของการโต้ตอบด้วยเสียง การทำงานร่วมกันระหว่างเอเจนต์ หรือความน่าเชื่อถือของข้อมูล ทุกอย่างก้าวกระโดดไปไกลมาก ถ้าคุณเคยคิดว่า AI เอเจนต์ “ตอบช้าไปหน่อย” รุ่นนี้คุ้มค่าที่จะลองอีกครั้ง — มันเริ่ม เข้าใจ วิธีที่มนุษย์พูดกันจริง ๆ แล้ว