นักพัฒนาใช้ NVIDIA Jetson Orin Nano Super สร้างระบบ TTS แบบ self-hosted ด้วยโมเดล Kokoro-82M โดยใช้ Durable Streams แทน API แบบ request-response เพื่อรองรับการส่งเสียงพูดทีละส่วนและแชร์ผ่านลิงก์ได้โดยไม่ต้องพึ่งบริการภายนอก ระบบนี้มีสเปค 1024 CUDA cores, 32 tensor cores และ 67 TOPS ซึ่งเพียงพอสำหรับการประมวลผล TTS ด้วยโมเดลขนาดเล็ก การใช้ Durable Streams ช่วยลดความซับซ้อนในการจัดการข้อมูลที่ต้องใช้ queue, database และ storage แบบดั้งเดิม ทำให้ระบบสามารถส่งเสียงพูดทีละส่วนผ่าน API ได้แบบ real-time และรองรับการดูซ้ำได้ทุกครั้งผ่านลิงก์ที่แชร์ไว้
AIJetson Orin Nano SuperTTSDurable Streamsself-hosted
สรุปด้วย MAF Local AI · เนื้อหาต้นฉบับเป็นของแหล่งข่าว