ข้ามไปยังเนื้อหาหลัก

AI แปลงข้อมูลเสียง สร้างเป็นภาพถนน ที่มีความแม่นยำสูง

23 ธ.ค. 673 นาที23 ธ.ค. 67

นักวิจัยจากมหาวิทยาลัยเท็กซัส (University of Texas) ประเทศสหรัฐอเมริกา ได้พัฒนาเทคโนโลยีปัญญาประดิษฐ์ (AI) ที่สามารถแปลงเสียงจากการบันทึกเป็นภาพถนนที่มีความแม่นยำสูง

ขนาดตัวอักษร

นักวิจัยจากมหาวิทยาลัยเท็กซัส (University of Texas) ประเทศสหรัฐอเมริกา ได้พัฒนาเทคโนโลยีปัญญาประดิษฐ์ (AI) ที่สามารถแปลงเสียงจากการบันทึกเป็นภาพถนนที่มีความแม่นยำสูง

การศึกษานี้ได้รับการเผยแพร่ในวารสารวิชาการด้านปัญญาประดิษฐ์ และได้รับความสนใจในวงกว้าง เนื่องจากเทคโนโลยีนี้มีศักยภาพในการสร้างภาพที่ละเอียดและสมจริงโดยใช้ข้อมูลจากเสียงเพียงอย่างเดียว

AI-streetscapes-2-2048x929.jpg
ภาพ 1 - ผลลัพธ์ของการสร้างภาพด้วยระบบ AI

ระบบ AI ทำงานโดยอาศัยข้อมูลเสียงจากสภาพแวดล้อม เช่น เสียงรถวิ่ง เสียงฝนตก หรือเสียงคนเดินบนถนน จากนั้นจะนำเสียงเหล่านี้ไปประมวลผลผ่านระบบเรียนรู้เชิงลึก (Deep Learning) เพื่อสร้างภาพถนนที่สอดคล้องกับเสียงได้อย่างแม่นยำ โดยสามารถนำผลลัพธ์ที่ได้ไปใช้ประโยชน์ได้หลากหลายด้าน เช่น การช่วยเหลือผู้พิการทางสายตา และการสำรวจพื้นที่ที่เข้าถึงยาก

ความสามารถของระบบ AI นี้ไม่เพียงแค่สร้างภาพได้อย่างแม่นยำ แต่ยังสามารถวิเคราะห์ลักษณะของพื้นที่โดยรอบได้อย่างละเอียด ไม่ว่าจะเป็นประเภทของพื้นถนน รูปแบบอาคารใกล้เคียง หรือสภาพอากาศ เช่น ฝนตก หรือหมอก นักวิจัยเชื่อว่าเทคโนโลยีนี้สามารถนำไปใช้กับระบบนำทางอัตโนมัติในรถยนต์ หรือโดรน เพื่อเพิ่มความปลอดภัยในสถานการณ์ที่ที่มีทัศนวิสัยต่ำ รวมถึงช่วยงานด้านการค้นหาและกู้ภัยในพื้นที่ประสบภัยธรรมชาติ

ทีมนักวิจัยได้รวบรวมคลังข้อมูลเสียงขนาดใหญ่ที่ครอบคลุมสภาพแวดล้อมหลากหลายรูปแบบ จากนั้นได้ใช้กระบวนการฝึกฝน AI ให้สามารถจับคู่เสียงกับภาพได้อย่างแม่นยำ การพัฒนานี้ใช้ความร่วมมือจากนักวิทยาศาสตร์หลากหลายสาขา เช่น วิศวกรรมคอมพิวเตอร์ และจิตวิทยาการรับรู้ ผลการทดสอบพบว่า AI สามารถสร้างภาพที่ใกล้เคียงกับภาพถ่ายจริงในระดับความแม่นยำสูงกว่า 90%

AI-streetscapes-1-2006x2048.jpg
ภาพ 2 - ขั้นตอนการเปลี่ยนเสียงเป็นภาพของ AI

นักวิจัยวางแผนที่จะพัฒนา AI ให้สามารถสร้างภาพในมุมมอง 3 มิติ ซึ่งจะช่วยเพิ่มศักยภาพในการใช้งานในอุตสาหกรรมต่าง ๆ เช่น การพัฒนาเกมที่สมจริง หรือการสร้างสื่อการเรียนการสอนแบบใหม่ เทคโนโลยีนี้ยังสามารถประยุกต์ใช้ในอุปกรณ์ช่วยเหลือผู้พิการทางสายตา เพื่อช่วยให้ผู้ใช้งานสามารถรับรู้สิ่งแวดล้อมรอบตัวผ่านเสียงและภาพได้อย่างชัดเจน

เทคโนโลยีการแปลงเสียงเป็นภาพถนนที่พัฒนาขึ้นโดยมหาวิทยาลัยเท็กซัส ถือเป็นนวัตกรรมที่มีศักยภาพสูงที่สามารถนำไปประยุกต์ใช้ได้หลากหลายด้าน เช่น การช่วยเหลือผู้พิการ ระบบนำทางอัตโนมัติ และการสำรวจพื้นที่ การพัฒนานี้แสดงให้เห็นถึงความก้าวหน้าของระบบปัญญาประดิษฐ์ (AI) ที่ช่วยเพิ่มคุณภาพชีวิตและสามารถแก้ปัญหาที่ซับซ้อนได้อย่างมีประสิทธิภาพ

เรียบเรียงโดย ขนิษฐา จันทร์ทร

ที่มาข้อมูล: newatlas, utexas, diyphotography, techexplorist
ที่มาภาพ: ภาพ 1, ภาพ 2
“รอบรู้ ดูกระแส ก้าวทันโลก” ไปกับ Thai PBS Sci & Tech

เขียนโดย

🌎 "รอบรู้ ดูกระแส ก้าวทันโลก" ไปกับ Thai PBS Sci & Tech • วิทยาศาสตร์ • เทคโนโลยี นวัตกรรม • ดาราศาสตร์ • Media Literacy • Cyber Security • Tips & Tricks • Trends

บทความที่เกี่ยวข้อง

เมื่อ GPT-6 สามารถแก้ปัญหาโจทย์ Navier–Stokes Millennium Prize ได้สำเร็จAI

เมื่อ GPT-6 สามารถแก้ปัญหาโจทย์ Navier–Stokes Millennium Prize ได้สำเร็จ

ล่าสุดหลังเปิดตัวโมเดล GPT-6 Astra ได้ไม่นาน ทาง OpenAI ได้ประกาศความสำเร็จของโมเดลว่าสามารถพิสูจน์โจทย์ Navier–Stokes Millennium Prize ได้สำเร็จเป็นครั้งแรก

21 ก.ย. 69|3 วันที่แล้ว
อ่านต่อ →
ทรัมป์ประกาศตั้ง “กองกำลัง AI” ไม่ยอมให้ขัดขวางการเติบโตเทคโนโลยีAI

ทรัมป์ประกาศตั้ง “กองกำลัง AI” ไม่ยอมให้ขัดขวางการเติบโตเทคโนโลยี

"ทรัมป์" ประกาศ เตรียมตั้ง “กองกำลัง AI” ช่วยเหลือ กำกับดูแลการขยายตัวของเทคโนโลยี ลั่นไม่ยอมให้ใครขัดขวางการเติบโตของอุตสาหกรรม พร้อมชวนประชาชนโหวตเปลี่ยนชื่อ AI ใหม่

20 ก.ย. 69|4 วันที่แล้ว
อ่านต่อ →
AI กำลังจะฉลาดเกินควบคุม ทั้งพัฒนาตัวเอง เรียนรู้เองได้ เสี่ยงล้างบางมนุษย์ได้จริง ๆAI

AI กำลังจะฉลาดเกินควบคุม ทั้งพัฒนาตัวเอง เรียนรู้เองได้ เสี่ยงล้างบางมนุษย์ได้จริง ๆ

เมื่อวันที่ 9 กันยายน 2026 เจค็อบ โคซอน (Jacob Coxon) นักวิจัย AI อายุ 27 ปี ได้โพสต์ไม่กี่ประโยคลงใน X ของเขา ซึ่งเป็นการแหกหน้าภาพลักษณ์อุตสาหกรรม AI อย่างไม่แคร์สื่อ

16 ก.ย. 69|16 ก.ย. 69
อ่านต่อ →
    AI แปลงข้อมูลเสียง สร้างเป็นภาพถนน ที่มีความแม่นยำสูง | Thai PBS Sci & Tech