Google ได้เปิดตัว Lyria 3.5 ซึ่งเป็นเวอร์ชันใหม่ล่าสุดของโมเดลการสร้างเพลง AI โดยตรงภายในแอป Gemini และผ่าน API สำหรับนักพัฒนา บริษัทได้ประกาศในสุดสัปดาห์นี้ การเปิดตัวครั้งนี้ทำให้การสร้างข้อความเป็นเพลงต่อหน้าฐานผู้ใช้จำนวนมหาศาลของ Gemini และช่วยให้นักพัฒนาสามารถเข้าถึงโมเดลนี้โดยทางโปรแกรมได้เป็นครั้งแรกในเจเนอเรชั่นนี้
การเปิดตัวนี้รายงานโดย The Decoder และช่องทางอื่นๆ ซึ่งระบุว่า Google วางตำแหน่ง Lyria 3.5 ให้เป็นโมเดลเพลงที่มีความสามารถมากที่สุด โดยมีเสียงร้องที่ดีกว่าและการเรียบเรียงที่สมบูรณ์มากกว่ารุ่นก่อน นอกจากนี้ยังเป็นสัญญาณล่าสุดที่การแข่งขันเครื่องมือ AI ดำเนินไปโดยตรงผ่านสื่อสร้างสรรค์ ซึ่งเป็นสิ่งที่เราติดตามอย่างใกล้ชิดใน ความครอบคลุมของเครื่องมือ AI
สิ่งที่ Lyria 3.5 สามารถทำได้
จากข้อมูลของ Google Lyria 3.5 ให้เสียงร้องที่แสดงออกและการเรียบเรียงดนตรีที่สมบูรณ์ยิ่งขึ้นมากกว่าเวอร์ชันที่จะมาแทนที่ ผู้ใช้สามารถเลือกแนวและสไตล์ในแอพ Gemini เลือกระหว่างเสียงร้องและเสียงเครื่องดนตรี และสร้างแทร็กที่มีตั้งแต่คลิปสั้นไปจนถึงเพลงขนาดยาว
Google ยังได้เพิ่มเทมเพลตที่ออกแบบมาเพื่อช่วยผู้มาใหม่ในการเริ่มต้น รวมถึงการตั้งค่าล่วงหน้าสำหรับเพลงพื้นหลังและเพลงวันเกิดส่วนตัว ซึ่งเป็นสัญญาณว่าบริษัทมุ่งเป้าไปที่ผู้ใช้ทั่วไปและการเฉลิมฉลองเช่นเดียวกับนักดนตรี การเสนอนั้นคุ้นเคยกับคุณลักษณะอื่นๆ ของราศีเมถุนของ Google นั่นคือ ลดอุปสรรคลงจนกว่าใครก็ตามจะสามารถสร้างสิ่งประดิษฐ์ที่เสร็จสมบูรณ์จากประโยคหนึ่งหรือสองประโยคได้
ขั้นตอนการทำงานสะท้อนถึงความเรียบง่ายดังกล่าว ผู้ใช้อธิบายประเภทของแทร็กที่ต้องการ เลือกประเภทและพารามิเตอร์สไตล์ และตัดสินใจว่าเอาต์พุตควรมีเสียงร้องหรือคงไว้ซึ่งเครื่องดนตรี เนื่องจากโมเดลรองรับทั้งการต่อสั้นและการเรียบเรียงที่ยาว เครื่องมือเดียวกันจึงครอบคลุมข้อความวันเกิด เตียงพอดแคสต์ หรือเพลงประกอบสำหรับโฮมวิดีโอ — กรณีการใช้งานที่ก่อนหน้านี้ต้องสมัครสมาชิกเพลงสต็อกหรือจ้างนักแต่งเพลง
สถานที่ที่มีโมเดลวางจำหน่าย
การเปิดตัวนี้ไปไกลกว่าแอป Gemini ตามประกาศของ Google Lyria 3.5 ยังมีให้บริการใน Google Flow Music พร้อมฟีเจอร์เพิ่มเติม ใน Google AI Studio สำหรับนักพัฒนา และใน Google Vids ซึ่งเป็นเครื่องมือสร้างวิดีโอที่ขับเคลื่อนด้วย AI ของบริษัท การเข้าถึง API หมายความว่าแอปพลิเคชันของบุคคลที่สามสามารถสร้างโมเดลได้โดยตรง ซึ่งอาจก่อให้เกิดฟีเจอร์ที่ขับเคลื่อนด้วยเพลงในแอปของบุคคลที่สามในอีกไม่กี่เดือนข้างหน้า
ความกว้างนั้นสำคัญ การฝังโมเดลเพลงไว้ในผู้ช่วยผู้บริโภค แพลตฟอร์มนักพัฒนาซอฟต์แวร์ และโปรแกรมตัดต่อวิดีโอทำให้ Google มีแพลตฟอร์มต่างๆ มากมาย โดยที่เสียงที่สร้างขึ้นกลายเป็นตัวเลือกสร้างสรรค์เริ่มต้น แทนที่จะเป็นสิ่งแปลกใหม่แบบสแตนด์อโลน
สำหรับนักพัฒนา การเข้าถึง AI Studio ถือเป็นส่วนที่โดดเด่น โดยเปลี่ยน Lyria จากความอยากรู้อยากเห็นของผู้บริโภคมาสู่โครงสร้างหลัก: แอปฟิตเนสสามารถสร้างเพลงออกกำลังกายที่ปรับเปลี่ยนได้ สตูดิโอเกมสามารถให้คะแนนตามขั้นตอน และเครื่องมือด้านการศึกษาสามารถสร้างเพลงที่กำหนดเองสำหรับบทเรียนได้ Google ยังไม่ได้ประกาศราคา API ในวัสดุที่รายงานจนถึงขณะนี้ ดังนั้นจึงต้องรอดูวิธีวัดโมเดล แต่ความพร้อมใช้งานเพียงอย่างเดียวส่งสัญญาณว่าบริษัทต้องการให้ Lyria 3.5 ฝังอยู่ในระบบเศรษฐกิจแอปที่กว้างขึ้น ไม่จำกัดเฉพาะผลิตภัณฑ์ของตัวเอง
สนามฝึกอบรมที่ได้รับใบอนุญาต
ส่วนที่ชี้ที่สุดของการประกาศของ Google คือข้อมูลการฝึกอบรม Google กล่าวว่าโมเดล Lyria ได้รับการฝึกฝนเฉพาะในเนื้อหาที่มีลิขสิทธิ์ ซึ่งแตกต่างอย่างชัดเจนกับ Suno บริษัทสตาร์ทอัพด้านดนตรีด้วย AI ซึ่งการฝึกอบรมได้นำไปสู่การฟ้องร้องเรื่องลิขสิทธิ์ รวมถึงคดีสำคัญในเยอรมนีที่นำโดยกลุ่มลิขสิทธิ์เพลง GEMA ที่ Suno แพ้เมื่อต้นปีนี้
Google ไม่ได้เปิดเผยข้อมูลเฉพาะเกี่ยวกับข้อมูลการฝึกอบรมที่ใช้จริง ตามที่ The Decoder ระบุไว้ แต่กรอบเนื้อหาที่ได้รับอนุญาตนั้นมีเส้นแบ่งที่ชัดเจนในอุตสาหกรรมที่แหล่งที่มาของข้อมูลการฝึกอบรมกลายเป็นตัวสร้างความแตกต่างทางกฎหมายและเชิงพาณิชย์ สำหรับผู้ถือสิทธิ์ ห้องปฏิบัติการหลักที่อ้างว่าได้รับการฝึกอบรมที่มีใบอนุญาตเต็มรูปแบบจะยกระดับมาตรฐานให้กับคู่แข่ง สำหรับผู้ใช้ทางธุรกิจ จะช่วยลดความเสี่ยงทางกฎหมายอย่างน้อยบางส่วนที่ทำให้เสียงที่สร้างโดย AI กลายเป็นทรัพย์สินที่เต็มไปด้วยการโฆษณาและการผลิตสื่อ
ตลาดที่แออัดและถูกฟ้องร้อง
การสร้างดนตรีด้วย AI กำลังกลายเป็นหนึ่งในมุมที่มีการโต้แย้งกันมากขึ้นของสื่อเชิงสร้างสรรค์ ความพ่ายแพ้ของศาลในเยอรมนีต่อคำถามด้านลิขสิทธิ์ของ Suno ส่งสัญญาณว่าสภาพแวดล้อมทางกฎหมายสำหรับโมเดลที่ได้รับการฝึกอบรมเกี่ยวกับการบันทึกที่ได้รับการคุ้มครองนั้นเข้มงวดมากขึ้น โดยเฉพาะอย่างยิ่งในยุโรป การตัดสินใจของ Google ที่จะเน้นย้ำเรื่องการออกใบอนุญาตในขณะที่ยังคงรักษารายละเอียดไว้เป็นความลับนั้น ถือเป็นทั้งเกราะป้องกันทางกฎหมายและข้อความทางการตลาดที่มุ่งเป้าไปที่ลูกค้าองค์กรที่ระมัดระวัง
การเดิมพันในการแข่งขันนั้นเกี่ยวกับการจัดจำหน่ายด้วย ฐานผู้ใช้ของ Gemini ทำให้ Lyria 3.5 เข้าถึงได้ยากซึ่งสตาร์ทอัพด้านดนตรีแบบสแตนด์อโลนต่างพยายามดิ้นรนเพื่อให้เข้ากัน และการบูรณาการเข้ากับ Google Vids ทำให้เพลงประกอบ AI อาจกลายเป็นส่วนมาตรฐานของการสร้างวิดีโอในที่ทำงานแทบจะในชั่วข้ามคืน
ความหมายสำหรับผู้สร้าง
สำหรับนักดนตรีที่ทำงาน การมาของโมเดลเพลงที่ได้รับใบอนุญาตและสวยงามภายในผู้ช่วยกระแสหลักถือเป็นการพัฒนาแบบสองขั้ว โดยจะลดต้นทุนของจิงเกิ้ล แบ็คกิ้งแทร็ก และเพลงส่วนตัวให้เกือบเป็นศูนย์ ขณะเดียวกันก็ทำให้เกิดคำถามที่คุ้นเคยเกี่ยวกับวิธีที่ศิลปินที่เป็นมนุษย์แข่งขันกันเพื่อให้ได้ผลงานที่ทันท่วงทีและเพียงพอ ในตอนนี้ การส่งข้อความของ Google มุ่งเน้นไปที่ความช่วยเหลือและความคิดสร้างสรรค์ในระดับการเฉลิมฉลอง แทนที่จะมาแทนที่การผลิตในสตูดิโอ
สิ่งที่ชัดเจนคือเพลง AI กำลังออกจากขั้นตอนการสาธิต ด้วย Lyria 3.5 ที่อยู่ในแอป Gemini, Flow Music, AI Studio, Google Vids และ API สาธารณะ การสร้างเพลงที่ใช้งานได้ตอนนี้กลายเป็นคุณสมบัติ ไม่ใช่หมวดหมู่ผลิตภัณฑ์ของตัวเอง และอุตสาหกรรมจะต้องจับตาดูว่าการเรียกร้องการฝึกอบรมที่ได้รับใบอนุญาตนั้นขึ้นอยู่กับการตรวจสอบข้อเท็จจริงหรือไม่
ก้าวนำหน้า AI
ภูมิทัศน์เครื่องมือ AI เปลี่ยนแปลงทุกวัน รับ การพัฒนา AI ล่าสุด ได้ในที่เดียว
อ่านข่าว AI เพิ่มเติม →