மீள்முறை திருத்தத்தை நோக்கி இசை உருவாக்கத்தை Google தள்ளுகிறது
Google தனது இசை உருவாக்க மாடலின் புதிய பதிப்பான Lyria 3.5-ஐ வெளியிட்டுள்ளது, மேலும் அதை Flow Music-இல் புதிய திருத்தக் கட்டுப்பாடுகளுடன் இணைத்துள்ளது. இந்த புதுப்பிப்பு வெறும் உருவாக்கத் திறனை மட்டும் குறிப்பிடவில்லை; இது generative audio கருவிகள் எந்த திசையில் செல்கின்றன என்பதையும் காட்டுகிறது: அவை ஒரே முறையில் உருவாக்கும் அணுகுமுறையிலிருந்து, மென்பொருள் போன்ற திருத்தப் பணிப்பாய்வுகளுக்குத் தாவுகின்றன.
Google-ன் கூற்றுப்படி, Lyria 3.5 மேலும் இயல்பாக ஒலிக்கும் மெலடிகள், மேம்பட்ட பாடல்வரிகள், மற்றும் தெளிவான உச்சரிப்புடன் அதிக உண்மைத்தன்மை கொண்ட குரல்களை வழங்குகிறது. இப்போது பயனர்கள் டெம்போ மற்றும் டிராக் நீளத்தின் மீது மேலும் நுண்ணிய கட்டுப்பாட்டைப் பெறுவார்கள் என்றும், உருவாக்கப்படும் துணுக்குகள் 30 விநாடிகளிலிருந்து மூன்று நிமிடங்கள் வரை இருக்கும் என்றும் நிறுவனம் கூறுகிறது. இந்த மேம்பாடுகள் முக்கியமானவை, ஆனால் அதைவிட அதிக தாக்கம் ஏற்படுத்தக்கூடிய சேர்க்கை Selective Section Painting என்ற அம்சமாக இருக்கலாம்; இது பயனர்கள் ஒரு பாடலை முழுவதும் புதிதாக உருவாக்காமல், அதன் குறிப்பிட்ட பகுதிகளையே திருத்த அனுமதிக்கிறது.
இந்த மாற்றம் generative media அமைப்புகளின் நீடித்த பலவீனங்களில் ஒன்றைத் தீர்க்கிறது. இவை பெரும்பாலும் நம்பகமான முதல் வரைவை உருவாக்கலாம், ஆனால் பயனருக்கு மிகத் துல்லியமான திருத்தம் தேவைப்படும் போது அவை குறைவாக பயனளிக்கின்றன. கருப்பு (chorus) வேலை செய்கிறது ஆனால் verse வேலை செய்யவில்லை என்றாலோ, beat சரியாக உள்ளது ஆனால் vocal phrasing தவறினாலோ, முழு இசைத்துணையை மீண்டும் தொடங்குவது பயனற்றது. பயனர்களை உள்ளூர்வாக தலையிட அனுமதிக்கும் ஒரு அமைப்பு, வெறும் புதுமை உருவாக்கியாக அல்லாமல், படைப்பாற்றல் உற்பத்தி கருவியாகத் தோன்றத் தொடங்குகிறது.
Prompt output-இலிருந்து திருத்தக்கூடிய இசை அமைப்புக்குத் தாவல்
Selective Section Painting AI இசை இடைமுகங்களில் ஒரு புதிய கட்டத்தைச் சுட்டிக்காட்டுகிறது. ஒரு பாடலைப் பிரிக்க முடியாத ஒரே வெளியீடாகப் பார்ப்பதற்குப் பதிலாக, மாடல் அதை பகுதி பகுதியாகத் திருத்தக்கூடிய ஒன்றாகக் கருதுகிறது. இது இசைக்கலைஞர்கள், தயாரிப்பாளர்கள், மற்றும் sound designers உண்மையில் பணிபுரியும் முறையை பிரதிபலிக்கிறது. ஒரு பகுதி மாற்றப்பட வேண்டுமென்றால் அவர்கள் முழு வரைவை அரிதாகவே கைவிடுவார்கள். அவர்கள் நேரத்தைச் சரிசெய்வார்கள், பகுதிகளை மீண்டும் எழுதுவார்கள், instrument அமைப்பை மாற்றுவார்கள், மேலும் சரியாக வேலை செய்யாத பகுதியை மட்டும் மறுபடியும் கட்டமைப்பார்கள்.
Google-ன் கூற்றுப்படி, இந்த அமைப்பு குறுகிய மெலடிகளை முழுமையான பாடல்களாக மாற்ற முடியும், அதுவும் முழுமையான restart-ஐ கட்டாயப்படுத்தாமல். நடைமுறையில், இதன் பொருள் பயனர் ஒரு யோசனையை வரைந்து, ஏற்கனவே நன்றாக வேலை செய்யும் பகுதிகளைப் பாதுகாத்துக் கொண்டு அதைத் தேர்வாக விரிவாக்க முடியும் என்பதாகும். குரல்கள், டிரம்ஸ், பாஸ், மற்றும் பிற கூறுகள் மீது டெம்போ மற்றும் நீளத்தை மேலும் துல்லியமாகக் கட்டுப்படுத்துவதோடு, இந்த புதுப்பிப்பு உருவாக்குபவருக்கும் மாடலுக்கும் இடையிலான மேலும் தொகுதி-மைய உறவை நோக்கி சுட்டிக்காட்டுகிறது.
அந்த modularity வணிக ரீதியாக முக்கியமானது. மீள்முறைக் களையை ஆதரிக்கும்போது தான் generative கருவிகள் உண்மையான படைப்பாற்றல் பணிப்பாய்வுகளில் சிறப்பாக பொருந்தும். முடிந்த தயாரிப்புகளை மட்டும் வெளியிடும் ஒரு மாடல் demo-களில் கவரலாம், ஆனால் பகுதி திருத்தம், கட்டமைப்பு கட்டுப்பாடு, மற்றும் கூறு-மட்ட மாற்றங்களை அனுமதிக்கும் மாடலுக்கே production சூழல்களில் நுழையத் தெளிவான பாதை உள்ளது.
AI audio போட்டியில் இந்த புதுப்பிப்பு ஏன் முக்கியம்
Generative music துறை மேலும் நெருக்கடியானதாகி வருகிறது, மேலும் கட்டுப்பாடு ஒரு முக்கிய வேறுபாட்டு அம்சமாக உருவெடுக்கிறது. Text-to-music அமைப்புகள் ஏற்கனவே குறுகிய கிளிப்புகள் மற்றும் பாணி வரைபடங்களை உருவாக்க முடியும் என்பதை நிரூபித்துள்ளன. கடினமான பிரச்சனை அவற்றை மீண்டும் மீண்டும் பயன்படுத்தக்கூடிய படைப்பாற்றல் வேலைக்குப் பயன்படும் வகையில் மாற்றுவதுதான். அதற்கு சிறந்த அமைப்பு, மேலும் கணிக்கக்கூடிய timing, மற்றும் யோசனைக்கும் திருத்தத்திற்கும் இடையிலான இடர்ப்பாடை குறைக்கும் editing கருவிகள் தேவை.
Lyria 3.5 நேரடியாக அந்தப் பிரச்சனையையே குறிவைத்துள்ளது போலத் தெரிகிறது. மூன்று நிமிடங்கள் வரை track நீளங்கள் இருப்பது மாடலை மிகச் சிறிய துண்டுகளைக் கடந்துவைக்கிறது. melody, பாடல்வரிகள், மற்றும் vocal realism மீது சிறந்த கையாளுதல், உருவாக்கப்பட்ட இசை மற்றும் நிஜத் திட்டத்தில் பயன்படுத்தத் தகுந்ததாக கற்பனை செய்யக்கூடிய பொருள் ஆகியவற்றுக்கு இடையிலான தர இடைவெளியை குறிக்கிறது. ஆனால் பகுதி-திருத்தப் பணிப்பாய்வு தான் இந்த வெளியீட்டைยุப்பணித் திருப்புமுனையாக மாற்றுகிறது. கட்டுப்படுத்தத்தக்க தன்மை, வெறும் புதுமை அல்ல, ஏற்றுக்கொள்ளுதலை நிர்ணயிக்கும் என்பதை Google புரிந்துள்ளது என்பதை இது சுட்டிக்காட்டுகிறது.
இது generative AI-இன் பரந்த போக்குடனும் ஒத்துப்போகிறது. படம், video, மற்றும் code அமைப்புகள் அனைத்தும் உள்ளூர்த் திருத்தங்கள், கட்டமைக்கப்பட்ட மேம்பாடு, மற்றும் மீள்முறை human-in-the-loop பணிப்பாய்வுகளுக்குத் தாவுகின்றன. Audio நேரியல் நேரத்தில் சிக்கலானது என்பதால் music சிறிது பின்னோக்கி இருந்துள்ளது: ஒரு பகுதியில் சிறிய மாற்றம் rhythm, phrasing, மற்றும் transitions-ஐ மற்ற இடங்களில் பாதிக்கலாம். Lyria 3.5 குறுகிய வரம்புகளுக்குள்ளும் பகுதி திருத்தத்தைச் செயல்படுத்தக்கூடியதாக மாற்றினால், அது ஒரு முக்கியமான product முன்னேற்றமாக இருக்கும்.
தீராத training-data கேள்வி
இந்த வெளியீடு generative media அமைப்புகளைச் சுற்றியுள்ள பழக்கமான கவலையைக் கிளப்புகிறது: training data transparency. Google Lyria 3-ஐ அறிமுகப்படுத்தியபோது, YouTube மற்றும் Google தங்கள் விதிமுறைகள், கூட்டாண்மை ஒப்பந்தங்கள், மற்றும் பொருந்தும் சட்டத்தின் கீழ் பயன்படுத்த அதிகாரம் பெற்ற உள்ளடக்கத்திலேயே மாடல் பயிற்சிபெற்றதாக நிறுவனம் கூறியது. Lyria 3.5 குறித்த செய்திகளில், புதிய மாடலின் training data பற்றி கேட்கப்பட்டபோது Google உடனடி கூடுதல் விவரங்களை வழங்கவில்லை.
அந்த இடைவெளி முக்கியமானது, ஏனெனில் generative music இன்னும் licensing, creator consent, மற்றும் attribution விவாதங்களோடு இணைந்திருக்கிறது. ஒரு மாடல் கட்டுப்பாடு மற்றும் audio quality-இல் மேம்படலாம், ஆனால் அதன் திறன்களை உருவாக்கிய உள்ளடக்கம் என்ன என்பது வெளியாரால் தெளிவாகப் புரிந்துகொள்ள முடியாவிட்டால் சந்தேகம் நீடிக்கும். கலைஞர்களுக்கும் உரிமையாளர் களுக்கும், workflow மேம்பாடுகள் இந்த அமைப்புகள் எவ்வாறு கட்டப்பட்டுள்ளன என்ற பெரிய கேள்வியைத் தீர்க்கவில்லை.
அதே நேரத்தில், product வெளியீடுகள் தொடர்ந்து முன்னேறுகின்றன. இதனால் AI media-வில் இரட்டை நிலை உருவாகிறது: நிறுவனங்கள் மேம்பட்ட கருவிகளை அனுப்புவதற்காகப் போட்டியிடுகின்றன, ஆனால் சட்ட, நெறிமுறை, மற்றும் வணிகத் தரநிலைகள் இன்னும் உறுதியாகவில்லை. எனவே Lyria 3.5-ஐ மதிப்பாய்வு செய்யும் பயனர்கள் ஒரே நேரத்தில் இரண்டு விஷயங்களை மதிப்பிடுகிறார்கள். ஒன்று software-இன் நடைமுறை பயன்பாடு. மற்றொன்று அதைச் சுற்றியுள்ள governance அமைப்பு.
Generative music-க்கு மேலும் நடைமுறை கட்டம்
அந்த திறந்த கேள்விகள் இருந்தாலும், Lyria 3.5 generative music demonstration நிலையிலிருந்து workflow நிலைக்குப் பரிபக்வமாகிறது என்பதற்கான அறிகுறி. இந்த update வெறும் சிறந்த outputs-ஐ மட்டும் வாக்குறுதி அளிக்கவில்லை; அவை எவ்வாறு வடிவமைக்கப்படுகின்றன என்பதற்கான மேலான கட்டுப்பாட்டையும் வாக்குறுதி அளிக்கிறது. இது raw novelty-ஐ விட adoption-க்கு வலுவான வாதம்.
Flow Music இப்போது அந்தத் திட்டத்தின் delivery layer ஆக செயல்படுகிறது. பயனர்கள் sections-ஐ சீரமைக்க, tempo-வை tune செய்ய, மற்றும் duration-ஐ அதிகத் துல்லியத்துடன் நிர்வகிக்கக்கூடிய ஒரு product-இல் Lyria 3.5-ஐ உட்படுத்துவதன் மூலம், Google அந்த மாடலை ஒரு தனித்த பரிசோதனையாக அல்லாமல், படைப்பாற்றல் செயல்முறையின் ஒரு பகுதியாக நிலைநிறுத்துகிறது. இந்த வேறுபாடு முக்கியமானது, ஏனெனில் AI audio-வில் எதிர்கால வெற்றியாளர்கள் வெறும் பாடல்களை உருவாக்கும் மாடல்கள் மட்டும் அல்லாமல், மக்கள் அவற்றை குறைந்த தடங்கலுடன் திருத்த, இயக்க, மற்றும் முடிக்க அனுமதிக்கும் மாடல்களாகவும் இருக்கலாம்.
இப்போது, இந்த release ஒரு படிப்படியான ஆனால் அர்த்தமுள்ள மாற்றத்தை குறிக்கிறது. Generative music tools இனி ஒரு button அழுத்தி முடிவை ஏற்றுக்கொள்வது பற்றியதல்ல; அது நோக்கத்துடன் பொருந்தும் வரை ஒரு draft-ஐ வழிநடத்துவது பற்றியது. அந்தத் திசை தொடர்ந்தால், AI music அமைப்புகள் ஒரு track-ஐ உருவாக்க முடியுமா என்பதைக் கொண்டு அல்ல, பயனர் அதை எவ்வளவு நன்றாக வடிவமைக்க அனுமதிக்கப்படுகிறார் என்பதைக் கொண்டு அதிகம் மதிப்பிடப்படும்.
- Lyria 3.5 டெம்போ மற்றும் track length மீது கடுமையான கட்டுப்பாட்டைச் சேர்க்கிறது.
- உருவாக்கப்பட்ட tracks 30 விநாடிகளிலிருந்து மூன்று நிமிடங்கள் வரை இருக்கலாம்.
- Selective Section Painting பாடலின் குறிப்பிட்ட பகுதிகளை மட்டும் திருத்த அனுமதிக்கிறது.
- அறிக்கையில் Lyria 3.5 training data குறித்து Google புதிய விவரங்களை வழங்கவில்லை.
இந்தக் கட்டுரை The Decoder-இன் செய்தி அறிக்கையை அடிப்படையாகக் கொண்டது. மூலக் கட்டுரையைப் படிக்கவும்.
Originally published on the-decoder.com


