Kehadiran kecerdasan buatan dalam kehidupan seharian kita terus berkembang, dan Google nampaknya bertekad untuk membiarkannya menentukan rentak apa yang kita dengarkan. Syarikat itu sedang menyediakan ciri baharu yang akan membolehkan pembantu Gemini mereka menggubah muzik daripada arahan teks , terus daripada aplikasi mudah alih.
Langkah ini sejajar dengan strategi Google untuk mengubah Gemini menjadi hab kreatif yang mampu menjana imej, teks dan kini audio tanpa memerlukan alatan luaran. Walaupun tiada pengumuman rasmi lagi, petunjuk teknikal yang terdapat dalam perisian tersebut menjelaskan bahawa syarikat itu sangat serius tentang muzik yang dijana AI.
Alat muzik baharu dalam Gemini
Menurut analisis aplikasi Android Gemini , salah satu versi terkininya mengandungi rujukan langsung kepada utiliti dalaman yang berkaitan dengan penciptaan bunyi. Antara baris kod, alat yang dikenal pasti sebagai MUSIC_GENERATION_AS_TOOL disebut , mencadangkan fungsi yang dikhaskan khusus untuk menjana muzik menggunakan AI yang disepadukan ke dalam pembantu itu sendiri.
Penemuan ini datang daripada pembongkaran APK Gemini versi 17.2.51.sa.arm64 pada Android , di mana keupayaan baharu ini dikesan dalam fasa penyediaan. Hakikat bahawa fungsi tersebut sudah ada dalam kod, walaupun ia tersembunyi daripada pengguna, menunjukkan bahawa pembangunan agak maju, walaupun ia belum bersedia untuk pengaktifan umum.
Sementara itu, terdapat tanda-tanda bahawa Gemini akan memasukkan kategori muzik tertentu dalam bahagian "Bahan Saya" . Kawasan ini, yang direka untuk mengumpulkan semua yang dijana oleh AI—seperti teks atau imej—kemudian akan turut merangkumi trek muzik, menjadikannya lebih mudah untuk menyimpan, menyusun dan memainkan ciptaan bunyi tanpa meninggalkan aplikasi.
Sehingga kini, eksperimen muzik Google terhad terutamanya kepada bidang tertentu, seperti ciri-ciri tertentu dalam aplikasi Recorder telefon Pixel atau projek penciptaan video seperti Veo. Perbezaannya sekarang ialah penciptaan audio akan menjadi keupayaan asli dalam Gemini , setanding dengan penulisan teks atau penjanaan imej menggunakan model yang dikenali secara dalaman sebagai Nano Banana.
Peranan Lyria dan pengalaman Google sebelum ini dalam muzik berkuasa AI
Google tidak bermula dari awal dalam bidang ini. Syarikat itu sudah mempunyai Lyria, model AI yang mengkhusus dalam muzik yang tersedia melalui API Gemini dan telah digunakan dalam pelbagai eksperimen. Lyria direka bentuk untuk menggubah karya instrumental dan memantau evolusi muzik dalam masa nyata , yang sejajar dengan ciri kreatif masa depan untuk pengguna akhir.
Kebocoran menunjukkan bahawa ciri Gemini baharu ini akan dikuasakan oleh Lyria , membawakan teknologi ke aplikasi Android yang, sehingga kini, terhad kepada persekitaran pembangun atau ujian tertutup. Ini akan membolehkan sesiapa sahaja, tanpa sebarang pengetahuan penerbitan muzik, menghasilkan lagu, melodi atau bunyi latar belakang dengan penerangan bahasa semula jadi yang mudah.
Dalam ekosistem Google, Lyria telah digunakan bersama-sama dengan alatan lain seperti Veo, model penjanaan video , untuk mencipta runut bunyi yang disesuaikan dengan klip yang dijana AI. Dengan penyepaduannya ke dalam Gemini, keupayaan ini hanya perlu satu klik sahaja pada mudah alih, tanpa perlu mengakses platform berasingan atau API teknikal.
Kunci kepada pendekatan ini adalah kebolehcapaian : walaupun API Gemini memerlukan sedikit pengetahuan dan sumber untuk digunakan sepenuhnya, ciri dalam aplikasi dengan antara muka berpandu dan arahan teks mudah menjadikan penciptaan muzik boleh diakses oleh khalayak yang lebih luas . Daripada pencipta kandungan media sosial kepada pengguna yang hanya mahukan trek untuk berlatih atau belajar, potensi penggunaannya adalah besar.

Bagaimanakah penjanaan muzik mungkin berfungsi dalam Gemini?
Walaupun antara muka akhir belum didedahkan lagi, rujukan yang ditemui dan cara ciri Gemini lain berfungsi membolehkan kita membayangkan skema yang agak jelas. Kemungkinan besar, pengguna perlu menaip gesaan yang menerangkan jenis muzik yang mereka mahukan, sama seperti cara imej diminta: contohnya, "trek elektronik lembut untuk tumpuan," "runtug bunyi epik untuk treler," atau "lagu rock gaya 80-an untuk bersenam."
Berdasarkan penerangan itu, Gemini akan menggabungkan keupayaan pemahaman bahasanya dengan model muzik yang mendasarinya, menghasilkan karya audio yang disesuaikan dengan gaya, intensiti atau tempoh yang diminta . Hasrat Google adalah untuk menawarkan pengalaman semudah penjanaan imej, tanpa memerlukan pengetahuan teknikal tentang pencampuran, instrumen atau teori muzik.
Rentetan teks yang ditemui menunjukkan bahawa mungkin terdapat sekatan penggunaan bergantung pada jenis akaun . Ada kemungkinan penciptaan muzik pada mulanya akan dihadkan kepada pengguna yang membayar , seperti mereka yang melanggan pelan lanjutan Gemini atau perkhidmatan premium Google AI, walaupun ini belum disahkan oleh syarikat itu.
Penapis juga berkemungkinan besar akan digunakan untuk mencegah peniruan langsung lagu berhak cipta atau suara artis tertentu . Industri muzik di Eropah dan seluruh dunia amat sensitif terhadap pengklonan gaya dan timbre yang tidak dibenarkan, dan kedua-dua peraturan EU dan tekanan industri memaksa penyedia AI utama untuk bertindak dengan berhati-hati.
Jika Google berjaya menjadikan sistem ini mudah sambil menghormati batasan ini, Gemini boleh menjadi alat biasa untuk pencipta kandungan mudah alih , daripada YouTuber dan TikToker hinggalah projek podcast kecil atau video korporat yang memerlukan muzik latar belakang yang pantas dan boleh digunakan secara sah.
Kebolehcapaian, status pembangunan dan persoalan yang perlu diselesaikan
Salah satu inovasi utama inisiatif ini ialah, buat pertama kalinya, Google akan menjadikan penjanaan muzik boleh diakses oleh mana-mana pengguna aplikasi Gemininya , tanpa bergantung pada perkakasan tertentu seperti telefon Pixel terkini atau platform eksperimen. Muzik akan menjadi elemen lain dalam tawaran multimedia pembantu, di samping teks dan imej.
Walau bagaimanapun, jejak dalam APK menjelaskan bahawa ciri tersebut masih dalam pembangunan . Buat masa ini, cara tepat ia akan dipaparkan dalam antara muka tidak diketahui, begitu juga berapa banyak pilihan penyesuaian yang akan disertakan (tempoh trek, instrumen, perubahan tempo, lapisan bunyi, dll.).
Tiada tarikh keluaran rasmi buat masa ini . Kebocoran seperti yang diterbitkan oleh Android Authority menunjukkan bahawa pengumuman itu mungkin akan dibuat dalam beberapa minggu atau bulan akan datang, tetapi ini sebahagian besarnya bergantung pada ujian dalaman dan Google menyelesaikan isu teknikal dan perundangan sensitif yang berkaitan dengan muzik yang dijana AI.
Satu lagi persoalan penting ialah sama ada ciri tersebut akan dilancarkan serentak di semua pasaran atau sama ada rantau tertentu, seperti Amerika Syarikat atau Kesatuan Eropah , akan diutamakan . Dalam kes Eropah, peraturan AI dan peraturan harta intelek terkini boleh mempengaruhi garis masa dan ciri yang tersedia di setiap negara.
Akhir sekali, masih belum jelas sama ada alat ini akan ditawarkan dengan mod percuma terhad dan pilihan berbayar lanjutan , atau sama ada ia akan dikaitkan secara langsung dengan langganan seperti Gemini Advanced atau Google One dengan AI. Keputusan ini mungkin penting dalam menentukan sama ada penciptaan muzik berkuasa AI sampai kepada orang awam atau kekal di tangan segmen pengguna intensif yang lebih kecil.

Persaingan dalam sektor ini dan potensi impak terhadap pengguna di Eropah dan Sepanyol
Keputusan untuk mempercepatkan pembangunan ciri ini dibuat di tengah-tengah persaingan sengit antara model AI utama . Walaupun Google berusaha mengembangkan keupayaan kreatif Gemini, OpenAI sedang menyediakan ciri baharu untuk ChatGPT yang turut merangkumi bidang seperti pengendalian fail, pengaturcaraan dan penjanaan kandungan multimedia.
Bagi pengguna di Eropah dan Sepanyol, penyepaduan muzik berkuasa AI dalam Gemini boleh mewakili alternatif langsung kepada perkhidmatan pihak ketiga yang telah pun membenarkan penciptaan trek tersuai, dengan kelebihan disepadukan dalam ekosistem Google sendiri. Keupayaan untuk menyimpan ciptaan dalam "My Stuff", menyegerakkannya dengan akaun dan mengaksesnya daripada peranti yang berbeza akan menjadikannya lebih mudah untuk digunakan semula dalam projek peribadi atau profesional.
Pada masa yang sama, pelancaran di Eropah akan bergantung kepada pematuhan peraturan EU , terutamanya mengenai ketelusan dalam data latihan, penghormatan terhadap hak cipta dan perlindungan untuk artis dan pemegang hak cipta. Google dijangka perlu memberikan maklumat yang jelas tentang cara trek ini dijana dan batasan yang dikenakan terhadap penggunaannya.
Jika syarikat itu mencapai keseimbangan yang betul antara inovasi dan perlindungan undang-undang, tidak hairanlah jika tidak lama lagi pencipta kandungan berbahasa Sepanyol menggabungkan muzik yang dihasilkan oleh Gemini ke dalam podcast, video pendek atau bahan pendidikan, sama seperti alat AI yang telah digunakan hari ini untuk sari kata, suara latar atau penyuntingan imej.
Apa yang muncul, akhirnya, ialah senario di mana penciptaan muzik bukan lagi domain eksklusif mereka yang menguasai instrumen atau perisian produksi , tetapi akan menjadi pilihan yang boleh diakses terus dari peranti mudah alih. Gemini, dengan alat penjanaan muzik yang akan datang, menyasarkan untuk menjadi sebahagian daripada perubahan ini, dengan syarat Google berjaya mengintegrasikannya dengan lancar ke dalam aplikasinya, menjadikannya mudah difahami oleh pengguna biasa, dan menyesuaikannya dengan peraturan permainan yang ditetapkan oleh industri muzik dan peraturan Eropah.

