Fable 5.1 Menandai SEMUA Hal dengan Watermark, Begini Cara Menghapusnya
CChase AI
Computing/SoftwareInternet Technology
Transcript
00:00:00Jadi kemarin, Anthropic meluncurkan Fable 5.1, dan ini adalah model pertama yang mereka keluarkan
00:00:04yang sekarang memberikan tanda air pada semua yang dibuatnya. Dan hari ini, saya akan menunjukkan cara menghilangkannya.
00:00:10Namun pertama-tama, mari kita bahas apa sebenarnya tanda air ini, karena agak keliru
00:00:14jika menyebutnya sebagai tanda air, mengapa hal ini ada sejak awal, dan bagaimana cara kerjanya.
00:00:19Karena jika Anda memahami hal-hal tersebut, solusi untuk mengatasi tanda air ini akan menjadi
00:00:23jauh lebih masuk akal. Sekarang, mengapa kita harus menghadapi ini sama sekali? Nah, ini karena
00:00:26ini mematuhi Undang-Undang AI Uni Eropa yang pada dasarnya telah ditandatangani oleh semua lab perintis utama
00:00:31dengan pengecualian XAI. Dan aturan ini menyatakan bahwa mereka perlu, yaitu pihak Uni Eropa,
00:00:38membutuhkan cara untuk dapat mengetahui apakah suatu teks atau keluaran tertentu dibuat oleh AI.
00:00:43Dan untuk melakukan ini, Anthropic telah menambahkan tanda air ke semua keluarannya untuk model yang dirilis
00:00:50setelah 2 Agustus 2026, yang tidak lain adalah Fable 5.1. Sekarang, Anthropic mengklaim ini tidak memiliki
00:00:56efek praktis pada keluaran aktual yang diberikan kepada Anda, dan bahwa ini sangat terbatas dalam hal apa
00:00:59yang akan diubah jika kita berbicara tentang kode. Tapi bagaimana benda ini benar-benar bekerja? Dan mengapa
00:01:03saya menyebutnya istilah yang keliru sejak awal? Sekarang, strategi Anthropic untuk menyuntikkan tanda air ini
00:01:07ke dalam keluarannya didasarkan pada makalah yang dirilis dari Google pada tahun 2024 berjudul Watermarking Skalabel
00:01:13untuk Mengidentifikasi Keluaran Model Bahasa Besar. Sekarang, ini adalah makalah yang relatif teknis. Ini membahas
00:01:19penandaan air berbasis turnamen SynthID. Tapi izinkan saya memberi Anda model mental sederhana untuk Anda pahami.
00:01:25Sekarang, seperti yang Anda tahu, model bahasa besar dan keluarannya didasarkan pada probabilitas dan ada
00:01:29sejumlah keacakan yang terlibat. Jika saya memberikan kalimat yang berbunyi, dia adalah titik-titik dan perlu
00:01:34mengisinya, yah, ia akan memiliki daftar kata yang mungkin dapat digunakannya untuk menyelesaikan kalimat itu.
00:01:41Dan katakanlah kata-kata itu adalah cantik, menawan, memukau, dan manis. Sekarang, pada kenyataannya,
00:01:48masing-masing kata ini akan memiliki persentase yang berbeda atau probabilitas yang berbeda yang terkait dengannya dalam hal
00:01:54apa yang akan dipilih oleh model bahasa besar. Istilah yang sering Anda dengar disebut softmax, tetapi Anda hanya perlu
00:01:58untuk memahami bahwa semua kata ini memiliki probabilitas yang terkait dengannya mengenai mana yang akan
00:02:04Untuk latihan mental ini, saya ingin Anda membayangkan semuanya memiliki
00:02:08persentase yang sama persis, benar? Jadi masing-masing kata ini untuk menyelesaikan kalimat memiliki peluang 25%
00:02:14untuk dipilih. Sekarang, biasanya sebelum penandaan air mulai berlaku, ia akan memilih salah satu dari ini.
00:02:20Dan katakanlah ia melempar dadu bersisi empat dan memilih kata cantik. Keren, kan? Peluangnya 25%,
00:02:26semua ini memiliki peluang yang sama untuk dipilih. Tapi sekarang kita bekerja dalam sistem yang berbeda dan sistem itu
00:02:31adalah sistem penandaan air. Dengan sistem penandaan air, kita masih bisa berada di tempat yang sama di mana saya katakan,
00:02:38hei, saya ingin kamu melengkapi kalimat, dia adalah titik-titik, dan kamu memiliki empat pilihan, benar? Dan katakanlah,
00:02:42sekali lagi, itu adalah keempat kata ini dan mereka memiliki probabilitas yang sama. Ketika kita menambahkan konstruksi penandaan air,
00:02:49yang akan dilakukannya adalah pada dasarnya ia akan memuat dadu ini. Jika ini adalah semacam
00:02:54dadu bersisi empat, yah, ia kemudian akan berkata, hmm, untuk tujuan penandaan air, kata cantik sekarang akan
00:03:01menjadi 50% dan memukau akan menjadi 30%. Jadi ketika kita menambahkan semacam sistem penandaan air,
00:03:10ia akan memilih kata-kata tertentu dan memberikan bobot yang lebih berat padanya. Dan karena kata-kata tertentu lebih
00:03:15berat bobotnya ketika model bahasa besar memilihnya, yah, kata-kata itu akan muncul
00:03:19lebih sering, benar? Menggunakan sistem penandaan air, kemungkinan besar ia akan mengatakan dia adalah
00:03:25cantik. Sekarang, Anda sebagai pengguna akhir tidak tahu apa kata-kata ini dan kata mana yang diberi bobot
00:03:32lebih berat. Tetapi seseorang yang memiliki kunci, kunci rahasia penandaan air dapat mengetahuinya. Sekarang,
00:03:40mereka tidak dapat mengetahuinya dengan kepastian mutlak karena seperti sebelumnya, Anda tahu, selalu ada kemungkinan
00:03:45ia akan mengatakan, Anda tahu, dia cantik. Anda tidak tahu apakah itu tentu saja memiliki peluang lebih tinggi
00:03:49karena penandaan air. Tetapi seseorang dengan kunci tersebut akan tahu kata mana yang diberi bobot
00:03:55lebih berat. Dan itu kemudian akan memberi mereka semacam probabilitas yang memberi tahu pengguna yang memiliki
00:04:01kunci tersebut, yaitu regulator Eropa, oke, ada peluang 90% bahwa teks ini, peluang 100%, peluang 99% bahwa teks ini
00:04:09ditulis dengan Claude, atau teks ini ditulis dengan AI. Begitulah cara kerjanya. Sekarang,
00:04:15gagasannya di sini adalah bahwa kata-kata yang dipilih untuk diubah dan diberi bobot lebih berat dengan penandaan air
00:04:20tidak akan mengubah arti keseluruhan kalimat. Itu tidak akan mengubah keluaran Anda.
00:04:24Itu tidak akan mengubah kinerja Anda. Dan ketika kita berbicara tentang kode khususnya, itu tidak akan mengubah
00:04:28kode jika itu akan memengaruhi tampilan keluaran nantinya. Dan itu tidak akan mengubah fakta.
00:04:34Anda tahu, jika dikatakan, hei, peristiwa sejarah ini, Anda tahu, terjadi pada, Anda tahu, 810. Nah,
00:04:41itu tidak akan mengubah kata-kata itu, benar? Itu adalah fakta. Peristiwa itu terjadi pada 810. Itu tidak akan
00:04:45diubah. Tapi itu adalah penjelasan yang disederhanakan, sekali lagi, penjelasan yang disederhanakan tentang cara kerja sistem ini.
00:04:52Sekarang, Anthropic belum sepenuhnya mempublikasikan algoritma persis untuk cara kerjanya, tetapi kita dapat
00:04:57mengekstrapolasi hal tersebut dari makalah DeepMind. Dan apa yang juga harus Anda pahami dari hal tersebut adalah
00:05:02memiliki kunci ini adalah satu-satunya cara untuk mengetahui apakah itu ditulis oleh AI berdasarkan sistem penandaan air.
00:05:08Dan kunci ini tidak bersifat publik. Untuk mendapatkan akses ke kunci tersebut, Anda harus meminta akses. Tidak ada daftar publik.
00:05:12Anda mungkin harus menjadi semacam regulator Uni Eropa. Jadi siapa pun di luar sana yang mengatakan,
00:05:16oh, hei, ini situs web saya yang dapat mendeteksi apakah itu bertanda air atau tidak, itu adalah kebohongan karena hal ini tidak
00:05:21ada. Sekarang, jika Anda ingin mendalami cara kerja tanda air teks, Anthropic juga memiliki artikel mereka sendiri.
00:05:25Dan mereka benar-benar mencoba menegaskan bahwa ini tidak akan memengaruhi keluaran.
00:05:29Jadi sistem penandaan air, pada intinya, adalah tentang kata-kata tertentu yang dipilih lebih sering daripada yang lain.
00:05:35Dan ini adalah algoritma statistik yang tidak akan pernah dapat Anda ketahui oleh Anda, pengguna akhir, kecuali
00:05:40Anda memiliki kuncinya. Lantas bagaimana cara kita mengatasinya? Apakah kita cukup melakukan penyuntingan ringan pada keluaran teks
00:05:47yang diberikan Claude kepada kita dan berharap itu berhasil? Atau apakah kita pada dasarnya harus menulis ulang semuanya?
00:05:52Dan bagaimana cara kita menulis ulangnya? Karena Anda tidak dapat menggunakan Claude untuk menulis ulang kalimat apa pun ini,
00:05:56karena itu akan diberi tanda air. Dan Anda juga tidak bisa menggunakan ChatGPT. Anda juga tidak bisa menggunakan Gemini.
00:06:01Jadi pilihan Anda menjadi sangat jelas. Anda perlu menulis ulang sebagian besar teks tersebut sambil
00:06:09mempertahankan nuansa keseluruhannya. Dan Anda perlu menggunakan XAI. Jadi Anda harus menggunakan Grok atau yang
00:06:16kemungkinan besar akan Anda lakukan adalah menggunakan semacam model sumber terbuka, benar? Semacam model Tiongkok
00:06:21yang dapat Anda unduh dan jalankan di komputer Anda yang A akan gratis dan B tidak tunduk pada
00:06:28undang-undang penandaan air ini. Sekarang, seperti apa sistem itu dalam arti praktis? Nah, Anda melakukan semua
00:06:33keluaran normal Anda dengan Claude. Dan jika Anda telah membuat sesuatu, anggap saja postingan blog yang panjang, dan Anda
00:06:37tidak ingin itu ditandai dengan tanda air, kita akan mengambil keluaran tersebut. Anda kemudian akan mengirimkannya
00:06:42ke semacam model lokal. Dan Claude dapat melakukannya untuk Anda. Ada banyak sekali model lokal yang sangat bagus
00:06:47di luar sana yang dapat Anda unduh melalui OLLAMA. Model lokal itu akan melanjutkan dan melakukan tugasnya.
00:06:51Ia akan menulis ulang teks tersebut. Anda akan memberinya perintah yang mengatakan, “Hei, saya ingin kamu,
00:06:55tahu, mempertahankan nuansa asli dari ini. Anda dapat menyisipkan catatan suara Anda sendiri, apa pun.” Dan kemudian begitu
00:07:01selesai, ia akan mengirimkan respons persisnya kata per kata kembali ke Claude. Dan Anda dapat melakukan
00:07:05apa pun yang Anda inginkan dengan itu pada saat itu. Sekarang, satu variabel lain yang perlu Anda pikirkan dalam semua ini
00:07:09adalah panjang keluaran Anda. Seperti berapa banyak token yang kita bicarakan? Karena, dan ini bukan
00:07:14angka yang sebenarnya dapat kita ketahui, adalah berapa banyak token, berapa panjang keluaran ini
00:07:19agar API deteksi, jika dijalankan, dapat mengatakan dengan tingkat keyakinan tertentu bahwa itu ditulis dengan AI.
00:07:25Karena jika saya hanya menulis komentar LinkedIn yang hanya bertuliskan, “Dia cantik,” dapatkah API benar-benar mengetahui
00:07:31apakah itu ditulis dengan Claude atau tidak? Tidak. Jadi jika Anda seseorang yang sangat takut jika hal-hal
00:07:37diberi tanda air dan diatribusikan ke Claude, yah, tanyakan saja pada diri sendiri, “Apakah saya menulis hal-hal yang cukup panjang
00:07:41hingga itu penting?” Jika kita berbicara seperti postingan LinkedIn, komentar di bawah, Anda tahu,
00:07:46sekitar 100 kata, mungkin tidak. Tetapi jika kita berbicara seperti postingan blog raksasa yang panjangnya ribuan kata,
00:07:51ya, Anda akan terkena tanda air tersebut. Dan itu akan sangat jelas bahwa
00:07:56itu ditulis dengan Claude. Sekarang, cara termudah untuk menyiapkan semua ini adalah dengan mengunduh Ollama,
00:08:00mengunduh model lokal yang masuk akal untuk perangkat keras Anda, lalu membuat keterampilan di dalam
00:08:05Claude sehingga saat Anda memanggilnya, ia mengirimkan keluaran Anda ke model lokal tersebut, melakukan penulisan ulang secara menyeluruh,
00:08:10dan kemudian mengembalikannya. Untuk mempermudah Anda, saya telah membuat seluruh perintah yang memandu Anda
00:08:15dan Claude melalui seluruh proses. Anda cukup menyalin dan menempelkan ini ke Claude. Ia akan melakukan beberapa
00:08:20penelitian pada perangkat keras Anda. Ia akan mencari tahu model lokal apa yang masuk akal untuk Anda. Ia akan
00:08:24mengunduh dan menginstal Ollama jika Anda belum melakukannya. Ia kemudian akan membuat keterampilan untuk Anda,
00:08:28dan ia akan menanyakan pertanyaan kepada Anda sehingga Anda bisa mendapatkan diksi aktual dari bagaimana bentuk penulisan ulang tersebut.
00:08:35Pada dasarnya menyuntikkan suara Anda, memberikan contoh, dan semacamnya. Jadi saya akan menaruh tautan di bawah ini
00:08:40untuk benar-benar melakukan ini. Dan daripada memandu Anda melalui seluruh hal ini langkah demi langkah untuk
00:08:4410 menit ke depan, jalankan saja perintah ini dan perintah itu akan melakukannya untuk Anda. Jadi mudah-mudahan seluruh penjelasan
00:08:48untuk penandaan air tadi masuk akal. Ini bukan tanda air yang sebenarnya. Tidak ada yang tertulis di balik
00:08:53layar. Tidak ada kode di sana. Hanya saja kata-kata tertentu akan lebih sering digunakan.
00:08:57Anda sama sekali tidak akan tahu apa kata-kata khusus itu. Satu-satunya cara Anda dapat mengetahuinya adalah jika Anda memiliki
00:09:02kunci untuk tanda air tersebut, yang tidak akan Anda miliki kecuali Anda adalah semacam regulator. Jadi siapa pun yang
00:09:07berkata kepada Anda bahwa mereka dapat mengetahui apakah itu bertanda air pada dasarnya sedang berbohong kepada Anda. Jadi ketahuilah itu segera.
00:09:11Dan berdasarkan cara kerja ini, sekali lagi, Anda dapat mendalami makalah DeepMind tersebut jika Anda mau. Satu-satunya cara
00:09:16Anda akan dapat menghindari ini adalah dengan penyuntingan berat. Ini bukan suntingan ringan. Anda harus
00:09:20menulis ulang semuanya. Dan satu-satunya cara Anda dapat melakukannya adalah dengan model sumber terbuka.
00:09:24Dan itu akan menjadi cara termurah. Jadi jika Anda ingin mendapatkan perintah tersebut,
00:09:29Anda dapat menemukannya di bawah. Semoga ini membantu beberapa dari Anda. Sejujurnya,
00:09:33menurut saya semuanya agak berlebihan dalam hal, Anda tahu, hal-hal yang diberi tanda air
00:09:38semacam itu. Kebanyakan orang yang Anda lihat menggunakan AI untuk melakukan penulisan mereka, sudah sangat jelas
00:09:43bahwa itu adalah AI karena mereka benar-benar tidak tahu bagaimana memanusiakannya atau membuatnya terdengar seperti gaya mereka sendiri.
00:09:49Dan kecuali kita masuk ke tempat di mana, Anda tahu, di mana pun Anda memposting,
00:09:52setiap situs web tunggal memiliki semacam pendeteksi tanda air dan itu menjadi kesalahan besar yang memalukan.
00:09:58Lagi pula, kita hanya perlu menjalankan ini melalui model lokal dan kamu akan aman.
00:10:02Jadi, beri tahu aku pendapatmu. Pastikan untuk mengecek Chase AI+ untuk mendapatkan
00:10:06Masterclass Cloud Code jika ini adalah hal yang ingin kamu pelajari lebih dalam.
00:10:10Selain itu, selamat bersenang-senang menghindari watermark ini.
Community Posts
No posts yet. Be the first to write about this video!
Write about this video