Fable 5.1 Menandai SEMUA Hal dengan Watermark, Begini Cara Menghapusnya

CChase AI
Computing/SoftwareInternet Technology

Transcript

00:00:00Jadi kemarin, Anthropic meluncurkan Fable 5.1, dan ini adalah model pertama yang mereka keluarkan
00:00:04yang sekarang memberikan tanda air pada semua yang dibuatnya. Dan hari ini, saya akan menunjukkan cara menghilangkannya.
00:00:10Namun pertama-tama, mari kita bahas apa sebenarnya tanda air ini, karena agak keliru
00:00:14jika menyebutnya sebagai tanda air, mengapa hal ini ada sejak awal, dan bagaimana cara kerjanya.
00:00:19Karena jika Anda memahami hal-hal tersebut, solusi untuk mengatasi tanda air ini akan menjadi
00:00:23jauh lebih masuk akal. Sekarang, mengapa kita harus menghadapi ini sama sekali? Nah, ini karena
00:00:26ini mematuhi Undang-Undang AI Uni Eropa yang pada dasarnya telah ditandatangani oleh semua lab perintis utama
00:00:31dengan pengecualian XAI. Dan aturan ini menyatakan bahwa mereka perlu, yaitu pihak Uni Eropa,
00:00:38membutuhkan cara untuk dapat mengetahui apakah suatu teks atau keluaran tertentu dibuat oleh AI.
00:00:43Dan untuk melakukan ini, Anthropic telah menambahkan tanda air ke semua keluarannya untuk model yang dirilis
00:00:50setelah 2 Agustus 2026, yang tidak lain adalah Fable 5.1. Sekarang, Anthropic mengklaim ini tidak memiliki
00:00:56efek praktis pada keluaran aktual yang diberikan kepada Anda, dan bahwa ini sangat terbatas dalam hal apa
00:00:59yang akan diubah jika kita berbicara tentang kode. Tapi bagaimana benda ini benar-benar bekerja? Dan mengapa
00:01:03saya menyebutnya istilah yang keliru sejak awal? Sekarang, strategi Anthropic untuk menyuntikkan tanda air ini
00:01:07ke dalam keluarannya didasarkan pada makalah yang dirilis dari Google pada tahun 2024 berjudul Watermarking Skalabel
00:01:13untuk Mengidentifikasi Keluaran Model Bahasa Besar. Sekarang, ini adalah makalah yang relatif teknis. Ini membahas
00:01:19penandaan air berbasis turnamen SynthID. Tapi izinkan saya memberi Anda model mental sederhana untuk Anda pahami.
00:01:25Sekarang, seperti yang Anda tahu, model bahasa besar dan keluarannya didasarkan pada probabilitas dan ada
00:01:29sejumlah keacakan yang terlibat. Jika saya memberikan kalimat yang berbunyi, dia adalah titik-titik dan perlu
00:01:34mengisinya, yah, ia akan memiliki daftar kata yang mungkin dapat digunakannya untuk menyelesaikan kalimat itu.
00:01:41Dan katakanlah kata-kata itu adalah cantik, menawan, memukau, dan manis. Sekarang, pada kenyataannya,
00:01:48masing-masing kata ini akan memiliki persentase yang berbeda atau probabilitas yang berbeda yang terkait dengannya dalam hal
00:01:54apa yang akan dipilih oleh model bahasa besar. Istilah yang sering Anda dengar disebut softmax, tetapi Anda hanya perlu
00:01:58untuk memahami bahwa semua kata ini memiliki probabilitas yang terkait dengannya mengenai mana yang akan
00:02:04Untuk latihan mental ini, saya ingin Anda membayangkan semuanya memiliki
00:02:08persentase yang sama persis, benar? Jadi masing-masing kata ini untuk menyelesaikan kalimat memiliki peluang 25%
00:02:14untuk dipilih. Sekarang, biasanya sebelum penandaan air mulai berlaku, ia akan memilih salah satu dari ini.
00:02:20Dan katakanlah ia melempar dadu bersisi empat dan memilih kata cantik. Keren, kan? Peluangnya 25%,
00:02:26semua ini memiliki peluang yang sama untuk dipilih. Tapi sekarang kita bekerja dalam sistem yang berbeda dan sistem itu
00:02:31adalah sistem penandaan air. Dengan sistem penandaan air, kita masih bisa berada di tempat yang sama di mana saya katakan,
00:02:38hei, saya ingin kamu melengkapi kalimat, dia adalah titik-titik, dan kamu memiliki empat pilihan, benar? Dan katakanlah,
00:02:42sekali lagi, itu adalah keempat kata ini dan mereka memiliki probabilitas yang sama. Ketika kita menambahkan konstruksi penandaan air,
00:02:49yang akan dilakukannya adalah pada dasarnya ia akan memuat dadu ini. Jika ini adalah semacam
00:02:54dadu bersisi empat, yah, ia kemudian akan berkata, hmm, untuk tujuan penandaan air, kata cantik sekarang akan
00:03:01menjadi 50% dan memukau akan menjadi 30%. Jadi ketika kita menambahkan semacam sistem penandaan air,
00:03:10ia akan memilih kata-kata tertentu dan memberikan bobot yang lebih berat padanya. Dan karena kata-kata tertentu lebih
00:03:15berat bobotnya ketika model bahasa besar memilihnya, yah, kata-kata itu akan muncul
00:03:19lebih sering, benar? Menggunakan sistem penandaan air, kemungkinan besar ia akan mengatakan dia adalah
00:03:25cantik. Sekarang, Anda sebagai pengguna akhir tidak tahu apa kata-kata ini dan kata mana yang diberi bobot
00:03:32lebih berat. Tetapi seseorang yang memiliki kunci, kunci rahasia penandaan air dapat mengetahuinya. Sekarang,
00:03:40mereka tidak dapat mengetahuinya dengan kepastian mutlak karena seperti sebelumnya, Anda tahu, selalu ada kemungkinan
00:03:45ia akan mengatakan, Anda tahu, dia cantik. Anda tidak tahu apakah itu tentu saja memiliki peluang lebih tinggi
00:03:49karena penandaan air. Tetapi seseorang dengan kunci tersebut akan tahu kata mana yang diberi bobot
00:03:55lebih berat. Dan itu kemudian akan memberi mereka semacam probabilitas yang memberi tahu pengguna yang memiliki
00:04:01kunci tersebut, yaitu regulator Eropa, oke, ada peluang 90% bahwa teks ini, peluang 100%, peluang 99% bahwa teks ini
00:04:09ditulis dengan Claude, atau teks ini ditulis dengan AI. Begitulah cara kerjanya. Sekarang,
00:04:15gagasannya di sini adalah bahwa kata-kata yang dipilih untuk diubah dan diberi bobot lebih berat dengan penandaan air
00:04:20tidak akan mengubah arti keseluruhan kalimat. Itu tidak akan mengubah keluaran Anda.
00:04:24Itu tidak akan mengubah kinerja Anda. Dan ketika kita berbicara tentang kode khususnya, itu tidak akan mengubah
00:04:28kode jika itu akan memengaruhi tampilan keluaran nantinya. Dan itu tidak akan mengubah fakta.
00:04:34Anda tahu, jika dikatakan, hei, peristiwa sejarah ini, Anda tahu, terjadi pada, Anda tahu, 810. Nah,
00:04:41itu tidak akan mengubah kata-kata itu, benar? Itu adalah fakta. Peristiwa itu terjadi pada 810. Itu tidak akan
00:04:45diubah. Tapi itu adalah penjelasan yang disederhanakan, sekali lagi, penjelasan yang disederhanakan tentang cara kerja sistem ini.
00:04:52Sekarang, Anthropic belum sepenuhnya mempublikasikan algoritma persis untuk cara kerjanya, tetapi kita dapat
00:04:57mengekstrapolasi hal tersebut dari makalah DeepMind. Dan apa yang juga harus Anda pahami dari hal tersebut adalah
00:05:02memiliki kunci ini adalah satu-satunya cara untuk mengetahui apakah itu ditulis oleh AI berdasarkan sistem penandaan air.
00:05:08Dan kunci ini tidak bersifat publik. Untuk mendapatkan akses ke kunci tersebut, Anda harus meminta akses. Tidak ada daftar publik.
00:05:12Anda mungkin harus menjadi semacam regulator Uni Eropa. Jadi siapa pun di luar sana yang mengatakan,
00:05:16oh, hei, ini situs web saya yang dapat mendeteksi apakah itu bertanda air atau tidak, itu adalah kebohongan karena hal ini tidak
00:05:21ada. Sekarang, jika Anda ingin mendalami cara kerja tanda air teks, Anthropic juga memiliki artikel mereka sendiri.
00:05:25Dan mereka benar-benar mencoba menegaskan bahwa ini tidak akan memengaruhi keluaran.
00:05:29Jadi sistem penandaan air, pada intinya, adalah tentang kata-kata tertentu yang dipilih lebih sering daripada yang lain.
00:05:35Dan ini adalah algoritma statistik yang tidak akan pernah dapat Anda ketahui oleh Anda, pengguna akhir, kecuali
00:05:40Anda memiliki kuncinya. Lantas bagaimana cara kita mengatasinya? Apakah kita cukup melakukan penyuntingan ringan pada keluaran teks
00:05:47yang diberikan Claude kepada kita dan berharap itu berhasil? Atau apakah kita pada dasarnya harus menulis ulang semuanya?
00:05:52Dan bagaimana cara kita menulis ulangnya? Karena Anda tidak dapat menggunakan Claude untuk menulis ulang kalimat apa pun ini,
00:05:56karena itu akan diberi tanda air. Dan Anda juga tidak bisa menggunakan ChatGPT. Anda juga tidak bisa menggunakan Gemini.
00:06:01Jadi pilihan Anda menjadi sangat jelas. Anda perlu menulis ulang sebagian besar teks tersebut sambil
00:06:09mempertahankan nuansa keseluruhannya. Dan Anda perlu menggunakan XAI. Jadi Anda harus menggunakan Grok atau yang
00:06:16kemungkinan besar akan Anda lakukan adalah menggunakan semacam model sumber terbuka, benar? Semacam model Tiongkok
00:06:21yang dapat Anda unduh dan jalankan di komputer Anda yang A akan gratis dan B tidak tunduk pada
00:06:28undang-undang penandaan air ini. Sekarang, seperti apa sistem itu dalam arti praktis? Nah, Anda melakukan semua
00:06:33keluaran normal Anda dengan Claude. Dan jika Anda telah membuat sesuatu, anggap saja postingan blog yang panjang, dan Anda
00:06:37tidak ingin itu ditandai dengan tanda air, kita akan mengambil keluaran tersebut. Anda kemudian akan mengirimkannya
00:06:42ke semacam model lokal. Dan Claude dapat melakukannya untuk Anda. Ada banyak sekali model lokal yang sangat bagus
00:06:47di luar sana yang dapat Anda unduh melalui OLLAMA. Model lokal itu akan melanjutkan dan melakukan tugasnya.
00:06:51Ia akan menulis ulang teks tersebut. Anda akan memberinya perintah yang mengatakan, “Hei, saya ingin kamu,
00:06:55tahu, mempertahankan nuansa asli dari ini. Anda dapat menyisipkan catatan suara Anda sendiri, apa pun.” Dan kemudian begitu
00:07:01selesai, ia akan mengirimkan respons persisnya kata per kata kembali ke Claude. Dan Anda dapat melakukan
00:07:05apa pun yang Anda inginkan dengan itu pada saat itu. Sekarang, satu variabel lain yang perlu Anda pikirkan dalam semua ini
00:07:09adalah panjang keluaran Anda. Seperti berapa banyak token yang kita bicarakan? Karena, dan ini bukan
00:07:14angka yang sebenarnya dapat kita ketahui, adalah berapa banyak token, berapa panjang keluaran ini
00:07:19agar API deteksi, jika dijalankan, dapat mengatakan dengan tingkat keyakinan tertentu bahwa itu ditulis dengan AI.
00:07:25Karena jika saya hanya menulis komentar LinkedIn yang hanya bertuliskan, “Dia cantik,” dapatkah API benar-benar mengetahui
00:07:31apakah itu ditulis dengan Claude atau tidak? Tidak. Jadi jika Anda seseorang yang sangat takut jika hal-hal
00:07:37diberi tanda air dan diatribusikan ke Claude, yah, tanyakan saja pada diri sendiri, “Apakah saya menulis hal-hal yang cukup panjang
00:07:41hingga itu penting?” Jika kita berbicara seperti postingan LinkedIn, komentar di bawah, Anda tahu,
00:07:46sekitar 100 kata, mungkin tidak. Tetapi jika kita berbicara seperti postingan blog raksasa yang panjangnya ribuan kata,
00:07:51ya, Anda akan terkena tanda air tersebut. Dan itu akan sangat jelas bahwa
00:07:56itu ditulis dengan Claude. Sekarang, cara termudah untuk menyiapkan semua ini adalah dengan mengunduh Ollama,
00:08:00mengunduh model lokal yang masuk akal untuk perangkat keras Anda, lalu membuat keterampilan di dalam
00:08:05Claude sehingga saat Anda memanggilnya, ia mengirimkan keluaran Anda ke model lokal tersebut, melakukan penulisan ulang secara menyeluruh,
00:08:10dan kemudian mengembalikannya. Untuk mempermudah Anda, saya telah membuat seluruh perintah yang memandu Anda
00:08:15dan Claude melalui seluruh proses. Anda cukup menyalin dan menempelkan ini ke Claude. Ia akan melakukan beberapa
00:08:20penelitian pada perangkat keras Anda. Ia akan mencari tahu model lokal apa yang masuk akal untuk Anda. Ia akan
00:08:24mengunduh dan menginstal Ollama jika Anda belum melakukannya. Ia kemudian akan membuat keterampilan untuk Anda,
00:08:28dan ia akan menanyakan pertanyaan kepada Anda sehingga Anda bisa mendapatkan diksi aktual dari bagaimana bentuk penulisan ulang tersebut.
00:08:35Pada dasarnya menyuntikkan suara Anda, memberikan contoh, dan semacamnya. Jadi saya akan menaruh tautan di bawah ini
00:08:40untuk benar-benar melakukan ini. Dan daripada memandu Anda melalui seluruh hal ini langkah demi langkah untuk
00:08:4410 menit ke depan, jalankan saja perintah ini dan perintah itu akan melakukannya untuk Anda. Jadi mudah-mudahan seluruh penjelasan
00:08:48untuk penandaan air tadi masuk akal. Ini bukan tanda air yang sebenarnya. Tidak ada yang tertulis di balik
00:08:53layar. Tidak ada kode di sana. Hanya saja kata-kata tertentu akan lebih sering digunakan.
00:08:57Anda sama sekali tidak akan tahu apa kata-kata khusus itu. Satu-satunya cara Anda dapat mengetahuinya adalah jika Anda memiliki
00:09:02kunci untuk tanda air tersebut, yang tidak akan Anda miliki kecuali Anda adalah semacam regulator. Jadi siapa pun yang
00:09:07berkata kepada Anda bahwa mereka dapat mengetahui apakah itu bertanda air pada dasarnya sedang berbohong kepada Anda. Jadi ketahuilah itu segera.
00:09:11Dan berdasarkan cara kerja ini, sekali lagi, Anda dapat mendalami makalah DeepMind tersebut jika Anda mau. Satu-satunya cara
00:09:16Anda akan dapat menghindari ini adalah dengan penyuntingan berat. Ini bukan suntingan ringan. Anda harus
00:09:20menulis ulang semuanya. Dan satu-satunya cara Anda dapat melakukannya adalah dengan model sumber terbuka.
00:09:24Dan itu akan menjadi cara termurah. Jadi jika Anda ingin mendapatkan perintah tersebut,
00:09:29Anda dapat menemukannya di bawah. Semoga ini membantu beberapa dari Anda. Sejujurnya,
00:09:33menurut saya semuanya agak berlebihan dalam hal, Anda tahu, hal-hal yang diberi tanda air
00:09:38semacam itu. Kebanyakan orang yang Anda lihat menggunakan AI untuk melakukan penulisan mereka, sudah sangat jelas
00:09:43bahwa itu adalah AI karena mereka benar-benar tidak tahu bagaimana memanusiakannya atau membuatnya terdengar seperti gaya mereka sendiri.
00:09:49Dan kecuali kita masuk ke tempat di mana, Anda tahu, di mana pun Anda memposting,
00:09:52setiap situs web tunggal memiliki semacam pendeteksi tanda air dan itu menjadi kesalahan besar yang memalukan.
00:09:58Lagi pula, kita hanya perlu menjalankan ini melalui model lokal dan kamu akan aman.
00:10:02Jadi, beri tahu aku pendapatmu. Pastikan untuk mengecek Chase AI+ untuk mendapatkan
00:10:06Masterclass Cloud Code jika ini adalah hal yang ingin kamu pelajari lebih dalam.
00:10:10Selain itu, selamat bersenang-senang menghindari watermark ini.

Key Takeaway

Model Fable 5.1 dari Anthropic menyematkan tanda air berbasis probabilitas kata untuk mematuhi regulasi Uni Eropa, dan cara paling efektif untuk menghapusnya adalah dengan menulis ulang teks menggunakan model sumber terbuka lokal.

Highlights

  • Anthropic merilis Fable 5.1 pada 2 Agustus 2026, yang secara otomatis menyertakan tanda air pada semua teks buatannya.

  • Undang-Undang AI Uni Eropa mewajibkan lab perintis utama untuk menambahkan tanda air guna mendeteksi keluaran kecerdasan buatan.

  • Sistem tanda air bekerja dengan memodifikasi probabilitas pemilihan kata atau memuat dadu statistik agar kata tertentu muncul lebih sering.

  • Kunci rahasia untuk mendeteksi tanda air hanya dipegang oleh regulator Eropa, sehingga alat pendeteksi publik tidak dapat membuktikan keasliannya.

  • Model sumber terbuka yang dijalankan secara lokal melalui Ollama dapat menulis ulang teks Claude untuk menghapus tanda air sepenuhnya.

Timeline

Peluncuran Fable 5.1 dan Latar Belakang Regulasi

  • Anthropic meluncurkan model Fable 5.1 yang memberikan tanda air pada seluruh keluarannya.
  • Undang-Undang AI Uni Eropa mewajibkan adanya mekanisme identifikasi untuk keluaran kecerdasan buatan.
  • Aturan ini berlaku untuk semua model yang dirilis setelah 2 Agustus 2026.

Model terbaru dari Anthropic menandai semua keluaran teks demi mematuhi regulasi Uni Eropa yang mewajibkan pelacakan konten buatan mesin. Regulasi ini ditandatangani oleh seluruh lab perintis utama kecuali XAI. Anthropic mengklaim penambahan ini tidak berdampak praktis pada hasil aktual maupun kode.

Mekanisme Teknis Tanda Air Berbasis Probabilitas

  • Sistem penandaan air mengadopsi makalah Google tahun 2024 tentang penandaan air berskala.
  • Algoritma mengubah bobot probabilitas kata pilihan tanpa mengubah arti keseluruhan kalimat.
  • Hanya pihak yang memiliki kunci rahasia yang dapat mendeteksi tanda air tersebut.

Sistem ini bekerja dengan memanipulasi probabilitas pemilihan kata dalam model bahasa besar. Alih-alih memberikan peluang yang sama pada setiap sinonim, algoritma memberikan bobot lebih berat pada kata-kata tertentu. Pengguna akhir tidak mengetahui kata yang diberi bobot khusus, sementara regulator dengan kunci rahasia dapat menghitung probabilitas bahwa teks tersebut dibuat oleh Claude.

Keterbatasan Alat Pendeteksi dan Solusi Penghapusan Tanda Air

  • Kunci deteksi tanda air tidak bersifat publik dan hanya diakses oleh regulator.
  • Panjang teks menentukan tingkat keyakinan sistem deteksi dalam mengidentifikasi konten AI.
  • Penggunaan model sumber terbuka lokal melalui Ollama menjadi cara efektif untuk menulis ulang teks tanpa tanda air.

Situs web publik yang mengeklaim dapat mendeteksi tanda air dipastikan tidak akurat karena kunci rahasianya disembunyikan. Komentar pendek di bawah 100 kata sulit dideteksi, tetapi postingan blog panjang akan mudah dikenali. Solusi praktis untuk menghindari deteksi adalah menyalin hasil Claude, mengirimkannya ke model sumber terbuka lokal menggunakan Ollama, lalu menulis ulang teks tersebut dengan gaya personal.

Community Posts

No posts yet. Be the first to write about this video!

Write about this video