Arsip konten sosial

CrowdTangle sudah tiada. Kisah penggantinya adalah peringatan soal masa pakai alat

11 September 2026 · ThreadGrab

Sesekali muncul berita yang secara nama tentang produk orang lain, tetapi sebenarnya tentang risiko struktural. Berita pekan ini adalah laporan Nieman Lab pada 9 September 2026 tentang Arbiter, alat AI dari organisasi nirlaba SimPPL yang berupaya mengisi ruang yang ditinggalkan Meta saat menutup CrowdTangle pada 2024. Saya membaca seluruhnya dengan harapan mendapat profil produk yang lugas. Yang saya dapatkan adalah catatan jernih tentang berapa mahal biaya bergantung pada alat yang tidak Anda kendalikan.

Itulah benang yang ingin saya tarik, karena berlaku jauh melampaui jurnalisme. Siapa pun yang memantau, menangkap, atau mengutip konten sosial publik menghadapi risiko yang sama, dan industri ini telah menghabiskan tiga tahun terakhir membuktikannya berulang kali.

Apa itu CrowdTangle, dan apa penggantinya

CrowdTangle adalah alat yang digunakan jurnalis, pemeriksa fakta, dan peneliti selama lebih dari satu dekade untuk mengamati bagaimana konten menyebar di Facebook dan Instagram. Meta menarik investasinya secara perlahan, lalu mengumumkan pada Maret 2024 bahwa layanan itu akan berhenti beroperasi pada Agustus. Sebuah petisi yang ditandatangani lebih dari 100 kelompok pengawas memperingatkan, dalam kata-kata yang dikutip Nieman Lab, bahwa "hampir semua upaya luar untuk mengidentifikasi dan mencegah disinformasi politik, hasutan kekerasan, dan pelecehan daring terhadap perempuan dan minoritas akan dibungkam".

Meta memang merilis penerusnya: Meta Content Library, tersedia pada November 2023. Sambutannya paling baik disebut campuran. Nieman Lab mencatat alat ini dikritik karena membatasi akses jurnalis dan menghapus wawasan otomatis serta pencarian canggih yang membuat CrowdTangle berguna. Duuya Baatar, salah satu pendiri Nest Center di Ulaanbaatar, merangkum perbedaannya secara gamblang untuk laporan itu: jika Anda ingin melihat kiriman atau narasi tertentu, Meta Content Library memadai; jika Anda ingin menganalisis bagaimana ekosistem informasi berubah, alat itu sama sekali tidak mendekati CrowdTangle.

Celah itulah yang disasar Arbiter, dan bentuk alatnya layak dipahami karena menunjukkan di mana bagian sulitnya berada:

DimensiCrowdTangle (berakhir 2024)Meta Content LibraryArbiter (SimPPL)
Cakupan platformFacebook, InstagramHanya produk MetaFacebook, Instagram, X, YouTube, TikTok, Reddit, Bluesky, 4chan
KekuatanVolume dan pelacakan penyebaranKiriman dan akun tertentu, dengan akses volume lebih dalamGaris tren dan narasi yang muncul lintas platform
PendekatanData dari platformData platform, akses dibatasiAPI, basis akademik, dan penyedia scraping pihak ketiga
Biaya untuk ruang redaksiGratisBergantung pada persetujuan aksesGratis selama organisasi masih menguji
PengelolaMetaMetaSimPPL, nirlaba 501(c)(3) Amerika Serikat yang didirikan 2021

Mengapa pendirinya membangun secara independen, dalam kata-katanya sendiri

Inilah bagian yang seharusnya menarik bagi siapa pun yang pernah membangun alur kerja di atas akses data milik orang lain. Swapneel Mehta, salah satu pendiri dan presiden SimPPL, menjelaskan alasannya kepada Nieman Lab, dan itu adalah batasan desain yang dinyatakan terang-terangan:

"CrowdTangle bukan layanan yang diwajibkan atau diatur untuk terus ditawarkan pada titik mana pun. Platform bisa memutuskan bahwa ini bukan nilai tambah bersih lalu berhenti menawarkannya."

Ia melanjutkan dengan posisi yang ingin dibangunnya: "Ini adalah percakapan publik, dan mengumpulkan percakapan publik demi kepentingan publik seharusnya tidak ilegal."

Ada kutipan kedua yang menunjukkan bagaimana alurnya benar-benar bekerja saat menanggung beban, dan jujur saja tidak glamor soal peran AI:

"Siapa pun yang pernah menangani lebih dari 100.000 keping data tahu bahwa melemparkannya dulu ke LLM akan meledakkan tagihan kartu kredit lalu memberi keluaran sampah yang tidak bisa Anda kendalikan."

Jawaban Arbiter bukan satu model, melainkan delapan sampai sepuluh model, masing-masing mengerjakan tugas berbeda: mengodekan kueri, mengambil kiriman yang tepat, mengidentifikasi jaringan terkoordinasi, mengukur kemiripan semantik, memetakan jaringan. Sebagian lapisan tidak bergantung pada model tertentu, dan ruang redaksi bisa memakai penyedia LLM pilihan mereka. Itu arsitektur yang masuk akal, sekaligus pengingat bahwa "kami menambahkan AI" tidak sama dengan "kami menyelesaikan pengambilan data".

Bagian yang tidak nyaman: aksesnya dipinjam

Bahkan alat independen yang dibangun dengan baik berada di hilir platform. Arbiter melewati proses peninjauan berbulan-bulan untuk mendapat akses API ke Facebook dan Instagram, dan tetap tunduk pada pembatasan laju Meta: dengan API saja, alat itu hanya bisa menarik sejumlah kiriman pada satu waktu. Untuk memperlebar celah itu, Mehta menggambarkan kerja sama dengan penyedia data pihak ketiga yang memiliki perjanjian vendor, mengidentifikasi pengecualian untuk mengumpulkan data publik tanpa melanggar ketentuan layanan, dan mengandalkan donasi data dari akademisi serta organisasi masyarakat sipil.

Ia juga tidak meromantisasi pengaturan itu. Mehta mengatakan kepada Nieman Lab bahwa proses semacam ini sering dimulai dengan baik karena organisasi kecil tidak tampak sebagai kekhawatiran bagi manajemen, dan bahwa "saat Anda tumbuh, jenis pekerjaan yang Anda lakukan berubah". Timnya memakai pengacara untuk meninjau celah hukum dari solusi API mereka, yang merupakan kewaspadaan wajar mengingat sejarahnya: X menggugat Center for Countering Digital Hate pada 2023 atas dugaan scraping dan penggunaan alat pemantau pihak ketiga, kasus yang kemudian dibatalkan.

Pola yang perlu diperhatikan: alat berusia satu dekade yang dianggap infrastruktur oleh ruang redaksi dihentikan sesuai jadwal vendor, pengganti resminya menyempitkan akses, dan penerus independennya berjalan di atas campuran API, perjanjian vendor, dan data hasil scraping yang oleh pendirinya sendiri digambarkan sebagai sesuatu yang tidak bisa ia andalkan. Tidak satu pun dari itu kritik terhadap Arbiter. Itu deskripsi tentang medannya.

Laporan Inggris mengatakan terang-terangan apa yang biasanya hanya dibisikkan

Dua hari sebelum tulisan Nieman Lab, Tech Policy Press menerbitkan esai pada 8 September 2026 yang terkait laporan Gugus Tugas Akses Data Platform Sosial Inggris. Esai itu menyebut kondisinya secara langsung, menggambarkan apa yang disebutnya lingkungan pasca-API dan ketidaksesuaian yang tumbuh antara permintaan bukti independen tentang platform dan jalur yang tersedia untuk menghasilkannya. Esai yang sama mencatat urutan waktunya: X menarik API riset gratis untuk akademisi pada 2023, dan Meta menutup CrowdTangle pada tahun berikutnya.

Kesimpulannya adalah yang layak dibawa terus oleh siapa pun yang mengarsipkan konten sosial, apa pun profesinya:

"Pengambilan data dengan scraping sudah menjadi metode riset yang mapan dan tetap menjadi salah satu dari sedikit cara peneliti dapat mengumpulkan data platform yang dapat diakses publik secara independen."

Bacalah itu bersamaan dengan laporan Nieman Lab dan Anda mendapat gambaran yang koheren. Pintu resminya sudah menyempit. Pintu yang tersisa — scraping, perjanjian vendor, donasi data, penyedia pihak ketiga — adalah yang menjadi sandaran semua orang, dan justru itu yang paling banyak membawa ketidakpastian hukum dan teknis.

Jadi apa yang sebaiknya dilakukan pengarsip secara berbeda?

Tidak ada dalam kisah ini yang mengubah fakta bahwa alat pemantauan berguna. Kemampuan Arbiter menandai narasi yang muncul berminggu-minggu lebih awal benar-benar bernilai: laporan itu menceritakan sebuah ruang redaksi Mongolia yang memakainya untuk mengenali akun yang mendorong pembingkaian "pencemaran nama baik dan fitnah" atas proses parlemen sebelum gugus kerja diumumkan. Itu sinyal nyata.

Pelajaran itu soal lapisan mana yang Anda perlakukan sebagai tahan lama. Secara konkret:

  1. Pisahkan penemuan dari catatan. Tugas alat pemantauan adalah memberi tahu Anda bahwa sesuatu sedang terjadi. Tugas arsip Anda adalah menyimpan apa yang benar-benar dikatakan. Keduanya sistem berbeda dengan masa pakai berbeda, dan hanya satu yang berada di bawah kendali Anda.
  2. Simpan teks kirimannya, bukan hanya penunjuknya. Hasil pencarian yang disimpan atau tautan permanen adalah referensi ke dalam sistem orang lain. Kata-katanya, penulisnya, dan stempel waktunya adalah buktinya.
  3. Anggap setiap jalur akses bisa ditutup. CrowdTangle menanggung beban selama lebih dari satu dekade lalu ditutup. API riset gratis ditutup. Pembatasan laju diperketat. Tidak satu pun diumumkan sebagai bencana; itu hanya keputusan yang dibuat orang lain.
  4. Jaga arsip tetap portabel. Berkas dalam format yang bisa Anda baca tanpa dasbor vendor adalah pembeda antara catatan yang Anda miliki dan catatan yang aksesnya Anda pinjam.
  5. Verifikasi ulang sebelum mengutip. Jika kutipan bergantung pada token, nama pengguna, atau alat yang ada saat Anda menangkapnya, pastikan hal itu masih mengarah ke tempat yang Anda gambarkan.

Sebuah skrip kecil menangkap perbedaannya lebih baik daripada prosa. ThreadGrab menyajikan profil publik sebagai JSON, yang bisa Anda ratakan menjadi Markdown yang bertahan melampaui alat yang menemukannya:

# Capture the posts themselves, not a pointer to a dashboard
curl -s https://threadgrab.com/api/profile/USERNAME \
  -H "Accept: application/json" \
  | jq -r '.posts[] | "## " + .created_at + "\n\n" + .text + "\n\nsource: " + .url + "\n"' \
  > archive/public-thread-USERNAME.md

# Record the observation date, so the capture is a dated claim
date -u +"captured_at: %Y-%m-%dT%H:%M:%SZ" \
  >> archive/public-thread-USERNAME.md

Perintah kedua lebih penting daripada kelihatannya. Berkas yang mencatat kapan ia ditangkap adalah pernyataan tentang satu momen. Berkas yang tidak mencatatnya adalah klaim tentang masa kini yang kedaluwarsa tanpa suara.

Dan jika Anda sudah punya folder berisi arsip yang asal-usulnya tidak Anda yakini, pemeriksaan ini menemukan yang sepenuhnya bergantung pada layanan eksternal yang aktif:

# List captures that store only a link and no post text of their own
for f in archive/*.md; do
  if ! grep -q '^## ' "$f"; then
    echo "pointer-only capture: $f"
  fi
done

# Anything printed above depends on a service staying up.
# Re-fetch each one and store the post text alongside the link.

Yang perlu diperhatikan selanjutnya

Keterbatasan artikel ini

Pertanyaan yang sering diajukan

Apa yang menggantikan CrowdTangle setelah Meta menutupnya?

Pengganti resmi dari Meta adalah Meta Content Library, dirilis pada November 2023. Alat ini dikritik karena membatasi akses jurnalis dan menghapus wawasan otomatis serta pencarian canggih yang dimiliki CrowdTangle. Secara independen, organisasi nirlaba SimPPL membangun Arbiter, alat AI yang menarik unggahan dari Facebook, Instagram, X, YouTube, TikTok, Reddit, Bluesky, dan 4chan. Nieman Lab melaporkan pada 9 September 2026 bahwa Arbiter mulai menerima ruang redaksi tahun ini, termasuk Deutsche Welle, Chequeado, dan Rappler, dengan pengguna dari lebih dari 100 organisasi yang terdaftar.

Apakah Arbiter sepenuhnya menggantikan CrowdTangle?

Tidak, dan para penggunanya sendiri mengatakan hal itu. Duuya Baatar dari Nest Center di Mongolia mengatakan kepada Nieman Lab bahwa satu-satunya kekhawatiran yang ia dengar dari timnya adalah volume konten yang benar-benar bisa diambil Arbiter dari sumbernya. Ia menggambarkan kombinasi praktisnya sebagai Meta Content Library ditambah Arbiter yang mendekati CrowdTangle, bukan salah satunya menggantikan sendiri. Arbiter lebih kuat pada garis tren dan narasi yang sedang muncul lintas platform; akses langsung ke platform lebih kuat pada volume dan pemantauan akun tertentu.

Mengapa peneliti menyebut ini lingkungan pasca-API?

Karena jalur resmi menuju data platform telah menyempit berulang kali. Tech Policy Press, pada 8 September 2026, saat membahas laporan Gugus Tugas Akses Data Platform Sosial Inggris, menggambarkan ketidaksesuaian yang tumbuh antara permintaan bukti independen tentang platform dan jalur yang tersedia untuk menghasilkannya. Tulisan yang sama mencatat bahwa X menarik API riset gratis untuk akademisi pada 2023, dan Meta menutup CrowdTangle pada tahun berikutnya. Pengambilan data dengan scraping dijelaskan dalam laporan itu sebagai metode riset yang sudah mapan dan salah satu dari sedikit cara yang tersisa untuk mengumpulkan data platform yang dapat diakses publik secara independen.

Apakah Arbiter melakukan scraping langsung ke platform?

Sebagian. Nieman Lab melaporkan bahwa Arbiter mengumpulkan data dari API media sosial, basis data akademik, dan perusahaan scraping pihak ketiga. Alat ini melewati proses peninjauan berbulan-bulan untuk mendapatkan akses API ke platform besar termasuk Facebook dan Instagram, dan tetap tunduk pada pembatasan laju dari Meta. Untuk memperluas akses itu, salah satu pendiri Swapneel Mehta mengatakan ia bekerja dengan penyedia pihak ketiga yang memiliki perjanjian vendor, mengidentifikasi pengecualian untuk mengumpulkan data publik tanpa melanggar ketentuan layanan, dan mengandalkan donasi data dari akademisi serta organisasi masyarakat sipil.

Jika alat AI bisa memantau narasi untuk saya, mengapa masih perlu mengarsipkan sendiri?

Karena lapisan pemantauan dan catatannya adalah dua hal berbeda, dan lapisan pemantauan itulah yang terus berubah. CrowdTangle menjadi tulang punggung selama lebih dari satu dekade lalu berhenti disediakan. Pendiri Arbiter sendiri menyatakannya terus terang: platform bisa memutuskan bahwa sebuah alat bukan nilai tambah bersih lalu berhenti menawarkannya, dan itulah sebabnya ia membangun secara independen. Alat memberi tahu Anda apa yang sedang tren sekarang. Berkas yang Anda kendalikan memberi tahu Anda apa yang benar-benar diposting seseorang, dalam kata-katanya sendiri, dengan stempel waktu yang bisa Anda kutip nanti, terlepas dari alat mana yang sedang populer tahun itu.

Apa inti praktisnya bagi orang yang mengarsipkan konten sosial?

Perlakukan alat platform dan arsip Anda sendiri sebagai dua lapisan terpisah dengan masa pakai berbeda. Gunakan permukaan pemantauan apa pun yang tersedia tahun ini untuk penemuan, dan simpan teks kiriman, URL sumber, dan stempel waktu dalam berkas Markdown portabel untuk apa pun yang mungkin perlu Anda kutip nanti. Alat itu dipinjamkan kepada Anda dan bisa ditarik kembali. Arsip dalam format yang Anda miliki adalah bagian yang bertahan setelah penarikan itu.

Verifikasi terakhir: 11 September 2026. Sumber utama: Nieman Lab, "Two years ago, Meta killed CrowdTangle. Can a new AI tool fill the void?" oleh Andrew Deck (9 September 2026); Tech Policy Press, "Why the UK Needs Better Social Media Data Access to Research Online Harms" (8 September 2026); halaman proyek SimPPL di simppl.org dan arbiter.simppl.org; serta liputan Nieman Lab 2024 tentang penutupan CrowdTangle. Semua kutipan bernama direproduksi dari liputan Nieman Lab dan esai Tech Policy Press di atas. Harga alat, ketentuan akses, dan ketersediaan API platform harus diperiksa ulang sebelum dijadikan dasar.

Simpan catatan yang tidak bergantung pada alat orang lain

ThreadGrab mengubah konten publik X, Bluesky, dan LinkedIn menjadi Markdown bersih dan berstempel waktu — agar percakapan yang penting tetap terbaca bahkan setelah alat pemantauan dihentikan.

Coba ThreadGrab →