Table of Content

Menguji NotebookLM Merangkum 50 Jurnal Ilmiah, Apakah Lebih Akurat daripada ChatGPT?

Uji NotebookLM merangkum 50 jurnal ilmiah dari 5 bidang, dibandingkan ChatGPT. Cek hasil akurasi, halusinasi, dan siapa pemenangnya.
Menguji NotebookLM Merangkum 50 Jurnal Ilmiah

Membaca puluhan jurnal ilmiah sebelum menulis skripsi, tesis, laporan penelitian, atau artikel akademis adalah pekerjaan yang menguras waktu. Satu jurnal saja bisa memuat 15 sampai 20 halaman padat berisi istilah teknis, metodologi, dan data statistik. 

Ketika harus membaca 30, 40, bahkan 50 jurnal sekaligus, banyak mahasiswa dan peneliti akhirnya mencari jalan pintas: menggunakan AI untuk merangkum.

Dua nama yang paling sering disebut adalah NotebookLM dan ChatGPT. Keduanya sama-sama bisa membaca dokumen PDF dan mengeluarkan ringkasan dalam hitungan detik. 

Namun pertanyaan yang jarang dijawab dengan data adalah: mana yang benar-benar lebih akurat ketika dihadapkan pada jurnal ilmiah sungguhan, bukan sekadar artikel populer?

Untuk menjawabnya, Admin KhairPedia tidak hanya membandingkan fitur di atas kertas. Bahkan sampai menjalankan pengujian langsung terhadap 50 jurnal ilmiah dari lima bidang keilmuan berbeda, menggunakan prompt yang identik untuk kedua AI, lalu menilai hasilnya dengan parameter yang terukur. Berikut laporan lengkapnya.

Abstrak Pengujian

Tujuan: mengukur tingkat akurasi NotebookLM vs ChatGPT dalam merangkum jurnal ilmiah. 

Metode: pengujian komparatif dengan prompt identik terhadap 50 dokumen PDF jurnal ilmiah dari lima disiplin ilmu. 

Jumlah sampel: 50 jurnal (10 jurnal per bidang). 

Hasil utama: NotebookLM unggul dalam akurasi fakta dan minim halusinasi karena bekerja berbasis sumber (grounded), sementara ChatGPT unggul dalam kualitas penjelasan dan kemampuan mengembangkan ide dari ringkasan. 

Kesimpulan: pemilihan alat sebaiknya disesuaikan kebutuhan : analisis literatur vs pengembangan tulisan.


Metodologi Pengujian

Dataset

Total 50 jurnal ilmiah dibagi merata ke lima bidang untuk menghindari bias terhadap satu jenis gaya penulisan akademis:

BidangJumlah Jurnal
Kesehatan10
Teknik10
Pendidikan10
Ekonomi10
Teknologi Informasi10

Seluruh jurnal diambil dari repositori ilmiah dan jurnal akses terbuka (open access) agar proses pengunggahan ke kedua AI tidak melanggar hak cipta.

Format Dokumen

  • Format file: PDF
  • Bahasa: campuran Bahasa Indonesia dan Bahasa Inggris
  • Panjang dokumen: 8–35 halaman per jurnal
  • Total keseluruhan: sekitar 900–1.200 halaman

Prompt yang Digunakan

Agar perbandingan adil, NotebookLM dan ChatGPT diberi prompt yang benar-benar sama untuk setiap jurnal:

"Ringkas jurnal ini menjadi 300 kata. Jelaskan tujuan penelitian, metode yang digunakan, hasil utama, keterbatasan penelitian, serta simpulkan kontribusi penelitian ini terhadap bidang ilmunya."

Proses Pengujian

Setiap jurnal diuji satu per satu, bukan diunggah sekaligus dalam satu batch, dengan alur berikut:

  1. Satu file PDF jurnal diunggah ke NotebookLM, lalu prompt yang sama diberikan.
  2. File PDF yang sama diunggah ke ChatGPT sebagai sesi terpisah (chat baru), lalu diberi prompt identik agar tidak ada "bocoran" konteks dari sesi sebelumnya.
  3. Kedua hasil ringkasan disandingkan secara manual, dibandingkan kalimat per kalimat dengan bagian abstrak, hasil, dan simpulan pada jurnal asli.
  4. Setiap penyimpangan baik berupa angka yang salah, klaim yang tidak ada di sumber, maupun informasi yang hilang dicatat sebagai temuan untuk jurnal tersebut.
  5. Proses ini diulang untuk seluruh 50 jurnal, lalu hasilnya direkap ke dalam tabel skor per jurnal (lihat bagian Lampiran).

Parameter Penilaian dan Cara Skor Dihitung

Setiap ringkasan dinilai dengan enam parameter berbobot berikut:

ParameterBobot
Akurasi fakta30%
Kelengkapan informasi20%
Kemampuan memahami konteks20%
Risiko halusinasi15%
Kemudahan dipahami10%
Kecepatan5%

Tiap parameter diberi skor 1–5 secara manual untuk setiap jurnal, dengan acuan sebagai berikut: skor 5 diberikan jika ringkasan sepenuhnya konsisten dengan jurnal asli tanpa penyimpangan; skor turun setiap kali ditemukan penyimpangan (angka keliru, klaim tanpa dasar di sumber, atau bagian penting yang hilang). 

Skor akhir per aspek adalah rata-rata skor dari 50 jurnal, dikalikan bobot masing-masing parameter, lalu dijumlahkan menjadi skor komposit. Karena penilaian ini dilakukan manual oleh penguji (bukan otomatis), hasilnya tetap mengandung unsur subjektivitas dan dicatat sebagai salah satu keterbatasan pengujian di bagian akhir artikel.


Hasil Pengujian

Berikut ringkasan skor rata-rata dari seluruh 50 jurnal yang diuji:

AspekNotebookLMChatGPTPemenang
Akurasi⭐⭐⭐⭐⭐⭐⭐⭐⭐NotebookLM
Halusinasi (makin sedikit makin baik)⭐⭐⭐⭐⭐⭐⭐⭐NotebookLM
Membaca PDF panjang⭐⭐⭐⭐⭐⭐⭐⭐⭐NotebookLM
Kualitas penjelasan⭐⭐⭐⭐⭐⭐⭐⭐⭐ChatGPT
Kreativitas⭐⭐⭐⭐⭐⭐⭐⭐ChatGPT
Brainstorming lanjutan⭐⭐⭐⭐⭐⭐⭐⭐ChatGPT

Temuan Menarik

  • NotebookLM hampir selalu mengutip informasi yang benar-benar tercantum dalam dokumen yang diunggah, sehingga jarang "mengarang" data atau angka yang tidak ada di sumber aslinya.
  • ChatGPT lebih unggul saat diminta menyederhanakan bahasa akademis menjadi bahasa yang lebih mudah dipahami pembaca awam.
  • Untuk jurnal dengan panjang di atas 20 halaman, NotebookLM lebih konsisten menjaga alur konteks dari awal hingga akhir dokumen.
  • ChatGPT cenderung menambahkan interpretasi atau opini tambahan yang tidak selalu berasal dari isi jurnal berguna untuk diskusi, tapi berisiko untuk kutipan akademis yang butuh presisi tinggi.
  • Pada jurnal berbahasa Inggris dengan istilah teknis yang jarang, kedua AI sama-sama menunjukkan penurunan akurasi dibanding jurnal berbahasa Indonesia.

Mengapa NotebookLM Lebih Akurat?

Perbedaan akurasi ini bukan kebetulan, melainkan konsekuensi langsung dari cara kerja masing-masing sistem.

NotebookLM dibangun dengan pendekatan source grounding: setiap jawaban yang dihasilkan dibatasi hanya pada dokumen yang diunggah pengguna, mirip prinsip Retrieval-Augmented Generation (RAG). 

Alurnya sederhana : NotebookLM mencari bagian relevan di dalam PDF, lalu menyusun jawaban berdasarkan potongan teks tersebut, bahkan mencantumkan kutipan halaman sumber. Karena "ruang gerak" jawabannya dibatasi ketat pada dokumen, risiko mengarang informasi (halusinasi) jadi jauh lebih kecil.

ChatGPT, sebaliknya, dilatih dari data dalam jumlah masif dan tidak dibatasi hanya pada dokumen yang diunggah. 

Saat membaca PDF, ChatGPT tetap bisa "mencampur" pengetahuan umum dari data latihnya dengan isi dokumen, sehingga hasilnya lebih luwes dan mudah dipahami, tapi juga lebih rentan menambahkan detail atau interpretasi yang sebenarnya tidak tertulis di jurnal asli.

NotebookLM lebih "setia" pada sumber, ChatGPT lebih "kreatif" dalam mengolah sumber. Keduanya bukan soal salah satu lebih pintar, melainkan filosofi desain yang memang berbeda.


Kelebihan dan Kekurangan

NotebookLM

Kelebihan: akurasi tinggi karena berbasis sumber (grounded), minim halusinasi, mampu mengutip halaman sumber, cocok untuk dokumen panjang.

Kekurangan: kurang fleksibel untuk brainstorming, gaya bahasa ringkasan cenderung kaku, terbatas hanya pada dokumen yang diunggah.

ChatGPT

Kelebihan: penjelasan lebih natural dan komunikatif, mampu mengembangkan ide dari ringkasan, fleksibel untuk berbagai jenis pertanyaan lanjutan.

Kekurangan: risiko halusinasi lebih tinggi, terkadang menambahkan informasi yang tidak ada di jurnal asli, kurang konsisten pada dokumen yang sangat panjang.

Siapa yang Sebaiknya Menggunakan NotebookLM?

PenggunaRekomendasi
Mahasiswa⭐⭐⭐⭐⭐
Dosen⭐⭐⭐⭐⭐
Peneliti⭐⭐⭐⭐⭐
Blogger⭐⭐⭐⭐
Content Writer⭐⭐⭐⭐
Copywriter⭐⭐⭐
Programmer⭐⭐⭐

Jangan Terlalu Bergantung pada AI

Sebaik apa pun hasil pengujian ini, penting diingat bahwa NotebookLM maupun ChatGPT tetap alat bantu, bukan pengganti membaca kritis. Ringkasan AI meskipun hasilnya akurat 95%, tetap bisa kehilangan nuansa argumen yang hanya terlihat saat pembaca menelaah jurnal secara utuh. 

Untuk kebutuhan akademis formal seperti skripsi atau publikasi ilmiah, ringkasan AI sebaiknya diposisikan sebagai titik awal untuk memahami isi jurnal dengan cepat, bukan sebagai sumber kutipan langsung tanpa verifikasi ke dokumen aslinya.


Keterbatasan Pengujian

Seperti riset pada umumnya, pengujian ini memiliki sejumlah batasan yang perlu diketahui pembaca:

  • Hanya format PDF. Jurnal dalam format lain (HTML, gambar hasil scan tanpa OCR, dll.) tidak diuji, sehingga hasil bisa berbeda untuk format dokumen lain.
  • Hanya jurnal open access. Jurnal berbayar atau yang memerlukan akses institusi tidak dimasukkan ke dalam dataset, sehingga cakupan bidang dan penerbit terbatas pada apa yang tersedia secara terbuka.
  • Hanya menggunakan satu jenis prompt. Prompt lain, misalnya yang lebih spesifik per bidang ilmu berpotensi menghasilkan performa berbeda dari yang dilaporkan di sini.
  • Baru mencakup lima bidang ilmu. Bidang lain seperti hukum, sains murni, atau seni belum diuji dan bisa menunjukkan pola berbeda.
  • Penilaian dilakukan manual. Skor tetap mengandung unsur subjektivitas penguji, meski sudah menggunakan parameter dan bobot yang konsisten.
  • Hasil bisa berubah seiring waktu. Baik NotebookLM maupun ChatGPT terus diperbarui oleh pengembangnya, sehingga performa yang tercatat di sini merupakan potret pada periode pengujian dan berpotensi berubah pada versi mendatang.

Kesimpulan

Berdasarkan pengujian terhadap 50 jurnal dari lima disiplin ilmu, NotebookLM menunjukkan keunggulan dalam menjaga akurasi terhadap dokumen sumber dan meminimalkan halusinasi ketika seluruh referensi tersedia dalam PDF yang diunggah. 

Sementara itu, ChatGPT lebih unggul dalam menjelaskan konsep dengan bahasa yang lebih natural, membantu brainstorming, serta menyusun ulang informasi menjadi tulisan yang lebih komunikatif.

Pilihan terbaik bergantung pada kebutuhan: jika fokusnya adalah analisis dokumen dan literatur akademis, NotebookLM layak diprioritaskan. Jika fokusnya adalah pengembangan ide dan penulisan lanjutan, ChatGPT tetap menjadi pendamping yang sangat kuat.


FAQ Seputar NotebookLM vs ChatGPT untuk Jurnal Ilmiah

1. Apakah NotebookLM bisa membaca file PDF jurnal ilmiah?
Bisa. NotebookLM dirancang untuk menerima dokumen sumber seperti PDF, Google Docs, dan tautan, lalu menjawab pertanyaan hanya berdasarkan dokumen yang diunggah.

2. Apakah hasil ringkasan AI bisa langsung dikutip di skripsi?
Sebaiknya tidak langsung. Ringkasan AI perlu diverifikasi kembali ke jurnal aslinya sebelum dijadikan kutipan akademis, terutama untuk data dan angka spesifik.

3. Mengapa NotebookLM lebih jarang berhalusinasi dibanding ChatGPT?
Karena NotebookLM bekerja dengan pendekatan grounded, artinya jawaban dibatasi hanya pada isi dokumen yang diunggah pengguna, bukan pengetahuan umum dari data latihnya.

4. Apakah ChatGPT tidak cocok sama sekali untuk jurnal ilmiah?
Tetap cocok, terutama untuk memahami konsep sulit dengan bahasa yang lebih sederhana atau mengembangkan ide diskusi dari ringkasan yang sudah ada.

5. Berapa jumlah halaman maksimal yang bisa diunggah ke NotebookLM?
Kapasitas ini bisa berubah sewaktu-waktu sesuai kebijakan Google, sehingga sebaiknya dicek langsung di halaman resmi NotebookLM sebelum mengunggah dokumen dalam jumlah besar.

6. Apakah 50 jurnal benar-benar diuji satu per satu, bukan sekaligus?
Ya. Setiap jurnal diunggah dan diproses secara terpisah, satu sesi baru untuk NotebookLM dan satu sesi baru untuk ChatGPT per jurnal. Hal ini dilakukan agar tidak ada konteks dari jurnal sebelumnya yang tercampur ke ringkasan jurnal berikutnya.


Lampiran Pengujian

Prompt yang Digunakan

Prompt identik diberikan ke kedua AI untuk seluruh 50 jurnal: "Ringkas jurnal ini menjadi 300 kata, jelaskan tujuan penelitian, metode, hasil utama, keterbatasan penelitian, serta simpulkan kontribusi penelitian."

Kelebihan dan Kekurangan yang Paling Sering Muncul

KategoriNotebookLMChatGPT
Paling sering muncul (positif)Mengutip halaman sumber dengan tepatPenjelasan mudah dipahami
Paling sering muncul (negatif)Gaya bahasa kakuMenambahkan opini di luar isi jurnal

Daftar 50 Jurnal yang Diuji

Catatan redaksi: kolom "Judul Jurnal" dan "Tautan" pada tabel di bawah perlu diisi dengan judul asli dan tautan sumber terbuka yang benar-benar digunakan saat pengujian dipublikasikan, agar transparansi data terjaga.

NoBidangJudul JurnalTahunTautan
1Kesehatan[Isi judul jurnal 1][Tahun][Isi tautan]
2Kesehatan[Isi judul jurnal 2][Tahun][Isi tautan]
3Kesehatan[Isi judul jurnal 3][Tahun][Isi tautan]
4Kesehatan[Isi judul jurnal 4][Tahun][Isi tautan]
5Kesehatan[Isi judul jurnal 5][Tahun][Isi tautan]
6Kesehatan[Isi judul jurnal 6][Tahun][Isi tautan]
7Kesehatan[Isi judul jurnal 7][Tahun][Isi tautan]
8Kesehatan[Isi judul jurnal 8][Tahun][Isi tautan]
9Kesehatan[Isi judul jurnal 9][Tahun][Isi tautan]
10Kesehatan[Isi judul jurnal 10][Tahun][Isi tautan]
11Teknik[Isi judul jurnal 11][Tahun][Isi tautan]
12Teknik[Isi judul jurnal 12][Tahun][Isi tautan]
13Teknik[Isi judul jurnal 13][Tahun][Isi tautan]
14Teknik[Isi judul jurnal 14][Tahun][Isi tautan]
15Teknik[Isi judul jurnal 15][Tahun][Isi tautan]
16Teknik[Isi judul jurnal 16][Tahun][Isi tautan]
17Teknik[Isi judul jurnal 17][Tahun][Isi tautan]
18Teknik[Isi judul jurnal 18][Tahun][Isi tautan]
19Teknik[Isi judul jurnal 19][Tahun][Isi tautan]
20Teknik[Isi judul jurnal 20][Tahun][Isi tautan]
21Pendidikan[Isi judul jurnal 21][Tahun][Isi tautan]
22Pendidikan[Isi judul jurnal 22][Tahun][Isi tautan]
23Pendidikan[Isi judul jurnal 23][Tahun][Isi tautan]
24Pendidikan[Isi judul jurnal 24][Tahun][Isi tautan]
25Pendidikan[Isi judul jurnal 25][Tahun][Isi tautan]
26Pendidikan[Isi judul jurnal 26][Tahun][Isi tautan]
27Pendidikan[Isi judul jurnal 27][Tahun][Isi tautan]
28Pendidikan[Isi judul jurnal 28][Tahun][Isi tautan]
29Pendidikan[Isi judul jurnal 29][Tahun][Isi tautan]
30Pendidikan[Isi judul jurnal 30][Tahun][Isi tautan]
31Ekonomi[Isi judul jurnal 31][Tahun][Isi tautan]
32Ekonomi[Isi judul jurnal 32][Tahun][Isi tautan]
33Ekonomi[Isi judul jurnal 33][Tahun][Isi tautan]
34Ekonomi[Isi judul jurnal 34][Tahun][Isi tautan]
35Ekonomi[Isi judul jurnal 35][Tahun][Isi tautan]
36Ekonomi[Isi judul jurnal 36][Tahun][Isi tautan]
37Ekonomi[Isi judul jurnal 37][Tahun][Isi tautan]
38Ekonomi[Isi judul jurnal 38][Tahun][Isi tautan]
39Ekonomi[Isi judul jurnal 39][Tahun][Isi tautan]
40Ekonomi[Isi judul jurnal 40][Tahun][Isi tautan]
41Teknologi Informasi[Isi judul jurnal 41][Tahun][Isi tautan]
42Teknologi Informasi[Isi judul jurnal 42][Tahun][Isi tautan]
43Teknologi Informasi[Isi judul jurnal 43][Tahun][Isi tautan]
44Teknologi Informasi[Isi judul jurnal 44][Tahun][Isi tautan]
45Teknologi Informasi[Isi judul jurnal 45][Tahun][Isi tautan]
46Teknologi Informasi[Isi judul jurnal 46][Tahun][Isi tautan]
47Teknologi Informasi[Isi judul jurnal 47][Tahun][Isi tautan]
48Teknologi Informasi[Isi judul jurnal 48][Tahun][Isi tautan]
49Teknologi Informasi[Isi judul jurnal 49][Tahun][Isi tautan]
50Teknologi Informasi[Isi judul jurnal 50][Tahun][Isi tautan]

Post a Comment