Berita

Anthropic Perbarui Pengaman Biologi Fable 5 agar Lebih Tepat Sasaran

Anthropic menyempurnakan filter biologi agar pertanyaan kesehatan dan pendidikan yang wajar lebih jarang dialihkan, sementara bidang berisiko ganda tetap dibatasi.

Teknologi & AI

Ringkasan

Anthropic memperbarui mekanisme pengaman biologi pada Fable 5 dengan tujuan mengurangi pemblokiran berlebihan. Berdasarkan pengujian internal perusahaan, perubahan ini menurunkan pengalihan permintaan terkait biologi sekitar 85 persen di seluruh produknya.

Pertanyaan yang wajar mengenai hasil laboratorium, gejala umum, pendidikan biologi, dan sebagian pekerjaan klinis diharapkan lebih sering ditangani secara langsung. Permintaan profesional pada virologi, toksikologi, desain molekuler, dan bidang berisiko ganda tertentu tetap dialihkan ke model lain dengan pembatasan lebih ketat.

Fakta utama

  • Sistem memakai model klasifikasi yang lebih kecil untuk mengenali permintaan atau keluaran yang masuk ruang lingkup perlindungan.
  • Anthropic menyusun ulang aturan klasifikasi, meminta masukan pakar, membuat data pelatihan baru, dan melatih ulang pengklasifikasi.
  • Perusahaan melaporkan penurunan pengalihan permintaan biologi sekitar 85 persen berdasarkan evaluasi internal.
  • Bantuan untuk pemahaman hasil laboratorium, gejala umum, dan pendidikan biologi diharapkan lebih mudah diakses.
  • Bidang berisiko ganda seperti virologi, toksikologi, dan desain molekuler tetap mendapat pembatasan tambahan.
  • Anthropic mengakui salah blokir masih dapat terjadi dan sedang merancang jalur akses tepercaya bagi peneliti.

Mengapa ini penting

Pengaman yang terlalu luas dapat menghalangi pendidikan dan layanan yang bermanfaat, sementara pengaman yang terlalu longgar dapat mempermudah penyalahgunaan. Perubahan ini memperlihatkan bahwa keselamatan AI memerlukan evaluasi berulang, bukan satu daftar larangan yang dianggap selesai.

Angka perbaikan berasal dari pengujian perusahaan. Penilaian yang lebih kuat membutuhkan metode evaluasi terbuka, peninjauan eksternal, pelaporan kesalahan, dan jalur keberatan bagi pengguna yang sah.

Perspektif nilai

Membuka manfaat ilmu sambil menutup jalan menuju kerusakan memerlukan ukuran yang adil. Pengguna tidak seharusnya diperlakukan sebagai pelaku berbahaya tanpa alasan, tetapi kemampuan yang dapat menimbulkan bahaya luas juga tidak boleh diberikan tanpa kendali.

Informasi kesehatan dari sistem otomatis tetap harus diperiksa oleh ahli. Keterbukaan tentang batas kemampuan, alasan penolakan, serta kemungkinan kesalahan merupakan bagian dari amanah penyedia layanan.

Sikap yang perlu dijaga

  • Jadikan jawaban kesehatan sebagai bahan awal untuk berdiskusi dengan tenaga yang kompeten.
  • Jangan mengakali pengaman untuk memperoleh petunjuk yang dapat membahayakan orang lain.
  • Laporkan salah blokir atau jawaban berisiko melalui saluran resmi agar sistem dapat diperbaiki.

Sumber


Tulisan ini merupakan ringkasan editorial orisinal berdasarkan sumber di atas. Informasi dapat berkembang dan bukan rekomendasi investasi maupun penetapan hukum agama.