Inference hooks mengirimkan prompt dari organisasi Anda ke server keamanan AI yang Anda pilih, dan menahan setiap permintaan untuk menunggu keputusan izinkan atau tolak sebelum Claude memprosesnya. Halaman ini memandu Anda mengaktifkan fitur ini, menghubungkan server Anda, dan mengontrol penegakan. Untuk memahami apa itu Inference hooks dan kapan menggunakannya, lihat ikhtisar Inference hooks. Untuk membangun server keamanan AI itu sendiri, lihat Mengembangkan integrasi Inference hooks.
Anda memerlukan:
organization:manage di claude.ai. Peran bawaan Admin, Owner, dan Primary owner memilikinya, begitu pula peran kustom apa pun yang telah diberi izin tersebut.https:// pada port 443, pada host yang dapat dirutekan secara publik, dapat dijangkau tanpa pengalihan. Untuk persyaratan hosting lengkap, serta untuk membangun server dan memverifikasi permintaan yang ditandatangani, lihat Mengembangkan integrasi Inference hooks.Ada tiga status penegakan: off (Enforce verdicts dimatikan: server keamanan AI Anda tidak pernah dihubungi dan prompt tidak diperiksa), shadow (Enforce verdicts diaktifkan dengan Mode diatur ke Shadow mode: server keamanan AI Anda menerima prompt dan mengembalikan keputusan, dan tidak ada yang diblokir), dan enforcing (Enforce verdicts diaktifkan dengan Mode diatur ke Allow the request atau Block the request: keputusan tolak akan memblokir permintaan). Langkah-langkah berikut membawa konfigurasi baru dari status off ke enforcing.
Izinkan Inference hooks untuk organisasi Anda
Buka claude.ai > Organization settings > Data and privacy dan temukan bagian Inference hooks. Aktifkan Allow for your organization.
Mengaktifkan ini akan membuka halaman pengaturan Inference hooks dan selalu memaksa Enforce verdicts ke posisi mati, sehingga mengizinkan fitur ini tidak pernah memulai pemeriksaan dengan sendirinya: bahkan konfigurasi yang sebelumnya memiliki penegakan aktif tetap tidak diperiksa sampai Anda mengaktifkan kembali Enforce verdicts pada langkah terakhir.
Buka halaman pengaturan Inference hooks
Masih di Data and privacy, buka bagian Inference hooks untuk mencapai halaman pengaturan Inference hooks. Halaman ini berada di bawah Data and privacy, bukan sebagai entri tersendiri di navigasi pengaturan, sehingga breadcrumb-nya berbunyi Data and privacy / Inference hooks. Sampai Anda menyimpan endpoint, halaman ini memperingatkan bahwa prompt belum diperiksa, dan Enforce verdicts tetap mati dengan lencana Requires endpoint.
Konfigurasikan endpoint Anda
Klik Configure untuk membuka dialog Configure endpoint dan isi:
https:// yang menerima permintaan keputusan. Hanya URL https:// yang diterima.- alih-alih _, dan tidak boleh bertabrakan dengan nama yang dicadangkan (header pembingkaian permintaan seperti Content-* dan Host, header proxy dan cookie, header alamat klien seperti X-Forwarded-*, header tanda tangan webhook-*, dan prefiks X-Anthropic-*). Nilai harus berupa ASCII yang dapat dicetak.Dialog ini hanya mencakup dua bidang tersebut ditambah Test connection; dialog ini tidak menanyakan tentang penanganan kegagalan, yang Anda pilih di langkah 6. Setelah endpoint disimpan, tombol akan berbunyi Edit.
Uji koneksi
Klik Test connection. Claude mengirimkan prompt uji sintetis ke URL dan header yang saat ini ada di formulir, bukan nilai yang tersimpan, jadi masukkan ulang nilai header yang tersimpan sebelum menguji. Jika berhasil, hasilnya melaporkan apakah server keamanan AI Anda mengembalikan keputusan izinkan atau tolak untuk prompt uji tersebut, yang akan mengungkap default tolak-semua sebelum Anda mulai menegakkan.
Hasil kegagalan yang umum:
| Hasil | Yang perlu diperiksa |
|---|---|
| URL rejected | URL gagal pemeriksaan struktural. Gunakan URL https:// pada port 443. |
| Private or internal IP | Host me-resolve ke alamat privat atau internal. Gunakan host yang dapat dirutekan secara publik. |
| Timeout | Server keamanan AI tidak mengembalikan keputusan dalam batas waktu. |
| Transport error | Resolusi DNS, handshake TLS, atau koneksi gagal. |
| Non-200 status | Server keamanan AI merespons dengan status selain 200. Keputusan harus dikembalikan sebagai HTTP 200; pengalihan tidak diikuti dan dihitung sebagai kegagalan. |
| Unparseable response | Server keamanan AI merespons, tetapi body bukan keputusan yang valid. |
Simpan dan simpan rahasia penandatanganan Anda
Simpan konfigurasi endpoint. Penyimpanan pertama menghasilkan rahasia penandatanganan webhook Anda dan menampilkannya satu kali. Salin dan simpan dengan aman sebelum menutup dialog: rahasia ini tidak dapat diambil kembali nanti, hanya dapat dirotasi.
Server keamanan AI Anda menggunakan rahasia ini untuk memverifikasi tanda tangan pada setiap permintaan yang diterimanya. Untuk prosedur verifikasi, lihat Memverifikasi tanda tangan.
Pilih penanganan kegagalan dan batas waktu
Di bawah Failure handling, atur Mode untuk memilih apa yang terjadi saat server keamanan AI tidak dapat dijangkau atau keputusan melebihi batas waktu:
Opsi ketiga pada dropdown, Shadow mode, adalah alat peluncuran, bukan kebijakan kegagalan; lihat Shadow mode.
Kemudian atur Prompt verdict timeout (ms): 1 hingga 10.000 ms, dengan default 5.000 ms. Anggaran ini mencakup seluruh pertukaran, dan keputusan yang lebih lambat dihitung sebagai server yang tidak dapat dijangkau, jadi atur nilai terendah yang dapat dipenuhi server Anda secara andal.
Perubahan di bagian ini disimpan saat Anda membuatnya. Pada penyimpanan pertama, default-nya adalah Allow the request dan 5.000 ms.
Pilih persentase peluncuran
Di bawah Rollout, atur Requests inspected (%) untuk menjalankan pemeriksaan pada persentase permintaan saat Anda menyiapkan server keamanan AI Anda. Nilainya berkisar dari 0 hingga 100: 100 memeriksa semuanya, dan 0 mematikan pemeriksaan.
Setiap permintaan diundi satu kali untuk seluruh giliran percakapannya, sehingga satu percakapan dapat diperiksa sebagian di antara giliran-gilirannya. Permintaan di luar persentase yang disampel dilanjutkan tanpa pemeriksaan, bahkan ketika penanganan kegagalan diatur ke Block the request.
Aktifkan Enforce verdicts
Untuk mengevaluasi keputusan terhadap lalu lintas langsung tanpa memblokir siapa pun pada awalnya, atur Mode ke Shadow mode (langkah 6) sebelum mengaktifkan penegakan; lihat Shadow mode.
Aktifkan Enforce verdicts untuk menjadikan keputusan server keamanan AI Anda sebagai gerbang bagi Claude untuk setiap prompt yang diatur, lalu konfirmasi di dialog, yang menyatakan ulang pilihan penanganan kegagalan Anda. Beri waktu sekitar satu menit agar perubahan mencapai setiap server Anthropic; permintaan yang sudah berjalan diselesaikan dengan pengaturan lama. Mematikannya akan menghentikan pengiriman prompt ke server keamanan AI Anda, juga dalam waktu sekitar satu menit; konfigurasi Anda tetap disimpan.
Shadow mode menjalankan hook Anda terhadap lalu lintas langsung tanpa memblokir apa pun. Server keamanan AI Anda menerima prompt yang diatur dan mengembalikan keputusan persis seperti saat menegakkan, tetapi tidak ada yang diblokir: setiap permintaan dilanjutkan ke model, bahkan ketika server Anda menolaknya atau tidak dapat dijangkau, dan pengguna akhir tidak melihat apa pun. Gunakan ini untuk menyetel kebijakan Anda terhadap lalu lintas nyata organisasi Anda sebelum Anda mulai menegakkan.
Untuk menggunakan shadow mode, atur Mode ke Shadow mode di bawah Failure handling, lalu aktifkan Enforce verdicts agar prompt mengalir ke server keamanan AI Anda. Saat aktif, halaman pengaturan menampilkan lencana Shadow mode — not blocking. Untuk keluar dari shadow mode, atur Mode kembali ke Allow the request atau Block the request; keputusan ditegakkan kembali setelah penegakan diaktifkan.
Di bawah Exclusions, pilih peran yang anggotanya tidak dicakup oleh Inference hooks: prompt mereka tidak pernah dikirim ke server keamanan AI Anda. Hanya peran kustom yang dibuat organisasi Anda yang dapat dikecualikan; peran bawaan tidak ditawarkan. Pilih peran tersebut di pemilih peran, yang placeholder-nya berbunyi Select roles to exclude, dan kelola siapa yang memegang setiap peran dari halaman admin peran (Manage roles); mengubah pengecualian memerlukan izin manajemen identitas. Daftar ini kosong secara default, dan tanpa peran yang dikecualikan, setiap permintaan yang diatur akan diperiksa.
Pengecualian berlaku untuk sesi interaktif pengguna; lalu lintas yang diautentikasi oleh kredensial mesin selalu diperiksa. Jika Claude tidak dapat menentukan keanggotaan peran pemohon, permintaan gagal secara tertutup dengan kesalahan yang dapat dicoba ulang, alih-alih dilanjutkan tanpa pemeriksaan. Perubahan pada daftar pengecualian dicatat dalam jejak audit.
Di bawah Custom blocked prompt message, atur teks kustom hingga 500 karakter yang ditambahkan ke pesan kesalahan yang dilihat pengguna akhir ketika server keamanan AI Anda menolak permintaan (biasanya siapa yang harus dihubungi atau di mana meminta pengecualian). Pesan akhir adalah deny_reason per-permintaan dari server keamanan AI Anda (jika ada), satu baris kosong, lalu teks ini. Tanpa teks kustom yang dikonfigurasi, default bawaan mengarahkan pengguna untuk menghubungi administrator mereka; Anda juga dapat mematikan pesan tambahan sepenuhnya sehingga pengguna hanya melihat deny_reason.
Area kesehatan endpoint pada halaman pengaturan Inference hooks menampilkan:
Panel ini bersifat upaya terbaik: jika Anthropic tidak dapat membaca penghitung, panel menampilkan nol kegagalan dan tidak ada kesalahan alih-alih menampilkan kesalahannya sendiri, sehingga panel yang tampak sehat bukanlah bukti tersendiri bahwa server keamanan AI Anda sehat. Failures per minute menghitung setiap kegagalan, termasuk kesalahan jaringan dan DNS yang tidak pernah memicu circuit breaker, sehingga nilainya bisa tinggi sementara Circuit breaker tripped tetap kosong.
Kegagalan webhook berkelanjutan yang disebabkan oleh server keamanan AI Anda akan memicu circuit breaker, yang menghentikan penegakan: server Anda tidak lagi dihubungi, dan pilihan Failure handling Anda berlaku untuk setiap permintaan yang diperiksa. Dengan Block the request dipilih, pengguna di organisasi Anda diblokir sampai Anda bertindak. Ketika breaker terpicu, administrator juga diberi tahu di pusat notifikasi claude.ai.
Untuk memulihkan, perbaiki server, lalu aktifkan kembali Enforce verdicts untuk mereset breaker.
Klik Rotate secret di bawah Request signing untuk mengganti rahasia penandatanganan Anda. Rotasi adalah peralihan langsung: rahasia baru dihasilkan dan ditampilkan satu kali, rahasia lama tidak dapat lagi diambil, dan tidak ada permintaan yang pernah ditandatangani dengan kedua rahasia, sehingga tidak ada periode tumpang tindih yang dapat diandalkan.
Permintaan yang ditandatangani dengan rahasia sebelumnya masih dapat tiba sebentar setelah rotasi; Memverifikasi tanda tangan membahas bagaimana server keamanan AI Anda harus menangani peralihan tersebut.
Aktivitas Inference hooks dicatat dalam Activity Feed organisasi Anda: perubahan konfigurasi, penolakan, dan permintaan yang dilanjutkan tanpa pemeriksaan berdasarkan pengaturan penanganan kegagalan Anda. Catatan penolakan membawa pengidentifikasi yang memungkinkan Anda menggabungkan setiap penolakan dengan catatan yang sesuai di sistem Anda sendiri.
Ada dua tingkat mematikan:
Bangun server keamanan AI: skema permintaan dan keputusan, verifikasi tanda tangan, dan semantik operasional.
Apa itu Inference hooks, bagaimana perjalanan bolak-balik keputusan bekerja, dan apa yang dikirim ke server keamanan AI Anda.
Was this page helpful?