🛡️ Regulator Inggris bergegas menilai risiko model AI Antropik terbaru, lapor FT ↗
Lembaga pengawas keuangan Inggris dilaporkan bergerak cepat terkait model Mythos baru dari Anthropic setelah muncul kekhawatiran bahwa model tersebut dapat mengungkap kelemahan serius dalam sistem-sistem penting. Pembicaraan tersebut melibatkan Bank of England, FCA, Departemen Keuangan, dan Pusat Keamanan Siber Nasional - yang merupakan jajaran yang tangguh untuk pratinjau satu model.
Yang menjadi kekhawatiran adalah Mythos sangat mahir dalam menemukan kerentanan perangkat lunak, meskipun Anthropic mengatakan peluncurannya sangat terbatas dan ditujukan untuk pekerjaan keamanan defensif. Bank, perusahaan asuransi, dan bursa diharapkan akan diberi pengarahan, sehingga hal ini sekarang terasa kurang seperti gosip laboratorium dan lebih seperti kebijakan infrastruktur.
🤖 Di konferensi HumanX, semua orang membicarakan Claude ↗
Anthropic tampaknya menentukan suasana di HumanX - itulah intinya. Di berbagai panel, obrolan vendor, dan percakapan di lorong, Claude terus muncul sebagai panutan yang paling diinginkan orang untuk alur kerja bisnis dan pengkodean.
Yang menonjol adalah suasana yang relatif tenang seputar ChatGPT. Artikel tersebut menunjukkan bahwa OpenAI masih memiliki skala dan dana yang besar, tetapi suasana konferensi lebih condong ke Claude sebagai alat yang memiliki daya tarik perusahaan yang lebih kuat saat ini - setidaknya begitulah kelihatannya.
📄 Claude for Word dari Anthropic merupakan tantangan lain bagi kerajaan perangkat lunak Microsoft ↗
Anthropic meluncurkan versi beta Claude untuk Word, melangkah lebih jauh ke perangkat lunak perkantoran sehari-hari alih-alih hanya terbatas sebagai alat pengembang. Aplikasi ini dapat menjawab pertanyaan tentang dokumen dengan kutipan bagian yang dapat diklik, mengedit teks yang dipilih tanpa merusak format, dan menangani perubahan yang dilacak.
Target audiensnya cukup jelas: tim yang banyak menggunakan dokumen, terutama tim hukum dan keuangan. Hal ini menjadikan fitur ini lebih dari sekadar penambahan fitur – ini adalah sindiran langsung ke wilayah kekuasaan Microsoft, dan langkah yang cukup berani.
🌐 Bot AI Mengeksploitasi Web Secara Besar-besaran, dan Anthropic Memimpinnya ↗
Analisis baru terhadap data Cloudflare menunjukkan bahwa perusahaan AI mengekstrak jauh lebih banyak informasi dari web daripada yang mereka berikan kembali. Statistik kuncinya adalah rasio perayapan-ke-rujukan - seberapa sering bot mengikis halaman dibandingkan seberapa sering mereka mengarahkan pengguna kembali - dan Anthropic menunjukkan hasil yang sangat buruk.
Rasio Anthropic dilaporkan sebesar 8.800 banding 1, dengan OpenAI juga tinggi tetapi jauh lebih rendah. Intinya sangat jelas: kesepakatan web lama adalah merayapi situs kami, lalu mengirimkan trafik kepada kami. Mesin penjawab AI mempertahankan bagian pertama dan membiarkan bagian kedua menjadi kabur.
⚔️ Menelaah perlombaan senjata AI global yang semakin memanas, ketika AS, Tiongkok, Rusia, dan negara-negara lain berlomba-lomba membangun senjata dan sistem pertahanan otonom yang didukung AI ↗
Liputan terbaru tentang AI militer lebih berfokus pada percepatan strategis daripada demonstrasi yang mencolok. Kekuatan-kekuatan besar mendorong sistem pertahanan otonom dan berbasis AI secara bersamaan, yang membuat semuanya terasa seperti perlombaan estafet di mana semua orang mengambil tongkat estafet dan lupa mengerem.
Hal itu memunculkan pertanyaan-pertanyaan yang biasa diajukan - kontrol, eskalasi, akuntabilitas - tetapi dengan urgensi yang lebih besar sekarang. Begitu AI tertanam lebih dalam ke dalam penargetan, pengawasan, dan pengambilan keputusan di medan perang, "eksperimental" mulai terdengar seperti label di atas kertas pada sesuatu yang sudah berjalan.
🏭 SoftBank Jepang meluncurkan unit untuk mengembangkan AI buatan dalam negeri ↗
SoftBank telah bekerja sama dengan Sony, Honda, dan perusahaan Jepang lainnya untuk membentuk usaha AI baru yang berfokus pada "AI fisik" - model yang dirancang untuk mengendalikan mesin dan robot, bukan hanya merespons dalam bentuk teks. Ini adalah jalur yang berbeda dari kontes chatbot biasa, dan mungkin yang lebih menarik.
Ambisi ini sangat besar, dengan upaya yang dilaporkan ditujukan pada model fondasi yang sangat besar dan landasan panjang menuju penggunaan industri. Ini sebagian merupakan strategi teknologi nasional, sebagian merupakan proyek ambisius yang ambisius, dan sebagian lagi seperti anime mekanik dengan rapat dewan direksi.
Pertanyaan yang Sering Diajukan (FAQ)
Mengapa regulator Inggris mengamati model Mythos dari Anthropic dengan saksama?
Laporan menunjukkan bahwa otoritas Inggris memandang Mythos sebagai potensi risiko karena mungkin sangat mahir dalam menemukan kerentanan perangkat lunak. Diskusi tersebut dilaporkan melibatkan Bank of England, FCA, Departemen Keuangan, dan Pusat Keamanan Siber Nasional. Kombinasi lembaga-lembaga tersebut menandakan kekhawatiran tentang kemungkinan dampak pada sistem-sistem penting, khususnya di bidang keuangan dan infrastruktur.
Apa yang membuat model Anthropic Mythos berbeda dari rilis AI biasa?
Yang menjadi kekhawatiran bukan hanya karena ini model baru, tetapi juga karena tampaknya sangat mumpuni dalam pekerjaan keamanan defensif terkait dengan penemuan kelemahan perangkat lunak. Anthropic dilaporkan mengatakan aksesnya sangat dibatasi, yang menunjukkan peluncurannya ditangani lebih hati-hati daripada peluncuran konsumen secara luas. Dalam praktiknya, hal itu membuatnya terasa lebih dekat dengan kemampuan keamanan yang terkontrol daripada pembaruan chatbot standar.
Mengapa Claude mendapat begitu banyak perhatian di konferensi HumanX?
Menurut artikel tersebut, Claude berulang kali muncul dalam panel diskusi, percakapan vendor, dan diskusi informal sebagai pilihan yang kuat untuk alur kerja bisnis dan pengkodean. Artikel tersebut menyajikan Anthropic sebagai perusahaan yang memiliki momentum signifikan di kalangan pengguna perusahaan pada acara tersebut. Artikel itu juga menunjukkan bahwa suasana seputar HumanX lebih tenang di ChatGPT, meskipun OpenAI masih memiliki skala dan sumber daya yang besar.
Apa sebenarnya fungsi Claude for Word bagi tim yang banyak menggunakan dokumen?
Versi beta yang dijelaskan di sini dirancang untuk bekerja di dalam dokumen, bukan hanya menghasilkan teks terpisah. Versi ini dapat menjawab pertanyaan tentang dokumen dengan kutipan bagian, mengedit bagian yang dipilih tanpa mengganggu format, dan menangani perubahan yang dilacak. Hal ini membuatnya sangat relevan bagi tim hukum, keuangan, dan tim lain yang membutuhkan tinjauan cermat, bukan sekadar draf kasar.
Apa yang dikatakan rasio perayapan-ke-rujukan tentang bot AI dan web?
Artikel ini menyajikan rasio ini sebagai cara untuk membandingkan seberapa sering perusahaan AI merayapi situs web dengan seberapa sering mereka mengirim pengguna kembali. Dalam kerangka tersebut, rasio yang sangat tinggi menunjukkan ekstraksi dengan sedikit lalu lintas balik. Anthropic digambarkan berkinerja sangat buruk berdasarkan ukuran ini, yang mempertajam kritik yang lebih luas bahwa mesin penjawab AI dapat melemahkan pertukaran web lama berupa pengindeksan sebagai imbalan atas rujukan.
Mengapa orang-orang menghubungkan kemajuan AI dengan senjata otonom dan AI fisik?
Artikel ini menyoroti dua tren yang saling terkait: pemerintah mempercepat pengembangan sistem pertahanan berbasis AI, dan perusahaan seperti SoftBank mendukung model yang dirancang untuk mengendalikan mesin dan robot. Bersama-sama, keduanya menunjukkan bahwa AI bergerak melampaui obrolan dan pencarian menuju sistem fisik yang dapat merasakan, memutuskan, dan bertindak. Hal ini menimbulkan pertanyaan yang lebih besar tentang kontrol, akuntabilitas, penggunaan industri, dan seberapa cepat sistem ini beralih dari eksperimental ke operasional.