Hasil pertama Jalapeño menunjukkan kecepatan dan efisiensi terdepan di industri dalam inferensi AI ↗
OpenAI menerbitkan hasil kinerja pertama untuk Jalapeño, chip inferensi kustomnya. Pada GPT-OSS 120B, mereka menyatakan bahwa chip tersebut memberikan throughput puncak per kilowatt sekitar 1,9 kali lebih tinggi dan latensi ujung-ke-ujung sekitar 1,7 kali lebih rendah daripada sistem pembanding.
Peningkatan performa juga terlihat pada DeepSeek R1 dan Kimi K2.5. OpenAI berencana untuk menerapkan Jalapeño di dalam infrastruktur komputasinya sendiri, sementara desain generasi kedua dan ketiga sudah dalam pengembangan... jadi ya, OpenAI semakin menjadi perusahaan chip juga, dalam arti tertentu. (OpenAI)
Claude Cowork akhirnya mengingat apa yang Anda katakan kepada aplikasi di obrolan ↗
Anthropic menyatukan ingatan Claude di seluruh obrolan biasa dan Cowork. Informasi yang dipelajari selama percakapan kini dapat mengikuti pengguna ke dalam tugas-tugas yang membutuhkan inisiatif, menghilangkan ritual yang agak menjengkelkan yaitu menjelaskan proyek yang sama berulang kali.
Pengguna dapat memeriksa, mengedit, dan menghapus topik yang diingat, sementara ingatan diperbarui saat percakapan masih berlangsung. Fitur ini diaktifkan secara default di semua paket Gratis, Pro, dan Max. (TechCrunch)
Google Cloud Meluncurkan Gemini Enterprise untuk Layanan Hukum ↗
Google Cloud meluncurkan paket Gemini Enterprise yang dirancang khusus untuk pengacara, mendorong agen-agennya melampaui obrolan umum dan masuk ke dalam peninjauan kontrak, riset hukum, pemantauan peraturan, permintaan privasi, dan penyusunan dokumen.
Ini mencakup konektor untuk platform seperti Harvey, iManage, Docusign, RelativityOne, dan Thomson Reuters, sambil tetap mempertahankan kontrol akses dan batasan etika yang ada di perusahaan. Perebutan lahan agen AI telah mencapai departemen hukum... dapat diprediksi, tetapi tetap cukup cepat. (Google Cloud Press Corner)
Google Cloud Meluncurkan Gemini Enterprise untuk Layanan Keuangan ↗
Google juga meluncurkan penawaran Gemini Enterprise khusus keuangan, termasuk agen Riset Keuangan terkelola, lebih dari 50 keterampilan khusus , dan 13 konektor ke sistem data keuangan dan pasar.
Platform ini menargetkan alur kerja termasuk penilaian risiko kredit, pemantauan portofolio, riset KYC, dan analisis pasar. CME Group dan Deutsche Bank termasuk di antara organisasi yang sudah terlibat - agen perusahaan semakin terspesialisasi, hampir seperti perangkat lunak yang mengenakan jas. (Google Cloud Press Corner)
NVIDIA Umumkan Komputer Robotika Jetson Orin Nano 2 untuk Mendefinisikan Ulang AI Edge Tingkat Awal ↗
Nvidia memperkenalkan Jetson Orin Nano 2, komputer ringkas yang ditujukan untuk robot, drone, dan sistem AI fisik lainnya. Komputer ini menawarkan 78 triliun operasi per detik, memori 8GB, dan CPU Arm delapan inti.
Nvidia mengatakan kinerja inferensi meningkat dua kali lipat dibandingkan Nano Super sebelumnya, sementara untuk mencapai kinerja yang sama hanya membutuhkan daya 40% lebih sedikit. Model yang lebih kecil menjadi benar-benar mampu pada perangkat keras yang ringkas adalah hal yang menarik di sini - AI tidak selalu perlu lagi menghubungi pusat data raksasa. (NVIDIA Newsroom)
Perplexity bermitra dengan Nvidia untuk meluncurkan Portable Computer, agen AI yang sepenuhnya lokal dengan biaya token nol ↗
Perplexity meluncurkan Portable Computer, menghadirkan pengalaman komputer berbasis agen ke perangkat keras lokal yang didukung Nvidia. Model, file, dan eksekusi agen dapat tetap berada di mesin pengguna, dengan pekerjaan yang diselesaikan secara lokal tidak mengonsumsi kredit penagihan cloud.
Tugas dimulai secara lokal, dan sistem meminta izin sebelum meningkatkan langkah ke model cloud terdepan. Sistem ini diluncurkan di sekitar Nvidia DGX Spark dan sistem Linux dengan GPU RTX yang cukup mumpuni - privasi dan biaya tiba-tiba menjadi bagian dari promosi penjualan AI lokal, bukan hanya kecepatan. (Venturebeat)
Anthropic diperkirakan akan memberi tahu investor bahwa mereka melihat potensi pendapatan lebih dari $30 triliun, menurut laporan WSJ ↗
Anthropic dilaporkan sedang bersiap untuk memberi tahu investor bahwa total pasar yang dapat dijangkaunya bisa melebihi $30 triliun. Perbedaan penting - itu adalah peluang tahunan teoretis jika AI menguasai pekerjaan yang relevan, bukan prediksi Anthropic bahwa mereka akan menghasilkan $30 triliun. (Reuters)
Angka yang sangat besar ini membantu menggambarkan pengeluaran infrastruktur Anthropic, persaingannya dengan OpenAI dan Google, serta kisah investor secara lebih luas. Ini adalah angka yang sangat besar... bahkan menurut standar angka industri AI. (Reuters)
Pertanyaan yang Sering Diajukan (FAQ)
Apa arti hasil chip Jalapeño dari OpenAI bagi inferensi AI?
OpenAI menyatakan bahwa Jalapeño memberikan throughput puncak per kilowatt yang lebih tinggi dan latensi ujung-ke-ujung yang lebih rendah daripada sistem pembandingnya saat menjalankan GPT-OSS 120B. Peningkatan serupa dilaporkan dengan DeepSeek R1 dan Kimi K2.5. Hasil ini menunjukkan bahwa OpenAI semakin merancang perangkat keras berdasarkan kebutuhan efisiensi dan kecepatan khusus dari inferensi AI skala besar.
Bagaimana cara kerja memori bersama Claude di seluruh obrolan dan Cowork?
Claude kini dapat membawa informasi yang dipelajari dalam percakapan biasa ke dalam tugas Cowork, mengurangi kebutuhan untuk menjelaskan proyek atau konteks yang sama berulang kali. Pengguna dapat memeriksa, mengedit, dan menghapus topik yang diingat, sementara ingatan tersebut dapat terus diperbarui seiring perkembangan percakapan. Menurut pengumuman yang dibahas dalam artikel ini, fitur ini diaktifkan secara default di semua paket Free, Pro, dan Max.
Apa yang dapat dilakukan Gemini Enterprise untuk Layanan Hukum dan Keuangan?
Penawaran khusus Gemini Enterprise dari Google Cloud ditujukan untuk alur kerja spesifik industri, bukan obrolan AI generik. Paket hukum mencakup area seperti peninjauan kontrak, riset, pemantauan regulasi, permintaan privasi, dan penyusunan dokumen, sementara versi layanan keuangan mendukung alur kerja termasuk penilaian risiko kredit, pemantauan portofolio, riset KYC, dan analisis pasar. Keduanya juga dapat terhubung dengan sistem data dan perangkat lunak profesional yang sudah ada.
Mengapa inferensi AI lokal menjadi semakin penting?
Inferensi AI lokal dapat memperkuat privasi, mengurangi ketergantungan pada infrastruktur cloud, dan berpotensi menurunkan biaya penggunaan berkelanjutan. Nvidia Jetson Orin Nano 2 menargetkan robot, drone, dan sistem edge lainnya, sementara Perplexity Portable Computer menyimpan model, file, dan eksekusi agen pada perangkat keras lokal yang kompatibel. Dalam banyak alur kerja, model cloud kemudian dapat dicadangkan untuk tugas-tugas yang membutuhkan kemampuan tambahan.
Bagaimana Perplexity Portable Computer memutuskan kapan harus menggunakan AI berbasis cloud?
Tugas dirancang untuk dimulai pada perangkat keras lokal pengguna yang didukung Nvidia, menjaga eksekusi model dan file yang kompatibel tetap berada di mesin tersebut. Jika suatu langkah memerlukan model cloud terdepan, sistem akan meminta izin pengguna sebelum meneruskannya. Pekerjaan yang diselesaikan secara lokal tidak akan menggunakan kredit penagihan cloud, sehingga pendekatan ini relevan bagi pengguna yang memperhatikan privasi dan biaya inferensi berulang.
Apa arti dari perkiraan pasar AI senilai $30 triliun yang dilaporkan oleh Anthropic?
Angka yang dilaporkan mengacu pada pandangan Anthropic tentang potensi pasar total yang dapat dijangkau oleh AI, bukan prediksi bahwa Anthropic sendiri akan menghasilkan pendapatan tahunan sebesar $30 triliun. Angka tersebut mewakili nilai teoretis dari pekerjaan yang berpotensi dapat ditangani oleh AI di seluruh perekonomian. Perkiraan ini juga membantu menjelaskan mengapa perusahaan AI terkemuka berinvestasi besar-besaran dalam infrastruktur dan kemampuan perusahaan.