Scott Wu dari Cognition mengatakan bahwa agen pengkodean AI seharusnya tidak menggantikan manusia ↗
Scott Wu dari Cognition menolak anggapan bahwa Devin dirancang untuk menggantikan programmer sepenuhnya. Sikap yang agak canggung, mengingat perusahaan tersebut juga mengatakan bahwa Devin melakukan sebagian besar penulisan kodenya sendiri.
Cara penyampaiannya lebih seperti "teman coding AI" daripada "pekerjaanmu telah ditelan oleh goblin laptop." Namun, ketegangannya sulit diabaikan - agen yang lebih baik, lebih sedikit alasan untuk tim teknik yang membengkak… begitulah argumennya.
Startup AI ini akan membersihkan rumah Anda secara gratis untuk melatih robot di masa depan ↗
Shift menawarkan layanan pembersihan rumah gratis, dengan syarat yang sekaligus praktis dan agak mengkhawatirkan: para petugas kebersihan mengenakan "topi ajaib" yang dilengkapi kamera agar perusahaan dapat mengumpulkan data pelatihan robot.
Penawarannya sederhana - Anda mendapatkan apartemen yang bersih, mereka mendapatkan video pekerjaan rumah tangga. Sebuah kesepakatan yang menguntungkan, mungkin.
Shift mengatakan mereka mengaburkan detail sensitif dan merahasiakan identitas dalam rekaman, tetapi pertanyaan yang lebih luas masih tetap ada seperti kaus kaki di bawah sofa: seberapa banyak privasi rumah yang rela dikorbankan orang demi kenyamanan?
Anthropic merilis Claude Opus 4.8 ↗
Anthropic meluncurkan Claude Opus 4.8 dengan peningkatan di seluruh pengkodean, alur kerja agen, penalaran, dan pekerjaan profesional. Keunggulan utamanya adalah keandalan - lebih sedikit klaim yang tidak didukung, penggunaan alat yang lebih baik, dan lebih banyak pengecekan mandiri.
Claude Code juga memiliki alur kerja dinamis, yang memungkinkan model untuk merencanakan, menjalankan sub-agen paralel, memverifikasi output, dan melaporkan kembali. Kedengarannya membosankan sampai Anda menyadari bahwa pada dasarnya ini adalah manajemen proyek dalam balutan jas hujan.
Harga tetap terbagi antara mode standar dan cepat, dengan Anthropic lebih menekankan pada kontrol upaya sehingga pengguna dapat menyeimbangkan kecepatan, kualitas, dan pembakaran token.
Ketua Foxconn mengatakan bahwa Foxconn sangat yakin dengan momentum pertumbuhan berkat AI ↗
Ketua Foxconn mengatakan permintaan AI mengubah ritme musiman perusahaan yang biasa. Penurunan pasokan di pertengahan tahun yang biasa terjadi? Rupanya tidak lagi terjadi seperti biasanya.
Alasannya adalah pengeluaran besar-besaran perusahaan raksasa cloud untuk AI, yang dilihat Foxconn sebagai peluang pasar tersendiri. Itulah sisi perangkat keras dari booming AI, kurang glamor dibandingkan chatbot, tetapi di situlah aliran uang mengalir deras.
Foxconn sudah menjadi produsen server Nvidia utama, jadi optimisme mereka pada dasarnya merupakan indikator awal persaingan infrastruktur AI.
Panduan bersama untuk evaluasi pihak ketiga yang terpercaya ↗
OpenAI menerbitkan panduan tentang evaluasi AI pihak ketiga, dengan alasan bahwa pengujian perlu detail yang lebih jelas tentang apa yang dievaluasi, bagaimana pengujian dilakukan, dan apa yang dapat dibuktikan oleh hasilnya.
Inti permasalahannya sangat praktis: evaluasi AI mutakhir tidak bisa hanya berupa tebakan berdasarkan peringkat. Para evaluator perlu menjelaskan sistem yang diuji, petunjuk, pengamanan, pemeriksaan validitas, dan batasan klaim.
Hal itu penting karena seiring model menjadi lebih aktif, pengujian yang dangkal dapat membuat sistem tampak lebih aman atau lebih kuat daripada yang sebenarnya. Sedikit usaha dalam hal administrasi, konsekuensinya besar.
Pertanyaan yang Sering Diajukan (FAQ)
Apakah agen pengkodean AI seperti Devin dimaksudkan untuk menggantikan programmer?
Scott Wu menggambarkan agen pengkodean AI sebagai mitra pengkodean, bukan sebagai pengganti penuh bagi programmer manusia. Namun, artikel tersebut memang menunjukkan adanya ketegangan: Devin juga digambarkan sebagai sosok yang memberikan kontribusi besar pada kode Cognition sendiri. Secara praktis, kesimpulannya adalah bahwa alat-alat ini dapat mengurangi beberapa pekerjaan rekayasa rutin sambil tetap bergantung pada manusia untuk penilaian, arahan, dan akuntabilitas.
Mengapa Shift menawarkan layanan pembersihan rumah gratis untuk data pelatihan AI?
Shift menawarkan layanan pembersihan rumah gratis karena mereka menginginkan data video dari aktivitas rumah tangga di dunia nyata untuk melatih robot di masa depan. Para petugas kebersihan mengenakan "topi ajaib" yang dilengkapi kamera saat bekerja, menghasilkan rekaman yang dapat membantu sistem AI memahami tugas-tugas rumah tangga. Pertukaran ini jelas: pelanggan mendapatkan rumah yang bersih, sementara perusahaan mendapatkan data dari ruang hidup pribadi.
Bagaimana Shift menangani privasi saat mengumpulkan rekaman kegiatan bersih-bersih rumah?
Artikel tersebut menyatakan bahwa Shift mengklaim mengaburkan detail sensitif dan merahasiakan identitas dalam rekaman. Hal itu mungkin mengurangi beberapa risiko privasi, tetapi tidak menghilangkan kekhawatiran yang lebih luas tentang perekaman di dalam rumah orang. Bagi pengguna, pertanyaan utamanya adalah apakah kenyamanan layanan kebersihan gratis sepadan dengan tingkat pengumpulan data tersebut.
Apa yang baru di Claude Opus 4.8?
Claude Opus 4.8 digambarkan sebagai peningkatan dalam pengkodean, alur kerja agen, penalaran, dan pekerjaan profesional. Pembaruan ini berfokus pada keandalan, termasuk klaim yang lebih sedikit dan tidak didukung, penggunaan alat yang lebih kuat, dan pengecekan mandiri yang lebih baik. Claude Code juga mendapatkan alur kerja dinamis, di mana model dapat merencanakan, menjalankan sub-agen secara paralel, memverifikasi output, dan melaporkan hasilnya.
Mengapa optimisme Foxconn terhadap booming AI penting?
Kepercayaan diri Foxconn penting karena mencerminkan sisi perangkat keras dari booming AI. Ketua perusahaan mengatakan permintaan AI mengubah pola musiman biasanya, dengan pengeluaran infrastruktur raksasa cloud menciptakan peluang pasar yang besar. Karena Foxconn sudah menjadi produsen server Nvidia utama, komentarnya berfungsi sebagai sinyal kuat untuk permintaan infrastruktur AI.
Apa yang dikatakan OpenAI yang membuat evaluasi AI pihak ketiga dapat dipercaya?
OpenAI berpendapat bahwa evaluasi AI membutuhkan penjelasan yang lebih jelas tentang sistem apa yang diuji, bagaimana cara pengujiannya, dan apa yang sebenarnya ditunjukkan oleh hasilnya. Itu termasuk detail tentang perintah, pengamanan, pemeriksaan validitas, dan batasan dari setiap klaim. Poin ini sangat penting untuk model yang lebih berorientasi pada agen, di mana pengujian yang dangkal dapat membuat sistem tampak lebih aman atau lebih mampu daripada yang sebenarnya.