Meta merilis pratinjau WildArtifactBench, sebuah kerangka evaluasi internal yang dirancang khusus untuk menguji performa agen kecerdasan buatan (AI) pada tugas-tugas dunia nyata yang kompleks.
Sistem ini berfokus pada berbagai format hasil kerja (deliverable) yang beragam dalam alur kerja multimodal secara praktis. Sebagai langkah awal untuk mengukur kegunaan nyata dari agen AI tersebut, Meta turut membagikan 10 tugas dari kerangka kerja ini kepada publik.
Hal yang paling menarik dari WildArtifactBench adalah cara penilaiannya yang tidak lagi kaku menggunakan kunci jawaban tunggal (ground-truth rubrics).
Kerangka kerja ini justru memanfaatkan sistem win rate dan skor Elo—sistem pemeringkatan yang biasa digunakan dalam catur profesional maupun kompetisi game e-sports—berdasarkan penilaian hakim manusia dan agen AI.
Ibarat turnamen sabung bakat antarasisten digital, metode penilaian dinamis ini mampu menguji seberapa andal dan fleksibel sebuah agen AI dalam menyelesaikan pekerjaan kreatif hingga analisis data rumit layaknya pekerja manusia profesional.
Meta Superintelligence Labs resmi meluncurkan Muse Voice Transcribe, model persepsi audio real-time pertama buatan mereka.
Teknologi ini menawarkan kemampuan transcription secara streaming, diarization yang mampu membedakan lebih dari 20 pembicara sekaligus, serta fitur endpointing untuk mendeteksi kapan seseorang berhenti berbicara.
Kehadirannya langsung menduduki peringkat pertama pada benchmark speech-to-text streaming di Artificial Analysis serta pengujian diarization publik.
Hal yang paling menarik dari Muse Voice Transcribe adalah kemampuannya dalam memahami alih kode (code-switching) secara mulus di tengah percakapan dwibahasa atau multibahasa.
Teknologi AI ini secara fleksibel dapat mengikuti orang yang berbicara campur-campur bahasa tanpa perlu file pemrosesan terpisah.
Ibarat penerjemah dan notulis serba bisa yang sangat jeli, sistem ini dibekali fitur adaptive delay yang secara cerdas memutuskan waktu jeda mendengarkan sebelum mengetik teks, sehingga hasil transkrip percakapan rapat yang ramah maupun diskusi teknis tetap akurat dan secepat kilat.
Muse meluncurkan versi terbaru Muse Spark 1.3 yang kini sudah tersedia di platform Muse Code maupun akses API.
Pembaruan ini menjadi lompatan terbesar yang pernah dibuat oleh tim pengembang, khususnya dalam menangani tugas-tugas pengodingan (coding) dan kerja agen mandiri (agentic work).
Menariknya, peningkatan kemampuan mutakhir ini dihadirkan dengan harga yang sangat terjangkau hingga efisiensi biayanya hampir tidak terasa.
Kejutan paling menarik dari Muse Spark 1.3 tidak berhenti pada performanya saja, tetapi juga pada arah pengembangannya ke depan.
Pihak Muse membocorkan bahwa peluncuran berikutnya—yang secara misterius disimbolkan dengan emoji semangka 🍉—akan menghadirkan rilis open weights.
Kehadiran versi open weights ini bertindak bak "resep rahasia" AI yang dibuka untuk publik, memberikan kebebasan bagi para komunitas developer dan peneliti di seluruh dunia untuk mengunduh, memodifikasi, serta menjalankan model AI canggih ini secara mandiri di komputer mereka sendiri.
Cognition mengumumkan integrasi Fable 5.1 ke dalam platform asisten pengodingan AI milik mereka, Devin.
Berkat optimasi pada sistem caching, tingkat kecerdasan setara Fable kini dapat dinikmati dengan biaya 54 persen lebih murah—bahkan menjadikannya lebih hemat dibandingkan model Opus.
Kehadiran pembaruan ini memberikan efisiensi luar biasa bagi para pengembang yang membutuhkan performa intelligence tingkat tinggi untuk proyek koding yang rumit.
Bukan hanya itu, sistem harness Devin Fusion juga mendapatkan peningkatan signifikan sehingga kini menjadi lebih cerdas dan makin terjangkau. Dalam pengujian benchmark FrontierCode, Devin Fusion berhasil menyamai performa Fable 5.1 dengan biaya 47 persen lebih rendah. Hal yang paling menarik adalah kemampuannya dalam melakukan caching dan pembagian tugas secara dinamis.
AI ini bertindak pintar layaknya tim pengembang profesional yang otomatis mengalokasikan tugas-tugas berat ke model utama dan tugas rutin ke asisten pendukung, sehingga pengerjaan program berjalan super cepat tanpa memboroskan anggaran.
Cognition resmi mengumumkan bahwa GPT-6 Astra akan segera hadir di dalam platform asisten pengodingan AI mereka, Devin.
Kehadiran model terbaru ini menjanjikan peningkatan performa yang signifikan untuk membantu para pengembang menyelesaikan berbagai proyek perangkat lunak dengan lebih efisien.
Integrasi ini menjadi langkah besar dalam menghadirkan alur kerja pemrograman berbasis kecerdasan buatan yang semakin canggih dan terjangkau.
Hal yang paling menarik dari GPT-6 Astra adalah efisiensi luar biasa yang ditawarkannya tanpa mengorbankan kualitas. Pada pengujian benchmark FrontierCode 1.1, kemampuannya berhasil menempel ketat Fable 5 dengan selisih hanya 0,4 poin, namun dengan biaya yang 64 persen jauh lebih murah.
Selain hemat anggaran, model AI ini juga mencetak rekor baru dalam membuat pengujian koding yang lebih komprehensif, laporan yang sangat jelas, hingga menyajikan bukti rekaman video analisis layaknya seorang detektif digital yang secara transparan memperlihatkan cara dia memperbaiki masalah program Anda.
Design / DevGoogle DeepMind dan Google Research resmi memperkenalkan WeatherNext 3, model kecerdasan buatan (AI) cuaca paling canggih dan akurat dari Google hingga saat ini.
Model AI ini dirancang untuk memberikan prediksi cuaca yang sangat detail hingga resolusi 5 kilometer dan diperbarui setiap jam.
Kehadiran teknologi ini menjadi pembaruan besar yang langsung terintegrasi ke dalam ekosistem Google seperti Google Search, Maps, Gemini, hingga Google Cloud.
Hal yang paling menarik dari WeatherNext 3 adalah kemampuannya meninggalkan simulasi fisika tradisional dan beralih memanfaatkan data satelit real-time serta stasiun cuaca secara langsung.
Pendekatan cerdas ini memungkinkan WeatherNext 3 memprediksi cuaca ekstrem, curah hujan, hingga variabel energi bersih—seperti radiasi matahari dan kecepatan angin di ketinggian kincir angin—secara presisi.
Ibarat memiliki "peneropong masa depan" yang super tajam, AI ini bertindak seperti pahlawan penjelajah iklim yang dapat mengantisipasi badai mendadak dan membantu efisiensi pembangkit listrik tenaga surya serta angin di seluruh dunia.
Z.ai resmi meluncurkan GLM-5.3-Flash, model AI multimodel berukuran 320B-A18B yang dirilis secara terbuka di bawah lisensi MIT.
Model yang sebelumnya dikenal dengan nama pratinjau Ox Alpha ini membawakan kapasitas context window hingga 1 juta token, menjadikannya sangat fleksibel untuk memproses dokumen tebal maupun data audio-visual berskala besar dengan biaya yang sangat efisien.
Hal yang paling menarik dari peluncuran ini adalah fakta bahwa GLM-5.3-Flash berjalan sepenuhnya di atas cip AI buatan Tiongkok.
Kehadiran model berkinerja tinggi yang ditenagai oleh infrastruktur perangkat keras lokal ini membuktikan kemajuan pesat ekosistem AI mandiri di luar ketergantungan cip Barat, sekaligus langsung menyediakan bobot model (weights) dan akses API yang bisa dicoba secara gratis oleh komunitas global.
Para pengembang berhasil menciptakan Gemma Translator, sebuah eksperimen perangkat penerjemah kecerdasan buatan serba luring yang memadukan keunggulan Google Gemma 4, Antigravity, dan mikrokomputer Raspberry Pi 5.
Perangkat portabel ini dirancang lengkap dengan antarmuka khusus, penutup cetak 3D, serta rangkaian elektronik kabel untuk memproses penerjemahan bahasa secara mandiri tanpa memerlukan sambungan internet.
Kehadiran inovasi ini membuktikan bahwa kemampuan AI tingkat tinggi kini dapat dijalankan secara efisien pada perangkat komputasi mini untuk kebutuhan komunikasi luring di daerah terpencil.
Design / Dev
Design / Dev
Design / Dev
Design / DevGoogle AI resmi menghadirkan model Gemini 3.8 Flash ke dalam ekosistem GitHub Copilot. Peluncuran ini memungkinkan para pengembang untuk memanfaatkan kemampuan AI terbaru dari Google langsung melalui aplikasi GitHub Copilot, CLI, maupun Visual Studio Code.
Langkah ini menjadi kabar gembira bagi komunitas developer yang membutuhkan asisten pengodingan yang tangguh dan serbaguna.
Berdasarkan pengujian awal, Gemini 3.8 Flash menunjukkan performa yang sangat luar biasa dalam menangani tugas-tugas pengodingan kompleks berbasis terminal.
Menariknya, AI ini memiliki kemampuan validasi yang sangat ketat serta daya tahan tinggi untuk bangkit (persistent recovery) dari kegagalan program.
Bayangkan memiliki asisten koding yang tidak hanya paham command line rumit, tetapi juga pantang menyerah dan secara cerdas dapat memperbaiki kodenya sendiri saat menemukan error—mirip seperti karakter superhero yang selalu menemukan jalan keluar di saat kritis.
Google Labs resmi memperkenalkan eksperimen terbarunya bernama Play with Putty, sebuah alat vibe coding kolaboratif yang memungkinkan pengguna merancang alat (tools) dan situs web bersama-sama secara langsung (real-time).
Melalui fitur ini, pengguna dapat mengubah ide kreatif mereka menjadi proyek digital yang dikerjakan secara multiplayer. Eksperimen ini baru tersedia untuk pengguna berusia 18 tahun ke atas yang berdomisili di Amerika Serikat melalui sistem daftar tunggu (waitlist).
Hal yang paling menarik dari eksperimen ini terletak pada konsep vibe coding interaktif yang menyerupai cara bermain adonan atau lilin mainan (putty).
Alih-alih menulis baris kode yang kaku secara mandiri, pengguna dapat secara fleksibel membentuk dan mengutak-atik antarmuka web bersama teman dalam satu kanvas kerja yang sama. Pengalaman visualnya yang dinamis dan santai membuat proses pembuatan program terasa seperti permainan kolaboratif yang menyenangkan.
Grok 4.6 kini resmi terintegrasi dan dapat digunakan langsung di dalam platform asisten pemrograman AI, Devin. Model AI terbaru ini membawa peningkatan performa yang sangat signifikan dibanding pendahulunya, Grok 4.5.
Kehadiran pembaruan ini semakin memperkuat kemampuan Devin dalam menangani berbagai tugas rekayasa perangkat lunak dan alur kerja pemrograman yang kompleks secara otomatis.
Hal yang paling menarik dari peluncuran ini terletak pada lonjakan kemampuannya yang sangat tinggi. Dalam tolok ukur performa, Grok 4.6 berhasil melampaui GPT-5.6 Sol dan kini berada di jajaran teratas model AI paling andal untuk pemrograman, tepat di bawah Opus 5 dan Fable 5.
Kemampuan tinggi ini memberikan fleksibilitas baru bagi para pengembang untuk menyelesaikan kode yang rumit dengan tingkat akurasi yang lebih presisi di Devin.
Google meluncurkan eksperimen perangkat penerjemah portabel bernama Gemma Translator yang dapat bekerja secara penuh tanpa koneksi internet (offline). Perangkat rakitan ini mentenagai model AI Gemma 4 berukuran paling ringkas yang dijalankan langsung di atas papan komputasi Raspberry Pi 5.
Dikembangkan bersama Antigravity, proyek ini dirancang lengkap dengan antarmuka kustom, sirkuit kabel terpadu, serta casing cetak 3D untuk penggunaan sehari-hari.
Hal yang paling menarik dari proyek eksperimental ini adalah sifatnya yang sepenuhnya sumber terbuka (open-source) dan dirancang untuk bisa dibuat sendiri (DIY).
Komunitas pengembang dapat mengunduh seluruh cetak biru, kode program, hingga desain casing secara gratis untuk merakit penerjemah AI portabel mereka sendiri.
Integrasi model Gemma yang super ringan di dalam Raspberry Pi 5 membuktikan bahwa AI canggih kini bisa berjalan mandiri di perangkat berukuran saku tanpa bergantung pada server awan.
Graphics
Internet
Internet
Graphics
PhotoshopGrok Bot kini hadir dengan peningkatan dukungan yang lebih optimal untuk platform X (sebelumnya Twitter).
Pembaruan ini dirancang untuk mempermudah para pengembang dan pengguna dalam mengintegrasikan serta memanfaatkan kapabilitas bot langsung ke dalam ekosistem X.
Langkah ini semakin memperluas fleksibilitas Grok Bot dalam menangani berbagai otomatisasi dan interaksi cerdas di media sosial.
Hal menarik yang paling mencuri perhatian dari pembaruan ini adalah kemudahan proses integrasinya. Saat kamu menghubungkan profil X milikmu, sistem akan secara otomatis membuatkan akun pengembang (developer account) yang sudah dilengkapi dengan kredit gratis.
Artinya, kamu bisa langsung mencoba dan membangun berbagai fitur tanpa perlu melewati proses pendaftaran pengembang yang rumit atau mengeluarkan biaya di awal.
Google resmi menghadirkan model Gemini 3.8 Flash ke dalam platform pengembang Antigravity untuk mendukung pembuatan autonomous agents dan alur kerja pemrograman jangka panjang (long-horizon coding).
Model ini dirancang sebagai mesin pendorong utama yang cerdas namun tetap efisien, sehingga mampu mengeksekusi instruksi kompleks yang membutuhkan pemrosesan bertahap tanpa kehilangan konteks.
Pengembang kini sudah dapat mencoba integrasi ini untuk membangun aplikasi kecerdasan buatan (AI) yang lebih mandiri dan responsif.
Hal paling menarik dari hadirnya model ini di Antigravity adalah kemampuannya dalam mengeksekusi proyek pemrograman skala besar secara otonom dari awal hingga akhir.
Dibandingkan model AI biasa yang hanya dapat memberikan potongan kode singkat, Gemini 3.8 Flash mampu merencanakan arsitektur perangkat lunak, mengidentifikasi bug secara mandiri, dan menyelesaikan tugas pemrograman rumit yang membutuhkan ingatan jangka panjang tanpa arahan berulang dari pengguna.
Google resmi memperkenalkan Gemini 3.8 Flash Cyber, model kecerdasan buatan (AI) terbaru yang dirancang khusus untuk memperkuat pertahanan keamanan siber.
Model ini menawarkan performa tingkat tinggi dalam mendeteksi sekaligus memperbaiki celah keamanan (vulnerability patching) secara massal dengan kecepatan dan efisiensi biaya kelas Flash.
Dalam pengujian industri, model ini mencatatkan skor 86,2% pada benchmark CyberGym serta mampu mencapai tingkat keberhasilan lebih dari 70% dalam menemukan celah keamanan yang tersebar di 20 bahasa pemrograman berbeda.
Hal paling menarik dari keunggulan model ini terletak pada kemampuannya untuk melakukan perbaikan kode secara otomatis melalui capaian 47,2% pada benchmark CWE-Bench.
Berbeda dari sistem keamanan tradisional yang umumnya hanya memberikan peringatan ancaman, Gemini 3.8 Flash Cyber dapat langsung menambal kode yang bermasalah secara mandiri dan real-time.
Kehadiran teknologi ini berpotensi mengubah alur kerja para pengembang software dan tim peretas etis (ethical hacker) dalam mengamankan infrastruktur digital skala besar dalam hitungan detik.
OpenAI secara resmi meluncurkan GPT-6 Astra, generasi terbaru model kecerdasan buatan yang diklaim membawa lompatan besar dalam kemampuan penalaran (reasoning) dan eksekusi tugas (agentic capabilities).
Model ini dirancang khusus untuk menangani alur kerja kompleks secara mandiri, mulai dari mengendalikan perangkat lunak, menulis dan menguji kode program (codebase), hingga merancang presentasi dan dokumen profesional dengan standar industri.
Selain peningkatan performa di bidang sains dan matematika, OpenAI juga menyematkan sistem keamanan dan pengawasan penyelarasan (misalignment monitoring) yang sangat ketat untuk mencegah penyalahgunaan kemampuan siber model tersebut.
Hal paling menarik yang ditunjukkan dalam pengujian model ini adalah kemampuannya berinteraksi langsung dengan aplikasi visual 3D.
Dalam salah satu demonstrasi resminya, GPT-6 Astra mampu merancang model rumah di perangkat lunak Blender, lalu secara otomatis mentransfernya menjadi lingkungan interaktif yang dapat dijelajahi di dalam Unreal Engine 5.
Kemampuan alur kerja lintas aplikasi (cross-software) secara real-time ini memberikan gambaran masa depan dalam pembuatan game dan desain arsitektur yang jauh lebih intuitif.
Graphics
Graphics
Graphics
Graphics
InternetCognition resmi mengintegrasikan model kecerdasan buatan terbaru Grok 4.6 ke dalam platform rekayasa perangkat lunak berbasis AI miliknya, Devin.
Kehadiran Grok 4.6 membawa peningkatan performa yang sangat signifikan dibanding pendahulunya, Grok 4.5, dengan kapabilitas yang berhasil melampaui GPT-5.6 Sol dan tepat di belakang Opus 5 serta Fable 5.
Dukungan Grok 4.6 di dalam Devin memungkinkan para tim pengembang untuk menyelesaikan proyek perangkat lunak skala besar dengan kecepatan dan tingkat ketelitian yang jauh lebih tinggi.
xAI bekerja sama dengan GitHub untuk mengintegrasikan model cerdas Grok 4.5 ke dalam ekosistem GitHub Copilot.
Pengembang kini dapat beralih ke Grok 4.5 langsung melalui menu pemilih model (model picker) untuk menikmati pemrosesan kode berkecepatan tinggi serta kemampuan penalaran pemrograman yang lebih tajam saat membangun perangkat lunak.
Kehadiran integrasi ini memperluas opsi model AI berkinerja tinggi bagi para pemrogram yang membutuhkan asistensi penulisan kode cerdas dan serba cepat di ruang kerja favorit mereka.
xAI resmi merilis generasi terbaru model AI pembuat gambar bernama Imagine Image 2.0.
Model ini dirancang khusus untuk kebutuhan alur kerja profesional dengan menghadirkan kemampuan pengeditan presisi, visualisasi teks yang jauh lebih tajam, serta tingkat akurasi factual yang lebih tinggi dalam menghasilkan aset visual.
Pembaruan ini mempermudah para pembuat konten dan pengembang dalam memproduksi gambar yang siap pakai untuk proyek nyata tanpa perlu proses penyuntingan manual yang rumit.
xAI resmi merilis fitur Voice connector di dalam aplikasi Grok untuk membantu pengguna berinteraksi melalui suara secara praktis.
Fitur baru ini sudah bisa dinikmati oleh seluruh pengguna tanpa perlu mengaktifkan pengaturan khusus di platform iOS, Android, maupun peramban Web.
Inovasi ini memberikan fleksibilitas tinggi bagi pengguna yang ingin menikmati konten berita serta asisten pribadi secara hands-free saat beraktivitas mobilitas tinggi.
Graphics
Artificial Intelligence
Artificial Intelligence
Artificial Intelligence
Design / Dev