Platform AI Manus secara resmi meluncurkan Manus 2.0 yang membawa pembaruan besar pada arsitektur agen harness internal terbarunya bernama Cascade. Pembaruan ini dirancang untuk mengelola proyek yang kompleks secara terhubung, mulai dari penulisan skrip, pembuatan video, hingga eksekusi otomatisasi dalam satu ekosistem.
Sistem baru ini menghadirkan fitur Automations berbasis pemicu kejadian (event-driven), memungkinan agen AI bekerja secara otomatis saat menerima sinyal seperti email masuk, pesan Slack, atau perubahan jadwal kalender. Selain itu, pengguna juga dapat memanfaatkan infrastruktur Cloud Computer untuk menjalankan proyek dan agen secara mandiri tanpa henti.
Daya tarik utamanya terletak pada arsitektur Cascade yang terbukti jauh lebih efisien, di mana dalam satu pengujian sistem ini mampu menggunakan token 23,2 persen lebih sedikit, menyelesaikan tugas 28,2 persen lebih cepat, dan memangkas biaya operasional hingga 32 persen dibanding versi terdahulu.
Langkah inovatif ini membuktikan bahwa batas kemampuan agen kecerdasan buatan kini berevolusi dari sekadar merespons prompt sederhana menjadi pengelola alur kerja mandiri yang jauh lebih hemat biaya dan responsif.
Kuaishou resmi mengumumkan bahwa Kling 4.0 akan meluncur pada bulan Oktober mendatang, dengan versi Kling 4.0 Flash yang sudah dapat diakses langsung oleh pelanggan paket Ultra Yearly. Pembaruan ini membawa pembuatan video AI ke tingkat baru dalam hal realisme visual, kontrol kreatif, dan keutuhan narasi.
Generasi baru ini dibekali peningkatan audio dan visual seperti gerakan dinamis yang stabil, suara stereo berkualitas tinggi, sinkronisasi bibir yang lebih akurat, resolusi hingga 4K, serta output 10-bit HDR. Pengguna juga disuguhkan kontrol multi-keyframe hingga 10 bingkai kunci dan durasi pembuatan video asli hingga 30 detik.
Daya tarik utamanya terletak pada fitur Omni Reference yang mendukung hingga 15 referensi multimodal untuk hasil yang lebih konsisten, serta fleksibilitas ekstensi video yang mendukung beragam bahasa, aksen, dan dialek.
Langkah inovatif ini membuktikan bahwa teknologi generator video AI kini semakin matang untuk memberikan kendali sutradara secara penuh kepada para pembuat konten kreatif di seluruh dunia.
Angular Native resmi diperkenalkan untuk menghadirkan pengalaman pengembang dan ekosistem hebat milik Expo ke dalam kerangka kerja Angular. Pembaruan ini memungkinkan pengembang membangun aplikasi seluler asli (real native) untuk iOS dan Android menggunakan Angular.
Kerangka kerja ini mengintegrasikan fitur khas Angular seperti komponen, signals, dan dependency injection (DI) secara langsung dengan ekosistem Expo SDK. Pengembang juga dapat langsung memanfaatkan dukungan CSS dan Tailwind secara praktis sejak awal.
Daya tarik utamanya terletak pada kombinasi sempurna antara produktivitas kerangka kerja Angular yang populer dengan keandalan ekosistem Expo, memungkinkan pembuatan aplikasi native seluler berkinerja tinggi tanpa alur kerja yang rumit.
Langkah inovatif ini membuktikan bahwa batas antara pengembangan web dan seluler kini semakin mudah dilangkahi, memberikan standar baru bagi komunitas pengembang Angular dalam membangun aplikasi lintas platform.
Fitur Dev Mode kini resmi tersedia di Codex melalui integrasi plugin Figma untuk mempermudah alur kerja pengembangan perangkat lunak. Pembaruan ini dirancang untuk menjembatani proses antarmuka desain visual langsung ke dalam lingkungan eksekusi kode.
Pengembang dapat memanfaatkan integrasi ini secara presisi tanpa perlu berpindah aplikasi saat menerjemahkan elemen desain. Langkah ini menyederhanakan kolaborasi teknis antara perancang antarmuka dan pengembang perangkat lunak.
Daya tarik utamanya terletak pada kemudahan akses Dev Mode yang kini terhubung langsung dengan Codex, memungkinkan pengembang mengambil konteks desain Figma secara instan di dalam alur kerja coding mereka.
Langkah inovatif ini membuktikan bahwa batas antara proses desain visual dan pemrograman kini semakin melebur demi efisiensi pengembangan produk digital modern.
Tencent resmi merilis versi pratinjau dari Hy Image 3.5, model pembuat gambar kelas profesional yang menghadirkan peningkatan performa visual secara signifikan.
Model terbaru ini mendukung pembuatan visual baik dari teks ke gambar (text-to-image) maupun gambar ke gambar (image-to-image) dengan resolusi tinggi hingga skala 2K.
Daya tarik utamanya terletak pada peningkatan konsistensi visual serta rasio kemenangan evaluasi manusia yang naik 30 persen dibanding Hy Image 3.0, dengan biaya sangat terjangkau yaitu 0,024 dolar AS per gambar via API Tencent Cloud.
Kehadiran pembaruan ini memberikan efisiensi tinggi bagi para kreator dan pengembang, di mana sistem hanya mengenakan biaya pada hasil gambar akhir tanpa memungut biaya untuk gambar referensi yang diunggah.
Artificial IntelligenceAgora-2 resmi diperkenalkan sebagai multi-agent world model generasi terbaru yang mampu mensimulasikan lingkungan interaktif secara real-time.
Model inovatif ini mendukung hingga 20 pengembang, pengguna manusia, serta agen AI untuk berinteraksi bersama dalam satu ruang virtual secara bersamaan.
Daya tarik utamanya terletak pada kemampuan simulasi multiplayer dalam skala besar, di mana seluruh interaksi antar-agen dan manusia dapat berjalan mulus tanpa hambatan latensi.
Kehadiran versi pratinjau riset ini membuka peluang baru dalam pengembangan gim, simulasi lingkungan digital, serta pengujian kolaborasi kecerdasan buatan di dunia nyata.
Black Forest Labs resmi memperkenalkan FLUX 3 Action, sebuah world action model berukuran 7 milliar parameter (open weights) yang berhasil meraih peringkat pertama pada tolok ukur RoboLab.
Model inovatif ini dirancang dengan arsitektur ringkas yang mampu memprediksi rekaman video masa depan sekaligus tindakan robot secara bersamaan untuk eksekusi tugas secara nyata.
Daya tarik utamanya terletak pada efisiensi performa yang luar biasa, di mana model ini mengungguli rekor terbuka sebelumnya sebesar 6,1 poin persentase meski menggunakan parameter 56 persen lebih sedikit dan berjalan hingga 3,95 kali lebih cepat.
Kehadiran FLUX 3 Action menandai era baru otomatisasi berbasis AI yang dapat diintegrasikan langsung ke sistem robotika, kendali kendaraan, hingga simulasi digital secara fleksibel dan presisi.
Google resmi meluncurkan Gemini 3.8 Live dan Gemini 3.8 Live Extended Thinking sebagai model audio real-time paling canggih yang membuat interaksi suara dengan kecerdasan buatan terasa makin alami.
Varian Gemini 3.8 Live dirancang untuk kecepatan dan efisiensi biaya, mendukung pengalihan 97 bahasa secara instan, pemahaman visual langsung melalui kamera, serta penanganan interupsi percakapan. Sementara itu, versi Extended Thinking dibekali penalaran tingkat tinggi yang mampu menyelesaikan tugas multi-langkah rumit sambil memberikan narasi proses secara langsung.
Daya tarik utamanya terletak pada kemampuan penalaran dan percakapan paralel, di mana pengguna dapat terus berdiskusi secara lancar tanpa jeda meskipun AI sedang memproses instruksi latar belakang yang kompleks.
Inovasi ini membuktikan bahwa interaksi suara berbasis AI kini telah berevolusi dari sekadar respons perintah sederhana menjadi mitra kolaborasi yang interaktif, proaktif, dan serbaguna.
3D Printing
Design / Dev
Design / Dev
Design / DevAlibaba resmi meluncurkan pembaruan besar Qwen-Audio-3.1 yang menghadirkan ekosistem audio lengkap dengan peningkatan fitur serta dua model baru, TTS-Next dan ASR-Next.
Rangkaian lima model ini mencakup seluruh kebutuhan pemrosesan suara digital, mulai dari pemahaman teks (ASR), pembuatan konten audio (TTS), hingga interaksi percakapan langsung secara real-time.
Daya tarik utamanya terletak pada kecanggihan fitur interaktif dan pemangkasan biaya layanan yang drastis, di mana model mampu merespons secara empatik saat mendeteksi suasana hati pengguna serta memotong harga API hingga 95 persen.
Langkah ini mempertegas persaingan teknologi pemrosesan suara berbasis AI yang semakin terjangkau, responsif, dan mampu memahami emosi manusia secara alami.
Aplikasi pembuat video Google Vids kini resmi mengintegrasikan model Gemini Omni 1.1 Flash serta seperangkat kontrol kreatif baru melalui situs vids.new.
Melalui pembaruan ini, siapa pun yang memiliki akun Google kini dapat membuat dan mengedit konten video di Google Vids secara gratis.
Daya tarik utamanya terletak pada kemudahan proses pembuatan video secara intuitif, di mana pengguna dapat menghasilkan video berkualitas tanpa memerlukan keahlian penyuntingan profesional.
Langkah ini semakin memperluas aksesibilitas teknologi AI dalam proses pembuatan konten visual untuk mendukung komunikasi dan presentasi kerja secara lebih praktis.
Microsoft resmi memperluas jajaran model kecerdasan buatan di layanan Copilot dengan meluncurkan Claude Opus 5.5 dari Anthropic dan GPT-6 Sol dari OpenAI.
Kedua model AI ini digulirkan secara terintegrasi ke berbagai ekosistem kerja Microsoft, termasuk Word, Excel, PowerPoint, Chat, Cowork, hingga Copilot Studio.
Daya tarik utamanya terletak pada dukungan fitur Work IQ yang mampu memahami konteks pekerjaan pengguna secara mendalam, sehingga pilihan model AI dapat disesuaikan secara fleksibel dengan kebutuhan tugas spesifik.
Kehadiran opsi model tingkat tinggi ini memberikan kebebasan bagi para profesional untuk mengoptimalkan efisiensi, analisis data, hingga pembuatan dokumen kerja secara jauh lebih presisi.
Google resmi memperkenalkan Gemini 3.8 Flash TTS dan Gemini 3.8 Flash-Lite TTS sebagai model generasi audio terbaru yang diklaim paling ekspresif hingga saat ini.
Kehadiran dua varian model ini dirancang khusus untuk membantu para kreator, pengembang, hingga skala perusahaan dalam merancang pengalaman suara yang jauh lebih kaya dan kaya akan emosi.
Daya tarik utamanya terletak pada peningkatan ekspresivitas audio yang sangat alami serta efisiensi pemrosesan tinggi, sehingga mampu menghasilkan intonasi percakapan yang hidup untuk berbagai kebutuhan aplikasi interaktif.
Pengembang dan publik kini sudah dapat mencoba langsung kemampuan kedua model text-to-speech ini melalui akses Gemini API serta antarmuka pengujian di AI Studio.
Design / Dev
Design / Dev
Graphics
Internet
GraphicsFish Audio resmi memperkenalkan pratinjau model text-to-speech (TTS) terbaru bernama Drama 3 yang dirancang dengan tingkat kontrol suara sangat tinggi.
Model generasi baru ini memungkinkan pengguna mengatur nada bicara, tempo, hingga kepribadian karakter hanya menggunakan deskripsi bahasa sehari-hari tanpa perlu kode audio khusus.
Daya tarik utamanya terletak pada fleksibilitas manipulasi suara yang dinamis, di mana sistem mampu mengubah intonasi di tengah kalimat, merancang adegan antarkarakter, hingga memperbaiki intonasi satu kata saja secara presisi.
Kehadiran teknologi ini menandai lompatan besar dalam pembuatan konten audio yang jauh lebih ekspresif, kontekstual, dan alami untuk berbagai kebutuhan industri kreatif.
Meshy V7.1 kini resmi tersedia di platform fal, memungkinkan pengembang dan kreator mengubah ide menjadi aset 3D production-ready dari input teks maupun gambar.
Model generasi terbaru ini mendukung pembuatan objek 3D dari petunjuk teks (Text to 3D), gambar tunggal (Image to 3D), hingga penggabungan beberapa sudut pandang referensi sekaligus (Multi Image to 3D), lengkap dengan peta tekstur PBR untuk efek material dan pencahayaan realistis.
Daya tarik utamanya terletak pada kemampuan Multi Image to 3D yang sanggup menyatukan berbagai sudut pandang referensi menjadi satu model 3D yang koheren dan siap digunakan dalam alur kerja produksi.
Inovasi ini mempertegas evolusi AI generatif 3D yang makin fokus pada standar kualitas industri untuk mempercepat alur kerja pengembangan game, desain produk, dan efek visual.
Model Tripo3D P2 kini resmi tersedia di platform fal, memungkinkan pengembang dan kreator menghasilkan jaring 3D (textured meshes) secara cepat langsung dari input teks atau gambar.
Model ini menyediakan empat opsi pengaturan kualitas tekstur, pemisahan seed untuk geometri dan tekstur, serta mendukung penghapusan efek pencahayaan bawaan (baked-in lighting) berkat dukungan model tekstur v3.5.
Daya tarik utamanya terletak pada fleksibilitas kustomisasi geometri dan tekstur secara terpisah, yang memberikan kontrol penuh bagi pembuat konten 3D untuk menghasilkan aset digital yang lebih bersih dan siap pakai.
Langkah ini mempertegas integrasi AI generatif 3D yang makin matang pada platform pengembang untuk mempermudah pembuatan aset dalam game, animasi, dan realitas virtual.
Ant Ling AGI resmi meluncurkan lini model Ming-Image-0.1-Design dan Ming-Image-0.1-Design-Layer yang kini tersedia secara langsung di platform Novita AI.
Lini model ini mencakup varian Ming-Image-0.1-Design untuk generasi teks-ke-gambar serta Ming-Image-0.1-Design-Layer untuk pemisahan lapisan gambar (layer decoupling), lengkap dengan dukungan API OpenAI Image Generations and Edits.
Daya tarik utamanya terletak pada fitur layer decoupling yang memungkinkan pemisahan elemen gambar secara independen untuk fleksibilitas penyuntingan tingkat lanjut bagi para desainer.
Inovasi ini membuktikan bahwa alur kerja desain digital berbasis AI kini makin terintegrasi dengan kustomisasi format, ukuran, dan pengelolaan lapisan gambar yang presisi.
Photoshop
Graphics
Graphics
Graphics
GraphicsQwen resmi meluncurkan Qwen-Image-2.1, sebuah model kecerdasan buatan terpadu untuk generasi dan penyuntingan gambar yang kini hadir dalam format open-weight.
Model berarsitektur 7B ini menawarkan performa super cepat yang melampaui berbagai model closed-source, serta mendukung generasi lapisan RGBA secara transparan untuk pengeditan teks dan komposit yang lancar.
Daya tarik utamanya terletak pada kemampuan penyuntingan presisi tinggi yang dapat memproses hingga 10 gambar acuan sekaligus, sambil mempertahankan detail wajah dan produk secara konsisten.
Inovasi ini membuktikan bahwa pembuatan konten visual berkualitas studio kini bisa dijalankan dengan jauh lebih efisien, hemat daya, dan fleksibel berkat aksesibilitas model terbuka.
Xiaomi resmi meluncurkan MiMo-V2.6 yang hadir dalam dua varian, yakni Pro dan Flash, sebagai model kecerdasan buatan omnimodal tingkat terdepan yang dikembangkan secara terbuka melalui pembelajaran penguatan skala besar.
Varian Pro dari model ini berhasil menorehkan rekor tertinggi di antara model sumber terbuka dengan skor 46 pada Artificial Analysis Intelligence Index, serta menawarkan performa yang setara dengan Claude Opus 5 dan GPT-5.6 Sol di berbagai tolak ukur agen komputasi.
Daya tarik utamanya terletak pada keterbukaan akses secara penuh yang mencakup bobot model, laporan teknis, lingkungan pelatihan, hingga kode sumber, yang dipadukan dengan peningkatan luar biasa dalam kemampuan pemograman, penalaran 3D, dan kreativitas.
Langkah strategis ini membuktikan bahwa model kecerdasan buatan berbasis open-source kini memiliki kapasitas yang setara dengan model komersial kelas atas untuk menangani berbagai alur kerja agen yang sangat kompleks.
BytePlus resmi menghadirkan Dramagic, sebuah platform kecerdasan buatan (AIGC) skala perusahaan yang dirancang khusus untuk mempermudah produksi video dan drama pendek.
Platform ini mengotomatisasi seluruh alur kerja produksi, mulai dari analisis naskah, penyiapan aset, pembuatan storyboard, hingga pratinjau video secara terintegrasi.
Daya tarik utamanya terletak pada kepresisian setara editor profesional yang dilengkapi pemeriksaan konsistensi otomatis serta dukungan kolaborasi banyak pengguna secara bersamaan.
Inovasi ini membuktikan bahwa alur produksi konten drama digital kini dapat direncanakan, ditinjau, dan ditingkatkan skalanya secara jauh lebih efisien.
Cognition resmi menghadirkan dua cara baru untuk mengakses komputer Devin melalui integrasi Devin Cloud in Terminal dan devin ssh.
Pengguna kini dapat membuat, mengarahkan, hingga melanjutkan sesi Devin Cloud langsung di dalam antarmuka baris perintah (CLI) menggunakan perintah /cloud.
Daya tarik utamanya terletak pada fitur devin ssh, yang memungkinkan pengembang terhubung langsung ke mesin virtual (VM) khusus milik Devin lalu menyerahkan hasil pekerjaan (handoff) kembali ke perangkat pribadi secara instan.
Inovasi ini membuktikan bahwa pengoperasian agen AI dalam alur kerja pemograman kini makin fleksibel dan menyatu erat dengan alat pengembangan harian.
Graphics
Design / Dev
Design / Dev
Design / Dev
Design / Dev