Newtechclub.com – Alibaba Cloud, anak perusahaan Alibaba Group, secara resmi meluncurkan senjata pamungkas terbarunya: Qwen3-Max-Thinking. Yang membuat gelombang kejutan, mereka dengan percaya diri menempatkan model ini sebagai penantang serius yang mampu menyaingi, bahkan melampaui, performa dua raksasa industri saat ini, yaitu GPT-5.2-Thinking dari OpenAI dan Gemini 3 Pro milik Google. Model ini tidak main-main dan langsung dinobatkan sebagai flagship terbaru, karena dirancang khusus untuk mengatasi tugas-tugas yang membutuhkan penalaran atau reasoning tingkat sangat kompleks. Bayangkan saja, model ini akan membantu Anda memecahkan soal sains paling rumit, menulis kode program yang elegan, hingga bertindak sebagai agen AI otonom yang dapat mengambil keputusan secara bertahap layaknya asisten pribadi yang jenius.
Dalam pengumuman resminya, Alibaba membeberkan rahasia di balik klaim mereka. Qwen3-Max-Thinking dikembangkan dengan skala parameter yang jauh lebih besar dan dilatih menggunakan sumber daya komputasi masif melalui teknik reinforcement learning yang canggih. Hasil dari semua investasi teknologi itu adalah peningkatan performa yang signifikan di berbagai aspek kunci, mulai dari akurasi pengetahuan faktual, kedalaman pemahaman instruksi, kepekaan terhadap preferensi manusia, hingga kemampuan agentic yang lincah.
Untuk membuktikan kehebatannya, Alibaba kemudian menunjukkan sejumlah data benchmark yang solid. Mereka mengklaim Qwen3-Max-Thinking telah diuji di 19 tolok ukur AI internasional dan mencatatkan performa yang sebanding dengan model-model papan atas. Lebih menarik lagi, dalam beberapa pengujian penalaran khusus, model ini bahkan dilaporkan berhasil mengungguli Gemini 3 Pro, terutama pada soal-soal yang menuntut logika bertahap dan pengambilan keputusan berbasis konteks panjang.
Salah satu bukti nyata yang paling disorot adalah prestasinya di Humanity’s Last Exam, sebuah benchmark legendaris yang berisi ribuan soal tersulit dari berbagai disiplin ilmu tingkat pascasarjana. Dengan bantuan fitur pencarian internal, Qwen3-Max-Thinking berhasil mencetak skor lebih tinggi, yakni 49,8 poin, mengalahkan Gemini 3 Pro yang meraih 45,8 poin dan GPT-5.2-Thinking yang mendapatkan 45,5 poin. Sementara itu, pada aspek penalaran murni di benchmark super sulit HMMT Feb 25, Qwen3 mencatat skor 98 poin, tetap unggul dari Gemini 3 Pro (97,5 poin) dan hanya terpaut sangat tipis dari GPT-5.2 dengan skor 99,4 poin. Prestasi ini secara jelas menunjukkan bahwa kemampuan Qwen3 dalam berpikir sistematis untuk menyelesaikan persoalan berlapis sudah menyentuh level elit dunia AI.
Yang tak kalah mengesankan, Qwen3 ternyata juga jago dalam hal memahami dan menuruti keinginan pengguna. Pada benchmark Arena-Hard v2 yang mengukur ketepatan AI dalam mengikuti instruksi kompleks, Qwen3 meraih skor tertinggi, yaitu 90,2 poin. Angka tersebut unggul jauh dibandingkan pencapaian GPT-5.2 yang 80,6 poin dan Gemini 3 Pro yang 81,7 poin.
Lalu, apa sih fitur revolusioner yang membedakannya? Jawabannya adalah kemampuan adaptive tool-use. Berbeda dari model generasi lama, Qwen3-Max-Thinking dapat secara otomatis memilih dan menggunakan berbagai alat bantu di tengah percakapan tanpa perlu disuruh. Model ini dengan lihai akan memanggil mesin pencari untuk data terbaru, mengakses memori untuk mengingat konteks, atau menjalankan code interpreter untuk eksekusi kode. Semua proses itu terjadi dalam satu alur reasoning yang terpadu dan efisien. Alibaba menekankan bahwa kombinasi ini ampuh untuk menekan halusinasi AI, karena setiap jawaban dapat diverifikasi melalui sumber eksternal dan komputasi aktual.
Inovasi lain yang menjadi jantung kecerdasannya adalah pendekatan test-time scaling. Alih-alih menghasilkan banyak jawaban sekaligus, model ini menggunakan strategi refleksi bertahap di mana Qwen3-Max-Thinking secara aktif belajar dari pengalamannya sendiri selama proses menjawab. Ia akan menyaring kesimpulan yang sudah pasti, lalu memfokuskan sumber daya komputasi hanya pada bagian yang masih ambigu. Teknik cerdas ini diklaim menghasilkan lonjakan skor yang tajam di berbagai benchmark, namun dengan konsumsi komputasi yang lebih hemat dibanding metode konvensional.
Kabar baiknya, Anda tidak perlu menunggu lama untuk mencobanya. Qwen3-Max-Thinking sudah tersedia untuk publik di layanan Qwen Chat. Bagi kalangan developer dan enterprise, model ini juga dapat diakses melalui API Alibaba Cloud dengan nama model qwen3-max-2026-01-23. Alibaba dengan strategis memposisikan model premium ini sebagai solusi yang tetap kompetitif harganya, khususnya untuk memenuhi kebutuhan industri yang mengutamakan kecerdasan tinggi dan efisiensi biaya. Dunia AI jelas semakin panas dengan kehadiran pemain sekuat ini.
Kunjungi juga situs berita terupdate hanya di Desapenari.id

