Amazon telah mengumumkan keluarga perbatasan baru kecerdasan buatan model—dan cara baru bagi pelanggan untuk membangun model terdepan mereka sendiri.
Raksasa ecommerce ini mengumumkan generasi kedua model Nova AI-nya di re:Invent, sebuah konferensi perusahaan yang diadakan di Las Vegas. Model-model tersebut tidak sepopuler model-model yang ditawarkan oleh pesaingnya seperti OpenAI dan Google, namun rencana Amazon untuk membuat model-model tersebut dapat disesuaikan dapat membuat model-model tersebut mendapatkan daya tarik di kalangan pengguna cloud-nya.
Amazon merinci dua model bahasa besar yang ditingkatkan, Nova Lite dan Nova Pro, model suara real-time baru yang disebut Nova Sonic, dan model yang lebih eksperimental disebut Nova Omni yang melakukan jenis simulasi penalaran menggunakan gambar, audio, dan video serta teks. Model-model baru saat ini tersedia untuk sejumlah pelanggan terbatas.
Lebih penting lagi, mengingat pentingnya bisnis cloud-nya, Amazon merilis alat bernama Nova Forge yang memungkinkan pelanggan membuat model perbatasan khusus dengan menambahkan data pelatihan mereka sendiri ke versi model Nova 2 Lite dan Pro yang belum selesai.
Model AI yang tersedia seperti Gemini dari Google dan GPT OpenAI sudah dapat disempurnakan. Namun pendekatan Amazon memungkinkan pelanggan menambahkan data pada berbagai tahap pelatihan model, termasuk proses pembuatan model dasar, sebuah tahap yang dikenal sebagai prapelatihan khusus yang biasanya disediakan untuk laboratorium AI besar.
“Semua orang mencari model terdepan yang ahli di bidangnya,” Rohit Prasad, yang memimpin upaya AI Amazon, mengatakan kepada WIRED sebelum pengumuman hari ini. Prasad mengatakan bahwa Amazon mengembangkan teknologi di balik Nova Forge untuk memberdayakan tim internal, termasuk mereka yang mengembangkan agen Alexa dan AI untuk membangun model khusus. “Ini pada dasarnya adalah paradigma pelatihan terbuka yang baru,” katanya.
Salah satu pelanggan yang telah menguji pendekatan ini adalah reddityang menggunakan Nova Forge untuk membuat model khusus guna mengidentifikasi konten yang melanggar aturan platform.
Menyempurnakan model konvensional tidak akan berhasil, kata kepala teknologi Reddit, Chris Slowe, karena sebagian besar model dirancang untuk sepenuhnya menghindari konten yang menyinggung atau kekerasan, yang berarti model tersebut akan menolak menganalisis beberapa materi. Slowe mengatakan bahwa pra-pelatihan khusus, dikombinasikan dengan penyesuaian konvensional, menghasilkan model terdepan yang ahli dalam memahami dan menggunakan Reddit.
“LLM lain memahami Reddit sebagai sebuah konsep, dan cara kerja Reddit, tetapi mereka tidak ketinggalan,” kata Slowe. “Kami benar-benar membangun model ahli Reddit.”
Slowe menambahkan bahwa model Reddit yang disesuaikan dapat memiliki berbagai kegunaan, dan kemungkinan besar akan digunakan untuk mengotomatiskan moderasi konten.
Perusahaan lain yang menguji Nova Forge termasuk Booking.com, Sony, dan Nimbus Therapeutics, sebuah perusahaan bioteknologi.
Mengizinkan pelanggan membuat model khusus mungkin terbukti cerdas karena perusahaan mencari alat yang melampaui kemampuan model tujuan umum terbaru. Sekitar tiga perempat perusahaan AS memandang AI sebagai prioritas utama sebuah survei dari perusahaan konsultan Bain yang dirilis pada bulan November. Namun, perusahaan-perusahaan tersebut juga melaporkan berbagai masalah dalam penggunaan AI, di antaranya kurangnya keahlian dan sumber daya yang dibutuhkan untuk membangun model khusus.
Saat ini sebagian besar model AI bersifat tertutup, yang berarti model tersebut hanya dapat diakses melalui API atau aplikasi, atau terbuka, yang berarti model tersebut dapat diunduh dan dijalankan pada perangkat keras milik seseorang. Banyak perusahaan memilih menggunakan model terbuka—yang paling populer adalah model yang berasal dari perusahaan Tiongkok, seperti Alibaba dan DeepSeek—karena model tersebut lebih murah untuk bereksperimen dan dapat dimodifikasi dengan relatif mudah. Namun, data yang digunakan untuk melatih model terbuka ini biasanya tidak dirilis, sehingga membatasi dan mempersulit proses penyesuaiannya.
Nova Forge menawarkan pendekatan baru, meskipun pendekatan tersebut terkunci di cloud Amazon. Membangun model bahasa yang besar dari awal dapat menghabiskan biaya puluhan atau ratusan juta dolar. Prasad mengatakan model terdepan yang dibuat menggunakan Nova Forge seharusnya jauh lebih murah, tanpa memberikan rinciannya.
Amazon tetap menjadi kuda hitam dalam perlombaan AI, karena relatif terlambat dalam mengembangkan model bahasa AI yang benar-benar mutakhir. Namun, perusahaan ini diam-diam membangun portofolio kemampuan AI tingkat lanjut. Mereka juga telah mengintegrasikan AI generatif ke dalam platform belanjanya, misalnya melalui pembantu chatbot yang berfokus pada e-niaga bernama Rufus.
Seperti perusahaan teknologi besar lainnya, Amazon juga demikian berinvestasi miliaran untuk membangun infrastruktur AI baru, bagian dari proyek besar—dan berpotensi berisiko—bertaruh bahwa permintaan akan AI akan terus tumbuh dengan kecepatan yang mengesankan.
Amazon bersaing dengan Google dan Microsoft untuk mendapatkan pelanggan cloud. OpenAI juga dengan cepat membangun infrastrukturnya sendiri dan suatu hari nanti bisa menjadi pemain cloud. Mereka telah melakukan lindung nilai dengan menginvestasikan $8 miliar di Anthropic, pesaing utama OpenAI yang didirikan oleh staf yang meninggalkan pembuat ChatGPT. Amazon juga ingin menantang dominasi perangkat keras Nvidia; Model terbaru Anthropic dilatih pada chip Trainium khusus Amazon.
Amazon mengatakan Nova 2 Pro cocok atau melampaui GPT-5 dan GPT-5.1 OpenAI, Gemini Pro 2.5 dan Gemini 3.0 Pro dari Google, dan Sonnet 4.5 dari Anthropic di berbagai tolok ukur. Prasad mencatat bahwa model ini sangat baik dalam tugas-tugas agen seperti mengikuti instruksi kompleks dan menggunakan alat di komputer. Perusahaan mengatakan model yang lebih kecil, Nova 2 Lite, mirip dengan Claude 4.5 Haiku, GPT-5 Mini, dan Gemini Flash 2.5 pada berbagai benchmark.
Nova 2 Omni menunjukkan bahwa Amazon tidak ketinggalan dalam penelitian AI saat ini. Model penalaran yang sepenuhnya multimodal, dapat mengambil gambar, audio, dan video serta teks sebagai masukan dan dapat melakukan simulasi penalaran untuk menghasilkan keluaran. Prasad mengatakan sepengetahuannya belum ada perusahaan AI lain yang merilis model mutli sepenuhnya seperti ini.
Slowe dari Reddit mengatakan sifat Nova yang dapat disesuaikan mungkin adalah kualitasnya yang paling penting. “Saya yakin ini memiliki banyak potensi,” katanya. “Untuk sejumlah besar situasi, ini akan jauh lebih baik daripada apa yang kami dapatkan.”
