Scroll untuk baca artikel
#Viral

Antropik meluncurkan model AI ‘penalaran hibrida’ pertama di dunia

91
×

Antropik meluncurkan model AI ‘penalaran hibrida’ pertama di dunia

Share this article
antropik-meluncurkan-model-ai-‘penalaran-hibrida’-pertama-di-dunia
Antropik meluncurkan model AI ‘penalaran hibrida’ pertama di dunia

Antropik, an kecerdasan buatan Perusahaan yang didirikan oleh orang buangan dari Openaitelah memperkenalkan model AI pertama yang dapat menghasilkan output konvensional atau jumlah “penalaran” yang dapat dikendalikan untuk menyelesaikan lebih banyak masalah yang melelahkan.

Antropik mengatakan model hybrid baru, yang disebut Claude 3.7, akan memudahkan pengguna dan pengembang untuk mengatasi masalah yang membutuhkan campuran output naluriah dan kogitasi langkah demi langkah. “Itu [user] Memiliki banyak kendali atas perilaku – seberapa lama itu dipikirkan, dan dapat memperdagangkan penalaran dan kecerdasan dengan waktu dan anggaran, ”kata Michael Gerstenhaber, pimpinan produk, platform AI di Anthropic.

Example 300x600

Claude 3.7 juga dilengkapi “ScratchPad” baru yang mengungkapkan proses penalaran model. Fitur serupa terbukti populer dengan Model AI China Deepseek. Ini dapat membantu pengguna memahami bagaimana suatu model bekerja karena masalah untuk memodifikasi atau memperbaiki petunjuk.

Dianne Penn, pemimpin produk penelitian di antropik, mengatakan ScratchPad bahkan lebih membantu ketika dikombinasikan dengan kemampuan untuk menggandengkan model “penalaran” model naik dan turun. Jika, misalnya, model berjuang untuk memecah masalah dengan benar, pengguna dapat memintanya untuk menghabiskan lebih banyak waktu untuk mengerjakannya.

Perusahaan AI Frontier semakin fokus untuk membuat model “beralasan” atas masalah sebagai cara untuk meningkatkan kemampuan mereka dan memperluas kegunaannya. Openai, perusahaan yang memulai booming AI saat ini dengan chatgpt, adalah yang pertama ditawarkan Model AI Alasan, yang disebut O1pada bulan September 2024. Openai sejak itu memperkenalkan a Versi yang lebih kuat yang disebut O3saat saingan Google telah merilis penawaran serupa untuk model Gemini, yang disebut Pemikiran flash. Dalam kedua kasus, pengguna harus beralih antara model untuk mengakses kemampuan penalaran – perbedaan utama dibandingkan dengan Claude 3.7.

Tampilan pengguna Claude 3.7

Atas perkenan Antropik

Perbedaan antara model konvensional dan penalaran yang mirip dengan dua jenis pemikiran yang dijelaskan oleh ekonom pemenang Nobel Michael Kahneman dalam bukunya 2011 Berpikir cepat dan lambat: Pemikiran Sistem-1 yang cepat dan naluriah dan pemikiran sistem-2 yang lebih lambat dan lebih lambat.

Jenis model yang memungkinkan chatgpt, yang dikenal sebagai model bahasa besar atau LLM, menghasilkan respons instan terhadap prompt dengan menanyakan jaringan saraf besar. Output ini bisa sangat pintar dan koheren tetapi mungkin gagal menjawab pertanyaan yang membutuhkan penalaran langkah demi langkah, termasuk aritmatika sederhana.

LLM dapat dipaksa untuk meniru penalaran yang disengaja jika diinstruksikan untuk membuat rencana yang harus diikuti kemudian. Trik ini tidak selalu dapat diandalkan, dan model biasanya berjuang untuk menyelesaikan masalah yang membutuhkan perencanaan yang luas dan hati -hati. Openai, Google, dan sekarang Antropik semuanya digunakan Metode pembelajaran mesin yang dikenal sebagai pembelajaran penguatan Untuk mendapatkan model terbaru mereka untuk belajar menghasilkan penalaran yang menunjuk pada jawaban yang benar. Ini membutuhkan pengumpulan data pelatihan tambahan dari manusia untuk memecahkan masalah tertentu.

Penn mengatakan bahwa mode penalaran Claude menerima data tambahan tentang aplikasi bisnis termasuk menulis dan memperbaiki kode, menggunakan komputer, dan menjawab pertanyaan hukum yang kompleks. “Hal -hal yang kami perbaikan adalah … subjek teknis atau subjek yang membutuhkan penalaran panjang,” kata Penn. “Apa yang kami miliki dari pelanggan kami sangat menarik dalam menggunakan model kami ke dalam beban kerja mereka yang sebenarnya.”

Antropik mengatakan bahwa Claude 3.7 sangat baik dalam memecahkan masalah pengkodean yang membutuhkan penalaran langkah demi langkah, mengungguli O1 Openai pada beberapa tolok ukur seperti SWE-Bench. Perusahaan ini saat ini merilis alat baru, yang disebut Claude Code, yang dirancang khusus untuk jenis pengkodean yang dibantu AI ini.

“Model ini sudah pandai pengkodean,” kata Penn. Tetapi “Pemikiran tambahan akan baik untuk kasus yang mungkin memerlukan perencanaan yang sangat kompleks – katakanlah Anda sedang mencari basis kode yang sangat besar untuk perusahaan.”