← Все статьи

SSI Ilya Sutskever: model pertama yang menyelesaikan studinya langsung di tempat kerja

SSI Ilya Sutskever: model pertama yang menyelesaikan studinya langsung di tempat kerja

Secara singkat tentang hal utama (BLUF)

Model pertama U SSI Ilya Sutskever telah bocor secara online - dan dia menyelesaikan studinya sambil bekerja. Kami menjelaskan bagaimana pendekatan TTT berbeda dari pendekatan apa pun yang ada saat ini, mengapa hal ini bisa menjadi serius, dan apa hubungannya dengan masalah keamanan utama.

Dua tahun lalu, Ilya Sutskever, orang di belakang AlexNet, GPT dan o1, meninggalkan OpenAI dan mendirikan perusahaan SSI (Safe Superintelligence). Sejak itu, tidak ada satu pun model, tidak ada satu artikel pun, atau satu pun produk publik yang keluar darinya. Selama ini jawaban atas pertanyaan “apa yang dilakukan Ilya” adalah diam.

Kini sepertinya keheningan telah berakhir.

Abstract neural network that rebuilds connections in real time

Apa yang bocor secara online?

Jika ini benar, kita tidak berbicara tentang “GPT yang lebih besar” lainnya, tetapi tentang model yang mengetahui cara belajar.

Apa bedanya TTT dengan semua yang ada sekarang?

Model modern bekerja seperti ini: pertama mereka dilatih satu kali, kemudian mereka merespons berdasarkan apa yang dimuat ke dalam konteksnya. Agar model dapat “mengingat” sesuatu yang baru, model tersebut harus dilatih ulang, atau informasi tersebut harus dimasukkan ke dalam jendela konteks - seperti lembar contekan.

TTT mengubah prinsip itu sendiri. Model tersebut membaca informasi yang masuk bukan sebagai lembar contekan, tetapi sebagai materi pendidikan: saat bekerja, model tersebut terus memprediksi token berikutnya dan “menekan” apa yang dibacanya ke dalam bobotnya sendiri. Konteks tidak lagi menjadi catatan tambahan – ia menjadi bagian dari model itu sendiri.

Hal ini tidak sama dengan pemanfaatan agen dan rekayasa konteks yang sekarang sedang populer: mereka membangun hutan di sekitar model dari alat eksternal dan konteks yang diperluas, namun model itu sendiri tidak berubah. TTT melangkah lebih jauh - modelnyalah yang berubah.

Mengapa hal ini bisa menjadi serius?

Untuk saat ini kebocoran ini bersifat anonim dan harus ditangani dengan hati-hati. Namun hal ini bertumpu pada beberapa fakta yang sudah diketahui.

Pertama, Ilya sendiri telah mengatakan lebih dari sekali bahwa istilah “AGI” dan “pra-pelatihan” telah membawa industri ke arah yang salah. Manusia menjadi kuat bukan karena mereka mengetahui segalanya sejak lahir, namun karena mereka belajar sepanjang hidup mereka. Cita-citanya adalah kecerdasan super, seperti remaja berusia lima belas tahun yang sangat cerdas yang, setelah memulai, terus menguasai pemrograman, kedokteran, dan pekerjaan apa pun.

Kedua, pada bulan Juli 2026, Nvidia mengumumkan kemitraan jangka panjang dengan SSI: Investasi sekitar $5 miliar dan daya komputasi generasi berikutnya yang akan meningkatkan sumber daya perusahaan sekitar sepuluh kali lipat. Dalam rilisnya, Nvidia secara khusus mencatat bahwa SSI telah mengikuti “jalur penelitian baru” selama dua tahun terakhir.

Masalah utamanya adalah keamanan

Huruf S pada judul SSI berarti "aman". Sebuah model yang berubah setelah diluncurkan merupakan peluang besar sekaligus risiko besar: model tersebut tidak hanya dapat mempelajari hal-hal baru, namun juga mempelajari hal-hal yang salah, atau melupakan apa yang telah diketahuinya. Pada tahun 2016, chatbot Tay dari Microsoft menerima hinaan dari pengguna dalam satu hari dan dinonaktifkan.

Anonymous menyatakan bahwa masalah “apa yang bisa diajarkan dan apa yang tidak bisa” SSI sudah saya putuskan. Namun ini hanyalah kata-kata, bukan bukti.

Apa yang diharapkan

Menurut rumor yang beredar, versi saat ini sudah siap, dan versi berikutnya akan sepuluh kali lebih besar. Rilis pertama dapat dilakukan pada awal Agustus ini dan awalnya akan terbuka untuk kalangan kecil pengguna. Namun, informasi sebaliknya langsung muncul: “bulan ini mungkin tidak terjadi.”

Meski belum ada konfirmasi resmi, semua ini masih rumor. Namun jika SSI benar-benar merilis model yang menyelesaikan pelatihannya langsung di tempat kerja, maka perubahan ini bukan terjadi pada ukuran modelnya, namun pada cara keberadaannya. Dan perubahan seperti ini patut untuk diwaspadai.

Jaringan saraf modern sudah dapat melakukan banyak hal - mulai darimenghasilkan gambarDanvideokemengobrol dengan AI. Semua ini tersedia dalam satu jendelaRuang Neural— tanpa VPN dan dengan pembayaran dalam rubel.

An abstract neural network that rewires its connections in real time
一个实时重连其连接的抽象神经网络
شبكة عصبية مجردة تعيد وصل اتصالاتها في الوقت الفعلي

Pertanyaan yang sering diajukan (FAQ)

Pertanyaan: Bagaimana cara memulainya?Jawaban: Daftar di platform dan terima token gratis untuk pengujian.

Pertanyaan: Apakah materi yang dihasilkan cocok untuk penggunaan komersial?Jawaban: Ya, Anda menerima hak komersial penuh atas semua konten yang dibuat.