SSI Ilya Sutskever: model pertama yang menamatkan pengajiannya secara langsung di tempat kerja
Secara ringkas tentang perkara utama (BLUF)
Model pertama U SSI Ilya Sutskever telah bocor dalam talian - dan dia sedang menamatkan pengajiannya sambil bekerja. Kami menerangkan cara pendekatan TTT berbeza daripada segala-galanya yang wujud sekarang, mengapa ini boleh menjadi serius, dan apa kaitan isu keselamatan utama dengannya.
Dua tahun lalu, Ilya Sutskever, lelaki di belakang AlexNet, GPT dan o1, meninggalkan OpenAI dan mengasaskan syarikat SSI (Safe Superintelligence). Sejak itu, tidak ada satu model, tidak satu artikel, atau satu produk awam yang keluar daripadanya. Selama ini, jawapan kepada soalan "apa yang Ilya buat" adalah senyap.
Kini nampaknya kesunyian telah berakhir.

Apa yang dibocorkan dalam talian?
Jika ini benar, kita tidak bercakap tentang satu lagi "GPT yang lebih besar", tetapi tentang model yang tahu cara belajar cara belajar.
Bagaimanakah TTT berbeza daripada semua yang wujud sekarang?
Model moden berfungsi seperti ini: mula-mula mereka dilatih sekali, kemudian mereka bertindak balas berdasarkan apa yang dimuatkan ke dalam konteks. Untuk membolehkan model "mengingat" sesuatu yang baharu, model itu mesti sama ada dilatih semula atau maklumat mesti diselitkan ke dalam tetingkap konteks - seperti helaian curang.
TTT mengubah prinsipnya. Model itu membaca maklumat masuk bukan sebagai helaian tipu, tetapi sebagai bahan pendidikan: semasa bekerja, ia terus meramalkan token seterusnya dan "menekan" apa yang dibacanya ke dalam pemberatnya sendiri. Konteks tidak lagi menjadi nota sampingan - ia menjadi sebahagian daripada model itu sendiri.
Ini tidak sama dengan kejuruteraan abah ejen dan konteks yang kini bergaya: mereka membina hutan di sekeliling model daripada alat luaran dan konteks lanjutan, tetapi model itu sendiri tidak berubah. TTT melangkah lebih jauh - model yang berubah.
Mengapa ini boleh menjadi serius?
Buat masa ini ini adalah kebocoran tanpa nama dan harus ditangani dengan berhati-hati. Tetapi ia bergantung pada beberapa fakta yang telah diketahui.
Pertama, Ilya sendiri telah mengatakan lebih daripada sekali bahawa istilah "AGI" dan "pra-latihan" telah membawa industri ke arah yang salah. Orang kuat bukan kerana mereka tahu segala-galanya sejak lahir, tetapi kerana mereka belajar sepanjang hidup mereka. Idealnya adalah superintelligence, seperti seorang remaja berusia lima belas tahun yang sangat pintar yang, selepas bermula, terus menguasai pengaturcaraan, perubatan, apa-apa pekerjaan.
Kedua, pada Julai 2026, Nvidia mengumumkan perkongsian jangka panjang dengan SSI: Pelaburan kira-kira $5 bilion dan kuasa pengkomputeran generasi akan datang yang akan meningkatkan sumber syarikat sebanyak kira-kira sepuluh kali ganda. Dalam keluaran tersebut, Nvidia secara khusus menyatakan bahawa SSI Selama dua tahun kebelakangan ini saya telah mengikuti "garisan penyelidikan baharu".
Isu utama adalah keselamatan
Huruf S dalam tajuk SSI bermaksud "selamat". Model yang berubah sendiri selepas pelancaran adalah peluang besar dan risiko besar: ia bukan sahaja boleh mempelajari perkara baharu, tetapi juga mempelajari perkara yang salah, atau melupakan perkara yang sudah diketahuinya. Pada 2016, chatbot Tay daripada Microsoft menerima penghinaan daripada pengguna dalam masa sehari dan telah dilumpuhkan.
Anonymous menyatakan bahawa masalah "apa yang boleh diajar dan apa yang tidak" SSI saya sudah putuskan. Tetapi ini masih perkataan, bukan bukti.
Apa yang diharapkan
Menurut khabar angin, versi semasa sudah sedia, dan yang seterusnya akan menjadi sepuluh kali lebih besar. Keluaran pertama boleh berlangsung seawal Ogos ini dan pada mulanya akan dibuka kepada kalangan kecil pengguna. Walau bagaimanapun, maklumat yang bertentangan segera muncul: "bulan ini mungkin tidak berlaku."
Walaupun tiada pengesahan rasmi, semua ini kekal khabar angin. Tetapi jika SSI benar-benar akan mengeluarkan model yang sedang melengkapkan latihannya secara langsung di tempat kerja, ini akan menjadi anjakan bukan dalam saiz model, tetapi dalam cara kewujudannya. Dan peralihan sedemikian patut diperhatikan.
Rangkaian saraf moden sudah boleh melakukan banyak perkara - daripadamenghasilkan gambarDanvideokepadaberbual dengan AI. Semua ini tersedia dalam satu tetingkap padaNeuralSpace— tanpa VPN dan dengan pembayaran dalam rubel.



Soalan lazim (FAQ)
Soalan: Bagaimana untuk bermula?Jawapan: Daftar di platform dan terima token percuma untuk ujian.
Soalan: Adakah bahan yang dihasilkan sesuai untuk kegunaan komersial?Jawapan: Ya, anda menerima hak komersial penuh untuk semua kandungan yang dibuat.