← Összes cikk

SSI Ilya Sutskever: az első modell, aki közvetlenül a munkahelyén fejezi be tanulmányait

SSI Ilya Sutskever: az első modell, aki közvetlenül a munkahelyén fejezi be tanulmányait

Röviden a legfontosabbról (BLUF)

Az U SSI Ilya Sutskever első modellje kiszivárgott az interneten – és munka közben fejezi be tanulmányait. Elmagyarázzuk, miben tér el a TTT megközelítése mindentől, ami jelenleg létezik, miért lehet ez komoly, és mi köze ehhez a fő biztonsági kérdésnek.

Két évvel ezelőtt Ilya Sutskever, az AlexNet, a GPT és az o1 mögött álló ember elhagyta az OpenAI-t, és megalapította az SSI (Safe Superintelligence) céget. Azóta egyetlen modell, egyetlen cikk, egyetlen publikus termék sem került ki belőle. Egész idő alatt a válasz a „mit csinál Ilja” kérdésre csend volt.

Most úgy tűnik, a csend véget ér.

Abstract neural network that rebuilds connections in real time

Mi szivárgott ki a neten?

Ha ez igaz, akkor nem egy másik „nagyobb GPT-ről” beszélünk, hanem egy olyan modellről, amely tudja, hogyan kell tanulni.

Miben különbözik a TTT a mostanitól?

A modern modellek így működnek: először egyszer betanítják őket, majd a kontextusba betöltött adatok alapján reagálnak. Ahhoz, hogy a modell „emlékezzen” valami újdonságra, vagy újra kell képezni, vagy az információt be kell csúsztatni a kontextusablakba - mint egy csalólapot.

A TTT megváltoztatja az elvet. A modell nem csalólapként, hanem oktatási anyagként olvassa be a beérkező információkat: munka közben továbbra is megjósolja a következő tokent, és a beolvasottakat a saját súlyaiba „nyomja”. A kontextus már nem mellékes, hanem magának a modellnek a részévé válik.

Ez nem ugyanaz, mint a manapság divatos agent-harness és kontextus tervezés: külső eszközökből és kiterjesztett kontextusból erdőt építenek a modell köré, de maga a modell nem változik. A TTT egy lépéssel tovább megy – a modell változik.

Miért lehet ez komoly?

Egyelőre ez egy névtelen szivárgás, és óvatosan kell kezelni. De ez több már ismert tényen nyugszik.

Először is, maga Ilja nem egyszer mondta, hogy az „AGI” és az „előképzés” kifejezések rossz irányba vitték az iparágat. Az emberek nem azért erősek, mert születésüktől fogva mindent tudnak, hanem azért, mert egész életükben tanulnak. Ideálja a szuperintelligencia, mint egy nagyon okos tizenöt éves tinédzser, aki az indulás után továbbra is elsajátítja a programozást, az orvostudományt, bármilyen munkát.

Másodszor, 2026 júliusában az Nvidia bejelentette, hogy hosszú távú partnerséget köt az SSI-vel: körülbelül 5 milliárd dolláros befektetés és a következő generációs számítási teljesítmény, amely körülbelül tízszeresére növeli a vállalat erőforrásait. A kiadásban az Nvidia külön megjegyezte, hogy az SSI Az elmúlt két évben egy „új kutatási irányvonalat” követtem.

A fő kérdés a biztonság

Az S betű az SSI címben azt jelenti, hogy "biztonságos". Egy modell, amely az indulás után megváltozik, egyszerre hatalmas lehetőség és óriási kockázat: nemcsak új dolgokat tanulhat meg, hanem megtanulhatja a rossz dolgokat is, vagy elfelejtheti, amit már tud. 2016-ban a Microsoft Tay chatbotja egy napon belül sértéseket kapott a felhasználóktól, és letiltották.

Az Anonymous azt állítja, hogy a „mit lehet tanítani és mit nem” SSI problémát már eldöntöttem. De ezek még mindig szavak, nem bizonyítékok.

Mire számíthatunk

A pletykák szerint a jelenlegi verzió már készen van, a következő pedig tízszer nagyobb lesz. Az első kiadás már idén augusztusban megtörténhet, és kezdetben a felhasználók szűk köre számára nyílik meg. Azonban azonnal az ellenkező információ jelent meg: „lehet, hogy ebben a hónapban nem fog megtörténni”.

Bár hivatalos megerősítés nincs, mindez pletyka marad. De ha az SSI valóban kiad egy olyan modellt, amely közvetlenül a munkahelyén fejezi be a képzését, akkor ez nem a modell méretében, hanem létezésének módjában fog elmozdulni. Az ilyen váltásokra pedig érdemes odafigyelni.

A modern neurális hálózatok már sok mindenre képesek – attól kezdveképek generálásaÉsvideóhogychateljen az AI-val. Mindez egy ablakban érhető elNeuralSpace— VPN nélkül és rubel fizetéssel.

An abstract neural network that rewires its connections in real time
一个实时重连其连接的抽象神经网络
شبكة عصبية مجردة تعيد وصل اتصالاتها في الوقت الفعلي

Gyakran ismételt kérdések (GYIK)

Kérdés: Hogyan kezdjünk hozzá?Válasz: Regisztráljon a platformon, és ingyenes tokeneket kaphat a teszteléshez.

Kérdés: Az előállított anyagok alkalmasak kereskedelmi használatra?Válasz: Igen, teljes kereskedelmi jogot kap az összes létrehozott tartalomhoz.