← Все статьи

SSI Ilya Sutskever: pierwsza modelka, która kończy studia bezpośrednio w pracy

Abstrakcyjna sieć neuronowa przebudowująca połączenia w czasie rzeczywistym

Krótko o najważniejszym (BLUF)

U SSI Do sieci wyciekł pierwszy model Ilyi Sutskever, która w trakcie pracy kończy studia. Wyjaśniamy, czym podejście TTT różni się od wszystkiego, co istnieje obecnie, dlaczego może to być poważne i co ma z tym wspólnego główny problem bezpieczeństwa.

Dwa lata temu Ilya Sutskever, twórca AlexNet, GPT i o1, opuścił OpenAI i założył firmę SSI (Bezpieczna superinteligencja). Od tego czasu nie wyszedł z niej ani jeden model, ani jeden artykuł, ani jeden produkt publiczny. Przez cały ten czas odpowiedzią na pytanie „co robi Ilya” była cisza.

Teraz wygląda na to, że cisza się skończyła.

Abstrakcyjna sieć neuronowa przebudowująca połączenia w czasie rzeczywistym

Co wyciekło do sieci?

Jeśli to prawda, to nie mówimy o kolejnym „większym GPT”, ale o modelu, który wie, jak się uczyć, jak się uczyć.

Czym TTT różni się od wszystkiego, co istnieje obecnie?

Nowoczesne modele działają w ten sposób: najpierw są szkolone raz, a następnie reagują na podstawie tego, co jest ładowane do kontekstu. Aby model „zapamiętał” coś nowego, należy go albo przeszkolić, albo informacje należy wsunąć do okna kontekstowego – niczym ściągawkę.

TTT zmienia samą zasadę. Model odczytuje przychodzące informacje nie jako ściągawkę, ale jako materiał edukacyjny: podczas pracy kontynuuje przewidywanie kolejnego żetonu i „wciska” to, co przeczytał, na swoje własne wagi. Kontekst przestaje być notką na marginesie – staje się częścią samego modelu.

To nie to samo, co modne obecnie łączenie agentów i inżynieria kontekstowa: budują las wokół modelu z zewnętrznych narzędzi i rozszerzonego kontekstu, ale sam model się nie zmienia. TTT idzie o krok dalej – zmienia się model.

Dlaczego to może być poważne?

Na razie jest to wyciek anonimowy i należy go traktować z ostrożnością. Ale opiera się na kilku znanych już faktach.

Po pierwsze, sam Ilya niejednokrotnie powtarzał, że terminy „AGI” i „szkolenie wstępne” skierowały branżę w złym kierunku. Ludzie są silni nie dlatego, że wiedzą wszystko od urodzenia, ale dlatego, że uczą się przez całe życie. Jego ideałem jest superinteligencja, niczym bardzo mądry piętnastoletni nastolatek, który po rozpoczęciu kontynuuje naukę programowania, medycyny, jakiejkolwiek pracy.

Po drugie, w lipcu 2026 roku Nvidia ogłosiła długoterminowe partnerstwo z SSI: Inwestycja o wartości około 5 miliardów dolarów i moc obliczeniowa nowej generacji, która zwiększy zasoby firmy około dziesięciokrotnie. W wydaniu Nvidia wyraźnie to zauważyła SSI Od dwóch lat podążam „nowym kierunkiem badań”.

Główną kwestią jest bezpieczeństwo

Litera S w tytule SSI oznacza „bezpieczny”. Model, który zmienia się po premierze, to zarówno ogromna szansa, jak i ogromne ryzyko: może nie tylko nauczyć się nowych rzeczy, ale także nauczyć się niewłaściwych rzeczy lub zapomnieć to, co już wie. W 2016 r. chatbot Tay firmy Microsoft wychwytywał obelgi od użytkowników w ciągu jednego dnia i został wyłączony.

Anonymous stwierdza, że ​​problem „czego można uczyć, a czego nie” SSI Już zdecydowałem. Ale to wciąż słowa, a nie dowód.

Czego się spodziewać

Według plotek obecna wersja jest już gotowa, a następna będzie dziesięciokrotnie większa. Pierwsze wydanie może nastąpić już w sierpniu tego roku i początkowo będzie dostępne dla niewielkiego kręgu użytkowników. Jednak od razu pojawiła się informacja odwrotna: „w tym miesiącu może nie dojść do skutku”.

Chociaż nie ma oficjalnego potwierdzenia, wszystko to pozostaje plotkami. Ale jeśli SSI faktycznie wypuści model, który kończy szkolenie bezpośrednio w pracy, będzie to zmiana nie w wielkości modelu, ale w samym sposobie jego istnienia. I warto na takie zmiany zwracać uwagę.

Nowoczesne sieci neuronowe potrafią już wiele – m.in generowanie zdjęć I wideo Do porozmawiać z AI. Wszystko to dostępne jest w jednym oknie na NeuralSpace — bez VPN i z płatnością w rublach.

Abstrakcyjna sieć neuronowa, która zmienia swoje połączenia w czasie rzeczywistym
一个实时重连其连接的抽象神经网络
شبكة عصبية مجردة تعيد وصل اتصالاتها في الوقت الفعلي

Często zadawane pytania (FAQ)

Pytanie: Jak zacząć? Odpowiedź: Zarejestruj się na platformie i odbierz darmowe tokeny do testów.

Pytanie: Czy wygenerowane materiały nadają się do użytku komercyjnego? Odpowiedź: Tak, otrzymujesz pełne prawa komercyjne do wszystkich stworzonych treści.