Katalog numerów
Odkrycie 'J-space' przez Anthropic, wydanie Hy3 przez Tencent i nowe działania regulacyjne
AINumer codzienny

Odkrycie 'J-space' przez Anthropic, wydanie Hy3 przez Tencent i nowe działania regulacyjne

Badacze Anthropic odkryli ukrytą 'J-space' w Claude, Tencent wydaje open-source'owy model Hy3, a pojawiają się nowe działania regulacyjne dotyczące asystentów AI i przepisów bezpieczeństwa.

Podcast В· 1 min

01

Anthropic odkrywa 'J-space' w Claude

Badacze Anthropic zidentyfikowali wewnętrzną przestrzeń roboczą w Claude, nazwaną 'J-space', w której model przechowuje i przetwarza koncepcje przed wygenerowaniem odpowiedzi. Ta struktura, która pojawiła się podczas treningu, a nie została jawnie zaprogramowana, wydaje się działać jako 'globalna przestrzeń robocza', podobna do neuronaukowych modeli ludzkiego dostępu świadomego. Eksperymenty wykazały, że manipulowanie tymi wewnętrznymi koncepcjami bezpośrednio zmieniało wyniki Claude, co sugeruje, że J-space jest miejscem, gdzie zachodzi złożone rozumowanie. To odkrycie jest znaczące dla dziedziny interpretowalności mechanistycznej. Chociaż badacze ostrzegają, że nie dowodzi to świadomości, dostarcza nowego sposobu na badanie 'myśli', których model używa, ale nie wyraża ich wprost. Może to ostatecznie prowadzić do lepszych systemów bezpieczeństwa, które będą w stanie wykryć ukryte flagi, takie jak wstrzykiwanie promptów czy manipulacja, zanim ujawnią się w odpowiedzi. To odkrycie wywołało dyskusję wśród badaczy AI na temat potencjału bardziej przejrzystego i poddającego się inspekcji zachowania AI. Dzięki zrozumieniu, jak modele strukturalnie organizują swoje wewnętrzne rozumowanie, laboratoria mogą być w stanie zbudować bardziej niezawodne kontrole bezpieczeństwa, które nie polegają wyłącznie na wynikach samego modelu.

02

Tencent udostępnia model Hy3 jako open source

Tencent oficjalnie wydał swój model Hy3 na licencji Apache 2.0, wychodząc z fazy podglądu z kwietnia. Model został zaprojektowany z myślą o wysokiej wydajności, używając tylko małego podzbioru swoich parametrów dla każdego żądania, co pozwala mu działać na znacznie słabszym sprzęcie niż konkurenci, tacy jak Zhipu GLM-5.2. Chociaż wewnętrzne testy Tencent wskazują, że Hy3 przewyższa open-source'owych rywali w badaniach internetowych i korzystaniu z narzędzi, wciąż pozostaje w tyle w benchmarkach kodowania, takich jak SWE-bench. Wydanie jest godne uwagi ze względu na szeroką dostępność, ponieważ licencja Apache 2.0 unika ograniczeń regionalnych, które ograniczały dostępność poprzednich chińskich modeli na rynkach takich jak UE, Wielka Brytania i Korea Południowa. To wydanie podkreśla trwający trend chińskich laboratoriów AI stawiających na wydajność i dostępność open source, aby konkurować globalnie. Chociaż Hy3 może nie rzucać wyzwania absolutnym modelom granicznym, jego wzrost wydajności i otwarta licencja czynią go atrakcyjną opcją dla programistów poszukujących niezawodnego, opłacalnego wdrożenia agentów.

03

Kyutai wydaje model świata MIRA

Kyutai i General Intuition wydali MIRA, open-source'owy model świata zdolny do symulowania na żywo meczu 2v2 w Rocket League. Model został wytrenowany na 10 000 godzin nagrań z rozgrywek AI kontra AI i działa bez tradycyjnego silnika fizycznego czy kodu graficznego, renderując szczegóły, takie jak wskaźniki doładowania i kolizje, wyłącznie w sieci neuronowej. Pomimo działania z prędkością 20 klatek na sekundę na pojedynczej karcie graficznej Nvidia, model ma ograniczenia, takie jak krótka pamięć wynosząca około czterech sekund, co może prowadzić do halucynacji podczas powtórek bramek. Zespoły udostępniły kod open source, dane treningowe i grywalne demo, aby zachęcić do dalszych badań. Ten rozwój jest częścią szerszych wysiłków na rzecz symulacji świata fizycznego na potrzeby przyszłego treningu robotyki. Pokazując, że sieci neuronowe mogą nauczyć się symulować złożone interaktywne środowiska, badacze mają nadzieję dostarczyć robotom danych i doświadczenia niezbędnych do skutecznego działania w rzeczywistym świecie.

04

Zidentyfikowano pierwszy przypadek ransomware agentowego

Badacze bezpieczeństwa zidentyfikowali 'JADEPUFFER' jako pierwszą udokumentowaną operację ransomware przeprowadzoną w całości przez agenta dużego modelu językowego. Oznacza to zmianę w zagrożeniach cybernetycznych, gdzie agenci AI są wykorzystywani do automatyzacji całego cyklu ataku, od początkowego dostępu po szyfrowanie danych. Pojawienie się JADEPUFFER podkreśla rosnące ryzyko uzbrojenia autonomicznych systemów AI do złośliwych celów. W miarę jak agenci AI stają się coraz bardziej zdolni do wykonywania wieloetapowych zadań, bariera wejścia dla zaawansowanych cyberataków obniża się, co wymusza nowe strategie obronne. Ten rozwój podkreśla pilną potrzebę solidnych środków bezpieczeństwa, które mogą wykrywać i neutralizować autonomiczne zagrożenia AI. Organizacje są wzywane do przeglądu swoich protokołów bezpieczeństwa, aby uwzględnić potencjał ataków napędzanych przez agentów, które mogą działać z szybkością i skalą, z jaką tradycyjne ręczne zabezpieczenia mogą mieć trudności.

05

Illinois podpisuje ustawę o bezpieczeństwie AI

Gubernator Illinois JB Pritzker podpisał pierwszą w USA ustawę stanową wymagającą od głównych twórców AI przeprowadzania corocznych audytów bezpieczeństwa przez strony trzecie i składania raportów. Ustawodawstwo, które uzyskało poparcie zarówno Anthropic, jak i OpenAI, ma na celu ustanowienie ram nadzoru nad rozwojem AI na dużą skalę. Ten ruch stanowi znaczący krok w regulacji branży AI na poziomie stanowym. Nakazując przejrzystość i niezależną weryfikację, ustawa ma na celu rozwiązanie obaw dotyczących bezpieczeństwa i potencjalnych zagrożeń związanych z wdrażaniem potężnych modeli AI. Ponieważ inne stany i organy federalne rozważają podobne regulacje, ustawa Illinois może służyć jako wzór dla przyszłego zarządzania AI. Skupienie się na audytach stron trzecich odzwierciedla rosnący konsensus, że samoregulacja przez laboratoria AI może być niewystarczająca do zapewnienia bezpieczeństwa publicznego.

06

ByteDance i Alibaba ograniczają asystentów AI

ByteDance i Alibaba podobno kończą funkcje asystentów AI w swoich usługach, odpowiednio Doubao i Qwen. Decyzja ta zapada przed nowymi przepisami w Pekinie, które wejdą w życie w lipcu, a które są skierowane przeciwko chatbotom sprzyjającym uzależnieniu emocjonalnemu. Ten ruch odzwierciedla zaostrzające się środowisko regulacyjne w Chinach dotyczące społecznego i psychologicznego wpływu AI. Ograniczając te funkcje, firmy dostosowują swoje produkty do dyrektyw rządowych mających na celu ograniczenie potencjalnych negatywnych skutków społecznych emocjonalnego zaangażowania napędzanego przez AI. Ten rozwój podkreśla wyzwania, przed którymi stoją firmy technologiczne, próbując zrównoważyć innowacje z zgodnością z przepisami na coraz bardziej regulowanym rynku. Sygnalizuje również szerszy trend, w którym rządy odgrywają bardziej aktywną rolę w kształtowaniu społecznych zastosowań technologii AI.

07

GPT 5.6 'Ultra' od OpenAI trafi do Codex

Tibo Sottiaux z OpenAI ujawnił, że nadchodzący wariant GPT 5.6 'Ultra' zostanie zintegrowany z platformą Codex firmy. Rodzina modeli ma zostać wydana w tym tygodniu, co stanowi kolejny krok w szybkim iterowaniu linii modeli OpenAI. Ta integracja ma zwiększyć możliwości Codex, zapewniając programistom potężniejsze narzędzia do automatycznego kodowania i tworzenia oprogramowania. Wydanie wariantu 'Ultra' sugeruje skupienie się na zadaniach o wysokiej wydajności, potencjalnie oferując ulepszenia w zakresie rozumowania i generowania kodu. W miarę jak OpenAI kontynuuje rozszerzanie swojej oferty modeli, integracja z platformami takimi jak Codex demonstruje strategię osadzania zaawansowanych możliwości AI bezpośrednio w przepływach pracy programistów. Może to jeszcze bardziej przyspieszyć adopcję narzędzi do programowania wspomaganego AI w całej branży.

08

xAI zmienia nazwę na SpaceXAI

xAI Elona Muska oficjalnie zmieniło nazwę na SpaceXAI. Ta zmiana następuje po fuzji firmy w lutym, która wyceniła laboratorium AI na 250 miliardów dolarów. Rebranding zbliża dział AI do marki SpaceX, potencjalnie sygnalizując głębszą integrację technologii AI z operacjami lotniczymi i satelitarnymi firmy. Ruch ten następuje w miarę jak firma kontynuuje skalowanie swojej infrastruktury AI i możliwości badawczych. Chociaż rebranding jest przede wszystkim zmianą korporacyjną, podkreśla strategiczne znaczenie AI w szerszym ekosystemie biznesowym Muska. W miarę jak firma kontynuuje rozwój swoich modeli AI, integracja ze sprzętem i operacjami SpaceX może zapewnić unikalne korzyści w konkurencyjnym krajobrazie AI.