Az Anthropic feltárta Claude mesterséges intelligenciájának rejtett munkaterületét
Az Anthropic új »J-lens« nevű eszközével sikerült megjelenítenie a Claude AI-modell belső működésének egy olyan aspektusát, amely egy vezető tudatosságelméletet tükröz.
Az Anthropic kutatói egy új vizualizációs módszert fejlesztettek ki, amely »J-lens« néven ismert, és amely betekintést nyújt a Claude nyelvi modell belső folyamataiba. Az eszköz egy »csendes munkaterületet« tár fel, amely a modell gondolkodási folyamatainak egy korábban rejtett rétegét mutatja meg.
A felfedezés különösen érdekes, mivel az azonosított belső mechanizmusok párhuzamot mutatnak egy vezető tudatosságelméleti modellel. Ez arra utal, hogy az AI-rendszerek bizonyos aspektusai hasonló elvek alapján működhetnek, mint amelyeket a tudatosság kutatói azonosítottak.
A kutatás az AI-modellek átláthatóságának és értelmezhetőségének növelésére irányuló szélesebb törekvés része. Az Anthropic célja, hogy jobban megértsük, hogyan működnek a nagy nyelvi modellek belülről, ami segíthet az AI-rendszerek biztonságosabbá és megbízhatóbbá tételében.
Forrás: VentureBeat — „Anthropic's new "J-lens" reveals a silent workspace inside Claude that mirrors a leading theory of consciousness - VentureBeat”
Ez az összefoglaló a fenti forrás alapján, mesterséges intelligenciával készült. Szerkesztőségi ellenőrzésen nem esett át; a részletekért olvasd el az eredeti cikket.