|

Anthropic обнаружила у Claude механизм, напоминающий человеческое сознание

Исследователи Anthropic опубликовали новую научную работу, в которой сообщили об обнаружении у языковой модели Claude внутреннего механизма, напоминающего принцип работы человеческого сознания. При этом компания подчёркивает, что речь не идёт о появлении настоящего сознания — открытие лишь помогает лучше понять, как современные ИИ-модели принимают решения.

Что такое глобальное рабочее пространство

В основе исследования лежит теория глобального рабочего пространства — одна из наиболее известных концепций современной нейронауки.

Согласно этой теории, большая часть процессов в человеческом мозге происходит автоматически, тогда как лишь небольшое количество информации попадает в своеобразную область «осознанного внимания», где используется для анализа, рассуждений и принятия решений.

По словам исследователей, внутри Claude удалось обнаружить схожий механизм, который получил название J-space.

Учёные создали инструмент для изучения мышления ИИ

Чтобы исследовать внутренние процессы языковой модели, специалисты Anthropic разработали специальный инструмент J-lens.

Он позволяет анализировать промежуточные вычисления нейросети и наблюдать, какие внутренние представления используются моделью во время формирования ответа.

Claude использует J-space как «черновик»

Во время экспериментов исследователи заметили интересную особенность.

При решении сложных задач — например, анализе шахматных позиций или логических головоломок — Claude сначала переносит ключевые концепции в область J-space, после чего использует её как своеобразный внутренний «черновик» для дальнейших рассуждений.

Более того, изменение информации внутри этой области напрямую влияло на итоговый ответ модели, что говорит о её важной роли в процессе принятия решений.

Механизм возник без участия разработчиков

Одним из самых неожиданных выводов исследования стало то, что архитектура J-space не была специально заложена инженерами Anthropic.

По утверждению авторов работы, этот механизм сформировался самостоятельно в процессе обучения модели, без явного программирования со стороны разработчиков.

Почему это важно

В Anthropic сравнивают это явление с конвергентной эволюцией — процессом, при котором совершенно разные системы независимо приходят к схожим эффективным решениям.

Исследователи предполагают, что подобная архитектура может оказаться одним из наиболее эффективных способов обработки сложной информации как для биологических систем, так и для искусственного интеллекта.

При этом в компании отдельно подчёркивают: обнаружение J-space не означает, что Claude обладает сознанием. Речь идёт лишь о сходстве некоторых принципов обработки информации, а не о появлении самосознания или человеческого мышления.

Поделиться:

Интересные

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *