Внутри «разума» Claude: Anthropic обнаружила пространство для скрытых рассуждений
Anthropic выявила в модели Claude внутреннюю рабочую область, названную J-space, где происходит скрытая обработка данных перед выдачей ответа. Это своего рода «черновик», который позволяет модели планировать сложные действия и даже распознавать попытки манипуляции.
Для тех, кто внедряет ИИ в продукты, это открывает возможность аудита: теперь можно заглянуть в то, что нейросеть «думает» на самом деле, а не только в то, что она говорит пользователю.
Ссылка: https://www-cdn.anthropic.com/files/4zrzovbb/website/cc4be2488d65e54a6ed06492f8968398ddc18ebe.pdf @AIandproducts