Внутри LLM нашли слой «до слов»
Григорьев Арсений АндреевичИсследователь покопался во внутренних представлениях модели и выделил направление, связанное со смыслом до превращения в текст. Если усиливать его, модель отвечала осторожнее и чаще перепроверяла себя; если ослаблять — становилась резче.
Полностью прочитать этот «внутренний ход мыслей» пока не вышло, но ближе к ответу он проявлялся сразу на нескольких языках.
Читать в TelegramЧитать в МАКС









