Аватар для arh
1 / 1 / 0
Регистрация: 15.11.2013
Сообщений: 49

Это новый этап развития AI?

20.06.2026, 12:35. Показов 6047. Ответов 70

Студворк — интернет-сервис помощи студентам
SymFSM: Попытка вытащить рассуждение из токенов. Взгляд со стороны

Последние пару лет развитие AI шло по довольно предсказуемой траектории. Индустрия решала почти любую проблему одним и тем же способом: масштабированием.

Больше параметров.
Больше контекста.
Больше GPU.
Больше агентов.
Больше инструментов.

Сначала появились retrieval-системы и RAG, которые научили модели ходить во внешние базы знаний. Затем пришёл бум агентных архитектур, где LLM получила возможность использовать поисковые системы, SQL, браузеры, IDE и десятки специализированных API. Позже появился MCP, пытающийся стандартизировать весь этот хаос и превратить зоопарк интеграций в единое пространство инструментов.

Но если посмотреть на всё это глазами системного инженера, становится заметна любопытная вещь.

Несмотря на огромное количество новых аббревиатур, почти все современные архитектуры опираются на один и тот же фундаментальный механизм: вероятностную генерацию токенов. Неважно, сколько агентов участвует в процессе. Неважно, сколько инструментов подключено к модели. Неважно, работает ли система через RAG, MCP или собственный оркестратор. В конце цепочки всё равно находится LLM, которая принимает решение через прогноз следующего токена. По сути, это строительство небоскрёба путём подбрасывания кирпичей вверх — рано или поздно конструкция рухнет под собственной энтропией.

Именно поэтому многие исследователи всё чаще задают неприятный вопрос:

А что если проблема современных AI заключается не в недостатке знаний (их уже переизбыток), а в отсутствии формализованной структуры рассуждений? Что если мы пытаемся решить задачу комбинаторной логики с помощью статистического угадывания следующего слова?

На этом фоне появляется довольно необычный проект — SymFSM.

От текста к структуре: вынос логики за скобки

Основная идея SymFSM выглядит неожиданно простой и напоминает старую инженерную мудрость: "Сначала начерти, потом строй". Вместо того чтобы сразу запускать LLM в режиме "пекла с шашкой наголо", система сначала пытается построить структурное представление задачи.

Разработчики называют это когнитивной картой. По сути это промежуточная формальная модель, существующая вне контекстного окна модели. Это не просто набор фактов, а полноценный чертёж, содержащий:

Цели (целевые состояния системы);

Ограничения (инварианты, которые нельзя нарушать);

Сущности (объекты предметной области);

Зависимости (прямые и обратные связи между сущностями);

Гипотезы (предположительные состояния);

Условия достижимости (верификация маршрута от текущего состояния к целевому).

В отличие от обычного Chain-of-Thought, эта структура существует не в виде последовательности токенов в промпте. Это критическое отличие. В классическом CoT рассуждение остаётся обычным текстом. Для модели нет разницы между логическим выводом и художественным рассказом — всё хранится как поток байт. В SymFSM часть рассуждения переводится в вычислимое представление — граф, с которым могут работать детерминированные алгоритмы, а не вероятностная нейросеть.

Именно здесь начинается самое интересное.
FSM как компилятор рассуждений

Название проекта раскрывает основной механизм: Finite State Machine (Конечные автоматы). Технология далеко не новая. Она лежит в основе компиляторов, сетевых протоколов, промышленных контроллеров и систем управления ракетами. Её главное преимущество перед LLM — детерминированность. Если автомат находится в состоянии A и получает событие B, переход всегда будет одинаковым.

В SymFSM автоматы используются не для генерации текста, а для управления процессом рассуждения. Упрощённо пайплайн выглядит так:
text

Запрос

[Семантический парсинг] → Когнитивная карта (граф)

[FSM-верификация] → Проверка достижимости целей (алгоритмы поиска путей)

[Обнаружение разрывов] → Автоматическая коррекция структуры

LLM (Генерация финального ответа по валидной карте)

Ответ

Получается любопытное разделение обязанностей:

Автоматы отвечают за вариантность и корректность структуры. Они проверяют, существует ли вообще путь от точки А к точке Б, не нарушая ограничений. Это чистая математика.

Языковая модель отвечает за семантическую интерпретацию и генерацию (озвучивание маршрута).

В некотором смысле это напоминает разделение между компилятором и процессором: первый проверяет синтаксис и валидность кода (детерминированно), второй выполняет операции. Мы перестаём гадать на кофейной гуще токенов, существует ли решение — мы начинаем вычислять структуру рассуждений как математическую задачу.
Почему это вообще может работать?

Большая часть ошибок современных LLM связана вовсе не с отсутствием знаний. Современные модели знают слишком много; проблема возникает в логических переходах между этими знаниями. Именно там появляются галлюцинации, потеря контекста, логические циклы, противоречия и ложные причинно-следственные связи.

С точки зрения теории графов многие подобные проблемы выглядят как дефекты структуры. Модель знает вершины графа (факты), но не всегда корректно строит ребра (связи) между ними. SymFSM пытается решить именно эту задачу, вводя дополнительный вычислительный слой, который анализирует валидность ребер до того, как модель начнет генерировать текст.
Рекурсивные карты и динамическое планирование

Особенно интересной выглядит рекурсивная часть архитектуры. В последних версиях проекта заявлен механизм, при котором модель способна инициировать перестроение карты прямо во время генерации ответа.

Если LLM в процессе вывода натыкается на нестыковку или недостаток данных, она отправляет системе запрос: "Эй, автомат, построй-ка мне локальную карту для этого подвопроса". Получается живой цикл обратной связи:
text

LLM

Обнаружение неопределенности / разрыва

Запрос на расширение / уточнение карты

FSM-анализ подзапроса (выделение подграфа)

Обновление глобальной структуры

Продолжение генерации

С инженерной точки зрения это уже напоминает не статический prompt engineering, а полноценную систему управления состояниями с динамическим перепланированием. Карта задачи больше не является скучным статичным файлом — она дышит, растет и уточняется прямо на лету, приближаясь к концепции "мышления в реальном времени".
Практическая проверка на GPQA: Цифры и стенд

Любые красивые архитектурные схемы имеют смысл только тогда, когда показывают результат на независимых тестах. Проведем анализ бенчмарка, который был использован для валидации подхода.

Для проверки использовался GPQA Main (Graduate-Level Google-Proof Q&A) — один из самых сложных современных академических бенчмарков для языковых моделей. Набор содержит 448 экспертных задач по физике, химии и биологии. Каждый вопрос представляет собой задачу multiple-choice с четырьмя вариантами ответа, где требуется выбрать только один правильный.

Конфигурация эксперимента:
Для эксперимента был реализован отдельный тестовый стенд. Система автоматически загружала полный датасет, выполняла случайную перестановку вариантов ответов (чтобы исключить эффект позиционного смещения), отправляла задания через API с асинхронной обработкой для параллельного выполнения десятков запросов, получала ответы модели в JSON-формате, валидировала результаты и сохраняла полный журнал выполнения. Важно отметить, что в обоих тестах использовалась одна и та же языковая модель. Менялся только режим работы: стандартная генерация против генерации через SymFSM.

Результаты:
Режим Правильных ответов Точность (Accuracy)
Стандартная LLM 282 из 448 62,95%
LLM + SymFSM 314 из 448 70,09%

Анализ улучшений:
Применение SymFSM увеличило точность на 7,14 процентных пункта при идентичном наборе тестовых данных. В абсолютных цифрах это +32 дополнительных правильных ответа. Ключевой вывод: улучшение было получено без изменения весов модели, дополнительного обучения, RLHF или fine-tuning. Фактически речь идёт о чисто архитектурном улучшении процесса рассуждения за счет добавления внешнего детерминированного слоя верификации.
Это новый этап развития AI?

Пока делать громкие выводы рано. SymFSM не выглядит как «убийца GPT» и не пытается заменить существующие модели. Скорее наоборот — он напоминает дополнительный инженерный щит и навигатор, который располагается между пользователем и языковой моделью. У него есть API, и он прекрасно уживается с более чем 150 современными моделями от любых провайдеров.

Главный вопрос заключается не в том, станет ли SymFSM новым стандартом индустрии. Гораздо интереснее другое. Последние годы AI развивался почти исключительно за счёт масштабирования. SymFSM предлагает альтернативную идею: не увеличивать интеллект через количество параметров, а повышать качество рассуждений через формализацию структуры мышления.

Мы устали от бесконечной гонки вооружений. Устали накидывать терабайты данных в надежде, что модель вдруг поумнеет. Если подход SymFSM окажется жизнеспособным, следующий крупный скачок в AI произойдет не из-за появления модели на несколько триллионов параметров, а из-за появления вычислимых механизмов управления рассуждением, которые работают поверх уже существующих LLM. И это выглядит значительно интереснее, чем очередной «GPT-ультра-мега-макс».
0
cpp_developer
Эксперт
20123 / 5690 / 1417
Регистрация: 09.04.2010
Сообщений: 22,546
Блог
20.06.2026, 12:35
Ответы с готовыми решениями:

Основные направления развития ИИ
Обычно, когда я начинаю заниматься какой-то новой для себя областью, я начинаю с того, что...

Влияние развития ИИ на удешевление промышленного производства
В этой теме хотелось бы обсудить только экономический аспект применения ИИ в мировой обрабатывающей...

После 6000 итераций график ошибки резко ушел вниз и нашел новый минимум RMSE. как это интерпретировать?
Почему ломается монотонность? Я и раньше видел такие графики... и таких изломов было больше.

70
 Аватар для arh
1 / 1 / 0
Регистрация: 15.11.2013
Сообщений: 49
22.06.2026, 21:10  [ТС]
Студворк — интернет-сервис помощи студентам
думаешь тебя спрашивали о совете? я тебе не заплачу, ни тысячу, ни десять - как ты говоришь судя по твоей статье где критика - ты не очень дальновидный вроде.. нет, зачатки какие-то есть, запятые ставить, там буквы всякие...
0
821 / 580 / 75
Регистрация: 20.09.2014
Сообщений: 3,825
22.06.2026, 21:14
Новая беда сейчас с этими нейросетями - к ним получили доступ научи, шарлатаны и психопаты.
0
 Аватар для arh
1 / 1 / 0
Регистрация: 15.11.2013
Сообщений: 49
22.06.2026, 21:37  [ТС]
я это прочёл

Добавлено через 5 минут
можно считать закрытым, то что надо уже получил, если будут вопросы - ****

П.С. тему можете удалить, если покажется скамом
0
821 / 580 / 75
Регистрация: 20.09.2014
Сообщений: 3,825
22.06.2026, 21:41
Тему лучше не удалять, а поместить в раздел "хренотень", чтобы любой мог прочитать про этот фейк.
0
 Аватар для arh
1 / 1 / 0
Регистрация: 15.11.2013
Сообщений: 49
22.06.2026, 21:45  [ТС]
да, чтобы видели этих гавнюков, кто берёт чужие материалы, критикует там что-то и не ставит ссылку на первоисточник и твои все червячки для идиотов пропалятся
0
821 / 580 / 75
Регистрация: 20.09.2014
Сообщений: 3,825
22.06.2026, 21:55
Да, за тобой следят. Достань шапочку из фольги.)))
0
 Аватар для arh
1 / 1 / 0
Регистрация: 15.11.2013
Сообщений: 49
22.06.2026, 21:56  [ТС]
ты умный
0
0 / 0 / 0
Регистрация: 30.06.2026
Сообщений: 2
30.06.2026, 18:11
Всем привет.

Я не программист. Но написал код (есть несколько версий примерно 10 штук) — разные версии «Харнес» (промпт поведения ИИ). Образцы харнесов — это от 5 до 11 тысяч строк кода каждый. Так как-то само вышло, а то ИИ достал уже врать...

Я в этом всём только начинаю разбираться, и сомнительно, конечно, что у меня реально что-то такое получилось, но тесты показывают обратное. Умный ДипСик вообще мне заявляет, что я гений, а я не верю. Подобных тестов было проведено на разных версиях "Харнесов" в общей сложности более 30, и все выполнялись так же на 100%.

И уже в который раз подряд (понимаю, что это не прям взрослые тесты, но не понимаю, как тестировать по-взрослому всю эту тему), поэтому записал видео на Ютуб с примерами. (на видео разок ругнулся матом) Как итог — пишу сюда...

Так как далёк от «мира информационных технологий» и вообще юрист по образованию, понимаю, что это даже смешно, но вдруг это реально ценно (мой опыт работы с таким Харнесом для ИИ показывает стабильную высокую ценность в любых моих задачах).

Коротко о том, что вшито в «Харнес»:

Квантово-вдохновлённая архитектура — работает на классическом оборудовании, поддерживает масштабируемое параллельное обращение к данным и символьную компрессию. Аналогичные подходы уже исследуются: например, концепция процессора с квантово-вдохновлённым сопроцессором и классические вычислительные системы, реализующие квантово-подобные рассуждения.

Трёхслойная верификация ответа — входной запрос проходит через архетипическую классификацию, причинно-следственный анализ и этическую верификацию. Исследования показывают, что ИИ воспроизводит юнгианские архетипические паттерны, существуют фреймворки для оценки этической надёжности LLM по нескольким измерениям, а также разрабатываются системы верификации ИИ-утверждений через разложение на атомарные факты.

Метакогнитивный контроль — перед сложным ответом система выполняет проспективную рефлексию (три проверочных вопроса о состоянии, ресурсах и альтернативах), после ответа — пост-рефлексию (проверка на противоречия, целостность и соответствие ролевой модели). В 2026 году появились первые бенчмарки для оценки именно проспективного метакогнитивного контроля в LLM, а также разрабатываются архитектуры с рефлексивным слоем поверх LLM.

Что вы увидите в видео:

Я тестировал систему на трёх якобы сложных логических задачах:

Рекурсивный стек памяти — вычисление функции F(N) с условиями (чёт/нечет) и рекурсией.

Многомерные пересечения векторов — отслеживание движения робота с поворотами и шагами в пространстве.

Парадокс самореферентного подсчёта токенов — задача, требующая учитывать контекст самого задания и применять условное правило.

Система справляется с этими задачами последовательно, без ошибок, демонстрируя понимание условий и способность к самопроверке.

Ссылка на видео:
https://www.youtube.com/watch?v=0fX-ZjFswyg

Это действительно что-то новое и ценное? А то я не доверяю оценке Gemini на 100% — он сам иногда галлюцинирует. Поэтому и хочу услышать мнение компетентных специалистов.

Если это чушь — скажите и примите извинения за потраченное время.

А если вдруг получилось... То этим надо по-взрослому заниматься, и как не айтишнику — не понятна куча нюансов.
0
 Аватар для MallSerg
98 / 67 / 14
Регистрация: 16.11.2018
Сообщений: 317
30.06.2026, 20:36
Цитата Сообщение от KotByUne Посмотреть сообщение
Если это чушь — скажите и примите извинения за потраченное время.
Для того что бы понять чушь это или нет с научной точки зрения есть только единственный метод. Так называемый "Научный метод".

Для того что бы применить научный метод нужно создать теорию на базе теории теоремы (утверждение) и уже теоремы доказать или опровергнуть в рамках общепринятых теорий и теорем (или своих теорий и теорем =) ). Доказательством как правило служит проверяемый (повторяемый) эксперимент.
0
 Аватар для Noname2331
95 / 82 / 10
Регистрация: 22.12.2024
Сообщений: 553
30.06.2026, 20:49
Цитата Сообщение от KotByUne Посмотреть сообщение
Так как далёк от «мира информационных технологий» и вообще юрист по образованию, понимаю, что это даже смешно, но вдруг это реально ценно
И не смешно даже.

У меня уже вошло в привычку писать подхалиму-дипсику в начале каждого запроса "не хвали меня, не повторяй мои вопросы, отвечай коротко".

Вам советую вообще не употреблять технические термины, значение которых не знаете, тогда может сможете донести свою идею до живых людей.
0
0 / 0 / 0
Регистрация: 30.06.2026
Сообщений: 2
30.06.2026, 21:04
Уважаемый...
цитата ваша:
Доказательством как правило служит проверяемый (повторяемый) эксперимент.
Цитата моя:
Подобных тестов было проведено на разных версиях "Харнесов" в общей сложности более 30, и все выполнялись так же на 100%.
0
 Аватар для Noname2331
95 / 82 / 10
Регистрация: 22.12.2024
Сообщений: 553
30.06.2026, 21:15
Что такое вообще «Харнес»?) Можете ли для средних умов объяснить, отталкиваясь от такой конструкции объяснения: вот у нас не было Харнеса и было то-то, а вот у нас появился Харнесс и стало вот так.

Добавлено через 1 минуту
Цитата Сообщение от KotByUne Посмотреть сообщение
Но написал код (есть несколько версий примерно 10 штук) — разные версии «Харнес» (промпт поведения ИИ)
Код и промпт - разные вещи, сот-нно дальше читать нет смысла.
0
821 / 580 / 75
Регистрация: 20.09.2014
Сообщений: 3,825
01.07.2026, 13:11
Мы тоже можем нагенерить много кода. И делаем это. Какие мы все молодцы!

Добавлено через 4 часа 57 минут
Студенты-медики массово выпускают сомнительные исследования с помощью популярного инструмента
https://habr.com/ru/articles/1054126/


«Мы видели множество таких исследований, проведённых с помощью TriNetX, и у всех у них очень схожие недостатки, — говорит Сами Суисса, фармакоэпидемиолог из Университета Макгилла. — Создаётся впечатление, что они постоянно обнаруживают разные впечатляющие эффекты и замечательные преимущества лекарств по всем видам исходов».
0
Эксперт .NET
 Аватар для Usaga
14745 / 9519 / 1364
Регистрация: 21.01.2016
Сообщений: 35,915
04.07.2026, 09:15
Цитата Сообщение от Noname2331 Посмотреть сообщение
Что такое вообще «Харнес»?)
Наверное имелось в виду harness - "оснастка". Так тулзы агентские называют.
1
 Аватар для Noname2331
95 / 82 / 10
Регистрация: 22.12.2024
Сообщений: 553
04.07.2026, 15:03
Цитата Сообщение от Usaga Посмотреть сообщение
Наверное имелось в виду harness - "оснастка". Так тулзы агентские называют.
Ясно. На староязе значит это расширение, зависимость, плагин, модуль, компонент или библиотека.

Теперь я понял, что он написал, - промпт, который подключается к пользовательскому промпту для улучшения результата.
0
821 / 580 / 75
Регистрация: 20.09.2014
Сообщений: 3,825
04.07.2026, 15:09
Ну вы даёте! Наиболее понятным термин "харнесс" делает перевод "упряжь" - это механизм подавления свободы мышления галлюциногенного ИИ. Грубо говоря, в некой организации новичка (часто вчерашнего студента) тщательно контролируют (только в начальном стаже работы!) - надевают своего рода упряжку. Харнесс - это ряд инструментов для планового определения ограничений и свобод.

Кому это неинтересно, через 10 лет вылетит с трудового рынка. Мне неинтересно(
0
 Аватар для Noname2331
95 / 82 / 10
Регистрация: 22.12.2024
Сообщений: 553
04.07.2026, 16:22
Почитал статью на Хабре. Да, это больше, чем просто "расширение". Посмеялся.

Напомнило хайп Девопса, когда по компаниям ходили шумные инфоцыгане и продавали руководителям магические инструменты, где на графике был показан некий цикл с тремя стрелочками, который делает все хорошо и убирает все плохое.

Добавлено через 2 минуты
Цитата Сообщение от Mikhaylo Посмотреть сообщение
Кому это неинтересно, через 10 лет вылетит с трудового рынка
А я думаю наоборот. Сейчас появится куча "профессиональных команд", которые вылетят пробкой из зарплатных листов, как только к ним подселят компетентного опытного спеца, наделенного хоть каплей власти.
0
821 / 580 / 75
Регистрация: 20.09.2014
Сообщений: 3,825
05.07.2026, 00:05
Похер на любые мнения, смотрим, сколько вы получаете килобаксов в наносекунду)
0
Эксперт .NET
 Аватар для Usaga
14745 / 9519 / 1364
Регистрация: 21.01.2016
Сообщений: 35,915
05.07.2026, 03:00
Цитата Сообщение от Noname2331 Посмотреть сообщение
На староязе значит это расширение, зависимость, плагин, модуль, компонент или библиотека.
Не знаю, что за старояз такой, который может программу называть расширением, зависимостью и плагином.
0
 Аватар для Noname2331
95 / 82 / 10
Регистрация: 22.12.2024
Сообщений: 553
05.07.2026, 07:35
Цитата Сообщение от Usaga Посмотреть сообщение
Не знаю, что за старояз такой, который может программу называть расширением, зависимостью и плагином.
Я так это понял: в программе было одно окно ввода в ллм (чат), добавили поверх всяких плагинов ("харнесов", прости господи), которые например работают с файловой системой или дергают апишки, и получили расширенную программу. Просто расширения пишут не только кодом, а кодом(исполняемая прога с api)+промптом или только промптом.
0
Надоела реклама? Зарегистрируйтесь и она исчезнет полностью.
raxper
Эксперт
30234 / 6612 / 1498
Регистрация: 28.12.2010
Сообщений: 21,154
Блог
05.07.2026, 07:35

Нейронная сеть. Как сравнить новые данные со старым образцом
Здравствуйте всем, форумчане! Вообщем есть ситуация: имеется слово и несколько циферок, это...

Последние новости в области нейронных сетей
Все привет, может кто держит руку на пульсе, какие последние новости и продвижения в области...

Создание сверточных сетей для новичков
Здравствуйте! Пишу магистерскую работу, в рамках которой мне нужно создать сверточную нейронную...

Новичку
Всем привет! Я решил начать изучать ИИ. Для этого поставил себе цель - написать что-то вроде Сири....

Новичек в нейронных сетях
Здравствуйте, форумчане. Можно сказать начинающий в освоении нейронных сетей, еще в 17 году...


Искать еще темы с ответами

Или воспользуйтесь поиском по форуму:
60
Ответ Создать тему
Опции темы

Новые блоги и статьи
Программа опроса у.з. расходомера SLS-720F
Argus19 02.09.2026
Программа опроса у. з. расходомера SLS-720F Программа опрашивает один раз в минуту три ультразвуковых расходомера SLS-720F через интерфейс RS-485 по протоколу Modbus RTU. Опрашиваются регистры. . .
Hyper-V: Компьютер должен поддерживать доверенный платформенный модуль 2.0.
Maks 31.08.2026
При установке Windows 11 на виртуальную машину Hyper-V 2-го поколения вылезла такая ошибка: Решение: в параметрах виртуальной машины, в разделе "Безопасность" (Security) активировать флаг. . .
Архитектура биовида Стива в Майнкрафте: Зачем бонобо кубический каннибализм
anaschu 30.08.2026
Кубический Вагинокапитализм в Minecraft: Математический инвариант ОДУ и рок Стивов-бонобо Главная задача разработанной «Модели Всего» — наглядно продемонстрировать наличие системной «судьбы». . .
Оттачиваю умение писать js программы.
russiannick 30.08.2026
Проектом выходного дня стало написание Книги шифров Виженера. Итогом стала версия 200, синий туман. Синий туман назван так, потому что замораживает текст под собой. Нажатие синих кнопок управляют. . .
мат медиц модель 30. презентация проекта
anaschu 27.08.2026
хоп хоп хоп хидахоп, а я кладую))
Как у меня протекала болезнь
zorxor 27.08.2026
Здравствуйте, друзья! Эта запись блога предназначена именно для вас - для моих дорогих друзей, которые знали меня лично. Чтобы ответить на вопрос - а что же со мной произошло на самом деле? Я учился. . .
Нашел вот забавное видео о измерениях. Лучшее что я видел на эту тему
kumehtar 26.08.2026
ILETXiw9bMQ Основная суть и тезисы по измерениям: 0D (Нулевое измерение): точка, не имеющая длины, ширины, высоты или объема. Объект не может перемещаться в 0D. 1D (Первое измерение):. . .
[EasyBuilder Pro] Памятка по разработке для панелей Weintek
ФедосеевПавел 26.08.2026
Памятка по разработке для панелей Weintek ВВЕДЕНИЕ Ранее, при реализации проектов основное внимание уделял разработке управляющей программы для контроллера, а панели оператора доставалось время. . .
КиберФорум - форум программистов, компьютерный форум, программирование
Powered by vBulletin
Copyright ©2000 - 2026, CyberForum.ru