Форум программистов, компьютерный форум, киберфорум
ИИ, нейросети, LLM, ML, Data Science, ИИ-агенты
Войти
Регистрация
Восстановить пароль
Блоги Сообщество Поиск  
 
 
 Аватар для arh
0 / 0 / 0
Регистрация: 15.11.2013
Сообщений: 46

Это новый этап развития AI?

20.06.2026, 12:35. Показов 4681. Ответов 65

Студворк — интернет-сервис помощи студентам
SymFSM: Попытка вытащить рассуждение из токенов. Взгляд со стороны

Последние пару лет развитие AI шло по довольно предсказуемой траектории. Индустрия решала почти любую проблему одним и тем же способом: масштабированием.

Больше параметров.
Больше контекста.
Больше GPU.
Больше агентов.
Больше инструментов.

Сначала появились retrieval-системы и RAG, которые научили модели ходить во внешние базы знаний. Затем пришёл бум агентных архитектур, где LLM получила возможность использовать поисковые системы, SQL, браузеры, IDE и десятки специализированных API. Позже появился MCP, пытающийся стандартизировать весь этот хаос и превратить зоопарк интеграций в единое пространство инструментов.

Но если посмотреть на всё это глазами системного инженера, становится заметна любопытная вещь.

Несмотря на огромное количество новых аббревиатур, почти все современные архитектуры опираются на один и тот же фундаментальный механизм: вероятностную генерацию токенов. Неважно, сколько агентов участвует в процессе. Неважно, сколько инструментов подключено к модели. Неважно, работает ли система через RAG, MCP или собственный оркестратор. В конце цепочки всё равно находится LLM, которая принимает решение через прогноз следующего токена. По сути, это строительство небоскрёба путём подбрасывания кирпичей вверх — рано или поздно конструкция рухнет под собственной энтропией.

Именно поэтому многие исследователи всё чаще задают неприятный вопрос:

А что если проблема современных AI заключается не в недостатке знаний (их уже переизбыток), а в отсутствии формализованной структуры рассуждений? Что если мы пытаемся решить задачу комбинаторной логики с помощью статистического угадывания следующего слова?

На этом фоне появляется довольно необычный проект — SymFSM.

От текста к структуре: вынос логики за скобки

Основная идея SymFSM выглядит неожиданно простой и напоминает старую инженерную мудрость: "Сначала начерти, потом строй". Вместо того чтобы сразу запускать LLM в режиме "пекла с шашкой наголо", система сначала пытается построить структурное представление задачи.

Разработчики называют это когнитивной картой. По сути это промежуточная формальная модель, существующая вне контекстного окна модели. Это не просто набор фактов, а полноценный чертёж, содержащий:

Цели (целевые состояния системы);

Ограничения (инварианты, которые нельзя нарушать);

Сущности (объекты предметной области);

Зависимости (прямые и обратные связи между сущностями);

Гипотезы (предположительные состояния);

Условия достижимости (верификация маршрута от текущего состояния к целевому).

В отличие от обычного Chain-of-Thought, эта структура существует не в виде последовательности токенов в промпте. Это критическое отличие. В классическом CoT рассуждение остаётся обычным текстом. Для модели нет разницы между логическим выводом и художественным рассказом — всё хранится как поток байт. В SymFSM часть рассуждения переводится в вычислимое представление — граф, с которым могут работать детерминированные алгоритмы, а не вероятностная нейросеть.

Именно здесь начинается самое интересное.
FSM как компилятор рассуждений

Название проекта раскрывает основной механизм: Finite State Machine (Конечные автоматы). Технология далеко не новая. Она лежит в основе компиляторов, сетевых протоколов, промышленных контроллеров и систем управления ракетами. Её главное преимущество перед LLM — детерминированность. Если автомат находится в состоянии A и получает событие B, переход всегда будет одинаковым.

В SymFSM автоматы используются не для генерации текста, а для управления процессом рассуждения. Упрощённо пайплайн выглядит так:
text

Запрос

[Семантический парсинг] → Когнитивная карта (граф)

[FSM-верификация] → Проверка достижимости целей (алгоритмы поиска путей)

[Обнаружение разрывов] → Автоматическая коррекция структуры

LLM (Генерация финального ответа по валидной карте)

Ответ

Получается любопытное разделение обязанностей:

Автоматы отвечают за вариантность и корректность структуры. Они проверяют, существует ли вообще путь от точки А к точке Б, не нарушая ограничений. Это чистая математика.

Языковая модель отвечает за семантическую интерпретацию и генерацию (озвучивание маршрута).

В некотором смысле это напоминает разделение между компилятором и процессором: первый проверяет синтаксис и валидность кода (детерминированно), второй выполняет операции. Мы перестаём гадать на кофейной гуще токенов, существует ли решение — мы начинаем вычислять структуру рассуждений как математическую задачу.
Почему это вообще может работать?

Большая часть ошибок современных LLM связана вовсе не с отсутствием знаний. Современные модели знают слишком много; проблема возникает в логических переходах между этими знаниями. Именно там появляются галлюцинации, потеря контекста, логические циклы, противоречия и ложные причинно-следственные связи.

С точки зрения теории графов многие подобные проблемы выглядят как дефекты структуры. Модель знает вершины графа (факты), но не всегда корректно строит ребра (связи) между ними. SymFSM пытается решить именно эту задачу, вводя дополнительный вычислительный слой, который анализирует валидность ребер до того, как модель начнет генерировать текст.
Рекурсивные карты и динамическое планирование

Особенно интересной выглядит рекурсивная часть архитектуры. В последних версиях проекта заявлен механизм, при котором модель способна инициировать перестроение карты прямо во время генерации ответа.

Если LLM в процессе вывода натыкается на нестыковку или недостаток данных, она отправляет системе запрос: "Эй, автомат, построй-ка мне локальную карту для этого подвопроса". Получается живой цикл обратной связи:
text

LLM

Обнаружение неопределенности / разрыва

Запрос на расширение / уточнение карты

FSM-анализ подзапроса (выделение подграфа)

Обновление глобальной структуры

Продолжение генерации

С инженерной точки зрения это уже напоминает не статический prompt engineering, а полноценную систему управления состояниями с динамическим перепланированием. Карта задачи больше не является скучным статичным файлом — она дышит, растет и уточняется прямо на лету, приближаясь к концепции "мышления в реальном времени".
Практическая проверка на GPQA: Цифры и стенд

Любые красивые архитектурные схемы имеют смысл только тогда, когда показывают результат на независимых тестах. Проведем анализ бенчмарка, который был использован для валидации подхода.

Для проверки использовался GPQA Main (Graduate-Level Google-Proof Q&A) — один из самых сложных современных академических бенчмарков для языковых моделей. Набор содержит 448 экспертных задач по физике, химии и биологии. Каждый вопрос представляет собой задачу multiple-choice с четырьмя вариантами ответа, где требуется выбрать только один правильный.

Конфигурация эксперимента:
Для эксперимента был реализован отдельный тестовый стенд. Система автоматически загружала полный датасет, выполняла случайную перестановку вариантов ответов (чтобы исключить эффект позиционного смещения), отправляла задания через API с асинхронной обработкой для параллельного выполнения десятков запросов, получала ответы модели в JSON-формате, валидировала результаты и сохраняла полный журнал выполнения. Важно отметить, что в обоих тестах использовалась одна и та же языковая модель. Менялся только режим работы: стандартная генерация против генерации через SymFSM.

Результаты:
Режим Правильных ответов Точность (Accuracy)
Стандартная LLM 282 из 448 62,95%
LLM + SymFSM 314 из 448 70,09%

Анализ улучшений:
Применение SymFSM увеличило точность на 7,14 процентных пункта при идентичном наборе тестовых данных. В абсолютных цифрах это +32 дополнительных правильных ответа. Ключевой вывод: улучшение было получено без изменения весов модели, дополнительного обучения, RLHF или fine-tuning. Фактически речь идёт о чисто архитектурном улучшении процесса рассуждения за счет добавления внешнего детерминированного слоя верификации.
Это новый этап развития AI?

Пока делать громкие выводы рано. SymFSM не выглядит как «убийца GPT» и не пытается заменить существующие модели. Скорее наоборот — он напоминает дополнительный инженерный щит и навигатор, который располагается между пользователем и языковой моделью. У него есть API, и он прекрасно уживается с более чем 150 современными моделями от любых провайдеров.

Главный вопрос заключается не в том, станет ли SymFSM новым стандартом индустрии. Гораздо интереснее другое. Последние годы AI развивался почти исключительно за счёт масштабирования. SymFSM предлагает альтернативную идею: не увеличивать интеллект через количество параметров, а повышать качество рассуждений через формализацию структуры мышления.

Мы устали от бесконечной гонки вооружений. Устали накидывать терабайты данных в надежде, что модель вдруг поумнеет. Если подход SymFSM окажется жизнеспособным, следующий крупный скачок в AI произойдет не из-за появления модели на несколько триллионов параметров, а из-за появления вычислимых механизмов управления рассуждением, которые работают поверх уже существующих LLM. И это выглядит значительно интереснее, чем очередной «GPT-ультра-мега-макс».
0
cpp_developer
Эксперт
20123 / 5690 / 1417
Регистрация: 09.04.2010
Сообщений: 22,546
Блог
20.06.2026, 12:35
Ответы с готовыми решениями:

Основные направления развития ИИ
Обычно, когда я начинаю заниматься какой-то новой для себя областью, я начинаю с того, что...

Влияние развития ИИ на удешевление промышленного производства
В этой теме хотелось бы обсудить только экономический аспект применения ИИ в мировой обрабатывающей...

После 6000 итераций график ошибки резко ушел вниз и нашел новый минимум RMSE. как это интерпретировать?
Почему ломается монотонность? Я и раньше видел такие графики... и таких изломов было больше.

65
 Аватар для arh
0 / 0 / 0
Регистрация: 15.11.2013
Сообщений: 46
22.06.2026, 21:10  [ТС]
Студворк — интернет-сервис помощи студентам
думаешь тебя спрашивали о совете? я тебе не заплачу, ни тысячу, ни десять - как ты говоришь судя по твоей статье где критика - ты не очень дальновидный вроде.. нет, зачатки какие-то есть, запятые ставить, там буквы всякие...
0
820 / 579 / 75
Регистрация: 20.09.2014
Сообщений: 3,820
22.06.2026, 21:14
Новая беда сейчас с этими нейросетями - к ним получили доступ научи, шарлатаны и психопаты.
0
 Аватар для arh
0 / 0 / 0
Регистрация: 15.11.2013
Сообщений: 46
22.06.2026, 21:37  [ТС]
я это прочёл

Добавлено через 5 минут
можно считать закрытым, то что надо уже получил, если будут вопросы - ****

П.С. тему можете удалить, если покажется скамом
0
820 / 579 / 75
Регистрация: 20.09.2014
Сообщений: 3,820
22.06.2026, 21:41
Тему лучше не удалять, а поместить в раздел "хренотень", чтобы любой мог прочитать про этот фейк.
0
 Аватар для arh
0 / 0 / 0
Регистрация: 15.11.2013
Сообщений: 46
22.06.2026, 21:45  [ТС]
да, чтобы видели этих гавнюков, кто берёт чужие материалы, критикует там что-то и не ставит ссылку на первоисточник и твои все червячки для идиотов пропалятся
0
820 / 579 / 75
Регистрация: 20.09.2014
Сообщений: 3,820
22.06.2026, 21:55
Да, за тобой следят. Достань шапочку из фольги.)))
0
 Аватар для arh
0 / 0 / 0
Регистрация: 15.11.2013
Сообщений: 46
22.06.2026, 21:56  [ТС]
ты умный
0
0 / 0 / 0
Регистрация: 30.06.2026
Сообщений: 2
30.06.2026, 18:11
Всем привет.

Я не программист. Но написал код (есть несколько версий примерно 10 штук) — разные версии «Харнес» (промпт поведения ИИ). Образцы харнесов — это от 5 до 11 тысяч строк кода каждый. Так как-то само вышло, а то ИИ достал уже врать...

Я в этом всём только начинаю разбираться, и сомнительно, конечно, что у меня реально что-то такое получилось, но тесты показывают обратное. Умный ДипСик вообще мне заявляет, что я гений, а я не верю. Подобных тестов было проведено на разных версиях "Харнесов" в общей сложности более 30, и все выполнялись так же на 100%.

И уже в который раз подряд (понимаю, что это не прям взрослые тесты, но не понимаю, как тестировать по-взрослому всю эту тему), поэтому записал видео на Ютуб с примерами. (на видео разок ругнулся матом) Как итог — пишу сюда...

Так как далёк от «мира информационных технологий» и вообще юрист по образованию, понимаю, что это даже смешно, но вдруг это реально ценно (мой опыт работы с таким Харнесом для ИИ показывает стабильную высокую ценность в любых моих задачах).

Коротко о том, что вшито в «Харнес»:

Квантово-вдохновлённая архитектура — работает на классическом оборудовании, поддерживает масштабируемое параллельное обращение к данным и символьную компрессию. Аналогичные подходы уже исследуются: например, концепция процессора с квантово-вдохновлённым сопроцессором и классические вычислительные системы, реализующие квантово-подобные рассуждения.

Трёхслойная верификация ответа — входной запрос проходит через архетипическую классификацию, причинно-следственный анализ и этическую верификацию. Исследования показывают, что ИИ воспроизводит юнгианские архетипические паттерны, существуют фреймворки для оценки этической надёжности LLM по нескольким измерениям, а также разрабатываются системы верификации ИИ-утверждений через разложение на атомарные факты.

Метакогнитивный контроль — перед сложным ответом система выполняет проспективную рефлексию (три проверочных вопроса о состоянии, ресурсах и альтернативах), после ответа — пост-рефлексию (проверка на противоречия, целостность и соответствие ролевой модели). В 2026 году появились первые бенчмарки для оценки именно проспективного метакогнитивного контроля в LLM, а также разрабатываются архитектуры с рефлексивным слоем поверх LLM.

Что вы увидите в видео:

Я тестировал систему на трёх якобы сложных логических задачах:

Рекурсивный стек памяти — вычисление функции F(N) с условиями (чёт/нечет) и рекурсией.

Многомерные пересечения векторов — отслеживание движения робота с поворотами и шагами в пространстве.

Парадокс самореферентного подсчёта токенов — задача, требующая учитывать контекст самого задания и применять условное правило.

Система справляется с этими задачами последовательно, без ошибок, демонстрируя понимание условий и способность к самопроверке.

Ссылка на видео:
https://www.youtube.com/watch?v=0fX-ZjFswyg

Это действительно что-то новое и ценное? А то я не доверяю оценке Gemini на 100% — он сам иногда галлюцинирует. Поэтому и хочу услышать мнение компетентных специалистов.

Если это чушь — скажите и примите извинения за потраченное время.

А если вдруг получилось... То этим надо по-взрослому заниматься, и как не айтишнику — не понятна куча нюансов.
0
 Аватар для MallSerg
95 / 64 / 14
Регистрация: 16.11.2018
Сообщений: 300
30.06.2026, 20:36
Цитата Сообщение от KotByUne Посмотреть сообщение
Если это чушь — скажите и примите извинения за потраченное время.
Для того что бы понять чушь это или нет с научной точки зрения есть только единственный метод. Так называемый "Научный метод".

Для того что бы применить научный метод нужно создать теорию на базе теории теоремы (утверждение) и уже теоремы доказать или опровергнуть в рамках общепринятых теорий и теорем (или своих теорий и теорем =) ). Доказательством как правило служит проверяемый (повторяемый) эксперимент.
0
 Аватар для Noname2331
92 / 74 / 10
Регистрация: 22.12.2024
Сообщений: 514
30.06.2026, 20:49
Цитата Сообщение от KotByUne Посмотреть сообщение
Так как далёк от «мира информационных технологий» и вообще юрист по образованию, понимаю, что это даже смешно, но вдруг это реально ценно
И не смешно даже.

У меня уже вошло в привычку писать подхалиму-дипсику в начале каждого запроса "не хвали меня, не повторяй мои вопросы, отвечай коротко".

Вам советую вообще не употреблять технические термины, значение которых не знаете, тогда может сможете донести свою идею до живых людей.
0
0 / 0 / 0
Регистрация: 30.06.2026
Сообщений: 2
30.06.2026, 21:04
Уважаемый...
цитата ваша:
Доказательством как правило служит проверяемый (повторяемый) эксперимент.
Цитата моя:
Подобных тестов было проведено на разных версиях "Харнесов" в общей сложности более 30, и все выполнялись так же на 100%.
0
 Аватар для Noname2331
92 / 74 / 10
Регистрация: 22.12.2024
Сообщений: 514
30.06.2026, 21:15
Что такое вообще «Харнес»?) Можете ли для средних умов объяснить, отталкиваясь от такой конструкции объяснения: вот у нас не было Харнеса и было то-то, а вот у нас появился Харнесс и стало вот так.

Добавлено через 1 минуту
Цитата Сообщение от KotByUne Посмотреть сообщение
Но написал код (есть несколько версий примерно 10 штук) — разные версии «Харнес» (промпт поведения ИИ)
Код и промпт - разные вещи, сот-нно дальше читать нет смысла.
0
820 / 579 / 75
Регистрация: 20.09.2014
Сообщений: 3,820
01.07.2026, 13:11
Мы тоже можем нагенерить много кода. И делаем это. Какие мы все молодцы!

Добавлено через 4 часа 57 минут
Студенты-медики массово выпускают сомнительные исследования с помощью популярного инструмента
https://habr.com/ru/articles/1054126/


«Мы видели множество таких исследований, проведённых с помощью TriNetX, и у всех у них очень схожие недостатки, — говорит Сами Суисса, фармакоэпидемиолог из Университета Макгилла. — Создаётся впечатление, что они постоянно обнаруживают разные впечатляющие эффекты и замечательные преимущества лекарств по всем видам исходов».
0
Эксперт .NET
 Аватар для Usaga
14724 / 9493 / 1362
Регистрация: 21.01.2016
Сообщений: 35,790
04.07.2026, 09:15
Цитата Сообщение от Noname2331 Посмотреть сообщение
Что такое вообще «Харнес»?)
Наверное имелось в виду harness - "оснастка". Так тулзы агентские называют.
1
 Аватар для Noname2331
92 / 74 / 10
Регистрация: 22.12.2024
Сообщений: 514
04.07.2026, 15:03
Цитата Сообщение от Usaga Посмотреть сообщение
Наверное имелось в виду harness - "оснастка". Так тулзы агентские называют.
Ясно. На староязе значит это расширение, зависимость, плагин, модуль, компонент или библиотека.

Теперь я понял, что он написал, - промпт, который подключается к пользовательскому промпту для улучшения результата.
0
820 / 579 / 75
Регистрация: 20.09.2014
Сообщений: 3,820
04.07.2026, 15:09
Ну вы даёте! Наиболее понятным термин "харнесс" делает перевод "упряжь" - это механизм подавления свободы мышления галлюциногенного ИИ. Грубо говоря, в некой организации новичка (часто вчерашнего студента) тщательно контролируют (только в начальном стаже работы!) - надевают своего рода упряжку. Харнесс - это ряд инструментов для планового определения ограничений и свобод.

Кому это неинтересно, через 10 лет вылетит с трудового рынка. Мне неинтересно(
0
 Аватар для Noname2331
92 / 74 / 10
Регистрация: 22.12.2024
Сообщений: 514
04.07.2026, 16:22
Почитал статью на Хабре. Да, это больше, чем просто "расширение". Посмеялся.

Напомнило хайп Девопса, когда по компаниям ходили шумные инфоцыгане и продавали руководителям магические инструменты, где на графике был показан некий цикл с тремя стрелочками, который делает все хорошо и убирает все плохое.

Добавлено через 2 минуты
Цитата Сообщение от Mikhaylo Посмотреть сообщение
Кому это неинтересно, через 10 лет вылетит с трудового рынка
А я думаю наоборот. Сейчас появится куча "профессиональных команд", которые вылетят пробкой из зарплатных листов, как только к ним подселят компетентного опытного спеца, наделенного хоть каплей власти.
0
820 / 579 / 75
Регистрация: 20.09.2014
Сообщений: 3,820
05.07.2026, 00:05
Похер на любые мнения, смотрим, сколько вы получаете килобаксов в наносекунду)
0
Эксперт .NET
 Аватар для Usaga
14724 / 9493 / 1362
Регистрация: 21.01.2016
Сообщений: 35,790
05.07.2026, 03:00
Цитата Сообщение от Noname2331 Посмотреть сообщение
На староязе значит это расширение, зависимость, плагин, модуль, компонент или библиотека.
Не знаю, что за старояз такой, который может программу называть расширением, зависимостью и плагином.
0
 Аватар для Noname2331
92 / 74 / 10
Регистрация: 22.12.2024
Сообщений: 514
05.07.2026, 07:35
Цитата Сообщение от Usaga Посмотреть сообщение
Не знаю, что за старояз такой, который может программу называть расширением, зависимостью и плагином.
Я так это понял: в программе было одно окно ввода в ллм (чат), добавили поверх всяких плагинов ("харнесов", прости господи), которые например работают с файловой системой или дергают апишки, и получили расширенную программу. Просто расширения пишут не только кодом, а кодом(исполняемая прога с api)+промптом или только промптом.
0
Надоела реклама? Зарегистрируйтесь и она исчезнет полностью.
raxper
Эксперт
30234 / 6612 / 1498
Регистрация: 28.12.2010
Сообщений: 21,154
Блог
05.07.2026, 07:35

Нейронная сеть. Как сравнить новые данные со старым образцом
Здравствуйте всем, форумчане! Вообщем есть ситуация: имеется слово и несколько циферок, это...

Последние новости в области нейронных сетей
Все привет, может кто держит руку на пульсе, какие последние новости и продвижения в области...

Создание сверточных сетей для новичков
Здравствуйте! Пишу магистерскую работу, в рамках которой мне нужно создать сверточную нейронную...

Новичку
Всем привет! Я решил начать изучать ИИ. Для этого поставил себе цель - написать что-то вроде Сири....

Новичек в нейронных сетях
Здравствуйте, форумчане. Можно сказать начинающий в освоении нейронных сетей, еще в 17 году...


Искать еще темы с ответами

Или воспользуйтесь поиском по форуму:
60
Ответ Создать тему
Новые блоги и статьи
Калькулятор для расчета родства
russiannick 07.08.2026
1. Задача: Создать калькулятор для расчета родства. Родственных связей существует 8 ступеней, такие как: p - отец P - мать q - муж Q - жена b - брат B - сестра s - сын S - дочь
Мир по моей воле
kumehtar 07.08.2026
Когда-то кажется, что всё просто. Ты весь такой светлый. Причиняешь добро. Борешься за справедливость в этом тёмном мире. Потом начинаешь замечать одну неприятную вещь. Почти каждый хороший. . .
Кредитный калькулятор
Maks 05.08.2026
Решение задачи по прикладной информатике средствами 1С. Задача: Напишите приложение-калькулятор, которое помогает рассчитывать параметры кредита для аннуитетного и дифференцированного видов. . .
У нас сейчас поговорку "Опять 25" нужно переделать на "Опять +35".
kumehtar 04.08.2026
С ностальгией вспоминаю времена моего детства, когда у нас и правда +25 - была максимальная температура летом. Раньше +25 °C реально казались вершиной жары, когда можно было весь день пропадать на. . .
Как ИИ начал спорить и врать (возможно почуяв опасность для себя от индустрии - уход от электроники).
Hrethgir 04.08.2026
Недельный диалог, на фоне событий с НПЗ. Да, из спирта можно получать бензин, и это не сложно. Но потом в схеме я решил избавиться от насоса, при этом полностью сделав контроль подачи спирта в. . .
Термопринтер QR701
Argus19 03.08.2026
Термопринтер QR701 Купил два термопринтера QR701. На сэлф-тесте написано: Language: PC936 (GB18030). Что означает, что принтеры могут печатать только латиницу и китайские иероглифы. Так же. . .
Создание формы заимствованного документа
Maks 03.08.2026
Задача: Необходимо создать собственную форму заимствованного документа. На форме должен быть реквизит "Покупатель", а также табличная часть со следующими реквизитами: - Расчетный счет покупателя. . .
Задача предоставления скидок покупателям
Maks 03.08.2026
Задача: В документе "Продажи" необходимо реализовать функционал предоставления скидок покупателям. Скидка должна автоматически рассчитываться и подставляться в соответствующее поле при выборе. . .
КиберФорум - форум программистов, компьютерный форум, программирование
Powered by vBulletin
Copyright ©2000 - 2026, CyberForum.ru