|
|
|
|
Рейтинг 4.88/229:
|
|
|
|
Умный генератор текстов10.10.2016, 08:28. Показов 47862. Ответов 200
Подскажите, пожалуйста, есть ли программы, способные генерировать тексты на основе уже имеющихся текстов? Чтобы копировала стиль автора, учитывала темы, на которые пишет автор, в идеале (не знаю, возможно ли это) – копировала отношение автора к жизни, к тем или иным вещам в жизни.
Слышала, что-то такое хотели сделать в Твиттере, чем дело кончилось, не знаю. Если такой программы нет, то, как её сделать? Хотя бы – с чего начать? (понимаю, что задача сложная, искусственным интеллектом попахивающая)
0
|
|
| 10.10.2016, 08:28 | |
|
Ответы с готовыми решениями:
200
Умный вирусняк |
|
|
||
| 15.10.2016, 09:57 [ТС] | ||
|
0
|
||
|
142 / 40 / 14
Регистрация: 16.06.2016
Сообщений: 239
|
||
| 15.10.2016, 16:46 | ||
|
Вообще, в этой теме уже было показано видео про нейросети, которые переделывают фотографию в картину в стиле определённого художника. Так вот, теоретически, ничто не мешает настроить ту же нейросеть на переделывание любого текста под стиль определённого писателя. На вход она будет получать исходный текст и текст целевого автора, после она будет переставлять слова местами, и в итоге получать тот же рассказ, но в стиле какого-то автора. Вопрос только в том, как и к чему эту нейросеть подключать, как обучать, да и вообще, какая именно нейросеть (какой топологии) используется в таких задачах? Я вот не знаю, но кто-то обязательно знает...
0
|
||
|
|
||
| 15.10.2016, 18:56 [ТС] | ||
|
Пункт первый. Взять, скажем, штук по пять текстов от каждого автора. Выбрать оттуда все слова. Сравнить. Увидим, что автор «А» слово «1» использует часто, а слово «2» – редко, а слово «3» вообще не использует. А автор «В» наоборот, слово 2 любит, слово 1 не жалует. Дальше. Берем стандартный текст, неважно, какой. Если писать под автора А, например, надо слово «женщина» везде (или почти везде) менять на «дама». А у автора «В» слово «женщина» менять на «баба». Слово «дом» для автора А надо менять на «особняк», а автор В скорее скажет – хижина или хибара. Такую замену можно сделать по аналогии с Вордом найти/заменить Пункт второй Ищем у автора все свойственные ему обороты. И делаем табличку. Первая колонка – стандартное выражение. Например: Он поехал туда-то. Я испугался. Вторая/третья/последующие колонки – как эту фразу скажет тот или иной автор на примере фраз из их текстов. Например, автор А: Он принял твердое решение отправиться в путь, лежащий через живописные холмы и мрачные леса к старинному замку. Ощущение непередаваемого страха сковало мою душу и ледяной рукой сжало моё трепещущее сердце. А автор В: Попёрся он, короче, в деревню, там ещё тачка заглохла на хрен… Я чуть в штаны не наложил со страху… …и так далее. Обороты, наверное, придется выбирать вручную, вот это только человек сделает. А менять обычную фразу на стиль автора можно и с помощью программы по принципу Ворда найти/заменить. Вот уже стиль скопировать сможем. Добавлено через 6 минут Следующий шаг. Какая программа сможет понять, что такое подлежащее, сказуемое, и прочие части предложения. Если научить программу понимать части предложения, она сможет выстроить предложение под стиль этого автора. Например, один напишет: Я поехал в город. а другой напишет: Поехал я в город.
0
|
||
|
142 / 40 / 14
Регистрация: 16.06.2016
Сообщений: 239
|
||
| 15.10.2016, 22:53 | ||
|
Тут возникает вопрос - имеет ли смысл тратить годы труда на ограниченную программу? Будет она пользоваться спросом в её ограниченном виде? Или всё-таки стоит копать в сторону общего решения, которое будет покрывать нишу всех возможных в данной сфере ограниченных программ? Короче, что в отношении предложенной задачи выгоднее - слабый (узкий) ИИ или сильный (общий) ИИ? Правда, стоит учесть, что слабые ИИ делают уже более полувека, но до сих пор не создано ни одного сильного ИИ... Хотя теоретически его создание возможно, и, по всей видимости, неизбежно. А после его появления все существующие слабые ИИ потеряют смысл, если, конечно, для поддержания нового ИИ не потребуется слишком много компьютерных ресурсов... Но вообще рассуждения у тебя верные, если ты хочешь разработать узкий ИИ (или агента для многоагентной системы). Для общего ИИ должны быть рассуждения совсем другого толка...
0
|
||
|
Модератор
3141 / 2289 / 469
Регистрация: 26.03.2015
Сообщений: 8,915
|
|
| 16.10.2016, 02:32 | |
|
0
|
|
|
|
|||
| 16.10.2016, 05:17 [ТС] | |||
|
Добавлено через 1 минуту а может же частный пригодиться как будущая часть общего? как агент многоагентной системы? тогда создание частного ИИ - вещь полезная.
0
|
|||
|
821 / 580 / 75
Регистрация: 20.09.2014
Сообщений: 3,826
|
|
| 16.10.2016, 07:43 | |
|
Вы хоть понимаете, что Ваши попытки начать лингвистический анализ примитивны и убоги? Отдавайте себе отчет!
0
|
|
|
27 / 26 / 6
Регистрация: 02.02.2014
Сообщений: 96
|
|
| 16.10.2016, 12:14 | |
|
Andrej Karpathy на тему посимвольного скармливания текстов в rnn неплохую запись у себя в блоге года полтора назад выдал. Примитивнейшая конструкция на 3 слоя в состоянии воспроизводить если не осмысленные тексты, то что-то на них похожее, так что для начала вполне сгодится.
0
|
|
|
142 / 40 / 14
Регистрация: 16.06.2016
Сообщений: 239
|
|
| 16.10.2016, 20:17 | |
|
Да, частный ИИ может быть интеллектуальным агентом многоагентной системы, но это зависит от строения и функций этого ИИ. Какого попало агента в систему не засунешь. Точнее, засунуть-то можно что угодно, но не факт, что это будет эффективно работать... Т.е. агентов нужно делать под конкретную систему, а не наоборот. Я так думаю...
Общий ИИ (или ядро многоагентной системы), на мой взгляд, должен быть максимально абстрагирован от типа воспринимаемой им информации и типа команд действий. То есть он должен одинаково переваривать любую поступающую извне информацию, обучаться на ней и реагировать на неё. Тогда его можно будет обучать под любые конкретные задачи, не изменяя ровным счётом ничего в его исходных кодах...
0
|
|
|
821 / 580 / 75
Регистрация: 20.09.2014
Сообщений: 3,826
|
|
| 16.10.2016, 20:33 | |
|
Круз, подсказка: не нужен общий ИИ, так как внешние среды в своем большинстве не произвольны, в них что-то общее есть, общие закономерности, называемые эвристиками...
0
|
|
| 17.10.2016, 13:23 | |
|
Mikhaylo
Чем вам не нравится лингвистический анализ? Для этой темы (и не только) - это самое важное. Хотя на земле существует порядка 6000 естественных языков. Но мы русские. И создавать ИИ будем на русском. Может следует основательно разобраться с русским языком? Или вы против?
0
|
|
|
821 / 580 / 75
Регистрация: 20.09.2014
Сообщений: 3,826
|
|
| 17.10.2016, 16:07 | |
|
Я пытаюсь вас остановить в том плане, что вы занялись тут псевдонаукой. Для сведения: наукой занимаются ученые, технологиями должны заниматься инженеры. До ученых вам далеко, до инженеров, судя по всему тоже, у вас и технологий нет. Учитесь!
0
|
|
|
821 / 580 / 75
Регистрация: 20.09.2014
Сообщений: 3,826
|
|
| 17.10.2016, 17:12 | |
|
К умному генератору умных текстов дорога ведет через учебу.
0
|
|
|
142 / 40 / 14
Регистрация: 16.06.2016
Сообщений: 239
|
||||
| 17.10.2016, 17:46 | ||||
|
Или ты только и умеешь, что повторять аки чат-бот фразы, которым тебя научил какой-то безумный и недалёкий учёный? Впрочем, ответ очевиден. Любой человек умеет лишь повторять фразы; "самостоятельное мышление" - это фикция. Однако, нас научили думать, что мы думаем самостоятельно, и поэтому мы пытаемся отстоять своё мнение...
0
|
||||
|
821 / 580 / 75
Регистрация: 20.09.2014
Сообщений: 3,826
|
|
| 17.10.2016, 18:43 | |
|
Добавлю. Нет предложений повествовательных, человек не понимает их. Есть только повелительные, их понимает. Учиться, учиться и еще раз учиться! Может после учебы повествования станут понятными.
0
|
|
| 17.10.2016, 20:12 | |
|
Лично для себя я уже сделал вывод.
1. В настоящее время лучше всего собрать готовые предложения. Именно на них должен опираться генератор умных текстов. Разумеется предложения лучше всего рассортировать по темам. При желании - по разным файлам, но можно оставить и в одном. 2. Собирать предложения из слов, а потом из этих предложений тексты - задача на 2-3 порядка сложнее. Зато она дает прямой выход на программы с ИИ. 3. Вероятно самым лучшим выбором здесь будет некая золотая середина. То есть и слова и словосочетания и предложения. Критерием того, что подходит, а что нет может быть только сам автор. Решение этой задачи мне видится в следующем виде. Надо взять эталонный текст. Распотрошить его. Написать программу, обладающую целым рядом параметров для ее настройки и благословить ее работу... .... через год что-то да получится - задача стоит того.
0
|
|
|
821 / 580 / 75
Регистрация: 20.09.2014
Сообщений: 3,826
|
|
| 18.10.2016, 04:48 | |
|
Вы самолюбивы. Ничего не получится, от тщетных попыток толку ноль. Нету никакой внятной цели, нету необходимых знаний. Практика показывает, что даже 50-летний курс диванной фэйлософии с элементами случайно-поискового кодирования дает абсолютно нулевой результат.
Только понимание того, что существует наука и что науку нужно учить, это уже отличное продвижение вперед! Как можно грызть науку? 1. Университет 2. Учебники 3. Видеокурсы Какие науки должен включать курс обучения: 1. Теория множеств, теория графов 2. Линейная алгебра, ряды, матрицы, оптимизация, аппроксимация 3. Теория вероятностей 4. Математическая статистика 5. Компьютерная наука: структуры данных, теория сложности вычислений 6. Машинное обучение Ваша конечная цель - дойти до курса "Машинное обучение". Лично я осваивал все с помощью видеокурсов на ютубе, самообразование у меня с детства - привычно.
0
|
|
|
|
|||
| 18.10.2016, 08:11 [ТС] | |||
|
А вот как сделать, чтобы тексты были оригинальные... неизвестно. Ну, для начала можно хотя бы игрушку, которая будет плагиатить авторов. Добавлено через 13 минут Может, я и ошибаюсь.
1
|
|||
|
defun
603 / 617 / 44
Регистрация: 30.04.2011
Сообщений: 702
|
|||||||
| 18.10.2016, 08:25 | |||||||
|
словарный запас первоклашки - ~2k слов средняя длина предложения в рус яз - ~10 слов прикинем количество размещений
0
|
|||||||
| 18.10.2016, 08:25 | |
|
Умный указатель Умный счетчик Умный вирус Умный фильтр Умный выключатель Искать еще темы с ответами Или воспользуйтесь поиском по форуму: |
|
Новые блоги и статьи
|
|||
|
Беседа с ИИ о программистах, недопускающих к созданию и правке кода генеративные ИИ и причины этого
zorxor 21.09.2026
Раньше я радовался или получал некоторые эмоции, пусть небольшие, но всё же, от самого процесса написания кода, рекомпиляции и запуска, видя постепенное развитие программы и прочее. А теперь лень. . .
|
Мобильное приложение ColorStep
pavlinmavlin 17.09.2026
Реализовал приложение Красный, Зеленый, Синий в Unity3d + c#.
Название изменил на ColorStep.
Приложение прошло модерацию и теперь доступно для скачивания. Делал его сам, шаг за шагом — и вот,. . .
|
Запрет дублирования строк в табличной части
Maks 13.09.2026
Реализация из решения ниже выполнена на нетиповом справочнике "Нормы ТО" с табличной часть "Виды ТО", разработанного в КА2, со следующими реквизитами:
- ВидТО (СправочникСсылка. ВидыТО);
- ВидГСМ. . .
|
Скрипты Tampermonkey для CyberForum, ChatGPT, Claude и пр.
Jin X 06.09.2026
Скрипты Tampermonkey для CyberForum, ChatGPT, Claude и пр.
Работая с форумом и нейросетями в браузере часто хочется что-то подкорректировать или добавить какого-то функционала.
Ниже прикреплён. . .
|
|
Программа опроса у.з. расходомера SLS-720F
Argus19 02.09.2026
Программа опроса у. з. расходомера SLS-720F
Программа опрашивает один раз в минуту три ультразвуковых расходомера SLS-720F через интерфейс RS-485 по протоколу Modbus RTU.
Опрашиваются регистры. . .
|
Hyper-V: Компьютер должен поддерживать доверенный платформенный модуль 2.0.
Maks 31.08.2026
При установке Windows 11 на виртуальную машину Hyper-V 2-го поколения вылезла такая ошибка:
Решение: в параметрах виртуальной машины, в разделе "Безопасность" (Security) активировать флаг. . .
|
Архитектура биовида Стива в Майнкрафте: Зачем бонобо кубический каннибализм
anaschu 30.08.2026
Кубический Вагинокапитализм в Minecraft: Математический инвариант ОДУ и рок Стивов-бонобо
Главная задача разработанной «Модели Всего» — наглядно продемонстрировать наличие системной «судьбы». . .
|
Оттачиваю умение писать js программы.
russiannick 30.08.2026
Проектом выходного дня стало написание Книги шифров Виженера. Итогом стала версия 200, синий туман.
Синий туман назван так, потому что замораживает текст под собой. Нажатие синих кнопок управляют. . .
|