|
5 артов
4 февраля 2026 |
|
3 года на сайте
29 сентября 2025 |
|
10 произведений
7 июля 2025 |
|
250 комментариев
25 июня 2025 |
|
5 рекомендаций
5 декабря 2024 |
|
#цифровое #ии абсолютно #всякая_фигня
Наверное, я разочарован. Как будто дошёл до края вселенной и потрогал его рукой: твёрдый и за ним ничего нет. Знания ИИ ограничены и она не способна воспринимать что-то новое из пользовательского ввода. Всё должно быть уложено в известную ей картину мира. Суть вопроса я могу описать, но вряд ли это кому-нибудь будет интересно. Пластические деформации металлов. Кристалл металла довольно тяжело расплющить или вытянуть, но относительно легко можно сдвинуть по атомным плоскостям. Но для этого в кристалле изначально должны иметься дефекты. И вот в механизм генерации дефектов (источник Франка – Рида) я пытался вникнуть. Имеется линейный дефект (дислокация) ограниченной длины. Под действием сдвигающей силы он изгибается, а затем распространяется за пределы своей проекции в бездефектную область. Как? Я замучил нейросеть, она уже начала жалобно спрашивать: «ну может быть пойдём дальше?», но нисколько не продвинулся, она просто рассказывала одно и то же слегка другими словами. Все попытки уточнения ни к чему не привели. Я перечитал все источники, там было написано то же самое словами школьного учебника. Нейросеть ещё и пыталась вставить дурацкие, не подходящие аналогии. Кажется, я всё-таки понял сам. В местах наибольшего натяжения происходит разрыв вертикальной цепочки (если плоскость сдвига считать горизонтальной) и рождаются две дислокации противоположной направленности сверху и снизу от плоскости сдвига. Одна из них убегает вперёд и сливается с изначальной, а другая уходит назад за препятствия. Я описал это, и ИИ меня не поняла. То есть она вписала объяснение в имеющуюся у неё картину мира, но по ответу было видно: не то. А ИИ умеет понимать (или квази-понимать) довольно сложные вещи. Например, я послойно описывал структуру кристалла с расположением атомов в решётке, и видно было, что да, понимает. Она же не умеет давать короткий ответ, она повторила сказанное, не дословно, с комментариями, всё в тему. А здесь – нет. То есть получается, нейросеть нельзя обучить ничему новому, кроме того, что описано в этих ваших интернетиках? Я понимаю, что если каждый начнёт учить чему-то своему, но хотя бы локально? С другой стороны, чат-боты вроде бы новое воспринимают, а здесь серьёзная дама. Так что если кто-то считает, что человечеству конец, то пока ещё не конец. Надеюсь, это будет исправлено в новых версиях. Свернуть сообщение - Показать полностью
Показать 7 комментариев |
|
#ии дегенеративное
Решил побаловаться. Взял рандомную дописывалку, взял начало своего рассказа, попросил дописать. Что же, дальнейшее развитие событий ИИ угадал. Ну не совсем, у меня более закручено, здесь более прямолинейно, но к чему должно было выйти, туда и вышло. Стиль вполне понравился (похоже, ИИ попытался повторить мой так что логично). Такой я бы прямо почитал. моё почтение, торговец Теперь о детекторах. Яндекс разделил сгенерированный текст (своё начало я не давал) на два сегмента: первый точно человеческий, второй точно ИИ. Что же, Яндекс хотя бы в некоторых случаях нейрогенерацию различить способен. Присмотревшись к тексту постфактум можно всё же заметить, что да, вторая часть всё же похуже. В общем давно известно, что чем дальше от репера, тем выдача хуже. Около килобайта из двух вышло хорошо. Дальше следует снова написать человеческий текст, на который ИИ будет опираться. С учётом того, что начальный кусок был около 3,5 кБ, и получен 1 кБ годного текста, выглядит не очень выгодно, но более предметно не экспериментировал, мне не за чем. И после, кусок текста, который Яндекс признал человеческим, засунул в два других рандомных нейродетектора. Один из них назвал текст подозрительным (но не точно сгенерированным), второй – признал человеческим. Так что ИИ может быть неплохим подспорьем, и практически не детектироваться, если отрезать хвосты (хотя бы по тому же Яндекс-детектору, или когда покаэется, что он немного не то погнал) и не лениться, писать всё же значительную часть вручную. Свернуть сообщение - Показать полностью
4 |
|
#цифровое #ии #вкалывают_роботы #нейроарты #длиннопост
Нейрокартинки похожи на сон: сначала думаешь «Ух ты, круто!», а приглядевшись замечаешь всё больше несуразностей. Комплексный подход к созданию артов: генерация, редактирование, коллажирование Где я и где изобразительное искусство… Никогда не умел рисовать, никогда не мог воплотить придуманную композицию даже в «чертёж рисунка» в графическом редакторе, а все «кисти», «пульверизаторы» воспринимал как «ну, оно есть, конечно, но воспользоваться этим в принципе невозможно». И нейроарты казались прорывом, победой человеческого разума, шансом: вот сейчас сделаю. Надо только набрать подходящий запрос, и нейросеть сделает всё хорошо. Нет. Нейросеть не учитывала нужные детали и добавляла ненужные. Бесконечные улучшения запросов не приводили к требуемому результату. Иногда она беленилась и выдавала совсем не то. Иногда почти попадала в настроение, но… вот бы усы от Ивана Ивановича, да к носу Ивана Семёновича. Несколько сотен сгенерированных картинок (к разным рассказам), отобранных как «почти», просто красивые, «в этом что-то есть», не считая тех, что сразу были отброшены, и из этого удалось выбрать с натяжкой одну для обложки одного фанфика. Могу только позавидовать тем, кто умеет составлять запросы, тем, у кого получается с первых нескольких раз, но мне нейросети рисуют совсем не то, что у меня в голове. К счастью, сейчас нейроарты можно редактировать (и всегда можно было, фотордактор вам в руки, но это казалось страшным и сложным). Те, кто давно этим пользуется, не найдут здесь ничего нового, никаких глубоких секретов, просто минимальный обзор для тех кто вообще не знает, что так можно (ну, если такие найдутся). Генерация Набираешь примерный запрос, уточняешь, добавляешь отрицательные запросы (если поддерживаются), пристреливаешься, стреляешь по площадям, снова уточняешь… Всем всё известно, и, наверняка, большинство превосходит меня в этом. Однако есть возможность влиять на результат более точно, не посредством запроса. Это ControlNet, общее название для различных инструментов, позволяющих более точно указывать нейросети композицию рисунка. Упомяну два, как мне кажется, наиболее доступных и перспективных. Карта глубин – рисуется в любом графическом редакторе расчерчиванием областей и заливкой различными градациями серого. Более подходящий способ – получить из рисунка, и отредактировать для изменения композиции. Белый цвет означает самые близкие к нам объекты, чёрный – наиболее отдалённые. Допустим, чёрное небо, серый фон – там будет лес, посветлее избушка, и белый герой – палка, палка, огуречек. Нейросеть будет пытаться рисовать в границах этих зон. Openpose – проекция карты частей человеческого тела на плоскость рисунка. Каждая кость (или другая часть) имеет определённый цвет (но не обязательно рисовать их все). Таким образом можно пытаться задавать позу: колени согнуты (человек бежит), руки вверх, вниз или вширь. Конечно, надеяться на совпадение можно только условно. Картинка в картинку (Img2Img) Я разделю такого рода перерисовку и собственно редактирование. Вы отдаёте нейросети исходный рисунок и объясняете, что хотите получить (или что хотите изменить, как договоритесь). Обычно в этом режиме указывается «интенсивность изменений». Она имеет разные значения для различных нейросетей: для одной 0,4 будет достаточно много, для другой – слишком мало. Пробуйте запросы, пробуйте менять «интенсивность изменений», если картинка изменяется слишком сильно или, наоборот, недостаточно. Редактирование Используется нейросеть натренированная специально на внесение изменений: удалить объект, добавить, перекрасить, сделать отдельную часть ярче или тусклее и ещё много чего. Используются короткие точные запросы вместо привычных витиеватостей. Качество поражает. Запросы выполняются именно с той «тупой машинной логикой», к которой мы привыкли по фантастике прошлого века – именно то, что мне лично нравится. Есть возможность указать на рисунке зоны внесения изменений. Один конкретный совет: формула всегда будет «in square», не «внутри квадрата», не «в прямоугольнике», даже если будет выделен прямоугольник. Но, опять же, генерация больное место всех. Удаляет или перекрашивает нейросеть идеально, а рисует – насколько умеет и насколько умеешь объяснить ей. Так что, если не получается «Заменить шило в квадрате на мыло», можно попытаться сделать это в два этапа. Фоторедактор. Куда без него, и не надейтесь. Коллажирование Та же нейросеть, используемая для редактирования, может работать и с несколькими изображениями. Но собрать всё вместе достаточно сложно. Некоторые нейросети понимают прямые ссылки на картинки: «Девушка с картинки 2 сидит за столом с картинки 1», некоторые так не умеют (тогда хорошо, если девушка хотя бы одна), но в любом случае задача достаточно сложная. Фоторедактор. Если не получается получить требуемое в один клик, а уже использовал двести, можно максимально подготовить объект для переноса (развернуть, заставить принять другую позу), а затем действовать вручную. Пример. Генерация. (SDXL) Асока Тано и падаван мужского пола стоят в сосновом лесу обнявшись… Что-то в этом роде. https://i.imgur.com/8DMhTp6.jpeg Явно видны проблемы, но, в общем, эта картинка самая лучшая из трёх десятков. Редактирование (FLUX.1 Kontext Dev) (обратите внимание на название: именно это, а не «нечто похожее») Удалить косу в квадрате. https://i.imgur.com/8ukEKXR.png Он ещё и заапскейлил бесплатно, хотя размеры стояли конкретно изначального изображения. Похоже, конкретный глюк интерфейса сайта. Была мысль, что делать с уходящей назад прядью, но пусть это будет бывшая падаванская коса, не обрезанная, а заплетённая так. По-моему, интересная деталь, только играющая на имидж. Картинка в картинку. (ADetailer с набором hand_yolov8s.pt поверх FLUX.1 Kontext Dev) ADetailer – отдельная нейросеть, натренированная на улучшение отдельных частей человеческого тела. Теоретически, должна работать по принципу «сделай всё хорошо сама» – сама находит, сама улучшает. На практике это работает не очень. ADetailer имеет собственные запросы, положительный и отрицательный, отдельно от основной генерирующей (или ничего не делающей) нейросети. Можно попытаться запустить без запросов, она пытается всё же улучшить свою часть, но не сильно хорошо. Впрочем, и с запросами пришлось делать в несколько итераций – выбирать лучшее и снова дорабатывать. https://i.imgur.com/NxSvfEz.png Оригинальная рука. https://i.imgur.com/fA3BLNN.png Только отрицательный запрос, повреждённые пальцы. https://i.imgur.com/1Ubyirm.png Следующий этап, положительный: красивые нежные пальцы. Отрицательный: повреждённые пальцы, сбитые костяшки. https://i.imgur.com/EjfodCm.png Следующий этап, положительный: укоротить пальцы. Мне они показались слишком длинными, не очень-то они укоротились, но, кажется, стали получше. https://i.imgur.com/8q8hVWM.png Окончательный вариант изображения после редактирования нейросетью. Редактирование. (GIMP) https://i.imgur.com/8ZEUIUz.png Окончательный результат. Как говорится, найди 10 отличий (не считал, на самом деле сколько их здесь). Начиная с того, пока я смотрел на женскую руку, мужская рука тоже продолжала «творчески переосмысливаться» нейросетью, так что пришлось делать что-то на основе первого варианта. Это небольшой обзор, просто показывающий возможности. Генерация, это только первый этап. Смотрите на неё через прицел: насколько она отвечает основному настроению и насколько легко её можно доработать. За последние несколько дней я сделал несколько обложек к своим рассказам, и ни одно из этих изображений не обошлось без доработки, хотя бы минимального подкрашивания в фоторедакторе. Свернуть сообщение - Показать полностью
8 Показать 1 комментарий |
|
#цифровое #ии #всякая_фигня атнти #блогожизнь
Мне нравится иногда вести теологические диспуты с гуглом. Это дискуссии в своём изначальном значении: для познания, а не для доказательства своей точки зрения и не для уничижения оппонента. В прошлый раз, когда показалось, что гугл начинает ходить по кругу, отгораживаясь от аргументов догматикой (которая действительно даёт хорошее объяснение, но слишком вольно трактуют первоисточник), один вопрос решил спор. Тот момент, когда понимаешь оппонента, оппонент понимает тебя, и спорить становится не о чем. всё больше людей склоняются к тому, что старые объяснения требуют не «косметического ремонта», а честного признания их архаичности Да, хорошая попытка, господа богословы, но современный гуманизм перерос вас.Ранее он где-то разъяснял мои заблуждения (о чём спорить, если на вопрос «а не так ли обстоит дело?» даётся аргументированный ответ, что нет, не так), где-то подтверждал предположения. Приятно говорить, когда оппонент не пытается тебя троллить, не пытается гуглить и бросать в тебя обрывками аргументов, чтобы потянуть время, подловить тебя на каком-то второстепенном факте, не переходит на личности, что практикуется в блогах с первой реплики. И новое веяние: от дисклеймеров вида «согласно христианской догматике, принятой на 2026…» веет чем-то сюрреалистическим. Свернуть сообщение - Показать полностью
|
|
#вкалывают_роботы #ии
Сейчас проходил тест по нашему славному законодательству. Гугл ИИ – одёсную, дипсик – ошуюю. Все врут. Главная проблема – используют устаревшие нормативные документы. Очевидно функции времени, устаревания в них нет. Хотя я и не представляю, как это сделать, если не использовать некую специальную экспертную систему, чётко хранящую варианты документов с датами ввода и устаревания. А многие вопросы целенаправленно ставились именно на это – было так, стало по-другому. Ещё, в одном месте, гугл пытался подтянуть факты под положительный ответ, хотя из формулировок было ясно, что врёт, тогда как дипсик однозначно сказал, что нет. В общем, сдал на 100%, но в сложных вопросах получил разве что половину правдивых ответов (а простые вопросы не задавал), так что пришлось выкручиваться самому. Была ли вообще помощь? Да, была. Там где я вообще «что это?» мне выдали верный список. Но вот верить ли этому? Короче нервный тик. Пойду выпью чаю что ли. 4 Показать 4 комментария |
|
#цифровое #ИИ #идиоты_за_работой #картинки_в_блогах
Почти как улыбка Боромира, только нахмурившийся Оби-Ван. Синий фон показывает соответствие исходного текста и гуглоперевода. ![]() Пояснительная бригада для слабовладеющих: Про «хмурится» там не было ни слова. Последнее предложение гуглопереводчик влепил вместо разделительных трёх дефисов. 4 Показать 9 комментариев |