↓
 ↑
Регистрация
Имя/email

Пароль

 
Вход при помощи VK ID
временно не работает,
как войти читайте здесь!

Блог » Поиск

До даты
Вот не копая особо вглубь по исходникам, процитирую:
AMD купила Taalas

Taalas делает довольно радикальную вещь: вместо того чтобы хранить веса нейросети в HBM и на каждом inference гонять их туда-сюда, они буквально зашивают модель в кремний.

Базовые веса лежат в mask ROM.

Причём архитектура устроена так, что для новой модели не нужно заново проектировать и производить весь чип. Меняются всего две маски — они задают веса и dataflow конкретной модели.

То есть большая часть дизайна остаётся прежней.

Это сильно меняет экономику специализированных ASIC: новый model-specific silicon становится не многолетним проектом с чудовищным NRE, а относительно дешёвой производственной вариацией уже существующего кристалла.

Первый HC1 у Taalas: TSMC 6 nm, 815 мм², 53 млрд транзисторов, Llama 3.1 8B прямо внутри кристалла.

Но теперь эту технологию купила AMD.

А AMD умеет в чиплеты (chiplets).

И вот здесь начинается самое интересное.

Представьте не гигантский монолит, а набор простых weight-chiplets.

Каждый содержит кусок фиксированных весов модели и способен отдавать их детерминированным потоком с нужной вычислителю полосой.

Рядом — compute chiplet, который принимает этот поток и делает MAC.

В грубом приближении модель на 80B параметров — это порядок десяти массивов ёмкостью около 8B каждый. Не обязательно десять буквальных HC1, конечно, но масштаб понятен.

При этом базовая модель полностью immutable, а небольшой объём нормальной программируемой памяти остаётся для KV cache и LoRA. То есть модель физически зашита в железо, но её всё ещё можно адаптировать под конкретного клиента.

И самое важное — исчезает огромная часть того безумия, которое сегодня называется AI accelerator:
• никакой HBM для хранения весов;
• никаких терабайт в секунду между GPU и внешней памятью;
• никакого CoWoS ради того, чтобы поставить память достаточно близко;
• никакого постоянного движения одних и тех же десятков гигабайт весов на каждый токен.

ROM можно спокойно делать на зрелом техпроцессе. HC1 уже сделан на 6 nm — ему не нужны 2 nm.

А если AMD действительно разложит эту архитектуру на chiplets, то требования к interconnect тоже становятся совсем другими.

Не нужно строить универсальную когерентную систему с произвольными обращениями к памяти.

Веса идут потоком.

Latency отдельного обращения практически перестаёт иметь значение. Нужны предсказуемая bandwidth и правильный pipeline.

Один блок стримит веса. Другой их умножает. Всё сидит рядом на подложке (substrate).

По сути мы наконец приходим к железу, где нейросеть перестаёт быть программой, которую исполняет универсальный компьютер.

Модель сама становится компьютером.

Асики для нейронок файналли аррайвд (Andrew)

Осталось сделать. И отгрузить в канал что-нибудь приличное.
отсюда

Вообще, что-то похожее напрашивалось. А потом - варианты с возможностью небольшой реконфигурации, так же как из asic выросли FPGA. Конечно, тут существенная проблема в самих методиках конвертации весов модели или там cuda кода в специфический чип - а это не так просто. Но...
И как же замечательно ложится на многие фантастические сеттинги с умными роботами с особенностями мышления, зависящими от модели и серии.

PS
О Taalas на ixbt, о ней же на Хабре 1 и два.

#ai #ии
Свернуть сообщение
-
Показать полностью
Показать 3 комментария
Московский суд постановил, что нейросетевые арты — не творчество. Мужчина, который создал с помощью ИИ арты «Мона Лиза с вином» и «Статуя Свободы с вином» не смог доказать своё авторское право на них.

Он обратился в суд после того, как предприниматель начал продавать футболки и термокружки с его картинками. Однако в суде решили, что что спорные изображения созданы нейросетью, а раз у нее нет сознания, нельзя утверждать, что ИИ прилагает творческие усилия.

Также там отметили, что вклад человека в этой ситуации ограничивается уточнением команд, что не считается творчеством.
см

У нас, конечно, не прецедентное право, но как пример позиции - очень ярко. Есть над чем подумать.
Тем более что мелкий шрифт условий использования многих нейросеток - и всех доступных через онлайн чаты бесплатно - тоже добавляет нюансов.

#ai #ии
Показать 5 комментариев
Невыносимая слопность бытия - ещё одна статья про признаки нефильтрованного llm-сгенерированного текста. Пусть будет для справки про иишенки.

#ai #ии #хабр
Показать 1 комментарий
Заметил, что обороты вида "не то, а это", особенно несколько на абзац, окончательно вышли из оборота более-менее читающей и пишущей публики. Теперь такое выдаёт или ИИ, или те кто не в курсе...

И кстати - отдельный способ отпугнуть читателя это вставить аннотацию, написанную llm (особенно бесплатной китайской). А ведь на Киниге/Фикбуке это местами аж как лайфхак некоторые рекламировали. Лучше уж вообще без аннотации, чем сгенерированная, имхо.
Даже орфографические ошибки теперь отпугивают меньше...

#ai #ии
Показать 4 комментария
О перспективах и персональных пузырях.
Больше не получится послать всех в «####». В Roblox пришел вежливый ИИ-цензор
Платформа Roblox решила навести порядок в игровом чате и одновременно избавить пользователей от привычных «решёток», которые появляются вместо запрещённых слов. Компания представила новую функцию на основе искусственного интеллекта. Система переписывает грубые сообщения в реальном времени, сохраняя смысл фразы и нормальный ход разговора.

Roblox Corporation объявила о запуске функции автоматического перефразирования сообщений. Алгоритм следит за чатом во время игры и заменяет ругательства на более нейтральные формулировки. Такой подход должен сохранить динамику общения и снизить количество конфликтов между участниками.

На платформе ежедневно общаются миллионы пользователей. Координация действий во время игры часто происходит прямо в чате. Раньше при срабатывании фильтра вместо запрещённого текста появлялась строка из символов «####». Подобные сообщения ломали диалог и делали переписку трудной для понимания.

Новая система работает иначе. Искусственный интеллект анализирует сообщение и переписывает его в более корректной форме. Например, фраза «Hurry TF up!» раньше превращалась в «####». Теперь алгоритм изменит текст на «Hurry up!» и отправит уже исправленное сообщение.
...
Такая вот специфическая "свобода слова", да. И подозреваю, что спустя какое-то время возможно сформируется система с несколькими уровнями подобных фильтров - платформа, государство, платежные системы (вспомните, как Visa и MasterCard давили всякое на Pixiv и прочих) и конечный пользователь (причём и осознанно используемые, и например явочно, без уведомлений, как Гугл Хром и Мелкомягкая Винда со своими ии-моделями и фильтрами, устанавливаемые софтом в фоне).

#цензура #ai #ии
Свернуть сообщение
-
Показать полностью
Показать 6 комментариев
Забавное совпадение по близким темам и одновременному всплытию в ленте новостей.

С одной стороны, Стивен Талер окончательно проиграл в Верховном Суде США дело о признании за ИИ авторских прав. Автором юридически может быть только человек - и с учётом законодательной функции Верховного Суда США это очень серьёзно и вероятно надолго.

С другой, в косплей-сообществе забродил скандал. Широко известный (не мне) в узких кругах коллекционер "сигн" (это когда косплей-модель делает фото с листиком/табличкой/на теле с персональной надписью от заказчика, за денюжку, иногда ню) которых хвастался коллекцией из 2000+ сигн от всех действующих в Рунете моделей вроде как попался на массовом использовании ИИ-нюдификаторов (раздевалок) и приторговывании получившимся, причём (как выделяют скандалящие) даже с несовершеннолетними моделями.
Прям хм.

#ai #ии
Показать 3 комментария
Для размышлений:

На San Diego Comic‑Con полностью запретили созданное с помощью ИИ искусство после шквала жалоб от художников
... В правилах проведения выставки говорится, что работы, частично или полностью созданные с помощью искусственного интеллекта, не допускаются к участию. При этом в случае возникновения вопросов решение о допуске будет принимать координатор выставки.

Это правило стало новшеством. Ранее на San Diego Comic‑Con допускались работы с участием искусственного интеллекта, однако их запрещалось выставлять для продажи, говорилось в правилах проведения выставки 2024 года. Кроме того, организаторы требовали маркировки работ, в которых использовался ИИ.
...
Ситуация на San Diego Comic‑Con отражает настроения в поп‑культурном сообществе, сложившиеся в отношении генеративного ИИ в последние годы. Президент DC Comics Джим Ли в октябре 2025 года пообещал, что студия будет поддерживать только работы живых людей, в которых не использовался ИИ. В августе на выставке GalaxyCon также ввели масштабный запрет на сгенерированное с помощью ИИ искусство. А в марте 2025-го участники и посетители Dragon Con заметили, что один из продавцов на выставке торговал ИИ‑артами — мужчина не стал отрицать, что использовал нейросети. Более того, продавец назвал пожаловавшихся на него художников «нищими» и «неудачников», а с самой выставки его вывели сотрудники полиции.
Размежевание и разделение ниш похоже всё же случится, не получится плавной интеграции как "всего лишь ещё один инструмент" - очень плохой фон для процесса, слишком злоупотребляют нейрослопом...

#ai #ии #нейросетевое #нейроарты #хабр
Свернуть сообщение
-
Показать полностью
Показать 8 комментариев
Для ориентира.
... Сколько стоит развертывание ИИ мощностей?

Достаточно противоречивые оценки в зависимости от источника, но Хуанг и операционный директор OpenAI склоняются к $50 млрд и выше в расчете на 1 ГВт мощности.

Решил оценить распределение расходов и понять, что включено в стоимость. Расчеты очень приблизительные, но позволяют оценить структуру распределения стоимости.

Сейчас рыночная цена одного вычислительного кластера на базе самого современного чипа Blackwell GB300 стоит около 4.5 млн долларов, где стоимость самих чипов и NVlink около 3.5 млн, а остальное – сетевая, энергетическая и инфраструктурная «обвязка».

Система включает 72 GPU Blackwell (36 суперчипов GB200, каждый с 2 GPU), 36 CPU Grace и инфраструктуру NVLink для соединения всех компонентов, сетевое оборудование InfiniBand, коммутаторы Spectrum-X800, DPU BlueField-3, кабельная система и блоки питания, система охлаждения, компоненты самой стойки и распределительных энергосистем с учетом мониторинга и систем защиты, далее система маршрутизации, виртуализации и хранения данных.

Каждая такая система весит около 1.5 тонн минимум с учетом вспомогательного оборудования и нормализованное потребление с постоянной нагрузкой около 120-132 кВт.

Производительность одного вычислительного кластера 360 петафлопс FP16, 5800 терафлопс FP32 и 2900 терафлопс FP64.

Если сравнить с игровой видеокартой RTX 5090 по цене 2 тыс баксов, по FP32 и FP64 производительность кластера выше всего в 55 раз, однако в специализированных ИИ вычислениях и тензорной производительности разница в среднем в 500 раз, а пропуская способность NVlink выше в 1000 раз.

В сопоставимой ИИ производительности система на базе RTX 5090 обойдется примерно в 2 млн долларов, но проиграет по площади развертывания и главное – по межядерному взаимодействию.

Напрямую сравнить нельзя. Во-первых, память у кластера 13.4 ТБ HBM3e и 576 ТБ/с у NVL72 против 32 ГБ и 1.8 ТБ/с у RTX 5090, т.е. разрыв свыше 320 раз в пользу кластера.

Интерконнект NVL72 у вычислительного кластера имеет пропускную способность в 130 ТБ/с, а масштабирование игрового GPU ограничено PCIe и NVLink-мостами прошлых поколений, что несопоставимо.

Слабое архитектурное звено гражданских RTX 5090 – память и межчиповое взаимодействие через интерконнект NVlink, что приведет к тому, что вычислительный чип будет простаивать, ожидая отклика в обмене данных, снижая КПД системы.

Для LLM-нагрузок определяющими будут не производительность в FP32-64, как в экосистеме Windows/Linux совместимых приложений, а FP8/FP4 Tensor (в основном для инференса), при обучении LLM доминируют BF16/FP16 и FP8 в смешанных схемах, имеют значение пропускная способность между GPU и HBM памятью.

Поэтому при реальных ИИ-задачах разрыв между кластерами и RTX 5090 обычно сотни раз и растет с размером модели.

В ИИ фабрике в расчете на 1 ГВт входной мощности на вычислительные кластеры с учетом систем хранения данных приходится примерно 75-77% потребления всей энергии, еще 15% идет на работу систем охлаждения, кондиционирование и обеспечение насосных станция для водоснабжения, 5% - системы питания, а 2-3% - освещение, административный корпус, мониторинг и управление.

Получается, что в расчете на 1 ГВт мощности (по собственным оценкам):

• Около 6100-6300 вычислительных кластеров стоимостью от $28 млрд + 5 млрд обслуживающее ИТ оборудование.

• Подготовка земли, разработка проекта, сертификация – $0.5-1 млрд в зависимости от места.

• Полный комплекс всех сооружений, модулей и корпусов ИИ фабрики, в том числе инженерная инфраструктура ЦОД (здание, электрика, UPS, охлаждение) с учетом особого уровня ИТ оборудования для «капризных» ИИ кластеров стоимостью около $8-12 млрд в зависимости от сложности и места проекта.

• Электростанция (ТЭЦ) с учетом электроподстанций, трансформаторов, электросетей, сопряженной энергоинфраструктуры и подсоединения к сетям около $3 млрд в расчете на 1 Гвт мощности.

• Внешняя промышленная инфраструктура – водные резервуары, телеком магистрали, резервы топлива, транспортная инфраструктура еще около $1-2 млрд.

Продолжение следует...
Отсюда

При этом срок эксплуатации этих самых кластеров оценивается в 2-4 года. С одной стороны, (моральное) устаревание, а с другой - довольно быстрая деградация собственно электроники и характерная форма графика роста частоты отказов от срока эксплуатации.

Эх, капексы не бьются...

#ai #заклёпки #ии #цитаты #экономика_спгс
Свернуть сообщение
-
Показать полностью
К вопросу о терминологии.
Эхоборг – это человек, чьи слова и/или действия определяются АИ, а реплики передаются человеку по скрытому каналу, после чего он их озвучивает (speech shadowing)
См

Люди такие люди, да. Если что-то можно использовать как наркоту (в самом широком смысле) - это что-то точно будет так использовано.
И да. Экономия. Вынести генерацию голосов из головы на внешнюю платформу - энергетически выгодно для нашего ленивого мозга. У себя оставить только то, что даёт дофамин и прочие поощрения, остальное лишнее, главное нажать педальку...

#ии
Показать 3 комментария
К вопросу о сомнительном прогрессе.

Эксперимент: смогут ли бесплатные чат-боты написать Sci-Fi роман, достойный публикации на Литресе
... На старте у меня был документ с описанием будущей книги и модели с базовыми тарифами: ChatGPT, DeepSeek, Claude и Алиса.
...
Я с удовольствием наблюдал, как мои идеи буквально материализуются. Книга больше не была абстрактными мыслями, которые витают только в моей голове — вот содержание всего романа, вот очень конкретные, хоть и краткие истории. Кроме эмоциональной составляющей этот шаг принёс очень прикладную пользу: я смог оценить книгу «взглядом с вертолёта», увидеть полную картинку
...
Так, Claude предложил любопытный сюжет, но сам рассказ сделал затянутым; DeepSeek написал откровенно слабую главу, но подытожил её вдохновляющим блоком; Алиса с ChatGPT генерировали интересные отдельные абзацы, которые вписывались практически в любой черновик.
...
Работа с промптами, этапность, сравнение разных LLM... Но...
Мне грустно. Похоже, уровень "текстов от йашек" и первых романов такая методика позволяет превзойти уже в ближайшей перспективе, и даже замахнуться на нижний уровень коммерческого писева. Но вот навыки, необходимые для более продвинутых художественных текстов - ... Вытеснение джунов, ага. И очередной этап великого усреднения.

#хабр #ии #нейросетевое #ai
Свернуть сообщение
-
Показать полностью
Показать 1 комментарий
ПОИСК
ФАНФИКОВ









Закрыть
Закрыть
Закрыть