Свернуть поиск
Превращаем себя в персонажа комиксов в Omni
Превращаем себя в персонажа комиксов в Omni Create a 10-second vertical cinematic video, 9:16, ultra-realistic premium live-action. A person faces the camera in a modern indoor room with warm natural ambient lighting. Their fingertips can physically manipulate the boundary between photorealistic reality and a black-and-white manga universe. There is NO physical object between the hands. The opening exists only because of finger positions. ## CORE VISUAL LAW The fingertips control a dynamic portal in real time. Everything OUTSIDE the hand-defined shape remains photorealistic live-action. Everything INSIDE becomes a perfectly aligned black-and-white manga version of the same face, body, and room. The manga layer stays spatially locked to the real scene beneath it. The boundary follows the fingertips precisely and continuously. --- ## 0–2s — THE SLIT Medium close-up, frontal view. The person looks into camera and quickly raises both hands. Thumbs and index fingers create an
Показать еще
- Класс
MiniMax выложила Music 3 в открытый доступ
MiniMax выложила Music 3 в открытый доступ MiniMax-Music3 это новая модель для генерации полноценных песен длительностью до пяти минут. На вход можно дать текст песни и описание звучания, а на выходе получить готовый трек с вокалом, инструментами и развитием аранжировки. Модель понимает структуру песни. Можно отдельно задать вступление, куплеты, припев, бридж, инструментальную часть и финал. Также описываются жанр, BPM, тональность, инструменты, характер вокала и то, как музыка должна меняться по ходу трека. Внутри используется связка из глобальной модели на 8 млрд параметров и локальной на 600 млн. Первая отвечает за общую структуру композиции на длинной дистанции, вторая за мелкие детали звука. Итог генерируется в стерео WAV с частотой 32 кГц. Модель можно запускать локально. В полном режиме ей нужно меньше 24 ГБ видеопамяти, а с выгрузкой части вычислений в оперативную память она запускается даже на GPU с 8 ГБ VRAM, хотя работать будет медленнее. Для запуска уже поддерживаются
Показать еще
- Класс
Эстетичные постеры в GPT
Эстетичные постеры в GPT Редакционный тревел-плакат «ЯПОНИЯ», подзаголовок «ПУТЕШЕСТВИЕ СКВОЗЬ ВЕЧНЫЕ ЧУДЕСА». Формат 3:4, эстетика luxury travel campaign. Фон — кремовая бумага с текстурой слоновой кости. Темно-синяя типографика, бордово-сливовые акценты, тонкие золотые детали, симметричная журнальная сетка. Вверху — огромное «ЯПОНИЯ» шрифтом с засечками в стиле high-fashion editorial, с каллиграфическими росчерками от крайних букв. Ниже — подзаголовок прописными без засечек. Орнамент: ветви сакуры, волновые мотивы, элементы японской гравюры в бордово-золотой гамме. По центру — минималистичная эмблема-Хиномару. Центр — большая непрерывная 3D-лента из струящейся кремовой бумаги (бесконечная петля) вертикально через весь плакат: загнутые края, объемная глубина, мягкие тени. Внутри — пять фотореалистичных панорамных сцен: Токио и наследие: пагода с красными деревянными деталями, сакура, сады, Skytree и небоскребы вдали, прохожие в кимоно, весенний свет. Традиционная Япония: квартал
Показать еще
- Класс
Manus стал полностью бесплатным до 25 августа
Manus стал полностью бесплатным до 25 августа До 25 августа 2026 года по сингапурскому времени Manus не будет списывать кредиты за использование агентов. Бесплатно доступны Manus 1.6 и облегчённая версия Manus 1.6 Lite. Можно запускать задачи через любой из них без расхода кредитов. Есть только одно ограничение. В часы высокой нагрузки задачи бесплатных пользователей могут вставать в очередь. Владельцы тарифов Pro и Team получают приоритет. Акция проходит на фоне того, что Manus снова становится независимой компанией и отделяется от Meta. Части пользователей Manus придётся сохранить данные до 23 августа, после чего некоторые аккаунты пройдут процедуру удаления и восстановления. С 25 августа резервную копию можно будет загрузить обратно и продолжить работу. Если аккаунт не попал под изменения, ничего делать не нужно. dailyprompts.ru
Показать еще
- Класс
Сервис, который превращает часовое интервью в готовый текст с задачами за пару минут
Сервис, который превращает часовое интервью в готовый текст с задачами за пару минут Делюсь с вами удобным сервисом для тех, у кого постоянно копятся подкасты, вебинары, интервью и длинные видео, которые проще прочитать, чем смотреть целиком. Whisper AI расшифровывает аудио и видео в текст без лимитов и поддерживает файлы длительностью больше 6 часов. Можно просто скинуть ссылку с YouTube, VK, Rutube, TikTok и еще десятка площадок. На выходе получаете текст с таймкодами и разбивкой по спикерам. Расшифровку можно сохранить в Docs, Word, PDF, TXT или Markdown, либо сразу разобрать через встроенные GPT и Claude. Из нового появилась поддержка MCP для GPT и Claude. То есть расшифровки и контекст из Whisper AI можно подключать напрямую к своим ИИ инструментам. Еще полезная штука для Telegram. Бота можно добавить в обычную беседу, после чего он будет расшифровывать голосовые сообщения и кружочки для всех участников. Работает даже для тех, у кого нет Telegram Premium. В итоге длинное инт
Показать еще
- Класс
Z.ai выпустила GLM-5.3
Z.ai выпустила GLM-5.3 Модель получила большой апгрейд именно в агентной работе и кодинге. Во внутреннем тесте Z.ai на реальных задачах программирования результат вырос примерно на 50% относительно GLM-5.2. В тесте на работу ИИ прямо внутри терминала результат вырос с 4.6 до 28.3. В задачах, где модель должна самостоятельно находить и исправлять ошибки в коде, показатель поднялся с 46.2 до 66.9. В тестах на полноценную работу с большими репозиториями и реальными программными проектами GLM-5.3 тоже заметно прибавила. Один из результатов вырос с 67.5 до 78.1, другой с 19.4 до 42.5. Отдельно сильно выросли способности в кибербезопасности. В тестах на поиск и эксплуатацию уязвимостей результат поднялся с 24.4% до 54.4%, а в другом наборе задач с 77.2% до 84.5%. Причем эти способности появились как побочный эффект обучения модели кодингу и работе с инструментами. Из-за этого Z.ai пока не публикует открытые веса и проводит дополнительную проверку безопасности. Сейчас GLM-5.3 уже доступ
Показать еще
- Класс
Suno выпустила Studio 2
Suno выпустила Studio 2 В Studio 2.0 появился MIDI. Можно подключить MIDI-клавиатуру, записывать и редактировать партии прямо на таймлайне, использовать встроенный синтезатор и даже подавать MIDI-клип как промпт для генерации нового аудио. Главное обновление это Chat Bar. Теперь с музыкальной студией можно буквально разговаривать. Просишь создать вокал или инструмент, собрать новый синтезатор, сделать собственный аудиоплагин или просто привести проект в порядок. Добавили продвинутое разделение треков на вокал, барабаны, бас и другие части. Причём загружать можно не только музыку из Suno, но и любые свои аудиофайлы. Появились нормальные аудиоэффекты, автоматизация параметров и экспорт мультитреков в качестве до 32 бит и 48 кГц. Свои эффекты и плагины тоже можно собирать через чат. На старте за их создание кредиты не списываются. По сути Suno постепенно уходит от схемы «написал промпт и получил песню». Теперь это уже полноценная студия, где ИИ генерирует материал, а человек получает
Показать еще
- Класс
Google выпустила Gemini 3.7 Flash всего через три недели после Gemini 3.6 Flash
Google выпустила Gemini 3.7 Flash всего через три недели после Gemini 3.6 Flash Новая версия заточена под кодинг и ИИ агентов, при этом на старте стоит в два раза дешевле первоначальной цены 3.6 Flash. В кодинге прирост получился заметным. FrontierCode 1.1 вырос с 34,4% до 43,6%, а DeepSWE v1.1 с 49% до 65,3%. В WebDev Arena новая модель набрала 1588 Elo против 1538 у прошлой версии. Google отдельно прокачала генерацию интерфейсов. Модель может получить скриншот, картинку или целую дизайн-систему и собрать по ним рабочий интерфейс, стараясь сохранить исходный стиль. В демонстрациях она за один запрос создает интерактивные лендинги и вместе с Nano Banana собирает полноценную 3D игру. С документами тоже большой скачок. На тесте GDP.pdf результат вырос с 22% до 34%, а на AutomationBench с 17% до 30,4%. Модель лучше справляется с многошаговыми задачами, использованием инструментов и реальными бизнес-процессами. Gemini 3.7 Flash уже стала основной моделью для агента Gemini Spark. Он мо
Показать еще
- Класс
Higgsfield официально появился внутри ChatGPT
Higgsfield официально появился внутри ChatGPT Теперь прямо из чата можно запускать Seedance 2.5, Seedream 5.0 Pro, GPT Image 2.0 и Kling 3.0. У Higgsfield уже есть единая платформа с несколькими генеративными моделями для изображений и видео. Главное здесь даже не список моделей. Больше не нужно переключаться между вкладками, переносить промпты и отдельно работать с каждым генератором. Можно попросить сделать движение медленнее, поменять освещение на золотой час или исправить отдельную деталь и продолжить работу обычным диалогом. ChatGPT как раз развивает такую модель работы через плагины. Они могут подключать внешние приложения и их действия прямо к разговору, без необходимости покидать ChatGPT. Получается довольно показательный тренд. Сами генераторы постепенно уходят на второй план, а главным интерфейсом становится обычный чат. Пользователю уже не так важно, где физически находится Seedream или Kling. Он просто описывает результат, а нужный инструмент подключается внутри рабоч
Показать еще
- Класс
Seedream 5.0 Pro вслед за другими научился раскладывать сгенерированное изображение на отдельные редактируемые слои
Seedream 5.0 Pro вслед за другими научился раскладывать сгенерированное изображение на отдельные редактируемые слои Новая функция Layer Separation отделяет элементы картинки друг от друга. После этого объект можно передвинуть, увеличить, перекрасить, заменить или полностью удалить, не пересобирая всю композицию заново. Готовый результат можно дальше дорабатывать в Photoshop или Figma. Меньше ручного выделения объектов, масок и повторного вырезания элементов. Туториал dailyprompts.ru
Показать еще
- Класс
загрузка
Показать ещёПравая колонка