Идеи проектов для вайб-кодинга: что собрать на выходных — приложения, боты, мини-сайты — и как довести до результата.

Раньше «живая камера с распознаванием» — это сервер, поток и лаги. В июле Google принесла в браузер быстрый движок на GPU: твоя модель бежит по видео прямо у тебя, ничего не улетает наружу. Сборка на выходные.

20 июля ByteDance показала Seed Audio 1.0: шаги, дождь, гул и голоса приходят одним запросом, уже сведённые в одну дорожку. На этом собирается генератор атмосфер за выходные.

8 июля Cloudflare убрал главный барьер новичка: живая ссылка появляется ДО аккаунта. Собери с ИИ страницу-приглашение и выложи её за минуту.

Раньше говорящий персонаж — это аниматоры, липсинк и движок. Теперь рисунок оживает по одной картинке и ведёт настоящий диалог. Оживи своего героя за выходные.

Раньше нейросеть рисовала «похожего на тебя» человека. Теперь она держит именно твоё лицо и переносит тебя хоть в 90-е, хоть в мультик. Собери такой генератор за выходные.

Царапины, жёлтый налёт, размытые лица. Раньше это чинили в фотошопе часами — а теперь модель приводит старый снимок в порядок за один заход. Собери такую примочку за выходные.

Раньше на каждое «а теперь по месяцам» модель открывала файл с нуля. Теперь у неё живой Python: переменные остаются между запросами, контейнер живёт 30 дней, 1550 часов в месяц бесплатно.

Правила боту обычно суют в реплику пользователя — и пользователь же отменяет их одной фразой. 15 июля в API появилась роль system прямо посреди диалога: это голос тебя-разработчика, и он весомее. Сборка на выходные.

Раньше картинку ждали: жмёшь «сгенерировать» — и смотришь в спиннер. Теперь она догоняет текст на лету: добавил слово — картинка сразу другая. Сборка на выходные.

Раньше книжка-раскраска значила рисовать каждую страницу руками. Теперь пишешь «космический кот-пожарный» — и через минуту восемь чёрно-белых страниц под печать. За вечер.

Раньше ИИ рисовал похожий на QR узор — наведёшь камеру, а он ведёт в никуда. Теперь модель пишет код и вставляет рабочий QR прямо в арт. С готовым промптом.

Обычный бот забывает всё, как только закрыл чат. Теперь память — отдельный сервис: бот вспоминает твоё имя и привычки через неделю. Бесплатно, с готовым промптом.

Раньше сдвинуть текст на постере = перегенерировать картинку целиком. Теперь она приходит стопкой слоёв: тянешь один — остальные на месте. С готовым промптом.

Раньше агент жил, только пока открыта вкладка. Закрыл ноут в метро — он умер на середине. Теперь ставишь background: true и уходишь. С готовым промптом.

Весь мир игры — это один поток от модели. Раньше каждый ход зависал на «загрузка…». Теперь ответ льётся за миг — и история оживает. С готовым промптом.

Записал озвучку, а там одно слово не то? Раньше — переписывать весь дубль заново. Теперь меняешь одно слово, и модель ресинтезирует только его — твоим же голосом, бесшовно. Open-source, сборка на выходные.

Раньше поправить одну деталь в ИИ-ролике значило собрать его заново — и он выходил другим. Теперь говоришь «сделай ночь», и меняется только небо. Остальное на месте. Сборка на выходные.

Раньше «рой агентов» приходилось городить руками, и десять параллельных стоили дорого. 9 июля OpenAI встроила это в модель, а дешёвый tier сделал копейками. Собери свой мини-ресёрч за выходные.

Раньше прогнать умную модель по каждому из 200 писем было дорого — поэтому фильтровали по ключевым словам. 9 июля вышел дешёвый tier за $1 за миллион токенов. Собери личный «важный» экран за выходные.

Раньше голос только отвечал: таймер ты заводил сам. 6 июля OpenAI выкатила речь-в-речь, которая на лету вызывает твои функции — теперь голос сам жмёт кнопки, пока руки заняты. Сборка на выходные.

Кидаешь документ, за пару минут получаешь телефонный номер — звонишь и голосом спрашиваешь по своему файлу, а он отвечает. Год назад это была неделя возни.

Пишешь одну фразу — что за игра — а агент сам делает арт, код и звук и выдаёт ссылку в браузере. Год назад так не выходило — теперь это проект на выходные.

4 июня Krea выложила Turbo в открытый вес — кадр 2K за ~2 секунды на обычном железе. Это ломает привычку «сделал один, жди, правь». Теперь генеришь сразу двадцать вариантов и выбираешь. На этом за выходные собирается примерочная идей интерьера или образа.

13 июня OpenRouter выкатил Fusion: один запрос уходит в панель моделей, а судья сводит их в один ответ и подсвечивает разногласия. На этом за выходные собирается бот для важных вопросов — с честной пометкой «тут модели не согласны».

Собеседование, отказ, важный звонок — то, что страшно завалить с первого раза. 1 июля xAI открыла конструктор голосовых агентов: описываешь словами — через пару минут он звонит и говорит сам, ~5 центов в минуту. Спарринг-партнёр собирается за вечер.

Раньше автоматизировать сайт значило писать хрупкий скрипт под конкретные кнопки — и он ломался от любого редизайна. Теперь агент просто смотрит на экран и жмёт, как человек. Сборка на выходные.

Берёшь свою готовую видеозаметку и получаешь её же на английском — своей интонацией, без пауз «перевёл-подождал». Год назад авто-дубляж звучал как навигатор. Сборка на выходные.

Раньше синтез читал всё ровным диктором. Теперь в текст вставляешь [шёпотом] или [взволнованно] — и модель играет сцену. Маленький аудиоспектакль собирается за выходные.

Раньше встроенная в браузер модель только читала текст. С Chrome 148 она видит картинку и возвращает структуру — фото афиши превращается в карточку. Сборка на выходные.

Переводчик показывает смысл слова. А страх — это произнести его вслух. На свежей фиче ChatGPT собирается тренажёр, который проговаривает слово по слогам. За выходные.

Раньше ИИ-фиче нужен был бэкенд, ключ и счёт за токены. Теперь модель живёт прямо в браузере — и тебе хватит одного файла. Собирается за выходные.

Грузишь одно селфи — получаешь восемь стикеров, и на всех узнаваемо ты: смеёшься, грустишь, показываешь класс. Раньше лицо плыло от кадра к кадру. Теперь держится.

Записываешь полминуты речи — и приложение отвечает на чужом языке твоим же голосом. Год назад так не выходило. Собирается за выходные.

Опиши настроение словами — получи трек, который можно публиковать. Музыкальный API теперь обучен на лицензированных данных. С готовым брифом.

Раньше тут была нужна векторная база и RAG. Теперь весь год переписки влезает в один запрос — миллион токенов контекста подешевел в разы.

Не картинку, а видео: пишешь одну фразу — через минуту 8-секундный вертикальный клип со звуком, прямо под Stories. Veo 3.1 в Gemini API. С готовым стартовым промптом.

Раньше большой файл резали на части и искали по ним (это RAG). Вышла GLM-5.2 — миллион токенов контекста, открытая и дешёвая. Теперь весь документ влезает в один запрос. С готовым стартовым промптом.

Скидываешь модели запись лекции или туториала — а в ответ оглавление: на 02:14 про токены, на 09:40 про эмбеддинги. Год назад так просто не вышло бы — теперь собирается за выходные.

Не подпись поверх картинки, а та же фотография, где надписи уже переведены и стоят на своих местах. Раньше это был отдельный конвейер — теперь один запрос.

«Где тут включить?» — раньше ты пересказывал, что у тебя на экране. Теперь модель сама видит твой экран и подсказывает голосом, шаг за шагом. Сборка на выходные.

Раньше ты фоткал и ждал ответ текстом. Теперь модель видит живой поток с камеры и говорит в реальном времени — и её можно перебить, как живого. Сборка на выходные.

Раньше нейросеть-композитор стоила денег и жила в закрытом сервисе. Теперь настоящая песня с вокалом и текстом — это один запрос за ~3 ₽. На этом собирается генератор поздравлений за выходные.

Раньше 3D-модель из реальной вещи делали из десятков фоток и в спецпрограмме. Теперь хватает одного снимка — модель сама достраивает то, чего на фото не видно. Сборка на выходные.

Подписки, оферты, аренда — мелкий шрифт, который никто не дочитывает. Теперь дешёвая модель читает его за тебя и подсвечивает, где ловушка.

Не «что приготовить вообще», а рецепт из твоих продуктов на фото плюс короткий список докупить. Год назад так просто не выходило.

Раньше «впишется ли» можно было только гадать или мучить фотошоп. Теперь модель сливает две твои фотки в одну сцену — вещь стоит в твоей комнате. Сборка на выходные.

Раньше модель в каждом кадре рисовала героя по-новому — и комикс рассыпался. Теперь лицо держится от кадра к кадру. Сборка на выходные.

Раньше «следилку» за рестоком или билетами надо было кодить: парсер, расписание, сравнение. Теперь агент сам смотрит и сам решает, важно ли. Сборка на выходные.

Раньше «агент» значило, что ты руками собираешь цикл подумал→сходил→проверил. Теперь это один вызов API: сервер крутит цикл сам. Сборка на выходные.

Раньше озвучку приходилось ждать: рендерится полминуты, ребёнок смотрит в спиннер. Теперь модель говорит с первого слова. Сборка на выходные.

В галерее 4000 скринов, и нужный не найти. Теперь модель ищет не по тексту, а по самой картинке — и достаёт тот самый кадр. Сборка на выходные.
Раньше модель видела только одну картинку. Теперь она смотрит видео целиком, ловит лучший момент — и делает из него обложку. Сборка на выходные.

Раньше любой переводчик = облачный API, ключ и плата за символы. Теперь браузер переводит сам: офлайн, бесплатно, на 145 языках. Сборка на вечер.

Обычная нейросеть рисует мир таким, каким запомнила на обучении. Новая Seedream сама лезет в интернет во время генерации — и постер выходит с сегодняшними фактами. На этом можно собрать проект за выходные.

Раньше, чтобы оживить фотографию, нужен был видеоредактор и куча возни. Теперь хватает одного фото и одной фразы — модель сама делает короткий ролик со звуком. Это сборка на выходные.

Не «запиши — подожди — прочитай ответ», а настоящий разговор голосом в реальном времени. На прошлой неделе OpenAI выкатила модель, которая отвечает без паузы и не сбивается, когда её перебиваешь.

Никакого API-ключа, никаких счетов за запросы: модель уже внутри iPhone. На прошлой неделе Apple добавила в неё картинки и бесплатное облако — собрать что-то полезное стало делом выходных.

Сохранённые статьи и конспекты можно скормить модели — и получить mp3, где два ведущих живо обсуждают их. Раньше так просто не выходило, теперь это сборка на выходные.

Раньше модель смотрела на фото одним взглядом и угадывала «штук двадцать». Теперь она приближает и считает точно — и это сборка на выходные.

Раньше нейросеть рисовала красивый фон и пьяные буквы поверх. 3 июня вышла Reve 2.0 — она сначала строит макет, а потом картинку, поэтому надписи на афише, меню и вывеске реально читаются.

Год назад «умный дневник» означал, что твои самые личные записи улетают на чужой сервер. 8 июня Apple открыла бесплатный доступ к модели прямо на устройстве — теперь ИИ размышляет офлайн, без ключа и без счёта за API.

Бормочешь мысли в телефон по дороге, а приложение возвращает не стену текста, а разобранные пункты: задачи, решения, идеи. И не спотыкается о твои термины.

Записываешь 30 секунд своей речи — и любой текст потом звучит твоим голосом. Год назад для этого нужна была студия. Теперь собирается за выходные.

Короткий список идей, у каждой — что именно ты потренируешь. От таймера до телеграм-бота. Выбери одну и начни сегодня.