Telegram Group & Telegram Channel
Vibe Coding: Реальность vs хайп. Как за 7 дней по вечерам собрать MVP AI-платформы транскрибации

Предыстория: Год назад мы с Артёмом уже делали ASR на Whisper Large v2
Есть даже бот @daisytranscribe_bot он работает на базе него, но работал медленно

Внутри компании звонки множатся, все хотят транскрипт, саммари и закрепить в базе знаний (еще же нужно что бы точно безопасно!)
Решение: Отбросить сомнения как говорит Паша, не смотреть на код, главное фичи для пользователя!

Железо: 2x RTX 4500 (40GB) + RTX 4090 (48GB) освободились недавно значит берем
Стек: WhisperX + Qwen2.5-32B-Instruct + FastAPI + Vanilla JS + Python

Vibe Coding это что на деле?

Все бурлят про "AI написал мне приложение за день".
Реальность чуть-чуть сложнее
Я не написал ни одной функции с нуля. AI писал код, я только правил порты, адреса, конфиги
Но направлял архитектуру, принимал решения, тестировал, давал правки вел TODO
За 7 днями стоят 6 лет опыта в DevOps/архитектуре/разработке/дизайне/продукте

Факт №1 AI не заменяет экспертизу он ускоряет её

Результат
- 16,611 строк кода (Python 25.7%, JS 42%, CSS 15.1%)
- 3 компонента: Backend + Frontend + Chrome Extension
- 56 транскриптов обработано, 20 пользователей
- x8 ускорение от старого ASR
- Час 30 аудио → 8 минут обработки с саммари


Фичи
- WhisperX транскрипция с диаризацией
- Qwen2.5-32B-Instruct саммаризация (120k контекст!)
- Real-time транскрипция через WebSocket
- Chrome расширение для записи звука
- 6 форматов экспорта: SRT, DOCX, PDF, JSON, TSV, VTT
- Google OAuth авторизация


Дальше я выдал доступ к репо Артёму и он накидал док по которому мы дальше будем двигаться по правкам (тоже вырабатываем новый подход к разработке).

Как точно подметил Коля из чатика авторов про AI:
"Вообще эта дока – лучшая иллюстрация отличий vibecoding vs coding-with-ai. Что большая часть вайбкодеров из твиттера/ютуба даже никогда не узнают про такие косяки у себя в коде."

И это действительно так разница между "вроде работает" и системным подходом огромная



Да, есть проблемы пока БД плохо описана и в sqllite, перееду на PostgreSQL. Были глюки с авторизацией, за 2 дня переехал на Google OAuth
Проект модульный, взял лучшие практики, теперь твердая основа для транскрипции в компании есть

Главные инсайты для меня

1. Можно сделать MVP за 7 дней одному
Доказал: один человек = DevOps/Архитектор/Разработчик/Дизайнер/Продукт Но нужны 6 лет фундамента
Начни с простого проекта на знакомом стеке
Четкое ТЗ, нарисуй архитектуру разбей все на микрозадачи(конвертим в cursor rules
)
Делай каждый день по 2-3 часа, не растягивай


2. AI-ассистент меняет роль
От кодера к архитектору и тестировщику
Попробуй Cursor/GitHub Copilot на реальном проекте
Архитектурные паттерны, системный дизайн
Формулируй задачи четко, проверяй каждый результат


3. Проверка критична
AI пишет красивый код, который может работать неправильно или вовсе создаст вам моков (такое было раза 3 точно)
Я тестил каждую функцию руками и по несколько раз от апи до интерфейса


4. Vibe coding ≠ магия
AI помогает думать быстрее, но опыт незаменим
Системное мышление, понимание бизнес-логики
Изучай паттерны, архитектуру, best practices


5. Vibe coding точно быстрее
Особенно на старте и с 0 когда ты можешь нарезанные задачи раздать
толпе вкладок в том же курсоре их можно сделать несколько
Курсор не плохо сразу трудится над параллельными задачами главное сам не теряй фокус!


Факт №2 Я Потратил 820 вызовов в Cursor это не "одна кнопка"

Почему успех?

Сервисом реально пользуются!
Саммари после встреч приходят сразу 1:30 звонка транскрибица с разделением по ролям за 8 минут!
Когда код сделанный вот в таком формате решает проблемы людей лучшая мотивация.

2x RTX 4500 + RTX 4090 + неделя энтузиазма = AI-платформа в продакшене!

Факт №3: Solo до MVP легко, но от MVP до production нужна команда: SAST, масштабирование, безопасность AI (не учёл всё сразу).

P.S. Дальше, если наберется данных, расскажу про обучение транскодера для qwen2.5-7b-instruct

Скрины интерфейса и архитектуры в комментариях

P.S.S Планирую залить в open-source
7🔥84👍26💯5🤔3



group-telegram.com/neuraldeep/1510
Create:
Last Update:

Vibe Coding: Реальность vs хайп. Как за 7 дней по вечерам собрать MVP AI-платформы транскрибации

Предыстория: Год назад мы с Артёмом уже делали ASR на Whisper Large v2
Есть даже бот @daisytranscribe_bot он работает на базе него, но работал медленно

Внутри компании звонки множатся, все хотят транскрипт, саммари и закрепить в базе знаний (еще же нужно что бы точно безопасно!)
Решение: Отбросить сомнения как говорит Паша, не смотреть на код, главное фичи для пользователя!

Железо: 2x RTX 4500 (40GB) + RTX 4090 (48GB) освободились недавно значит берем
Стек: WhisperX + Qwen2.5-32B-Instruct + FastAPI + Vanilla JS + Python

Vibe Coding это что на деле?

Все бурлят про "AI написал мне приложение за день".
Реальность чуть-чуть сложнее
Я не написал ни одной функции с нуля. AI писал код, я только правил порты, адреса, конфиги
Но направлял архитектуру, принимал решения, тестировал, давал правки вел TODO
За 7 днями стоят 6 лет опыта в DevOps/архитектуре/разработке/дизайне/продукте

Факт №1 AI не заменяет экспертизу он ускоряет её

Результат

- 16,611 строк кода (Python 25.7%, JS 42%, CSS 15.1%)
- 3 компонента: Backend + Frontend + Chrome Extension
- 56 транскриптов обработано, 20 пользователей
- x8 ускорение от старого ASR
- Час 30 аудио → 8 минут обработки с саммари


Фичи
- WhisperX транскрипция с диаризацией
- Qwen2.5-32B-Instruct саммаризация (120k контекст!)
- Real-time транскрипция через WebSocket
- Chrome расширение для записи звука
- 6 форматов экспорта: SRT, DOCX, PDF, JSON, TSV, VTT
- Google OAuth авторизация


Дальше я выдал доступ к репо Артёму и он накидал док по которому мы дальше будем двигаться по правкам (тоже вырабатываем новый подход к разработке).

Как точно подметил Коля из чатика авторов про AI:
"Вообще эта дока – лучшая иллюстрация отличий vibecoding vs coding-with-ai. Что большая часть вайбкодеров из твиттера/ютуба даже никогда не узнают про такие косяки у себя в коде."

И это действительно так разница между "вроде работает" и системным подходом огромная



Да, есть проблемы пока БД плохо описана и в sqllite, перееду на PostgreSQL. Были глюки с авторизацией, за 2 дня переехал на Google OAuth
Проект модульный, взял лучшие практики, теперь твердая основа для транскрипции в компании есть

Главные инсайты для меня

1. Можно сделать MVP за 7 дней одному
Доказал: один человек = DevOps/Архитектор/Разработчик/Дизайнер/Продукт Но нужны 6 лет фундамента
Начни с простого проекта на знакомом стеке
Четкое ТЗ, нарисуй архитектуру разбей все на микрозадачи(конвертим в cursor rules
)
Делай каждый день по 2-3 часа, не растягивай


2. AI-ассистент меняет роль
От кодера к архитектору и тестировщику
Попробуй Cursor/GitHub Copilot на реальном проекте
Архитектурные паттерны, системный дизайн
Формулируй задачи четко, проверяй каждый результат


3. Проверка критична
AI пишет красивый код, который может работать неправильно или вовсе создаст вам моков (такое было раза 3 точно)
Я тестил каждую функцию руками и по несколько раз от апи до интерфейса


4. Vibe coding ≠ магия
AI помогает думать быстрее, но опыт незаменим
Системное мышление, понимание бизнес-логики
Изучай паттерны, архитектуру, best practices


5. Vibe coding точно быстрее
Особенно на старте и с 0 когда ты можешь нарезанные задачи раздать
толпе вкладок в том же курсоре их можно сделать несколько
Курсор не плохо сразу трудится над параллельными задачами главное сам не теряй фокус!


Факт №2 Я Потратил 820 вызовов в Cursor это не "одна кнопка"

Почему успех?

Сервисом реально пользуются!
Саммари после встреч приходят сразу 1:30 звонка транскрибица с разделением по ролям за 8 минут!
Когда код сделанный вот в таком формате решает проблемы людей лучшая мотивация.

2x RTX 4500 + RTX 4090 + неделя энтузиазма = AI-платформа в продакшене!

Факт №3: Solo до MVP легко, но от MVP до production нужна команда: SAST, масштабирование, безопасность AI (не учёл всё сразу).

P.S. Дальше, если наберется данных, расскажу про обучение транскодера для qwen2.5-7b-instruct

Скрины интерфейса и архитектуры в комментариях

P.S.S Планирую залить в open-source

BY Neural Deep


Warning: Undefined variable $i in /var/www/group-telegram/post.php on line 260

Share with your friend now:
group-telegram.com/neuraldeep/1510

View MORE
Open in Telegram


Telegram | DID YOU KNOW?

Date: |

Soloviev also promoted the channel in a post he shared on his own Telegram, which has 580,000 followers. The post recommended his viewers subscribe to "War on Fakes" in a time of fake news. Additionally, investors are often instructed to deposit monies into personal bank accounts of individuals who claim to represent a legitimate entity, and/or into an unrelated corporate account. To lend credence and to lure unsuspecting victims, perpetrators usually claim that their entity and/or the investment schemes are approved by financial authorities. In addition, Telegram now supports the use of third-party streaming tools like OBS Studio and XSplit to broadcast live video, allowing users to add overlays and multi-screen layouts for a more professional look. I want a secure messaging app, should I use Telegram? Telegram users are able to send files of any type up to 2GB each and access them from any device, with no limit on cloud storage, which has made downloading files more popular on the platform.
from us


Telegram Neural Deep
FROM American