Yapay Zekâ & Medya
Open Generative AI: Kendi Sunucunda 600+ Modelli Ücretsiz Görsel ve Video Stüdyosu
Midjourney, Runway ve Kling gibi kapalı platformlara her ay ayrı ayrı abonelik ödemekten bıkmıştım. 600'den fazla açık modeli tek bir self-hosted arayüzde birleştiren Open Generative AI'ı kendi ortamımda çalıştırdım; işte edindiğim deneyimler.
Yapay zekâ ile görsel ve video üretirken en çok canımı sıkan şey 'abonelik enflasyonu' oldu: Görsel için Midjourney'e, video animasyonu için Runway'e, dudak senkronizasyonu için başka bir servise her ay onlarca dolar bayılmak gerekiyordu. Üstelik en masum sanatsal fikirlerde bile karşıma çıkan yapay zeka sansür filtreleri beni fazlasıyla bunaltmıştı.
Anil Matcha tarafından geliştirilen Open-Generative-AI projesini kendi sunucuma kurduğumda bu dağınıklık sona erdi. Proje; Flux, Kling, Sora, Veo ve Wan-Video gibi 600'den fazla popüler modeli tek bir açık kaynak stüdyoda topluyor.
Stüdyoda Bizzat Kullandığım 4 Temel İş Akışı
- Text-to-Image & Image-to-Video: Metinden Flux ile yüksek çözünürlüklü görsel üretip saniyeler içinde sinematik video animasyonuna dönüştürme.
- LipSync ve Karakter Konuşturma: Yüklediğim bir ses kaydını karakter görseline bağlayarak gerçekçi dudak senkronizasyonu yakalama.
- Yan Yana Model Kıyaslama: Aynı prompt'u birden fazla modele gönderip sonuçları tek ekranda karşılaştırabilme.
- Sıfır Saçma Filtreler: Kurumsal platformların aşırı hassas filtrelerine takılmadan yaratıcı projeleri özgürce deneyebilme.
Kendi Sunucumda Kurulum Deneyimi
# Depoyu klonlayıp bağımlılıkları yüklüyoruz
git clone https://github.com/Anil-matcha/Open-Generative-AI.git
cd Open-Generative-AI
npm install
# .env dosyasında API anahtarlarını yapılandırıyoruz
cp .env.example .env
# Stüdyoyu ayağa kaldırıyoruz
npm run devKendi iş akışımda kullandığımda en çok hoşuma giden tarafı, video ve görsel üretmek için arayüz arayüz gezme derdini bitirmesi oldu. Arka planda MuAPI veya kendi GPU çıkarım motorumu bağlayarak kesintisiz bir yapay zeka fabrikasına kavuştum.