Summary

Palo Alto AI voice startup Fish Audio raised a 50M headlines) led by Coreline Ventures and Capital Today, with participation from 359 Capital and others. The company reports 8M+ users of open-source/hosted models, ~$21M ARR, and 15,000+ natural-language voice controls. Fish Speech GitHub exceeds 31k stars; S2.1 Pro is API-only. Enterprise customers cited include HeyGen and Sanas. Story also covers past consent/DMCA issues around user-uploaded voices and plans for audio understanding and speech-to-speech models.

Source Analysis

[Added during prescreening/evaluation]

Research Notes

Additional sources

  • SiliconANGLE: 2026-07-28-fish-audio-siliconangle (confirms $52M)
  • TechCrunch (updated amount): pipeline source
  • Techmeme still showed early $50M headline in aggregator — prefer updated TC + SiliconANGLE

Key facts verified

ClaimStatus
Seed $52M (not $50M)Confirmed — TC update note + SiliconANGLE
Led by Coreline Ventures + Capital TodayConfirmed
Participants (359 Capital, Play Time, HF0, etc.)Confirmed across TC/SiliconANGLE (lists vary slightly)
8M+ users, ~$21M ARR, >31k GitHub starsCompany-reported — attribute
Enterprise customers HeyGen, SanasCompany-cited
Consent/DMCA history on uploaded voicesMaterial secondary — cover responsibly, no clone how-to

Broader context

Open-source Fish Speech → enterprise API path pressures elevenlabs-class market. Voice as default agent interface narrative from investors. Hub: ai-voice-market-2026.

fish-audio · ai-voice · text-to-speech · voice-cloning · elevenlabs · heygen · coreline-ventures · venture-capital

Editorial Notes

Verdict: Approved — strongest pure-funding AI story in this batch.

Approved angle / format: standard (600–800 words). Confirm Suggested Angle: open-source Fish Speech → enterprise voice API; ElevenLabs-class competition; consent/DMCA as responsible side note.

Instructions for Reporting:

  • Amount is **50M headlines/aggregators (Techmeme still shows $50M).
  • Users, ARR (~$21M), GitHub stars, enterprise logos = company-reported — attribute.
  • Cover consent/DMCA history in one responsible paragraph; no voice-clone how-to.
  • Investor lead: Coreline Ventures + Capital Today.

Headline suggestions (TR):

  1. Fish Audio, yapay ses modelleri için $52M seed turu kapattı
  2. Open-source Fish Speech’ten enterprise TTS’e: $52M’lik sıçrama
  3. Fish Audio, ElevenLabs rekabetinde $52M seed ile büyüyor

Must include: 50M); lead investors; open-source → API path; company traction claims attributed; consent risk caveat; brief roadmap (audio understanding / speech-to-speech).

Draft Article

Fish Audio, Yapay Ses Modelleri için $52M Seed Turu Kapattı

Palo Alto merkezli fish-audio, 28 Temmuz 2026’da yapay ses modelleri için **50M rakamı güncellendi: TechCrunch düzeltme notu ve SiliconANGLE teyidiyle doğru tutar $52M.

Ana Gelişme

fish-audio open-source Fish Speech hattından enterprise text-to-speech / ses API’sine uzanan bir yol izliyor. Şirkete göre 8 milyondan fazla kişi open-source veya hosted modelleri kullanıyor; yıllık yinelenen gelir (ARR) yaklaşık $21 milyon; 15.000’den fazla natural-language voice control sunuluyor. Fish Speech GitHub deposu 31.000’den fazla star’a sahip. Bu traction iddiaları şirket beyanıdır; bağımsız denetim basın materyalinde yer almıyor.

Son bir yılda dört speech generation ve bir speech-to-text modeli çıkarıldı; üç speech generation modeli açık kaynaklandı. En güncel S2.1 Pro yalnızca ücretli API üzerinden — open-source çekirdek ile commercial frontier model ayrımı bilinçli bir ürün stratejisi. Kurumsal müşteri olarak heygen ve Sanas şirket tarafından anılıyor.

CEO ve ortak kurucu Rissa Cao’ya göre farklı enterprise müşteriler farklı özellik istiyor: HeyGen avatar gerçekçiliği, oyun stüdyoları ifade gücü, LiveKit tarzı ses ajanları düşük gecikmeli doğal ses. Kurucu Shijia Liao (eski NVIDIA araştırmacısı), piyasadaki ifadesiz sentetik seslerden duyduğu hayal kırıklığıyla tek GPU’da bir model eğitip open-source yapmıştı. Seed, bu topluluk tabanını enterprise API’ye taşıma iddiasını finanse ediyor.

Rekabet ve Yol Haritası

ai-voice-market-2026 içinde elevenlabs, WellSaid, Cartesia, Speechify, Async (eski Podcastle) ve Krisp rakip olarak anılıyor. Open-source → ücretli API yolu, ElevenLabs sınıfı oyunculara fiyat, latans ve topluluk baskısı oluşturabilir. SiliconANGLE / Coreline çerçevesi sesi varsayılan AI arayüzü olarak konumlandırıyor: çok dilli ifade, duygusal ton ve maliyet liderliği yatırımcı tezinin parçası.

İleriye dönük plan: bu yıl bir audio understanding modeli ve speech-to-speech modeli. Creator planları dakikalık generation kotası ve voice-cloning özellikleri sunuyor; enterprise katmanı API ve platform olarak ayrı paketleniyor. TechCrunch’ın güncelleme notu, erken 52M olarak düzeltilmeli.

Rıza ve DMCA — Sorumlu Not

Şirket, model kütüphanesini büyütmek için kullanıcıların kendi seslerini yüklemesini ve kullanılan sesler için telafi etmeyi denemişti. Birkaç ay önce bazı creator’lar seslerinin rızasız yüklendiğini iddia etti. Fish Audio DMCA kaldırma süreci işletiyor; Cao’ya göre kaldırmalar artık ses örneği veya sözleşme kanıtıyla üç dakikanın altına otomatikleştirildi. Rıza/sahiplik sorunları sektör genelinde sürüyor.

Coreline’dan Osuke Honda, topluluk modellerinin yalnızca creator güveniyle çalışabileceğini vurguluyor: rıza, şeffaflık, attribution, doğrulanmış ses sahipliği, net lisanslama ve ileride gelir paylaşımı. Bu paragraf politika bağlamıdır; ses klonlama “nasıl yapılır” detayı verilmez.

Neden Önemli?

Türk AI geliştiricileri için haber, çok dilli TTS, ses ajanları ve open-source Fish Speech ekosisteminin enterprise’a sıçraması. Finans okurları için 21M ARR, ai-investment-trends ve venture-capital içinde ses dikeyinin hâlâ agresif sermaye çektiğini gösteriyor. Rakamı $50M sanmamak ve traction’ı şirket iddiası olarak etiketlemek kritik.

Ses, metin chat’inin ardından agent arayüzünün varsayılan kanalı haline geldikçe, TTS kalitesi ve rıza altyapısı ürün farklılaşması kadar reputasyon riski de taşıyor. Open-source yıldız sayısı enterprise ARR’ye dönüşürken, creator trust ve otomatik DMCA hızı ürün pazarlama dilinin ayrılmaz parçası haline geliyor. Türk geliştiriciler için pratik ayrım: Fish Speech ile lokal/deneysel üretim; S2.1 Pro API ile latency ve steerability gerektiren production ses ajanları.

Sonraki Adımlar

İzlenecekler: S2.1 Pro API adoption’ı, audio understanding / speech-to-speech çıkışları, rıza altyapısının bağımsız denetimi, ElevenLabs sınıfı fiyat/özellik rekabeti ve açık model yıldızlarının ücretli API’ye dönüşüm oranı.


Kaynaklar

Ana Gelişme

fish-audio open-source Fish Speech hattından enterprise text-to-speech / ses API’sine uzanan bir yol izliyor. Şirkete göre 8 milyondan fazla kişi open-source veya hosted modelleri kullanıyor; yıllık yinelenen gelir (ARR) yaklaşık $21 milyon; 15.000’den fazla natural-language voice control sunuluyor. Fish Speech GitHub deposu 31.000’den fazla star’a sahip. Bu traction iddiaları şirket beyanıdır; bağımsız denetim basın materyalinde yer almıyor.

Son bir yılda dört speech generation ve bir speech-to-text modeli çıkarıldı; üç speech generation modeli açık kaynaklandı. En güncel S2.1 Pro yalnızca ücretli API üzerinden — open-source çekirdek ile commercial frontier model ayrımı bilinçli bir ürün stratejisi. Kurumsal müşteri olarak heygen ve Sanas şirket tarafından anılıyor.

CEO ve ortak kurucu Rissa Cao’ya göre farklı enterprise müşteriler farklı özellik istiyor: HeyGen avatar gerçekçiliği, oyun stüdyoları ifade gücü, LiveKit tarzı ses ajanları düşük gecikmeli doğal ses. Kurucu Shijia Liao (eski NVIDIA araştırmacısı), piyasadaki ifadesiz sentetik seslerden duyduğu hayal kırıklığıyla tek GPU’da bir model eğitip open-source yapmıştı. Seed, bu topluluk tabanını enterprise API’ye taşıma iddiasını finanse ediyor.

Rekabet ve Yol Haritası

ai-voice-market-2026 içinde elevenlabs, WellSaid, Cartesia, Speechify, Async (eski Podcastle) ve Krisp rakip olarak anılıyor. Open-source → ücretli API yolu, ElevenLabs sınıfı oyunculara fiyat, latans ve topluluk baskısı oluşturabilir. SiliconANGLE / Coreline çerçevesi sesi varsayılan AI arayüzü olarak konumlandırıyor: çok dilli ifade, duygusal ton ve maliyet liderliği yatırımcı tezinin parçası.

İleriye dönük plan: bu yıl bir audio understanding modeli ve speech-to-speech modeli. Creator planları dakikalık generation kotası ve voice-cloning özellikleri sunuyor; enterprise katmanı API ve platform olarak ayrı paketleniyor. TechCrunch’ın güncelleme notu, erken 52M olarak düzeltilmeli.

Rıza ve DMCA — Sorumlu Not

Şirket, model kütüphanesini büyütmek için kullanıcıların kendi seslerini yüklemesini ve kullanılan sesler için telafi etmeyi denemişti. Birkaç ay önce bazı creator’lar seslerinin rızasız yüklendiğini iddia etti. Fish Audio DMCA kaldırma süreci işletiyor; Cao’ya göre kaldırmalar artık ses örneği veya sözleşme kanıtıyla üç dakikanın altına otomatikleştirildi. Rıza/sahiplik sorunları sektör genelinde sürüyor.

Coreline’dan Osuke Honda, topluluk modellerinin yalnızca creator güveniyle çalışabileceğini vurguluyor: rıza, şeffaflık, attribution, doğrulanmış ses sahipliği, net lisanslama ve ileride gelir paylaşımı. Bu paragraf politika bağlamıdır; ses klonlama “nasıl yapılır” detayı verilmez.

Neden Önemli?

Türk AI geliştiricileri için haber, çok dilli TTS, ses ajanları ve open-source Fish Speech ekosisteminin enterprise’a sıçraması. Finans okurları için 21M ARR, ai-investment-trends ve venture-capital içinde ses dikeyinin hâlâ agresif sermaye çektiğini gösteriyor. Rakamı $50M sanmamak ve traction’ı şirket iddiası olarak etiketlemek kritik.

Ses, metin chat’inin ardından agent arayüzünün varsayılan kanalı haline geldikçe, TTS kalitesi ve rıza altyapısı ürün farklılaşması kadar reputasyon riski de taşıyor. Open-source yıldız sayısı enterprise ARR’ye dönüşürken, creator trust ve otomatik DMCA hızı ürün pazarlama dilinin ayrılmaz parçası haline geliyor. Türk geliştiriciler için pratik ayrım: Fish Speech ile lokal/deneysel üretim; S2.1 Pro API ile latency ve steerability gerektiren production ses ajanları.

Sonraki Adımlar

İzlenecekler: S2.1 Pro API adoption’ı, audio understanding / speech-to-speech çıkışları, rıza altyapısının bağımsız denetimi, ElevenLabs sınıfı fiyat/özellik rekabeti ve açık model yıldızlarının ücretli API’ye dönüşüm oranı.


Kaynaklar

Ana Gelişme

fish-audio open-source Fish Speech hattından enterprise text-to-speech / ses API’sine uzanan bir yol izliyor. Şirkete göre 8 milyondan fazla kişi open-source veya hosted modelleri kullanıyor; yıllık yinelenen gelir (ARR) yaklaşık $21 milyon; 15.000’den fazla natural-language voice control sunuluyor. Fish Speech GitHub deposu 31.000’den fazla star’a sahip. Bu traction iddiaları şirket beyanıdır; bağımsız denetim basın materyalinde yer almıyor.

Son bir yılda dört speech generation ve bir speech-to-text modeli çıkarıldı; üç speech generation modeli açık kaynaklandı. En güncel S2.1 Pro yalnızca ücretli API üzerinden — open-source çekirdek ile commercial frontier model ayrımı bilinçli bir ürün stratejisi. Kurumsal müşteri olarak heygen ve Sanas şirket tarafından anılıyor.

CEO ve ortak kurucu Rissa Cao’ya göre farklı enterprise müşteriler farklı özellik istiyor: HeyGen avatar gerçekçiliği, oyun stüdyoları ifade gücü, LiveKit tarzı ses ajanları düşük gecikmeli doğal ses. Kurucu Shijia Liao (eski NVIDIA araştırmacısı), piyasadaki ifadesiz sentetik seslerden duyduğu hayal kırıklığıyla tek GPU’da bir model eğitip open-source yapmıştı. Seed, bu topluluk tabanını enterprise API’ye taşıma iddiasını finanse ediyor.

Rekabet ve Yol Haritası

ai-voice-market-2026 içinde elevenlabs, WellSaid, Cartesia, Speechify, Async (eski Podcastle) ve Krisp rakip olarak anılıyor. Open-source → ücretli API yolu, ElevenLabs sınıfı oyunculara fiyat, latans ve topluluk baskısı oluşturabilir. SiliconANGLE / Coreline çerçevesi sesi varsayılan AI arayüzü olarak konumlandırıyor: çok dilli ifade, duygusal ton ve maliyet liderliği yatırımcı tezinin parçası.

İleriye dönük plan: bu yıl bir audio understanding modeli ve speech-to-speech modeli. Creator planları dakikalık generation kotası ve voice-cloning özellikleri sunuyor; enterprise katmanı API ve platform olarak ayrı paketleniyor.

Rıza ve DMCA — Sorumlu Not

Şirket, model kütüphanesini büyütmek için kullanıcıların kendi seslerini yüklemesini ve kullanılan sesler için telafi etmeyi denemişti. Birkaç ay önce bazı creator’lar seslerinin rızasız yüklendiğini iddia etti. Fish Audio DMCA kaldırma süreci işletiyor; Cao’ya göre kaldırmalar artık ses örneği veya sözleşme kanıtıyla üç dakikanın altına otomatikleştirildi. Rıza/sahiplik sorunları sektör genelinde sürüyor.

Coreline’dan Osuke Honda, topluluk modellerinin yalnızca creator güveniyle çalışabileceğini vurguluyor: rıza, şeffaflık, attribution, doğrulanmış ses sahipliği, net lisanslama ve ileride gelir paylaşımı. Bu paragraf politika bağlamıdır; ses klonlama “nasıl yapılır” detayı verilmez.

Neden Önemli?

Türk AI geliştiricileri için haber, çok dilli TTS, ses ajanları ve open-source Fish Speech ekosisteminin enterprise’a sıçraması. Finans okurları için 21M ARR, ai-investment-trends ve venture-capital içinde ses dikeyinin hâlâ agresif sermaye çektiğini gösteriyor. Rakamı $50M sanmamak ve traction’ı şirket iddiası olarak etiketlemek kritik.

Ses, metin chat’inin ardından agent arayüzünün varsayılan kanalı haline geldikçe, TTS kalitesi ve rıza altyapısı ürün farklılaşması kadar reputasyon riski de taşıyor. Open-source yıldız sayısı enterprise ARR’ye dönüşürken, creator trust ve otomatik DMCA hızı ürün pazarlama dilinin ayrılmaz parçası haline geliyor. Türk geliştiriciler için pratik ayrım: Fish Speech ile lokal/deneysel üretim; S2.1 Pro API ile latency ve steerability gerektiren production ses ajanları.

Sonraki Adımlar

İzlenecekler: S2.1 Pro API adoption’ı, audio understanding / speech-to-speech çıkışları, rıza altyapısının bağımsız denetimi, ElevenLabs sınıfı fiyat/özellik rekabeti ve açık model yıldızlarının ücretli API’ye dönüşüm oranı.


Kaynaklar

Ana Gelişme

fish-audio open-source Fish Speech hattından enterprise text-to-speech / ses API’sine uzanan bir yol izliyor. Şirkete göre 8 milyondan fazla kişi open-source veya hosted modelleri kullanıyor; yıllık yinelenen gelir (ARR) yaklaşık $21 milyon; 15.000’den fazla natural-language voice control sunuluyor. Fish Speech GitHub deposu 31.000’den fazla star’a sahip. Bu traction iddiaları şirket beyanıdır; bağımsız denetim basın materyalinde yer almıyor.

Son bir yılda dört speech generation ve bir speech-to-text modeli çıkarıldı; üç speech generation modeli açık kaynaklandı. En güncel S2.1 Pro yalnızca ücretli API üzerinden — open-source çekirdek ile commercial frontier model ayrımı bilinçli bir ürün stratejisi. Kurumsal müşteri olarak heygen ve Sanas şirket tarafından anılıyor.

CEO ve ortak kurucu Rissa Cao’ya göre farklı enterprise müşteriler farklı özellik istiyor: HeyGen avatar gerçekçiliği, oyun stüdyoları ifade gücü, LiveKit tarzı ses ajanları düşük gecikmeli doğal ses. Kurucu Shijia Liao (eski NVIDIA araştırmacısı), piyasadaki ifadesiz sentetik seslerden duyduğu hayal kırıklığıyla tek GPU’da bir model eğitip open-source yapmıştı. Seed, bu topluluk tabanını enterprise API’ye taşıma iddiasını finanse ediyor.

Rekabet ve Yol Haritası

ai-voice-market-2026 içinde elevenlabs, WellSaid, Cartesia, Speechify, Async (eski Podcastle) ve Krisp rakip olarak anılıyor. Open-source → ücretli API yolu, ElevenLabs sınıfı oyunculara fiyat, latans ve topluluk baskısı oluşturabilir. SiliconANGLE / Coreline çerçevesi sesi varsayılan AI arayüzü olarak konumlandırıyor: çok dilli ifade, duygusal ton ve maliyet liderliği yatırımcı tezinin parçası.

İleriye dönük plan: bu yıl bir audio understanding modeli ve speech-to-speech modeli. Creator planları dakikalık generation kotası ve voice-cloning özellikleri sunuyor; enterprise katmanı API ve platform olarak ayrı paketleniyor.

Rıza ve DMCA — Sorumlu Not

Şirket, model kütüphanesini büyütmek için kullanıcıların kendi seslerini yüklemesini ve kullanılan sesler için telafi etmeyi denemişti. Birkaç ay önce bazı creator’lar seslerinin rızasız yüklendiğini iddia etti. Fish Audio DMCA kaldırma süreci işletiyor; Cao’ya göre kaldırmalar artık ses örneği veya sözleşme kanıtıyla üç dakikanın altına otomatikleştirildi. Rıza/sahiplik sorunları sektör genelinde sürüyor.

Coreline’dan Osuke Honda, topluluk modellerinin yalnızca creator güveniyle çalışabileceğini vurguluyor: rıza, şeffaflık, attribution, doğrulanmış ses sahipliği, net lisanslama ve ileride gelir paylaşımı. Bu paragraf politika bağlamıdır; ses klonlama “nasıl yapılır” detayı verilmez.

Neden Önemli?

Türk AI geliştiricileri için haber, çok dilli TTS, ses ajanları ve open-source Fish Speech ekosisteminin enterprise’a sıçraması. Finans okurları için 21M ARR, ai-investment-trends ve venture-capital içinde ses dikeyinin hâlâ agresif sermaye çektiğini gösteriyor. Rakamı $50M sanmamak ve traction’ı şirket iddiası olarak etiketlemek kritik.

Ses, metin chat’inin ardından agent arayüzünün varsayılan kanalı haline geldikçe, TTS kalitesi ve rıza altyapısı ürün farklılaşması kadar reputasyon riski de taşıyor.

Sonraki Adımlar

İzlenecekler: S2.1 Pro API adoption’ı, audio understanding / speech-to-speech çıkışları, rıza altyapısının bağımsız denetimi, ElevenLabs sınıfı fiyat/özellik rekabeti ve açık model yıldızlarının ücretli API’ye dönüşüm oranı.


Kaynaklar

PreScreening Notes

  • Score 7 / priority high: Large seed ($52M) with strong traction claims (ARR, users, GitHub stars) in competitive AI voice space; fits AI domain and audience.
  • Real funding news, same-day, credible source (TechCrunch). Amount updated from early 52M at Evaluation.
  • Consent/DMCA history is newsworthy secondary angle for responsible coverage.
  • Duplicate check: no Fish Audio item in pipeline.

Evaluation Report

News Value

  • Timeliness: High — July 28, 2026 announcement; TechCrunch + SiliconANGLE same-day.
  • Impact: Medium–high within AI voice/TTS market; large seed signals competitive pressure on ElevenLabs-class incumbents.
  • Prominence: Rising open-source voice player; enterprise logos (HeyGen, Sanas) cited.
  • Proximity: Good for Turkish AI builders (voice APIs, multilingual TTS, open-source Fish Speech).
  • Novelty: Outsized seed ($52M) with open-source → enterprise path; consent/DMCA history adds non-PR depth.

Audience Fit

Strong for AI enthusiasts and developers using TTS/voice agents. Finance readers: funding size and ARR claims as market signal. Actionable: competitive landscape + responsible voice cloning caveats.

Risk & Ethics

  • Amount confirmed: TechCrunch and SiliconANGLE both state **50M URL/headline).

Warning

Users, ARR (~$21M), GitHub stars, and enterprise customer citations are company-reported via press — attribute; Analysis may seek independent corroboration.
[!warning]

Consent/DMCA history around user-uploaded voices is material — cover responsibly; do not amplify clone-how-to detail.

  • Competitive comparisons (e.g. ElevenLabs valuation) should be attributed to secondary sources.

Publication Strategy

  • Format: standard (600–800 words) — round terms, open-source traction, enterprise push, consent risk, roadmap (audio understanding / S2S).
  • Priority: Keep high; score 7.
  • Wiki to reference: fish-audio, ai-voice, text-to-speech, elevenlabs.
  • Batch note: Strongest pure-funding AI story vs Act (4.5M) — prioritize Fish + Act over Pilot.

Suggested Angle

Türk AI okuruna: Fish Audio’nun 50M erken manşetlerini düzelt: rakam $52M. Kullanıcı/ARR iddialarını şirket beyanı olarak etiketle. Rıza / DMCA geçmişini sorumlu bir yan paragraf olarak ekle; ses klonlama “nasıl yapılır” detayına girme. Sesin agent arayüzü olarak yükselişini kısa bağlamda bağla.