· kaynak TechCrunch
Synthesia interaktif bir PR avatarı geliştirdi, sonra bir TechCrunch muhabiri için de bir tane yarattı
Synthesia, basın sorularını yanıtlamak üzere kurumsal ilişkiler direktörünün konuşmacı bir klonunu geliştirdi ve bir TechCrunch muhabiri için de bir tane oluşturdu — bu, gerçek zamanlı avatarların kurumsal iletişime girdiğinin bir işareti.

Synthesia, kendi iletişim direktörünün, basın sorularını gerçek zamanlı yanıtlayabilen interaktif bir dijital kopyasını geliştirdi — ve bu yeteneği göstermek için bir TechCrunch muhabiri için de bir tane oluşturdu.
TechCrunch'a göre, Synthesia'nın kurumsal ilişkiler direktörü Alexandru Voica, bu yaz yayına, şirket hakkındaki yaygın soruları yanıtlamak üzere eğitilmiş kendi konuşmacı klonunun bir bağlantısını gönderdi. Muhabir Eylül ayında Synthesia'nın yeni açılan New York ofisini ziyaret ettiğinde, şirket kendisi için de bir "dijital ikiz" oluşturmayı teklif etti — TechCrunch'a göre bu, şirketin Voica'nın kendisi dışında biri için yaptığı ilk avatar.
Interaktif avatarlar nasıl çalışıyor
Interaktif avatar dört model türünden oluşuyor. Bir konuşma-metne modeli kişinin söylediklerini yazıya döküyor, agentic bir dil modeli metni yorumlayıp hangi eylemlerin alınacağına karar veriyor, bir metin-konuşmaya modeli yanıtı sese dönüştürüyor ve Synthesia'nın geliştirdiği bir video modeli konuşurken avatarı canlandırıyor. TechCrunch'a göre müşteriler, bu bileşenlerin yerine başka laboratuvarların — Cartesia, ElevenLabs, Google veya OpenAI — bileşenlerini takabiliyor ve avatarları istedikleri bulutta barındırabiliyor ya da barındırma için Synthesia'ya ödeme yapabiliyor.
Bir avatar oluşturmak hızlı. Muhabir, Synthesia'nın ofisinin içindeki küçük bir stüdyoda oturdu, bir dizi fotoğraf için poz verdi, iki dakikalık ses kaydı yaptı ve açık onay verdi. Birkaç gün içinde ekip, kişisel bir avatar (verilen her metni sadece okuyan bir tür) artı interaktif sürümler teslim etti; her biri gözlüklü ve gözlüksüz olarak işlendi.
Bilinçli olarak tek bir habere dayalı
Interaktif klon deterministik: yalnızca söylemesi için eğitildiğini söylüyor. Synthesia, muhabirin avatarını, risk sermayesi destekli girişimlerin neden VC fonu olmayan şirketlerden daha fazla dolandırıcılık yaptığına dair tek bir makaleye dayandırdı ve avatar, her konu dışı soruyu — muhabirin ailesinden gelen kişisel sorular dahil — o makaleye geri yönlendirdi.
TechCrunch, interaktif sürümün sesinin ve görünümünün, metin okuyan kişisel avatar kadar ikna edici olmadığını, ancak onu gören teknik olmayan arkadaşları tedirgin etmeye yetecek kadar yakın olduğunu belirtiyor. Muhabir ayrıca, doğaçlama yapmaktan özgür chatbot'larla desteklenen deterministik olmayan klonlara dair bir endişeyi dile getirdi: insanlar, söyleyecek yeni şeyler üretmeye devam eden bir kopyayla sağlıksız bir ilişkiye girebilir.
Demonstrasyonun arkasındaki iş modeli
Orijinal olarak İngiltere merkezli olan Synthesia, kurumsal eğitim videoları için yapay zeka avatarları satıyor ve D-ID, HeyGen ve Colossyan gibi firmalarla rekabet ediyor. TechCrunch'a göre şirket, bu yılın başlarında 4 milyar dolarlık bir değerlemeye ulaştı ve geçen yıl yıllık yinelenen gelirinin 100 milyon doları aştığını söyledi.
Portföyü üç ürün hattını kapsıyor. Bir video oluşturma ve dağıtım platformu, yazılı metinleri okuyan klasik avatarlar sunuyor. Sessions adlı agentic bir platform anketleri ve interaktif alıştırmaları destekliyor; buna göre çalışanların satış sunumlarını, yanıtları puanlayan duyarlı bir avatara karşı prova etmesini sağlayan Roleplay Sessions özelliği de dahil. Bir API platformu ise müşterilerin Synthesia'nın video ve ses modellerini diğer hizmetlerle birleştirerek kendi interaktif avatarlarını ya da başka ürünlerini oluşturmalarına imkân veriyor.
Neden önemli
Rutin muhabir sorularını her saat, sınırsız biçimde yanıtlayabilen bir iletişim direktörü, gerçek zamanlı konuşmacı avatarların kurumsal iletişime girdiğinin somut bir örneği — bir yenilik demonstrasyonu olarak değil, bir PR ekibinin her an erişilebilir bir uzantısı olarak.
Demonstrasyon ayrıca bu tür dağıtımları mümkün kılan güvence mekanizmasını gösteriyor: avatarı onaylı materyale dayandırmak, böylece doğrulanmamış iddialara savuşamamasını sağlamak. Bu, halüsinasyon sorununu çözüyor ama bir açıklama sorunu yaratıyor; çünkü etkileşimin hiçbir yönü avatarın bir insan olmadığını açıklamasını zorunlu kılmıyor.
Kayıt gereksinimleri minimal — birkaç fotoğraf, iki dakikalık ses, birkaç günlük oluşturma süresi — ki bu, klon isteyen herhangi bir yönetici ya da kamuya mal olmuş kişi için engeli düşürüyor. İzleyicilerin bunları kabul edip etmeyeceği ayrı bir konu: TechCrunch muhabirinin de gözlemlediği gibi, güven gazeteciliğin özü ve bir makineye devredilmesi imkânsız görünüyor. Ama aynı şirket SSS'lerini tekrar tekrar yanıtlamak için bu, belirleyici faktör olmayabilir.
- #ai
- #avatars
- #synthesia
- #generative-ai
- #corporate-communications
İlgili yazılar
- Eğitmen, yapay zeka ajanları her take-home ödevini tamamladıktan sonra ML dersini yeniden tasarlıyor
- ABD temyiz mahkemesi yapay zeka tedarik zinciri riski tanımlamasını onayladı; tedarikçi bağımlılığı endişeleri yeniden gündemde
- Google, Gemini Notebook'a canlı sesli sohbetler ve mobil ses kaydını ekliyor