
Black Forest Labs, robotları çalıştırmak için video yapay zekasını öğretiyor.
Özet
Black Forest Labs, görsel, video ve senkronize ses üretebilen yeni "görsel zeka" modeli FLUX 3'e erken erişimi açmıştır. Geliştirilen bu teknoloji, gerçek dünyayı simüle etme yeteneği sayesinde Audi üretim hatlarında robot kontrol varyantı olarak kullanılmaya başlanmıştır. Yapay zeka modellerinin dijital alandan fiziksel dünyaya sızması, robotiğin gelişimi açısından kritik bir dönüm noktası oluşturmaktadır. Ayrıca, iş süreçlerinde yapay zekanın ne zaman ve nasıl kullanılacağını belirleyen "yapay zeka sezgisi" kavramı, ekipler için standart bir çerçeveyle uygulanmaktadır.
Günaydın, {{ first_name | AI enthusiasts }} ve dün aramıza katılan 6.243 yeni okuyucuya hoş geldiniz. Black Forest Labs, yapay zeka görsel dünyasında adını duyurdu. En yeni modeli, görsel, video ve ses oluşturabilmesinin yanı sıra artık bir Audi üretim hattında da görev yapıyor.
Şirketin "görsel zeka" modeli FLUX 3, dünyanın aslında nasıl hareket ettiğini simüle ederek gerçekçi videolar üretiyor; bu aynı zamanda fiziksel dünyadaki makineleri eğitmeye ve yönlendirmeye yardımcı olan yeteneğin aynısıdır.
Özetle: Black Forest Labs, video, görsel ve senkronize ses üreten bir "görsel zeka" yapay zekası olan FLUX 3'e erken erişimi açtı; ayrıca Alman laboratuvarı bunu Audi'nin üretim hatları için bir robot kontrol varyantı olan FLUX-mimic'e dönüştürdü.
Neden önemli: BFL genellikle daha yavaş bir hızda hareket etti, ancak bu birleştirilmiş sistem emeğin karşılığı gibi görünüyor — daha uzun, ses senkronize videolar ve tutarlı görseller (bu komik olan gibi) bize Sora günlerini hatırlatıyor (iyi bir şekilde). Mimic için görsel modeller fiziksel dünyaya sızmaya devam ediyor ve robotiğin kilit dişlilerinden biri haline geliyor.
Özetle: AWS re:Invent, 30 Kasım - 4 Aralık tarihleri arasında Las Vegas'ta 2.200'den fazla oturum düzenliyor ve bunların %70'i uygulamalı.
Rowan: Geçen hafta, yapay zeka çağının en önemli becerisini inceledim: yapay zekayı ne zaman kullanıp ne zaman kullanmayacağınızı bilmek olan yapay zeka sezgisi. Bu hafta, bunu The Rundown'daki ekibimde gerçekten nasıl uyguladığım konusunda daha derinlere inmek istiyorum.
Yukarıdaki grafik, kabul edilemez, beklenen ve istisnai yapay zeka kullanımının nasıl olduğunu haritalandıran rol bazlı yapay zeka akıcılığı standardımızdır. Yapay zeka odaklı bir girişim olarak bile, bunun gibi bir çerçeve gerçek örneklerle standart belirliyor.
Tüm bunların arkasındaki amaç tekrarlardır. Yapay zeka sezgisi, iş sezgisi gibi çalışır: kimse bununla doğmaz. Yapay zekaya ne zaman başvurulacağını bilmek içgüdüsel hale gelene kadar araçları sınırlarına kadar zorlayarak bunu inşa edersiniz.
Ekibiniz henüz böyle bir standart belirlemediyse, şiddetle tavsiye ederim. İşte kopyalayabileceğiniz kurulumumun indirilebilir bir şablonu.
Özetle: Bu kılavuzda, The Rundown'da yaptığımız gibi yapay zeka kullanarak videoları nasıl düzenleyeceğinizi ve ardından ChatGPT'ye eller serbest olarak sizin için düzenleme yapmayı nasıl öğreteceğinizi öğreneceksiniz.
Özetle: Temsilci (agent) donanımınız, çalıştırdığınız modelden daha büyük bir etkiye sahip olabilir. Strands Agents ile kendi temsilci donanımınızı oluşturabilir ve kilitli kalmadan baştan sona kontrol edebilirsiniz.
Özetle: OpenAI ve Anthropic, neredeyse tam aynı anda ses güncellemeleri yayınladı; OAI, GPT-Live sesini masaüstü uygulamasına ve Codex'e taşıdı, Anthropic ise Claude'un sesini daha akıllı modellerine ve bağlantılı uygulamalarına entegre etti.
Neden önemli: Her iki laboratuvar da yararlı bir şey yayınladı, ancak Claude 5 Opus'un çıkış söylentileri ve OAI için Cerebras destekli hız yükseltmelerinden sonra birçok kullanıcının aradığı şey bu değildi. Güncellemeyle bile Anthropic, ses konusunda en büyük rakibinin gerisinde kalmış gibi hissediyor ve konuşma, insanların yapay zeka ile çalışmasının birincil yolu olarak büyümeye devam ediyor.
ABD'li yapay zeka çipi girişimi Etched, gizlilikten çıktıktan sadece haftalar sonra 300 milyon dolar yeni finansman sağladı ve