Genie 3
Model świata badawczego Google DeepMind do generowania fotorealistycznych, kontrolowanych środowisk, które można badać w czasie rzeczywistym na podstawie opisu tekstowego.
Model świata badawczego Google DeepMind do generowania fotorealistycznych, kontrolowanych środowisk, które można badać w czasie rzeczywistym na podstawie opisu tekstowego.
Przegląd w prostym języku angielskim
Genie 3 generuje wizualny świat, gdy użytkownik się po nim porusza, zamiast z góry renderować ustalony film. DeepMind zgłasza rozdzielczość 720p, 20–24 klatki na sekundę i spójność w ciągu kilku minut interakcji.
Najlepiej rozumieć go jako ważny produkt badawczy i eksperymentalny, a nie ogólnoświatowy interfejs API. Dostęp odbywa się za pośrednictwem Project Genie i nie jest objęty cenami publicznych interfejsów API ani ogólną umową integracyjną.
Porównanie kategorii
Są to specyfikacje opublikowane przez dostawcę, a nie wyniki testów porównawczych Cody. Skorzystaj z połączonych źródeł, aby poznać aktualne limity i wyjątki specyficzne dla punktu końcowego.
Dostęp do API i dostawcy
Dostępność
Dostęp do badań/eksperymentów poprzez Project Genie; nie jest udokumentowany żaden ogólny interfejs API programisty.
Kwalifikowalność projektu i dostępność w poszczególnych krajach mogą się zmieniać i nie są wymienione na stronie modelu.
Sprawdź dostępność na żywoDane i szkolenia
Dla tego wpisu dotyczącego dostępu do badań nie opublikowano żadnych ogólnych zasad dotyczących danych API programistów. Przed przesłaniem poufnych podpowiedzi lub materiałów referencyjnych zapoznaj się z warunkami Project Genie.
Jest to zwięzła lektura cytowanych materiałów dostawcy, a nie porada prawna. Brama innej firmy może mieć inne warunki przechowywania, routingu, szkolenia i miejsca zamieszkania niż bezpośrednie API twórcy modelu.
Przeczytaj politykę dostawcyCzęsto zadawane pytania
Model świata badawczego Google DeepMind do generowania fotorealistycznych, kontrolowanych środowisk, które można badać w czasie rzeczywistym na podstawie opisu tekstowego. Genie 3 generuje wizualny świat, gdy użytkownik się po nim porusza, zamiast z góry renderować ustalony film. DeepMind zgłasza rozdzielczość 720p, 20–24 klatki na sekundę i spójność w ciągu kilku minut interakcji.
Według materiałów cytowanego dostawcy Genie 3 został wydany na 5 sierpnia 2025.
Dostęp do badań/eksperymentów poprzez Project Genie; nie jest udokumentowany żaden ogólny interfejs API programisty. Drogi dostępu wymienione w tym przewodniku to Google DeepMind.
Nieopublikowane. Genie 3 jest prezentowany za pośrednictwem Project Genie, a nie ogólnie dostępnego API programisty z licznikiem.
Dostęp do badań/eksperymentów poprzez Project Genie; nie jest udokumentowany żaden ogólny interfejs API programisty. Kwalifikowalność projektu i dostępność w poszczególnych krajach mogą się zmieniać i nie są wymienione na stronie modelu.
Dla tego wpisu dotyczącego dostępu do badań nie opublikowano żadnych ogólnych zasad dotyczących danych API programistów. Przed przesłaniem poufnych podpowiedzi lub materiałów referencyjnych zapoznaj się z warunkami Project Genie. Polityka należy do warunków trasy dostawcy i konta, dlatego sprawdź ją ponownie przed użyciem w środowisku produkcyjnym.
Powiązane porównania
Publiczny model API World Labs do przekształcania tekstu, obrazów, panoram, zestawów z wieloma widokami lub wideo w duże, możliwe do eksploracji światy 3D i zasoby przestrzenne.
Otwórz pełne porównanieUwarunkowany działaniem model świata Decart do treningu fizycznej sztucznej inteligencji, generujący zsynchronizowane, kontrolowane widoki symulacyjne w czasie rzeczywistym.
Otwórz pełne porównanieNajwiększy ogólny model światowy Odyssey, skupiający się na symulacji następnego stanu w czasie rzeczywistym, dokładności fizycznej, otwartej przyszłości i dłuższych interaktywnych wdrożeniach.
Otwórz pełne porównaniePubliczna powierzchnia konwersacyjna Ogólnego Modelu Świata Runway, tworząca postacie wizualne w czasie rzeczywistym z jednego obrazu referencyjnego.
Otwórz pełne porównanie