Najpierw odpowiedź. Seedance 3 nie został oficjalnie ogłoszony. Publiczny katalog modeli ByteDance Seed wskazuje obecnie Seedance 2.5 jako najnowszy wydany model wideo Seedance. Dlatego kolejna główna generacja najlepiej omawiać jako oczekiwanie oparte na mapie drogowej: model, który mógłby rozszerzyć 30‑sekundowe opowiadanie historii, multimodalną kontrolę referencji, zsynchronizowane audio i precyzyjną edycję, jednocześnie adresując pozostałe słabości w zakresie złożonej fizyki i spójności wielopodmiotowej.
Czym jest Seedance 3?
Seedance to rodzina generatywnych modeli wideo ByteDance Seed. Oficjalny katalog modeli nie zawiera obecnie produktu Seedance 3, karty modelu, identyfikatora API, ceny ani harmonogramu wydania. Ten brak ma znaczenie: nazwa jest rozsądną etykietą dla przyszłej głównej generacji, ale nie jest jeszcze potwierdzonym modelem komercyjnym.
Dlatego ten artykuł rozróżnia trzy poziomy dowodów. Fakty potwierdzone opisują wydane modele Seedance i opublikowane możliwości konkurencji. Oczekiwane funkcje wynikają z widocznej trajektorii rozwoju ByteDance. Nieznane pola pozostają oznaczone jako TBD zamiast wypełniania ich plotkowanymi liczbami. To rozróżnienie utrzymuje artykuł użytecznym przed premierą i łatwym do aktualizacji, gdy pojawi się oficjalne ogłoszenie.
Dlaczego kolejny model Seedance jest prawdopodobny
Seedance 1.0 ustanowił natywną, wieloujęciową generację tekst‑>wideo oraz obraz‑>wideo w 1080p. Seedance 1.5 Pro dodał natywną generację audio i ukierunkowanie na opowiadanie w stylu filmowym. Seedance 2.0 przeszedł do ujednoliconej architektury audio‑wideo, która potrafiła wspólnie interpretować tekst, obrazy, klipy wideo i referencje audio. Seedance 2.5 następnie podwoił opublikowaną długość pojedynczej generacji i rozszerzył pojemność referencji.
Wzorzec jest spójny: każde wydanie rozszerza jednostkę tworzenia. Seria przeszła od wizualnie spójnego klipu, do klipu audiowizualnego, do multimodalnego systemu reżyserii, a następnie do dłuższego i bardziej edytowalnego przepływu pracy kreatywnej. Przyszły Seedance 3 miałby największy sens, gdyby poprawił niezawodność tego przepływu pracy, zamiast tylko dodawać kolejny nagłówkowy parametr.
Jak ewoluowała mapa drogowa Seedance
| Generacja | Wejścia | Opublikowany czas trwania | Audio | Kluczowy postęp |
|---|---|---|---|---|
| Seedance 1.0 | Tekst i obraz | 10 s, wieloujęciowo | Brak natywnego audio | Generacja 1080p; szybka baza wnioskowania |
| Seedance 1.5 Pro | Tekst i obraz | Krótkie formy | Natywne audio | Filmowe opowiadanie audiowizualne |
| Seedance 2.0 | Tekst, obraz, wideo, audio | 15 s | Natywne audio | Ujednolicone referencje, kontynuacja i edycja |
| Seedance 2.5 | Tekst, obraz, wideo, audio | 30 s | Natywne audio | 50 referencji i edycja na poziomie znaczników czasu |
| Seedance 3 | TBD | TBD | Oczekiwane | Brak oficjalnego ogłoszenia |
Źródło: ByteDance Seed 1.0 technical overview; Seedance 2.0 launch materials; Seedance 2.5 launch materials. Pola Seedance 3 są nieujawnione.

Źródła: ByteDance Seed 1.0, Seedance 2.0 i Seedance 2.5 – materiały oficjalne. Seedance 3 pozostaje TBD.
Oczekiwane specyfikacje Seedance 3
Najbezpieczniejszym sposobem omawiania specyfikacji przed ogłoszeniem jest użycie wydanego zestawu funkcji Seedance 2.5 jako punktu odniesienia. Poniższa tabela nie twierdzi, że Seedance 3 już obsługuje te wartości; identyfikuje to, co od następnej generacji oczekiwałoby się zachować lub poprawić.
| Specyfikacja | Punkt odniesienia Seedance 2.5 | Oczekiwanie wobec Seedance 3 | Pewność |
|---|---|---|---|
| Status oficjalny | Wydany | Nie został oficjalnie ogłoszony | Potwierdzone |
| Architektura | Ujednolicona wspólna generacja audio‑wideo | Bardziej wydajna ujednolicona generacja multimodalna | Wysoka |
| Modalności wejściowe | Tekst, obraz, wideo, audio | Najpewniej te same cztery modalności z głębszym wspólnym wnioskowaniem | Wysoka |
| Czas trwania pojedynczej generacji | Do 30 sekund | Co najmniej utrzymanie progu 30 s; dłuższe wyjście niepotwierdzone | Średnia |
| Pojemność referencji | 30 obrazów + 10 wideo + 10 klipów audio | Co najmniej utrzymanie 50 zasobów lub mądrzejsze nimi zarządzanie | Średnia |
| Wyjście audio | Natywne zsynchronizowane audio | Ulepszone dialogi, tożsamość głosów i dźwięk przestrzenny | Wysoka |
| Edycja | Edycja wg znaczników czasu, kamery, green‑screen i referencji | Bardziej lokalna, niezawodna i konwersacyjna edycja | Wysoka |
| Rozdzielczość i klatkaż | Nie określone w oficjalnym artykule | TBD | Nieznane |
| Identyfikator modelu API | seedance-2-5 na CometAPI | TBD | Potwierdzone |
| Ceny i regiony | Dostępne zależnie od ścieżki | TBD | Nieznane |
Źródło: Potwierdzony punkt odniesienia z oficjalnej strony produktu Seedance 2.5. Oczekiwania to analiza, nie ogłoszone specyfikacje.
Publishing rule. Nie stwierdzaj, że Seedance 3 obsługuje 4K, 60‑sekundową natywną generację, określony klatkaż lub konkretną cenę, dopóki ByteDance nie opublikuje tych szczegółów. Używaj TBD dla każdego nieujawnionego pola.
Jakie funkcje mógłby wprowadzić Seedance 3?
Dłuższe historie pozostające spójne
Seedance 2.5 potrafi generować 30‑sekundowe klipy audiowizualne w jednym przebiegu i wydłużać je w wielu rundach. Kolejne wyzwanie to nie tylko czas trwania. Długi film staje się użyteczny tylko wtedy, gdy tożsamość postaci, garderoba, układ przestrzenny, oświetlenie, głos i przyczynowość narracyjna pozostają stabilne w ujęciach i rozszerzeniach.
Seedance 3 mógłby więc skupić się na trwałym stanie sceny: pamiętaniu, która postać trzyma obiekt, gdzie znajduje się drzwi, jak zmienia się kostium oraz jak wcześniejsze zdarzenie powinno wpływać na późniejsze ujęcie. Zmniejszyłoby to ilość pracy korygującej, którą twórcy obecnie wykonują po wygenerowaniu wizualnie imponującej, ale wewnętrznie niespójnej sekwencji.
Silniejsza fizyka i złożone interakcje
Kontakt człowiek‑obiekt, kolizje, tkaniny, płyny, tłumy i szybki ruch kamery pozostają trudne dla generatywnych systemów wideo. Własne podsumowanie Seedance 2.5 od ByteDance wskazuje fizykę złożonych ruchów i stabilność interakcji wielopodmiotowych jako obszary do poprawy. Znaczący skok generacyjny uczyniłby te sceny bardziej niezawodnymi, a nie tylko bardziej szczegółowymi.
Praktycznym miernikiem jest wskaźnik użyteczności. Klip sportowy nie jest udany, ponieważ jedno ujęcie wygląda realistycznie; odnosi sukces, gdy dłonie, sprzęt, pęd, kontakt, dźwięk i ruch kamery pozostają wiarygodne przez całe ujęcie. Seedance 3 należy oceniać na podstawie kompletnych sekwencji i powtarzanych generacji, a nie wybranych kadrów pokazowych.
Trwałe postacie, produkty i głosy
Kontrola referencji staje się interfejsem produkcyjnym dla wideo AI. Twórcy potrzebują, by ten sam aktor, produkt, rekwizyt, lokalizacja i głos pozostawały rozpoznawalne w wielu scenach. Seedance 2.5 już przyjmuje do 30 obrazów, 10 wideo i 10 klipów audio, ale kolejnym krokiem nie musi być większy limit przesyłania. Lepszy dobór referencji, rozwiązywanie konfliktów, ważenie tożsamości i wielokrotnego użytku zasoby postaci mogą dać większą wartość niż surowe zwiększenie pojemności.
W reklamie oznacza to, że opakowanie, logo, system kolorystyczny i rzecznik mogą przetrwać zmiany kamery bez dryfu. W produkcji narracyjnej – że powracająca postać może wyglądać i brzmieć spójnie bez ponownego budowania zestawu referencji dla każdego klipu.
Bardziej precyzyjna, zlokalizowana edycja wideo
Generacja to tylko pierwsza połowa przepływu produkcyjnego. Montażyści muszą zmienić jeden obiekt, wyraz twarzy, kwestię dialogową, ruch kamery lub przedział czasu, pozostawiając zaakceptowaną treść nietkniętą. Seedance 2.5 wspiera edycję opartą na znacznikach czasu, zmiany perspektywy kamery, workflow green‑screen i rewizję kierowaną referencjami. Seedance 3 mógłby uczynić te operacje bardziej lokalnymi i deterministycznymi.
- Zmiany na poziomie regionu, które zachowują piksele i ruch poza żądanym obszarem.
- Rewizja wyłącznie audio lub wyłącznie ruchu bez regeneracji całej sekwencji.
- Konwersacyjna historia edycji, dzięki której twórca może dopracowywać wynik przez kilka tur.
- Stabilne wersje referencji, które utrzymują zatwierdzoną tożsamość postaci lub produktu w kolejnych edycjach.
Profesjonalna kontrola kamery i sceny
Seedance 2.5 może używać instrukcji ze znacznikami czasu i referencji w postaci renderów clay do kontrolowania ustawień aktorów, ruchu kamery, geometrii sceny, kierunku światła i tempa. Przyszły model mógłby zacieśnić związek między prewizualizacją a renderingiem końcowym. Panele storyboardu, szkice 3D, listy ujęć, ścieżki ruchu i wskazówki audio mogłyby stać się elementami jednego briefu reżyserskiego.
Tu Seedance może się odróżnić od modeli zoptymalizowanych głównie pod piękne krótkie klipy. Zespoły produkcyjne cenią powtarzalność: możliwość poproszenia o konkretny charakter obiektywu, czas trwania ujęcia, znacznik aktora, setup oświetlenia czy kąt produktu i otrzymania wyniku, który można poprawiać bez zaczynania od nowa.
Wydajność w benchmarkach: co jest potwierdzone, a co nie?
Nie istnieją wyniki Seedance 3. Nie ma oficjalnych benchmarków Seedance 3. Każdy wykres przypisujący modelowi wynik Elo, współczynnik wygranych, prędkość generacji lub ocenę jakości przed oficjalną ewaluacją należy traktować jako niezweryfikowany.
Bazowa wydajność Seedance 2.5
ByteDance nie opublikował ustandaryzowanego wyniku leaderboard Seedance 2.5 ani protokołu benchmarku zewnętrznego. Oficjalne materiały premierowe definiują wydajność przez możliwości zorientowane na produkcję i kuratorskie demonstracje. To czyni Seedance 2.5 relewantnym, potwierdzonym punktem odniesienia, jednocześnie zapobiegając myleniu jakościowych pokazów z niezależnymi wynikami porównawczymi między modelami.
Opublikowana baza obejmuje do 30 sekund w jednej generacji, do dwóch rund rozszerzeń i maksymalnie 50 zasobów referencyjnych: 30 obrazów, 10 klipów wideo i 10 klipów audio. ByteDance zgłasza również płynniejsze przejścia, silniejszą stabilność obiektów w ujęciach, zsynchronizowane audio i wideo oraz edycję na poziomie znaczników czasu. Te twierdzenia opisują zamierzoną wydajność produkcyjną modelu; nie ujawniają zestawu testowych promptów, protokołu ocen, współczynnika wygranych, rozkładu opóźnień ani kosztu na zaakceptowaną sekundę.

Maksymalna opublikowana pojemność referencji Seedance 2.5. Źródło: opis premiery ByteDance Seed. To metryka pojemności produktu, a nie ustandaryzowana ocena jakości.
Co pokazuje baza Seedance 2.5
Najbardziej mierzalną siłą Seedance 2.5 jest skala przepływu pracy. Natywny klip 30 s, wielorundowe rozszerzenia i wejście 50 referencji mogą zmniejszyć liczbę oddzielnych generacji wymaganych dla sekwencji bogatej w referencje. Narzędzia edycji celują także w punkt, gdzie koszty produkcji zwykle rosną: poprawianie jednego przedziału czasu, ruchu kamery, obiektu lub tła bez przebudowy całej koncepcji.
Pozostające pytania o wydajność to pytania o niezawodność. Niezależne testy powinny mierzyć użyteczność w pierwszym podejściu, spójność tożsamości i głosu w pełnych 30 sekundach, wskaźniki błędów przy złożonych ruchach, synchronizację audio‑wideo w dialogu oraz to, ile zatwierdzonej treści zmienia się po edycji celowanej. Te wyniki byłyby bardziej użyteczne decyzyjnie niż pojedyncza ocena preferencji wizualnej.
Benchmarki Seedance 3.0, które będą istotne przy premierze
Wiarygodna ewaluacja Seedance 3 powinna raportować więcej niż ogólny wynik preferencji. Najbardziej użyteczna analiza premierowa przetestowałaby następujące wymiary z ujawnionymi promptami, wieloma losowymi ziarnami i kompletnymi nieedytowanymi wynikami.
- Spójność tożsamości w dłuższej formie: stabilność twarzy, ciała, ubioru, produktu, rekwizytu i głosu w ujęciach i rozszerzeniach.
- Fizyka złożonego ruchu: kontakt człowiek‑obiekt, pęd, kolizje, tkaniny, płyny, tłumy i sporty.
- Podążanie za instrukcjami: akcje z kodowaniem czasowym, kolejność ujęć, ruchy kamery, dialogi i ograniczenia negatywne.
- Synchronizacja audio‑wideo: mowa, ruch warg, efekty, ambient, muzyka i timing zdarzeń.
- Zachowanie edycji: ile zatwierdzonej treści zmienia się, gdy rewizji podlega jeden region, przedział czasu lub dźwięk.
- Wydajność produkcyjna: czas do użytecznego wyniku, współczynnik ponowień, opóźnienie, koszt na zaakceptowaną sekundę i współczynnik awarii.
Czy powinieneś czekać na Seedance 3?
Czekanie nie jest automatycznie bezpieczniejszym wyborem, ponieważ Seedance 3 nie ma potwierdzonej daty wydania, specyfikacji, ceny ani identyfikatora API. Praktyczna decyzja to, czy Seedance 2.5 już spełnia kryteria akceptacji dla pracy, którą musisz dostarczyć.
Czekaj, jeśli...
Twój obecny blokujący problem to znana luka możliwości. Jeśli projekt zależy od niezawodnej złożonej fizyki, gęstych interakcji wielopodmiotowych, silnie zlokalizowanych edycji lub trwałych, wielokrotnego użytku zasobów postaci, obecny model może wciąż wymagać zbyt wielu ponowień i ręcznych korekt.
Projekt nie ma sztywnego terminu dostawy. Czekanie może być rozsądne, gdy odroczenie ma niewielki koszt, a zespół toleruje nieznany harmonogram premiery, region dostępu, zachowanie kolejki i cenę.
Migracja byłaby kosztowna. Jeśli prompty, pakietowanie referencji, kryteria przeglądu lub zgody compliance trzeba byłoby zbudować na nowo wokół nowego modelu, lepiej ocenić oficjalny interfejs Seedance 3 przed zobowiązaniem się do przepływu produkcyjnego.
Używaj teraz Seedance 2.5, jeśli.
Potrzebujesz działającej bazy produkcyjnej. Seedance 2.5 już zapewnia 30‑sekundową generację, rozszerzenia, natywne zsynchronizowane audio, duże multimodalne zestawy referencji oraz edycję opartą na znacznikach czasu. Te możliwości są na tyle konkretne, by przetestować je na prawdziwym briefie dziś.
Iteracja jest ważniejsza niż teoretyczna jakość szczytowa. Aktualny model pozwala zespołowi nauczyć się, które prompty, referencje, instrukcje kamery, bramki przeglądowe i edycje awaryjne faktycznie determinują użyteczny wynik.
Chcesz dowodów przed przełączeniem. Baza Seedance 2.5 daje porównywalne mierniki dla akceptacji w pierwszym podejściu, ponowień, opóźnienia, kosztu na zaakceptowaną sekundę, dryfu tożsamości i zachowania edycji. Seedance 3 można potem ocenić względem tego samego zestawu testowego, gdy stanie się realny.
Seedance 3 vs Seedance 2.5 vs Vidu Q3, Kling 3.0 vs Veo 3.1
Ponieważ Seedance 3 nie ma opublikowanych specyfikacji, poniższe porównanie traktuje jego kolumnę jako próg, a nie kartę wyników. Pokazuje, co następny model musiałby co najmniej dorównać lub przewyższyć w stosunku do obecnie dostępnych systemów.
| Model | Status | Natywny czas trwania | Audio | Kontrola i edycja | Obecne pozycjonowanie |
|---|---|---|---|---|---|
| Seedance 3 | Nie ogłoszono | TBD | Oczekiwane natywne audio | Oczekiwana głębsza kontrola multimodalna | Musi poprawić niezawodność długiej formy |
| Seedance 2.5 | Dostępny | Do 30 s | Natywne zsynchronizowane audio | 50 referencji; edycja wg znaczników czasu i kamery | Długie, bogate w referencje opowiadanie |
| Vidu Q3 | Dostępny | 1–16 s | Natywne wyjście audio‑wideo | Tekst, obraz, pierwsza/ostatnia klatka i tryby referencji | Elastyczny czas trwania i szybka iteracja |
| Kling 3.0 | Dostępny | 3–15 s | Natywne wyjście audio‑wideo | Sterowanie storyboardem; referencje obrazu, wideo i elementów | Reżyseria wieloujęciowa i elementy wielokrotnego użytku |
| Veo 3.1 | Dostępny | Zależny od trybu | Natywne audio | Rozszerzenie, generacja klatkowa i prowadzenie obrazem | Filmowe renderowanie i workflow Google |
Strony modeli: Seedance 2.5 | Vidu Q3 | Kling 3.0 | Veo 3.1
Co pokazuje porównanie
Seedance 2.5 ma obecnie najklarowniejszą przewagę w opublikowanej natywnej długości klipu i maksymalnej liczbie referencji wśród pokazanych tu modeli. Jego 30‑sekundowy przepływ jest zaprojektowany wokół kompletnej jednostki narracyjnej, a nie krótkiego izolowanego ujęcia.
Vidu Q3 oferuje elastyczną generację od jednej do 16 sekund, do 1080p według oficjalnej dokumentacji API oraz warianty priorytetyzujące jakość wyjścia lub prędkość. Jest atrakcyjny, gdy szybka iteracja, kontrola klatki początkowej/końcowej lub workflow referencja‑>wideo są ważniejsze niż maksymalna natywna długość.
Kling 3.0 obsługuje do 15 sekund, natywne wyjście audiowizualne, własne wieloujęciowe storyboardy i elementy postaci budowane z referencji obrazów lub wideo. Jego przewagą konkurencyjną jest jawna reżyseria na poziomie ujęć i zasoby tożsamości wielokrotnego użytku.
Veo 3.1 akcentuje natywne audio, rozszerzanie wideo, generację specyficzną dla klatek i prowadzenie obrazem. Pozostaje mocnym benchmarkiem filmowego renderingu i integracji w generatywnym stacku Google.
Aby Seedance 3 reprezentował prawdziwą zmianę generacji, musi zrobić więcej niż wygrać wybrany test preferencji wizualnych. Powinien zamieniać więcej promptów w użyteczne, edytowalne sekwencje za pierwszym razem, zwłaszcza w scenach wielopostaciowych, ze złożonym ruchem i długą kontynuacją.
Kiedy zostanie wydany Seedance 3?
Nie ma oficjalnej daty wydania Seedance 3. ByteDance nie opublikował strony projektu, karty modelu, identyfikatora API, tabeli cen, regionu dostępności ani sekwencji rollout dla tej nazwy. Okna wydania nie należy wywodzić mechanicznie z odstępów między wcześniejszymi wersjami Seedance.
Najbardziej wiarygodne punkty potwierdzenia to katalog modeli ByteDance Seed, artykuły premierowe ByteDance Seed, dokumentacja API Volcano Engine lub BytePlus oraz działający produkt lub strona modelu. Dopóki jedno z tych źródeł nie zidentyfikuje Seedance 3, twierdzenia o dacie premiery powinny być przedstawiane jako plotki lub całkowicie pomijane.
Jak uzyskać dostęp do modeli Seedance w oczekiwaniu
Deweloperzy nie muszą czekać na niepotwierdzony model, by przetestować aktualny przepływ pracy. Seedance 2.5 jest dostępny przez CometAPI z użyciem asynchronicznego wzorca generacji wideo. Aplikacje składają zadanie, zapisują zwrócony identyfikator, odpytywają o ukończenie i pobierają wynikowy film. Ta sama warstwa integracji ułatwia porównywanie modeli wideo bez przebudowywania uwierzytelniania i obsługi zadań dla każdego dostawcy.
Bash (cURL)
curl --request POST 'https://api.cometapi.com/v1/videos' \ --header 'Authorization: Bearer YOUR_COMETAPI_KEY' \ --form-string 'model=seedance-2-5' \ --form-string 'prompt=A cinematic tracking shot of a paper dragon flying above a lantern-lit river at dusk.' \ --form-string 'seconds=5'
Przykład używa wydanego identyfikatora modelu seedance-2-5. Nie należy go zmieniać na seedance-3, dopóki CometAPI nie opublikuje rzeczywistej strony modelu i wspieranego identyfikatora. Zachowanie endpointu i parametry żądania należy sprawdzać w aktualnej dokumentacji API przed użyciem produkcyjnym.
Pełne parametry, obsługa statusu zadań i wskazówki produkcyjne znajdują się w dokumentacji CometAPI.
Czego wciąż nie wiemy
- Czy Seedance 3 będzie oficjalną nazwą produktu.
- Daty wydania i sekwencji rollout.
- Maksymalnego natywnego czasu trwania, rozdzielczości wyjściowej, klatkażu i ograniczeń proporcji.
- Maksymalnej liczby referencji i tego, czy referencje mogą stać się zasobami wielokrotnego użytku.
- Szczegółów architektury, skali parametrów, ujawnienia danych treningowych i sprzętu inferencyjnego.
- Oficjalnych wyników benchmarków i protokołu ewaluacji, który za nimi stoi.
- Identyfikatorów modeli API, cen, regionów dostępności, limitów szybkości i warunków komercyjnych.
- Mechanizmów pochodzenia, znakowania wodnego, ochrony tożsamości i kontroli praw autorskich, które będą dostarczone z modelem.
Finalne uwagi
Seedance 3 pozostaje niepotwierdzony, ale kierunek rodziny Seedance jest coraz bardziej jasny. Seria przeszła od natywnej wieloujęciowej generacji wizualnej do zsynchronizowanego audio, ujednoliconej multimodalnej kontroli referencji, 30‑sekundowego opowiadania historii i ukierunkowanej edycji. Kolejny duży krok powinien uczynić ten workflow bardziej niezawodnym, a nie tylko bardziej spektakularnym w wybranych demonstracjach.
Najważniejszym dowodem będzie powtarzalna wydajność: spójne postacie i głosy w długich sekwencjach, wiarygodna interakcja fizyczna, precyzyjna odpowiedź na instrukcje z kodowaniem czasowym oraz edycje, które zachowują zatwierdzoną treść. Te cechy decydują o tym, czy model może przejść z generowania koncepcji do codziennej produkcji.
Czekając na oficjalne informacje o Seedance 3, deweloperzy mogą ocenić aktualne API Seedance 2.5 i porównać je z innymi modelami wideo poprzez CometAPI. Ten artykuł należy aktualizować tylko wtedy, gdy ByteDance lub żywe źródło API potwierdzi nazwę modelu, specyfikacje, benchmarki i szczegóły dostępu.
