Zdjęcie: mochi mambo/Shutterstock
DeepSeek, Qwen i Z.ai – te nazwy chińskich modeli AI z pewnością dały się we znaki wielu zachodnim badaczom. Sposobów walki z konkurencyjnością azjatyckich rozwiązań było w USA wiele. Być może jednak oprócz ich cenzury i ograniczeń, Amerykanom uda się w końcu odpowiedzieć rozwiązaniem o porównywalnej wydajności. Ta cechować ma model Beam, stworzony przez startup Reflection.
Beam od startupu Reflection
Beam ma być modelem, który umożliwi rozumowanie, kodowanie oraz wykonywanie zadań agentowych przy „ułamku kosztów tokenów i czasu wnioskowania” konkurentów. Rozwiązanie to model o 501 mld parametrów, z których 23 mld to parametry aktywne. Został wstępnie wytrenowany na 23,8 bln tokenów i ma okno kontekstowe o rozmiarze 1 mln tokenów. Dla porównania, GLM-5.2 Z.ai ma łącznie około 744 mld parametrów, z czego 40 mld jest aktywnych.
Póki co brak jednak niezależnych weryfikacji parametrów amerykańskiego modelu. Firma twierdzi, że w zaawansowanych testach wnioskowania Beam osiąga wyniki porównywalne z GLM-5.2 firmy Z.ai i przewyższa wiodące zachodnie otwarte modele, zużywając przy tym „3–4 razy mniej obliczeń wnioskowania”.
Model jest aktualnie udostępniany wybranej grupie użytkowników z listy oczekujących. Udostępnienie pełnych wag modelu (open-weight) oraz szczegółów technicznych dla wszystkich deweloperów ma nastąpić jeszcze w tym miesiącu.
Być może więc niedługo przekonamy się, czy deklaracje twórców wytrzymają starcie z rzeczywistością (i azjatycką konkurencją).
Komentarze
Nie ma jeszcze żadnych komentarzy :)