Modele

Kolibri 1 od Aleph Alpha to otwarty model po niemiecku i angielsku. Polskiego nie obsługuje

Aleph Alpha wypuściła otwarty model Kolibri 1, który działa na jednej mocnej karcie graficznej. Producent celowo uczył go tylko dwóch języków, więc polskie firmy z niego nie skorzystają przy tekstach po polsku.

Łukasz Niesyto
prowadzi serwis · wdraża systemy AI w firmach
Opublikowano 3 min czytania
AITekst przygotowany przez AI na podstawie źródła: huggingface.co · jak powstaje
Zdjęcie: mała stalowa figurka kolibra z czerwonym dziobem siedzi na grubym słowniku niemiecko-angielskim

Firma Aleph Alpha udostępniła 3 października model Kolibri 1. To otwarty model językowy, który obsługuje dwa języki: niemiecki i angielski. Polskiego na tej liście nie ma. Model dotyczy głównie firm, które chcą uruchomić AI na własnych serwerach, tak żeby dokumenty nie wychodziły poza firmę. Opis, wyniki testów i wymagania sprzętowe Aleph Alpha opublikowała na stronie modelu Kolibri 1 w serwisie Hugging Face.

Model jest udostępniony na licencji Apache 2.0. Kolibri nie jest czatem do zainstalowania w telefonie. To model, który programiści wbudowują w firmowe programy, na przykład do przeszukiwania wewnętrznych dokumentów albo przygotowywania szkiców pism.

Dwa języki zamiast kilkudziesięciu

Aleph Alpha ograniczyła model do dwóch języków celowo. W opisie modelu nazywa to świadomym wyborem głębi zamiast szerokości. Firma przygotowała nawet osobny sposób dzielenia tekstu na kawałki, dopasowany do budowy niemieckich słów. Dzięki temu model przetwarza niemiecki tekst wydajniej.

Dla polskiej firmy wniosek jest prosty. Jeśli pracujesz na dokumentach po polsku, Kolibri nie jest dla ciebie, bo producent nie deklaruje obsługi naszego języka. Jeśli twoja firma pracuje z partnerami z Niemiec i pisze po niemiecku albo po angielsku, model może się przydać.

Duży model, który mało liczy

Kolibri 1 to model typu mixture of experts. Ma 78 mld parametrów, ale przy każdym kawałku tekstu używa tylko ok. 3,5 mld z nich. Dzięki temu pojedyncza odpowiedź wymaga mało obliczeń. Haczyk polega na pamięci, bo cały model musi siedzieć w pamięci karty graficznej. Producent podaje, że wystarczy jedna karta NVIDIA H200 albo dwie H100.

Kolibri 1Dane producenta
Wszystkie parametry78 mld
Parametry używane narazok. 3,5 mld
Językiniemiecki, angielski
Najdłuższy sprawdzony tekst1 048 576 tokenów
Zalecana długość tekstudo 262 144 tokenów
Wiedza modelu sięga2026-06-18
LicencjaApache 2.0

Token to kawałek słowa. Model przyjmie w jednym zapytaniu ponad milion tokenów, ale producent zaleca najwyżej ćwierć tej wartości, gdy liczy się szybkość albo zadanie jest trudne.

Wyniki i do czego producent go przeznacza

W ogólnej ocenie Aleph Alpha Kolibri 1 dostał 75,5 pkt po angielsku i 70,8 pkt po niemiecku. To lepiej niż inne modele, które używają podobnie mało parametrów naraz, na przykład Qwen3.5 35B-A3B z wynikiem 74,7. Wyprzedza też gpt-oss-120b od OpenAI, który dostał 72,3. To jednak wyniki z testów producenta. Model Qwen3.8 27B, który przy każdym kawałku tekstu używa kilka razy więcej parametrów, ma w tej samej tabeli więcej, bo 80,2 pkt.

Aleph Alpha pisze wprost, że Kolibri ma doradzać, a nie decydować. Według opisu model nadaje się do systemów, w których człowiek sprawdza wynik, zanim ktoś na jego podstawie zadziała. Producent nie przeznacza go do programów, które działają same, bez nadzoru.

Aleph Alpha podpisała też unijny kodeks postępowania dla dostawców modeli AI ogólnego przeznaczenia. Komisja Europejska opisuje go jako dobrowolne narzędzie, które pomaga firmom wykazać, że spełniają obowiązki z AI Act. Terminy i obowiązki z tego rozporządzenia opisaliśmy w tekście o AI Act w Polsce.

Trening wstępny trwał 21 dni na 768 kartach NVIDIA B200. Cały trening, bez końcowego dostrajania, zużył według szacunku producenta ok. 950 MWh energii.

Źródła
  1. Aleph Alpha, karta modelu Kolibri 1 w Hugging Face, dostęp 2026-10-05
  2. Komisja Europejska, The General-Purpose AI Code of Practice

Ten tekst napisał model AI na podstawie źródeł wymienionych wyżej. Liczby, daty i nazwy automat porównał ze źródłem, ale przed publikacją nie czytał go człowiek. Jak powstają teksty.

Widzisz błąd? Napisz, poprawiamy i dopisujemy notę o zmianie.

Łukasz Niesyto
Łukasz Niesyto

Wdraża systemy oparte na AI w firmach produkcyjnych i usługowych. Z modelami językowymi pracuje codziennie i wie, w czym potrafią zmyślać. Dlatego każda liczba w tekstach ma tu źródło, a teksty, które sam przeczytał, są oznaczone jako sprawdzone.

wszystkie teksty autora

Powiązane

5 października 2026

Cloudflare Clef nie pisze tekstu, tylko wybiera odpowiedź. Otwarty model do sortowania spraw

Modelehuggingface.co2 min
4 października 2026

GitHub Copilot wycofał Claude Opus 4.7 i dwa modele Gemini Flash

Modelegithub.blog2 min
1 października 2026

Claude Sonnet 4.5 przestanie działać w API 30 listopada. Następca Sonnet 5.5 jest tańszy

Modeleplatform.claude.com2 min