W dobie rosnącej zależności europejskiego biznesu od zamkniętych modeli AI dostarczanych przez amerykańskich gigantów technologicznych, JetBrains wykonuje odważny i znaczący krok. Twórcy kultowego środowiska IntelliJ IDEA udostępnili publicznie na licencji Apache 2.0 swój najnowszy model językowy - Mellum2. Ta wyspecjalizowana, oparta na architekturze MoE jednostka ma zrewolucjonizować sposób, w jaki buduje się systemy sztucznej inteligencji dla programistów. Model trafił już na platformę Hugging Face i jest gotowy do wdrożenia.
W świecie zdominowanym przez gigantyczne, uniwersalne modele od OpenAI, Google czy Anthropic, coraz wyraźniej rysuje się alternatywny trend: specjalizacja. JetBrains, dostawca narzędzi deweloperskich, właśnie wykonał ruch, który może mocno namieszać na rynku sztucznej inteligencji. Firma ogłosiła udostępnienie jako open source modelu Mellum2 - bezpośredniego następcy swojego silnika AI, który dotychczas wspierał programistów m.in. w automatycznym uzupełnianiu kodu.
Mellum2 trafia na platformę Hugging Face i jest gotowy do wdrożeń produkcyjnych. Nie jest to jednak kolejny „ogólnotematyczny chatbot”. To precyzyjnie skrojone narzędzie inżynieryjne.
Największym atutem Mellum2 jest architektura Mixture-of-Experts (MoE). Model posiada łącznie 12 miliardów parametrów, jednak dla każdego przetwarzanego tokenu aktywnych jest zaledwie 2,5 miliarda.
Efekt? Drastyczne obniżenie kosztów operacyjnych przy zachowaniu minimalnych opóźnień. Z oficjalnych danych wynika, że Mellum2 skraca czas wnioskowania o ponad połowę w porównaniu do innych modeli tej samej klasy, zachowując wysoką jakość w testach logicznych, matematycznych i generowaniu kodu. Model celowo nie jest multimodalny - brak obsługi grafiki czy wideo pozwolił maksymalnie zoptymalizować go pod kątem zadań inżynieryjnych.
Dzięki otwartej licencji i niskim wymaganiom sprzętowym, model idealnie nadaje się do wdrożeń produkcyjnych w czterech obszarach:
● Orkiestracja i routing: Błyskawiczna analiza zapytań i kierowanie ich do właściwych narzędzi lub cięższych modeli.
● Szybkie potoki RAG: Natychmiastowe przeszukiwanie dokumentacji, wyciąganie kontekstu i streszczanie danych.
● Wydajne sub-agenty: Obsługa wysokoczęstotliwościowych zadań cząstkowych w złożonych procesach (workflow).
● Prywatność i On-premise: Możliwość uruchomienia lokalnie na własnej infrastrukturze, co gwarantuje pełną kontrolę nad kodem źródłowym firmy.
Wraz z premierą Mellum2, JetBrains prezentuje swoją wizję przyszłości AI. Zdaniem twórców era jednego wielkiego monopolisty odchodzi do lamusa. Przyszłość należy do rozproszonych ekosystemów, w których obok potężnych modeli frontier kluczową rolę będą pełnić tzw. focal models – mniejsze, wyspecjalizowane i niezwykle szybkie komponenty do konkretnych zadań.
JetBrains udostępnił pełen raport techniczny na platformie arXiv. Sam model można już pobrać z Hugging Face (kolekcja JetBrains/Mellum-2), eksperymentalnie uruchamiać, dostrajać (fine-tuning) oraz bez przeszkód wdrażać w komercyjnych projektach.
Źródło: JetBrains, opracowanie własne