Virtual-IT.pl - data center cloud computing SDx AI storage network cybersecurity

Aż 95% firm obawia się o bezpieczeństwo w chmurze publicznej
Aż 95% firm obawia się o bezpieczeństwo w chmurze publicznej

Jak wynika z opublikowanego przez Fortinet dokumentu „2023 Cloud Security Report”, w chmurze publicznej znajduje się już ponad połowa danych prawie 40% ankietowanych przedsiębiorstw. W ciągu najbliższych 12-18 miesięcy odsetek tych firm zwiększy się do 58%, co spowoduje, że wyzwań związanych z zabezpieczani...

Czytaj więcej...

Pamięć na wagę złota. Boom na AI destabilizuje rynek PC i SSD
Pamięć na wagę złota. Boom na AI destabilizuje rynek PC i SSD

Osoby, które w ostatnich tygodniach planowały rozbudowę komputera o dodatkową pamięć RAM lub szybszy dysk SSD, mogły przeżyć niemałe zaskoczenie. Ceny komponentów pamięci RAM i dysków wyraźnie poszły w górę, a wszystko wskazuje na to, że nie jest to chwilowa korekta, lecz efekt głębszych zmi...

Czytaj więcej...

FRITZ!Smart Gateway i Amazon Echo - sterowanie głosem w inteligentnym domu
FRITZ!Smart Gateway i Amazon Echo - sterowanie głosem w inteligentnym domu

W dobie szybko rozwijających się technologii Smart Home coraz więcej użytkowników poszukuje rozwiązań, które pozwolą na wygodne i centralne zarządzanie inteligentnymi urządzeniami w domu. Połączenie bramki FRITZ!Smart Gateway z głośnikami Amazon Echo i asystentem Alexa to prosty sposób na wprowadze...

Czytaj więcej...

Trójtorowe podejście do monitorowania centrów danych
Trójtorowe podejście do monitorowania centrów danych

Firmy korzystają z centrów danych, aby sprawnie obsłużyć duże ilości ruchu przychodzącego i wychodzącego oraz umożliwić płynną komunikację między partnerami biznesowymi. Centra danych są jednak mocno rozproszone geograficznie. Umożliwia to szybsze i bardziej niezawodne połączenie użytkownikom z całego świata, of...

Czytaj więcej...

VMware Cloud Pro - infrastruktura IT w europejskiej chmurze
VMware Cloud Pro - infrastruktura IT w europejskiej chmurze

Współczesne środowiska IT stają się coraz bardziej wymagające. Firmy i instytucje muszą sprostać rosnącym oczekiwaniom w zakresie wydajności, elastyczności, bezpieczeństwa oraz zgodności z regulacjami. Tradycyjne modele zarządzania infrastrukturą IT coraz częściej okazują się niewystarczające, a konieczność szyb...

Czytaj więcej...

Technologie na żądanie - wygoda, która może słono kosztować
Technologie na żądanie - wygoda, która może słono kosztować

W erze dynamicznej transformacji cyfrowej coraz więcej organizacji sięga po technologie dostępne na żądanie - takie jak chmura publiczna, SaaS czy generatywna sztuczna inteligencja (GenAI). Ich wspólnym celem jest zwiększenie zwinności, innowacyjności i konkurencyjności firm. Jednak, jak pokazuje najnowsze globa...

Czytaj więcej...

Aktualności

Model językowy Mellum2 od JetBrains dostępny jako open source

LLM model językowyW dobie rosnącej zależności europejskiego biznesu od zamkniętych modeli AI dostarczanych przez amerykańskich gigantów technologicznych, JetBrains wykonuje odważny i znaczący krok. Twórcy kultowego środowiska IntelliJ IDEA udostępnili publicznie na licencji Apache 2.0 swój najnowszy model językowy - Mellum2. Ta wyspecjalizowana, oparta na architekturze MoE jednostka ma zrewolucjonizować sposób, w jaki buduje się systemy sztucznej inteligencji dla programistów. Model trafił już na platformę Hugging Face i jest gotowy do wdrożenia.

W świecie zdominowanym przez gigantyczne, uniwersalne modele od OpenAI, Google czy Anthropic, coraz wyraźniej rysuje się alternatywny trend: specjalizacja. JetBrains, dostawca narzędzi deweloperskich, właśnie wykonał ruch, który może mocno namieszać na rynku sztucznej inteligencji. Firma ogłosiła udostępnienie jako open source modelu Mellum2 - bezpośredniego następcy swojego silnika AI, który dotychczas wspierał programistów m.in. w automatycznym uzupełnianiu kodu.

Mellum2 trafia na platformę Hugging Face i jest gotowy do wdrożeń produkcyjnych. Nie jest to jednak kolejny „ogólnotematyczny chatbot”. To precyzyjnie skrojone narzędzie inżynieryjne.

Architektura MoE: Pełna moc przy ułamku kosztów

Największym atutem Mellum2 jest architektura Mixture-of-Experts (MoE). Model posiada łącznie 12 miliardów parametrów, jednak dla każdego przetwarzanego tokenu aktywnych jest zaledwie 2,5 miliarda.

Efekt? Drastyczne obniżenie kosztów operacyjnych przy zachowaniu minimalnych opóźnień. Z oficjalnych danych wynika, że Mellum2 skraca czas wnioskowania o ponad połowę w porównaniu do innych modeli tej samej klasy, zachowując wysoką jakość w testach logicznych, matematycznych i generowaniu kodu. Model celowo nie jest multimodalny - brak obsługi grafiki czy wideo pozwolił maksymalnie zoptymalizować go pod kątem zadań inżynieryjnych.

Gdzie Mellum2 sprawdzi się najlepiej?

Dzięki otwartej licencji i niskim wymaganiom sprzętowym, model idealnie nadaje się do wdrożeń produkcyjnych w czterech obszarach:

● Orkiestracja i routing: Błyskawiczna analiza zapytań i kierowanie ich do właściwych narzędzi lub cięższych modeli.
● Szybkie potoki RAG: Natychmiastowe przeszukiwanie dokumentacji, wyciąganie kontekstu i streszczanie danych.
● Wydajne sub-agenty: Obsługa wysokoczęstotliwościowych zadań cząstkowych w złożonych procesach (workflow).
● Prywatność i On-premise: Możliwość uruchomienia lokalnie na własnej infrastrukturze, co gwarantuje pełną kontrolę nad kodem źródłowym firmy.

Filozofia „Focal Model”

Wraz z premierą Mellum2, JetBrains prezentuje swoją wizję przyszłości AI. Zdaniem twórców era jednego wielkiego monopolisty odchodzi do lamusa. Przyszłość należy do rozproszonych ekosystemów, w których obok potężnych modeli frontier kluczową rolę będą pełnić tzw. focal models – mniejsze, wyspecjalizowane i niezwykle szybkie komponenty do konkretnych zadań.

Jak zacząć testy?

JetBrains udostępnił pełen raport techniczny na platformie arXiv. Sam model można już pobrać z Hugging Face (kolekcja JetBrains/Mellum-2), eksperymentalnie uruchamiać, dostrajać (fine-tuning) oraz bez przeszkód wdrażać w komercyjnych projektach.

Źródło: JetBrains, opracowanie własne

Logowanie i rejestracja