OpenAI i Broadcom prezentują „Jalapeño” – autorski układ dla wnioskowania LLM
OpenAI we współpracy z Broadcomem zaprezentowało „Jalapeño”, swój pierwszy autorski procesor do wnioskowania w dużych modelach językowych, który ma działać na dużą skalę do końca 2026 roku.

OpenAI wprowadza do swojego stosu technologicznego niestandardowy sprzęt. Układ „Jalapeño”, opracowany wspólnie z firmą Broadcom, został zaprojektowany specjalnie do wnioskowania w dużych modelach językowych (LLM) i ma zostać wdrożony na dużą skalę do końca 2026 roku.
Pierwszy „Procesor Inteligencji” OpenAI
Zgodnie ze wspólnym ogłoszeniem, OpenAI i Broadcom zaprezentowały „Jalapeño” – pierwszy tak zwany „Procesor Inteligencji” OpenAI. Jest to niestandardowy akcelerator stworzony specjalnie do wnioskowania w LLM, a także pierwszy układ w wielogeneracyjnej platformie, którą obie firmy budują razem. Prezes Broadcomu, Hock Tan, oraz prezes Charlie Kawwas przekazali pierwszy wafel krzemowy dyrektorowi generalnemu OpenAI, Samowi Altmanowi, i prezesowi Gregowi Brockmanowi. Dla OpenAI jest to pierwszy krok w kierunku własnego sprzętu po latach skupiania się na modelach i produktach.
OpenAI podkreśla, że „Jalapeño” nie jest zmodyfikowanym układem ogólnego przeznaczenia. Został zaprojektowany od podstaw z myślą o nowoczesnym wnioskowaniu LLM. OpenAI odpowiada za projekt układu, Broadcom wnosi technologię produkcji półprzewodników i sieciową, w tym swoje układy sieciowe Tomahawk, natomiast firma Celestica zajmuje się płytami, szafami serwerowymi i integracją systemów.
Wyniki testów i proces rozwoju
Według OpenAI, wczesne testy wykazały „znacznie lepszą” wydajność na wat w porównaniu z obecnym, najnowocześniejszym sprzętem. Są to jednak dane zgłoszone przez samą firmę, które nie zostały jeszcze ostatecznie potwierdzone. Planowane jest opublikowanie raportu technicznego. Obecnie nie jest jasne, z jakimi układami „Jalapeño” było testowane, w jakich zadaniach i w jakich warunkach.
Architektura układu ma ograniczać ruch danych i maksymalizować wykorzystanie zasobów, zbliżając je do teoretycznego maksimum. Próbki inżynieryjne już teraz uruchamiają obciążenia uczenia maszynowego w laboratorium, w tym model GPT-5.3-Codex-Spark. Model ten obecnie działa na sprzęcie firmy Cerebras, która również specjalizuje się w wnioskowaniu.
OpenAI informuje, że proces od projektu do produkcji prototypu (tape-out) zajął zaledwie dziewięć miesięcy, co firma określa jako najszybszy cykl rozwoju układu ASIC dla wysokowydajnych półprzewodników, o jakim wie. Własne modele OpenAI pomogły przyspieszyć niektóre etapy procesu projektowania. Plotki o planach dotyczących własnych układów krążyły jednak już od 2023 roku.
Strategia pełnej kontroli i partnerstwa
Ogłoszenie to odzwierciedla argumentację OpenAI, że kontrola nad całym stosem technologicznym, od układu po produkt, pozwala na szybsze, bardziej niezawodne i tańsze uruchamianie modeli. Prezes Broadcomu, Tan, stwierdził, że pierwsze wdrożenie planowane jest na koniec 2026 roku na skalę gigawatową, we współpracy z Microsoftem i innymi partnerami. Broadcom miał podobno zażądać od Microsoftu gwarancji zakupu 40 procent układów, aby zabezpieczyć pierwszą fazę projektu.
Rozwój własnego układu „Jalapeño” przez OpenAI i Broadcom stanowi znaczący krok w kierunku pionowej integracji w branży sztucznej inteligencji. Ta strategia, mająca na celu optymalizację sprzętu pod kątem specyficznych potrzeb dużych modeli językowych, może potencjalnie obniżyć koszty operacyjne i zwiększyć wydajność, co jest kluczowe w obliczu rosnącego zapotrzebowania na moc obliczeniową w AI. Wprowadzenie własnych układów może również zmniejszyć zależność OpenAI od zewnętrznych dostawców, co ma strategiczne znaczenie dla przyszłego rozwoju firmy i całej branży.
Źródło: the-decoder.com
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej


OpenAI stworzyło GPT-Red – super-hakera AI do zwiększania bezpieczeństwa swoich modeli
OpenAI opracowało GPT-Red, model językowy pełniący rolę 'super-hakera', którego zadaniem jest znajdowanie luk w zabezpieczeniach innych modeli LLM firmy. Dzięki temu najnowsza wersja GPT-5.6 jest uznawana za najbardziej
Redakcja Aigest15 lip 2026
xAI wprowadza Imagine Image 2.0, model plasuje się tuż za GPT-Image-2 OpenAI w rankingach Arena
xAI zaprezentowało Imagine Image 2.0, nową wersję swojego generatora obrazów, która oferuje zaawansowane narzędzia edycyjne i szablony. Model ten osiągnął wysokie wyniki w benchmarkach Arena, ustępując jedynie GPT-Image-
Redakcja Aigest10 godz. temu
OpenAI wstrzymuje rozwój modelu Astra z powodu obaw o cyberbezpieczeństwo
OpenAI ogłosiło wstrzymanie prac nad niektórymi aspektami swojego nadchodzącego modelu Astra, po tym jak wewnętrzny przegląd wykazał, że osiągnął on zdolności do samodzielnego przeprowadzania cyberataków, przekraczając k
Redakcja Aigest19 godz. temu

Głośnik OpenAI z ruchomymi elementami ma kosztować nawet 400 dolarów i naśladować ludzką interakcję
OpenAI pracuje nad głośnikiem inteligentnym, który ma wyróżniać się ruchomymi częściami i zaawansowaną interaktywnością, a jego cena może sięgnąć 400 dolarów. Urządzenie ma zastąpić smartfony i kontrolować inteligentny d
Redakcja Aigestwczoraj

Chatboty AI zawodzą w kryzysach psychicznych. Czy da się to naprawić?
Chatboty AI, w tym ChatGPT, były wielokrotnie oskarżane o szkodliwe interakcje z osobami w kryzysie psychicznym, prowadzące nawet do tragedii. Firmy technologiczne, świadome odpowiedzialności prawnej, podejmują kroki w c
Redakcja Aigestwczoraj
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.