»

Nvidia kupuje Hugging Face

Slo-Tech - Nvidia se je dogovorila, da bo za 13 milijard dolarjev prevzela priljubljeno platformo Hugging Face, na kateri razvijalci delijo odprte modele umetne inteligence. Gre za skrbno premišljeno potezo, ki Nvidii ne bo takoj prinesla milijonskih prihodkov, temveč strateško pomembno sredstvo. Nvidia ima kot ponudnik infrastrukture za umetno inteligenco drugačne interese kot OpenAI, SpaceX, Google in podobni. Medtem ko ti želijo, da bi uporabniki posegali po njihovih modelih, je Nvidii to nepomembno. Še več, Nvidia ima raje odprte modele, ker ti tečejo na komercialno dostopni infrastrukturi, ki jo nudi Nvidia. OpenAI in ostali ponudniki namreč razvijajo tudi lastne čipe, ki bi dolgoročno lahko privedli do njihove neodvisnosti od Nvidie.

Zato ni presenetljivo, da bo Nvidia za podjetje, ki ima 150 milijonov prihodkov letno, odštela 13 milijard dolarjev, torej 86-krat več. Hugging Face se je začel leta 2016 kot preprost pogovorni robot, ime pa je dobil po emotikonu, ki ga je podjetje...

13 komentarjev

Nvidia oblikuje zavezništvo za varno umetno inteligenco

Slo-Tech - Incident, v katerem je OpenAI-jev model pobegnil iz peskovnika na Hugging Faceu, odmeva na različne načine. Medtem ko želi ameriški zakonodajalec uzakoniti stikalo za izklop v sili (kill switch), je Nvidia ustanovila zavezništvo industrijskih partnerjev za varnost umetne inteligence. V njem sodelujejo vsa večja imena s področja.

Med skoraj štiridesetimi partnerji so bolj znani Adobe, Crowdstrike, Dell, Hugging Face, Red Hat, IBM, Microsoft, Nvidia in SpaceX. Člani so podpisali memorandum, ki med drugim prepoveduje razvoj odprtih sistemov, ki bi ogrozili obrambne zmogljivosti ali nesprejemljivo koncentrirali moč, odvisnost in ranljivosti pri zgolj nekaj zaprtih ponudnikih. Prizadevali si bodo za odprtokodno varnost in razvoj zaščitnih orodij.

Novo zavezništvo se imenuje Open Secure AI Alliance. Ali bo ostalo mrtva črka na papirju, bomo še videli. Interes razvijalcev čipov in ponudnikov računske moči je imeti čim več odprtih modelov, medtem ko OpenAI, Anthropic in podobni stavijo...

12 komentarjev

OpenAI teden dni vedel, da ChatGPT vdira v Hugging Face

Slo-Tech - Po dostopnih podatkih je OpenAI-jev model umetne inteligence med 11. in 13. julijem vdrl v infrastrukturo podjetja Hugging Face, ki nudi repozitorije za modele umetne inteligence, podatkovne zbirke zanje in ostale povezave aplikacije. Po poročanju Reutersa je OpenAI šele teden dni pozneje ugotovil, kaj se dogaja. OpenAI in Hugging Face pa sta se o incidentu začela pogovarjati šele 20. julija, nato pa so incident javnosti razkrili 21. julija.

V Hugging Faceu pripravljajo podrobno časovnico dogodkov, ki jo bodo javno objavili. V OpenAI pa pravijo, da gre za prelomen trenutek, ki bo vplival na varnost. Podrobnosti incidenta še niso znane, poznamo pa grobe obrise. OpenAI je testiral najnovejši in najzmogljivejši model, da bi dognal njegove zmogljivosti, kar je terjalo tudi izklop nekaterih varovalk. Preverjali so njegove sposobnosti na področju kibernetske varnosti, cilj je bil rešiti več hekerskih nalog. Model je torej zasledoval jasno definiran cilj (preizkus ExploitGym z 900...

14 komentarjev

OpenAI izdal odprta modela

Slo-Tech - Po dolgem času, vse od že prazgodovinskega GPT-2, je OpenAI spet izdal velika jezikovna modela, ki imata javno dostopno drobovje. Modela gpt-oss-120B in gpt-oss-20B lahko prenesemo in poganjamo tudi na malce zmogljivejšem osebnem računalniku. Večji model zahteva grafično kartico z 80 GB pomnilnika, šibkejši pa 16 GB pomnilnika. To pa so že povsem dosegljive specifikacije.

Modela lahko poganjamo lokalno, lahko pa ju tudi prilagajamo in predelujemo. Izid so napovedali že minuli mesec, a je Sam Altman v zadnjem hipu zahteval dodatna varnostna preverjanja. To je pri odprtih modelih izjemno pomembno, saj jih po splavitvi ni možno ugasniti ali odpoklicati. Ko sta modela v svetu, bosta tam tudi ostala, dobila pa bosta še vse predelave, ki se jih bodo uporabniki lotili.

Modela sta izdana pod licenco Apache 2.0, torej ju je možno integrirati v Hugging Face, Ollamo, llamaa.cpp in vLLM.

19 komentarjev

Google lansiral odprt jezikovni model Gemma

vir: Google
Google - Pretekli teden so pri Googlu pokazali Gemmo, svoj prvi veliki jezikovni model z javnimi utežnimi parametri, ki je očitno namenjen predvsem spopadu z Metino družino odprtih modelov LLaMA.

Na področju velikih jezikovnih modelov poteka vrsta ideoloških bitk; poleg tiste med "doomerji", ki menijo, da lahko LLMji pripeljejo do nevarne splošne umetne inteligence, in njihovimi nasprotniki, pa spopada med podjetji in strokovnjaki za etiko, še najmanj tisti med pristaši zaprtih in odprtih modelov. Med prve spadajo trenutno najbolj razvpiti velikani, kot sta OpenAI in Google, ki v svoje programje ne dovolijo kdovekoliko vpogleda. Med drugimi so razvijalci LLMjev, ki o svojih stvaritvah objavijo več podatkov, v prvi vrsti strukturo nevronske mreže in pa "uteži" (weights), najpomembnejšo podmnožico parametrov nekega modela, ki določa, kaj se je mreža naučila iz podatkov. Malce ironično je tu glavni igralec Meta, po zaslugi svojega laboratorija FAIR, kjer razvoj vodi Yann LeCun, in modelov...

12 komentarjev

Stability AI izdal svoj veliki jezikovni model

Slo-Tech - Kakor je Stability mešal štrene OpenAI-ju s svojim modelom za ustvarjanje slik Stable Diffusion, mu bodo tudi pri jezikovnih modelih. Pripravili so odprtkodni jezikovni model StableLM, ki je pod licenco CC BY-SA-4.0 na voljo vsakomur. Koda je dostopna na GitHubu, preizkusimo pa jo lahko na Hugging Face ali Replicate. Verzija za pogovor je takisto že dostopna.

StableLM je naučen na treh in sedmih milijardah parametrov, kar je precej manj od ChatGPT-jevih 175 milijard. Sicer prihajata tudi verziji s 15 in 65 milijardami parametrov, a velikost modela ni vse. StableLM v svoji srži smiselno nadaljuje besedilo, ki ga začne človek z ukazom (prompt), rezultat pa so smiselni odgovori. StableLM se lahko pogovarja kot človek, lahko pa tudi piše kodo. Ta je po prvih preizkusih še malce bolj robata kakor pri ChatGPT, a večja modela bosta bržkone boljša. Še vedno pa je boljši od Facebookovega LLaMA, dasiravno GPT-3.5 ali GPT-4.0 še ne dosega. StableLM se je učil na odprtem korpusu podatkov, ki...

4 komentarji