Slo-Tech - Okoli OpenAI-jeve rešitve Navier-Stokesovih enačb se je vnela precej manj matematična polemika. V ospredju le-te ni toliko vprašanje pravilnosti OpenAI-jevega dolgega dokaza, temveč vprašanje, kdo je pravzaprav prvi prišel do rešitve, ter, ali niso OpenAI-jevi agenti poti do rešitve našli kar v preteklih pogovovorih svojih uporabnikov.
V središču zgodbe sta matematika Tristan Buckmaster z Univerze New York in Levent Alpöge - slednji je zaposlen pri OpenAI-jevemu konkurentu Anthropic, kar bo postalo pomembno - ki sta isti oz. nekoliko lažji problem (Eulerjeve enačbe) že nekaj časa reševala zasebno. Vzela sta izsledke dveh drugih španskih matematikov, Diega Córdobe in Luisa Martínez-Zoroa, ter potem z uporabo OpenAI Codexa ter Clauda iskala primere, kjer rešitve Eulerjevih enačb v končnem času postanejo singularne. Njuno delo je seveda potekalo precej počasneje, ker nista imela na voljo toliko računske moči kot OpenAI-jevi raziskovalci. A vseeno naj bi sredi avgusta uspela najti rešitev, ki sta jih potem 22. avgusta začela formalno preverjati.
Govorice o tem naj bi okoli 1. septembra prišle na uho raziskovalcem znotraj OpenAI, ki so se odločili, da še sami poskusijo s svojimi agenti. A za razliko od Buckmasterja in Alpoga so jim lahko namenili precej več računske moči, ter tako uspeli do dokaza priti v manj kot tednu dni. Zapregli so približno 10.000 agentov, ki so v 88 urah izmenjali 2,7 milijona sporočil in proizvedli približno 130 milijard izhodnih žetonov, za ceno več milijonov evrov. Petega septembra so dobili rezultat, še naslednjih 17 ur pa je GPT-6 Astra porabil za formalizacijo in preverjanje.
Ko sta Buckmaster in Alpöge slišala, da OpenAI rešuje isti problem in to obenem na isti način, nista bila najbolj navdušena. Buckmasterja je zmotilo predvsem to, da je OpenAI prišel do rešitve po isti, precej specifični poti z gladko zunanjo silo, ki sta jo že raziskovala. Sumil je, da so njune informacije še pred objavo prišle do OpenAI. Kako? Ker sta vse osnutke projekta obdelovala tudi s Codexom, je Buckmaster vprašal, ali bi lahko OpenAI-jev notranji model njihove seje videl neposredno ali prek učenja. O tem je povprašal OpenAI, a jasnega odgovora do sedaj ni dobil. Pravi, da sicer nima dokaza, da so bili njuni podatki dejansko uporabljeni, a da na to močno sumi.
Da je morda nekaj na tem, kaže dejstvo, da je bil OpenAI med pogovori z njim pripravljen priznati soavtorstvo. Vendar pa naj bi OpenAI to pogojeval s tem, da se izključi Alpöge-a, zaradi zaposlitve pri konkurenčnem Anthropicu.
Kar OpenAI seveda zanika. 10. septembra so po interni preiskavi svojo objavo dokaza dopolnili, tako da sedaj pravi, da je »kategorično nemogoče«, da bi Buckmasterjeve seje s Codexom iz zadnjih dveh mesecev kakorkoli vplivale na uporabljeni model, tudi ne prek učenja. Obenem priznavajo prednost Buckmasterja in Alpögeja pri njunem rezultatu za Eulerjeve enačbe, a poudarjajo, da je njihov Navier-Stokesov dokaz nastal neodvisno.
Spor tako za zdaj ne dokazuje kraje matematičnega rezultata, precej jasno pa kaže nov problem znanstvenega dela: raziskovalci v modele pošiljajo še neobjavljene ideje, ponudnik istega modela pa lahko na zanimiv problem nato usmeri računske vire, s katerimi se posameznik ne more niti približno kosati.
Novice » RIM BlackBerry » OpenAI: naši agenti rešili enega izmed največjih nerešenih problemov matematike (2)
sigmundfreud ::
Ima kdo izkušnje kako daleč smo z lokalno gnanimi modeli? Kišta za 5-10k€, potem pa gor nek DeepSeek ali Qwen? Kako se obnese?
karafeka ::
Stari, moj avto je vreden 1000EUR, ali pa še to ne, ker je dizl in ga sedaj nihče ne bi niti ukradel, če mu ne dam dnarja, ti pa o nekih 10.000EUR mašinah....
Sem pa prav tako radoveden, s kakšno konfiguracijo bi lahko recimo doma poganjal nekaj na nivoju zastonjskih chatgpt in claude.
Sem pa prav tako radoveden, s kakšno konfiguracijo bi lahko recimo doma poganjal nekaj na nivoju zastonjskih chatgpt in claude.
Zgodovina sprememb…
- spremenil: karafeka ()
user1618 ::
Včasih so razglasili problem da je rešen, ko so matematiki objavili dokaz o pravilnosti in sprejemljivosti rešitve.
"If we were supposed to talk more than listen
we would have been given two mouths and one ear"
- Mark Twain
we would have been given two mouths and one ear"
- Mark Twain
LiquidAI ::
Svečke za kosilnico ni našel pa sem podal vse podatke o prejšnjem modelu svečke ki se ne prodaja več. Na NGK pa takoj link na nov model svečke z enakimi specifikacijami. Vprašaš ga še "kaj je super bosna" pa se 
@mandi dej spremeni kategorijo članka na znanost
@mandi dej spremeni kategorijo članka na znanost
65001
Zgodovina sprememb…
- spremenilo: LiquidAI ()
LiquidAI ::
Ker je bilo OpenAI ustanovljeno leta 2015 kot neprofitna raziskovalna organizacija z idejo, da bi umetna inteligenca koristila vsemu človeštvu in da bi se raziskave ter koristi čim bolj delile. “Open” je torej prvotno pomenil odprtost, dostopnost in javno usmerjeno poslanstvo -- ne nujno, da bo vsaka koda in vsak model odprtokoden.
Agent, ki bi samostojno zasnoval, natreniral, preveril in varno objavil boljši splošni model od sebe, pa še ni zanesljivo dosežen.
Agent, ki bi samostojno zasnoval, natreniral, preveril in varno objavil boljši splošni model od sebe, pa še ni zanesljivo dosežen.
65001
Zgodovina sprememb…
- spremenilo: LiquidAI ()
DamijanD ::
sigmundfreud je izjavil:
Ima kdo izkušnje kako daleč smo z lokalno gnanimi modeli? Kišta za 5-10k€, potem pa gor nek DeepSeek ali Qwen? Kako se obnese?
dokaj popularna in p/p dobra rešitev je 4x mac (mini), ki jih med sabo povežeš. Se mi pa zdi, da so zdajle novi komercialni modeli kar konkretno stopili naprej, tako da si z lokalnim verjetno kar na slabšem...
WhiteAngel ::
sigmundfreud je izjavil:
Ima kdo izkušnje kako daleč smo z lokalno gnanimi modeli? Kišta za 5-10k€, potem pa gor nek DeepSeek ali Qwen? Kako se obnese?
qwen3.8 jaz dnevno uporabljam za kodirat z OpenCode. Dela zelo solidno. Brez kvantizacije rabi model vsaj 96 GB VRAMa, tako da je 5k eur kar optimistična spodnja meja. 5500 EUR stane najcenejši stack od Nvidie - DGX Spark s 128 GB VRAMa. RTX 6000, H ali B serija je od 10k+ EUR dalje.
Stari, moj avto je vreden 1000EUR, ali pa še to ne, ker je dizl in ga sedaj nihče ne bi niti ukradel, če mu ne dam dnarja, ti pa o nekih 10.000EUR mašinah....
Sem pa prav tako radoveden, s kakšno konfiguracijo bi lahko recimo doma poganjal nekaj na nivoju zastonjskih chatgpt in claude.
GLM 5.3 in DeepSeek 4 rabita brez kvantizacije nekaj čez 700 GB VRAMa. To je 8x H100 grafičnih (cca. 240k EUR) ali RTX 6000 (pol manj).
Zgodovina sprememb…
- spremenil: WhiteAngel ()
McMallar ::
AMD AI Halo z 128GB unified RAM naj bi bil nekje 4k+. Mogoče bi bila to alternativa.
Why can't a programmer tell the difference between Halloween and Christmas?
Because OCT31 = DEC25
Because OCT31 = DEC25
Furbo ::
Torej zdaj nek matematik (ali kaj drugega) dela na nečem, priteče skoraj do ciljne črte, potem pa ti tipi z neomejenimi AI resourci priletijo mimo njega v formuli?
Nekje v drobnem tisku med pogoji uporabe se pa ziher tudi najde kaka vrstica o tem, kako je to povsem legalno, da ukradejo tvoje delo in ideje.
Nekje v drobnem tisku med pogoji uporabe se pa ziher tudi najde kaka vrstica o tem, kako je to povsem legalno, da ukradejo tvoje delo in ideje.
i5-13600K, Noctua NH-D15, TUF Z790-F, 64GB DDR5, 2TB Samsung 990PRO,
Toughpower GF3 1000W, RTX 5080 AORUS, ALIENWARE AW3423DWF, Dell S2722QC
Toughpower GF3 1000W, RTX 5080 AORUS, ALIENWARE AW3423DWF, Dell S2722QC
WhiteAngel ::
Torej zdaj nek matematik (ali kaj drugega) dela na nečem, priteče skoraj do ciljne črte, potem pa ti tipi z neomejenimi AI resourci priletijo mimo njega v formuli?
Nekje v drobnem tisku med pogoji uporabe se pa ziher tudi najde kaka vrstica o tem, kako je to povsem legalno, da ukradejo tvoje delo in ideje.
To ni nič novega v bistvu. Imaš univerze z več resursi in lahko sestavijo veliko raziskovalno ekipo z dobro plačo, ali pa imaš ljubljansko univerzo, kjer imaš kup one man band laboratorijev, kjer raziskovalci delajo za jurja, dokler ne odidejo drugam.
Isto je tu, le da je zdaj AI v igri. Nekateri si ga lahko privoščijo več, drugi manj.
Furbo ::
Nekam obupani se zdijo tile AI guruji, da bi dokazali koristnost AI.
Še malo, pa bo ta 2.0 .com balonček počil.
Še malo, pa bo ta 2.0 .com balonček počil.
i5-13600K, Noctua NH-D15, TUF Z790-F, 64GB DDR5, 2TB Samsung 990PRO,
Toughpower GF3 1000W, RTX 5080 AORUS, ALIENWARE AW3423DWF, Dell S2722QC
Toughpower GF3 1000W, RTX 5080 AORUS, ALIENWARE AW3423DWF, Dell S2722QC
