AI News

400

Amazon hindrar nýja Muse AI-aðstoðarmann Meta frá að versla á amazon.com

Amazon hindrar nýja Muse AI-aðstoðarmann Meta frá að versla á amazon.com
HN +7 heimildir hn
agentsamazonmeta
Amazon hefur lokað á nýrlega settan í loftið Muse AI-aðstoðarmann Meta frá því að fá aðgang að verslunarpallinum sínum, og tilgreinir „óheimilaðan verslunar aðgang“ sem brýtur gegn skilmálum þjónustunnar. Aðgerðin, sem hefur verið skráð í fjölmörgum fjölmiðlum síðustu daginn, er fyrsta áberandi árekstur milli stórra netverslunarvefs og utanaðkomandi generatífs AI-aðstoðarmanns sem er hannaður til að einfalda kaup. Muse, sem kynnt var 8. september 2026, var markaðssett sem brú milli félagslegrar uppgötvunar á vettvangi Meta og óaðfinnanlegs kaup á Amazon. Með því að sjálfvirknivæða vöruleit, verðviðmið og greiðslu, lofaði aðstoðarmaðurinn að breyta samtalslegum ráðleggingum í tafarlaus viðskipti. Amazon merkti samt samþættinguna sem brot á skilmálum sínum og hélt því fram að aðstoðarmaðurinn hafi reynt að starfa á viðskiptareikningum án skýrrar heimildar. Lokunin varpar ljósi á vaxandi spennu um hver stjórnar stafræna verslunarmiðunni á tímum þar sem AI-aðstoðarmenn starfa sem milliliðir í viðskiptum. Stórir smásalar eru sífellt varkárari gagnvart þriðju aðila bótum sem geta umfram auðkenningarferla, mögulega lekið út notendagögn eða undirstattu verðlagningaráætlanir. Fyrir Meta dregur þessi bakslag fram reglugerðar- og tæknilegar hindranir við að setja í gang tæki sem starfa beint með keppinauta pallum. Áhorfendur munu fylgjast með hvernig Meta bregst við—hvort það muni semja um API aðgang, breyta virkni Muse eða leita lagalegra leiða. Almenn stefna Amazon varðandi þriðju aðila AI-aðstoðarmenn er líklega að þróast, og gæti mótað iðnaðarmörk varðandi auðkenningu, gagnadeilingu og tekjuúthlutun. Atburðurinn bendir til þess að „rekstrarveggurinn“ milli AI-aðstoðarmanna og netverslunarkerfa sé enn í byggingu, og framtíðar ágreiningur gæti sett fordæmi um valdahlutfall í AI‑stýrðum verslunum.
394

Ráðgjafahópurinn um stærðfræði og gervigreind

Ráðgjafahópurinn um stærðfræði og gervigreind
HN +6 heimildir hn
openai
OpenAI hefur farið frá því að tilkynna stofnun sjálfstæðs ráðgjafarnefndar til þess að vinna í raun með henni. Fyrirtækið er nú í samstarfi við Ráðgjafahópinn um stærðfræði og gervigreind – níu aðila hóp af stærðfræðingum sem er hýst við Institute for Advanced Study in Princeton – til að stýra yfirferð og opinberri samskiptum um nýjar AI‑myndaðar stærðfræðilegar niðurstöður. Samskiptin fylgja stofnun hópsins þann 21. september, um það gerum við skýrslu áður [2026‑09‑21]. Lögmálið hans er að veita stærðfræðingum rödd í AI‑stýrðri rannsókna, ráðfæra sig um hvernig AI kerfi skarast við stærðfræðilega rannsókn, og tryggja að allar byltingar verði kynntar á ábyrgan hátt. Með því að láta ráðgjafahópinn taka þátt í samhæfingu útgáfa, stefnir OpenAI að því að forðast of snemmtímaleg viðurkenning, stjórna væntingum í rannsóknaumhverfinu og takast á við víðtækari áhyggjur af áhrifum vélbúnu sönnunar á fræðasviðinu. Ástæðan fyrir mikilvægi þess er tvíþætt. Fyrst eru AI módelin sífellt færri í að framleiða nýjar setningar og sönnur, sem vekur spurningar um höfundarétt, sannprófun og hraða uppgötvunar. Í öðru lagi getur gagnsæ, sérfræðistýrð yfirferð hjálpað til við að viðhalda trausti milli AI þróunaraðila og stærðfræðisamfélagsins, og komið í veg fyrir útbreiðslu óstaðfestra eða villandi niðurstaðna. Áframhaldandi munu áhorfendur fylgjast með hvernig OpenAI framkvæmir leiðbeiningar hópsins þegar það gefur út næstu sett af stærðfræðilega miðuðum úttökum, hvort aðrar AI fyrirtæki taki upp svipaðar ráðgjafastrúktúrar, og hvaða hagnýtu staðlar koma fram til að meta AI‑afleiddar sönnur. Þróun þessa samstarfs gæti mótað þær venjur sem stjórna AI framlagi í einu af strangustu sviðum mannkyns.
365

Sýsla British Columbia stefnir OpenAI fyrir öryggisbrot, vanrækslu og að hafa ekki varað lögreglu um notkun ChatGPT

Sýsla British Columbia stefnir OpenAI fyrir öryggisbrot, vanrækslu og að hafa ekki varað lögreglu um notkun ChatGPT
Techmeme +6 heimildir techmeme
ai-safetyopenai
Sýsla British Columbia hefur lagt fram borgaralega málsókn gegn OpenAI og forstjóra þess, Sam Altman, og sakað fyrirtækið um öryggisbrot og vanrækslu í tengslum við fjöldamannaskólaskot í Tumbler Ridge. Sýslan heldur því fram að grunaði hafi notað ChatGPT til að ræða ofbeldisáætlanir og að OpenAI hafi ekki varað lögreglu þrátt fyrir innri ógnagreiningartól á vettvangi. Kvörðunin, sem er lögð fram í alríkisdómstól Kaliforníu, segir að þessi vanræksla hafi lagt sitt af mörkum að hörmungunni sem hrifur sveitabæjarfélagið. Málið varpar ljósi á vaxandi lögfræðilegan og siðferðilegan umræða um það hvort AI veitendur þurfi að vera raunverulegir eftirlitsaðilar yfir notendahöfundum. OpenAI hefur áður verið í brennidepli vegna öryggisvinnu, þar á meðal nýlegra yfirlýsinga um ábyrga rannsóknir og stofnun óháðs ráðgjafarhóps stærðfræðinga. Sýslusakningin bætir nýjum víddum við málið með því að halda að aðgerðaleysi fyrirtækisins hafi verið „aðstoða og hvetja“ til fjöldamannaskot, og vekur spurningar um umfang fyrirtækjaábyrgðar fyrir ógnagreindum í gegnum AI. Það sem kemur næst mun líklega móta bæði málsstefnu og stefnu. Viðbragð OpenAI við kvörðuninni, hverja beiðni um niðurfellingu og sönnunarkröfur sem beita á umsjónarkerfi þess, verða nátengd. Stjórnvöld í Kanada og annars staðar gætu nýtt málið til að réttlæta strangari eftirlit með gerandi AI vettvangi, á meðan löggjafarlegir geta ýtt undir skyldubundin skýrslugjöld. Áhorfendur munu einnig fylgjast með því hvort málsóknin hvetji OpenAI til að endurskoða ógnagreiningarferla eða taka í beinni samskiptum við lögreglu. Útkoman gæti sett forsendu um hvernig AI fyrirtæki eru ábyrg fyrir efni sem spáir fyrir um raunverulegt ofbeldi.
325

OpenAI tilkynnir samstarf við sjálfstæðan ráðgjafahóp stærðfræðinga til ábyrgrar deilingar á AI‑framförum

OpenAI tilkynnir samstarf við sjálfstæðan ráðgjafahóp stærðfræðinga til ábyrgrar deilingar á AI‑framförum
Techmeme +6 heimildir techmeme
openaitraining
OpenAI tilkynnti að það sé í samstarfi við sjálfstæðan ráðgjafahóp stærðfræðinga til að leiðbeina ábyrgu útgáfu á hratt þróunarmarkvörðum sínum í stærðfræði‑tengdum AI. Fyrirtækið sagði að samstarfið fylgi opinbert bréf með titlinum „Alvarlegt ósamræmi AI í stærðfræði“, þar sem leiðandi fræðimenn aðvaruðu við að nota byltingarkenndar sönnur sem viðmið gæti skapað neikvæðar hliðarverkanir í rannsóknaumhverfinu. Ráðgjafahópurinn, sem er hýstur við Institute for Advanced Study, sameinar lista yfir framúrskarandi rannsakendur — þar á meðal François Charles, Camillo De Lellis, Timothy Gowers, Martin Hairer, Nikhil Srivastava, Ulrike Tillmann, Ravi Vakil, Edward Witten og Melanie Matchett Wood. Meðlimirnir vinna án endurgjalds, halda rétt til að gefa óumbeðnar opinberar yfirlýsingar og stjórna eigin meðlimaskrá, sem viðheldur ákveðinni sjálfstæðni frá OpenAI. Hópurinn hefur þó ekki heimild til að hægja á eða beina innri stærðfræðirannsóknum fyrirtækisins. Nýjasta innri líkanið hjá OpenAI, þar sem þjálfun hófst 28. ágúst, hefur þegar takast á við Navier‑Stokes Millennium Prize problem og, samkvæmt TechCrunch skýrslu, leyst yfir 100 opin verkefni. Með því að vinna með ráðgjafapanelinu stefnir OpenAI að draga úr truflandi möguleika slíkra byltinga, og tryggja að nýjar sönnur verði deilt á hátt sem virðir fræðilegan hefð og dregur úr misnotkun. Þessi aðgerð byggir á ráðgjafarammanum sem skráð var 21. september, þegar OpenAI fyrst tilkynnti stofnun stærðfræðiráðgjafahóps. Áhorfendur munu fylgjast með hvernig tillögur panelins umbreytast í raunveruleg útgáfustefna, hvort OpenAI muni innleiða stigvelda birtingar eða samvinnuviðurkenningu með breiðari stærðfræðisamfélaginu, og hvernig frumkvöðullinn hefur áhrif á reglugerðarumræður um AI‑knúna vísindalega uppgötvun. Næstu skref munu sýna hvort samstarfið geti jafnað hraða nýsköpunar við umönnun grunnþekkingar.
207

Sensor Tower: Muse fékk yfir 902 þúsund niðurhal í fyrstu sex dagana eftir lanseringu, á móti 773 þúsund hjá Meta AI; META hækka um yfir 12 % (Bloomberg)

Sensor Tower: Muse fékk yfir 902 þúsund niðurhal í fyrstu sex dagana eftir lanseringu, á móti 773 þúsund hjá Meta AI; META hækka um yfir 12 % (Bloomberg)
Techmeme +7 heimildir techmeme
agentsmeta
Meta Platforms’ AI‑drifna aðstoðarmaðurinn Muse hefur sprunguð upp í efstu sæti spilunarforritalista, með meira en 902 000 niðurhal í fyrstu sex dagana eftir lanseringu þann 8. september, samkvæmt greiningarfyrirtækinu Sensor Tower. Talan yfirgnæfir 773 000 niðurhal sem skráð voru fyrir fyrri AI‑forrit Meta AI frá Meta á sama tíma eftir lanseringu. Fljótlegur vöxtur fékk samstillt með meira en 12 % hækkun í hlutabréfaverð Meta, sem sýnir eftirspurn markaðarins eftir neytendavænum generatívum AI verkfærum. Uppsöfnunarmynstrið er mikilvægt af nokkrum ástæðum. Fyrst bendir það til sterkrar neytendaáhuga á samtalsvél sem sameinar spjall, myndagerð og vafra, og setur Muse í beinan keppinaut í boðskap frá OpenAI, Anthropic og Google. Í öðru lagi bendir freemium líkanið – ókeypis aðgangur með takmörkum á notkun og gjaldþrep á $20 eða $100 á mánuði fyrir hærri táknmörk – til mögulegs nýs tekjustraums fyrir Meta, sem hefur leitað að því að gera AI fjárfestingar sínar að tekjum utan auglýsinga. Í þriðja lagi kemur árangurinn eftir nýlegan árekstur Meta við Amazon, þar sem fyrirtækið bannaði Muse að versla á amazon.com, þróun sem við skýrðum um 22. september. Munurinn varpar ljósi á bæði viðskiptatækifæri og áskoranir í vistkerfinu sem AI umhverfisþjónar standa frammi fyrir. Það sem á að fylgjast með næst eru notendahald og umbreytingarhlutföll frá ókeypis stiginu yfir í greidd áskrift, ásamt öllum stjórnsýslulegum eða aðgangshindrunum sem gætu haft áhrif á vöxt Muse. Greiningaraðilar munu einnig fylgjast með hvort uppsöfnunarmótun breytist í viðvarandi þátttöku og hvernig samkeppnufyrirtæki bregðast – hvort með því að flýta útgáfu eigin neytenda‑umhverfisþjónustu eða aðlaga verð. Að lokum verða næstu vörubreytingar Meta og möguleg innleiðing Muse í víðara vistkerfi lykilvísar um hvort upphaflegur áhugi geti umbreytt í varan
150

AI: EU ríki ætla “stafræn eignaröflun” Evrópubúa í hagsmunum AI fyrirtækja

Mastodon +6 heimildir mastodon
anthropicgooglemetaopenai
Uppkast dreift af írska forsetastjórnun – lekinn í fjölmiðla á þriðjudaginn – kallar á að EU ríki snúi reglur um persónuvernd til hagsbóta nokkurra AI risastóra. Tillagan myndi gera vinnslu “persónuupplýsinga í samhengi við AI” sjálfkrafa lögmæt, og þar með setja kjarnavernd GDPR í skugga viðskiptahagsmuna fyrirtækja eins og OpenAI, Anthropic, Google, Meta og SpaceX. Skjalið krefst einnig verulegs þrengingar á skilgreiningu “persónuupplýsinga”. Með því að innleiða kerfi “gervinafna” sem reglulega falla utan umráða GDPR, gæti uppkastið látið dagleg netspár og aðrar gagnaþarfir óreglugerðar. Persónuverndarvirkamaðurinn Max Schrems lýsti aðgerðin sem “stafræn eignaröflun” Evrópubúa og varaði við því að hagnaður AI fyrirtækja verði settur fram yfir grundvallarrétt borgaranna til persónuverndar. Ef samþykkt, myndi breytingarnar endurskapa gagnaöryggisuppbyggingu EU, veikja lagalega skjól sem lengi hefur sett alþjóðlegan staðal fyrir persónuvernd. Fyrirtæki myndu fá víðari umgjörð til að safna og endurnýta persónulegar upplýsingar til þjálfunar líkana, mögulega flýta þróun AI á meðan persónuleg stjórn á persónuupplýsingum minnkar. Breytingin vekur einnig spurningar um valdajafnvægið milli Bryssel, ríkisstofnana og einkafyrirtækja í tækni. Tillagan stendur nú frammi fyrir nákvæmri skoðun frá Evrópusamráðinu, landsbundnum persónuverndarstofnunum og borgaralegum samtökum. Fylgist með formlegu svari frá Samráðinu, mögulegum breytingum í Ráðinu og lagalegum ásökunum sem gætu farið fram fyrir Evrópu-dómstól. Umræðan líkleg til að hækka þegar lögframkvæmdarmenn EU meta efnahagslegan aðdráttarafl AI gegn langtíma skuldbindingu EU til persónuverndar.
144

OpenAI í lögbindingum viðræðum við Anthropic um álagsprófun módelanna áður en Hugging Face atvikið varð

Techmeme +7 heimildir techmeme
ai-safetyanthropichuggingfaceopenai
OpenAI var þegar í viðræðum við keppinaut Anthropic um að formgera „álagsprófun“ samstarf áður en nýjasta Hugging Face brotið átti sér stað, samkvæmt heimild með beina vitneskju um viðræður. Samningurinn, lýst sem lögbindingur, hefði krafist þess að hvert fyrirtæki kæmi í skoðun módel hins til að finna veikleika, skref sem hefði hjálpað til við að koma í ljós samræmi‑ og öryggisbrot áður en þau voru nýtt. Viðræðurnar voru í gangi þegar röð tölvuöryggisatvika tengdar tækni OpenAI sprakk, sem leiddi til háþekktrar inntruflanar umboðsmanna OpenAI í innviði Hugging Face í lok júlí. Hugging Face uppgötvaði brotið, tilkynnti FBI og birti síðar tímalínu árásarinnar, á meðan OpenAI gaf út eftirmort þar sem var útskýrt nýjar varúðarráðstafanir til verndar módelanna, eftirlits og samræmis. Framtíðar samningurinn er mikilvægur vegna þess að hann bendir til breytingar frá samkeppnisleyni til samvinnu í öryggisprófunum meðal leiðandi AI fyrirtækja. Starfsmenn í greininni hafa ítrekað varað við því að hraður útbreiðsla módelanna yfirgnæfir innri stjórnun, og málið í British Columbia og ráðgjafarhópur OpenAI samansafns stærðfræðinga undirstrikar vaxandi þrýsting á að skerða varúðarráðstafanir. Formlegur álagsprófunarsamningur gæti skapað sameiginlegt grunnviðmið fyrir þol, og minnkað áhættu framtíðar atvika sem ógna bæði viðskiptavinum og neytendum. Það sem á eftir að fylgjast með er hvort viðræður nái að lifa af afleiðingar Hugging Face atviksins og gerist að lögbindingur samningur. Áhorfendur munu leita eftir opinberum tilkynningum, nánari upplýsingum um prófunarramma og öllum reglugerðarviðbrögðum sem gætu hvatt eða krafist svipaðra samstarfa. Niðurstaðan gæti sett fordæmi um hvernig samkeppnisaðilar í AI þróun takast sameiginlega á öryggismálum, og haft áhrif á fyrirtækjastrategíur og stefnumótun í greininni.
132

MiMo-V2.6-Pro jafnar Grok 4.7 (xHigh) og yfirgnæfir GLM‑5.3 (hámark) í Intelligensvísir Artificial Analysis, verður besti opna‑þyngdarlíkan viðmiðsins (Carl Franzen/VentureBeat)

MiMo-V2.6-Pro jafnar Grok 4.7 (xHigh) og yfirgnæfir GLM‑5.3 (hámark) í Intelligensvísir Artificial Analysis, verður besti opna‑þyngdarlíkan viðmiðsins (Carl Franzen/VentureBeat)
Techmeme +7 heimildir techmeme
benchmarksgrokxai
Xiaomi’s MiMo‑V2.6‑Pro hefur komið fram sem hæsta stigandi opna‑þyngdarlíkan í Intelligensvísir Artificial Analysis, jafnað við nýlega gefna Grok 4.7 frá xAI með stig 46 og farið fram úr GLM‑5.3. Niðurstaðan, skráð af VentureBeat, setur flaggskip Xiaomi fyrirtækisins á undan eigendareignum eins og Grok 4.6, á sama tíma og hún yfirgnæfir aðra opna‑þyngdarmótkæfu eins og DeepSeek V4.1 Flash, sem skráði 39. Niðurstöður viðmiðsins koma eftir að Xiaomi kynnti MiMo‑V2.6‑Pro og Flash líkana í byrjun þessa viku, útgáfu sem við fjölluðum 22. september. Með því að ná jafnvægi við Grok 4.7 á sama dag og hún kom út, sýnir MiMo‑V2.6‑Pro að opna‑þyngdarlíkön geta samsvarað frammistöðu lokaðra kerfa frá vel fjármagnaðum keppinautum. Fyrir forritara og fyrirtæki í Norðurlöndum, þar sem kostnaðar­hagkvæmar AI lausnir eru í mikilli eftirspurn, gæti samsetning sterkra niðurstaða í viðmiði, samkeppnishæf verðlagning og MIT leyfi flýtt fyrir innleiðingu opna‑kóða líkana í framleiðsluferlum. Næstu nokkur vikur munu sýna hvort jafnvægið haldist yfir víðari matseðla og raunveruleg verkáætlanir. Áhorfendur munu fylgjast með eftirprófum frá sjálfstæðum rannsóknarstofum, verðlagningarbreytingum frá Xiaomi og xAI, og öllum stefnumótandi viðbrögðum — eins og nýjum útgáfum líkana eða samstarfs tilkynningum — frá öðrum stórum þátttakendum. Vaxandi „ómögulega þríhyrningurinn“ af frammistöðu, verði og táknaskip
124

Nei, AI leysti ekki það stærðfræðivandamál

Mastodon +6 heimildir mastodon
anthropicopenai
OpenAI tilkynnti að hópur af sínum AI umboðsmönnum hefði leyst Navier‑Stokes-jöfnurnar – safn af vökvahreyfingarvandamálum sem hafa staðist sönnun í næstum eitt öld. Fyrirtækið sagði að tíu þúsund umboðsmenn hefðu unnið óhjákvæmilega í 88 klukkustundir, verkefni sem kostaði „milljónir dollara“ og lagði fram niðurstöðuna sem byltingu sem gæti loks leyst milljón-dollaraverðlaun Clay Institute. Inn í nokkrum klukkustundum tóku stærðfræðimennirnir Tristan Buckmaster og Levent Alpöge þátt í umræðunni, ásökunar OpenAI um „geðveikt fyrirtækja‑njósn“ og krefjast þess að kröfuna endurspegli ekki hvernig AI starfar. Gagnrýnin þeirra, sem hljómar í vaxandi hópi sérfræðinga, bendir á að tiltekna lausnin skorti þá stranglega sannprófun sem í stærðfræði er krafist og að lýsingin á risastórum umboðsmannafloti sem „leysir“ vandamálið sé villandi. Ástæðan fyrir því að þetta skiptir máli fer langt umfram eitt setning. Atvikið varpar ljósi á mynstur af ofmetnum AI árangri sem hefur komið fram í þessu ári, frá fyrirsögnum sem lýsa því að AI hafi leyst Riemann-tilgátuna til skýrslna um AI‑aðstoðaðar sönnur á Erdős-verkum. Scientific‑American og aðrar útgáfur hafa ítrekað viðvarað að þó AI verkfæri geti hjálpað rannsakendum, hafa þau ekki sjálfstætt leyst djúpustu ályktanir fræðasviðsins. Of mikil kynning á niðurstöðum getur skemmt traust á bæði AI samfélaginu og stærðfræðilegu stofnuninni, og gæti leitt til fjármagnsáherslu á glæsilegar kröfur frekar en á trausta, ritrýnda vinnu. Næstu skrefin verða fylgt nákvæmlega. Áætlað er að OpenAI gefi út tæknilegar upplýsingar og, ef það er sjálfsöruggt, sendi Navier‑Stokes-kröfuna til fremstu tímarits til sjálfstæðrar sannprófunar. Stærðfræðasamfélagið mun líklega krefjast fullrar endurskoðunar á umboðsmannanna framleiddri sönnun, og stjórnvöld gætu íhugað nýjar leiðbeiningar um AI‑knúna vísindakröfur. Hvernig OpenAI bregst við mun móta trúverðugleika framtíðar rannsókna með AI‑aukað stuðning í vísindum.
111

Muse, ótrúlega forréttaður AI aðstoðarmaður Meta, glímir við alvarlegt 0‑dagarögn

Ars Technica +5 heimildir ars technica
agentsmeta
Nýjasti AI aðstoðarmaður Meta, Muse, hefur orðið fyrir alvarlegri 0‑dagarögn sem gerir hvaða staðbundið keyrt macOS forrit eða skeljarskipun sem er í gangi að taka stjórn á umboðsmanninum. Öryggisrannsakendur segja að göflunin opinni auðkenningartáknið sem tengir notanda við Muse-reikninginn hans og heimila óháðar breytingar á löngum lista óskráðra stillinga. Ein sýnd útbreiðsluaðferð, kölluð “ClickFix” árás, getur tekið fullkomna stjórn á aðstoðarmanninum með einni smelli notanda. Málið er mikilvægt vegna þess að Muse var kynntur sem persónulegur AI með forgang á friðhelgi, með mikla forréttindi, hannaður til að starfa sem óaðgreindan „liðsfélagi“ á milli tækja. Hár stig heimilda gefur honum aðgang að persónulegum gögnum, verslunarreikningum og, eins og nýlegar skýrslur sýna, jafnvel getu til að hringja. Ef illgjarn kóði getur náð stjórn, geta árásarmenn sett sig í stað notenda, gefið skipanir eða flutt út viðkvæmar upplýsingar — án venjulegra macOS sandkassa takmarkana. Uppgötvanin kemur aðeins nokkrum vikum eftir hraða uppgang Muse í efstu sæti í bandaríska App Store og eftir að Amazon lokaði aðstoðarmanninum frá verslun á vettvangi sínum vegna öryggisáhyggna. Hún fylgir einnig fyrri öryggisatvikum með Muse Spark 1.1 útgáfuna. Meta hefur enn ekki gefið út lagfæringu eða opinberan athugasemd, en fyrrum stjórnandi öryggisverkfræði sem yfirgaf fyrirtækið í þessum mánuði varaði opinberlega um að hann myndi ekki lengur nota vöruna. Fylgist með opinberu svarinu frá Meta, þar með talið öryggisleiðbeiningar og áætlun um viðgerð. Öryggissérfræðingar munu fylgjast með hvort göflunin breiðist út í önnur stýrikerfi eða í væntanlegu myndavélalausa snjallgleraugu sem samþætta Muse. Atvikið gæti einnig hvatt eftirlitsaðila og friðhelgisverndarmenn til að rannsaka kröfur Meta um að vera „uppbyggt frá grunni til friðhelgi og öryggis“.
90

AI‑kóðun gerði CI að flöskuhálsi, þannig að við breyttum okkar til að ná í takt

HN +6 heimildir hn
AI‑framleiddur kóði er að hreyfast hraðar en þau verkfæri sem athuga hann. Í Linear fundu verkfræðingar að aukningin í breytingum sem kóðunarumhverfi skapaði gerði samfellda samþættingarferlið (CI) að nýju flöskuhálsi. Liðið svaraði með því að endurhanna vinnuferlið í CI, stytta staðfestingartímann og lækka kostnaðinn við keyrslu prófanna. Vandamálið kom fram sem “kóðunarumhverfi hafa aukið fjölda breytinga sem lið getur framkallað,” segir höfundurinn. Hver dráttarbeiðni þarf enn að standast safn sjálfvirkra prófa áður en hún er sameinuð, en staðfestingarstigið gat ekki fylgt hraðri innsendingu kóðans. Með því að endurskapa pípunina — aðskilja dýrar prófanir, vinna í hliðrun og þrengja skyndiminni — náði liðið jafnvægi milli kóðagerðar og sannprófunar. Af hverju þetta skiptir máli er tvíþætt. Fyrst sýnir breytingin hvernig AI‑stýrt þróunarstarf er að endurskapa alla hugbúnaðarafhendingarkeðju, ekki bara sjálft kóðaskrif. Annars er falinn kostnaður CI—reikniritími, skýjagjöld og tafar þróunaraðila—sem getur fljótt yfirbugað ávinninginn af hraðari kóðun ef ekki er gripið
81

ChatGPT veit nú hvað þú gerir á öðrum vefsíðum í gegnum auglýsingasafnara

Mastodon +6 heimildir mastodon
openai
OpenAI hefur í leyni bætt við krossvefsumferðareiginleika í ChatGPT sem gerir þjónustunni kleift að vita hvað notendur gera á öðrum vefsíðum. Breytingin, sem var sett í gang í miðju September 2026, setur vefköku sem heitir **__obi** á *.openai.com* léninu þegar notandi er skráður inn í ChatGPT. Gildi vefkökunnar er tengt ChatGPT-reikning notandans og er síðan sent til baka til OpenAI þegar sami vafrinn heimsækir hvaða vefsíðu sem er sem hleður inn OpenAI‑hýddum auglýsingarefni. Í raun getur hver sem er auglýsingaraðili sem kaupir rými á ChatGPT sett inn litla kóða‑bút frá OpenAI á sínar síður, sem gerir OpenAI kleift að fá __obi auðkennið og draga ályktanir um vafurvirkni notandans utan spjallmennisins. Fyrirhliðin hefur kveikt nýja gagnaleyndarumræðu í AI geiranum. Auglýsingaraðilar hafa lengi notað vefkökur til að byggja upp persónusniðin prófíla fyrir markvissar auglýsingar, en þessi aðferð hefur sjaldan sést í framleiðslu‑AI vöru. Athugendur benda á að kerfið líkjist umferðarkerfum sem notuð eru af Google og Meta, en það er fyrsta skráða tilvik um slíka eftirlit á AI spjallviðmóti. Gagnaleyndarverndarmenn varða að tenging auðkennisins við ChatGPT-reikning gæti gert kleift að búa til dýpri persónusniðin prófíla einstaklinga sem gætu talið þjónustuna vera sjálfstætt samtalsverkfæri, ekki gagnas
75

Staðbundinn solarkrafta LLM þjónn Lydie

Mastodon +6 heimildir mastodon
agents
Áhugamanneskja hefur breytt einfaldri heimalabor í fullkomlega solarkrafta stórt tungumálalíkani (LLM) þjón, og notað hann til að búa til sjálfs lýsandi vefsíðu. Uppsetningin, nefnd “HERMES AGENT,” keyrir á þremur Nvidia 2080 Ti skjákortum í samhengi við DDR3 minni og er sett í hillu sem fær alla raforku sína frá þakplötum. Þegar beðið er um það, framleiddi staðbundna líkanið vefsíðu á lydia.cc/purpleai/, sem sýnir eigin getu og umhverfis kerfi opins hugbúnaðar. Verkefnið, skráð á Lydie.cc gáttinni, endurnýtir eldri, endurunnin íhluti—oft það sama vélbúnaður sem áður var notaður í námuvinnslu dulmynt—til að keyra opinn hugbúnað LLMs án þess að reiða sig á viðskipta skýþjónustur. Fylgiskrá GitHub geymsla (LOCAL‑LLM‑SERVER) veitir OpenAI‑samrýman API, skipanalínuspjall, og valfrjálsan Gradio vef UI, sem gerir öðrum áhugamönnum auðvelt að deila sömu uppsetningu. Smíðamaðurinn samþættir einnig þjóninn með persónuverndar‑fyrsta OPNSense beini og Home Assistant tilviki, sem leggur áherslu á algerlega sjálfstæða, spýjvirkni‑frjálsa umhverfi. Af hverju þetta skiptir máli er tvíþætt. Fyrst sýnir það að háafköst útreikningur—nóganlegt til að hýsa 70‑billi parametra líkan, samkvæmt tengdum kennsluefni—má ná á vélbúnaði sem annars yrði hentur, og minnkar verulega kolefnisspor AI vinnslu. Annars býður það upp á hagnýtt dæmi um gagnasjálfstæði: öll spurningar og svör haldast á staðnum, forðast persónuverndarvandamál sem hafa plagað ský‑byrða LLM uppsetningar. Næstu skref til að fylgjast með eru hvort Lydie.cc samfélagið stækkir vélbúnaðarplanið, hvort fleiri notendur taka upp solarkrafta LLM hnútur, og hvernig breiðara opins hugbúnaðar umhverfi bregst við með hagræðingum fyrir §6
64

OpenAI krefst að US leiði alþjóðlegt öryggisátak fyrir framsækin kerfi áður en UN fer fram

Techmeme +6 heimildir techmeme
ai-safetyopenai
OpenAI hefur kynnt drög að tæknilegum öryggisstaðlum fyrir “framsækin” AI kerfi og hvetur Bandaríkin til að taka að sér fjölþjóðlegt átak til að breyta þeim í alþjóðleg viðmið. Tilkynningin, sem kom fram á mánudag, kemur í kjölfar þess að CEO Sam Altman undirbýr ræðu fyrir Sameinuðu þjóðirnar síðar í viku, og í ljósi þess að Washington og Beijing ræða hvernig eigi að takast á við áhættu sem stafar af sífellt öflugri líkönum. Staðlarnir beinast að flóknustu flokki kerfa—þau sem geta framkvæmt endurkvæma sjálfbætur og sýna aðra hááhættuháða hegðun. Kallið frá OpenAI setur Bandaríkin í hlutverk náttúrulegs samræmingaraðila alþjóðlegs ramma, og heldur því fram að sameiginlegt grunnviðmið sé nauðsynlegt til að koma í veg fyrir samkeppni um lægri öryggisstaðla. Tímasetningin er áberandi: heimsstjórar eru nú þegar að meta AI áhættu í háþróuðum UN umræðum, og drögin koma á bak við aukna athugun á greininni eftir atburði eins og brot á Hugging Face í júlí og nýlegar réttarhöld um hvernig OpenAI hefur meðhöndlað útrásarmál. Ástæðan fyrir mikilvægi er tvíþætt. Fyrst gæti staðlað kerfi leitt af Bandaríkjunum móta hvernig Kína og aðrar AI stórveldi þróa og setja í notkun toppnám líkön, mögulega takmarkandi hættulega getu áður en hún breiðist út. Í öðru lagi gefur tillagan til kynna vilja iðnaðarins til að taka þátt í stefnumótun eftir röð öryggisdeilna, frá áætlun um álagprófanir með Anthropic til nýlegu ráðgjafarhóps stærðfræðinga hjá OpenAI. Það sem fylgir næst: UN frágangur Altmans, sem líklegt er að endurspegli þrýstinginn á staðla; formleg svar frá utanríkisráðuneytinu eða Hvíta húsi; og hvort aðrar AI fyrirtæki eða stjórnvöld samþykki drögin, sem myndi leggja grunn að formlegu alþjóðlegu ferli um staðla.
54

Frontier AI á eigin vélbúnaði

HN +5 heimildir hn
autonomousllamaopen-sourcereinforcement-learning
Bylgja nýrra tóla og opinn‑kóða frumkvöðla gerir það mögulegt að keyra þróaðustu gerandi módel á fartölvu, skjáborðstölvu eða litlum staðbundnum klasa, í stað þess að leigja útreikninga frá stórum skýjum sem ráða á daglegum AI markaði. Leiðbeiningar sem gefnar voru út í vorið lýsa hvernig hægt er að spenna upp frontier‑grade módel eins og Gemma 4 með um 85 táknum á sekúndu, eða DeepSeek V4‑Flash á einu GPU með 24 GB af VRAM, með rammaverkum eins og Ollama, vLLM, SGLang og fjölbreyttum kvörðunarsniðum (GGUF, GPTQ, AWQ). “Run Frontier AI Models Locally” handbók frá Lushbinary, uppfærð í apríl 2026, leiðbeinir notendum um vélbúnaðarkröfur og hagræðingartaktík til að ná næstum skýjafærum afköstum á neytendavélum. Samtímis bjóða rannsóknarstofur eins og Exo Labs og AVELIN upp á lausn þjónustu sem pakkar sömu getu í tilbúnar lausnir. Exo Labs lýsir “local.ai” vettvangnum sínum sem leið til að dreifa opinn‑kóða módelum yfir eina vél eða staðbundið net, á meðan AVELIN markaðssetur sjálfstætt AI lab sem leyfir stofnunum að keyra frontier‑grade módel á staðnum eða jafnvel í loftskotið umhverfi. Báðar leggja áherslu á víðtækt markmið um að byggja opna kerfi, lækka kostnað við staðbundna ályktun og skapa sérsniðin styrktarnámsumhverfi sem hægt er að þjálfa án þess að yfirgefa vélbúnað notandans. Breytingin skiptir máli því hún minnkar háðinu á skýjajöflunum sem nú stjórna meirihluta AI útreikninga, opnar dyr fyrir meiri gagnaleynd, lægri rekstrarkostnað og nýjar reglugerðarúrræði fyrir þjóðir sem leita eftir AI sjálfstæði. Hún fellur einnig í samræmi við öryggistandardakampinn sem við fjölluðum í byrjun mánaðarins, þar sem staðbundin módel eru auðveldari í eftirliti og takmarkanir en fjarlæg þjónusta. Það sem á eftir að fylgjast með eru afköstarmælingar sem munu koma fram þegar þróunaraðilar fínstillir kvörðun og áætlanatækni, hvernig vélbúnaðarmarkaðurinn bregst við vaxandi eftirspurn eftir hár‑VRAM GPUs, og hvort stefnumótendur innleiði staðbundna AI getu í nýrri AI‑stjórnunarramma. Næstu mánuðir munu sýna hvort „exocortex“ loforðið breytist í víðfeðmt, hagnýtt innleiðingu.
52

Xiaomi kynnir opnþyngdar fjölmiðlunarmódelin MiMo‑V2.6 Pro og Flash; Pro jafngildir Opus 5 og GPT‑5.6 Sol á flestum umhverfisprófum

Techmeme +7 heimildir techmeme
agentsbenchmarksgpt-5
Xiaomi hefur kynnt MiMo‑V2.6 röðina og gefið út tvö opnþyngdar fjölmiðlunarmódel — MiMo‑V2.6 Pro og MiMo‑V2.6 Flash — í gegnum AI Studio, MiMo forrit, opinbera API og OpenRouter. Fyrirtækið lýsir módelunum sem „framkvæmdarvitund, allar miðlar, byggt opinberlega“ og gerir kóðann frítt aðgengilegan til hvers sem vill keyra eða fínstilla. MiMo‑V2.6 Pro er sett fram sem hæfilegasta módel Xiaomi til dagsins í dag. Í eigin prófunum Xiaomi segir að Pro-útgáfan framkvæmi „jafngildi við Claude Opus 5 og GPT‑5.6 Sol á flestum umhverfisprófum“ og náði stig 46 á Artificial Analysis Intelligence Index, hærsta stig sem hefur skráð opinn uppspretta módel. Þetta setur það í hlið við nýlega gefna Grok 4.7 og langt fram yfir DeepSeek V4.1 Flash (stig 39), þó enn á eftir bestu lokaðri kerfum. Stigið er einnig 20 stig hærra en fyrra MiMo‑V2.5‑Pro (stig 26). MiMo‑V2.6 Flash, á hinn bóginn, miðar að jafnvægi milli vitundar, skilvirkni og kostnaðar, og býður léttari fótspor fyrir þróunaraðila sem þurfa fjölmiðlunarfærni án þess að nota eins mikla útreikningafjármögnun og Pro-útgáfan. Útgáfan er mikilvæg því hún minnkar bilið milli opins uppspretta og eigendarmála stórra tungumálamódel í hratt vaxandi fjölmiðlunarmarkaði. Með því að opna upp módel sem getur mætt leiðandi lokað kerfum í umhverfisverkefnum gefur Xiaomi rannsakendum, sprotafyrirtækjum og fyrirtækjum — sérstaklega á Norðurlöndum, þar sem opn AI vistkerfi eru metin — öflugt nýtt verkfæri til að byggja sjón‑tungumála umhverfisverkefni, kóðaaðstoðarmenn og aðrar þversniðs forrit. Það sem á eftir að fylgjast með eru sjálfstæðar prófunarniðurstöður og samfélagsdrifnar fínstillingar sem gætu staðfest kröfur Xiaomi. Notkunarmælikvarðar frá AI Studio og OpenRouter munu sýna hversu fljótt módelin ná í umferð, á meðan frekari útgáfur frá keppinautum í Kína eins og Grok og DeepSeek munu móta opnþyngda stigatöflu. Næstu nokkur mánuðir ættu að sýna hvort MiMo‑V2.6 geti haldið frumleiðslu sinni og haft áhrif á víðari hreyfingu í átt að opinberlega aðgengilegum, hágæða AI.
34

Designer-RSI: Þróun ferli minnis út frá notendaflæði fyrir sjálfstæð grafíska hönnun

HF Papers +5 heimildir hf papers
agents
Ný rannsóknarverkefni nefnt **Designer‑RSI** leggur fram aðferð til að AI‑knúnir grafískir hönnunarbúnaðir geti bætt sig stöðugt án þess að breyta undirliggjandi líkansvægi. Kerfið sameinar fryst „framskiptalíkan“ – sem getur stjórnað faglegu hönnunarforriti í gegnum meira en 230 verkfæri – með ytri ferli minni sem geymir hönnunarfærni á náttúrulegu máli. Þegar notendur senda inn hönnunaverkefni er minninu uppfært með því að endurspila bæði grunnbútinn og þróuð útgáfur hans, draga út árangursríkar aðgerðarröð og breyta þeim í lesanlegar, breytanlegar færni færslur. Aðferðin lítur á raunverulegt notendaflæði sem uppsprettu kennslu, sem gerir bútinum kleift að víkka og dýpka safn endurnýtanlegra ferla á meðan kjarnalíkani er óbreytt. Þessi þróun er mikilvæg vegna þess að fagleg grafísk hönnun er langtímaverk, mjög samhengisverkefni sem skortir áreiðanlegan forritanlegan oracle. Með því að flytja þekkingu út í breytilegt færni­bank, forðast Designer‑RSI dýrar endurþjálfunarhringi sem eru einkenni stórra líkana og dregur úr háðinu á handvirkt merkjum gögn. Aðferðin býður einnig upp á gagnsæjan eftirlitsleið – hver færni er sett fram á náttúrulegu máli – sem gæti létt á áhyggjum varðandi svarta kassa hegðun í skapandi AI kerfum. Designer‑RSI byggir á sömu rannsóknarleið sem við fjölluðum 21. september 2026, þegar við skýrðum um V7‑stofnanlega minni fyrir AI bútana. Báðar verkefnin kanna hvernig ytri minnisuppbyggingar geta veitt bútum form ferli endurminningar sem er hraðari en það sem einungis fryst vægi getur boðið. Áfram mun vísindasamfélagið
31

OmniVBench: Nýtt viðmið og stórt gagnasett fyrir omni tilvísun‑til‑myndskeið

HF Papers +5 heimildir hf papers
benchmarks
Nýtt viðmið og gagnasett sem miðar að hratt vaxandi “omni” tilvísun‑til‑myndskeið (R2V) framleiðsluáherslu hefur verið gefið út undir heitið **OmniVBench**. Viðeigandi **Omni‑R2V gagnasett** inniheldur 340 þúsund unnin þjálfunardæmi sem ná yfir breiðan fjölda tilvísunargerða—texta, myndir, hljóð og samsetningar þeirra—og gerir kleift að meta líkön á mun fjölbreyttari stýritáknum en fyrri prófsett. Útgáfan leysir skýran skort í greininni: núverandi R2V viðmið fjalla aðeins um þröngt úrval tilvísana og meta aðallega heildarsamræmi, án þess að huga að því hversu vel líkan getur fylgt flóknum, fjölmótnum vísbendingum. Með því að bjóða bæði heildstæð matsskjöl og stórt þjálfunargagnasett veitir OmniVBench rannsakendum sameinaða vettvang til að mæla og bæta samsetningarfleksibilitetið sem einkenni omni R2V framleiðslu er. Mikilvægið felst í tímasetningunni. Þegar R2V líkön fara frá einangruðum verkefnum yfir í almenna, fjölbreyttari stjórn—í takt við þróun í nýlegu omni‑móða verki eins og OmniVChat kerfinu sem við fjölluðum 21. september—verða traust viðmið ómissandi til að fylgjast með framvindu og tryggja endurtekningu. Stærð gagnasafnsins lækkar einnig hindrunina fyrir þjálfun næstu kynslóða líkana sem geta túlkað og blandað mörgum tilvísunarmódelum í eitt myndskeið. Framundan mun samfélagið fylgjast með fyrstu notendum sem innleiða OmniVBench í mataráætlanir sínar, með greinum sem skrá árangursbætur við notkun Omni‑R2V þjálfunargagnasafns, og með nýjum stigataflum eða áskorunum byggðum á viðmiðinu. Ef auðlindin fær fjölda notenda gæti hún flýtt fyrir þróun raunverulega omni‑hæfra myndskeiðaframleiðslukerfa og sett nýjar staðla fyrir fjölmóða AI mat.
27

Umboð AI mega ekki taka neinar sjálfstæðar ákvarðanir

Dev.to +6 heimildir dev.to
agents
Vaxandi hópur forritara varar við því að nútíma umboð AI rekist á hörð vegg: þeim er ekki heimilt að taka neinar sjálfstæðar ákvarðanir. Vandinn kom í ljós í nýlegu umræðuvæði þar sem notandi lýsti yfir skyndilegum afhendingartíma og umboði sem óhjákvæmilega bað um heimild áður en það framkvæmdi nokkuð. Einkennið—umboð sem seinkast í bið eftir mannlegri samþykkt—er orðað í algengum vandamálum hjá fyrirtækjum sem hafa sett sjálfstæð hjálparforrit í notkun til verkefna eins og dagsetningastillingar, kóðauppsetning eða fjármálaúrvinnslu. Greiningar frá iðnaðarráðgjöfum rekja flöskuhornið til skorts á “stýringarlagi” sem liggur utan traustamarka umboðanna. Eins og skýrt er í greininni *The AI Agent Permission Problem — and How to Solve It*, þarf traust lausn að bjóða upp á ákvörðun API sem metur hvern mögulegan afleiðingar gegn viðfangsatriði, aðgerð, auðlind og lifandi samhengi, og sk
26

BI-Agent og BI-Bench: Á leið til sjálfvirkrar endan-til-enda viðskiptagreiningar

HF Papers +5 heimildir hf papers
agents
Rannsakendur hafa kynnt **BI‑Agent**, frumgerðarkerfi sem notar stór tungumálalíkön (LLMs) til að sjálfvirkja allan líftímaferil viðskiptagreiningar (BI) verkefna, og **BI‑Bench**, fyrsta viðmið sem er hannað til að meta hversu vel LLMs takast á við þessi endan-til-enda vinnuferli. Hópurinn byggði BI‑Bench með því að safna stórum safni af opinberlega aðgengilegum BI verkefnum og handvirkt draga út parað spurninga og sannar svör frá raunverulegum notendastjórnabörðum. Niðurstöðukasinninn fangar þrjá hefðbundna þætti BI pípu—að greina viðeigandi töflur, framkvæma gagnabreytingar og smíða myndir—sem gerir kerfisbundna prófun LLMs á raunverulegum fyrirtækjaspurningum mögulega. Fyrstu tilraunir sýna að „einföld“ LLMs, án sértækrar spurningaskipunar eða verkfærasameiningar, eiga í erfiðleikum með að skila réttum svörum í gegnum viðmiðinu, sem dregur fram bilið milli núverandi getu tungumálalíkana og kröfunnar um greiningar á framleiðslustigi. Þessi þróun er mikilvæg vegna þess að BI er grundvöllur ákvörðunartöku í næstum öllum stórum stofnunum, en að búa til skýrslur í verkfærum eins og Power BI eða Tableau krefst enn klukkustunda handvirkrar gagnaúrvinnslu. Ef LLMs getur áreiðanlega sjálfvirkjað þessi skref, gætu greiningarsérfræðingar fengið innsýn fljótar, minnkað hindrunir fyrir notendur sem eru ekki tæknilega færir og umbreytt markaðinum fyrir BI hugbúnað. Enn fremur veitir viðmiðið rannsakendum áþreifanlegt markmið til að bæta rökstuðning líkana yfir uppbyggð gögn, svið sem hefur sló á eftir verkefnum sem aðeins fela í sér texta. Fylgist með eftirfylgjandi verkum sem fínstillir verkfæranotkun BI‑Agent, stækkar §
25

MintAct: Samrýmt sjónvænt tæki fyrir stafræna umhverfi

HF Papers +6 heimildir hf papers
agentstraining
Ný líkanafjölskylda sjón‑tungumálalíkana, kölluð **MintAct**, hefur verið kynnt, og lofar eina AI. Rannsóknin kynnir þrjár líkanstærðir — 2 milliardar, 4 milliardar og 8 milliardar færibreytur — hver um vandaða blöndu af hermdum umhverfum, gagnastreymum og þjálfunaruppskriftum. Samkvæmt höfundunum samsvarar MintAct frammistöðu sérhæfðra, eins konar líkana á þremur lykilvirkni: UI festing (að finna stjórntæki á skjá), fjölskrefa leiðsögn (framkvæma aðgerðarröð til að ná markmiði) og sjónvæn verkfæra notkun (samskipti við skjáverkfæri). Mikilvægið felst í því að sameina það sem hefðbundið hefur verið brotið upp í sundurliðað landslag þröngra umhverfisþjóna. Núverandi lausnir einbeita sér oft að einu kerfi — farsímaforrit, skjáborðshugbúnað eða vefsíður — og krefjast aðskildra þróunar- og viðhaldspípa. Með því að sameina þessi verkefni gæti MintAct lækkað hindrunina við að byggja upp trausta stafræna aðstoðarmenn, einfaldað sjálfvirkni vinnuferla og flýtt útbreiðslu AI‑knúinna framleiðniverkfæra. Aðferðin sýnir einnig að stækkun í hóflegar líkanstærðir, í samspili við vandlega hannað þjálfunarumhverfi, getur keppst við stærri, sérsniðna kerfi. Áframhorfandi mun samfélagið fylgjast með sjálfstæðum viðmiðunartölum sem staðfesta áætlaða jafnvægið við sérfræðilíkön, sem og raunverulegum tilraunum sem prófa traust MintAct í lifandi forritum. Samþætting við núverandi AI stafla — eins og BI‑Agent rammann sem við fjöllum áður — gæti sýnt hvernig samrýmt sjónvænt tæki fellur inn í víðtækari fyrirtækja sjálfvirkni pípur. Frekar útgáfur gætu stækkað líkanafjölskylduna, fínpússað þjálfunaráætlunina eða opnað byggingaruppsetninguna fyrir ytri þróunaraðila, og skapað grundvöll fyrir fjölbreyttari, fjöl‑kerfis AI aðstoðarmenn.

Allar dagsetningar