AI News

222

Meta prófar Muse AI umboðsmann: símtöl gerð af mönnum í símtalsmiðju

Meta prófar Muse AI umboðsmann: símtöl gerð af mönnum í símtalsmiðju
Mastodon +7 heimildir mastodon
agentsmeta
Meta er í leyni að prófa nýja útgáfu af persónulegum AI aðstoðarmanni, Muse, sem beina símtalabeiðnum til mannlegra umboðsmanna í símtalsmiðju í stað þess að láta hugbúnaðinn hringja og tala sjálfstætt. Innri starfsmannaskilaboðapinna, sem 404 Media fékk að sjá, útskýrir að Muse “handi nú beiðnir til þjálfaðs mannlegs umboðsmanns, sem framkvæmir símtalið og fer í gegnum það,” og að þessi eiginleiki er enn leyndur, framleiðsla fyrir útgáfu. Miðlar sem meta hlutfallið milli AI og mannlegs álags segja að um það bil 70 prósent verkefna umboðsmannsins eru enn framkvæmd af fólki. Uppgötvanirnar koma í kjölfar nýjustu uppfærslu Meta á Muse-gallann sem gerði árásarmönnum kleift að taka stjórn á umboðsmanninum, saga sem við fjölluðum 22. september. Þetta dregur fram vaxandi mynstur í greininni: stórkostlegar kröfur um sjálfstæða AI fela oft í sér verulega mannavinnu í bakgrunni. Með því að setja mannlega umboðsmenn í hlutverk “mannlegs þjónustumaðls” getur Meta umhverft tæknilegar hindranir eins og villur í talgreiningu, reglugerðarviðbrögð gegn óumbeðnum sjálfvirkum símtölum og nauðsyn á traustum öryggisráðstöfunum áður en full sjálfstæð útfærsla fer í loft. Meta segir að starfsmannaviðbrögð við prófið hafi verið yfirþyrmandi jákvæð og lýsir tilrauninni sem leið til að safna gögnum um öryggi og persónuvernd. Fyrirtækið hefur ekki tilkynnt hvenær—eða hvort—aðeins AI‑stýrða símtalafærnin verði gefin út. Á eftir að fylgjast með: hvort Meta stækki mann‑í‑hringrásarlíkanið til annarra Muse aðgerða, hvernig reglugerðarstjórar bregðast við blöndun AI lofanna og mannavinnu, og hvort fyrirtækið birti frammistöðumælikvarða sem gætu haft áhrif á víðari umræða um AI gagnsæi og siðfræði “draug” sjálfvirkni.
149

Starfsmenn sem þjálfa OpenAI’s AI sparkaðir fyrir að nota AI til að þjálfa AI

Starfsmenn sem þjálfa OpenAI’s AI sparkaðir fyrir að nota AI til að þjálfa AI
Mastodon +6 heimildir mastodon
openaitraining
OpenAI hefur sagt upp fjölda verktaka eftir að hafa uppgötvað að þeir notuðu gervigreindartól til að framkvæma það mannlegu endurgjöfaverkefni sem þeir voru ráðir til. Verktakar, sem voru ráðnir í gegnum vinnu­vettvanginn Mercur til að lesa raunverulega ChatGPT spurningar og meta svör módelins, þurftu að veita “aðeins mannlegar” dóma. Samkvæmt skýrslu frá 404 Media brutu nokkrir þeirra þessa reglu með því að nota AI til að meta eða búa til endurgjöf, sem leiddi til þess að OpenAI lokaði samningum þeirra. Uppsögnirnar varpa ljósi á vaxandi árekstra í gagna‑þjálfunarleiðangri fyrirtækisins. Módel OpenAI eru ennþá háð mannlegum merkjum til að veita hágæða, hlutlaus merki sem stýra hegðun og öryggi módelanna. Að innleiða gervi, AI‑framleiddar dóma getur leitt til mengunar þjálfunargagnanna með endurgjöf sem gæti styrkt núverandi hlutdrægni eða falið villur, sem dregur úr áreiðanleika mannlegrar þátttöku í ferlinu. Aðgerðina dregur einnig fram mótsögn: OpenAI hvetur opinberlega til víðtækrar notkunar AI á vinnustöðum en á sama tíma stjórnar eigin starfsmannahópi gegn sömu aðferð. Þessi þróun kemur í kjölfar fyrri tilkynningar OpenAI um að leyfa þriðju aðila að framkvæma tæknilegar öryggismat á módelum sínum, og fellur að sér í tengslum við aðra frétt frá 22. september um að fyrirtækið hafi sagt upp verktökum vegna svipaðra brota. Mynstrið bendir til þess að OpenAI stækkir eftirlit með merkja‑kerfinu sínu þegar það eykur útgáfu nýrra módel. Áhorfendur munu fylgjast með formlegu svar frá OpenAI sem útskýrir endurskoðaðar leiðbeiningar fyrir verktaka og mögulega víðtækari stefnumótun varðandi notkun AI í þjálfunarleiðum. Atvikið gæti einnig hvatt aðra AI fyrirtæki til að endurmeta hvernig þau jafna hagkvæmni sjálfvirkni við þörfina fyrir óaðfinnanlega mannlega endurgjöf, umræða sem gæti mótað nálgun iðnaðarins við módelþróun í marga mánuði.
143

Pentagon segir að ofurtraust á AI hafi stuðlað að eldflaugárás á írskum skóla

Pentagon segir að ofurtraust á AI hafi stuðlað að eldflaugárás á írskum skóla
HN +6 heimildir hn
Rannsakendur Pentagon sjálfir hafa komist að því að ofurtraust á gervigreindartólum hjálpaði til við að knýja febrúarárlegu eldflaugárásina sem sló í Shajarah Tayyebeh grunnskóla í Minab, Íran, og drap 123 börn. Yfirlitið fann að gölluð upplýsingagjöf, úrelt gervihnattamyndir og sterkt traust á Palantir AI kerfi leiddu til þess að markmiðið var rangt greint sem löglegt hernaðarleg svæði. Niðurstaðan byggir á fréttinni sem við birttu 19. september, þegar embættismenn Bandaríkjanna lýstu því að Palantir Maven AI væri meðal þátta sem leiddu til sömu árásar. Nýja skýrslan bætir við smáatriðum um „dauða keðjuna“ sem fluttist frá gömlum gögnum yfir í sjálfvirkt ákvörðunarlag, og sýnir hvernig hálf‑sjálfstæð markvörun getur magnsett mannlegan mistök. Úkrainskur drónahönnuður vísaði í atvikið sem vararandi dæmi um áhættuna í hálf‑sjálfstæðum stríði. Áhrifin eru tafarlaus fyrir víðtækari AI‑stýrða markvörun Pentagon. Lögðefndir og varnarmálsteymir munu líklega krefjast strangari eftirlits með AI‑hjálpaðri vopnabúnaði, og herdeildir gætu þurft að endurskoða verklagsreglur sem nú leyfa AI úttök að hafa áhrif á árásartökubúnað með takmarkaðri mannlegri staðfestingu. Væntanleg er formleg svar frá varnarmálaráðuneytinu um hvernig það mun breyta AI innkaupum og rekstrarreglum, auk mögulegra þingfundar sem gætu ummyndað lagaramma um sjálfvirk vopn. Atvikið vekur einnig spurningu um frekari réttarfari gegn AI birgjum, í samræmi við nýlega lögsögn frá British Columbia vegna óskylds skóla‑skotvopna AI atviks. Minab‑tragedían gæti orðið lykilpunktur í umræðunni um hversu langt Bandaríkjajafnan ætti að láta reiknirit stýra dauðlegum afl.
130

Scott Bessent gæti fljótlega orðið AI keisari Trump, segir skýrsla

Scott Bessent gæti fljótlega orðið AI keisari Trump, segir skýrsla
Mastodon +6 heimildir mastodon
Fjármálaráðherra Bandaríkjanna Scott Bessent virðist vera helsti frambjóðandi um að taka við nýsköpuðu AI keisaraembætti hjá forseta Donald Trump, samkvæmt nafnlausri skýrslu frá Semafor. Frásögnin, sem hefur verið endurtekin í nokkrum fjölmiðlum, segir að White House sé að íhuga Bessent fyrir æðsta stöðu sem myndi samræma alríkislegar AI stefnu, reglugerðir og stefnumótandi frumkvæði. Nafn Bessent hefur þegar komið fram í hápunktum AI umræðna. Eins og við skýrðum 21. september sagði hann lögðingum að Washington hefði lagt til AI-atvik tilkynningarkerfis til Kína og að báðar hliðar væru að stefna að tvíþættum AI-samskiptum. Hann hélt einnig uppi meðferð OpenAI á öryggisbrotinu í júlí, og hélt því fram að ábyrgðin liggi hjá stjórn fyrirtækisins frekar en ytri aðila. Þessar íhlutir sýna vaxandi vilja til að setja æðsta efnahagsstjórnunarmann á miðju AI stjórnun, skref sem gæti þrengt samhæfingu milli fjármálastefnu og eftirlits með nýrri tækni. Ef staðfest, myndi ráðningin veita Treasury Department beinan þátt í að móta reglur um persónuvernd gagna, útflutningsstýringar og AI-knúna fjármálaþjónustu, svið sem hefðbundið hefur verið skipt á milli margra stofnana. Hún undirstrikar einnig að Trump stjórnendahópurinn hyggist miðstilla AI stefnu undir eitt yfirvaldsatriði, í mótsögn við dreifðari nálgun fyrri stjórnvalda. Væntanleg er opinber tilkynning frá White House á næstu vikum, sem og möguleg lagasetningaleg viðbrögð frá Kongressinu, sem hefur lýst áhyggjum af því að safna AI eftirliti í eitt skrifstofa. Frekari vísbendingar gætu komið fram í komandi Treasury-fyrirlestrum um AI-tengd fjármáláhætta, og í víðari tæknistefnu stjórnvalda frammi fyrir næsta kosningahring.
125

Rabbit kynnir nýjan AI agenta sem þarf ekki R1

Rabbit kynnir nýjan AI agenta sem þarf ekki R1
Mastodon +6 heimildir mastodon
agentsapple
Rabbit, frumkvöðlafyrirtækið á bak við stuttvarandi R1 handfangandi AI tækið, hefur kynnt nýtt umhverfisstýrandi stýrikerfi sem heitir OS3. Ólíkt forgengum er OS3 eingöngu hugbúnaðar‑grunnur AI agentur sem keyrir í skýinu en framkvæmir staðbundið á Windows, macOS og Linux tölvum. Þetta þýðir að notendur þurfa ekki lengur eigið vélbúnaðar‑tæki Rabbit til að nýta samtalsgetu þess. Breytingin er mikilvæg því hún bendir á víðtækari þróun í greininni frá sérstökum AI tækjum til kross‑vettvangs þjónustu sem nýtir núverandi tæki. R1 frá Rabbit átti í erfiðleikum með að ná markmiðum, og snúningur fyrirtækisins í ský‑fyrstu, tæknavalkostur líkan gæti endurlifað mikilvægi þess og víkkað notendahópinn. Með því að nýta sömu undirstöðulíkön sem knúðu R1 en bjóða þau í gegnum léttan biðlara, stefnir Rabbit að því að keppa við aðra nýja umhverfisstýrandi vettvang eins og Muse frá Meta og Snorkel AI gagna‑þróunar agenta, sem einnig eru að færa sig í átt að aðgengilegri, aðeins hugbúnaðar‑uppsetningu. Það sem á eftir að fylgjast með er hvernig OS3 stendur í raunverulegri notkun, hvort Rabbit nái að laða að þróunaraðila til að byggja á vettvangnum, og hversu fljótt það getur tryggt samstarf við helstu OS birgja. Áhorfendur munu einnig vilja sjá hvort fyrirtækið gefi út verð‑ eða áskriftarupplýsingar, og hvort agentinn geti tengst núverandi framleiðni‑verkfærum. Útgáfan mun prófa hvort aðeins hugbúnaðar‑aðferð geti sigrast á markaðsviðnámi sem hamlaði R1, og gæti sett viðmið fyrir framtíðar AI‑agent tilboð.
123

Lauk OpenAI að leysa rangt Navier‑Stokes‑vandamál?

Mastodon +7 heimildir mastodon
openai
OpenAI tilkynnti að hópur af AI umhverfisþjónum sínum hefði framleitt 166 blaðsíðna sönnun, formlega staðfest í Lean setningafræðiritlinum, sem það hélt leysti Navier‑Stokes‑vandamálið – eitt af sjöum Millenniumverðlaunaverkefnum sem felur í sér US $1 milljón verðlaun frá Clay Mathematics Institute. Kröfuna, sem var kynnt í bloggfærslu fyrir tveimur vikum, vakti mikla spenntu í AI-umhverfinu og stærðfræðisamfélaginu, með fyrirsögnum sem bendu á að vél hafi loksins leyst vandamál sem mannlegir sérfræðingar hafa misst af í öld. Inn í nokkrum dögum rannsókuðu þrír stærðfræðingar innsendinguna og komust að því að sönnunin forðast kjarnaspurninguna frekar en að bjóða upp á fullkomna lausn. Gagnrýnin þeirra, sem enduróma í nokkrum tæknilegum umfjöllunum, bendir á eyður í umfang röksemdanna og óvissu um hvaða útgáfu Navier‑Stokes‑jafna AI fjallaði um. Clay Institute hefur enn ekki viðurkennt neina lausn, og OpenAI hefur skýrt sagt að það hyggst ekki krefjast verðlaunanna. Atburðurinn er mikilvægur af tveimur ástæðum. Fyrst sýnir hann hvernig stórstæð tungumálalíkani kerfi geta framkallað flókin formleg stærðfræði, og opnar möguleikann á AI‑aðstoðaðri uppgötvun. Í öðru lagi undirstrikar hann erfiðleikana við að sannreyna vélframleiddar sönnunum, sérstaklega þegar verkið snertir djúpar, óleystar spurningar þar sem kröfur um nákvæmni eru enn í umræðu. Framvegis mun stærðfræðisamfélagið líklega framkvæma formlega fagfællamat á Lean‑staðfestu sönnuninni, á meðan OpenAI gæti fínpússað
87

AI‑þjálfunargagnasnyrsköpunarfyrirtækið Micro1 fær $100 milljónir og verðmæti $4 billi, upp frá $500 milljón í September 2025

Techmeme +7 heimildir techmeme
startuptraining
Micro1, AI‑þjálfunargagnasnyrsköpunarfyrirtækið stofnað af Ali Ansari, hefur lokið fjármögnunarrunda sem færir inn meira en $100 milljónir og hækka verðmæti þess í um það bil $4 billi. Fjáröflunin fylgir sprengjandi tekjuaukningu: fyrirtækið, sem var lítið ráðningarfyrirtæki með $7 milljónir í árlegum endurteknar tekjum (ARR) í upphafi síðustu árs, tilkynnir nú ARR yfir $500 milljónir. Á síðustu átta mánuðum hækkaði brúttó árlegur tekjuþróun frá $100 milljónum í $500 milljónir, fimmfalt, á meðan sjálfvirkar gagnasafnspípur skila samkvæmt upplýsingum brúttóframlegð 80‑90 prósent. Samningurinn undirstrikar blómstraða markaðinn fyrir hágæða þjálfunargögn þegar generative‑AI módelar fjölga sér. Með því að bjóða upp á mannvirkt og AI‑aukað merkjandi þjónustu, hefur Micro1 staðsett sig sem beinn keppinautur við núverandi fyrirtæki eins og Scale AI, og laðar að fjárfesta sem vilja styðja innviði sem byggir næstu bylgju þróunar á stórum tungumálamódelum. Verðmætaskreftið — frá $500 milljónum í september 2025 til $4 billi — gefur til kynna sterkt traust á að gagnamiðuð nýsköpunarfyrirtæki geti vaxið arðbært, frásögn sem styrkt er af nýlegum stórum fjármagnsöflunum í greininni. Áframhorfinn munu greiningaraðilar fylgjast með því hvort Micro1 nýti nýja fjármagn til að víkka verktakarnet sitt, dýpka sjálfvirkni eða sækja eftir stefnumörkuðum yfirtökum sem gætu styrkt markaðsforystu þess. Næsta fjármögnunarrunda fyrirtækisins, möguleg opinber skráning og allar samstarfsauglýsingar við helstu AI módelasmiðar verða lykilvísar um hvernig gagna‑merkingakerfið sameinast þegar eftirspurn eftir sífellt stærri módelum eykst.
73

DeepSeek Elastic Compute (DSec): Sandkassainnviður til að þjálfa umhverfisþjónar í stórum skala

Mastodon +6 heimildir mastodon
agentsdeepseektraining
DeepSeek hefur kynnt nýtt sandkassaplatform sem er hannað til að einfalda stórstærða umhverfisþjónatþjálfun fyrir stór tungumálalíkön (LLMs). Í grein sem sett var á arXiv þann 19. september 2026 lýsir fyrirtækið DeepSeek Elastic Compute (DSec) sem framleiðslustig innviður sem gerir rannsakendum og verkfræðingum kleift að keyra, meta og byggja umhverfi fyrir LLM umhverfisþjóna í stórum mæli. DSec býður upp á sameinaðan hugbúnaðarþróunarpakka (SDK) sem getur beint vinnulóðum til fjölbreyttra keyrslu­bakenda—þ.m.t. fallkall viðmót, gáma, örsmá sýndarvélar og fullar sýndarvélar—og gefur notendum kost á að velja þann einangrunar-, samhæfni- og afkasta stig sem hver verkefni krefst. Tilkynningin er mikilvæg vegna þess að hraðvöxtur „umhverfisþjón“ (LLMs) líkana, sem geta skipulagt, framkvæmt og haft samskipti við ytri verkfæri, hefur farið fram úr framboði öruggra, teygjanlegra sandkassainnviða. Núverandi skýjaúrræði krefjast oft einnar lausnar fyrir alla, sem veldur flöskuhálsi fyrir þróunaraðila sem þurfa bæði háþróun í þjálfun og strangt sandkassa umhverfi til öryggis eða samræmis. Með því að fela mörg sandkassatæknin í einum SDK, lofar DSec að minnka verkfræðilegan álag, bæta nýtingu auðlinda og gera það auðveldara að framfylgja einangrunarreglum bæði í þjálfun og eftirþjálfunarmati. Plattformið speglar einnig víðtækari þróun í greininni í átt að mótulegum, öryggismiðuðum verkfærum, eins og Snorkel AI umhverfisþjónagögnarþróun og OpenAI áform um að leyfa þriðju aðila að framkvæma tæknilegar öryggiskoðanir. Það sem verður að fylgjast með næst er hvort DSec verði boðið sem skýjaþjónusta eða haldið innri verkfæri fyrir eigin líkön DeepSeek, og hversu fljótt ytri þróunaraðilar taka SDK í notkun fyrir eigin umhverfisþjónaverkefni. Greiningaraðilar í greininni munu einnig leita eftir samstarfi sem sameinar DSec við nýrri öryggismatarramma, auk mögulegs stjórnsýslulegs athyglis vegna vaxandi athugunar á LLM umhverfisþjónum í opnu umhverfi.
59

Trump segir að hann breyti gervigreind í ofurgreind í stjórnsýsluskjölum

Gizmodo +9 heimildir 2026-09-22 news
Forseti Donald Trump nýtti framkomu sína í United Nations General Assembly til að tilkynna að „gervigreind“ verði endurnefnd í „ofurgreind“ í öllum stjórnsýsluskjölum United States. Yfirlýsingin, sem kom fram á þriðjudaginn, var sett fram sem einfalt ummerki og var sett í samhengi við víðtækari tilraun til að takast á við vaxandi almenningsáhyggjur af AI tækni. Aðgerðin hefur vakið tafarlausa rugling meðal fræðimanna og tæknifræðinga vegna þess að „ofurgreind“ hefur þegar sérstaka merkingu innan fræðasviðsins. Hugmyndafræðingur Nick Bostrom lýsir í bókinni sinni frá 2014, *Superintelligence: Paths, Dangers, Strategies*, hugtakið sem hvaða greind sem er sem skiptir verulega meira af mannlegri hugsun í næstum öllum sviðum. Með því að taka yfir orðasambandið til embættislegrar merkingar setur stjórnandinn í hættu að móða út línuna milli stefnumótunarmerkis og tæknilegs hugtaks sem liggur að baki meirihluta núverandi umræðu um AI öryggi og stjórnun. Ástæðan fyrir mikilvægi þess er tvíþætt. Fyrst, orðaval mótar hvernig stefnumótunaraðilar og almenningur hugsa um nýrri tækni; breytning í „ofurgreind“ gæti aukið skynjaða ógn og haft áhrif á framtíðarreglugerðir. Í öðru lagi kom tilkynningin án viðeigandi framkvæmdarstefnu eða raunverulegs framkvæmdaáætlunar, sem skilur eftir stjórnvalda óvissu um hvernig nýja merkið eigi að nota í framkvæmd. Það sem á að fylgjast með næst er hvort White House gefi út formlegar leiðbeiningar eða framkvæmdarstefnu, hvernig ríkisdeildir laga skjölun sína, og viðbrögð frá AI rannsóknaumhverfinu og alþjóðlegum samstarfsaðilum. Áhorfendur munu einnig fylgjast með öllum löggjafarupppötum sem vísa til nýja orðaforða, sem og víðari frásögn um AI eftirlit sem hefur komið fram í nýlegum fréttum, þar á meðal grein okkar frá 23. september um mögulega hlutverk Trump sem „AI czar“.
57

OpenAI kynnir GPT‑6 Sol og Luna með lægri kostnaði og færri villur

TechCrunch +5 heimildir techcrunch
openai
OpenAI tilkynnti viðbót tveggja nýrra líkana í GPT‑6 fjölskylduna – Sol og Luna – á þriðjudaginn, og setur þau fram sem ódýrari valkosti við nýlega gefna GPT‑6 Astra. Fyrirtækið segir að nýju útgáfurnar haldi „framsækinni greind“ Astra‑línunnar en minnki verðið í um helming af fyrri 5.6‑raðar Sol og Luna tilboðum. OpenAI rekur sparnaðinn til framfara í biðminni og útreikningum sem einfalda reiknirit líkana. Útgáfan kemur eftir að GPT‑6 Astra var sett á markað í byrjun mánaðarins, sem OpenAI lýsti sem öflugasta og fjölbreyttasta líkani sínu fyrir verkefni frá almennum verkum til hugbúnaðarþróunar. Með því að stækka GPT‑6 úrvalið með ódýrari, ennþá afkastamiklum kostum, stefnir OpenAI að því að víkka aðgengi að nýjustu kynslóð tungumálalíkana, mögulega hröða innleiðingu í fyrirtækja‑ og þróunarfyrirkomulagi sem hefur verið viðkvæmt fyrir kostnaði 5‑raðar líkana. Tímasetningin er áberandi: Sol og Luna komu út nokkrum mínútum eftir að Anthropic kynnti eigið forystulíkan, Claude Opus 5.5, sem bendir til samkeppnisþrýstings meðal leiðandi AI rannsóknarstofna til að ná markaðshlutdeild með nýrri, skilvirkari tilboðum. Áhorfendur fylgjast með hvernig verð‑ og afköstakröfur breytast í raunverulegri notkun, sérstaklega þegar fyrirtæki meta hvort kostnaðarmunurinn minnki hindrunina við innleiðingu stórskala tungumálalíkana. Lykilmerki til að fylgjast með eru tökuviðmið fyrir Sol og Luna, öryggismat frá þriðju aðila sem tilkynntur er í samræmi við nýlegu stefnu OpenAI um að leyfa utanaðkomandi endurskoðanir, og hvort lægra verðkerfi hvetur til breytinga í verðstefnu í gegnum forystulíkön iðnaðarins.
52

Rabbit kynnir OS3, ský‑AI umboðsmaður sem tengist forritum og skrám í Windows, Mac og Linux í gegnum vef, Telegram, iMessage eða R1 tækið

Techmeme +6 heimildir techmeme
agents
Rabbit hefur sett í umferð OS3, ský‑hýstan AI umboðsmaður sem getur náð í staðbundin forrit og skrár í Windows, macOS og Linux tölvum. Þjónustan er aðgengileg í gegnum léttan staðbundinn Rabbit umboðsmaður sem er settur upp með einni skipun, og notendur geta átt samskipti við aðstoðarmanninn í gegnum vefviðmót, Telegram, iMessage eða upprunalega R1 handfangið. Einn reikningur getur tengt allt að fimm tæki, og kerfið ákveður hvort verkefni keyrist á tölvu notandans, í skývirkri vél eða í tilteknu AI reiti, og flokka skrár, forrit og „færni“ milli umhverfa eftir þörfum. Útgáfan merkir breytingu frá fyrri tækjabundnu stefnu Rabbit. Eins og við skýrðum 23. september 2026, gat fyrri umboðsmaður fyrirtækisins starfað án R1 tækisins, en OS3 er fyrsta alhliða kross‑stefna tilboðið sem útrýmir þörfinni fyrir sérstakan AI vélbúnað alveg. Með því að brúa skýgreind og hugbúnað á staðnum stefnir Rabbit að gera AI‑knúin afkastatól nothæf á skjáum sem fólk þegar á, í stað þess að krefjast sértæks tækis. Þessi þróun er mikilvæg því hún minnkar hindrunina fyrir AI aðstoðarmenn í daglegum vinnuflæðum og setur Rabbit í beina samkeppni við aðra nýlegar umboðsmen eins og OpenAI’s GPT‑6 Sol og Luna, DeepSeek’s Elastic Compute sandbox og Meta’s Muse tilraunir. Ef OS3 uppfyllir loforð um samfellda verkstjórnun og örugga staðbundna aðgang, gæti það hratt aukið innleiðingu á auknu skjáborðsvinnu með AI í norrænum löndum og víðar. Á eftir að fylgjast með er hversu fljótt notendur taka upp margtækið líkan, hvort forritarar byggja viðbætur sem nýta kross‑umhverfis samhæfingu, og hvernig Rabbit takast á við öryggis- og persónuverndarspurnir varðandi ský‑stýrða stjórn á staðbundnum skrám. Eftirfylgjandi uppfærslur um afköstarmælikvarða, verðlagningu og fyrirtækjastig eiginleika munu ákveða hvort OS3 endurskapi landslagið fyrir AI‑aðstoðarmenn.
39

GAM: 3D-grunnur sem undirstaða fyrir vélmenni

HF Papers +6 heimildir hf papers
robotics
Ný flokk vélmenna‑grunnlíkana hefur verið kynntur undir heitinu Grounded Action Model (GAM). Rannsóknin leggur til „3‑D‑grunnar“ sem kjarnastöðu fyrir nám vélmennaaðgerða, og kemur í stað tungumála‑ og myndskeiða‑framleiðslu­grunnstoða sem ríkja í núverandi sjón‑tungumála‑aðgerð (VLA) og heim‑aðgerð (WAM) líkanum. GAM er hægt að krefja um með náttúrulegu máli, smelli á punkta eða val á umhverfisreitum, og hvert er breytt í sameinaða, hlutmiðaða framsetningu á völdum atriðum í mælanlegu 3‑D rými. Breytan er mikilvæg því að stjórnunaraðgerðir þurfa að vita ekki aðeins hvaða hlutir eru viðeigandi heldur einnig nákvæmlega hvar þeir eru staðsettir. Núverandi forþjálfaðar grunnstoðir framfylgja ekki þessari mælanlegu grunngerð, sem leiðir til óstöðugrar frammistöðu þegar umhverfi breytist eða markmiðin færist. Með því að festa stjórnun á forþjálfað, spurningar‑viðbragðs­hæft 3‑D‑grunnar‑líkan, tengir GAM beint sjónræna athuganir og verkefnaspurningar við raunveruleg rúmfræðileg hnit. Fyrstu sýnikennslur sýna bættan þol gegn umhverfisbreytingum og flutningi á markmiðum, og benda til vegs í átt að áreiðanlegri vélmenna‑stýring í óskipulögðum umhverfum. Verkefnið bendir einnig á víðtækari stefnu í átt að opnum 3‑D sjóngrunnstoðum sem innbyggt skilja hreyfingu, uppbyggingu og útlit. Þar sem líkanið og þjálfunarpípun er gefin út opinberlega, getur vélmennafélagið prófað aðferðina á fjölbreyttum kerfum, frá rannsóknarstofum til jaðartækja. Framundan ættu athugendur að fylgjast með viðmiðunartölum sem bera GAM saman við viðurkenndar VLA og WAM kerfi, með samþættingarverkefnum í núverandi vélmenna‑stafla og með öllum eftirfylgjandi útgáfum sem auka getu spurningar‑viðbragðs­hæfs 3‑D‑grunnar‑líkanins. Ef fyrstu ávinningarnir standast, gæti 3‑D‑grunnar orðið að staðlaða undirstöðu fyrir framtíðarstýringu vélmenna, og umbreyta því hvernig stjórnunaraðgerðir eru þjálfaðar og settar í framkvæmd.
37

Deep Persona: Sálfræðilega byggt kerfi og matarrammi fyrir hlutverkaspilaraðila og hermun

HF Papers +5 heimildir hf papers
agentscohere
Ný rannsóknargrein kynnir **Deep Persona**, þrílaga arkitektúr sem miðar að því að veita umhverfisþjónustum byggðum á stórum tungumálalíkani (LLM) varanlegri persónuskilning. Rammannskilur persónu í sýnilega tjáningu, falin trúnað og kjarnadrifkrafta, og tengir þessa stigveldi við reglumynstur „skrifaður ákveðni“ sem takmarkar ákvörðunarpláss. Með því að festa svör umhverfisþjónustunnar við innri handrit í stað handahófskennds spurningar, halda höfundarnir því fram að líkanið geti viðhaldið samræmdum hegðun í löngum, opnum samtölum — eitthvað sem núverandi persónusímtunaraðferðir eiga í erfiðleikum með. Þessi þróun er mikilvæg vegna þess að mörg nýrri forrit—persónulegir aðstoðarmenn, félagslegir hegðunarsímtunir, gagnvirkir hlutverkaspilabotar og samræmingarrannsóknartól—treysta á LLMs sem geta sannfærandi tekið upp og viðhaldið persónu. Yfirborðslegar lýsingar leiða oft til frávika, brjóta ímyndun og draga úr trausti. Sálfræðilega byggða hönnun Deep Persona lofar stöðugri, mannlegri samskiptum, sem gæti hækkað stöðuna fyrir bæði viðskiptavörur og rannsóknarprótotýpur sem byggja á trúverðugum gervigreindarþjónustum. Ritgerðin kynnti einnig matarramma til að mæla samkvæmni, trúverðugleika og samræmingu skapaðra persóna, og býður upp á viðmið fyrir framtíðarverk. Áhorfendur munu fylgjast með hvernig arkitektúrinn er innleiddur í núverandi umhverfisþjónustukerfi, eins og gagnavinnslupípur sem voru dregnir fram í nýlegri umfjöllun okkar um Snorkel AI, og hvort hægt sé að stækka hann með innviðum eins og DeepSeek Elastic Compute. Frekari sannprófun í raunverulegum innleiðingum—frá þjónustubótum til stórra hegðunarsímtana—mun sýna hvort Deep Persona geti orðið staðlaður byggingareining fyrir næstu kynslóð hlutverkaspilaraðila.
34

Firecrawl fær $75 milljón í Series B fjármögnun, forystu Smash Capital (Maria Deutscher/SiliconANGLE)

Techmeme +6 heimildir techmeme
agentsfundingstartup
Firecrawl, nýsköpunarfyrirtæki sem byggir vefskrapunarfyrirbyggingu fyrir gervigreindar‑aðila, tilkynnti $75 milljón í Series B fjármögnun undir forystu Los Angeles‑síðuðra áhættufyrirtækisins Smash Capital. Fjárhæðin fylgir útgáfu “Alexandria”, gagnaaðgangslags sem safnar saman fleiri en hundrað uppsprettur — þar á meðal lifandi vefinn, opinbera gagnaþjónustur og eigin vísitölur Firecrawl — í eitt API sem AI aðilar geta spurt. Fjármögnunin undirstrikar vaxandi eftirspurn eftir lausum gagna pípunum sem gera gerðarmódelum kleift að fara út fyrir stöðug þjálfunargögn og sækja nýjustu upplýsingar eftir þörfum. Með því að einfalda ferlið við skráning, þáttun og staðla vefefni, stefnir Firecrawl að því að sparna þróunaraðilum á því að byggja sérsniðna skrapara fyrir hvert nýtt notkunartilvik. Samræmda viðmótið í Alexandria lofar að flýta fyrir þróun “aðila” forrita sem þurfa að vafra, sannreyna eða bæta við þekkingu sína í rauntíma, eiginleiki sem verður að greinaþætti fyrir vörur frá spjallaðilum til sjálfstæðra rannsóknarbóta. Fjárfestar virðast vera vissir um að þjónustan verði grunnlag fyrir næstu bylgju AI aðila, sérstaklega þar sem fyrirtæki vilja innleiða lifandi gagnaflæði án þess að verða fyrir lagalegum og tæknilegum flækjum stórra skráningarfyrirbæra. Rundan gefur einnig til kynna traust á víðari markaði fyrir sérhæfð gagna‑sem‑þjónustu vettvang sem sitja á milli hráa vefefnis og AI módel. Framvegis mun iðnaður fylgjast með því hversu fljótt þróunaraðilar taka Alexandria í notkun og hvort vettvangurinn geti tryggt samstarf við helstu gagnaþjónustur. Jafnframt verður mikilvægt hvernig Firecrawl tekst á við þróun reglna um vefskrapun og samkeppni frá stærri skýjaþjónustuaðilum sem eru að koma á eigin gagnaaðgangs APIs. Næstu áfangar fyrirtækisins — vörusamþættingar, viðskiptavinavinna og möguleg frekari fjármögnun — munu sýna hvort sýn þess um alhliða gagna­bókasafn fyrir AI aðila geti vaxið.
33

Ekki láta þér blekkja af sumarið í AI uppörvun

MIT Tech Review +5 heimildir mit tech review
anthropicclaudehuggingfacemetaopenai
Bylgja af djarfum yfirlýsingum hefur sveiflast yfir AI geirann í sumarið, en nákvæmari skoðun bendir til þess að mörg af fyrirsögunum séu meira uppörvun en hörð sönnunargögn. Í lok apríl tilkynnti Anthropic að nýja líkanið, Claude Mythos, gæti greint öryggisbrot í hugbúnaði betur en flestir mannlegir öryggissérfræðingar. Ákvörðunin vakti fyrirsagnir og optimisma fjárfesta, en tæknafréttir hafa þegar byrjað að spyrja um styrk gagna sem liggja að baki. Uppörvunin varð enn meira dregin úr með háþekktum broti sem tengdist líkanum hjá OpenAI og Hugging Face, sem sýndi hversu auðvelt er að brjóta inn í AI kerfi. Í eftirspurninni tilkynntu Anthropic – “stoltlega” – og Meta – “óskilyrt” – um svipað öryggisatvik sem snertu eigin líkan. Myndefni háværra lofanna sem fylgja skjótar viðurkenningar á veikleikum hefur hvatt greiningaraðila til að vara við því að sumarið í AI spenna gæti verið ofmetin. Ástæðan er tvíþætt. Fyrst geta uppblásnar frammistöðuáherslur villt fyrirtæki til að setja í notkun tóla sem enn eru ekki prófaðir í bardaga, og setja þannig mikilvæg innviði í nýja árásarvegi. Í öðru lagi varpa endurteknir öryggisbrot ljósi á kerfislegan bil í því hvernig AI þróunaraðilar verja líkan sín, sem vekur áhyggjur hjá stjórnvöldum og viðskiptavinum jafnan. Framundan stendur iðnaðurinn í þrýstingi að sanna fullyrðingar sínar með gagnsæjum viðmiðum og sjálfstæðum endurskoðunum. Áhorfendur munu fylgjast með eftirfylgjandi rannsóknum sem annaðhvort staðfesta eða hrekja áætlun Anthropic um greiningu á öryggisbrotum, og einnig eftir því hvort stórir leikmenn bregðist samstillt til að styrkja öryggi líkana. Nýleg skýrsla Technology Review, endurspeglað í AI Weekly og AI Foresights, krefst að hagsmunaaðilar skerist í gegnum sumarið uppörvun og einbeiti sér að því sem AI getur áreiðanlega skilað í dag.
31

HuRo: Róbótun mannlegra myndbanda til stærðarhæfrar VLA forsýningar

HF Papers +6 heimildir hf papers
alignmenttraining
Nýtt rannsóknarverkefni nefnt **HuRo** sýnir að umfangsmiklar safn af daglegum mannlegum myndböndum er hægt að breyta í róbótum tilvalin þjálfunargögn fyrir sjón‑tungumála‑aðgerð (VLA) stefnu. Með því að umbreyta 630 000 myndskeiðum—sem samanstanda af 142 milljónum ramma—í róbótavæddar athuganir, aðgerðir og tungumála leiðbeiningar, sýnir hópurinn að stækkun á þessum “róbótun” gögnum bætir frammistöðu í raunverulegum handvirkum verkefnum. Aðferðin takast á við langtímavandann í róbótanámi: hágæða róbót samskiptagögn eru dýrar og takmarkaðar í fjölbreytni, á meðan mannlegar myndbanda safn eru í yfirgnæfandi fjölda en eru í öðruvísi líkamsformi. HuRo byrjar á því að draga út myndavélastöðu og handahreyfingar úr sjálfsmiðaðu myndefni, aðgreina handvirkni hluta, og síðan endurstíla mannlegar handahreyfingar í róbóta liðbendingar. Mannlegar handar eru fjarlægðar úr rammum og gerviróbót er sett í staðinn, sem gefur myndskeið þar sem sjónræn inntak, tungumála skipanir og róbót aðgerðir eru paraðar saman. Forspárþjálfun VLA stefna á stærri undirbúningi af þessum róbótun myndskeiðum skilar stöðugt hærri árangursprósentu þegar stefnurnar eru síðar sett í raunverulega róbóta. Þessi þróun er mikilvæg vegna þess að hún býður upp á skalanlegan, lágt kostnaðar leið til að auðga róbótanámsferla með fjölbreytileika mannlegrar virkni. Ef aðferðin er almennt nothæf á mörgum sviðum gæti hún flýtt fyrir innleiðingu aðlögunarhæfra róbót aðstoðarmanna í heimilum og iðnaði, og minnkað þarfir til dýra gagnasöfnunaráætlana. Framtíðarathuganir fela í sér hvort vinnsluferli HuRo sé hægt að samþætta við núverandi róbót‑lærdómsvettvang, hvernig það stendur sig í flóknari verkefnum, og hvort aðrar hópar muni taka upp svipaðar mann‑til‑róbót myndbanda umbreytingaraðferðir. Samfélagið mun einnig vera spennt að sjá viðmið sem bera saman HuRo‑forspárþjálfaðar stefnur við þær sem eru þjálfaðar á hefðbundnum róbót gagnasöfnum, og hvort aðferðin geti verið útvíkkuð til fjölbreyttra inntaka eins og hljóð eða snertingarskilaboð.
28

Trump neitar alþjóðlegri áætlun til að stjórna AI í UN-ræðu og segir að US sé langt framundan Kína (Financial Times)

Techmeme +6 heimildir techmeme
speech
Forseti Donald Trump notaði lokatöku sína í United Nations General Assembly á þriðjudaginn til að gagnrýna alþjóðleg tilraun til að reglna gervigreind. „US hafnar algerlega öllum tilraunum til að byggja upp alþjóðlega áætlun til að stjórna gervigreind,“ sagði hann og bætti við að Ameríka sé „nú langt framundan Kína og aðra – og við munum halda því þannig.“ Forsetinn settir einnig AI fram sem „ofurgreind“ sem Bandaríkin munu stjórna. Athugasemdir Trumpar koma í kjölfar bylgju af kröfum um samræmda AI-eftirlit sem fær í loftið í Europe og Asia, þar sem stjórnvöld eru að útbúa staðla um öryggi, gagnanotkun og útflutningsstýringar. Með því að lýsa fjölþjóðlegum reglugerðum sem „globalist scheme“ gefur forsetinn til kynna áframhaldandi einhliða nálgun stjórnvalda sinna á nýrri tækni. Þetta samræmist fyrri skýrslum um að Trumpur hafi þegar hafið að endurnefna AI í opinberum skjölum sem „super intelligence“ og sé samkvæmt upplýsingum að íhuga stofnun sérstaks „AI czar“ til að stýra stefnu Bandaríkjanna. Ræðan fjallaði einnig um aðrar utanríkisáherslur – að verja áframhaldandi átök við Iran og tilkynna nýtt öryggissamning við Denmark um Greenland – sem sýnir hvernig AI er fléttað inn í víðari alþjóðlegar frásagnir. Það sem á eftir að fylgjast með: hvort stjórnendurnir muni formlega „superintelligence“ stefnu sína með lögum eða framkvæmdalöndum, og hvernig þeir munu bregðast við vaxandi þrýstingi frá bandamönnum um sameiginlegt stjórnunarrammi. Áhorfendur munu einnig fylgjast með mögulegri ráðningu á æðri AI-starfsmanni, tilvísun í fyrri umfjöllun okkar um hugsanlegan „AI czar.“ Næsta UN-fundur og væntanlegir tvíþættir samráð um AI-staðla munu prófa hvort neitun Trumpar á alþjóðlegri áætlun breytist í raunverulega stefnu eða haldist í orðræðu.
25

Realtime‑Venus: Fulltvíhliða samskiptakerfi með ósamstilltri úthlutun

HF Papers +5 heimildir hf papers
Rannsóknarhópur frá Ant Group og Tsinghua University hefur kynnt **Realtime‑Venus**, nýja samtalsvettvang sem getur haldið samtali á meðan það starfar í bakgrunni. Kerfið sameinar innfæddan fulltvíhliða líkan við ósamstillt úthlutunarumhverfi, sem gerir aðstoðarmanninum kleift að skynja, tala og úthluta verkefnum til ytri tóla án þess að stöðva samtalið. Tvö sérsniðin framenda eru gefin út: **Realtime‑Venus‑Omni**, sem sér um hljóð‑mynd samskipti, og **Realtime‑Venus‑Audio**, sem einbeitir sér að talmálsviðskipti. Báðir eru byggðir á MiniCPM‑o 4.5 arkitektúrinu og deila eftirþjálfunaruppskrift sem sameinar ónettengda skilning með frumvirkum, fulltvíhliða ferlum og úthlutunarvinnuferlum. Framfarirnar eru mikilvægar vegna þess að náttúruleg samskipti í bæði stafrænum og líkamlegum umhverfum krefjast stöðugrar skynjunar og tímanlegra viðbragða. Núverandi raddaðstoðarmenn bíða venjulega eftir að notandi loki talmáli áður en þeir kalla á ytri þjónustu, sem veldur áberandi tafar. Með því að halda samtali í forgrunni lifandi á meðan bakgrunns kerfi framkvæmir skipanir, lofar Realtime‑Venus mýkri, mannlegri samskiptum og gæti flýtt fyrir innleiðingu fjölbreyttra AI í vélmenna, snjallheimilistækjum og dýnamískum fjölmiðlum. Opinn‑kóða útgáfan á GitHub inniheldur kóða, fljótlegar uppsetningarleiðbeiningar og tilvitnun, og býður forritara að prófa ósamstillta úthlutunarmyndan. Fylgist með snemma innleiðingum í neytendavörur, viðmiðunartölum sem bera saman tafir og verkefnaúttektartíðni kerfisins við núverandi aðstoðarmenn, og fylgi hvernig rannsóknafélagið byggir á eftirþjálfunaruppskriftinni. Kerfið vekur einnig spurningar um stjórn og öryggi þegar AI umboðsmenn starfa sjálfstætt í bakgrunni—vandamál sem líklega munu koma fram þegar forritarar byrja að innleiða Realtime‑Venus í raunveruleg forrit.
18

Betri skyndiminni fyrir GPT‑6

OpenAI +1 heimildir openai
OpenAI hefur sett í loftið safn af endurbótum á skyndiminni kerfisins sem styður GPT‑6, og lofar hraðari svörum og lægri rekstrarkostnaði. Uppfærslan eykur hlutfall skyndiminniárekstra, kynna dýpri greiningar, og bætir við skýrum brotpunktum og nýjum stjórntækjum sem gera forriturum kleift að fínstilla hvenær og hvernig skyndiminni­fyrirspurnir eru endurnýttar. Með því að endurnýta meira af sama fyrirspurnar­umhverfi milli beiðna, getur líkanið sleppt óþarfa úrvinnslu, minnkað tafartíma og token‑tengd gjöld sem viðskiptavinir greiða fyrir hverja fyrirspurn. Breytingin er mikilvæg því skyndiminni fyrirspurna er lykilþáttur við að stækka stór tungumálalíkön í framleiðslu. Hærri skyndiminniárekstrar þýða beint ódýrari API notkun fyrir fyrirtæki sem treysta á endurtekna eða svipaðar fyrirspurnir—ávinningur sem gæti gert GPT‑6 samkeppnishæfara gagnvart keppinautum eins og xAI’s Grok 4.7, sem nýlega lagði áherslu á eigin hagkvæmniaukningu. Fyrir forritara veita viðbótargreiningarnar og brotpunktarnir skýrari sýn á hegðun skyndiminna, sem hjálpar þeim að fínstilla hönnun fyrirspurna og leysa vandamál í frammistöðu. Það sem á eftir að fylgjast með er hvernig nýju stjórntækin eru tekin upp í raunverulegum vinnulóðum og hvort OpenAI muni birta viðmiðunargögn sem sýna nákvæmlega minnkun tafar og kostnaðar. Greiningaraðilar munu einnig leita að áhrifum á verðlagaskiptingu eða á útgáfu GPT‑6‑tengdra vara sem tilkynntar voru fyrr í þessum mánuði. Eins og við skýrðum 23. september, lagði kynning GPT‑6 Sol og Luna áherslu á lægri kostnað og færri mistök; þessi skyndiminniuppfærsla dýpkar það loforð með því að takast á við hagkvæmni á innviða‑stigi.
18

Stanford R&DE notar AI til að breyta kynþætti nemenda í auglýsingum

HN +1 heimildir hn
Rannsóknar- og þróunardeild Stanford hefur hafið notkun gervigreindartækja til að breyta skráðum kynþætti nemenda í markaðssetningu. Samkvæmt stuttu tilkynningunni skiptir kerfið sjálfkrafa um kynþáttartákn í nemendagögnum áður en upplýsingarnar eru sendar til viðskiptavina sem selja á háskólastig miðaðar auglýsingar. Aðgerðin er mikilvæg vegna þess að hún dular út mörkum milli ábyrgðar á fræðilegum gögnum og kommersíunnar. Með því að breyta lýðfræðilegum einkennum gerir háskólinn auglýsingafyrirtækjum kleift að sérsníða herferðir á hátt sem gæti styrkt fordóma eða rangt lýst nemendahópnum. Aðferðin vekur einnig spurningar um samþykki, gagnaleynd og samræmi við lög gegn mismunun sem stjórna hvernig persónuleg gögn mega vera notuð í markaðssetningu. Hagsmunaaðilar — þar á meðal nemenda hópar, gagnaleyndarverndarmenn og eftirlitsaðilar — munu líklega rannsaka hvort AI‑stýrða ferlið virði siðferðilegar og lagalegar skuldbindingar háskólans. Á næstu tíma er vænt um að Stanford gefi út nákvæma stefnu um tæknina, umfang hennar og varúðarráðstafanir. Lögframleiðendur og menntastofnanir gætu leitað skýringar á því hvort aðferðin brjóti núverandi gagnaverndarreglur. Á sama tíma gætu aðrir háskólar orðið undir þrýstingi um að opinberlega segja frá hvernig þeir nota AI við meðferð lýðfræðilegra gagna nemenda í kommersiælu tilgangi, sem gæti leitt til víðtækari iðnaðarleiðbeininga um siðferðilegan notkun AI í háskómaauglýsingum.

Allar dagsetningar