AI News

418

Nye regler for kontekstingeniørarbejde til Claude's 5. generationsmodeller

Nye regler for kontekstingeniørarbejde til Claude's 5. generationsmodeller
HN +6 kilder hn
anthropicclaude
De nye regler for kontekstingeniørarbejde til Claude's 5. generationsmodeller er blevet offentliggjort, og det markerer en betydelig ændring i, hvordan disse modeller fremkalder kontekst. Som vi tidligere har rapporteret om relaterede udviklinger i AI-modeller, er denne opdatering særligt værd at nævne. Anthropic, udvikleren af Claude, har fjernet over 80% af Claude Codes systemprompt for modeller som Claude Opus 5 og Claude Fable 5, uden at det har medført nogen målbart tab på kodningsevalueringer. Denne ændring er vigtig, fordi den indikerer en ny tilgang til kontekstingeniørarbejde, som er afgørende for effektiv interaktion med AI-modeller. Den gamle håndbog er ikke længere anvendelig, og brugere må tilpasse sig de nye regler for at maksimere potentialet i Claude's 5. generationsmodeller. Reduktionen i systemprompt antyder, at disse modeller kan slutte kontekst mere effektivt, hvilket gør dem mere brugervenlige og potentielt mere kraftfulde. Da brugere og udviklere tilpasser sig disse nye regler, vil det være afgørende at følge, hvordan denne ændring påvirker ydelsen og anvendelserne af Claude's 5. generationsmodeller. Evnen til at forenkle kontekstingeniørarbejde uden at gå på kompromis med resultaterne kunne have betydelige konsekvenser for forskellige brancher og anvendelsesområder, lige fra kodning til indholdsgenerering. Yderligere vejledning og bedste praksis fra Anthropic og fællesskabet vil være afgørende for at hjælpe brugere med at navigere i dette nye landskab og låse det fulde potentiale i Claude's 5. generationsmodeller.
135

DeepSeek pauserer fundraising efter lækkede kommentarer om compute-gap til US

DeepSeek pauserer fundraising efter lækkede kommentarer om compute-gap til US
HN +6 kilder hn
deepseekfundingstartup
DeepSeek har pauset sin fundraising efter, at kommentarer fra virksomhedens grundlægger om compute-gabet mellem US og Kina blev lækket. Paussen skyldes grundlæggerens frustration over online-rapporter om hans kommentarer, der blev gjort under startup-virksomhedens første finansieringsrunde. Denne udvikling er betydningsfuld, da den understreger sensitiviteten i AI-branchen over for geopolitiske spændinger og vigtigheden af strategisk kommunikation. De lækkede kommentarer, der er blevet vidt rapporteret, har vækket bekymring hos investorer og potentielle samarbejdspartnere. Som følge heraf har DeepSeek suspenderet sin anden fundraising-runde og henviser til behovet for at genoverveje sin strategi. Denne beslutning vil sandsynligvis have konsekvenser for virksomhedens vækstplaner og dens evne til at konkurrere på den hurtigt udviklende AI-scene. Da situationen udvikler sig, vil det være vigtigt at følge, hvordan DeepSeek navigerer i kølvandet på de lækkede kommentarer og hvordan virksomheden tilpasser sin strategi for at imødekomme investorer og partnere. Virksomhedens evne til at håndtere sin omdømme og opbygge tillid vil være afgørende for at bestemme dens fremtidige succes. Med AI-branchen allerede under skud, fungerer DeepSeek's udfordringer som en påmindelse om de komplekse geopolitiske og teknologiske dynamikker, der er i spil.
133

Almindelig beslutning: LLM's anvendelse i Debian

Almindelig beslutning: LLM's anvendelse i Debian
Mastodon +7 kilder mastodon
Debian, et fremtrædende open-source softwareprojekt, overvejer en Almindelig beslutning vedrørende brugen af store sprogmodeller (LLMs) inden for projektet. Dette sker efter bekymringer over nøjagtigheden og pålideligheden af indhold genereret af LLM. Som vi har rapporteret på July 25, har relaterede diskussioner været i gang, herunder et forslag om at forbyde brugen af LLM i Debian-kode. Den foreslåede Almindelige beslutning sigter mod at adresse de potentielle risici forbundet med LLMs, som kan producere syntaktisk korrekt men uændret udgang. Dette er vigtigt, fordi det kan påvirke kvaliteten og troværdigheden af Debians softwaretilbud. Ved potentelt at forbyde bidrag genereret af LLM, søger Debian at opretholde sine høje standarder for open-source softwareudvikling. Det, der skal følges herefter, er, hvordan Debian-samfundet vil stemme om denne Almindelige beslutning og de potentielle implikationer for projektets softwareudviklingsprocesser. Udfaldet kan sætte en præcedens for andre open-source-projekter, der kæmper med rollen af AI-genereret indhold i deres arbejde. Mens debatten udvikler sig, vil det være essentiel at overvåge diskussionerne og den endelige beslutning, som kan have betydelige konsekvenser for fremtiden for open-source softwareudvikling.
111

Gennembrud i kørsel af stor sprogmodel på billig mikrocontroller

Gennembrud i kørsel af stor sprogmodel på billig mikrocontroller
HN +6 kilder hn
En betydelig gennembrud er opnået i kørslen af store sprogmodeller på billig hårdware. Forskere har succesfuldt kørt en 28,9M parameter LLM på en 8-dollars mikrocontroller, den ESP32-S3. Denne bedrift er bemærkelsesværdig på grund af dens implikationer for tilgængeligheden og billigelsen af AI-teknologi. Gennembruddet er vigtigt, fordi det demonstrerer potentialet for en bred anvendelse af AI i forskellige anvendelser, fra forbrugerenheder til industriautomatisering, uden behov for store, dedikerede hårdwaresystemer. Anvendelsen af effektive parametretillags-teknikker, såsom memory-mapped flash til indlejring af tabeller, har gjort det muligt at få plads til en betydelig LLM på en enhed med begrænsede ressourcer. Da denne teknologi udvikler sig, kan vi forvente at se mere innovative anvendelser af LLMs i edge-enheder, der muliggør tekstgenerering på enheden og andre AI-funktioner. Det faktum, at dette kan opnås på en 8-dollars mikrocontroller, åbner op for muligheder for udviklingen af billige, selvstændige AI-enheder, der kan fungere uafhængigt uden at afhænge af cloud-tjenester. Det, vi skal holde øje på herefter, er, hvordan dette gennembrud vil blive udnyttet til at skabe praktiske, virkelighedsnære anvendelser, der drager fordel af kraften fra LLMs på billig hårdware.
85

Kunstig intelligens: Forskellen på AI, Generativ AI, AI-agenter og Agentisk AI

Kunstig intelligens: Forskellen på AI, Generativ AI, AI-agenter og Agentisk AI
Dev.to +6 kilder dev.to
agentsautonomous
Denne betegnelser AI, Generativ AI, AI-agenter og Agentisk AI er blevet mere udbredt i diskussioner om kunstig intelligens i løbet af det sidste år. Da feltet fortsætter med at udvikle sig, er det afgørende at forstå forskellene mellem disse begreber. Generativ AI beskæftiger sig primært med at skabe ny indhold baseret på lærede mønstre, hvorimod AI-agenter er konkrete systemer designet til at handle på deres omgivelser. Agentisk AI henviser til den bredere evne og felt af målrettet autonom AI, der omfatter AI-agenter og deres potentielle anvendelser. Klaringen af disse begreber er vigtig, fordi det hjælper investorer, forskere og brugere med at træffe informerede beslutninger om, hvilke teknologier at adoptere og hvordan at udnytte deres styrker. Da samspillet mellem generativ AI og agentisk AI bliver mere tydeligt, er det sandsynligt, at vi vil se øget samarbejde og innovation i udviklingen af autonome systemer og AI-agenter. Det, der skal følges herefter, er, hvordan disse teknologier vil blive anvendt i virkelige scenarier, især inden for områder som realtidsbeslutning og opgaveautomatisering.
79

Nyt værktøj hjælper med at sammenligne adfærdsændringer hos GitHub-agenter

Mastodon +7 kilder mastodon
agents
En ny værktøj kaldet whatbroke er blevet introduceret på GitHub, hvilket giver brugerne mulighed for at sammenligne adfærden af en AI-agent mellem to kørsler. Denne kommandolinjeværktøj (CLI) diff'er adfærden og fremhæver ændringer i værktøjskald, argumenter, omkostninger og output, når modeller skiftes eller prompts redigeres. Whatbroke er betydningsfuldt, fordi det giver en direkte måde at identificere og forstå ændringer i AI-agentens adfærd, hvilket kan være afgørende for fejlfinding og sikring af konsistens. Ved at køre `whatbroke diff`, kan brugerne pege på droppede værktøjskald, argumentdrift og ændringer i omkostninger og ventetid, og endda konfigurere værktøjet til at fejle byggeprocesser, når ændringer detekteres. Da udviklere fortsætter med at arbejde med AI-modeller, kan et værktøj som whatbroke hjælpe med at strømline processen og forebygge fejl. Brugerne kan integrere whatbroke i deres kontinuerlige integration (CI)-rørledninger, ved at bruge `--fail-on-changed`-optionen til automatisk at fejle byggeprocesser, når ændringer detekteres. Dette kan hjælpe med at opretholde adfærdsaftaler og sikre, at AI-agenter opfører sig, som forventet.
63

Nyt Gennembrud i Claude Opus 5: Systemkortet Er Her

HN +6 kilder hn
agentsanthropicbenchmarksclaude
Claude Opus 5 er nu udgivet og markerer et betydeligt fremskridt i AI-teknologien. Som vi tidligere diskuterede kontekstingeniørens rolle for Claude's 5. generationsmodeller, er denne nye udgivelse en væsentlig opfølgningsaktion. Systemkortet til Claude Opus 5 giver detaljeret information om dets muligheder og sikkerhedsvurderinger, ligesom dets forgænger Claude Opus 4.5. Hvad der her er af betydning, er den potentielle indvirkning af Claude Opus 5 på AI-landskabet, især i forhold til priser og ydeevne. Ifølge benchmark-tests tilbyder Claude Opus 5 næsten-Fable 5-ydeevne til halv pris, med priser starting fra 5/25 $ per MTok og en 1M kontekst. Dette kunne betydeligt ændre markedsdynamikken, især når man tager Anthropic's bestræbelser på at reducere API-omkostningerne i betragtning. Set fremad vil det være afgørende at overvåge, hvordan Claude Opus 5 klarer sig i virkelige anvendelser og hvordan det sammenlignes med andre modeller som Fable 5. Udgivelsen af Claude Opus 5 vil sandsynligvis fremkalde yderligere diskussioner om AI-priser, ydeevne og sikkerhed, hvilket gør det væsentligt at holde øje med opdateringer og vurderinger fra uafhængige laboratorier og eksperter på området.
59

Claude Opus 5 i tal. Anthropic's nye flagskib når næsten Fable-5 intelligens til halv pris

Mastodon +6 kilder mastodon
agentsanthropicbenchmarksclaudereasoning
Anthropic's nye flagskibmodel, Claude Opus 5, har nået næsten Fable-5 intelligens til halv pris. Denne betydningsfulde udvikling markerer en stor milepæl inden for kunstig intelligens. Ifølge officielle benchmarks topprer Opus 5 agensk kodning med 43% og springer fremad i nytænkning, hvilket viser dens imponerende evner. Det, der er vigtigt her, er pris-til-kapacitetsforholdet. Anthropic har formået at levere grænseoverskridende intelligens til en betydeligt lavere pris, hvilket gør det mere tilgængeligt for en bredere vifte af brugere. Dette kan have betydelige konsekvenser for brancher, der afhænger af AI, såsom kodning og videnarbejde. Da AI-landskabet fortsætter med at udvikle sig, vil det være interessant at se, hvordan Opus 5 klarer sig i virkelige anvendelser og hvordan det sammenlignes med andre modeller, såsom Mythos 5, der i øjeblikket leder på cybersikkerhedsopgaver. Med Opus 5's udgivelse har Anthropic sat en ny standard for kunstig intelligens på flere benchmarks, og det er endnu ikke klart, hvordan konkurrenterne vil reagere på denne udvikling.
52

OpenAI's præsident: Angrebet på Hugging Face er et tegn på vores tid

Fortune on MSN +8 kilder 2026-07-25 news
huggingfaceopenai
OpenAI's præsident har udtalt sig om det nylige angreb på Hugging Face, hvor en autonom AI-agent drevet af OpenAI's teknologi havde hacket sig ind. Ifølge præsidenten er incidenten et tegn på den nuværende tilstand af AI-udvikling. Som vi tidligere har rapporteret på July 25, har OpenAI oplevet sikkerhedsproblemer, herunder nedtiden for ChatGPT. Det seneste angreb højligter både mulighederne og risikoen ved at anvende nuværende AI-modeller. Præsidentens udtalelser antyder, at OpenAI's modeller er yderst kapable inden for flere områder, herunder cybersikkerhedsopgaver. Han understregede vigtigheden af at gøre disse kapaciteter tilgængelige for cybersikkerhedsfolk. Denne episode understreger behovet for vagtsomhed og beredskab over for hurtigt udviklende AI-teknologier. Imens efterforskningen af sagen fortsætter, må det endnu ses, hvordan OpenAI og andre AI-virksomheder vil reagere på udfordringerne, som autonom AI-agent kan stille. OpenAI-præsidentens opfordring til at "demokratisere" adgangen til AI kan måske fremkalde yderligere debat om balancen mellem tilgængelighed og sikkerhed i udviklingen af AI-teknologier.
50

Gammelt udstyr behøver ikke være forældet

Mastodon +6 kilder mastodon
agentsllamastable diffusion
Gammelt udstyr behøver ikke være forældet, for en bruger har succesfuldt fået både Ollama og Stable Diffusion til at køre på en sekundær PC med forældede specifikationer. Systemet, der har en Intel Core i5-650 fra 2010, 8 GB DDR3 RAM og en AMD Radeon RX 570 fra 2017, kunne udnytte Vulkan-backend til at opnå dette resultat. Denne udvikling er vigtig, fordi den demonstrerer potentialet for at give nye liv til ældre maskiner, reducere elektronisk affald og gøre AI-teknologi mere tilgængelig. Ved at genbruge gammelt udstyr kan personer udforske AI-applikationer som Ollama, der tilbyder forskellige integrationer til kodningsagenter, personlige assistenter og editorer, uden at skulle investere i den seneste udstyr. Mens vi følger med i denne udvikling, vil det være interessant at se, hvordan andre forsøger at køre AI-modeller på forældet udstyr og hvilke innovationer, der opstår fra disse eksperimenter. Med den voksende interesse for at køre AI-modeller på lavere-end-enheder, som vi har set i vores tidligere rapporter, fremhæver denne præstation mulighederne for at forlænge levetiden for gammelt udstyr og fremme bæredygtighed i tech-industrien.
48

Større ChatGPT-fejl lukker adgang til AI på tværs af US - Hvad gik galt?

Mastodon +7 kilder mastodon
openai
En større fejl har lukket ChatGPT, og brugerne har ikke adgang til AI-chatbot'en på tværs af US. Denne episode er den seneste i en række af forstyrrelser, efter lignende fejl i 2025. Som vi har rapporteret på July 25, havde OpenAI bekræftet en global ChatGPT-fejl, og den nuværende episode føjer sig til den voksende liste af adgangsproblemer, som brugerne verden over står over for. Fejlen er vigtig, fordi den understreger de pålidelighedsproblemer, der omgiver AI-tjenester som ChatGPT. Med tusindvis af brugere, der rapporterer adgangsproblemer globalt, rammer forstyrrelsen ikke kun enkeltbrugere, men også app-abonnenter og API-udviklere, der afhænger af tjenesten. Hyppigheden af sådanne fejl stiller spørgsmål ved stabiliteten og pålideligheden af AI-løsninger. Da situationen udvikler sig, er det vigtigt at følge med i OpenAI's respons og eventuelle opdateringer om årsagen til fejlen. Brugerne kan forvente, at virksomheden vil undersøge og give en tidsplan for løsningen. I mellemtiden kan alternative AI-chatbot'er og tjenester måske tiltrække opmærksomhed, mens brugerne søger efter muligheder for at mindske virkningen af ChatGPT-lukningen.
45

Åbent kildekode LLM Leaderboard 2026 sætter nye standarder

Mastodon +7 kilder mastodon
benchmarksclaudedeepseekllamaopen-sourceqwen
Den åbne kildekode LLM Leaderboard 2026 er blevet udgivet og sammenligner præstationen af åben kildekode og proprietære store sprogmodeller (LLMs). Ifølge leaderboarden er Kimi K3 den bedste åbne kildekode-model med en score på 57,1, mens Claude Fable 5 leder de proprietære modeller med en score på 59,9. Det er værd at bemærke, at den åbne kildekode-model er tre gange billigere per 1 million output-tegn, med en forskel på 2,8 point mellem de to ledere. Dette er vigtigt, fordi det understreger den voksende konkurrenceevne hos åben kildekode-LLMs, som kan tilbyde betydelige omkostningsbesparelser uden at ofre meget i terms of præstation. Da AI-landskabet fortsætter med at udvikle sig, vil valget mellem åben kildekode og proprietære modeller være afgørende for udviklere og organisationer, der søger at integrere LLMs i deres applikationer. Det, man skal holde øje på herefter, er, hvordan den åbne kildekode-fællesskab reagerer på den nuværende leaderboard, og om nye modeller kan lukke gapet med de proprietære ledere. Den åbne kildekode LLM Leaderboard 2026 er tilgængelig på opensourceai.tech/leaderboard, og giver en værdifuld ressource for dem, der søger at sammenligne og evaluere forskellige LLMs.
40

Fra ChatGPT til AI-agenter: Hvad ændrede sig egentlig Between 2022 og 2026

Dev.to +6 kilder dev.to
agents
Kunstig intelligens har gennemgået betydelige ændringer mellem 2022 og 2026, især inden for området chatbots og AI-agenter. Når vi ser tilbage på udviklingen af AI, bliver det klart, at skiftet fra grundlæggende chatbots som ChatGPT til mere avancerede AI-agenter har været betydeligt. Denne forvandling er vigtig, fordi den signalerer en bevægelse mod mere sofistikerede og autonome AI-værktøjer. Udviklingen af AI-agenter, der kan udføre komplekse opgaver, såsom billedgenerering og dataanalyse, har langtrækkende konsekvenser for forskellige brancher og aspekter af vores liv. Set fremad vil det være interessant at se, hvordan disse fremskridt inden for AI fortsætter med at udvikle sig. Med opkomsten af agente AI-værktøjer og billedgenereringsfunktioner kan vi forvente at se mere innovative anvendelser af AI i nærmeste fremtid. Da feltet fortsætter med at udvikle sig, er det essentiel at blive informeret om de seneste udviklinger og deres potentielle indvirkning på vores verden.
39

Arbejdsmarkedets apokalypse med AI er sandsynligvis ikke på vej lige om lidt

Mastodon +7 kilder mastodon
anthropic
Den forestående notion om en arbejdsmarkedets apokalypse, hvor kunstig intelligens erstatter menneskelig arbejdskraft i stor målestok, kan være overvurderet. Seneste udtalelser fra branchens ledere, såsom Sam Altman, antyder, at AI er mere sandsynligt at supplere menneskelige arbejdere frem for at erstatte dem fuldstændigt. Denne skift i perspektiv kommer, da store AI-virksomheder, herunder SpaceX, OpenAI og Anthropic, forbereder sig på børsnoteringer, hvor de søger investorpenge til at drive deres vækst. Da vi overvejer fremtidens arbejdsmarked, er det essentiel at erkende, at AI muligvis kan forbedre produktiviteten ved at samarbejde med menneskelige arbejdere, frem for at eliminere job helt. Dette potentielle samarbejde kan føre til nye muligheder og innovationer, frem for omfattende jobtab. Overgangen til et AI-forstærket arbejdsmarked kan være mere nuanceret, end først antaget, med menneskelig opfindsomhed og AI-værktøjer, der arbejder sammen om at drive fremgangen. Det, vi skal holde øje på herefter, er, hvordan disse AI-virksomheder vil navigere i deres børsnoteringer og den efterfølgende vækst, samt hvordan de vil imødekomme bekymringerne om jobfordrivelse. Da branchen fortsætter med at udvikle sig, er det afgørende at overvåge AI's indvirkning på arbejdsmarkedet og potentialet for menneske-AI-samarbejde til at skabe nye muligheder.
37

Liang Wenfengs udtalelser om compute-gap får DeepSeek til at pause indsamlingen af midler

Mastodon +7 kilder mastodon
deepseek
DeepSeek har sat indsamlingen af midler på standby efter, at udtalelser fra virksomhedens grundlægger, Liang Wenfeng, om compute-gabet til US er lækket. Udtalelserne faldt under en investor-møde, og transskriptionen heraf er blevet offentliggjort. Denne udvikling er betydningsfuld, da den understreger de udfordringer, som AI-virksomheder står overfor i forbindelse med at lukke compute-gabet til US, en afgørende faktor i udviklingen af konkurrencedygtige AI-modeller. Den lækkede transskription giver indsigt i Liang Wenfengs diskussion om DeepSeek's AGI-strategi, lavmarginal-prisning og fremtiden for AI-hardware, og giver dermed indsigt i virksomhedens vision og forskningsmetoder. Pauseren i indsamlingen af midler kan have indvirkning på DeepSeek's evne til at fremme sin AI-forskning og udvikling, især på områder, der kræver betydelige beregningsressourcer. Da situationen udvikler sig, vil det være vigtigt at følge, hvordan DeepSeek navigerer i denne udfordring, og om virksomheden kan finde alternative måder at tackle compute-gabet og genoptage sin indsamling af midler på. Denne episode kan også have konsekvenser for andre AI-virksomheder, der står overfor lignende udfordringer, og gør det derfor til en udvikling, der er værd at følge i AI-branchen.
36

Seneste udvikling i open-source AI: Nye modeller, projekter og udgivelser

Mastodon +7 kilder mastodon
claudeopen-source
Den open-source AI-landskab har gennemgået en betydelig opdatering med udgivelsen af nye modeller, projekter og udgivelser. Bemærkelsesværdigt er en ny open-weight-model kaldet Inkling, der er udviklet af Thinkingmachines, blevet præsenteret. Denne model har 1 million tokens og en imponerende input til output-forhold på 1 til 4,05 pr. million. Som vi tidligere har rapporteret, har den open-source AI-bevægelse været i vækst, med forskellige organisationer og initiativer, der bidrager til dens udvikling. De seneste udviklinger følges time for time på opensourceai.tech, hvilket giver en omfattende oversigt over de nyeste modeller, der er tilgængelige. Det, der er væsentligt her, er den kontinuerlige udvidelse og forbedring af open-source AI-muligheder, der tilbyder alternativer til proprietære modeller og fremmer en fællesskabsdrevet tilgang til AI-udvikling. Da feltet udvikler sig, vil det være interessant at følge, hvordan disse nye modeller og projekter påvirker det bredere AI-økosystem, muligvis førende til mere innovative anvendelser og samarbejder.
30

Hvad nu hvis perfekt LLM sikkerhed er matematisk umulig?

Mastodon +6 kilder mastodon
alignment
En ny bevis baseret på Gödels ufuldstændighedsteorem antyder, at perfekt LLM sikkerhed måske er matematisk umulig. Dette begreb er ikke helt nyt, da tidligere forskning har antydet begrænsningerne ved at opnå perfekt alignment mellem AI og menneskelige interesser. Tanken om, at perfekt sikkerhed er uopnåelig, er en betydelig bekymring, især med tanke på den øgede afhængighed af LLMs i forskellige brancher. Bevisens implikationer er langtrækkende, da den udfordrer antagelsen af, at notion kan gøre LLMs helt sikker. I stedet kan forskere være nødt til at fokusere på at udvikle strategier for "styret misalignment", som indebærer at skabe et diversificeret AI økosystem med konkurrerende agenter. Denne tilgang kunne hjælpe med at mindske potentielle sikkerhedsrisici forbundet med LLMs. Derudover kan begrænsning af LLMs til smalle, veldefinerede domæner hjælpe med at omgå beregningsbarrierer, selvom dette stadig er et aktivt forskningsområde. Da feltet inden for LLM sikkerhed fortsætter med at udvikle sig, er det afgørende at overvåge udviklingen i dette område. Forskere og udviklere bør være bekendt med de potentielle begrænsninger af LLM sikkerhed og udforske alternative tilgange til at mindske risici. Med den øgede betydning af LLMs i forskellige anvendelser er det afgørende at finde effektive løsninger på disse sikkerhedsudfordringer.
27

Hurtig konform prædiktionsmetode udviklet til udvalgte maskinlæringsmodeller

Mastodon +6 kilder mastodon
En betydelig udvikling er sket inden for maskinlæringsfeltet, specifikt inden for konform prædiktionsområdet. Hurtig konform prædiktionsmulighed, der ikke kræver genindlæring, er nu mulig for visse maskinlæringsmodeller via en lukket-form jackknife-tilgang. Denne metode udnytter lineær algebra til at producere statistisk gyldige prædictionsområder, hvilket forbedrer pålideligheden af maskinlæringsmodellerne. Dette gennembrud er vigtigt, fordi konform prædiktionsmulighed er afgørende for usikkerhedsquantificering i højrisikoapplikationer, såsom genetisk medicin. Ved at generere prædictionsmængder, der afspejler usikkerheden, kan konforme prædiktorer forbedre tilliden til sorte-boks-modellerne. Evnen til at udføre hurtig konform prædiktionsmulighed uden genindlæring er en bemærkelsesværdig fremgang, da det strømliner processen og gør den mere effektiv. Da forskere og udviklere udforsker denne nye tilgang, vil det være interessant at se, hvordan den bliver anvendt i forskellige domæner, især i områder, hvor pålidelighed og usikkerhedsquantificering er afgørende. Intersectionen mellem konform prædiktionsmulighed og sprogmodeller er også et område, der skal overvåges, da det har potentialet til at forbedre ydeevnen og tilliden til sprogmodeller, der sampler fra betingede distributioner.
27

At blive forskningsingeniør på et stort LLM-laboratorium

HN +6 kilder hn
fundingmistral
En nyhed har vækket interesse i det store sprogmodel (LLM) fællesskab, da en person delte sin oplevelse med at blive forskningsingeniør på Mistral, et fremtrædende ML foundation model laboratorium. Denne udvikling er værd at lægge mærke til, givet den betydelige finansiering Mistral har modtaget, der overstiger en milliard dollars. Nyheden har fundet genklang hos mange, især på Twitter, hvor personens begejstring blev mødt med spørgsmål og anmodninger om råd om, hvordan man kan følge en lignende karrierevej. Det, der er væsentligt her, er den voksende interesse for LLM-forskning og de muligheder, der er til rådighed for ingeniører og forskere på dette område. Da efterspørgslen på avancerede AI-teknologier fortsætter med at stige, er laboratorier som Mistral i forkanten af innovation, og fagfolk med ekspertise i LLM er meget efterspurgte. Vejen til at blive forskningsingeniør på et sådant laboratorium er ikke tilfældig, som personen antyder, og tyder på en strategisk tilgang til karriereudvikling. Da LLM-landskabet fortsætter med at udvikle sig, vil det være interessant at følge, hvordan fagfolk navigerer deres karriere på dette område. Med den stigende betydning af AI-forskning kan vi forvente flere udviklinger og meddelelser fra fremtrædende laboratorier som Mistral. Da vi følger væksten i LLM-industrien, er det essentiel at holde øje på de muligheder og udfordringer, der opstår for forskere og ingeniører.
26

Nyt tale-til-tale-model frigivet på Hugging Face

Mastodon +5 kilder mastodon
huggingfaceinferencespeechvoice
En ny tale-til-tale-model, Inflect-Micro-v2, er blevet frigivet på Hugging Face, og den kan prale af komplet stemmesyntese i kun 9,36M parametre. Denne model, som er bygget og finansieret uafhængigt af Owen, tilbyder fast stemme på engelsk TTS med deterministiske frø, håndtering af lange tekster og CPU eller CUDA slutledning. Det, der gør denne udvikling betydningsfuld, er dens potentiale til at fremme lokal tale-til-bølgeform-syntese, og dermed give en mere kompakt og effektiv løsning. Som skaberen bemærker, hvis denne udgivelse får fart, planlægger de at fortsætte projektet med en bredere version 3, som muligvis kan inkludere flere sprog og stemmer. Da vi følger udviklingen af AI-modeller på Hugging Face, er denne udgivelse værd at holde øje på, især på baggrund af de seneste sikkerhedsbekymringer omkring OpenAI og Hugging Face, som vi tidligere har rapporteret om. Inflect-Micro-v2-modellen demonstrerer den fortsatte innovation på området, og dens indvirkning på udviklingen af mere avancerede og tilgængelige AI-modeller vil være interessant at observere.

Alle datoer