Atvirojo kodo LLM koregavimas naudojant „Axolotl“ naudojant tiesioginį nuostatų optimizavimą (DPO) – „SitePoint“
LLM atrakino daugybę naujų galimybių dirbtinio intelekto programoms. Jei kada nors norėjote…
Allen institutas AI (AI2) išleido OLMo 2: naują atvirojo kodo 7B ir 13B kalbų modelių šeimą, išmokytą naudoti iki 5T žetonų
Kuriant kalbos modeliavimą pagrindinis dėmesys skiriamas dirbtinio intelekto sistemų kūrimui, kurios gali…
Antropinis atvirojo šaltinio modelio konteksto protokolas (MCP): DI integracijos pakeitimas su universaliu duomenų ryšiu, kad būtų sukurtos pažangesnės, kontekstą suvokiančios ir keičiamo dydžio programos įvairiose pramonės šakose
Anthropic sukūrė atvirojo kodo Modelio konteksto protokolas (MCP)tai svarbus žingsnis gerinant AI…
aiOla išleido Whisper-NER: atvirojo kodo AI modelį, skirtą bendrai kalbos transkripcijai ir objektų atpažinimui
Kalbos atpažinimo technologija padarė didelę pažangą, o dirbtinio intelekto pažanga pagerino pasiekiamumą…
„Tencent“ išleido „Hunyuan-Large“ (Hunyuan-MoE-A52B) modelį: naują atvirojo kodo transformatoriumi pagrįstą MoE modelį, kuriame iš viso yra 389 milijardai parametrų ir 52 milijardai aktyvių parametrų
Dideli kalbos modeliai (LLM) tapo daugelio dirbtinio intelekto sistemų pagrindu, o tai…

