
AI gratuită de la Microsoft a depășit OpenAI și Google la navigarea pe web
Fara1.5 de la Microsoft Research, o familie de agenți de navigare web open-weight, a depășit Operatorul OpenAI și Gemini 2.5 Computer Use de la Google pe un benchmark live-web. Această realizare evidențiază progresele în AI open-source și potențialul său de a concura cu modelele proprietare de top.
Rezumat Detaliat
Microsoft Research a dezvoltat Fara1.5, o suită de agenți de navigare web open-weight, care a depășit performanța Operatorului OpenAI și a Gemini 2.5 Computer Use de la Google în sarcinile de navigare live-web. Aceasta marchează o etapă importantă în dezvoltarea AI open-source, demonstrând capacitatea sa de a rivaliza cu performanța modelelor proprietare consacrate. Benchmark-ul utilizat este considerat unul dintre cele mai dificile din industrie, demonstrând capacitatea agenților de a naviga și de a interacționa eficient cu site-urile web din lumea reală.
Succesul Fara1.5 este atribuit arhitecturii sale open-weight, permițând o mai mare transparență și contribuții din partea comunității. Agenții sunt proiectați să navigheze autonom pe web, să finalizeze sarcini și să extragă informații. Aceștia utilizează tehnici avansate de procesare a limbajului natural și interacțiune web pentru a înțelege și executa instrucțiuni complexe. Detaliile tehnice specifice, cum ar fi algoritmii de bază și datele de antrenament, sunt probabil detaliate în documentația Microsoft Research, deși articolul nu le oferă.
Implicațiile performanței Fara1.5 sunt substanțiale, potențial accelerând dezvoltarea AI open-source și stimulând o mai mare concurență în domeniu. Acest lucru ar putea duce la soluții AI mai accesibile și mai inovatoare. Următorii pași implică probabil o rafinare suplimentară a agenților, extinderea capacităților lor și explorarea de noi aplicații pentru navigarea web și regăsirea informațiilor.
⚠️ Notă: Acesta este un rezumat generat automat. Drepturile asupra conținutului aparțin sursei originale. Citește articolul complet aici
Sursa originală
Citește articolul complet aici
Articole similare
330 Modele Lingvistice Testate pe Coreeană; Jumătate Au Eșuat în Utilizarea Alfabetului Corect
Un studiu care a evaluat 330 de modele lingvistice pentru capacitățile lor în limba coreeană a relevat că peste jumătate au eșuat în utilizarea consecventă a alfabetului corect. O funcție simplă de patru rânduri s-a dovedit extrem de eficientă în descalificarea unei porțiuni semnificative de răspunsuri incorecte, subliniind limitările modelelor actuale în gestionarea nuanțelor lingvistice.
Certinia la Dreamforce: Previziuni despre AI în Serviciile Profesionale
Evenimentul Certinia de la Dreamforce va explora evoluția AI în serviciile profesionale, trecând de la productivitatea individuală la transformarea modului în care firmele își coordonează munca și livrează valoare. Accentul va fi pus pe valorificarea inteligenței partajate pentru a îmbunătăți luarea deciziilor și rezultatele în cadrul angajamentelor, conectând datele operaționale cu contextul proiectului și cunoștințele instituționale.
Profound strânge 180 de milioane de dolari pentru a spori vizibilitatea brandurilor în servicii AI
Startup-ul de tehnologie de marketing Profound a anunțat o rundă de finanțare Seria D de 180 de milioane de dolari, atingând o evaluare de 1,8 miliarde de dolari. Investiția, co-condusă de Sequoia Capital și Kleiner Perkins, vizează să ajute companiile să-și îmbunătățească vizibilitatea în peisajul în rapidă creștere al serviciilor AI.
Startup-ul de certificare a agenților AI, AIUC, strânge 40 de milioane de dolari pentru a audita modelele de frontieră
Artificial Intelligence Underwriting Company (AIUC), o companie specializată în certificarea agenților AI, a obținut o finanțare de 40 de milioane de dolari. Acești bani vor permite extinderea serviciilor de auditare pentru a acoperi modelele AI de frontieră, nu doar agenții construiți pe acestea. AIUC consideră că incertitudinile actuale legate de riscurile AI încetinesc adopția tehnologiei.