A mesterséges intelligencia rendszerek előrejelzési képességeit vizsgáló, egy éven át tartó tesztsorozat újabb szakaszához érkezett, ezúttal a 2026-os labdarúgó-világbajnokság eredményeinek megjóslása volt a feladat. Az eddigi eredmények vegyes képet mutattak: a Super Bowl kimenetelét például egyetlen MI sem találta el, az Oscar-díjak átadásánál két chatbot teljesen téves filmeket jelölt meg, és a választási eredmények sem hoztak hibátlan jóslatokat. A foci-vb azonban új lehetőséget kínált a mesterséges intelligenciák számára, hogy bizonyítsák prognosztikai képességeiket, különösen a dobogós helyezések és a döntő tekintetében.
A vasárnapi döntőben Spanyolország és Argentína mérkőzött meg egymással, ahol végül Spanyolország diadalmaskodott. Ebben a kontextusban egyértelműen a Copilot bizonyult a legpontosabbnak a vizsgált MI-k közül. A chatbot nemcsak a két döntős csapatot, Spanyolországot és Argentínát találta el helyesen, hanem a végső győztest, Spanyolországot is. Bár a bronzérmes csapatot illetően tévedett – a franciák helyett végül az angol válogatott szerezte meg a harmadik helyet –, a döntőre vonatkozó jóslata kiemelkedő pontosságot mutatott a többi mesterséges intelligencia teljesítményéhez képest.
A többi MI-rendszer jóslatai már korántsem voltak ilyen sikeresek. A ChatGPT és a Gemini például egyaránt Brazília jobb szereplését prognosztizálta, mint ami valójában bekövetkezett. A dél-amerikai csapat azonban nem jutott be a legjobb négy közé, miután a negyeddöntőben Norvégia 2-1-re legyőzte őket, ezzel véget vetve reményeiknek. Ez a hiba rávilágít arra, hogy még a fejlettebbnek számító nyelvi modellek is komoly kihívásokkal néznek szembe a sportesemények komplex és kiszámíthatatlan kimenetelének előrejelzésében.
Míg a Copilot kiemelkedett, addig más mesterséges intelligenciák gyengébben szerepeltek a világbajnokság előrejelzésében. A Grok és a DeepSeek például kifejezetten téves jóslatokkal szolgáltak, amelyek a forrás szerint „átverték” az argentin szurkolókat, ami arra utal, hogy a döntőbe jutásukat vagy győzelmüket prognosztizálták tévesen. Habár a legtöbb MI legalább a döntőhöz potenciálisan esélyes csapatok közül válogatott, a pontos párosítást és eredményt nem sikerült eltalálniuk. Fontos megjegyezni, hogy bár a döntőre vonatkozó jóslatokban jelentős eltérések mutatkoztak, a legtöbb MI legalább egy dobogós helyezettet helyesen azonosított, ami némi részleges pontosságot jelez.
A Copilot teljesítménye különösen figyelemre méltó, ha figyelembe vesszük korábbi, kevésbé sikeres próbálkozásait. Korábban például tévesen ítélt meg egy „macskaadóról” szóló hírt, azt gondolva, hogy az valós. A mostani, foci-vb-re vonatkozó pontos előrejelzése jelentős fejlődést mutat a rendszer képességeiben. Ez a siker felveti a kérdést, hogy azok, akik az eredeti teszt során a legnagyobb bizalmat szavazták meg ennek az MI-nek, vajon most elégedetten veregethetik-e meg a vállukat, látva a Copilot kiemelkedő teljesítményét.
A mesterséges intelligenciák próbáltatásai azonban még korántsem értek véget. A tesztsorozat folytatódik, és a közeljövőben további kihívások várnak rájuk. Előttük áll még a Forma-1-es szezon kimenetelének előrejelzése, valamint az Egyesült Államok időközi választásainak eredményeinek prognosztizálása. Ezek az események újabb lehetőséget biztosítanak majd a mesterséges intelligencia rendszerek számára, hogy bizonyítsák vagy cáfolják előrejelzési képességeiket a sport, a politika és más komplex területeken.
A Copilot kiemelkedő teljesítménye a foci-vb előrejelzésében egy fontos mérföldkő az MI-k képességeinek felmérésében, de az átfogó, megbízható előrejelzésekhez vezető út még hosszú és tele van kihívásokkal.
📰 Forrás: Telex — Eredeti cikk elolvasása