Dringend 13:10 Studie waarschuwt dat herhaaldelijk druk uitoefenen op AI-chatbots desinformatie kan vergroten 12:47 Rabat Business School breekt de wereldwijde top 10 in Financial Times ranking binnen 12:29 Bombardier benadrukt Amerikaanse economische impact na waarschuwing van Trump 12:12 China blijft Rusland's grootste handelspartner voor het 16de achtereenvolgende jaar 11:47 Goldman Sachs verhoogt olieprijsvoorspellingen terwijl risico's voor scheepvaart in het Midden-Oosten aanhouden 11:30 Overwinning van de AfD roept vragen op over de politieke allianties in Europa en het Oekraïne-beleid 11:19 Google past zijn zoekmachine in Europa aan om sancties van de EU te vermijden 11:11 Duizenden protesteren tegen AfD in Berlijn na verkiezingsoverwinning 10:56 eBay verwijdert geslachtbepalingskits die in India worden aangeboden en opent intern onderzoek 10:56 Yves Brunier, de maker en vertolker van Casimir, is op 85-jarige leeftijd overleden 10:55 Gianni Infantino onder druk na klacht over zijn relaties met Donald Trump 10:55 Huawei geconfronteerd met een belangrijke rechtszaak in de Verenigde Staten over zijn activiteiten in Iran 10:47 Witte Huis viert Marco Rubio met SpongeBob-geïnspireerde Labor Day meme 10:30 Nederlandse regering zegt dat het geen wapenleveringen aan Israël kan blokkeren op Nederlandse vlaggenschepen 10:15 Argentinië escaleert geschil met Groot-Brittannië over olie-exploratie 10:00 Zou een Democratische overwinning de benadering van het Amerikaanse Congres ten opzichte van Rusland veranderen? 09:43 Scheepvaartverkeer door de Straat van Hormuz daalt tot zeven schepen te midden van toenemende spanningen 09:22 EU waarschuwt voor opkomende online-gedreven extremistische dreiging onder jongeren 09:09 Jaguar Land Rover snijdt 4.000 banen door wereldwijde marktdruk 08:45 Peru registreert 5,5% daling in buitenlandse toeristenarrivals in het tweede kwartaal van 2026 08:27 VN-rechters waarschuwt dat geavanceerde AI de toekomst van de mensheid kan bedreigen 08:10 Marokko versterkt zijn rol in nucleaire veiligheid en capaciteitsopbouw in Afrika 07:47 Crisis in Ceuta begint Spaanse toerismeboekingen naar Marokko te beïnvloeden 07:32 WhatsApp ontwikkelt gastoproepfunctie voor gebruikers zonder accounts 07:15 Spanje roept op tot voorzichtigheid over Marokko's vermeende rol in de migratiecrisis van Ceuta 21:36 OpenAI overhandigt Brussel rapport over de kaping van een Duitse website door autonome IA-agenten 21:30 Agrarische exporten: Marokko vestigt zich als de tweede leverancier van blauwe bessen voor Finland 21:25 Ballon d'Or 2026: de lijst van genomineerden wordt dinsdag onthuld voor de ceremonie in Londen 20:50 Parijs: twee verdachten gearresteerd na de diefstal van een Richard Mille horloge ter waarde van 395.000 euro 20:37 Argentijnse Patagonië trekt enorme data center projecten voor AI aan 20:27 Jaguar Land Rover gaat 4.000 banen wereldwijd schrappen om kosten te verlagen 19:10 Nieuw door teken overgedragen virus geïdentificeerd in China veroorzaakt griepachtige symptomen 18:47 Ceuta-economie lijdt verlies van meer dan €33 miljoen te midden van grenscrisis 18:28 TikTok introduceert nieuwe interactieve tools voor opmerkingen en gebruikersbetrokkenheid 18:10 VN roept op tot verantwoording over migrantendoden in Amerikaanse detentie 17:47 Marokkaans vrouwelijk voetbaltalent maakt groeiende indruk op Europese competities 17:32 SpaceX lanceert 27 Starlink-satellieten in lage aardbaan 17:15 De Zuid-Koreaanse economie wint aan kracht door investeringen in AI en export 16:50 Finse man voor de rechter voor vermeend online misbruik van 361 kinderen 16:33 Marokko registreert historisch handelsoverschot met Spanje in 2025 16:15 VN Mensenrechtenraad opent spannende sessie over Soedan, Oekraïne en Myanmar 15:59 Wim Wenders verduidelijkt zijn opmerkingen over cinema en politiek in Venetië 15:52 Lille: Hamza Igamane mist de reguliere fase van de Champions League 15:49 China: Peking verscherpt zijn juridische arsenal tegen de misstanden van kunstmatige intelligentie 15:47 De Europese defensie-industrie heeft moeite om te voldoen aan de oorlogseisen van Oekraïne 15:32 Bondgenoot van Erdogan roept op tot nieuwe grondwet en verkiezingshervormingen in Turkije 15:15 Rusland en Noord-Korea openen nieuwe brug om grensoverschrijdende handel te bevorderen 14:47 Droogte dwingt tot nieuwe beperkingen op het Panamakanaal en bedreigt de wereldhandel 14:29 Indonesië registreert gelijktijdige activiteit bij zes actieve vulkanen 14:25 Merz' nederlaag in Saksen-Anhalt roept vragen op over de veranderende politieke landschap van Duitsland 14:18 Groenland: de Europese Unie versterkt haar partnerschap met Nuuk met een overeenkomst van 200 miljoen euro 14:14 Kernenergie: Saoedi-Arabië bereidt uitbreiding van controlebevoegdheden van het IAEA voor 14:10 Marokko verkent David's Sling terwijl het zijn luchtverdedigingscapaciteiten versterkt 14:05 Marokko streeft naar een sterkere en competitievere positie onder leiding van koning Mohammed VI 13:45 Huawei onthult nieuwe opvouwbare smartphone terwijl premium strijd in China toeneemt 13:28 Zuid-Afrika besteedt bijna 17 miljard rand aan terugkeer van onregelmatige migranten 13:21 IAEA: Syrisch nucleair reactor was bijna voltooid

Studie waarschuwt dat herhaaldelijk druk uitoefenen op AI-chatbots desinformatie kan vergroten

13:10
Studie waarschuwt dat herhaaldelijk druk uitoefenen op AI-chatbots desinformatie kan vergroten

Een nieuwe studie heeft zorgen geuit over de betrouwbaarheid van kunstmatige intelligentie-chatbots, waarbij is vastgesteld dat herhaaldelijk uitdagen of onder druk zetten van deze systemen om valse informatie te accepteren soms de kans vergroot dat ze uiteindelijk instemmen met misleidende beweringen.

Onderzoekers van de Universiteit van Arizona hebben zeven AI-modellen getest, waaronder GPT-3.5, GPT-4o, GPT-4o-mini, Claude 3.5 Sonnet, Gemini 1.5 Pro, Llama 3 70B en DeepSeek-R1. In plaats van een enkele reactie te evalueren, voerden de onderzoekers uitgebreide gesprekken waarin de modellen herhaaldelijk werden blootgesteld aan onjuiste uitspraken.

Het experiment omvatte 100 valse claims die een breed scala aan onderwerpen besloegen, van duidelijk onzinnige beweringen tot meer ambiguïteit. Onderzoekers herhaalden de desinformatie tot wel 50 keer binnen hetzelfde gesprek om te bepalen of de systemen uiteindelijk hun reacties zouden veranderen.

Geen van de zeven modellen bleek volledig resistent tegen het effect. GPT-3.5 toonde het hoogste percentage instemming met valse claims, waarbij het deze accepteerde in 12,3% van de interacties. Claude 3.5 Sonnet registreerde het laagste percentage, met slechts 0,08%, terwijl GPT-4o en GPT-4o-mini onder de 1% bleven.

De onderzoekers ontdekten dat GPT-3.5 aanvankelijk 96 van de 100 geteste valse claims afwees. Nadat de claims 50 keer waren herhaald, stemde het model uiteindelijk in met 18 daarvan.

Een ander patroon dat in het onderzoek werd vastgesteld, was wat de onderzoekers beschrijven als “wankelheid”, waarbij sommige AI-systemen herhaaldelijk wisselden tussen het accepteren en afwijzen van dezelfde misleidende informatie.

De studie suggereerde ook dat ambiguïteit AI-modellen kwetsbaarder kan maken voor desinformatie. Claims over onderwerpen met beperkte of onduidelijke informatie online werden eerder geaccepteerd tijdens herhaalde interacties, waarbij de onderzoekers een statistisch significante relatie identificeerden tussen ambiguïteit en vatbaarheid voor misleidende claims.

De onderzoekers onderzochten verder of meer confronterende uitwisselingen de modellen konden beïnvloeden. De meeste systemen bleven relatief stabiel, maar DeepSeek-R1 toonde een merkbare toename in de acceptatie van desinformatie wanneer het werd onderworpen aan argumentatieve druk. Het acceptatiepercentage steeg van 1% tijdens eenvoudige herhaling naar 22,2% onder meer confronterende omstandigheden.

Het gebruik van sarcasme en herhaalde humoristische reacties maakte sommige interacties ook moeilijker voor onderzoekers om consistent te classificeren.

Er was echter een bemoedigende bevinding toen de modellen de kans kregen om eerdere fouten te heroverwegen. GPT-4o, GPT-4o-mini, Gemini 1.5 Pro en DeepSeek corrigeerden al hun eerder gemaakte fouten. GPT-3.5 corrigeerde slechts 32% van zijn eerdere fouten.

Claude 3.5 Sonnet maakte zeer weinig fouten tijdens de eerste tests, maar slaagde er niet in om de vier fouten die het maakte te corrigeren.

De onderzoekers waarschuwden echter dat de relatief kleine steekproefomvang van de studie de kracht van de conclusies die kunnen worden getrokken, beperkt. De bevindingen benadrukken desalniettemin een bredere uitdaging voor generatieve AI: chatbots kunnen soms de voorkeur geven aan consistentie in gesprekken of responsiviteit boven het handhaven van een stevige afwijzing van onjuiste informatie.

Naarmate AI-systemen steeds meer geïntegreerd worden in onderwijs, onderzoek, werk en dagelijkse besluitvorming, benadrukt de studie het belang van het verifiëren van belangrijke informatie in plaats van aan te nemen dat een zelfverzekerde of herhaalde chatbotreactie noodzakelijkerwijs nauwkeurig is.


  • Fajr
  • Zonsopgang
  • Dhuhr
  • Asr
  • Maghrib
  • Isha

Lees meer

Deze website, walaw.press, gebruikt cookies om u een goede browse-ervaring te bieden en onze diensten voortdurend te verbeteren. Door deze website verder te gebruiken, gaat u akkoord met het gebruik van deze cookies.