Je hebt een klacht over de onderstaande posting:
Door _R0N_: Veel van de gebruikte bronnen hebben nooit op het web gestaan vanwege de auteursrechten. Boeken zijn betrouwbaarder dan de data op het internet, dus alle boeken zijn van belang. Ik was ergens anders een bericht tegengekomen (ik dacht in het Engels) waarin werd gesteld dat het om boeken ging die ouder waren dan een aantal jaar. Het gaat ze erom dat de boeken geen door AI gegenereerde inhoud bevatten, volledig door mensen zijn geschreven. Een probleem met hoe de huidige AI-bedrijven AI aanpakken is dat momenteel een flink deel van de nieuwe inhoud van het internet door LLM's wordt gegenereerd. Als je LLM's traint met wat door LLM's gegenereerd is krijg je slechtere resultaten dan wanneer ze het traint met tekst die door mensen is geschreven. Ik ben alweer een poos terug tegengekomen dat de nieuwere modellen, al zijn ze in bepaalde opzichten krachtiger dan hun voorgangers, ook aanzienlijk meer hallucineren dan hun voorgangers. Bedenk dat een LLM een soort statistisch model is van de tekst waarmee ...
Beschrijf je klacht (Optioneel):