Red Hot Cyber
Condividi la tua difesa. Incoraggia l'eccellenza. La vera forza della cybersecurity risiede nell'effetto moltiplicatore della conoscenza.
Condividi la tua difesa. Incoraggia l'eccellenza.
La vera forza della cybersecurity risiede
nell'effetto moltiplicatore della conoscenza.
UtiliaCS 970x120
TM RedHotCyber 320x100 042514
AI Senza Dati: Entro il 2026 potremmo esaurire i dati di addestramento. Cosa succederà dopo?

AI Senza Dati: Entro il 2026 potremmo esaurire i dati di addestramento. Cosa succederà dopo?

12 Novembre 2023 09:30

Recentemente avevamo parlato del fatto che l’intelligenza artificiale, una volta che utilizzerà i propri dati per alimentarsi, avrebbe potuto perdere di qualità e precisione. Una nuova ricerca inizia a prendere in considerazione il fatto che tra qualche anno, i dati prodotti dagli umani inizieranno a scarseggiare.

Questo determinerà meno informazioni per le IA ma anche un problema da risolvere da parte degli scienziati.

L’esaurimento dei dati di addestramento

L’intelligenza artificiale (AI), che ha raggiunto l’apice della popolarità, deve far fronte alla mancanza di dati di addestramento necessari per il suo funzionamento. Ciò potrebbe rallentare lo sviluppo di modelli di intelligenza artificiale. In particolare di modelli linguistici di grandi dimensioni, e persino cambiare il corso della rivoluzione dell’intelligenza artificiale.


Cyber Offensive Fundamentale Ethical Hacking 02

Avvio delle iscrizioni al corso Cyber Offensive Fundamentals
Vuoi smettere di guardare tutorial e iniziare a capire davvero come funziona la sicurezza informatica?
La base della sicurezza informatica, al di là di norme e tecnologie, ha sempre un unico obiettivo: fermare gli attacchi dei criminali informatici. Pertanto "Pensa come un attaccante, agisci come un difensore". Ti porteremo nel mondo dell'ethical hacking e del penetration test come nessuno ha mai fatto prima. Per informazioni potete accedere alla pagina del corso oppure contattarci tramite WhatsApp al numero 379 163 8765 oppure scrivendoci alla casella di posta [email protected].


Supporta Red Hot Cyber attraverso: 

  1. L'acquisto del fumetto sul Cybersecurity Awareness
  2. Ascoltando i nostri Podcast
  3. Seguendo RHC su WhatsApp
  4. Seguendo RHC su Telegram
  5. Scarica gratuitamente “Byte The Silence”, il fumetto sul Cyberbullismo di Red Hot Cyber

Se ti piacciono le novità e gli articoli riportati su di Red Hot Cyber, iscriviti immediatamente alla newsletter settimanale per non perdere nessun articolo. La newsletter generalmente viene inviata ai nostri lettori ad inizio settimana, indicativamente di lunedì.

L’addestramento di algoritmi IA potenti e accurati richiede grandi quantità di dati. Ad esempio, ChatGPT è stato addestrato su 300 miliardi di parole. Allo stesso modo, DALL-E, Lensa e Midjourney sono stati addestrati su set di dati LIAON-5B contenente 5,8 miliardi di coppie immagine-testo. Se un algoritmo viene addestrato su dati insufficienti, potrebbe produrre risultati imprecisi o di bassa qualità.

La ricerca mostra che il patrimonio di dati di Internet sta crescendo molto più lentamente rispetto ai set di dati utilizzati per addestrare l’intelligenza artificiale. 

il 2026 potrebbe essere la data limite

L’anno scorso, un gruppo di ricercatori ha previsto che i dati testuali di qualità si esauriranno entro il 2026. Questa previsione è state definita sulla base delle attuali tendenze di formazione dell’IA continueranno. Si stima inoltre che i dati linguistici di bassa qualità si esauriranno tra il 2030 e il 2050. Inoltre le immagini di bassa qualità si esauriranno tra il 2030 e il 2060. La mancanza di dati utilizzabili potrebbe rallentare lo sviluppo dell’intelligenza artificiale. Questo mentre si prevede che l’economia AI contribuirà fino a 15,7 trilioni di dollari all’economia globale entro il 2030.

Tuttavia, ci sono modi per risolvere il problema della carenza di dati. 

Soluzioni per poter generare nuovi dati

Una possibilità è migliorare gli algoritmi di intelligenza artificiale per utilizzare meglio i dati esistenti. Nei prossimi anni, gli sviluppatori saranno probabilmente in grado di addestrare sistemi di IA utilizzando meno dati e forse meno potenza di calcolo. Ciò contribuirà anche a ridurre l’impronta di carbonio dell’intelligenza artificiale. 

Un’altra opzione è utilizzare l’intelligenza artificiale per creare dati sintetici per addestrare i sistemi. Gli sviluppatori possono semplicemente generare i dati necessari adatti al loro modello di intelligenza artificiale specifico. Diversi progetti utilizzano già contenuti sintetici, spesso ottenuti da servizi di generazione dati. Questo diventerà più comune in futuro

Ti è piaciuto questo articolo? Ne stiamo discutendo nella nostra Community su LinkedIn, Facebook e Instagram. Seguici anche su Google News, per ricevere aggiornamenti quotidiani sulla sicurezza informatica o Scrivici se desideri segnalarci notizie, approfondimenti o contributi da pubblicare.

Cropped RHC 3d Transp2 1766828557 300x300
La redazione di Red Hot Cyber è composta da professionisti del settore IT e della sicurezza informatica, affiancati da una rete di fonti qualificate che operano anche in forma riservata. Il team lavora quotidianamente nell’analisi, verifica e pubblicazione di notizie, approfondimenti e segnalazioni su cybersecurity, tecnologia e minacce digitali, con particolare attenzione all’accuratezza delle informazioni e alla tutela delle fonti. Le informazioni pubblicate derivano da attività di ricerca diretta, esperienza sul campo e contributi provenienti da contesti operativi nazionali e internazionali.

Articoli in evidenza

Immagine del sitoCybercrime
Morte on demand: le reti digitali che trasformano i ragazzi e i disabili in killer
Redazione RHC - 13/01/2026

Negli ultimi mesi si sta parlando sempre più spesso di un cambio di paradigma nel cybercrime. Quello che per anni è stato percepito come un ecosistema prevalentemente digitale — fatto di frodi, furti di identità,…

Immagine del sitoCybercrime
Basta un riavvio: il trucco che spegne Windows Defender prima ancora che parta
Redazione RHC - 13/01/2026

A volte, per disattivare la protezione di Windows non è necessario attaccare direttamente l’antivirus. È sufficiente impedirne il corretto avvio. Un ricercatore che si fa chiamare Two Seven One Three (TwoSevenOneT) ha pubblicato su GitHub…

Immagine del sitoCultura
La mente dietro le password: Errore umano? No, un legame che non c’è. Puntata 4
Simone D'Agostino - 13/01/2026

Quando la sicurezza fallisce prima ancora dell’errore Questo testo nasce dall’esperienza diretta, maturata osservando nel tempo numerosi casi di frodi e incidenti informatici, in cui il fattore umano nella sicurezza è stato l’elemento che ha…

Immagine del sitoCultura
Burnout: un allarme di sistema nell’IT e nella Cyber Security aziendale
Paloma Donadi - 13/01/2026

Nel mondo della cybersecurity si parla spesso di attacchi, vulnerabilità, incidenti. Si parla meno di una variabile silenziosa che attraversa tutto il settore: la fatica. Non la stanchezza di fine giornata, ma una fatica più…

Immagine del sitoCyberpolitica
Quando il segnale muore, il potere vince: il blackout digitale dell’Iran
Roberto Villani - 13/01/2026

A volte le cose importanti non arrivano in conferenza stampa. Arrivano come un grafico che smette di respirare: la linea della connettività che crolla, l’OSINT che si inaridisce, il rumore che cresce perché il segnale…