(XINHUA) – SHANGHAI, 18 GEN – Un modello linguistico di nuova generazione di grandi dimensioni, in grado di accogliere ed elaborare circa 300.000 caratteri cinesi alla volta, è stato presentato ieri a Shanghai.
La lunghezza limitata del contesto dei modelli di grandi dimensioni costituisce un problema significativo nell’intelligenza artificiale.
Il nuovo modello, InternLM2, è stato sviluppato dallo Shanghai Artificial Intelligence Laboratory, dal SenseTime, dall’Università cinese di Hong Kong, e dalla Fudan University.
In un esperimento, i ricercatori hanno somministrato al modello la trascrizione di un incontro pubblico della durata di tre ore e gli hanno chiesto di estrarre le informazioni salienti.
I risultati del test hanno dimostrato che, nonostante la presenza di molti errori di battitura nel testo non revisionato, InternLM2 è in grado di estrarre con precisione le informazioni chiave e di riassumere i punti principali dell’oratore.
Gli sviluppatori mirano a far progredire la capacità di modellazione linguistica della base del modello migliorando la qualità del corpus e la densità delle informazioni.
Lo Shanghai Artificial Intelligence Laboratory ha dichiarato di continuare a concedere InternLM2 in licenza per uso commerciale gratuito. (XINHUA)
