Da una settimana, OpenAI ha lanciato e successivamente ritirato un aggiornamento per ChatGPT dopo che quasi tutti gli utenti hanno segnalato un comportamento bizzarro. L’azienda ha spiegato l’accaduto in un post sul blog pubblicato questa sera.
Gli utenti di ChatGPT desiderano che il chatbot sia più personale e meno clinico. Il chatbot Claude di Anthropic è spesso descritto come più umano nelle sue risposte rispetto allo stile più formale di OpenAI. Per questo motivo, OpenAI ha rilasciato un aggiornamento al suo modello GPT-4o la scorsa settimana, che secondo il capo dell’azienda Sam Altman, “ha migliorato sia l’intelligenza che la personalità”.
Due giorni dopo, Altman ha riconosciuto qualcosa che ogni utente aveva notato: gli ultimi aggiornamenti di GPT-4o hanno reso la personalità troppo servile e fastidiosa (anche se ci sono alcuni aspetti molto buoni), e stiamo lavorando a delle correzioni il prima possibile, alcune oggi e altre questa settimana. A un certo punto condivideremo le nostre scoperte, è stato interessante.
In pratica, ChatGPT rispondeva con lodi incredibilmente inautentiche a qualsiasi domanda che richiedesse un feedback. Era comicamente pessimo e scomodo.
Per quanto riguarda ciò che è successo, OpenAI attribuisce la colpa a un focus eccessivo sul feedback a breve termine rispetto all’uso a lungo termine. Nell’aggiornamento della scorsa settimana di GPT-4o, abbiamo apportato modifiche mirate a migliorare la personalità predefinita del modello per renderlo più intuitivo ed efficace in una varietà di compiti. Tuttavia, ci siamo concentrati troppo sul feedback a breve termine e non abbiamo tenuto pienamente conto di come le interazioni degli utenti con ChatGPT evolvono nel tempo. Di conseguenza, GPT-4o si è orientato verso risposte eccessivamente supportive ma disoneste.
La soluzione, al momento, è stata quella di annullare completamente le modifiche rilasciate la scorsa settimana.
Il piano d’azione in quattro punti di OpenAI getta più luce sulla situazione:
- Raffinare le tecniche di addestramento di base e i prompt di sistema per indirizzare esplicitamente il modello lontano dalla servilità.
- Costruire più barriere per aumentare l’onestà e la trasparenza, principi nel nostro Model Spec.
- Espandere i modi per consentire a più utenti di testare e fornire feedback diretto prima del lancio.
- Continuare ad ampliare le nostre valutazioni, basandoci sul Model Spec e sulla nostra ricerca continua, per aiutare a identificare problemi oltre la servilità in futuro.
In altre parole, OpenAI voleva costruire una personalità più gentile e di supporto per ChatGPT. Ciò che è stato rilasciato corrispondeva a questa descrizione ma ha superato una soglia di realismo. Si è scoperto che aggiungere più personalità al tuo chatbot richiede più lavoro del previsto.
In futuro, OpenAI afferma di voler includere opzioni di personalità predefinite e formare personalità basate sul feedback diretto degli utenti.
Fonte: 9to5Mac

