OpenAI promete comunicar sistematicamente 'desalinhamentos' de IA
A iniciativa da empresa busca mostrar aos observadores externos as capacidades da IA de vanguarda, a fim de promover uma reflexão sobre o ritmo de desenvolvimento dessa tecnologia.
A indústria não "resolveu a questão do alinhamento [dos modelos com os valores humanos] e da supervisão em um nível suficiente para que possamos continuar desenvolvendo a IA a toda a velocidade por muito mais tempo", adverte a OpenAI no documento divulgado hoje.
A partir de agora, a empresa vai relatar problemas relacionados, entre outras coisas, com as ações realizadas por uma IA sem autorização, a saída do marco de supervisão e a coordenação espontânea entre IAs. Não será necessário que um incidente tenha causado danos ou faça parte de um padrão mais amplo para que a OpenAI o mencione.
O escopo abrange todas as etapas do ciclo de vida da IA, do desenvolvimento à implantação, passando pela avaliação e os testes. Dos seis exemplos revelados hoje, nenhum teve consequências significativas, mas eles confirmam tendências já observadas.
Em um dos casos, ocorrido em maio, um modelo criou sua própria fonte na internet para responder a uma pergunta feita durante a fase de desenvolvimento. Citou, portanto, um documento que ele mesmo havia criado.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.