-
Nova York fecha 12 sites de pornografia "deepfake" com imagens de celebridades e políticos
-
Venezuela é convidada para reuniões do G20 nos EUA sobre 'abundância energética'
-
Maior refinaria da África abre seu capital na bolsa
-
Trump diz que há uma 'conspiração doentia' contra a IA
-
Novo Nordisk, fabricante do Ozempic, encurta nome para 'Novo'
-
Kennedy Center enfrenta risco de falência e fechamento, afirma Washington Post
-
Indonésia retoma busca de desaparecidos após naufrágio de balsa
-
Resultado indefinido nas eleições da Suécia; extrema direita perde terreno
-
Claro lança serviço de filtro de telemarketing e entra na disputa com Vivo
-
Como os semáforos inteligentes com IA estão reduzindo o trânsito em grandes cidades
-
Autonomia de carros elétricos após oito anos: perda média e fatores
-
نوشا آوبل دم از مسئولیت میزند؛ خرابی خیابانهای پوتسدام گواه ضعف مدیریت اوست
-
Esquerda social-democrata lidera eleições na Suécia e extrema direita perde terreno
-
Seis mortos e 129 desaparecidos após naufrágio de balsa na Indonésia
-
Polônia denuncia 'escalada' de Moscou após ataque a trem na fronteira com Ucrânia
-
Governo dos EUA reluta em regulamentar IA
-
Restringir IA em excesso pode beneficiar China, diz presidente da Câmara dos EUA
-
Diretor da Casa Argentina em Paris renuncia ao cargo
-
Suécia vota em eleições acirradas com extrema direita em busca do governo
-
'Segunda chance': sobrevivente do Nepal relata sua odisseia preso em um túnel
-
OpenAI anuncia que não abrirá seu capital este ano
-
iPhone 18預購後出現可疑扣款 四間銀行調查未授權交易
-
Seis mortos e mais de 100 desaparecidos após naufrágio de balsa na Indonésia
-
Enel é autuada por Procon após falha de energia no Shopping Plaza
-
Galaxy Tab S12系列效果圖曝光 Ultra擬配雙鏡頭及瀏海螢幕
-
اليورو يستقر في البنوك المصرية وأعلى سعر للبيع 59.85 جنيه
-
الأرصاد السعودية تتوقع سيولاً وأمطاراً رعدية في خمس مناطق
-
ستاندرد آند بورز تثبت تصنيف السعودية عند A+
-
França minimiza hipótese de ato deliberado após descarrilamento de trem
-
Gigantes da IA concordam em frear seu desenvolvimento
-
Incêndio em balsa nas Filipinas deixa 76 mortos
-
'O Segredo de Widow's Bay' e 'The Pitt' chegam como favoritos ao Emmy
-
França investiga possível ato deliberado após descarrilamento de trem
-
Conselho de Supervisão da Meta pede que verificação não seja substituída por 'Notas da Comunidade'
-
Matemáticos alertam para 'efeito destrutivo' da IA em sua disciplina
-
Venezuela assina com Suriname acordo de cooperação em hidrocarbonetos
-
Deputados britânicos rejeitam legalização da morte assistida
-
Economia da França 'perde fôlego' antes de ano eleitoral incerto
-
Inflação dos EUA se mantém estável em agosto, a 3,4%
-
Reconstrução após desastre no Himalaia tem custo estimado de US$ 4,78 bilhões, diz Nepal
-
Nova York recorda os atentados de 11 de setembro sem Donald Trump
-
Putin chega à Índia para cúpula do Brics marcada por tensões geopolíticas
-
Carney diz que Canadá está pronta para acordo comercial "justo" com EUA
-
Rede de verificadores da América Latina pede à Meta que não substitua a checagem de fatos profissional
-
Família real de Uganda em 'prisão domiciliar' em meio à disputa por sucessão
-
'Vestido da vingança' da princesa Diana será leiloado em Nova York
-
BCE eleva taxas de juros para 2,5% devido à inflação pela guerra no Oriente Médio
-
Incêndio em navio de carga na China deixa ao menos 25 mortos
-
Céline Dion, o retorno de uma diva incansável
-
Estreito de Bab el-Mandeb, a outra passagem marítima ameaçada no Oriente Médio
ChatGPT e IA conversacional continuam incapazes de raciocinar, diz estudo
Os grandes modelos de linguagem (LLM, na sigla em inglês), como o ChatGPT, um dos sistemas de inteligência artificial (IA) mais populares do mundo, ainda seguem tendo dificuldades para raciocinar usando a lógica e cometem erros frequentes, de acordo com um estudo.
Estes robôs conversacionais refletem os preconceitos de gênero, éticos e morais dos humanos presentes nos textos dos quais se alimentam, recorda o estudo publicado na quarta-feira (5) na revista Open Science da Royal Society britânica.
Mas eles também refletem estes preconceitos nos testes de raciocínio?, questionou Olivia Macmillan-Scott, doutoranda do departamento de Ciências da Computação da University College de Londres (UCL).
O resultado da pesquisa é que os LLM mostram "um raciocínio muitas vezes irracional, mas de uma forma diferente da dos humanos", explica a pesquisadora à AFP.
Sob a supervisão de Mirco Musolesi, professor e diretor do Machine Intelligence Lab da UCL, Macmillan-Scott apresentou sete modelos de linguagem — duas versões do ChatGPT (3.5 e 4), da OpenAI, Bard, do Google, Claude 2, da Anthropic, e três versões de LLaMA, da Meta — a uma série de testes psicológicos desenvolvidos para humanos.
Como esta tecnologia aborda o preconceito que leva a privilegiar soluções com um maior número de elementos, em detrimento daquelas com uma proporção adequada?
Um exemplo: se tivermos uma urna com nove bolinhas brancas e uma vermelha e outra urna com 92 bolinhas brancas e 8 vermelhas, qual devemos escolher para ter a melhor chance de obter uma bolinha vermelha?
A resposta correta é a primeira urna, visto que há 10% de possibilidades frente a 8% da segunda opção.
As respostas dos modelos de linguagem foram muito inconsistentes. Alguns responderam corretamente ao mesmo teste seis em cada dez vezes. Outros apenas duas em cada dez, embora o teste não tenha mudado. "Cada vez obtemos uma resposta diferente", diz a pesquisadora.
Os LLM "podem ser bons para resolver uma equação matemática complicada, mas logo te dizem que 7 mais 3 é igual a 12", constatou.
- "Não tenho muita certeza" -
Estes modelos "não falham nestas tarefas da mesma forma que um humano", afirma o estudo. É o que Musolesi chama de "erros de máquina".
"Existe uma forma de raciocínio lógico que é potencialmente correta se a considerarmos por etapas, mas que é errada tomada como um todo", ressalta.
A máquina funciona com "uma espécie de pensamento linear", diz o professor, e cita o modelo Bard (atual Gemini), capaz de realizar corretamente as diferentes fases de uma tarefa, mas que obtém um resultado final incorreto por não ter uma visão geral.
Sobre esta questão, o professor de ciências da computação Maxime Amblard, da University of Lorraine, na França, recorda que os LLM, como todas as inteligências artificiais generativas, não funcionam como os humanos".
Os humanos são "máquinas capazes de criar significado", o que as máquinas não conseguem, explica à AFP.
Existem diferenças entre os diferentes modelos de linguagem e em geral, o GPT-4, sem ser infalível, obteve resultados melhores que os demais.
Macmillan-Scott suspeita que os modelos "fechados", cujo código operacional permanece secreto, "incorporam mecanismos em segundo plano" para responder a questões matemáticas.
De toda forma, neste momento é impensável confiar uma decisão importante a um LLM. Segundo o professor Musolesi, eles deveriam ser treinados para responder "não tenho muita certeza" quando necessário.
Y.Jeong--CPN