tech
Uma nova geração de modelos de IA para para 'pensar' passo a passo antes de responder, gastando mais computação no momento da pergunta e não só no treino.
Modelos de raciocínio fazem uma pausa para resolver um problema em etapas intermediárias antes de produzir uma resposta final, em vez de gerar uma resposta em uma única passada imediata, como os chatbots anteriores costumavam fazer. Ao gastar esforço computacional extra no momento em que você faz uma pergunta, gerando um rascunho interno de raciocínio, esses modelos conseguem detectar erros, explorar múltiplas abordagens e lidar com problemas de várias etapas, melhorando perceptivelmente o desempenho em matemática difícil, quebra-cabeças de lógica e tarefas complexas de programação.
Esses modelos ainda exigem uma conexão com a internet quando executados por um serviço em nuvem, então essa opção interpreta mal a forma como são implantados. Eles também não usam menos memória do que modelos mais antigos; o raciocínio adicional passo a passo tende a usar mais recursos computacionais por resposta, já que gerar esse raciocínio oculto exige tempo e poder de processamento extras.
Isso mostra que simplesmente tornar um modelo maior não é o único caminho para um desempenho melhor; deixar um modelo "pensar por mais tempo" no momento da pergunta às vezes pode igualar ou superar os ganhos obtidos ao treinar um modelo ainda maior do zero.
tech
O que a Geração Aumentada por Recuperação (RAG) faz?Qual é uma vantagem fundamental dessa IA 'no dispositivo'?Como um modelo de 'Mistura de Especialistas' consegue isso?Como se chama esse material de treinamento gerado por IA?Como se chama a segunda abordagem, a de treinar com exemplos?Como essa 'marca d'água' de texto geralmente funciona?Como se chama essa técnica de treinamento?Como se chama essa técnica de compressão?Como se chamam os modelos de IA que lidam com vários tipos de entrada ao mesmo tempo?Qual empresa opera esse serviço comercial de robotáxi totalmente sem motorista?Na conhecida escala SAE, qual é o número de nível mais alto, que representa a automação total?Qual é o nome do robô humanoide apresentado pela montadora Tesla?Quration — Quration Play