Quration Play

tech

Uma nova geração de modelos de IA para para 'pensar' passo a passo antes de responder, gastando mais computação no momento da pergunta e não só no treino.

Qual é o principal benefício desses modelos de 'raciocínio'?

Melhores respostas em matemática e lógica difíceis
Ao gerar uma cadeia de pensamento oculta, modelos de raciocínio como o o1 da OpenAI trocam respostas mais lentas e caras por grandes ganhos em matemática, código e lógica complexos. Esse 'cálculo na inferência' mostra que pensar mais na hora de responder pode superar apenas aumentar o modelo.

Modelos de raciocínio fazem uma pausa para resolver um problema em etapas intermediárias antes de produzir uma resposta final, em vez de gerar uma resposta em uma única passada imediata, como os chatbots anteriores costumavam fazer. Ao gastar esforço computacional extra no momento em que você faz uma pergunta, gerando um rascunho interno de raciocínio, esses modelos conseguem detectar erros, explorar múltiplas abordagens e lidar com problemas de várias etapas, melhorando perceptivelmente o desempenho em matemática difícil, quebra-cabeças de lógica e tarefas complexas de programação.

Esses modelos ainda exigem uma conexão com a internet quando executados por um serviço em nuvem, então essa opção interpreta mal a forma como são implantados. Eles também não usam menos memória do que modelos mais antigos; o raciocínio adicional passo a passo tende a usar mais recursos computacionais por resposta, já que gerar esse raciocínio oculto exige tempo e poder de processamento extras.

Isso mostra que simplesmente tornar um modelo maior não é o único caminho para um desempenho melhor; deixar um modelo "pensar por mais tempo" no momento da pergunta às vezes pode igualar ou superar os ganhos obtidos ao treinar um modelo ainda maior do zero.

▶ Quration Play

tech

O que a Geração Aumentada por Recuperação (RAG) faz?Qual é uma vantagem fundamental dessa IA 'no dispositivo'?Como um modelo de 'Mistura de Especialistas' consegue isso?Como se chama esse material de treinamento gerado por IA?Como se chama a segunda abordagem, a de treinar com exemplos?Como essa 'marca d'água' de texto geralmente funciona?Como se chama essa técnica de treinamento?Como se chama essa técnica de compressão?Como se chamam os modelos de IA que lidam com vários tipos de entrada ao mesmo tempo?Qual empresa opera esse serviço comercial de robotáxi totalmente sem motorista?Na conhecida escala SAE, qual é o número de nível mais alto, que representa a automação total?Qual é o nome do robô humanoide apresentado pela montadora Tesla?

Quration — Quration Play