Quration Play

tech

May bagong alon ng mga AI model na huminto muna para 'mag-isip' nang hakbang-hakbang bago sumagot, gumagamit ng dagdag na computing power sa oras ng tanong, hindi lang sa training.

Ano ang pangunahing benepisyo ng mga 'reasoning' model na ito?

Mas magagaling na sagot sa mahirap na math at lohika
Sa paglikha ng nakatagong chain of thought, ang mga reasoning model tulad ng o1 ng OpenAI ay nagpapalit ng mas mabagal at magastos na sagot para sa malaking pag-angat sa kumplikadong math, code, at lohika. Ipinapakita ng 'compute habang sumasagot' na ang mas matagal na pag-iisip ay maaaring mangibabaw kaysa basta palakihin ang model.

Ang mga reasoning model ay huminto muna upang lutasin ang isang problema sa mga hakbang na intermedya bago gumawa ng huling sagot, sa halip na bumuo ng sagot sa iisang agad na daan tulad ng ginagawa ng mas maagang chatbot noon. Sa paglalaan ng dagdag na pagsisikap sa pagkalkula sa sandaling itinatanong mo ang isang tanong, na bumubuo ng panloob na scratchpad ng pangangatwiran, kaya ng mga modelong ito na mahuli ang mga pagkakamali, siyasatin ang maraming paraan, at hawakan ang mga problemang may maraming hakbang, na kapansin-pansing nagpapahusay ng performance sa mahihirap na matematika, puzzle ng logic, at komplikadong gawain sa coding.

Kailangan pa rin ng mga modelong ito ng koneksiyon sa internet kapag pinapatakbo sa pamamagitan ng cloud service, kaya't hindi tama ang pagpapaliwanag na iyon kung paano ito ginagamit. Hindi rin sila gumagamit ng mas kaunting memory kaysa sa mas lumang modelo; ang dagdag na hakbang-hakbang na pangangatwiran ay kadalasang gumagamit ng mas maraming computing resource sa bawat sagot, dahil ang pagbuo ng nakatagong pangangatwirang iyon ay tumatagal ng dagdag na oras at kuryente sa pagproseso.

Ipinapakita nito na ang paggawa lamang ng modelo nang mas malaki ay hindi lamang ang tanging paraan tungo sa mas mahusay na performance; ang pagpapahintulot sa isang modelo na "mag-isip nang mas matagal" sa sandaling ka nagtatanong ay maaari minsan tumugma o tumalo sa gains mula sa pagte-train ng mas malaking modelo mula sa wala.

▶ Quration Play

tech

Ano ang ginagawa ng Retrieval-Augmented Generation (RAG)?Ano ang isang mahalagang bentahe ng 'on-device' AI na ito?Paano ito nagagawa ng isang 'Mixture of Experts' na modelo?Ano ang tawag sa ganitong training material na gawa ng AI?Ano ang tawag sa ikalawang paraan, ang pagsasanay gamit ang mga halimbawa?Paano karaniwang gumagana ang 'watermarking' na ito sa teksto?Ano ang tawag sa teknik na ito ng pagsasanay?Ano ang tawag sa teknik na ito ng compression?Ano ang tawag sa mga AI model na sabay-sabay na humahawak ng ilang uri ng input?Anong kompanya ang nagpapatakbo ng ganap na walang-drayber na komersyal na robotaxi na ito?Sa kilalang SAE scale, ano ang pinakamataas na numero ng antas na kumakatawan sa ganap na automation?Ano ang pangalan ng humanoid na robot na inilabas ng gumagawa ng sasakyang Tesla?

Quration — Quration Play