tech
초기 AI 챗봇은 텍스트만 다뤘지만, 최신 '프런티어' 모델은 사진, 차트, 음성 질문까지 받아 모두에 응답할 수 있습니다.
멀티모달 모델은 텍스트, 이미지, 오디오, 영상처럼 한 가지 이상의 입력 유형을 하나의 통합된 시스템 안에서 처리하고 이해하도록 만든 AI 시스템으로, 초기 챗봇들처럼 문자로 된 언어에만 국한되지 않습니다. 덕분에 사진을 보여주며 질문하거나, 오디오 클립을 들려주거나, 차트를 공유하면 이런 서로 다른 종류의 정보 사이의 연관성을 파악해 의미 있게 답할 수 있습니다.
오픈웨이트 모델은 내부 매개변수를 누구나 내려받아 쓸 수 있도록 공개한 AI 모델을 말하는 것으로, 모델이 처리할 수 있는 입력 유형이 아니라 접근성과 라이선스에 관한 다른 개념입니다. 오프라인 모델은 그저 인터넷 연결 없이 돌아간다는 뜻으로, 이 역시 여러 형식을 다루는 것과는 무관한 별개의 특성입니다.
이렇게 여러 입력 유형을 하나로 섞는 능력 덕분에 오늘날의 AI 어시스턴트는 사진 속 상황을 설명하거나 차트를 요약하거나 영상에 대한 구두 질문에 답할 수 있습니다. 이런 능력들은 불과 몇 년 전만 해도 완전히 별개의 전용 시스템이 있어야만 가능했을 일들이죠.
tech
완전 무인 상업용 로보택시 서비스를 운영하는 회사는?널리 쓰이는 SAE 척도에서 완전 자동화를 나타내는 가장 높은 단계 숫자는?자동차 회사 테슬라가 공개한 휴머노이드 로봇의 이름은?아프리카에서 이 의료 드론 배송 서비스를 개척한 회사는?아마존의 창고 로봇은 2012년 어떤 로봇 회사를 인수하면서 시작됐을까?인튜이티브 서지컬이 만든 널리 쓰이는 수술 로봇의 이름은?이 레이저 제초 로봇이 농부에게 주는 가장 큰 이점은?이 레이저 기반 거리 측정 기술의 일반적인 이름은?사람과 작업 공간을 공유하도록 만든 이런 로봇을 부르는 일반적인 용어는?로봇에게 이런 촉각과 쥐는 압력을 느끼게 해주는 센서는?EUV 노광 장비는 이 극자외선 빛을 실제로 어떻게 만들어낼까?현대 공정 노드의 'nm' 숫자는 실제로 무엇을 뜻할까?Quration — Quration Play