핵심 요약: AI Weekly Roundup - Key Developments. 이어서 데이터 크기 달라져도 AI 예측 정확도 유지. 배경으로는 데이터 크기 달라져도 AI 예측 정확도 유지 - 동아사이언스를...

관련 사실관계와 후속 흐름을 정리하고 있습니다.

OpenAI와 DeepSeek이 신규 AI 모델을 공개하면서 생성형 AI 시장의 기술 경쟁이 한층 심화되고 있다. 동시에 Perplexity 등 AI 연구 플랫폼들도 실무 중심의 고급 기능을 속속 출시하고 있어, AI 도구의 실용성 확대 추세가 뚜렷해지고 있다.

무슨 일이 있었나

OpenAI는 새로운 모델 GPT-5.5 '스퍼드' 를 출시했다. 이 모델은 기존 대비 2배의 가격대를 유지하면서도 향상된 에이전트 기능을 제공한다. ChatGPT와 Codex에서 사용 가능하며, 사용자의 의도를 더 빠르게 파악하고 고급 워크플로우를 지원하는 것이 특징이다.

한편 오픈소스 진영의 DeepSeek은 V4 모델 을 공개했다. 1.6조 개의 파라미터를 갖춘 이 모델은 오픈소스 기반으로 제공되어 개발자들의 접근성을 높였다.

Perplexity는 두 가지 주요 기술을 선보였다. 먼저 딥 리서치(Deep Research) 기능은 2~4분 내에 수십 번의 검색과 수백 개 출처 분석을 통해 종합 보고서를 자동 생성한다. 또한 pplx-embed-v1과 pplx-embed-context-v1 이라는 텍스트 임베딩 모델을 출시해 웹 규모의 정보 검색 성능을 강화했다.

왜 중요한가

이번 모델 출시들은 생성형 AI의 실무 활용 범위를 크게 확대하는 신호다. GPT-5.5의 에이전트 기능 강화는 금융, 마케팅, 제품 연구 등 전문 분야에서 AI가 독립적으로 복잡한 작업을 수행할 수 있음을 의미한다. DeepSeek V4의 오픈소스 공개는 대형 기업뿐 아니라 중소 개발사도 최신 AI 기술에 접근할 수 있는 길을 열었다.

Perplexity의 딥 리서치는 특히 주목할 만하다. 인류 최후의 시험(Humanity's Last Exam)이라는 벤치마크에서 21.1%의 정확도를 기록해 Gemini Thinking, o3-mini, o1, DeepSeek-R1 등 주요 경쟁 모델들을 앞섰다. 이는 AI가 단순 정보 검색을 넘어 고차원의 분석과 추론 능력을 갖추고 있음을 보여준다.

쟁점

AI 모델의 급속한 발전 속에서 데이터 출처 문제는 여전히 논쟁의 중심이다. Reddit은 Perplexity를 포함한 여러 AI 기업을 상대로 무단 웹 스크래핑 혐의로 소송을 제기했다. 소송장에서 Reddit은 저작권 침해, 부정 경쟁, 부당 이득 등을 주장했으며, Perplexity가 신원을 위장한 봇을 통해 데이터를 수집했다고 지적했다.

이는 AI 기업들이 학습 데이터를 확보하는 과정에서 콘텐츠 제작자의 권리를 어떻게 보호할 것인가 하는 근본적인 질문을 던진다.

다음에 볼 것

향후 주목할 점은 세 가지다. 첫째, OpenAI와 DeepSeek의 모델 경쟁이 가격과 성능 측면에서 어떻게 전개될지다. 둘째, Perplexity의 딥 리서치 같은 고급 기능들이 실제 업무 환경에서 얼마나 효과적으로 작동하는지 검증되는 과정이다. 셋째, Reddit 소송을 포함한 데이터 출처 관련 법적 분쟁이 AI 산업의 학습 데이터 수집 방식을 어떻게 규제할지 결정하는 것이다.