"17만 개 유튜브 영상, AI 기업들 무단으로 학습"

An investigation by Proof News and Wired revealed that over 170,000 YouTube videos were part of a massive dataset used to train AI systems for major tech companies. Apple, Anthropic, Nvidia, and Salesforce are among those who used the 'YouTube Subtitles' data extracted without permission. The dataset includes subtitles from videos of popular creators and major news outlets. YouTube has not immediately responded to the findings. AI companies rarely show transparency about the data used in their AI systems. In previous interviews, YouTube CEO Neal Mohan stated that using video content for AI training would violate the platform's terms. Google CEO Sundar Pichai agreed with this assessment, emphasizing the importance of abiding by terms and conditions when building products.

조사에 따르면, 주요 빅테크 기업들이 AI 훈련을 위해 17만 개 이상의 유튜브 동영상을 데이터셋으로 활용했다고 밝혀졌다. 애플, 앤스로픽, 엔비디아, 세일즈포스 등이 허가없이 유튜브에서 추출한 '유튜브 자막(YouTube Subtitles)' 데이터를 사용했다. 이 데이터셋에는 MrBeast, Marques Brownlee 등 유명 크리에이터와 주요 뉴스 매체의 영상 자막이 포함되어 있다. 유튜브는 이에 대한 즉각적인 답변을 하지 않았다. AI 기업들은 자사 AI 시스템에 사용된 데이터에 대해 거의 투명성을 보이지 않고 있다. 유튜브 CEO는 이전 인터뷰에서 AI 훈련을 위한 동영상 콘텐츠 사용이 플랫폼 이용약관을 위반한다고 말한 바 있다. 구글 CEO도 이러한 견해에 동의했다.

Apple, Anthropic, and other companies used YouTube videos to train AI


기자의 다른 기사보기
저작권자 © Tech42 - Tech Journalism by AI 테크42 무단전재 및 재배포 금지

관련 기사

구글, 휴대폰 개인정보 무단 수집 혐의로 집단소송 직면

Google faces a class action lawsuit for allegedly collecting personal information from mobile phones without user consent.

마이크로소프트, 성과 기반 소규모 인력 감축 실시

Microsoft is conducting small-scale workforce reductions across all departments based on performance.

메타, 인스타그램과 스레드에 정치 콘텐츠 추천 재개

Meta has announced that it will resume recommending political content on Instagram and Threads.

클라우드 소프트웨어 그룹, 전 세계적으로 인력 감축 실시

Cloud Software Group (CSG) has conducted large-scale layoffs globally.