AI 비서 확산과 국내 독자모델 평가 논란

AI 비서가 업무 도구로 자리잡는 동시에 국내 AI 모델 평가 투명성 논란이 이어진 하루의 소식을 정리했습니다.

업무용 AI 비서, 이제 어디서든 쓸 수 있게

앤트로픽이 자사의 업무 지원 AI '클로드 코워크'를 웹과 모바일에서도 쓸 수 있도록 확대했습니다. 그동안은 컴퓨터 프로그램(데스크톱 앱)에서만 주로 쓰였는데, 이제는 스마트폰이나 인터넷 브라우저에서도 이어서 작업할 수 있습니다. 지메일, 구글 드라이브, 구글 캘린더 같은 구글 업무 도구와도 직접 연동돼, 사장님이 외부에서도 AI에게 이메일 정리나 일정 관리를 맡길 수 있는 환경이 넓어진 셈입니다.

구글도 학습을 돕는 AI 기능을 대거 내놨습니다. 검색창에 어려운 개념을 물으면 그림이나 시뮬레이션으로 바로 보여주는 기능인데, 직원 교육이나 신입 채용자 온보딩 자료를 만들 때도 참고할 만한 흐름입니다.

AI가 실험실과 코딩 현장까지 파고든다

앤트로픽은 클로드를 활용해 신약 개발에 필요한 단백질 설계 연구 속도를 크게 줄인 실험 결과를 공개했습니다. 전문 연구자의 직관까지 흉내 낼 수 있다는 점에서, AI가 전문직 업무를 보조하는 수준을 넘어서고 있다는 신호로 읽힙니다.

중국 지푸(Z.ai)는 개발자용 AI 모델 'GLM-5.3'을 이전과 같은 가격에 내놨습니다. 코드 작성과 장기간 자동 작업(에이전트) 능력을 키우면서 가격은 올리지 않아, AI 기능을 저렴하게 쓰려는 개발사들의 선택지가 늘었습니다.

AI를 돌리는 인프라와 안전장치도 진화

미국 세레브라스는 기존 GPU(그래픽처리장치)보다 최대 30배 빠른 추론 성능을 낸다는 새 AI 가속기 'CS-4'를 공개했습니다. 국내 기업 모레도 여러 종류의 AI 반도체를 통합 제어하는 개방형 소프트웨어로 해외 시장에 진출하고 있어, 엔비디아 중심 생태계에 변화 조짐이 보입니다.

AI 에이전트가 고객을 직접 상대하는 서비스가 늘면서, 보안 스타트업 파브릭스는 AI 스스로 자기 허점을 찾아내는 점검 도구 '닉스'를 내놨습니다. 회사가 AI 챗봇이나 자동 상담 시스템을 도입하려 한다면, 이런 사전 점검 도구가 필요해지는 시대가 온 것입니다.

국내 AI 모델 평가, 투명성 논란 계속

정부가 추진하는 '독자 AI 파운데이션 모델(독파모)' 사업 2차 평가를 두고 '깜깜이' 논란이 일자, 과기정통부가 항목별 순위를 추가로 공개했습니다. 글로벌 벤치마크에서 1위였던 모티프테크놀로지스가 탈락하고, 국내 벤치마크에서는 SKT, 전문가·국민 평가에서는 LG AI연구원이 각각 1위를 차지한 것으로 나타났습니다.

이 논란은 국내 AI 기술력을 어떤 기준으로 평가해야 하는지에 대한 사회적 논의로 이어지고 있습니다. 중소기업 입장에서는 당장 체감되는 이슈는 아니지만, 향후 정부 지원을 받는 국산 AI 서비스의 신뢰도와 직결되는 문제입니다.

참고한 원문

이 글은 아래 기사들의 사실 관계를 바탕으로 일잘러 AI가 정리해 다시 쓴 글입니다. 원문의 표현을 그대로 옮기지 않았으며, 자세한 내용은 각 매체의 기사를 확인해 주세요.

다른 기사도 보세요

AI 뉴스 목록으로

월 8만 원 정기구독 · 약정 없음

AI 비서 신청하기

남겨 주시면 1영업일 안에 연구소에서 연락드립니다.

전화가 편하시면 080-574-3300