AI 뉴스

10월 8일 AI뉴스: Claude Haiku 5.5 출시와 미스트랄 라지 4, 모두의 AI 베타

AI Together 2026. 10. 8. 08:27
반응형

10월 8일 AI 소식은 10월 7일 발표된 Claude Haiku 5.5와 Mistral Large 4부터 보안 검증 접근 확대, 구글 문서 도구 안의 Claude, 국내 ‘모두의 AI’ 일정까지 살펴봅니다. 회사가 제시한 성능·효율 수치와 독립 검증이 아닌 점, 아직 공개 전이거나 계획 단계인 기능을 나눠 설명하고, 조사와 프로토콜 논의의 확인 범위도 함께 정리했습니다.

업데이트: KT '모두의 AI' 공개, 이달 클로즈 베타·12월 정식 출시

KT는 10월 7일 서울 코엑스에서 열린 'AI 페스타 2026'에서 미디어 스터디를 열고 컨소시엄의 '모두의 AI' 서비스와 개발 현황을 공개했다고 뉴데일리가 보도했습니다. 보도에 따르면 참여사는 KT, 다음, 업스테이지, 모티프, NC AI, 솔트룩스, 리벨리온입니다. 이는 정부의 '모두의 AI' 사업에서 SKT·카카오·KT가 선정된 뒤 KT 서비스가 구체화되는 내용이며, 10월 3일에 다룬 10월 베타 계획에 대한 세부 업데이트입니다.

발표된 일정은 계획 단계입니다. KT는 이달 제한된 이용자를 대상으로 클로즈 베타를 시작해 날씨·생활정보·주식·인물 등에 관한 자연어 질문을 우선 검증하고, 11월에는 대상을 확대하며, 12월에는 전 국민 정식 출시를 예정한다고 밝혔습니다. 따라서 이 날짜들은 이미 완료된 출시 사실이 아니라 공개된 일정입니다. 베타 참여 방법, 무료 이용 범위, 실제 출시일은 제공된 자료에서 확인되지 않았습니다.

모델 구성으로는 업스테이지의 Solar Pro 4가 고난도 추론, Solar Mini 4가 경량 작업을 맡고, 모티프는 긴 문맥, NC AI는 3D·음성·사운드 분야를 담당한다고 설명됐습니다. KT의 'Token Factory'는 질문의 의도와 난이도를 분석해 모델을 자동 선택하는 오케스트레이션 역할을 합니다. KT는 라우팅·캐시·프롬프트 기술로 약 16~20%의 효율 개선이 가능하다고 설명했으며, 인프라는 리벨리온의 국산 AI 반도체 NPU 클러스터라고 밝혔습니다. 효율 수치는 KT 측 설명이지 독립 측정 결과로 제시된 것은 아닙니다.

서비스 연결 기능인 '이음 Inside'는 쇼핑·금융·부동산·교육 등 외부 생활 서비스를 잇는 구상입니다. 시작 시에는 다음 계정을 기반으로 하고, 2027년 상반기에 OAuth를 도입해 파트너사 통합 로그인을 추진할 계획입니다. 예약·결제처럼 권한이 필요한 기능은 파트너사와 협의 중이며, 잘못된 예약 실행 위험을 베타에서 검증한다고 합니다. 청년 월세 지원처럼 개인정보가 필요한 신청 업무는 초기에 신청서를 자동 입력하기보다 양식과 작성 방법을 안내하는 방안을 검토 중입니다. 이 기능과 일정의 실현 여부는 아직 확인되지 않았습니다.

출처: 뉴데일리, SBS Biz(다음)

Anthropic, Claude Haiku 5.5 출시: 소형 모델 비용 평균 약 75% 절감

Anthropic은 10월 7일(현지) Claude Haiku 5.5를 출시했다고 발표했습니다. 9to5Mac은 이를 지난 한 달 사이 공개된 Opus와 Sonnet에 이은 Claude 5.5 계열의 세 번째 모델로 소개했습니다. Anthropic이 제시한 주된 용도는 요약·컴팩션·데이터베이스 질의·분류처럼 대량으로 처리하는 저비용 작업입니다. Opus 5.5와 Sonnet 5.5를 함께 쓰는 코딩 서브에이전트, 실시간 고객 지원, 브라우저 사용도 활용 사례로 들었습니다. 회사는 표준 속도 기준 '가장 빠른 모델'이라고 표현했지만, Opus Fast Mode보다는 느리다고 밝혔습니다.

가격은 100만 토큰당 프롬프트 10만 토큰 이하와 초과 구간으로 나뉩니다. 입력은 각각 0.10달러와 0.50달러, 출력은 0.50달러와 2.50달러, 캐시 읽기는 0.01달러와 0.05달러입니다. 이전 Haiku 4.5의 입력 가격은 1달러, 출력 가격은 5달러였습니다. Anthropic은 새 가격이 평균 약 75% 저렴하며, 10만 토큰 이하 요청은 90% 낮은 가격이라고 계산했습니다. 회사에 따르면 이전 Haiku 요청의 약 90%가 이 구간에 해당합니다. 다만 새 토크나이저로 작업당 사용 토큰은 약간 늘 수 있다고 밝혔으므로, 토큰 단가 인하와 실제 작업 비용은 구분해서 볼 필요가 있습니다.

성능 수치는 회사 자체 벤치마크입니다. OSWorld 2.1 오프라인 서브셋에서 Haiku 5.5는 72.4%를 기록했고, 비교 수치는 Haiku 4.5가 15.7%, GPT-6 Luna가 48.9%, Sonnet 5.5가 83.9%였습니다. Terminal-Bench 4.0에서는 Haiku 5.5가 39.2%, Sonnet 5.5가 70.6%였습니다. Anthropic은 Haiku 계열에 처음으로 '노력(effort) 조절' 기능을 넣었다고 설명했습니다. 이는 발표된 비교 수치이며, 자료에는 한국어 작업의 독립 성능 검증이 없습니다.

함께 발표된 변경으로 Sonnet 5.5의 캐시 읽기 가격은 0.20달러에서 0.10달러로 내려가며, 회사는 대부분 에이전트 작업이 약 20% 저렴해진다고 설명했습니다. Max·Team 구독자용 월 API 크레딧은 이번 주 배포 예정으로, Max 5x는 100달러, Max 20x는 200달러, Team은 공동 크레딧 최대 500달러입니다. Python·TypeScript SDK에는 컴퓨터·브라우저 사용 베타 지원이 추가됐습니다. 사이버 보호장치는 Haiku 4.5보다 엄격하지만 다른 최신 모델보다는 다소 완화됐고, 침투 테스트 등은 계속 차단하며, 생물 보호장치는 Sonnet 5·5.5 및 Opus 5와 동일하다고 했습니다. Claude Platform(claude-haiku-5-5), AWS, Google Cloud, Microsoft Azure에서 제공되며 AWS는 Amazon Bedrock 제공을 별도 발표했습니다. 원화 가격과 한국어 성능 수치는 없고, 리전별 세부도 미확인입니다.

출처: Anthropic 공식 발표, 9to5Mac, AWS 블로그

Mistral Large 4 공개 프리뷰: 1조 매개변수 오픈웨이트, 가중치는 이달 말

프랑스의 Mistral AI는 Mistral Large 4(ML4) 공개 프리뷰를 발표했습니다. 지금 제공된 것으로 소개된 것은 Mistral Studio에서 사용할 수 있는 프리뷰 API이며, 모델 가중치(weights)는 이달 말 공개 예정이라고 밝혔습니다. 따라서 프리뷰 API 사용 가능과 가중치 공개는 서로 다른 단계입니다. 자료에는 가중치의 구체적인 라이선스 조건이나 공개 이후의 배포 조건이 실려 있지 않습니다.

Mistral이 공개한 사양은 1조 매개변수, 활성 매개변수 520억 개의 네이티브 멀티모달 MoE 모델입니다. 회사는 이를 자사 최대·최고 성능 모델이라고 평가했습니다. 학습은 유럽 자체 데이터센터에 있는 NVIDIA Grace Blackwell GPU 3,800개로 처음부터 진행했다고 설명했습니다. 학습 데이터 상당 부분은 160개 이상 언어를 포함하며, 유럽연합(EU)의 모든 공식 언어도 포함된다고 발표했습니다. 다만 한국어 성능 수치는 별도로 공개된 자료에 없습니다.

가중치를 공개하기 전 사이버보안 리더, 검증된 파트너, 국가 당국과 실제 환경에서 레드팀 시험을 진행할 계획이며, 이 기간에는 완화된 모더레이션을 적용한다고 밝혔습니다. 성능 결과도 회사 발표 기준으로 Cybench 40개 과제 중 93% 해결, DeepSWE v1.1 61.7%, Terminal-Bench 4 28.3%입니다. Mistral은 일부 폐쇄형 모델이 특정 사이버 시험에서 거절 때문에 0점에 가깝다고 주장했습니다. 비교 조건과 수치는 회사 평가로 구분해야 하며 독립 검증 수치는 자료에 제시되지 않았습니다.

프리뷰 API 가격은 입력 100만 토큰당 1.36달러, 출력 100만 토큰당 4.18달러입니다. Mistral은 이번 발표를 30억 유로 시리즈 D 자금으로 추진하는 로드맵의 첫 이정표라고 설명했습니다. 오픈웨이트 모델의 가중치가 예정대로 공개되면 국내에서도 자체 서버 운영 선택지가 넓어질 수 있지만, 이는 공개 이후의 가능성이지 현재 확인된 배포 방식은 아닙니다. 한국어 성능 수치와 라이선스 세부, 실제 가중치 공개 시점은 아직 확인되지 않았고, 공개 시점도 발표 당시에는 계획이었습니다.

출처: Mistral AI 공식 발표, Tech Startups 정리

Anthropic 사이버 검증 프로그램(CVP) 3단계 개편: 방어자에게 고성능 모델 확대

Anthropic은 Cyber Verification Program(CVP)을 확대 개편하고 Project Glasswing을 하나의 프로그램으로 통합했다고 발표했습니다. Defense Access는 보안관제·사고대응·악성코드 역분석·취약점 분석을 위한 등급입니다. 대상은 기업·비영리·대학·정부의 보안팀, 지역 병원과 지자체 시설처럼 기반시설을 운영하는 곳, 오픈소스 관리자, 실적이 있는 개인 연구자입니다. 이 등급은 며칠 내 회신을 목표로 한다고 안내됐습니다. 신청 승인이나 국내 조직의 자격 여부는 자료에서 확정되지 않았습니다.

Red Team Access는 승인된 시스템에 대한 침투 테스트를 추가하며 조직만 신청할 수 있고 심사에는 수 주가 걸린다고 합니다. 랜섬웨어 배포처럼 물리적 피해나 대규모 혼란을 일으키는 행위는 계속 실시간 차단한다고 밝혔습니다. Specialized Access는 항공 운항·전력망·통신망·은행 간 이체·정부 행정망 등 안전 시스템을 시험할 권한이 있는 소수 조직을 위한 등급이며, 미국 정부와 함께 심사합니다. 기존 Glasswing 참여자는 이 등급으로 이전된다고 발표됐습니다. 각 등급에서 Claude Opus 5.5, Sonnet 5.5, Mythos 5.1 및 이후 신규 모델을 이용할 수 있다고 안내했습니다.

일반 공개 모델인 Opus 5.5, Fable 5.1, Sonnet 5.5에는 대부분의 사이버 작업을 막는 보수적 보호장치가 유지된다고 합니다. 다만 코드 리뷰, 알려진 문제의 패치, 자체 소스 코드에서의 취약점 탐색, 경보 분류는 계속 허용되는 작업으로 제시됐습니다. Anthropic의 자체 CyScenarioBench 시험은 Opus 5.5로 과제 10개를 각각 5회 수행한 결과입니다. 프로그램이 없을 때는 모든 과제가 첫 프롬프트에서 차단됐고, Defense에서는 50회 중 46회 차단됐으며, Red Team에서는 차단 없이 50회 중 34회를 완료했습니다. 회사는 마지막 결과가 보호장치가 없는 경우의 67.6%와 사실상 같다고 설명했습니다.

Anthropic은 Glasswing 파트너들이 2026년 4~7월 검증된 취약점 최소 129,000건을 발견했고, 자사 오픈소스 스캔은 4~10월 5,500건이었다고 발표했습니다. 회사 설명에는 치명·높음 등급이 33,000건 이상이라는 수치도 포함되며, 이는 부분 데이터에 기반한 하한치라고 했습니다. 이 수치들은 회사가 제시한 데이터입니다. 참여 조직은 오남용 감시를 위해 데이터를 보관해야 하며, 올가을 'Enterprise Frontier Safeguards'가 나오면 자체 클라우드 보관이 가능해질 예정입니다. 제공 경로는 Claude Platform, Google Cloud Vertex AI, Microsoft Foundry이며, Amazon Bedrock은 EFS 자격 고객만 대상입니다. 국내 신청 가능 여부와 국가 제한은 확인되지 않았습니다.

출처: Anthropic 공식 발표, SecurityWeek

Claude for Google Workspace 공개 베타: Docs·Sheets·Slides 안에서 바로 편집

Claude for Google Workspace는 모든 유료 Claude 플랜에서 공개 베타로 제공되며, Google Docs·Sheets·Slides에 사이드바로 열린다고 안내됐습니다. Docs에서는 문장을 수정하고 제목 스타일을 바꿀 수 있으며, 큰 수정은 제안 카드로 표시됩니다. Sheets에서는 수식·피벗 테이블·차트를 만들고 새 탭을 추가할 수 있으며, 일부 데이터 작업에 Python을 사용할 수 있습니다. Slides에서는 기존 레이아웃과 테마에 맞춰 새 슬라이드를 만들고 겹침이나 넘침을 점검할 수 있다고 설명합니다.

편집 통제에는 두 방식이 있습니다. 기본 'Ask before edits' 모드에서는 변경 때마다 승인 카드가 나타나고, 'Accept all edits' 모드에서는 멈추지 않고 변경 사항을 적용합니다. 이 설정은 문서 편집 시 사용자가 선택하는 승인 방식으로 소개됐습니다. 따라서 어떤 모드에서 작업하느냐에 따라 매 변경 승인 여부가 달라집니다. 구체적인 한국어 편집 품질이나 오작동 비율은 제공 자료에 수치로 제시되지 않았습니다.

별도로 제공되는 Google Docs·Sheets·Slides 커넥터(베타)는 Claude 채팅에서 구글 파일을 만들고 편집하도록 연결합니다. 접근 권한은 기존 Google 공유 권한과 동일하다고 안내됐습니다. Team·Enterprise 환경에서는 조직 소유자가 먼저 기능을 켜야 합니다. Enterprise의 Compliance API, 고객 관리 암호화 키(CMEK), OpenTelemetry 감사 내보내기 통제도 애드온에 적용된다고 합니다. 이 내용은 Workspace 애드온과 커넥터의 기능·관리 설정 안내이며, 회사 문서 정책에 따른 권한 관리는 별도로 고려해야 합니다.

설치 절차는 Google Workspace Marketplace에서 애드온을 설치한 뒤 확장 프로그램 메뉴에서 Claude를 선택하고 'Open Claude'를 누르는 방식입니다. 관리자는 Google Admin 콘솔을 통해 배포할 수 있습니다. 공지에는 국가 제한 언급이 없지만, 국내 유료 이용자의 실제 설치 가능 여부와 국가별 제공 범위는 자료만으로 확인되지 않습니다. 또한 한국어 문서 편집 품질도 미확인입니다. 조직에서는 외부 AI의 문서 접근과 편집 권한을 자사 정책에 맞게 관리해야 합니다.

출처: Claude 공식 안내, Tech Startups 정리

Reuters/Ipsos 여론조사: 미국 유권자 84% 'AI는 노동자에게 위협'

Reuters/Ipsos 조사는 6일 동안 진행돼 10월 5일 완료됐으며, 미국 성인 4,506명과 등록 유권자 3,526명이 응답했습니다. 제시된 표본오차는 약 ±2%포인트입니다. 응답자의 84%는 AI가 미국 노동자에게 위협이라고 답했습니다. 이는 미국 대상 조사 결과이며 한국의 법적 의무나 한국 국민의 의견을 나타내는 수치가 아닙니다.

등록 유권자 중 57%는 행정부가 AI 위험을 충분히 진지하게 다루지 않는다고 답했고, 54%는 의회가 위험을 충분히 진지하게 다루지 않는다고 응답했습니다. 정부의 더 엄격한 AI 규제를 지지한 비율은 민주당 응답자 80%, 공화당 응답자 61%였습니다. 당파별 응답 비율은 조사에 소개된 항목이며, 자료는 한국 내 여론과 비교하는 수치를 제공하지 않습니다.

신규 데이터센터 건설 제한을 지지한다는 응답은 전체 56%였습니다. 정당 성향별로는 민주당 69%, 무당파 55%, 공화당 43%였습니다. 또한 AI가 미군의 공격 목표를 정하는 것에 57%가 반대했습니다. 이 군사 관련 반대 비율은 2025년 8월 조사에서 제시된 49%보다 높습니다. 두 수치는 보도된 조사 시점별 결과로, 자료에는 추가적인 원인 분석이나 한국과의 직접 비교는 포함돼 있지 않습니다.

조사 수치는 Reuters/Ipsos 조사 보도에 근거하지만, 제공 자료에 따르면 Reuters 원문은 유료 접근이 제한돼 원문 표를 직접 확인하지 못했고 Tech Startups의 2차 정리를 기준으로 했습니다. 따라서 표본 규모와 퍼센트는 자료에 기록된 보도 수치로 소개하며, 원문 표를 대조한 수치라고 표현하지 않습니다. 미국에서 일자리, 규제, 데이터센터가 AI 논의의 쟁점임을 보여주는 조사이지만, 국내 정책에 대한 직접 근거로 사용할 수는 없습니다.

출처: Reuters, Tech Startups 정리

Meta·Sierra '개인 에이전트 프로토콜' 제안: AI 비서와 기업의 연결 표준

Meta와 Sierra는 Genesys, Instinct, Rocket, Shopify, Stripe, Walmart와 함께 Personal Agent Protocol을 개발 중이라고 발표했습니다. 이 프로토콜은 누구나 구현할 수 있는 오픈 표준을 지향한다고 Sierra가 설명했습니다. 제안의 문제의식은 현재 개인 에이전트가 사람처럼 웹페이지를 클릭하거나 고객센터에 전화하면 느리고 실패할 수 있다는 점입니다. 회사들은 직접 연결을 통해 이런 작업을 안전하게 몇 초 안에 처리할 수 있다고 제안하지만, 이는 설계 취지로 제시된 설명이며 이미 달성한 성능 결과는 아닙니다.

제안된 작동 방식은 웹사이트에서 기업이 제공하는 기능을 발견한 뒤 이용자를 대신해 세션을 시작하는 것입니다. 로그인 없이 게스트로 재고와 반품 정책을 확인할 수 있고, 계정에 관한 작업은 로그인해야 합니다. 읽기 전용 권한과 쓰기 권한 중 무엇을 허용할지는 이용자가 결정하도록 설계한다고 합니다. 세션은 OAuth 기반이라고 발표됐습니다. 이는 제안된 구조이며, 공개된 사양에 따른 실제 제품 구현과 보안 동작은 아직 검증된 사실로 제시되지 않았습니다.

기업은 연결 경로를 직접 선택할 수 있습니다. 웹사이트, MCP·OpenAPI 기반 API, 또는 자체 회사 에이전트 중 어떤 방법을 열지 기업이 결정하는 구상입니다. 따라서 프로토콜이 기업 서비스를 자동으로 모두 연결하거나 참여를 강제하는 것은 아닙니다. 참여 기업으로 발표된 곳은 Genesys, Instinct, Rocket, Shopify, Stripe, Walmart이며, 추가 참여 규모와 실제 채택 여부는 아직 정해지지 않았다고 볼 수 있는 단계입니다.

향후 검토 항목으로는 세부 권한, 항공 지연이나 배송과 관련한 푸시 알림, 카드 정보를 공유하지 않는 결제가 언급됐습니다. v0.1 사양을 이달 말 공개하고 디자인 워크숍과 참조 구현을 진행할 예정이라고 발표했습니다. 국내 커머스·예약 서비스도 향후 에이전트 접속 표준 논의의 영향을 받을 수 있지만, 실제 적용 여부는 사양 공개와 사업자 채택에 달려 있습니다. 현재 사양은 미공개이며, 기능 범위와 참여 확대, 채택 여부는 확인되지 않았습니다.

출처: Sierra 공식 블로그

자주 묻는 질문

Q. Claude Haiku 5.5는 언제 출시됐고 어떤 작업을 겨냥하나요?

A. Anthropic은 10월 7일(현지) Claude Haiku 5.5를 출시했다고 발표했습니다. 요약·컴팩션·데이터베이스 질의·분류 같은 대량 저비용 작업과 코딩 서브에이전트, 실시간 고객 지원, 브라우저 사용을 제시했습니다.

Q. Mistral Large 4는 지금 내려받을 수 있나요?

A. 공개 프리뷰 API는 Mistral Studio에서 사용할 수 있다고 발표됐습니다. 가중치 공개는 이달 말 예정이며, 라이선스 세부는 미확인입니다.

Q. Anthropic 사이버 검증 프로그램은 몇 단계인가요?

A. Defense Access, Red Team Access, Specialized Access의 세 단계입니다. 승인되는 작업과 신청 대상이 다르며, Specialized Access는 안전 시스템 시험 권한이 있는 소수 조직을 대상으로 미국 정부와 함께 심사한다고 발표됐습니다.

Q. Claude for Google Workspace는 어떤 앱에서 쓸 수 있나요?

A. 모든 유료 Claude 플랜의 공개 베타로 Google Docs, Sheets, Slides에서 사이드바로 사용할 수 있다고 안내됐습니다. 국가별 제공 범위와 한국어 문서 편집 품질은 미확인입니다.

Q. KT ‘모두의 AI’의 베타와 정식 출시 일정은 어떻게 되나요?

A. 보도된 계획은 10월 제한된 이용자 대상 클로즈 베타, 11월 대상 확대, 12월 전 국민 정식 출시 예정입니다. 실제 출시 일자와 베타 참여 방법은 확인되지 않았습니다.

Q. Reuters/Ipsos 조사에서 AI를 노동자 위협으로 본 응답은 몇 퍼센트였나요?

A. 미국 성인 4,506명과 등록 유권자 3,526명을 대상으로 한 조사에서 84%가 AI가 미국 노동자에게 위협이라고 답했습니다. 표본오차는 약 ±2%포인트로 제시됐습니다.

Q. Personal Agent Protocol은 어떤 방식의 연결을 제안하나요?

A. 웹사이트에서 기업이 제공하는 기능을 찾아 이용자 대신 세션을 시작하는 방식입니다. 게스트로 재고나 반품 정책을 확인하고, 계정 작업은 로그인하며, 읽기 전용 또는 쓰기 권한을 이용자가 결정하도록 제안됐습니다.

Q. 오늘 기사에서 회사 자체 평가로 표시한 항목은 무엇인가요?

A. Claude Haiku 5.5와 Mistral Large 4의 벤치마크 수치, Anthropic 사이버 검증 프로그램의 차단·완료 시험과 취약점 집계, KT의 약 16~20% 효율 개선 설명은 회사 측 평가 또는 설명으로 구분했습니다. Reuters/Ipsos 수치는 보도에 정리된 여론조사 결과이며 원문 표 직접 확인은 자료에서 확인되지 않았습니다.

#AI뉴스 #클로드하이쿠55 #Claude보안프로그램 #미스트랄라지4 #구글워크스페이스클로드 #개인에이전트프로토콜 #모두의AI #실행형AI #오픈웨이트 #AI규제여론

반응형