AI 뉴스
최신 AI 뉴스 5페이지
최신 AI 뉴스 5페이지입니다. 미국·글로벌 AI 기업, 중국·오픈모델 생태계, 국내 기업·정책의 새 소식을 공식 발표에서 확인해 핵심 내용과 실무에 미치는 영향을 짧게 정리합니다.
지역별 새 소식
새 소식
새로 나온 AI 소식
새로 나온 발표를 최신순으로 모았습니다. 발표 시각이 같은 소식은 최근 수집한 순서로 이어지며, 핵심 내용과 공식 원문을 함께 확인할 수 있습니다. 마지막 전체 확인은 입니다.
Anthropic, 연구·제조 장비를 에이전트와 잇는 Model Hardware Standard 미리보기
Anthropic이 현미경·액체 처리기·로봇 팔 같은 장비를 표준 드라이버와 에이전트로 연결하는 Model Hardware Standard 연구 프리뷰를 공개했습니다.
왜 중요한가실험실과 제조 현장에 에이전트를 연결하려면 자연어 지시만으로는 부족하며, 장비 드라이버·권한·결정적 안전 코드·전문가 감독을 함께 표준화해야 한다는 방향을 보여줍니다.
- Model Hardware Standard는 프로그래밍 인터페이스가 있는 현미경, 액체 처리기, 로봇 팔 등 여러 장비를 공통 방식으로 발견하고 제어하는 규격입니다.
- 표준 드라이버는 온도 읽기와 설정 같은 read·write 기본 명령, 장비 검색 정보와 자연어 기반 장비 특성 태그를 제공합니다.
- 모델에 구애받지 않으며 MCP 같은 표준 프로토콜을 통해 에이전트 하니스에서 접근할 수 있다고 Anthropic은 설명합니다.
- 현재는 제한된 연구 프리뷰이고, 프로그래밍 인터페이스가 없는 장비는 지원하지 않으며 물리적 오류에는 전문가 감독이 필요합니다.
네이버클라우드·LG CNS, 보안 특화 AI 파운데이션 모델 공동 개발 참여
네이버클라우드와 LG CNS가 정부의 사이버 보안 특화 AI 파운데이션 모델 개발 사업에 33개 산·학·연 기관과 함께 참여한다고 밝혔습니다.
왜 중요한가국내 보안 AI는 모델만 따로 만드는 방향보다 폐쇄망·온프레미스·데이터 보호·관제까지 묶은 배포 환경을 전제로 움직이고 있습니다. 공공과 규제 산업에서 소버린 AI의 실제 요구조건을 읽을 수 있는 발표입니다.
- 네이버클라우드와 LG CNS는 과학기술정보통신부·정보통신산업진흥원의 사이버 보안 분야 특화 AI 파운데이션 모델 개발 사업에 참여한다고 밝혔습니다.
- 컨소시엄은 모델·인프라·보안·데이터를 아우르는 풀스택 기술로 국내 보안 환경에 맞는 모델을 개발할 계획입니다.
- 네이버클라우드는 폐쇄망·온프레미스 환경의 모델 배포와 CSAP 기반 데이터 암호화·격리 경험을 강점으로 제시했습니다.
- 공격·탐지 보안 기업, 대학, 공공 연구기관 등을 포함한 33개 산·학·연 기관이 참여한다고 공개됐으며, 개발·상용화는 계획 단계입니다.
Anthropic, 외부 연구자가 Claude 사용 데이터를 분석하는 파일럿 공개
Anthropic이 외부 연구기관 세 곳에 개인정보 보호형 집계 사용 데이터를 제공한 파일럿과 연구 결과, 확장 조건을 공개했습니다.
왜 중요한가공공기관과 연구팀이 AI 사용 실태를 이해할 때 공급자 보고서만 읽지 않고, 개인정보 보호와 독립성을 갖춘 외부 분석 구조를 함께 검토할 수 있게 하는 사례입니다.
- Anthropic은 스탠퍼드 SALT Lab, 옥스퍼드 Human Information Processing Lab, METR 세 기관이 Anthropic Insights를 통해 약 25만 건의 Claude.ai·Claude Code 대화를 집계 분석했다고 밝혔습니다.
- 원본 대화 대신 개인정보 검토를 거친 집계 결과를 공유했으며, 각 연구팀은 자체 질문을 설계하고 결과를 독립적으로 분석했다고 설명했습니다.
- SALT Lab의 초기 결과에서는 Claude 대화의 절반이 넘는 사례가 결과에 책임이 따르거나 되돌리기 어려운 과업을 포함했고, 특히 법률·금융 조언에서 이런 경향이 나타났다고 보고했습니다.
- 집계 모델의 질문 표현에 따라 분류 오류가 생길 수 있고, 외부 연구 프로그램의 확장성·연구 품질은 아직 검토 중이라고 밝혔습니다.
MiniMax, 2026년 상반기 매출 1억1660만 달러 발표
MiniMax가 2026년 상반기 매출과 AI 기업 서비스·AI 네이티브 제품 매출, 조정 순손실을 포함한 실적을 발표했습니다.
왜 중요한가중국계 AI 기업의 경쟁이 모델 성능 발표를 넘어 API·기업 서비스와 AI 네이티브 제품의 매출 구조로 드러나고 있습니다. 매출 성장과 함께 연구개발비와 조정 순손실도 같이 봐야 사업 지속성을 판단할 수 있습니다.
- MiniMax는 2026년 상반기 총매출이 전년 동기 3040만 달러에서 1억1660만 달러로 283.1% 증가했다고 발표했습니다.
- Open Platform과 기타 AI 기반 기업 서비스 매출은 7390만 달러로 703.1% 증가했고, AI 네이티브 제품 매출은 4260만 달러로 100.9% 증가했다고 밝혔습니다.
- 조정 순손실은 2억9300만 달러였고, 연구개발비는 2억9690만 달러로 발표됐습니다.
- MiniMax M3 출시와 MiniMax H3 오픈 웨이트 공개를 상반기 이후 사업 진전으로 함께 언급했으며, 재무 수치는 회사가 발표한 미감사 자료입니다.
Qwen, Qwen4 구조 미리보기 Qwen3.8-Flash-Next 가중치 공개
Qwen이 차세대 Qwen4 구조를 시험하는 멀티모달 모델 Qwen3.8-Flash-Next의 가중치와 실행 자료를 공개했습니다.
왜 중요한가차세대 Qwen 구조를 실제 가중치로 미리 시험할 수 있게 됐습니다. 공개 도구에서 구동 가능한 희소 멀티모달 모델이라 자체 배포와 추론 효율 비교에 활용할 수 있습니다.
- Qwen은 2026년 8월 26일 Qwen3.8-Flash-Next를 Qwen4용 차세대 구조의 실험 미리보기로 공개했습니다.
- 공식 자료는 1,250억 개 주 모델 매개변수 중 60억 개를 활성화하고 별도의 n-gram 임베딩을 결합한 구조로 설명합니다.
- 이미지 입력을 처리하는 비전 인코더를 포함한 멀티모달 인과 언어 모델입니다.
- 가중치와 설정 파일을 Hugging Face에 공개했으며 Transformers, vLLM, SGLang 등 여러 실행 환경을 안내합니다.
Anthropic, AI 웰빙 영향 평가를 위한 500만 달러 지원 프로그램 시작
Anthropic이 대화형 AI가 이용자 웰빙에 미치는 영향을 독립적으로 평가하는 공개 벤치마크 연구에 500만 달러를 지원합니다.
왜 중요한가교육·복지·상담처럼 대화 맥락이 이어지는 서비스를 운영하는 조직은 단일 답변 평가만으로 충분하지 않으며, 장기 대화와 전문가 검증을 포함한 독립 평가를 준비해야 합니다.
- Anthropic은 AI가 이용자 웰빙에 미치는 영향을 측정하는 독립 연구에 500만 달러를 지원하고, 선정 연구자에게 모델 접근과 기술 지원도 제공한다고 발표했습니다.
- 지원 연구는 공개 평가·벤치마크로 배포될 예정이며, 연구자는 Anthropic과 독립적으로 결과를 발표할 수 있다고 안내했습니다.
- Anthropic은 평가가 무엇을 합격·실패로 보는지 명확히 하고, 임상·주제 전문가를 설계와 검증에 포함하며, 과잉 순응과 과잉 거절을 함께 시험해야 한다고 제안했습니다.
- 실제 사용을 반영하려면 위험이 대화 중에 커지거나 맥락이 바뀌는 다중 턴 시나리오가 필요하며, 이 기준은 Anthropic의 안내이지 업계 공통 표준은 아닙니다.
IBM Granite, 엣지 배포를 겨냥한 4.7억 매개변수 영어 음성 인식 모델 공개
IBM Granite이 Apache 2.0으로 배포할 수 있는 470M 매개변수 영어 ASR 모델 Granite Speech 5.0 TurboCTC를 공개했습니다.
왜 중요한가사내 음성 기록을 외부 API로 보내기 어렵거나 지연시간을 줄여야 하는 팀은 영어 전사 모델을 노트북·스마트폰·엣지 장치에 직접 배포하는 선택지를 비교할 수 있습니다.
- Granite Speech 5.0 TurboCTC는 4.7억 매개변수의 영어 전용 CTC 음성 인식 모델이며, 모델 카드에는 Apache 2.0 라이선스와 2026년 8월 25일 출시일이 적혀 있습니다.
- IBM Granite은 이 모델이 노트북·스마트폰·엣지 장치와 저지연·고처리량 기업 전사에 맞는다고 설명합니다.
- 공식 모델 카드와 공개 글의 Open ASR·FFASR 수치는 2026년 8월 25일 기준 공급자 평가이며, 실제 장치의 성능을 보장하지 않습니다.
- 영어만 지원하고 현재 Hugging Face Inference Provider에는 배포되지 않았으므로, 한국어 전사나 관리형 추론을 바로 대체하는 모델은 아닙니다.
OpenAI, ChatGPT Work·Codex용 관리자 플러그인 공개
OpenAI가 대화형 인터페이스에서 워크스페이스 사용량을 분석하고 멤버·권한·한도 관리 요청을 처리하는 관리자 플러그인을 공개했습니다.
왜 중요한가관리자가 분석 화면과 설정 화면을 오가는 대신 대화에서 사용량을 확인하고 지원되는 변경을 실행할 수 있게 하는 제품입니다. 조직용 AI 운영이 질문·분석을 넘어 권한 있는 조치로 확장됩니다.
- 관리자는 ChatGPT Work와 Codex에서 활동·크레딧 사용량, 멤버·그룹, 권한, 모델 접근과 사용량 한도를 확인할 수 있습니다.
- Slack이나 Microsoft Teams로 사용 요청을 보내고, 사전 정의한 기준에 맞는 접근 요청을 자동 처리하는 흐름을 지원한다고 OpenAI는 설명합니다.
- 플러그인은 사용자의 기존 역할과 권한 안에서 작동하며 더 넓은 접근 권한을 부여하지 않습니다.
- 워크스페이스 설정에서 활성화한 뒤 ChatGPT Work의 Plugins 디렉터리에서 설치하는 방식이며, 지원되는 조치와 승인 정책의 범위 안에서 사용해야 합니다.
OpenAI, 자체 추론 칩 Jalapeño의 첫 성능 결과 공개
OpenAI가 자체 설계 추론 칩 Jalapeño의 공개 모델 테스트 결과와 연내 인프라 배치 계획을 공개했습니다.
왜 중요한가모델 경쟁이 가속기와 메모리·네트워크·서빙 소프트웨어를 함께 설계하는 추론 인프라 경쟁으로 이어지고 있습니다. 다만 현재 발표는 상용 배포가 끝났다는 소식이 아니라 시험 결과와 배치 계획입니다.
- OpenAI는 Jalapeño가 GPT-OSS 120B, DeepSeek R1, Kimi K2.5 1T에서 처리량·전력 효율·지연시간을 함께 측정했다고 밝혔습니다.
- 발표된 배수와 처리량은 SemiAnalysis의 InferenceX를 이용한 OpenAI의 비교 결과이며, OpenAI는 성능이 전력 단위의 유용한 AI 작업량으로 평가돼야 한다고 설명합니다.
- Jalapeño는 700W로 설계됐고 시험된 워크로드에서 지속 전력은 550W 이하였다고 발표됐습니다.
- OpenAI는 생산 인증과 소프트웨어 성숙화 이후 2026년 말부터 자체 컴퓨팅 인프라에 배치할 계획이며, NVIDIA 등 파트너 가속기도 계속 사용한다고 밝혔습니다.
DeepSeek, 시각 이해 모델 V4 Flash Vision API 공개
DeepSeek가 이미지와 차트를 읽는 실험 모델 DeepSeek-V4-Flash-Vision-Exp를 API에 추가했습니다.
왜 중요한가DeepSeek API가 텍스트를 넘어 이미지와 차트까지 다루기 시작했습니다. 화면 분석이 필요한 개발·자동화 작업에서 다른 멀티모달 모델과 비교할 후보가 늘었습니다.
- 공식 변경 기록은 이 모델을 새로운 멀티모달 시각 이해 실험 모델로 명시합니다.
- API 호출 시 model 값을 deepseek-v4-flash-vision-exp로 지정해 접근할 수 있습니다.
- DeepSeek는 순수 텍스트 능력은 V4 Flash와 비슷하고, 시각 이해가 필요한 에이전트 평가에서는 개선됐다고 설명합니다.
- 공개된 수치는 공급자 자체 평가이므로 실제 업무 적용 전 별도 검증이 필요합니다.
OpenAI, Zero Data Retention 호환 안전 분석 기능 미리보기
Zero Data Retention을 쓰는 조직이 고객 통제 저장소를 통해 여러 상호작용의 위험 신호를 분석하는 Private Safety Processing 미리보기입니다.
왜 중요한가민감한 업무에서 AI 안전 모니터링과 데이터 보존 요구가 충돌할 때, 고객이 보관 경계와 암호화 키를 통제하면서도 반복 상호작용의 위험 신호를 다루려는 설계 방향을 보여줍니다.
- OpenAI는 적격 API 고객의 Zero Data Retention 환경에서 처리 후 프롬프트와 모델 응답을 보존하지 않는다고 설명합니다.
- Private Safety Processing은 관련된 여러 상호작용을 자동으로 살펴보되 OpenAI 직원이 원문 콘텐츠에 접근하지 않도록 설계된 미리보기입니다.
- 고객 통제 인프라에 콘텐츠를 보관하거나 고객 키로 암호화된 OpenAI 제공 저장소를 사용하는 방식을 설명하고 있습니다.
- 이 기능은 초기 고객 대상으로 시험 중이며, 법적 보고가 필요한 아동 성착취물 의심 이미지 보존 예외가 원문에 명시돼 있습니다.
Anthropic, Claude의 단백질 설계·분석화학 실험 결과 공개
Anthropic이 Claude가 단백질 결합체 설계와 NMR·LC-MS 분석을 수행한 실험, 외부 검증 결과와 접근 제한을 공개했습니다.
왜 중요한가과학 연구에 AI를 연결할 때는 모델이 제안한 결과와 실험실 검증을 분리해야 하며, 이번 사례는 전문 도구를 조율하는 에이전트의 가능성과 생명과학 접근 제한을 함께 보여줍니다.
- Anthropic은 Claude Opus 4.8과 Mythos Preview로 15개 단백질 표적을 대상으로 설계해 14개 표적에서 결합체를 만들었다고 발표했습니다.
- 공급자 실험에서 설계 성공률은 설정에 따라 22.6%에서 35.1%였고, Anthropic은 현재 단백질 설계 캠페인의 일반적인 10~15%와 비교했습니다.
- Claude Opus 5는 원시 NMR·LC-MS 파일과 짧은 지시만으로 각각 23분과 19분 만에 실험실 분석과 일치하는 결과를 냈다고 보고했습니다.
- 이 결과는 Anthropic의 실험과 외부 평가자의 검증에 기반하며, 습식 실험은 여전히 필요하고 Fable 계열의 생명과학 연구 질의는 일반 접근에서 차단되어 있다고 밝혔습니다.
Z.ai, 코딩·사이버보안 역량을 내세운 GLM-5.3 공개
Z.ai가 장기 코딩 작업과 네트워크 보안 능력을 강화했다고 설명한 GLM-5.3을 ZCode·AutoClaw·Coding Plan에 공개했습니다.
왜 중요한가코딩 에이전트와 공개 모델을 비교하는 팀은 벤치마크 주장, 실제 제공 경로, 가중치 공개 시점을 따로 확인해야 하며, GLM-5.3은 중국계 모델의 개발·보안 활용 선택지를 넓히는 사례입니다.
- Z.ai는 GLM-5.3을 2026년 8월 14일 공개하면서 GLM-5.2의 기반을 유지하고 장기 코딩과 네트워크 보안에 초점을 둔 후속 학습을 적용했다고 설명했습니다.
- 공식 발표는 GLM-5.3을 ZCode, AutoClaw, Coding Plan에서 사용할 수 있다고 안내했으며, ZCode 변경 기록도 같은 날짜에 모델 지원을 기록했습니다.
- Z.ai는 안전성 보강을 마친 뒤 2주 후 전체 가중치를 공개하겠다는 계획을 밝혔지만, 공개 시점과 실행 조건은 공식 모델 카드에서 다시 확인해야 합니다.
- 코딩·사이버보안 벤치마크와 성능 표현은 Z.ai 자체 발표이며, 실제 보안성·한국어 품질·비용·도구 연동은 사용 환경에서 별도 평가가 필요합니다.
Google, 코딩·에이전트용 Gemini 3.7 Flash 공개
Google이 코딩과 에이전트 작업을 겨냥한 범용 모델 Gemini 3.7 Flash를 공개하고 주요 개발 환경에 제공하기 시작했습니다.
왜 중요한가빠른 응답과 긴 문맥, 조절 가능한 추론을 한 모델에 묶었습니다. 코딩 에이전트와 대규모 문서 처리에서 성능·지연·비용을 함께 비교할 새 선택지입니다.
- Google은 2026년 8월 13일 Gemini 3.7 Flash를 공개했으며 모델 카드는 정식 제공 상태로 표시합니다.
- 모델 카드는 최대 100만 토큰 입력 문맥과 6만4천 토큰 출력을 지원한다고 명시합니다.
- Gemini API와 Google AI Studio, Gemini Enterprise Agent Platform, Antigravity, Spark에서 사용할 수 있습니다.
- Google은 출시 가격을 기존 Gemini 3.6 Flash 원래 가격의 절반으로 소개했으며, 이는 공급자 발표 기준입니다.
MiniMax, 최대 5분 생성 Music 3.0 오픈 가중치 공개
MiniMax가 자연어 콘셉트와 선택적 가사로 최대 5분 길이의 완성곡을 만드는 Music 3.0 가중치를 공개했습니다.
왜 중요한가짧은 음악 조각을 넘어 곡 전체의 구조와 보컬을 생성하는 모델을 자체 환경에서 시험할 수 있게 됐습니다. 음악 제작 자동화와 공개 모델 연구의 비교 대상이 늘었습니다.
- MiniMax는 2026년 8월 13일 Music 3.0을 오픈 가중치 음악 생성 모델로 공개했습니다.
- 자연어로 적은 곡 콘셉트와 선택적으로 제공한 가사를 바탕으로 최대 5분 길이의 음악을 생성합니다.
- 전체 곡 구성과 구간별 지시를 함께 다루기 위해 전역·지역 Hybrid-LM과 다층 RVQ, 흐름 정합 방식을 적용했다고 설명합니다.
- 공개 발표는 가중치 제공 사실을 명시하지만 별도의 이용 조건은 배포처에서 다시 확인해야 합니다.