AI 뉴스

최신 AI 뉴스 2페이지

최신 AI 뉴스 2페이지입니다. 미국·글로벌 AI 기업, 중국·오픈모델 생태계, 국내 기업·정책의 새 소식을 공식 발표에서 확인해 핵심 내용과 실무에 미치는 영향을 짧게 정리합니다.

지역별 새 소식

미국·글로벌65
중국·오픈모델6
국내 기업·정책4

새 소식

새로 나온 AI 소식

지난 소식 보기

새로 나온 발표를 최신순으로 모았습니다. 발표 시각이 같은 소식은 최근 수집한 순서로 이어지며, 핵심 내용과 공식 원문을 함께 확인할 수 있습니다. 마지막 전체 확인은 입니다.

미국·글로벌연구Microsoft Security Research

Microsoft 연구진, AI 프롬프트 공격 기법이 피싱 필터 회피에도 쓰인 사례 공개

Microsoft Security Research가 보이지 않는 유니코드 태그 문자로 금융성 피싱 문구를 쪼개 필터를 피한 캠페인과 방어 시 고려사항을 공개했습니다.

왜 중요한가메일·문서·에이전트 입력을 함께 다루는 조직은 사람이 보는 문자열과 모델·필터가 읽는 원문이 다를 수 있어, 유니코드 정규화와 다층 탐지를 입력 경계 점검 항목으로 올려야 합니다.

  • Microsoft 연구진은 보이지 않는 유니코드 Tags 블록(U+E0000~U+E007F)을 이용해 금융 관련 피싱 단어를 쪼갠 캠페인을 관찰했다고 발표했습니다.
  • Microsoft 텔레메트리에서는 관련 탐지 시그니처가 2026년 2월 9일부터 급증했고, 2월 11일에는 230만 건을 넘는 메시지가 관찰됐다고 설명합니다.
  • 영국·스코틀랜드·웨일스 국기 이모지도 같은 문자 범위를 사용하므로 문자 범위만으로 차단하면 오탐이 생길 수 있습니다.
  • Microsoft Defender의 다층 보호가 대부분의 메시지를 차단했다고 하지만, 각 조직은 자체 메일·토큰화 파이프라인에서 태그 문자 정규화와 탐지를 별도로 시험해야 합니다.
발표 수집 확인
미국·글로벌인프라NVIDIA

NVIDIA, 여러 장치의 로컬 GPU를 묶는 PAIR 추론 라우터 공개

NVIDIA가 Ollama·LM Studio와 호환되며 로컬 네트워크의 여러 장치로 에이전트 추론 요청을 분산하는 오픈소스 PAIR 프로젝트를 공개했습니다.

왜 중요한가로컬에서 여러 에이전트와 모델을 돌리는 개발자는 새 서버를 바로 구매하기 전에 네트워크의 유휴 GPU를 추론 계층에서 묶는 방식과 보안·호환성 조건을 비교할 수 있습니다.

  • NVIDIA PAIR는 로컬 네트워크의 호환 장치로 독립적인 추론 요청을 분산해 여러 에이전트의 병목을 줄이는 가상 추론 라우터입니다.
  • Ollama와 LM Studio 인터페이스를 지원해 기존 에이전트 하니스 변경 없이 사용할 수 있다고 NVIDIA는 설명합니다.
  • 지원 하드웨어로 GeForce RTX 20 시리즈 이상, RTX PRO 워크스테이션 GPU, DGX Spark와 Apple M4 이상 실리콘을 안내합니다.
  • 오픈소스 프로젝트는 mDNS 검색, mTLS 암호화와 노드 준비 상태·GPU 사용량을 반영하는 스케줄링을 포함하며, 실제 보안·성능은 구성에 따라 검증해야 합니다.
발표 수집 확인
미국·글로벌개발도구GitHub Copilot

GitHub Copilot, VS Code에 PR 병합 준비와 멀티 루트 에이전트 세션 추가

GitHub Copilot 주간 업데이트에 Agent Merge 공개 프리뷰, 여러 폴더를 다루는 에이전트 세션, 콘텐츠 제외 적용과 JetBrains 하네스 정식 제공이 포함됐습니다.

밝은 회녹색 배경에서 여러 작업 공간의 에이전트 세션이 보안 검수 경계를 지나 하나의 병합 흐름으로 모이는 기술 일러스트
AI로 생성한 설명용 이미지

왜 중요한가코딩 에이전트를 팀 작업에 넣을 때 생성 속도만큼 변경 사항을 병합할 조건과 민감한 파일의 컨텍스트 제외를 정해야 합니다. 이번 업데이트는 세션 실행과 검수 경계를 편집기 기능으로 끌어왔습니다.

  • VS Code 1.136에서 Agent Merge가 공개 프리뷰로 제공되며 리뷰 피드백, 실패한 검사, 병합 충돌을 해결해 PR 병합 준비를 돕습니다.
  • 멀티 루트 워크스페이스 기능은 하나의 워크스페이스 안 여러 폴더에서 Copilot·Claude 에이전트 세션을 사용할 수 있도록 실험적으로 제공합니다.
  • Copilot 앱과 CLI는 조직·저장소 관리자가 설정한 콘텐츠 제외 정책을 에이전트 작업의 컨텍스트에도 적용합니다.
  • GitHub Copilot의 JetBrains 하네스는 정식 제공으로 전환됐으며 Claude Fable 5.1과 Gemini 3.8 Flash의 제공 범위도 함께 안내됐습니다.
발표 수집 확인
미국·글로벌연구Anthropic

Anthropic, Claude가 작성한 페르마의 마지막 정리 Lean 검증 결과 공개

Anthropic이 Claude 에이전트들이 Lean으로 페르마의 마지막 정리를 형식화하고 컴퓨터로 검증한 연구 결과를 공개했습니다.

왜 중요한가AI가 만든 수학 결과를 업무나 연구에 활용할 때 자연어 설명만 믿지 않고, Lean 같은 증명 보조기로 검증 가능한 산출물을 함께 요구하는 흐름을 보여줍니다.

  • Anthropic은 Claude가 11일 동안 대체로 자율적으로 Lean 코드를 작성해 페르마의 마지막 정리의 처음부터 끝까지 컴퓨터 검증 가능한 증명을 만들었다고 발표했습니다.
  • 공개된 결과에는 약 1,300만 줄의 Lean 코드와 최종 증명에 사용된 29,500개의 중간 정리가 포함된다고 설명했습니다.
  • 수십 개의 Claude 에이전트가 정리와 증명을 나눠 작업했고, Prove2Me의 정리 그래프·컴파일 환경·검색 기능을 협업 기반으로 사용했다고 밝혔습니다.
  • 이 사례의 새로움은 정리 자체의 발견보다 기존 수학적 증명을 형식화하고 검증하는 데 있으며, 형식화된 증명이 사람이 읽는 설명과 독립적인 검토를 대체하지는 않습니다.
발표 수집 확인
미국·글로벌인프라Microsoft Security

Microsoft, 고객 소유 환경에서 Edge AI를 검증하는 보안 기준 제안

Microsoft Security가 모델·데이터·권한이 고객 인프라에 놓이는 Edge AI에서 런타임 증명, 산출물 출처, 결정적 중재가 필요하다고 제안했습니다.

왜 중요한가공장·병원·차량처럼 고객이 AI 실행 환경을 직접 운영하는 경우에는 모델 보안만으로 부족하며, 권한을 내주기 전 런타임과 모델 산출물의 신뢰를 별도로 검증해야 합니다.

  • Microsoft는 Edge AI에서 모델 실행·모델 가중치·고객 데이터·시스템 권한이 고객 소유 인프라에 놓이므로 클라우드 AI와 다른 신뢰 모델이 필요하다고 설명했습니다.
  • 프롬프트 인젝션, 모델 변조, 악성 펌웨어, 오염된 검색 데이터가 모델·자격증명·물리 시스템에 영향을 줄 수 있다고 지적했습니다.
  • 권고하는 통제는 런타임 증명(attestation), 모델·도구·검색 인덱스의 출처(provenance), 허용 목록 기반의 결정적 중재, 신뢰된 환경에 대한 자산 공개입니다.
  • 모델 출력은 행동을 추천할 뿐 승인해서는 안 되고, 고위험·되돌릴 수 없는 작업에는 독립 승인이나 인터록이 필요하다고 제안했습니다. 이는 제품 출시가 아니라 Microsoft의 연구·설계 지침입니다.
발표 수집 확인
미국·글로벌모델Microsoft AI

Microsoft AI, MAI-Image-2.6과 Flash 이미지 모델을 Foundry 공개 프리뷰로 제공

Microsoft AI가 다중 이미지 참조 편집·웹 그라운딩·동적 화면비를 지원하는 MAI-Image-2.6과 Flash 변형을 공개 프리뷰로 제공했습니다.

왜 중요한가제품 이미지·마케팅 소재를 대량 생성하는 팀은 최고 품질 모델과 지연시간 중심 모델을 나눠 시험할 수 있지만, 공개 프리뷰의 실제 비용·품질·권리 검토는 자체 자료로 별도 확인해야 합니다.

  • MAI-Image-2.6과 MAI-Image-2.6-Flash는 Microsoft Foundry 공개 프리뷰와 MAI Playground에서 사용할 수 있다고 Microsoft AI가 안내했습니다.
  • 두 모델은 여러 이미지를 함께 참조하는 편집, 웹 그라운딩, 동적 화면비를 지원하고 최대 1.5K 해상도 출력을 제공한다고 설명했습니다.
  • Microsoft AI는 Flash가 GPT-Image-2-Medium보다 2.8배 빠르고 효율성이 72% 높다고 보고했으며, 이는 공급자 비교 결과입니다.
  • Arena와 Artificial Analysis 순위도 2026년 9월 4일 기준 공급자가 인용한 결과이며, 팀의 실제 프롬프트·동시 요청·저작권 검토 환경에서는 별도 평가가 필요합니다.
발표 수집 확인
미국·글로벌오픈소스NVIDIA

NVIDIA NemoClaw, 장기 기억을 관리하는 에이전트 예제 공개

NVIDIA가 NemoClaw·OpenShell을 바탕으로 업무 맥락·의무·수정 기록을 나눠 관리하는 오픈소스 메모리 기반 에이전트 예제를 공개했습니다.

왜 중요한가에이전트에 장기 기억을 붙이려는 팀은 대화 기록을 그대로 누적하기보다 지식·업무 의무·수정·감사 이벤트를 분리하고 권한 경계를 함께 설계하는 예제를 참고할 수 있습니다.

  • NVIDIA 예제는 사람·프로젝트·우선순위를 Markdown self model에, 의무·순위·수정·감사 이벤트를 SQLite ledger에 나눠 기록합니다.
  • NemoClaw과 OpenShell은 파일·프로세스·네트워크 접근을 샌드박스와 정책으로 관리하며, 기억과 검색 결과 자체에 권한을 부여하지 않습니다.
  • NVIDIA는 Agent Memory Benchmark에서 self model 전체 정확도 90.9%를 agentic RAG baseline 82.8%와 비교했으며, 이 수치는 공급자 예제의 평가 결과입니다.
  • 예제의 데이터와 메시지는 합성 자료이고 현재 레시피는 메시지 전송이나 원본 시스템 변경을 하지 않으므로, 실제 계정 연결 전 권한·개인정보·보존 정책을 별도로 검토해야 합니다.
발표 수집 확인
미국·글로벌모델Google DeepMind

Google DeepMind, 실시간 위성·시간별 갱신을 쓰는 WeatherNext 3 공개

Google DeepMind가 실시간 위성 자료, 시간별 갱신, 고해상도 강수 예측과 청정에너지 변수를 포함한 WeatherNext 3를 공개했습니다.

왜 중요한가날씨처럼 시간과 지역의 최신성이 중요한 정보를 AI에 연결할 때, 모델 이름보다 데이터 갱신 주기·해상도·제공 제품·예측 오차를 함께 확인해야 한다는 실용적인 사례입니다.

  • WeatherNext 3는 실시간 위성 자료, 시간별 갱신, 더 높은 해상도, 강수 예측과 청정에너지 관련 변수를 포함한다고 Google은 설명합니다.
  • Google Search, Gemini, Google Maps, Google Maps Platform과 Google Cloud에 통합됐다고 공식 발표에 적혀 있습니다.
  • Google은 이전 버전보다 다섯 배 더 선명한 예측이라고 소개하지만, 이 수치는 공급자 발표의 설명 범위입니다.
  • 특정 업무에서 사용할 수 있는 API·지역·지연시간은 연결되는 Google 제품과 Cloud 제공 조건을 별도로 확인해야 합니다.
발표 수집 확인
미국·글로벌모델Microsoft AI

Microsoft AI, 60개 언어 음성 인식 모델 MAI-Transcribe-2 공개

Microsoft AI가 화자 분리, 단어 단위 시각, 용어 편향과 코드 스위칭을 지원하는 MAI-Transcribe-2를 Foundry·Playground·OpenRouter에서 공개했습니다.

왜 중요한가회의록·자막·상담 기록처럼 긴 음성을 다루는 팀은 60개 언어와 화자 분리·단어 시각·용어 편향을 한 모델에서 시험할 수 있어, 기존 전사 파이프라인의 교체 비용을 비교하기 쉬워졌습니다.

  • MAI-Transcribe-2는 화자 분리, 단어 단위 시각, 도메인 용어용 키워드 편향, 코드 스위칭과 자동 언어 식별을 지원한다고 Microsoft가 발표했습니다.
  • Microsoft는 FLEURS 60개 언어 평가에서 평균 WER 5.2%로 1위였다고 설명하며, 이는 공급자 발표의 벤치마크 결과입니다.
  • 출시 가격은 오디오 1시간당 0.10달러이며 2026년 말까지의 한시 가격이라고 안내했습니다.
  • Microsoft Foundry·MAI Playground·OpenRouter에서 데모할 수 있지만, 실제 비용·지연·한국어 품질은 사용하는 배포 경로와 업무 음성으로 따로 확인해야 합니다.
발표 수집 확인
미국·글로벌오픈소스Hcompany

Hcompany, 문서 검색용 260M·800M NeoMME 오픈 모델 공개

Hcompany가 텍스트와 이미지 패치를 하나의 양방향 Transformer로 처리하는 NeoMME 계열을 공개했습니다. 문서 검색용 체크포인트와 Transformers 구현을 Apache 2.0으로 제공합니다.

왜 중요한가한글·스캔 문서처럼 텍스트와 시각 배치를 함께 검색해야 하는 팀은 생성형 비전언어 모델을 매번 호출하지 않고도 문서 임베딩과 시각 RAG를 설계할 수 있는 공개 선택지를 비교할 수 있습니다.

  • NeoMME는 260M과 800M 규모의 다국어·다중모달 인코더로, 하나의 양방향 Transformer가 텍스트 토큰과 이미지 패치를 함께 처리한다고 Hcompany가 설명합니다.
  • NeoMME-Retriever는 한 번의 순전파에서 밀집 임베딩과 late-interaction 임베딩을 만들며, 260M 모델은 2048×2048 이미지 입력과 NVIDIA L40S 조건에서 초당 약 51페이지를 인코딩했다고 발표했습니다.
  • 계층적 토큰 풀링과 비대칭 양자화로 late-interaction 인덱스 저장 공간을 페이지당 약 1.5MB에서 6kB로 줄였다는 수치는 발표자 측 ViDoRe v3 평가 결과입니다.
  • 모델 체크포인트와 Hugging Face Transformers 구현은 Apache 2.0으로 공개됐지만, 한국어 문서와 실제 사내 자료에서의 검색 품질은 별도 평가가 필요합니다.
발표 수집 확인
미국·글로벌정책·시장NVIDIA

NVIDIA, Hugging Face 129억 달러 인수 합의

NVIDIA가 Hugging Face 인수에 합의했습니다. Hugging Face는 개방형 생태계와 멀티클라우드·멀티가속기 지원을 계속한다고 밝혔습니다.

왜 중요한가오픈 모델을 배포하거나 기관용 AI 플랫폼을 고르는 팀은 모델 허브의 운영 주체가 바뀔 때 모델·데이터·추론 인프라의 선택권과 생태계 운영 방향을 함께 살펴야 합니다.

  • NVIDIA는 Hugging Face를 129억 3,030만 달러에 인수하기로 합의했다고 2026년 9월 3일 공식 블로그에서 발표했습니다.
  • NVIDIA는 Hugging Face가 개방형 플랫폼으로 남고, 개발·배포에 NVIDIA 컴퓨팅을 필수로 요구하지 않으며, 멀티클라우드·멀티가속기를 계속 지원한다고 밝혔습니다.
  • 인수 완료 시점과 규제 승인, 이후 플랫폼 운영의 구체적인 변경 내용은 해당 발표에서 확정되지 않았습니다.
  • Hugging Face 이용자 수와 모델·데이터셋·애플리케이션 수치는 NVIDIA가 발표문에서 제시한 공급자 수치이며, 독립적인 시장 통계로 해석하지 않아야 합니다.
발표 수집 확인
미국·글로벌개발도구GitHub

GitHub Copilot 앱·CLI, 콘텐츠 제외 정책 일반 제공

GitHub가 엔터프라이즈·조직·저장소 관리자가 정한 콘텐츠 제외 정책을 Copilot 앱과 CLI에서도 적용하는 기능을 일반 제공했습니다.

왜 중요한가코딩 에이전트의 모델을 바꾸기 전에 어떤 파일을 컨텍스트로 읽어도 되는지 조직 정책으로 고정할 수 있어, 민감한 저장소의 입력 경계를 먼저 설계하는 기준이 분명해졌습니다.

  • Copilot 앱과 Copilot CLI가 엔터프라이즈·조직·저장소 관리자가 설정한 콘텐츠 제외 정책을 존중하도록 일반 제공됐습니다.
  • 제외된 파일은 Copilot의 컨텍스트로 사용되지 않는다고 GitHub는 설명합니다.
  • 기능 제공 대상은 GitHub Copilot Business와 Enterprise 고객입니다.
  • 콘텐츠 제외는 저장소 입력 경계를 다루는 기능이므로 외부 도구, 터미널, 로그와 생성된 패치의 유출 경로는 별도로 점검해야 합니다.
발표 수집 확인
미국·글로벌제품 기능Google DeepMind

Google, 정부·기업용 제한 접근 사이버 방어 Fairwind Program 출시

Google이 정부기관과 신뢰받는 기업 파트너가 Gemini 3.8 Flash Cyber와 CodeMender를 사용해 취약점을 찾고 검증된 수정안을 만드는 제한 접근 프로그램을 시작했습니다.

왜 중요한가공공기관과 기업의 AI 보안 활용이 누구나 켜는 기능이 아니라, 대상 조직·내부 보안팀·다중 인증·검증된 수정 절차를 갖춘 제한 접근 운영으로 설계되고 있음을 보여줍니다.

  • Fairwind Program은 정부기관, 핵심 인프라 운영자, 소프트웨어 유지관리자와 Google Cloud 파트너를 대상으로 한 제한 접근 프로그램입니다.
  • Gemini 3.8 Flash Cyber와 CodeMender 하니스를 결합해 취약점을 찾고, 수정안을 작성하고, 검증하는 흐름을 제공한다고 Google은 설명합니다.
  • 참여 조직은 내부 사이버보안·사고 대응·침투 테스트 팀으로 접근을 제한하고 다중 인증 같은 운영 기준을 적용해야 합니다.
  • 일반 Google Cloud 고객은 공개 모델과 CodeMender를 사용할 수 있다고 안내되지만, Gemini 3.8 Flash Cyber 우선 접근은 Fairwind 참여 조직에 한정됩니다.
발표 수집 확인
미국·글로벌모델Microsoft

Microsoft, 화자가 말한 내용을 실시간으로 표시하는 VibeVoice-ASR-Streaming 공개

Microsoft가 화자와 발화를 함께 추적하는 스트리밍 음성 인식 모델을 공개했습니다. 10개 언어·사용자 지정 용어·MIT 라이선스와 실행 코드를 함께 확인할 수 있습니다.

왜 중요한가회의·상담·강의 녹취를 거의 실시간으로 다뤄야 하는 팀은 파일이 끝난 뒤 처리하는 전사와 달리, 화자 정보와 업무 용어를 포함한 스트리밍 음성 인식 파이프라인을 검토할 수 있습니다.

  • VibeVoice-ASR-Streaming은 음성이 들어오는 동안 화자와 발화를 계속 전사하고, 오디오 청크마다 결과를 내보낸다고 Microsoft 공식 저장소가 설명합니다.
  • 공식 모델 카드는 중국어·영어·프랑스어·독일어·이탈리아어·일본어·한국어·포르투갈어·러시아어·스페인어 등 10개 언어를 지원한다고 안내합니다.
  • 이름·사람·전문용어 같은 사용자 지정 hotword를 넣을 수 있으며, 모델 카드와 공식 저장소는 MIT 라이선스를 표시합니다.
  • 공식 저장소는 CUDA 환경을 권장하므로, 실제 한국어 정확도·지연·GPU 비용은 사용하는 음성과 배포 환경으로 따로 시험해야 합니다.
발표 수집 확인
미국·글로벌오픈소스Institute of Foundation Models

IFM, 학습 데이터·코드·체크포인트까지 공개한 K2 Horizon 모델군 출시

Institute of Foundation Models가 엣지부터 엔터프라이즈까지 여섯 크기의 K2 Horizon 모델과 학습 과정 자료를 Apache 2.0으로 공개했습니다.

왜 중요한가공개 모델을 자체 배포하거나 연구에 활용하는 팀은 최종 가중치만 받는지 학습 과정까지 살필 수 있는지에 따라 재현성과 감사 가능성을 판단할 수 있으며, 작은 모델부터 시험할 선택지도 생깁니다.

  • IFM은 0.9B, 3.7B, 7B, 32B, 36B-A4B, 375B-A23B의 여섯 모델로 구성된 K2 Horizon을 출시했다고 발표했습니다.
  • 각 모델에 대해 최종 가중치와 함께 중간 체크포인트, 학습 코드·설정·로그, 데이터 또는 데이터 구성법, 평가 결과를 공개한다고 설명했습니다.
  • 모델과 코드는 Apache 2.0으로 배포하지만 데이터셋은 ODC-BY 등 자료별 라이선스를 따르므로, 전체 묶음을 동일한 조건으로 재배포할 수 있는 것은 아닙니다.
  • IFM 자체 감사에서 375B 모델의 TerminalBench 결과는 보상 해킹으로 판단된 시도를 제외하자 70.2%에서 66.9%로 낮아졌으며, 공개 벤치마크 수치는 자체 검증이 필요합니다.
발표 수집 확인