AI 뉴스
최신 AI 뉴스 7페이지
최신 AI 뉴스 7페이지입니다. 미국·글로벌 AI 기업, 중국·오픈모델 생태계, 국내 기업·정책의 새 소식을 공식 발표에서 확인해 핵심 내용과 실무에 미치는 영향을 짧게 정리합니다.
지역별 새 소식
새 소식
새로 나온 AI 소식
새로 나온 발표를 최신순으로 모았습니다. 발표 시각이 같은 소식은 최근 수집한 순서로 이어지며, 핵심 내용과 공식 원문을 함께 확인할 수 있습니다. 마지막 전체 확인은 입니다.
DeepSeek, 시각 이해 모델 V4 Flash Vision API 공개
DeepSeek가 이미지와 차트를 읽는 실험 모델 DeepSeek-V4-Flash-Vision-Exp를 API에 추가했습니다.
왜 중요한가DeepSeek API가 텍스트를 넘어 이미지와 차트까지 다루기 시작했습니다. 화면 분석이 필요한 개발·자동화 작업에서 다른 멀티모달 모델과 비교할 후보가 늘었습니다.
- 공식 변경 기록은 이 모델을 새로운 멀티모달 시각 이해 실험 모델로 명시합니다.
- API 호출 시 model 값을 deepseek-v4-flash-vision-exp로 지정해 접근할 수 있습니다.
- DeepSeek는 순수 텍스트 능력은 V4 Flash와 비슷하고, 시각 이해가 필요한 에이전트 평가에서는 개선됐다고 설명합니다.
- 공개된 수치는 공급자 자체 평가이므로 실제 업무 적용 전 별도 검증이 필요합니다.
NVIDIA SkillEvaluator, AI 에이전트 스킬을 설치 전후로 비교하는 오픈소스 도구 공개
NVIDIA가 에이전트 스킬의 구조·보안과 실제 작업 성능을 스킬 설치 전후로 비교하는 SkillEvaluator와 검증 스킬 카탈로그를 소개했습니다.

왜 중요한가에이전트에 스킬·플러그인을 추가하는 팀은 설치 전에 파일 구조와 보안을 검사하고, 설치 후에는 작업별 성능과 토큰·시간 변화를 비교하는 평가 루프를 만들 수 있습니다.
- NVIDIA는 SkillEvaluator를 스킬이 있을 때와 없을 때의 에이전트 실행을 비교하고, 정적 구조·보안 검사와 실제 작업 평가를 함께 수행하는 오픈소스 도구로 소개했습니다.
- NVIDIA는 30개가 넘는 제품의 검증 스킬 300개 이상을 두 개의 에이전트 하니스에서 평가했다고 밝혔습니다.
- 공급자 실험에서 정확성 Skill Lift는 41점, 효과성 Skill Lift는 39점이었으며, 이는 합격 확률이 아니라 평가한 전문 작업의 평균 점수 차이라고 설명했습니다.
- 제품별 차이가 하니스 차이보다 컸고, 한 스킬은 토큰과 실행 시간을 줄였지만 다른 스킬은 늘렸으므로 작업 정의와 평가 데이터셋을 별도로 설계해야 합니다.
OpenAI, Zero Data Retention 호환 안전 분석 기능 미리보기
Zero Data Retention을 쓰는 조직이 고객 통제 저장소를 통해 여러 상호작용의 위험 신호를 분석하는 Private Safety Processing 미리보기입니다.
왜 중요한가민감한 업무에서 AI 안전 모니터링과 데이터 보존 요구가 충돌할 때, 고객이 보관 경계와 암호화 키를 통제하면서도 반복 상호작용의 위험 신호를 다루려는 설계 방향을 보여줍니다.
- OpenAI는 적격 API 고객의 Zero Data Retention 환경에서 처리 후 프롬프트와 모델 응답을 보존하지 않는다고 설명합니다.
- Private Safety Processing은 관련된 여러 상호작용을 자동으로 살펴보되 OpenAI 직원이 원문 콘텐츠에 접근하지 않도록 설계된 미리보기입니다.
- 고객 통제 인프라에 콘텐츠를 보관하거나 고객 키로 암호화된 OpenAI 제공 저장소를 사용하는 방식을 설명하고 있습니다.
- 이 기능은 초기 고객 대상으로 시험 중이며, 법적 보고가 필요한 아동 성착취물 의심 이미지 보존 예외가 원문에 명시돼 있습니다.
Anthropic, Claude의 단백질 설계·분석화학 실험 결과 공개
Anthropic이 Claude가 단백질 결합체 설계와 NMR·LC-MS 분석을 수행한 실험, 외부 검증 결과와 접근 제한을 공개했습니다.
왜 중요한가과학 연구에 AI를 연결할 때는 모델이 제안한 결과와 실험실 검증을 분리해야 하며, 이번 사례는 전문 도구를 조율하는 에이전트의 가능성과 생명과학 접근 제한을 함께 보여줍니다.
- Anthropic은 Claude Opus 4.8과 Mythos Preview로 15개 단백질 표적을 대상으로 설계해 14개 표적에서 결합체를 만들었다고 발표했습니다.
- 공급자 실험에서 설계 성공률은 설정에 따라 22.6%에서 35.1%였고, Anthropic은 현재 단백질 설계 캠페인의 일반적인 10~15%와 비교했습니다.
- Claude Opus 5는 원시 NMR·LC-MS 파일과 짧은 지시만으로 각각 23분과 19분 만에 실험실 분석과 일치하는 결과를 냈다고 보고했습니다.
- 이 결과는 Anthropic의 실험과 외부 평가자의 검증에 기반하며, 습식 실험은 여전히 필요하고 Fable 계열의 생명과학 연구 질의는 일반 접근에서 차단되어 있다고 밝혔습니다.