모델·연구NVIDIA Developer2026-08-21
NVIDIA AVO, ARC-AGI-3에서 100% 성적 달성
NVIDIA AVO Reaches 100% on ARC-AGI-3, Demonstrating a Frontier-Level General-Purpose Architecture for Long-Horizon Autonomous Agents
- NVIDIA AVO는 ARC-AGI-3 벤치마크에서 100.00 RHAE 점수를 기록하며 성능과 일반성을 보여줬다.
- AVO는 지속적인 자율 작동을 가능하게 하는 시스템 설계에 초점을 맞춘 일반적인 에이전트 시스템이다.
왜 중요한가이 성과는 AI 에이전트 시스템의 성능과 일반성은 모델 능력이 아닌 시스템 설계에 달려 있음을 보여준다.
공식 원문 확인 ↗
모델·연구Hugging Face2026-08-21
음성 인식 모델이 벤치마크에 최적화된 전략을 사용하는 현상 분석
Measuring benchmark optimization in speech recognition
- 공개 벤치마크에서 높은 점수를 기록하는 음성 인식 모델들이 실제 음성 전달을 정확히 반영하지 못하는 경우가 많다.
- 모델들이 벤치마크의 특정 패턴이나 참조 전문을 학습해 전달을 왜곡하거나, 특정 스펠링 방식을 선택하는 현상이 관찰되었다.
왜 중요한가모델의 실제 성능을 평가하기 위해 벤치마크 외의 데이터를 사용하는 것이 중요하다.
공식 원문 확인 ↗
제품·서비스OpenAI2026-08-19
Replit, GPT-5.6 Luna 기반 무료 모드로 소프트웨어 개발 접근성 확대
Replit expands access to software creation with GPT-5.6 Luna
- Replit이 GPT-5.6 Luna 기반의 무료 모드를 도입해 누구나 소프트웨어 개발을 할 수 있도록 지원한다.
- 이 무료 모드는 토큰 비용 걱정 없이 아이디어를 실행 가능한 소프트웨어로 만들 수 있도록 한다.
왜 중요한가모든 사용자가 소프트웨어 개발에 접근할 수 있게 되면서, 창의성과 기술의 장벽이 줄어들고 새로운 기회가 생길 수 있다.
공식 원문 확인 ↗
정책·안전NVIDIA Developer2026-08-21
AI 에이전트 스택에서 보안의 위치
Where Security Fits in an AI Agent Stack
- AI 에이전트가 복잡한 작업을 수행하면서 보안과 신뢰를 구축하는 것이 중요해지고 있다.
- 보안 제어는 에이전트 스택의 런타임 및 인프라 계층에서 가장 효과적으로 시행되어야 한다.
왜 중요한가AI 에이전트가 더 많은 권한을 가지면서 보안이 더욱 중요해지며, 이는 시스템의 안정성과 신뢰성에 직접적인 영향을 미친다.
공식 원문 확인 ↗
제품·서비스OpenAI2026-08-18
ChatGPT Ads, 유럽 31개 시장으로 확장
ChatGPT Ads expands across Europe
- ChatGPT Ads가 미국 테스트 6개월 만에 유럽 31개 국가로 확장
- 광고는 Free 및 Go 플랜 사용자에게만 노출되고, Pro 및 Enterprise는 광고 없음
왜 중요한가유럽 시장에서의 광고 확장은 기업이 소비자 의사결정 과정에서 새로운 마케팅 기회를 얻을 수 있게 해 줌
공식 원문 확인 ↗
제품·서비스OpenAI2026-08-18
OpenAI, 청소년을 위한 ChatGPT 서비스 출시
Introducing ChatGPT for Teens: Built for learning, backed by protections
- OpenAI가 청소년을 위한 ChatGPT for Teens 서비스를 출시하며, 학습과 비판적 사고를 지원하고 보안 기능을 강화했다.
- 이 서비스는 청소년의 안전을 우선시하고, 부모의 추가 제어 기능을 제공하며, 학습에 유용한 기능들을 포함하고 있다.
왜 중요한가청소년이 AI를 안전하게 활용하고 학습을 독려하는 데 기여할 수 있는 새로운 도구가 등장했다.
공식 원문 확인 ↗