제품·서비스Hugging Face2026-08-20
LFM2.5-DSpark, GPU와 맥북에서 최대 3.2배 추론 속도 향상
Up to 3.2x Faster Inference with LFM2.5-DSpark
- LFM2.5-DSpark는 1.2B, 2.6B, 8B-A1B 모델에 적용되어 GPU에서는 최대 3.18배, 장치 내에서는 2.87배 추론 속도 향상을 제공합니다.
- DSpark는 추측 해석 기법을 사용해 메모리 증가를 최소화하면서 해석 속도를 크게 높이고, 출력 품질은 변하지 않습니다.
왜 중요한가이 기술은 클라우드 모델보다 더 높은 상호작용 수준을 제공하며, 엣지 장치에서의 성능 향상으로 다양한 애플리케이션에 적용 가능합니다.
공식 원문 확인 ↗
제품·서비스NVIDIA Developer2026-08-20
생성형 추천 시스템이 추천 알고리즘을 재정의하는 방식
How Generative Recommenders Are Redefining RecSys at Scale
- 생성형 추천 시스템(Generative Recommenders)은 전통적인 임베딩 기반 추천 시스템과 달리 시퀀스 모델링을 기반으로 하며, HSTU와 Semantic IDs와 같은 모델을 통해 확장성, 콜드 스타트 문제, 장미 문제를 해결하고 있다.
- NVIDIA는 생성형 추천 시스템을 위한 프로덕션 준비된 구현을 제공하며, DynamicEmb, KV 캐시, CUDA 커널 등 최적화된 기술을 활용해 추천 시스템의 성능을 향상시켰다.
왜 중요한가추천 시스템의 확장성과 성능을 개선함으로써 사용자 경험을 향상시키고, 대규모 데이터 처리에 적합한 솔루션을 제공한다.
공식 원문 확인 ↗
제품·서비스NVIDIA2026-08-20
지브로 페어: 브라우저에서 GeForce NOW 이용 가능해진다
Bring the Fire: Play Games on GeForce NOW With New Firefox Browser Support
- NVIDIA가 Firefox 브라우저를 통해 GeForce NOW를 지원 시작한다
- 12개 신규 게임이 추가되어 브라우저에서 고성능 게임을 즐길 수 있다
왜 중요한가유저는 다운로드 없이 브라우저에서 고성능 게임을 즐길 수 있는 새로운 방식을 경험할 수 있다
공식 원문 확인 ↗
정책·안전OpenAI2026-08-20
OpenAI, AI 기술이 자유 사회에 미치는 영향 탐구하는 새로운 블로그 출시
Introducing AI Futures
- OpenAI는 AI 기술이 권력 구조와 자유 사회에 미칠 수 있는 영향을 탐구하는 'AI Futures' 블로그를 출시했다.
- AI의 발전이 국가의 힘을 유지하는 방식을 바꾸고, 개인의 자유와 권리를 위협할 수 있는 위험성을 경고했다.
왜 중요한가AI 기술의 발전이 사회 구조와 개인의 자유에 미칠 수 있는 영향을 이해하는 것이 중요하다.
공식 원문 확인 ↗
제품·서비스OpenAI2026-08-20
스탬플리, 챗GPT 워크로 런칭 시간 68% 절감
Stampli cuts launch hours by 68% using ChatGPT Work
- 스탬플리는 챗GPT 워크와 코덱스를 활용해 런칭 생산 시간을 243시간에서 77시간으로 약 3.16배 단축했다.
- 이 프로세스는 제품 마케팅 팀이 일상적으로 사용하는 시스템으로, 제품 자료를 실시간으로 업데이트하고 대규모 콘텐츠 생성을 가능하게 한다.
왜 중요한가AI 도구를 활용한 런칭 프로세스 최적화는 기업의 생산성 향상과 혁신적인 제품 출시 속도를 높이는 데 중요한 영향을 미친다.
공식 원문 확인 ↗
제품·서비스NVIDIA Developer2026-08-19
NVIDIA Holoscan 애플리케이션 개발에 AI 코드 에이전트 활용
Developing NVIDIA Holoscan Applications with CLI, Skills, and AI Coding Agents
- NVIDIA Holoscan 플랫폼을 사용해 실시간 내시경 도구 분할 애플리케이션을 개발하며, AI 코드 에이전트가 CLI와 HoloHub 문서를 활용해 개발 프로세스를 최적화했다.
- CLI, 스킬, 문서의 조합이 개발 효율성과 품질을 높이는 데 효과적이었으며, 반복 가능한 벤치마킹과 성능 개선을 통해 처리 속도와 지연 시간을 개선했다.
왜 중요한가AI 코드 에이전트의 활용은 엔지니어와 협업하여 실시간 AI 애플리케이션 개발을 효율화하고, 반복 가능한 테스트와 성능 개선을 가능하게 한다.
공식 원문 확인 ↗