테크·2026년 5월 20일NVIDIA AI, Nemotron-Labs-Diffusion 공개: Qwen3-8B 대비 한 번의 순전파당 토큰 6배를 처리하는 3모드 언어 모델MarkTechPost
테크·2026년 5월 20일알리바바 Qwen 팀, Qwen3.5-LiveTranslate-Flash 공개: 60개 언어를 2.8초 지연으로 실시간 멀티모달 통역MarkTechPost
테크·2026년 5월 20일Google, I/O 2026에서 Antigravity 2.0 출시: CLI, SDK, 관리형 실행, 엔터프라이즈 지원을 갖춘 독립형 에이전트 중심 플랫폼MarkTechPost
테크·2026년 5월 19일MemPrivacy를 만나보세요: 메모리 유용성을 해치지 않으면서 사용자 데이터를 보호하는 로컬 가역적 가명화를 사용하는 엣지-클라우드 프레임워크MarkTechPost
테크·2026년 5월 18일NVIDIA, NVFP4를 활용한 4비트 사전학습 방법론 공개… 12B 하이브리드 Mamba-Transformer로 10T 토큰 구간 검증MarkTechPost
테크·2026년 5월 18일llmcompressor를 사용해 FP8, GPTQ, SmoothQuant 양자화로 인스트럭션 튜닝 LLM을 압축하고 벤치마크하는 코드 구현MarkTechPost