테크·2026년 5월 18일llmcompressor를 사용해 FP8, GPTQ, SmoothQuant 양자화로 인스트럭션 튜닝 LLM을 압축하고 벤치마크하는 코드 구현MarkTechPost
테크·2026년 5월 17일Vercel Labs, AI 에이전트가 네이티브 프로그램을 읽고 수정하고 배포할 수 있도록 설계한 시스템 프로그래밍 언어 ‘Zero’ 공개MarkTechPost
테크·2026년 5월 17일Nous Research, 긴 컨텍스트에서 사전학습 속도를 1.4~1.7배 높이는 학습 전용 선택 기반 계층적 어텐션 ‘Lighthouse Attention’ 제안MarkTechPost
테크·2026년 5월 17일LiteLLM Agent Platform 소개: 격리된 에이전트 샌드박스와 프로덕션용 지속 세션 관리를 위한 Kubernetes 기반 자체 호스팅 인프라 계층MarkTechPost
테크·2026년 5월 16일Graph 분석, Dead-Code 감지, Decisions, AI Context를 활용해 Repowise로 리포지토리 수준 코드 인텔리전스를 구축하는 방법MarkTechPost
테크·2026년 5월 16일Zyphra, ZAYA1-8B-Diffusion-Preview 공개: 최대 7.7배 속도 향상을 이룬 최초의 자회귀 LLM 변환 MoE 디퓨전 모델MarkTechPost
테크·2026년 5월 15일Supertone, 온디바이스 텍스트 음성 변환 모델 ‘Supertonic v3’ 출시… 31개 언어 지원, 읽기 실패 감소, 표현 태그 추가MarkTechPost