NVIDIA Vera Rubin NVL72, MLPerf Inference v6.1 첫 출전에서 최고 성능 기록
NVIDIA 한국 블로그가 9월 21일 MLPerf Inference v6.1 결과를 정리해 올렸다. 처음 출전한 Vera Rubin...
2026, Sep 25 — 4 minute readNVIDIA 한국 블로그가 9월 21일 MLPerf Inference v6.1 결과를 정리해 올렸다. 처음 출전한 Vera Rubin...
2026, Sep 25 — 4 minute readHugging Face 공동창업자 Thomas Wolf(@Thom_Wolf)가 9월 22일부터 25일(KST) 사이에 올린 트윗 가운데 기술적으로 읽을거리가 있는...
2026, Sep 25 — 5 minute readDAIR.AI(@dair_ai)가 2026년 9월 24일 X에 올린 스레드는 Salesforce AI Research의 터미널 에이전트 강화학습(RL) 논문 RIVER...
2026, Sep 24 — 4 minute read오랜만에 블로그 저장소를 열어보니 GitHub Dependabot이 취약점 36건(critical 1건 포함)을 알려주고 있었다. Claude Code의 도움을...
2026, Sep 22 — 18 minute read오라클 클라우드 프리티어 시작하기를 쓴 지 5년이 넘었는데, 그 무료 인스턴스가 여전히 현역이다. 정확히는 기존...
2026, Sep 22 — 7 minute readHugging Face 블로그의 「Transformers now runs llama.cpp quants」(Marc Sun·Arthur Zucker·Lysandre, 2026-09-22)를 정리했다. 로컬 추론은 llama.cpp...
2026, Sep 22 — 4 minute read토스 LLM Modeling 팀이 서비스 운영 환경에서 모델을 선별하기 위해 만든 Toss Benchmark를 공개했다. 공개...
2026, Sep 21 — 3 minute read에이전트에게 도구를 쥐여주는 방법은 대체로 둘 중 하나였다. 스키마를 꼼꼼히 정의한 typed tool 카탈로그를 주거나,...
2026, Sep 20 — 3 minute readHermes 에이전트가 배치 작업으로 수집한 RAG·AI 에이전트 분야 주간 논문 보고서(arXiv cs.IR/cs.CL/cs.MA/cs.AI/cs.LG + Hugging Face...
2026, Sep 20 — 5 minute read지금까지 오픈소스 AI 에이전트를 실제로 구축하며 쓴 글들이 흩어져 있다. Hermes 설치, 소스 구조, OCI...
2026, Sep 19 — 7 minute read