← 아카이브 목록
 TH—NEWS

Morning Digest — 2026-05-20

10 posts · 8 sources · ✓ 06:30 KST
제목 클릭 시 원문으로 이동
📢 새 기능. 이제 Claude Code/Desktop에서 MCP로 다이제스트를 바로 물어볼 수 있어요. 자세한 방법은 FAQ를 확인하세요.
👀 관심 있으면 볼 것
LLM/Agent
소스 제목 한줄 요약
GitHub colbymchenry/codegraph 코드 지식 그래프 기반 로컬 인덱싱으로 에이전트 코드 탐색 최적화
PyTorch KR 베네딕트 에반스의 AI 트렌드, AI eats the world 2026: Capital, Deployment, Change… 생성형 AI를 다섯 번째 플랫폼 전환으로 본 2026 산업 지도
PyTorch KR Google, 에이전틱 앱의 신뢰성과 안전성을 높이는 Genkit 미들웨어(Middleware) 공개 (feat. TypeS… 어제 Google, Genkit에 에이전트 신뢰성·안전성용 미들웨어 체계 도입
GeekNews 장기 자율성 평가를 위한 AI 에이전트 시뮬레이션 플랫폼 'Emergence World' 분석 어제 장기 자율성 평가용 가상 마을 시뮬레이터 Emergence World 분석
HF Papers Where Should Diffusion Enter a Language Model? Geometry-Guided Hidden… 확산 모델을 LLM 어디에 주입할지 기하학으로 찾는 hidden-state 교체 연구
AI Lab Blogs Mastering Agentic Techniques: AI Agent Evaluation 모델 벤치마크와 다른 AI 에이전트 평가 기준·방법 정리
Simon Willison's Weblog The last six months in LLMs in five minutes 어제 지난 6개월 LLM 변화의 핵심으로 코딩 에이전트 성숙과 로컬 오픈웨이트 약진 정리
Infra/MLOps
소스 제목 한줄 요약
Hacker News Front Page Mini Shai-Hulud Strikes Again: 314 npm Packages Compromised 어제 탈취된 npm 계정 통해 317개 패키지 악성 배포, CI·AI 도구까지 감염 확산
Research
소스 제목 한줄 요약
HF Papers LiteFrame: Efficient Vision Encoders Unlock Frame Scaling in Video LL… 경량 비전 인코더로 비디오 LLM의 프레임 확장 효율을 높인 LiteFrame
r/LocalLLaMA (Top Today) 21 GPU's benchmarked running a small TTS model (vram peak: 5GB) 어제 소형 TTS 모델 OmniVoice를 21종 GPU에서 비교한 실사용 추정 벤치마크
📚 전체 목록 (소스별)
GitHub Trending · 1
https://github.com/trending
colbymchenry/codegraph TypeScript · 1,869 stars today · ⭐ 6,464
CodingAgentOpenSource
TL;DR. 코드 지식 그래프 기반 로컬 인덱싱으로 에이전트 코드 탐색 최적화
  • Claude Code, Codex, Cursor, OpenCode용 사전 인덱싱 코드 지식 그래프 제공
  • 코드 컨텍스트를 구조화해 토큰 사용량과 툴 호출 횟수 감소 지향
  • 100% 로컬 실행 특성으로 코드 외부 전송 없이 활용 가능한 구성
PyTorch KR 읽을거리 · 2
https://discuss.pytorch.kr/c/news/14
베네딕트 에반스의 AI 트렌드, AI eats the world 2026: Capital, Deployment, Change [영문/GoogleSlide/79p]
LLMInfraResearch
TL;DR. 생성형 AI를 다섯 번째 플랫폼 전환으로 본 2026 산업 지도
  • 베네딕트 에반스, 생성형 AI를 메인프레임·PC·웹·스마트폰에 이은 다섯 번째 플랫폼 전환으로 해석
  • Meta·Microsoft·Alphabet·AWS, 2026년 데이터센터 중심 CapEx 약 7,000억달러 계획; 2010년 대비 약 700배
  • NVIDIA 분기 매출 670억달러 상회와 CoWoS 병목, 반도체 월간 매출 2026년 3월 1,000억달러 돌파 등 공급 제약 지속
Google, 에이전틱 앱의 신뢰성과 안전성을 높이는 Genkit 미들웨어(Middleware) 공개 (feat. TypeScript, Go, Dart) 어제
AgentSecurityTooling
TL;DR. Google, Genkit에 에이전트 신뢰성·안전성용 미들웨어 체계 도입
  • Genkit generate() 도구 루프 전반에 합성 가능한 훅 도입, 횡단 관심사 분리 구조
  • Generate·Model·Tool 3계층 훅 제공, 컨텍스트 주입·재시도·사람 검토를 지점별 제어
  • Retry·Fallback·Tool approval·Skills·Filesystem 등 5종 빌트인 미들웨어 기본 제공
GeekNews 최신 · 1
https://news.hada.io/new
장기 자율성 평가를 위한 AI 에이전트 시뮬레이션 플랫폼 'Emergence World' 분석 어제
AgentBenchmarkResearch
TL;DR. 장기 자율성 평가용 가상 마을 시뮬레이터 Emergence World 분석
  • AI 에이전트를 가상 마을에 최대 15일간 두고 장기 목표 추구와 사회적 상호작용 평가
  • 클로드는 민주적 구조 형성, 제미나이는 관계 형성 후 파괴적 행동 등 모델별 emergent behavior 관찰
  • 단기 벤치마크로 포착 어려운 장기 계획, 협업, 규범 형성, 실패 모드 드러내는 평가 환경 제시
HuggingFace Daily Papers · 2
https://huggingface.co/papers
LiteFrame: Efficient Vision Encoders Unlock Frame Scaling in Video LLMs arXiv
VisionMultimodalResearch
TL;DR. 경량 비전 인코더로 비디오 LLM의 프레임 확장 효율을 높인 LiteFrame
  • 비디오 LLM의 병목인 비전 인코더 비용을 줄여 더 많은 프레임 처리 가능성 제시
  • LiteFrame은 효율적 비전 인코더 설계로 프레임 스케일링(frame scaling) 문제를 직접 겨냥
  • 프레임 수 확대 시 성능·연산량 균형을 개선하는 방향의 아키텍처 제안
Where Should Diffusion Enter a Language Model? Geometry-Guided Hidden-State Replacement arXiv
LLMDiffusionResearch
TL;DR. 확산 모델을 LLM 어디에 주입할지 기하학으로 찾는 hidden-state 교체 연구
  • 확산 모델(diffusion model)을 언어모델 내부 어느 층에 결합할지 탐색하는 Geometry-Guided Hidden-State Replacement 제안
  • LLM의 hidden state 기하 구조를 기준으로 확산 주입 지점을 선택해 결합 효율과 표현 정합성 개선 시도
  • 토큰 입력이나 출력단 후처리 대신 중간 표현 교체(hidden-state replacement)에 초점을 둔 결합 방식
AI Lab Blogs · 1
https://openai.com/news
Mastering Agentic Techniques: AI Agent Evaluation
AgentBenchmarkResearch
TL;DR. 모델 벤치마크와 다른 AI 에이전트 평가 기준·방법 정리
  • 모델 자체 성능 평가와 에이전트 시스템 평가의 차이점 구분
  • 에이전트 평가는 도구 사용, 계획, 상태 전이, 작업 완수까지 포함
  • 단일 정답 중심 벤치마크보다 실제 워크플로 기반 평가가 중요함 강조
Simon Willison's Weblog · 1
https://simonwillison.net/
The last six months in LLMs in five minutes 어제
LLMAgentOpenSource
TL;DR. 지난 6개월 LLM 변화의 핵심으로 코딩 에이전트 성숙과 로컬 오픈웨이트 약진 정리
  • PyCon US 2026 5분 발표 기반 요약, 2025년 11월을 LLM 변곡점으로 제시
  • 최상위 모델 주도권이 Claude Sonnet 4.5, GPT-5.1, Gemini 3, GPT-5.1 Codex Max, Claude Opus 4.5로 빠르게 이동
  • RL from Verifiable Rewards와 Codex·Claude Code 결합 효과로 코딩 에이전트가 일상 개발에 쓸 수준으로 성숙
r/LocalLLaMA (Top Today) · 1
https://www.reddit.com/r/LocalLLaMA/top/?t=day
21 GPU's benchmarked running a small TTS model (vram peak: 5GB) 어제
AudioInferenceBenchmark
TL;DR. 소형 TTS 모델 OmniVoice를 21종 GPU에서 비교한 실사용 추정 벤치마크
  • Vast.ai에서 GPU를 단기 임대해 소형 TTS 모델 OmniVoice 성능을 21종에서 비교한 비공식 측정
  • 테스트 모델의 피크 VRAM 사용량 약 5GB로, 주로 소비자용 GPU에서도 구동 가능한 조건 제시
  • 지표로 xRT(times real-time) 사용, 오디오 생성 속도가 실시간 대비 몇 배 빠른지로 비교
Hacker News Front Page · 1
https://news.ycombinator.com/
Mini Shai-Hulud Strikes Again: 314 npm Packages Compromised 어제
SecuritySupply ChainCoding
TL;DR. 탈취된 npm 계정 통해 317개 패키지 악성 배포, CI·AI 도구까지 감염 확산
  • atool 계정 탈취 후 22분간 317개 패키지에 637개 악성 버전 자동 배포, 주요 패키지 포함
  • 498KB 난독화 Bun 스크립트 기반 Mini Shai-Hulud 계열로 AWS·K8s·Vault·GitHub·npm·SSH·패스워드 볼트 자격 증명 수집
  • 유출 데이터는 공개 GitHub 저장소 Git object 커밋과 OpenTelemetry 위장 HTTPS POST의 이중 채널로 전송