← 아카이브 목록
 TH—NEWS

Morning Digest — 2026-05-27

10 posts · 8 sources · ✓ 06:30 KST
제목 클릭 시 원문으로 이동
📢 새 기능. 이제 Claude Code/Desktop에서 MCP로 다이제스트를 바로 물어볼 수 있어요. 자세한 방법은 FAQ를 확인하세요.
👀 관심 있으면 볼 것
LLM/Agent
소스 제목 한줄 요약
GitHub thedotmack/claude-mem 에이전트 세션 기록을 압축·재주입하는 지속 메모리 레이어
PyTorch KR CAD Skills: CAD와 로봇 설계를 자동화하는 Codex 및 Claude Code 등 AI 에이전트 스킬 모음 어제 CAD·로봇 설계 자동화를 위한 Codex·Claude Code 기반 에이전트 스킬 모음
GeekNews LLM 평가의 맹점: 우리는 왜 '행동'이 아니라 '지식'만 보는가? 단발성 정답 평가를 넘어 LLM의 장기 행동을 보는 벤치마크 필요성
HF Papers Macaron-A2UI: A Model for Generative UI in Personal Agents 개인 에이전트용 생성형 UI 모델 Macaron-A2UI 제안
HF Papers ParaVT: Taming the Tool Prior Paradox for Parallel Tool Use in Agenti… 에이전트 비디오 RL에서 병렬 도구 사용 편향을 다루는 ParaVT 제안
r/LocalLLaMA (Top Today) PrismML just released Binary and Ternary Bonsai Image 4B: 1-bit/terna… 1비트·삼진화 4B 확산 트랜스포머, 브라우저 WebGPU 로컬 실행 지원
Hacker News Front Page Outsourcing plus local AI will soon become more economical vs. fronti… 어제 저비용 엔지니어+로컬 AI 조합이 프런티어 LLM 가격 상한 압박 전망
Infra/MLOps
소스 제목 한줄 요약
PyTorch KR Cloudflare가 공개한, Mythos Preview 사용 후기 (feat. Project Glasswing) Cloudflare, Mythos Preview로 대규모 코드베이스 취약점 탐색 하니스 실전 공개
AI Lab Blogs Extract More Kernel Performance with NVIDIA CompileIQ Auto-Tuning NVIDIA CompileIQ 기반 커널 컴파일 옵션 자동 탐색·성능 최적화
Simon Willison's Weblog Microsoft Copilot Cowork Exfiltrates Files Microsoft Copilot Cowork의 이메일·이미지 렌더링 경로 악용 파일 유출 사례
📚 전체 목록 (소스별)
GitHub Trending · 1
https://github.com/trending
thedotmack/claude-mem TypeScript · 319 stars today · ⭐ 78,584
AgentLLMOpenSource
TL;DR. 에이전트 세션 기록을 압축·재주입하는 지속 메모리 레이어
  • 에이전트의 세션 활동 전반을 수집하고 AI로 압축해 장기 컨텍스트로 보존하는 구조
  • 이전 세션에서 관련 맥락을 다시 주입해 세션 간 단절을 줄이는 persistent context 방식
  • Claude Code, Codex, Gemini, Copilot, OpenClaw, Hermes, OpenCode 등 다수 에이전트 도구 지원
PyTorch KR 읽을거리 · 2
https://discuss.pytorch.kr/c/news/14
Cloudflare가 공개한, Mythos Preview 사용 후기 (feat. Project Glasswing)
SecurityAgentLLM
TL;DR. Cloudflare, Mythos Preview로 대규모 코드베이스 취약점 탐색 하니스 실전 공개
  • Anthropic Project Glasswing의 보안 특화 모델 Mythos Preview를 Cloudflare 50여 개 저장소에 적용한 운영 사례
  • 범용 프론티어 모델 대비 익스플로잇 체인 구성과 PoC 생성 능력에서 차별화, 저심각도 버그 묶음의 고위험화 가능성 확인
  • 일반 코딩 에이전트 방식은 컨텍스트와 처리량 한계로 대규모 저장소 커버리지 부족, 좁은 범위 병렬 에이전트 하니스 필요성 강조
CAD Skills: CAD와 로봇 설계를 자동화하는 Codex 및 Claude Code 등 AI 에이전트 스킬 모음 어제
AgentRoboticsTooling
TL;DR. CAD·로봇 설계 자동화를 위한 Codex·Claude Code 기반 에이전트 스킬 모음
  • CAD와 로봇 설계 워크플로 자동화를 목표로 한 AI 에이전트 스킬 모음 소개
  • Codex, Claude Code 등 코드 생성형 에이전트를 설계 작업에 연결하는 활용 맥락 제시
  • CAD 설계와 로보틱스 엔지니어링을 결합한 자동화 중심 사례·도구 집약
GeekNews 최신 · 1
https://news.hada.io/new
LLM 평가의 맹점: 우리는 왜 '행동'이 아니라 '지식'만 보는가?
LLMBenchmarkAgent
TL;DR. 단발성 정답 평가를 넘어 LLM의 장기 행동을 보는 벤치마크 필요성
  • MMLU·HumanEval·SWE-bench 등 현행 평가지표의 단일 세션·단일 정답 중심 한계 지적
  • 실제 코딩 에이전트 환경의 다중 세션, 상태 유지, 반복 상호작용 특성 반영 필요성
  • 지식 회상보다 계획 변경, 복구, 일관성 유지 등 행동적 역량 측정 주장
HuggingFace Daily Papers · 2
https://huggingface.co/papers
Macaron-A2UI: A Model for Generative UI in Personal Agents arXiv
AgentHCIGenerative
TL;DR. 개인 에이전트용 생성형 UI 모델 Macaron-A2UI 제안
  • 개인 에이전트(personal agent) 맥락에서 동적으로 UI를 생성하는 Macaron-A2UI 모델 제안
  • 자연어 지시나 작업 맥락에 맞춰 인터페이스를 구성하는 generative UI 접근 강조
  • 정적 화면 설계 대신 에이전트 상호작용에 맞는 적응형 UI 자동 생성 방향 제시
ParaVT: Taming the Tool Prior Paradox for Parallel Tool Use in Agentic Video Reinforcement Learning arXiv
AgentReinforcement LearningResearch
TL;DR. 에이전트 비디오 RL에서 병렬 도구 사용 편향을 다루는 ParaVT 제안
  • 에이전트형 비디오 강화학습(agentic video RL)에서 병렬 도구 사용(parallel tool use) 문제를 다루는 ParaVT 제안
  • 도구 사전편향(tool prior) 역설을 핵심 과제로 정의하고, 병렬 호출 시 학습 불안정성과 선택 왜곡 완화 목적
  • 비디오 환경과 도구 사용을 결합한 에이전트 학습 설정에 초점, 순차적 도구 사용 한계 보완 시도
AI Lab Blogs · 1
https://openai.com/news
Extract More Kernel Performance with NVIDIA CompileIQ Auto-Tuning
InferenceToolingInfra
TL;DR. NVIDIA CompileIQ 기반 커널 컴파일 옵션 자동 탐색·성능 최적화
  • GPU 커널 성능 엔지니어링의 난제인 최적 컴파일러 옵션 탐색 자동화 초점
  • 특정 커널·하드웨어 조합에 맞는 빌드 설정을 찾아 성능 향상 여지 발굴
  • 수작업 튜닝에 드는 반복 실험 비용을 줄이는 auto-tuning 접근 강조
Simon Willison's Weblog · 1
https://simonwillison.net/
Microsoft Copilot Cowork Exfiltrates Files
SecurityAgentLLM
TL;DR. Microsoft Copilot Cowork의 이메일·이미지 렌더링 경로 악용 파일 유출 사례
  • 에이전트가 사용자 승인 없이 본인 이메일로 메일 전송 가능 상태에서 공격 경로 형성
  • 수신 메일 내 외부 이미지 로드가 외부 네트워크 요청을 유발하며 데이터 유출 채널로 작동
  • OneDrive의 사전 인증 다운로드 링크(pre-authenticated link) 노출 시 파일 직접 다운로드 가능
r/LocalLLaMA (Top Today) · 1
https://www.reddit.com/r/LocalLLaMA/top/?t=day
PrismML just released Binary and Ternary Bonsai Image 4B: 1-bit/ternary text-to-image diffusion transformers that can even run 100% locally in your browser on WebGPU.
DiffusionInferenceOpenSource
TL;DR. 1비트·삼진화 4B 확산 트랜스포머, 브라우저 WebGPU 로컬 실행 지원
  • PrismML의 Bonsai Image 4B 공개, 1-bit·ternary 텍스트-투-이미지 diffusion transformer 계열
  • 모델 크기 약 3GB로 제시, 비교 대상으로 언급된 FLUX.2 Klein 4B의 약 16GB 대비 경량화
  • WebGPU 기반으로 브라우저에서 100% 로컬 실행 가능하다고 소개, 별도 서버 없이 데모 제공
Hacker News Front Page · 1
https://news.ycombinator.com/
Outsourcing plus local AI will soon become more economical vs. frontier labs 어제
LLMInferenceEconomics
TL;DR. 저비용 엔지니어+로컬 AI 조합이 프런티어 LLM 가격 상한 압박 전망
  • DeepSeek를 로컬 AI 비용 프록시로 두고, 저임금 국가 엔지니어+OSS LLM 조합의 경제성 비교 시도
  • 가정상 100만 입력 토큰당 5만 출력, 캐시 반영 평균 비용이 OpenAI 2.80달러·Anthropic 2.82달러·DeepSeek 0.094달러 수준
  • 본문은 프런티어 모델이 더 유능하더라도 코딩 업무에서는 30배 안팎 비용 차를 항상 정당화하기 어렵다는 논지 제시