← 아카이브 목록
 TH—NEWS

Morning Digest — 2026-06-09

10 posts · 8 sources · ✓ 06:30 KST
제목 클릭 시 원문으로 이동
📢 새 기능. 이제 Claude Code/Desktop에서 MCP로 다이제스트를 바로 물어볼 수 있어요. 자세한 방법은 FAQ를 확인하세요.
👀 관심 있으면 볼 것
LLM/Agent
소스 제목 한줄 요약
GitHub luongnv89/claude-howto Claude Code 활용법을 예제와 템플릿으로 정리한 실전 가이드 저장소
PyTorch KR Paseo: Claude Code, Codex 등 코딩 에이전트를 휴대폰과 데스크톱에서 쓰는 셀프 호스팅 도구 어제 Claude Code·Codex를 모바일·데스크톱에서 쓰는 셀프 호스팅 코딩 에이전트 도구
PyTorch KR Jeju-Standard Korean Translator: 제주 방언과 표준어를 양방향 번역하는 88M 규모의 모델 어제 제주 방언·표준어 양방향 번역을 위한 88.79M 소형 Qwen3 계열 모델 공개
HF Papers LayerRoute: Input-Conditioned Adaptive Layer Skipping via LoRA Fine-T… LoRA 미세조정으로 입력별 레이어 스킵을 학습하는 에이전트형 LLM 추론 최적화
Simon Willison's Weblog datasette-agent-edit 0.1a0 어제 Datasette Agent용 텍스트 편집 공통 플러그인 0.1a0 공개
r/LocalLLaMA (Top Today) Gemma4_31b_fp8 keeping up with Sonnet_4.6_medium in my harness. 어제 Gemma4 31B FP8, 자체 하네스에서 Sonnet 4.6 medium급 추격 사례
Infra/MLOps
소스 제목 한줄 요약
GeekNews TypeScript를 LLVM 기계어로 직접 컴파일, "Perry" 네이티브 컴파일러 어제 TypeScript를 LLVM 네이티브 바이너리로 직접 컴파일하는 Rust 기반 컴파일러
HF Papers Almieyar-Oryx-BloomBench: A Bilingual Multimodal Benchmark for Cognit… 아랍어·영어 이중언어 기반 VLM 인지평가 벤치마크 제안
AI Lab Blogs Train Models Faster with JAX and MaxText Using NVFP4 on NVIDIA Blackw… Blackwell 기반 JAX·MaxText에서 NVFP4로 LLM 학습 처리량 향상
Hacker News Front Page MiMo-v2.5-Pro-UltraSpeed: 1T model with 1000 tokens per second 샤오미, 1T MiMo를 범용 8GPU에서 1000 tokens/s로 구동
📚 전체 목록 (소스별)
GitHub Trending · 1
https://github.com/trending
luongnv89/claude-howto Python · 393 stars today · ⭐ 35,726
LLMAgentCoding
TL;DR. Claude Code 활용법을 예제와 템플릿으로 정리한 실전 가이드 저장소
  • Claude Code의 기본 개념부터 고급 에이전트 활용까지 시각 자료와 예제로 구성한 안내서
  • 복사해 바로 적용 가능한 템플릿 중심 구성으로 빠른 실무 적용성 강조
  • GitHub Trending 기준 약 3.6만 스타, 당일 393개 스타를 기록한 높은 관심도
PyTorch KR 읽을거리 · 2
https://discuss.pytorch.kr/c/news/14
Paseo: Claude Code, Codex 등 코딩 에이전트를 휴대폰과 데스크톱에서 쓰는 셀프 호스팅 도구 어제
AgentCodingOpenSource
TL;DR. Claude Code·Codex를 모바일·데스크톱에서 쓰는 셀프 호스팅 코딩 에이전트 도구
  • Claude Code, Codex 등 코딩 에이전트를 개인 환경에서 운영하는 셀프 호스팅 도구
  • 휴대폰과 데스크톱 양쪽에서 접근 가능한 사용 환경 제공
  • 로컬·개인 인프라 중심의 에이전트 활용 워크플로우에 초점
Jeju-Standard Korean Translator: 제주 방언과 표준어를 양방향 번역하는 88M 규모의 모델 어제
LLMTranslationResearch
TL;DR. 제주 방언·표준어 양방향 번역을 위한 88.79M 소형 Qwen3 계열 모델 공개
  • PCN R&S LLM 팀 공개 모델로, Qwen3 계열 디코더 전용 아키텍처를 88.79M 규모로 처음부터 학습
  • 약 147만 쌍 제주어·표준어 평행 코퍼스를 H100 1장으로 4시간 학습, 단일 체크포인트로 양방향 번역 지원
  • <d2s>·<s2d> 프리픽스 토큰으로 번역 방향 제어, <copy> 자기 복사 보조 과제 5% 혼합으로 입력 보존 학습
GeekNews 최신 · 1
https://news.hada.io/new
TypeScript를 LLVM 기계어로 직접 컴파일, "Perry" 네이티브 컴파일러 어제
CompilerInfraTooling
TL;DR. TypeScript를 LLVM 네이티브 바이너리로 직접 컴파일하는 Rust 기반 컴파일러
  • SWC로 TypeScript를 파싱하고 LLVM으로 기계어 생성, Node.js·Electron·브라우저 엔진 없이 단일 실행 파일 출력
  • Rust·C++·Swift와 비슷한 수준의 성능 지향, macOS ARM64 벤치에서 일부 작업은 Node.js·Bun 대비 큰 폭 우위
  • v0.5.585부터 fast-math를 기본 비활성화해 Node와 f64 연산 비트 정확도 유지, 필요 시 CLI·환경변수·package.json으로 활성화
HuggingFace Daily Papers · 2
https://huggingface.co/papers
Almieyar-Oryx-BloomBench: A Bilingual Multimodal Benchmark for Cognitively Informed Evaluation of Vision-Language Models arXiv
BenchmarkVisionMultimodal
TL;DR. 아랍어·영어 이중언어 기반 VLM 인지평가 벤치마크 제안
  • Almieyar-Oryx-BloomBench 제안, 아랍어·영어를 아우르는 bilingual multimodal benchmark 구성
  • 비전-언어 모델(VLM) 평가에 인지적으로 설계된 과제 체계 적용, 단순 정답률 beyond 평가 지향
  • 다국어·멀티모달 환경에서 모델의 이해 능력과 일반화 성능을 점검하는 벤치마크 성격
LayerRoute: Input-Conditioned Adaptive Layer Skipping via LoRA Fine-Tuning for Agentic Language Models arXiv
LLMInferenceFine-tuning
TL;DR. LoRA 미세조정으로 입력별 레이어 스킵을 학습하는 에이전트형 LLM 추론 최적화
  • 입력 조건(input-conditioned)에 따라 레이어 실행 여부를 동적으로 결정하는 LayerRoute 제안
  • LoRA fine-tuning 기반으로 적응형 레이어 스키핑을 학습해 전체 모델 수정 비용 최소화 지향
  • 에이전트형 언어모델(agentic language models) 추론에서 입력별 계산량 조절과 효율 향상 겨냥
AI Lab Blogs · 1
https://openai.com/news
Train Models Faster with JAX and MaxText Using NVFP4 on NVIDIA Blackwell
TrainingLLMInfra
TL;DR. Blackwell 기반 JAX·MaxText에서 NVFP4로 LLM 학습 처리량 향상
  • NVIDIA Blackwell 환경에서 JAX와 MaxText 조합으로 NVFP4 활용 학습 가속 소개
  • 프런티어 LLM 사전학습의 핵심 지표를 처리량(throughput) 중심으로 설명
  • 수천 개 가속기와 수조 토큰 규모 학습에서 단계별 성능 개선의 누적 효과 강조
Simon Willison's Weblog · 1
https://simonwillison.net/
datasette-agent-edit 0.1a0 어제
AgentToolingOpenSource
TL;DR. Datasette Agent용 텍스트 편집 공통 플러그인 0.1a0 공개
  • 기존 텍스트 수정 작업용 Datasette Agent 베이스 플러그인으로 view·str_replace·insert 핵심 도구 제공
  • 협업형 Markdown 편집, 대형 SQL 쿼리 업데이트, SVG 파일 수정 등 다양한 편집 플러그인의 공통 기반 지향
  • Claude 텍스트 에디터 설계를 참고해 줄 번호 기반 조회와 정확 일치 치환, 라인 단위 삽입 패턴 채택
r/LocalLLaMA (Top Today) · 1
https://www.reddit.com/r/LocalLLaMA/top/?t=day
Gemma4_31b_fp8 keeping up with Sonnet_4.6_medium in my harness. 어제
LLMInferenceAgent
TL;DR. Gemma4 31B FP8, 자체 하네스에서 Sonnet 4.6 medium급 추격 사례
  • 작성자 자체 평가 하네스에서 Gemma4 31B FP8이 Sonnet 4.6 medium과 비슷한 수준 성능 보고
  • 평가 과제에 Neo4j 그래프 순회용 Cypher 쿼리 생성, 텍스트 청크 엔터티 추출 포함
  • 웹 질의·그래프 질의·벡터 검색을 아우르는 에이전트형 툴 호출과 스킬 선택 시나리오 평가
Hacker News Front Page · 1
https://news.ycombinator.com/
MiMo-v2.5-Pro-UltraSpeed: 1T model with 1000 tokens per second
InferenceLLMInfra
TL;DR. 샤오미, 1T MiMo를 범용 8GPU에서 1000 tokens/s로 구동
  • Xiaomi와 TileRT 협업으로 MiMo-V2.5-Pro-UltraSpeed 공개, 1T 파라미터 모델 디코드 1000+ tokens/s 달성
  • 전용 ASIC 대신 단일 범용 8-GPU 노드에서 구현, 모델-시스템 공동 설계(codesign) 전략 강조
  • FP4(MXFP4) 양자화로 메모리·대역폭 병목 축소, 추론 품질 저하를 줄이기 위한 선택적 적용 언급