← 아카이브 목록
 TH—NEWS

Morning Digest — 2026-06-24

10 posts · 8 sources · ✓ 06:30 KST
제목 클릭 시 원문으로 이동
📢 새 기능. 이제 Claude Code/Desktop에서 MCP로 다이제스트를 바로 물어볼 수 있어요. 자세한 방법은 FAQ를 확인하세요.
👀 관심 있으면 볼 것
LLM/Agent
소스 제목 한줄 요약
GitHub shanraisshan/claude-code-best-practice Claude Code 활용 패턴과 에이전트형 개발 워크플로를 정리한 실무 가이드
PyTorch KR deepclaude: Claude Code의 에이전트 루프를 DeepSeek 등 더 저렴한 백엔드로 돌리는 도구 어제 Claude Code의 에이전트 루프를 DeepSeek 등 저비용 모델로 대체 실행하는 도구
PyTorch KR CADAM: 자연어로 3D CAD 모델을 만드는 오픈소스 text-to-CAD 웹 애플리케이션 어제 자연어·이미지 입력을 파라메트릭 OpenSCAD로 바꾸는 브라우저형 text-to-CAD 앱
HF Papers PlanBench-XL: Evaluating Long-Horizon Planning of LLM Tool-Use Agents… 대규모 도구 생태계에서 LLM 에이전트의 장기 계획 능력을 검증하는 PlanBench-XL
Simon Willison's Weblog Prompt Injection as Role Confusion 어제 프롬프트 인젝션을 역할 혼동으로 해석한 연구와 방어 한계
r/LocalLLaMA (Top Today) Why is NO one talking about Microsoft's open source Fast Context!!! 어제 Microsoft FastContext, 코드 에이전트용 저장소 탐색 서브에이전트 공개
Infra/MLOps
소스 제목 한줄 요약
AI Lab Blogs Boost Inference Performance up to 15x on NVIDIA Blackwell Using DFlas… NVIDIA Blackwell에서 DFlash 추측 디코딩으로 LLM 추론 최대 15배 가속
Research
소스 제목 한줄 요약
GeekNews 금융 데이터 사이언스 Part.0 금융 데이터 사이언스가 일반 ML과 다른 7가지 어제 신용 심사 ML이 일반 ML과 다른 7가지 구조적 제약 정리
Simon Willison's Weblog Porting the Moebius 0.2B image inpainting model to run in the browser… 어제 Moebius 0.2B 인페인팅 모델의 브라우저 WebGPU 구동 이식 사례
Hacker News Front Page Unlimited OCR: One-shot long-horizon parsing 어제 Baidu Unlimited-OCR 공개, 단일 호출로 장문서·다중 페이지 OCR 파싱 지원
📚 전체 목록 (소스별)
GitHub Trending · 1
https://github.com/trending
shanraisshan/claude-code-best-practice HTML · 329 stars today · ⭐ 59,368
AgentProductivityTooling
TL;DR. Claude Code 활용 패턴과 에이전트형 개발 워크플로를 정리한 실무 가이드
  • vibe coding에서 agentic engineering으로 넘어가는 개발 방식과 실천 팁 정리
  • Claude Code를 더 정확하고 일관되게 쓰기 위한 프롬프팅·작업 분해 관점 제공
  • GitHub 스타 5.9만여 개, 하루 329스타 기록의 높은 관심도와 실무 참고 자료 성격
PyTorch KR 읽을거리 · 2
https://discuss.pytorch.kr/c/news/14
deepclaude: Claude Code의 에이전트 루프를 DeepSeek 등 더 저렴한 백엔드로 돌리는 도구 어제
AgentCodingTooling
TL;DR. Claude Code의 에이전트 루프를 DeepSeek 등 저비용 모델로 대체 실행하는 도구
  • Claude Code의 에이전트 루프를 다른 LLM 백엔드로 연결해 실행하는 구성
  • DeepSeek 등 상대적으로 저렴한 모델을 활용한 비용 절감 지향
  • Claude Code 사용 경험은 유지하면서 모델 선택 폭을 넓히는 접근
CADAM: 자연어로 3D CAD 모델을 만드는 오픈소스 text-to-CAD 웹 애플리케이션 어제
GenerativeToolingOpenSource
TL;DR. 자연어·이미지 입력을 파라메트릭 OpenSCAD로 바꾸는 브라우저형 text-to-CAD 앱
  • 자연어 설명이나 참고 이미지를 Anthropic Claude API로 OpenSCAD 코드로 변환하는 오픈소스 웹 앱
  • 조절 가능한 치수를 자동 식별해 슬라이더로 노출, AI 재호출 없이 파라미터만 즉시 갱신하는 방식
  • OpenSCAD WebAssembly와 Three.js 기반 브라우저 실행 구조로 설치 없이 실시간 3D 미리보기 제공
GeekNews 최신 · 1
https://news.hada.io/new
금융 데이터 사이언스 Part.0 금융 데이터 사이언스가 일반 ML과 다른 7가지 어제
ResearchMLRisk
TL;DR. 신용 심사 ML이 일반 ML과 다른 7가지 구조적 제약 정리
  • 승인 고객의 상환 결과만 보이는 선택편향 구조와 reject inference·인과추론의 필요성
  • 무작위 K-fold 대신 OOT(out-of-time) 검증과 배포 후 drift 모니터링이 기본인 환경
  • AUC 같은 순위 성능만으로 부족하며 pricing·충당금 계산용 보정된 PD 추정의 중요성
HuggingFace Daily Papers · 1
https://huggingface.co/papers
PlanBench-XL: Evaluating Long-Horizon Planning of LLM Tool-Use Agents in Large-Scale Tool Ecosystems arXiv
AgentBenchmarkLLM
TL;DR. 대규모 도구 생태계에서 LLM 에이전트의 장기 계획 능력을 검증하는 PlanBench-XL
  • LLM tool-use agent의 long-horizon planning 성능을 평가하기 위한 벤치마크 PlanBench-XL 제안
  • 대규모 도구 생태계(large-scale tool ecosystems) 환경에서 도구 선택과 단계적 계획 수행 능력 측정
  • 단순 단일 호출이 아닌 장기 작업 맥락에서 에이전트의 계획 수립·실행 한계 분석에 초점
AI Lab Blogs · 1
https://openai.com/news
Boost Inference Performance up to 15x on NVIDIA Blackwell Using DFlash Speculative Decoding
InferenceLLMInfra
TL;DR. NVIDIA Blackwell에서 DFlash 추측 디코딩으로 LLM 추론 최대 15배 가속
  • NVIDIA Blackwell 기반에서 DFlash speculative decoding 적용 시 추론 성능 최대 15배 향상 사례
  • 단일 턴 응답을 넘어 멀티에이전트 워크플로로 확장되는 AI 시스템에서 저지연 추론 중요성 부각
  • 자가회귀 LLM의 토큰 순차 생성 병목을 speculative decoding으로 완화하는 접근 소개
Simon Willison's Weblog · 2
https://simonwillison.net/
Porting the Moebius 0.2B image inpainting model to run in the browser with Claude Code 어제
VisionInferenceTooling
TL;DR. Moebius 0.2B 인페인팅 모델의 브라우저 WebGPU 구동 이식 사례
  • PyTorch·NVIDIA CUDA 전용이던 Moebius 0.2B를 ONNX Runtime Web+WebGPU 기반 브라우저 실행으로 변환
  • Claude Code가 모델 변환, 웹 UI 구현, Hugging Face 가중치 배포, GitHub Pages 데모 공개까지 수행
  • 변환된 ONNX 가중치 크기 1.24GB, 초기 로드 시 약 1.3GB 다운로드 문제를 CacheStorage API로 완화
Prompt Injection as Role Confusion 어제
LLMSecurityResearch
TL;DR. 프롬프트 인젝션을 역할 혼동으로 해석한 연구와 방어 한계
  • 모델이 <system>, <think>, <assistant>, <user> 같은 역할 태그보다 텍스트 스타일을 더 강하게 단서로 활용한다는 분석
  • gpt-oss-20b 사례에서 사용자 입력이 내부 추론 블록처럼 보이면 초기 안전 정렬을 덮어쓰는 탈옥(jailbreak) 가능성 확인
  • 표현만 약간 바꾸는 destyling으로 의미는 유지한 채 공격 성공률이 데이터셋 평균 61%에서 10%로 급감
r/LocalLLaMA (Top Today) · 1
https://www.reddit.com/r/LocalLLaMA/top/?t=day
Why is NO one talking about Microsoft's open source Fast Context!!! 어제
AgentCodingOpenSource
TL;DR. Microsoft FastContext, 코드 에이전트용 저장소 탐색 서브에이전트 공개
  • FastContext-1.0-4B-SFT 기반 경량 저장소 탐색 서브에이전트 구조
  • 단일 모델이 탐색과 해결을 함께 맡지 않고 메인 에이전트와 역할 분리
  • READ·GLOB·GREP의 병렬 읽기 전용 툴 호출로 코드베이스 탐색 효율화
Hacker News Front Page · 1
https://news.ycombinator.com/
Unlimited OCR: One-shot long-horizon parsing 어제
OCRVisionInference
TL;DR. Baidu Unlimited-OCR 공개, 단일 호출로 장문서·다중 페이지 OCR 파싱 지원
  • Baidu의 Unlimited-OCR 발표, Deepseek-OCR을 확장한 one-shot long-horizon parsing 지향
  • 단일 이미지와 다중 페이지/PDF 파싱 지원, 문서를 이미지로 변환해 연속 입력하는 방식 제공
  • 최대 컨텍스트 길이 32768 설정 예시와 no-repeat ngram 제어로 장출력 반복 억제 구성