← 아카이브 목록
 TH—NEWS

Morning Digest — 2026-06-10

10 posts · 8 sources · ✓ 06:30 KST
제목 클릭 시 원문으로 이동
📢 새 기능. 이제 Claude Code/Desktop에서 MCP로 다이제스트를 바로 물어볼 수 있어요. 자세한 방법은 FAQ를 확인하세요.
👀 관심 있으면 볼 것
LLM/Agent
소스 제목 한줄 요약
GitHub maziyarpanahi/openmed 의료 텍스트를 기기 내에서 처리하는 로컬 우선 헬스케어 AI 오픈소스
GeekNews Claude Fable 5/Mythos 5 공개, Anthropic의 5세대 프런티어 모델 Anthropic, 장기 비동기 작업용 5세대 Claude Fable 5·Mythos 5 공개
HF Papers SpatialWorld: Benchmarking Interactive Spatial Reasoning of Multimoda… 실세계 과업에서 멀티모달 에이전트의 상호작용형 공간 추론을 평가하는 SpatialWorld 벤치마크
Simon Willison's Weblog Siri AI at WWDC 2026 어제 애플, Gemini 기반 Siri AI와 Core AI로 온디바이스·PCC 확장 제시
Hacker News Front Page The iPhone's Last Stand? 어제 에이전트 시대의 얇은 클라이언트 부상 속 아이폰 중심성 재검토
Infra/MLOps
소스 제목 한줄 요약
PyTorch KR MAI-Thinking-1 기술 보고서: 데이터 파이프라인부터 RL 인프라까지, 프런티어 모델 학습의 전 과정을 해부한 '힐… 어제 Microsoft AI, MAI-Thinking-1 보고서로 프런티어 모델 학습 시스템 전과정 공개
HF Papers OmniGameArena: A Unified UE5 Benchmark for VLM Game Agents with Impro… UE5 기반 통합 벤치마크로 VLM 게임 에이전트의 성능과 개선 동학 평가
AI Lab Blogs Model Quantization: Turn FP8 Checkpoints into High-Performance Infere… FP8 양자화 체크포인트를 TensorRT 추론 엔진으로 전환하는 배포 경로
r/LocalLLaMA (Top Today) Xiaomi just claimed 1,000+ tps on a 1T model using a standard 8-GPU s… 어제 샤오미, 일반 8GPU 서버로 1T MoE 1,000+ TPS 주장
Research
소스 제목 한줄 요약
AI Lab Blogs Evaluate Clinical ASR Models Faster with Agent Skills and NVIDIA Nemo… 에이전트 스킬과 Nemotron Speech로 임상 ASR 평가 가속화 방법
📚 전체 목록 (소스별)
GitHub Trending · 1
https://github.com/trending
maziyarpanahi/openmed Python · 165 stars today · ⭐ 1,813
LLMHealthcarePrivacy
TL;DR. 의료 텍스트를 기기 내에서 처리하는 로컬 우선 헬스케어 AI 오픈소스
  • 임상 텍스트 구조화, 의료 NER, PII 비식별화를 API 호출 없이 온디바이스로 수행
  • 1,000개 이상 의료 특화 모델, 12개 언어, 247개 PII 체크포인트 제공
  • Python 원라인, Docker REST, 배치 처리, Swift 기반 iPhone·macOS 앱 연동 지원
PyTorch KR 읽을거리 · 1
https://discuss.pytorch.kr/c/news/14
MAI-Thinking-1 기술 보고서: 데이터 파이프라인부터 RL 인프라까지, 프런티어 모델 학습의 전 과정을 해부한 '힐 클라이밍 머신' (feat. Microsoft AI) 어제
TrainingLLMInfra
TL;DR. Microsoft AI, MAI-Thinking-1 보고서로 프런티어 모델 학습 시스템 전과정 공개
  • 모델 성능보다 데이터·RL·평가·안전성·클러스터 운영을 묶은 힐 클라이밍 머신 관점 제시
  • MAI-Thinking-1, 활성 35B·전체 1T MoE로 SWE-Bench Pro 52.8%, AIME 2025 97.0%, LiveCodeBench v6 87.7% 기록
  • 사전학습에 30T 토큰, 중간학습에 3.55T 토큰 사용; 공개·계약 데이터만 활용하고 증류 데이터는 배제
GeekNews 최신 · 1
https://news.hada.io/new
Claude Fable 5/Mythos 5 공개, Anthropic의 5세대 프런티어 모델
LLMAgentResearch
TL;DR. Anthropic, 장기 비동기 작업용 5세대 Claude Fable 5·Mythos 5 공개
  • Anthropic의 5세대 프런티어 모델 발표, 며칠 단위의 장기·비동기 작업 수행에 초점
  • Fable 5는 Mythos급 성능을 일반 사용자용으로 안전하게 조정한 버전이라는 포지셔닝
  • 기존 단일 질의응답보다 오래 지속되는 업무 흐름과 장기 실행형 에이전트 활용을 겨냥한 출시
HuggingFace Daily Papers · 2
https://huggingface.co/papers
SpatialWorld: Benchmarking Interactive Spatial Reasoning of Multimodal Agents in Real-World Tasks arXiv
MultimodalReasoningBenchmark
TL;DR. 실세계 과업에서 멀티모달 에이전트의 상호작용형 공간 추론을 평가하는 SpatialWorld 벤치마크
  • 멀티모달 에이전트의 interactive spatial reasoning 성능 측정용 신규 벤치마크 제안
  • 정적 VQA가 아닌 실세계 과업 맥락에서 상호작용 기반 공간 이해 능력 평가 지향
  • 실제 환경 작업 수행에 필요한 지각·행동·추론 결합 능력 검증에 초점
OmniGameArena: A Unified UE5 Benchmark for VLM Game Agents with Improvement Dynamics arXiv
BenchmarkVisionAgent
TL;DR. UE5 기반 통합 벤치마크로 VLM 게임 에이전트의 성능과 개선 동학 평가
  • Unreal Engine 5(UE5) 기반의 통합 게임 벤치마크 OmniGameArena 제안
  • 비전-언어 모델(VLM) 게임 에이전트 평가에 더해 improvement dynamics 분석 포함
  • 정적 최종 점수뿐 아니라 학습·개선 과정의 변화 추적에 초점
AI Lab Blogs · 2
https://openai.com/news
Model Quantization: Turn FP8 Checkpoints into High-Performance Inference Engines with NVIDIA TensorRT
InferenceOptimizationInfra
TL;DR. FP8 양자화 체크포인트를 TensorRT 추론 엔진으로 전환하는 배포 경로
  • FP8로 양자화된 체크포인트를 NVIDIA TensorRT 엔진으로 변환해 최적화와 운영 배포 간 간극 해소
  • 체크포인트 수준 양자화를 실제 고성능 추론 엔진으로 연결하는 배포 파이프라인과 변환 절차 중심
  • TensorRT 기반 추론으로 더 빠른 실행과 효율 개선을 목표로 한 프로덕션 지향 접근
Evaluate Clinical ASR Models Faster with Agent Skills and NVIDIA Nemotron Speech
SpeechEvaluationAgent
TL;DR. 에이전트 스킬과 Nemotron Speech로 임상 ASR 평가 가속화 방법
  • 아세트아미노펜·암로디핀 등 임상 용어 인식 난제를 겨냥한 clinical ASR 평가 워크플로 소개
  • NVIDIA Nemotron Speech와 agent skills를 결합해 임상 음성 인식 모델 비교·평가 속도 향상
  • 의료 도메인 특화 ASR에서 일반 발화 대비 높은 전문용어 오류율을 줄이기 위한 평가 자동화 초점
Simon Willison's Weblog · 1
https://simonwillison.net/
Siri AI at WWDC 2026 어제
LLMMultimodalInfra
TL;DR. 애플, Gemini 기반 Siri AI와 Core AI로 온디바이스·PCC 확장 제시
  • WWDC 2026 Siri AI, 사용자 화면 정보 추출에 비전 LLM 활용 방향 제시
  • 기존 앱별 Apple Intelligence 전용 코드 없이 화면 이해로 통합 시도
  • 애플 전용 Private Cloud Compute(PCC)에 Gemini 파생 커스텀 모델 라이선스 적용
r/LocalLLaMA (Top Today) · 1
https://www.reddit.com/r/LocalLLaMA/top/?t=day
Xiaomi just claimed 1,000+ tps on a 1T model using a standard 8-GPU server 어제
InferenceLLMInfra
TL;DR. 샤오미, 일반 8GPU 서버로 1T MoE 1,000+ TPS 주장
  • MiMo-V2.5-Pro UltraSpeed 발표 맥락에서 1조 파라미터급 MoE 모델 1,000+ tokens/sec 출력 주장
  • 단일 표준 8-GPU 노드에서 달성했다는 내용으로 특수 웨이퍼급 하드웨어 의존성 최소화 강조
  • 비교 대상으로 Cerebras의 wafer-scale, Groq의 SRAM 중심 구조와 다른 범용 서버 기반 접근 제시
Hacker News Front Page · 1
https://news.ycombinator.com/
The iPhone's Last Stand? 어제
AgentHCITech
TL;DR. 에이전트 시대의 얇은 클라이언트 부상 속 아이폰 중심성 재검토
  • 마이크로소프트 Project Solara 제시, 클라우드 상주 에이전트와 다기기 포털 중심 하드웨어 비전
  • 에이전트가 상호작용보다 과업 완료를 대행하는 구조로, 서버사이드 추론과 thin client 모델 부각
  • WWDC의 Siri AI 데모는 실제 동작과 개인 맥락 활용을 보여줬지만, 자율 에이전트 수준과는 격차 노출