Morning Digest — 2026-06-10
10 posts · 8 sources · ✓ 06:30 KST
제목 클릭 시 원문으로 이동
📢
새 기능. 이제 Claude Code/Desktop에서 MCP로 다이제스트를 바로 물어볼 수 있어요. 자세한 방법은
FAQ를 확인하세요.
📚 전체 목록 (소스별)
LLMHealthcarePrivacy
TL;DR. 의료 텍스트를 기기 내에서 처리하는 로컬 우선 헬스케어 AI 오픈소스
- 임상 텍스트 구조화, 의료 NER, PII 비식별화를 API 호출 없이 온디바이스로 수행
- 1,000개 이상 의료 특화 모델, 12개 언어, 247개 PII 체크포인트 제공
- Python 원라인, Docker REST, 배치 처리, Swift 기반 iPhone·macOS 앱 연동 지원
TrainingLLMInfra
TL;DR. Microsoft AI, MAI-Thinking-1 보고서로 프런티어 모델 학습 시스템 전과정 공개
- 모델 성능보다 데이터·RL·평가·안전성·클러스터 운영을 묶은 힐 클라이밍 머신 관점 제시
- MAI-Thinking-1, 활성 35B·전체 1T MoE로 SWE-Bench Pro 52.8%, AIME 2025 97.0%, LiveCodeBench v6 87.7% 기록
- 사전학습에 30T 토큰, 중간학습에 3.55T 토큰 사용; 공개·계약 데이터만 활용하고 증류 데이터는 배제
LLMAgentResearch
TL;DR. Anthropic, 장기 비동기 작업용 5세대 Claude Fable 5·Mythos 5 공개
- Anthropic의 5세대 프런티어 모델 발표, 며칠 단위의 장기·비동기 작업 수행에 초점
- Fable 5는 Mythos급 성능을 일반 사용자용으로 안전하게 조정한 버전이라는 포지셔닝
- 기존 단일 질의응답보다 오래 지속되는 업무 흐름과 장기 실행형 에이전트 활용을 겨냥한 출시
HuggingFace Daily Papers · 2
MultimodalReasoningBenchmark
TL;DR. 실세계 과업에서 멀티모달 에이전트의 상호작용형 공간 추론을 평가하는 SpatialWorld 벤치마크
- 멀티모달 에이전트의 interactive spatial reasoning 성능 측정용 신규 벤치마크 제안
- 정적 VQA가 아닌 실세계 과업 맥락에서 상호작용 기반 공간 이해 능력 평가 지향
- 실제 환경 작업 수행에 필요한 지각·행동·추론 결합 능력 검증에 초점
BenchmarkVisionAgent
TL;DR. UE5 기반 통합 벤치마크로 VLM 게임 에이전트의 성능과 개선 동학 평가
- Unreal Engine 5(UE5) 기반의 통합 게임 벤치마크 OmniGameArena 제안
- 비전-언어 모델(VLM) 게임 에이전트 평가에 더해 improvement dynamics 분석 포함
- 정적 최종 점수뿐 아니라 학습·개선 과정의 변화 추적에 초점
InferenceOptimizationInfra
TL;DR. FP8 양자화 체크포인트를 TensorRT 추론 엔진으로 전환하는 배포 경로
- FP8로 양자화된 체크포인트를 NVIDIA TensorRT 엔진으로 변환해 최적화와 운영 배포 간 간극 해소
- 체크포인트 수준 양자화를 실제 고성능 추론 엔진으로 연결하는 배포 파이프라인과 변환 절차 중심
- TensorRT 기반 추론으로 더 빠른 실행과 효율 개선을 목표로 한 프로덕션 지향 접근
SpeechEvaluationAgent
TL;DR. 에이전트 스킬과 Nemotron Speech로 임상 ASR 평가 가속화 방법
- 아세트아미노펜·암로디핀 등 임상 용어 인식 난제를 겨냥한 clinical ASR 평가 워크플로 소개
- NVIDIA Nemotron Speech와 agent skills를 결합해 임상 음성 인식 모델 비교·평가 속도 향상
- 의료 도메인 특화 ASR에서 일반 발화 대비 높은 전문용어 오류율을 줄이기 위한 평가 자동화 초점
Simon Willison's Weblog · 1
LLMMultimodalInfra
TL;DR. 애플, Gemini 기반 Siri AI와 Core AI로 온디바이스·PCC 확장 제시
- WWDC 2026 Siri AI, 사용자 화면 정보 추출에 비전 LLM 활용 방향 제시
- 기존 앱별 Apple Intelligence 전용 코드 없이 화면 이해로 통합 시도
- 애플 전용 Private Cloud Compute(PCC)에 Gemini 파생 커스텀 모델 라이선스 적용
r/LocalLLaMA (Top Today) · 1
InferenceLLMInfra
TL;DR. 샤오미, 일반 8GPU 서버로 1T MoE 1,000+ TPS 주장
- MiMo-V2.5-Pro UltraSpeed 발표 맥락에서 1조 파라미터급 MoE 모델 1,000+ tokens/sec 출력 주장
- 단일 표준 8-GPU 노드에서 달성했다는 내용으로 특수 웨이퍼급 하드웨어 의존성 최소화 강조
- 비교 대상으로 Cerebras의 wafer-scale, Groq의 SRAM 중심 구조와 다른 범용 서버 기반 접근 제시
Hacker News Front Page · 1
AgentHCITech
TL;DR. 에이전트 시대의 얇은 클라이언트 부상 속 아이폰 중심성 재검토
- 마이크로소프트 Project Solara 제시, 클라우드 상주 에이전트와 다기기 포털 중심 하드웨어 비전
- 에이전트가 상호작용보다 과업 완료를 대행하는 구조로, 서버사이드 추론과 thin client 모델 부각
- WWDC의 Siri AI 데모는 실제 동작과 개인 맥락 활용을 보여줬지만, 자율 에이전트 수준과는 격차 노출