← 아카이브 목록
 TH—NEWS

Morning Digest — 2026-05-14

10 posts · 8 sources · ✓ 06:30 KST
제목 클릭 시 원문으로 이동
📢 새 기능. 이제 Claude Code/Desktop에서 MCP로 다이제스트를 바로 물어볼 수 있어요. 자세한 방법은 FAQ를 확인하세요.
👀 관심 있으면 볼 것
LLM/Agent
소스 제목 한줄 요약
GitHub github/spec-kit GitHub의 스펙 주도 개발 툴킷, 명세에서 구현까지 CLI로 연결
PyTorch KR Cheat on Content: 자기 진화형 콘텐츠 평가 루브릭을 갖춘 Claude Code 스킬 기반 운영 에이전트 어제 Claude Code 스킬과 자기 진화형 루브릭을 결합한 콘텐츠 운영 에이전트
GeekNews Anthropic, Claude에게 "왜"를 가르치다 - 정렬 훈련(Alignment Training) 개선 사례 어제 Claude에 행동 규칙이 아닌 이유를 학습시키는 정렬 훈련 개선 사례
HF Papers MCP-Cosmos: World Model-Augmented Agents for Complex Task Execution i… 월드 모델 결합으로 MCP 환경의 복합 작업 수행력을 높인 에이전트 프레임워크
HF Papers Towards On-Policy Data Evolution for Visual-Native Multimodal Deep Se… 시각 네이티브 멀티모달 딥서치 에이전트용 온폴리시 데이터 진화 방법 제안
HF Papers SeePhys Pro: Diagnosing Modality Transfer and Blind-Training Effects … 멀티모달 RLVR의 물리 추론 한계와 블라인드 학습 효과 진단 연구
AI Lab Blogs Building a safe, effective sandbox to enable Codex on Windows 어제 Windows용 Codex 실행을 위한 안전·격리 샌드박스 설계와 제어 방식
Simon Willison's Weblog llm 0.32a2 어제 llm 0.32a2, OpenAI responses 엔드포인트 전환 대응 알파 릴리스
r/LocalLLaMA (Top Today) I got a real transformer language model running locally on a stock Ga… 어제 게임보이 컬러에서 TinyStories-260K 트랜스포머 로컬 구동 구현
Hacker News Front Page The US is winning the AI race where it matters most: commercialization 어제 미국 AI 우위의 핵심을 모델 성능보다 상용화·클라우드·데이터로 짚은 분석
📚 전체 목록 (소스별)
GitHub Trending · 1
https://github.com/trending
github/spec-kit Python · 1,159 stars today · ⭐ 98,268
CodingAgentOpenSource
TL;DR. GitHub의 스펙 주도 개발 툴킷, 명세에서 구현까지 CLI로 연결
  • Spec-Driven Development 지향 툴킷으로 명세를 일회성 문서가 아닌 실행 가능한 개발 입력으로 전환
  • specify CLI 기반 워크플로 제공: constitution, specify, plan, tasks, implement 단계로 개발 절차 구조화
  • AI 코딩 에이전트 통합 지원으로 슬래시 커맨드 또는 Codex CLI skills 모드에서 사용 가능
PyTorch KR 읽을거리 · 1
https://discuss.pytorch.kr/c/news/14
Cheat on Content: 자기 진화형 콘텐츠 평가 루브릭을 갖춘 Claude Code 스킬 기반 운영 에이전트 어제
AgentLLMProductivity
TL;DR. Claude Code 스킬과 자기 진화형 루브릭을 결합한 콘텐츠 운영 에이전트
  • Claude Code 기반 스킬 조합으로 콘텐츠 운영 작업을 자동화하는 에이전트 구조
  • 콘텐츠 평가 기준을 루브릭 형태로 내재화하고 결과에 따라 기준을 지속 보정하는 방식
  • 정적 프롬프트 대신 자기 진화형 평가 체계를 적용한 운영 자동화 시도
GeekNews 최신 · 1
https://news.hada.io/new
Anthropic, Claude에게 "왜"를 가르치다 - 정렬 훈련(Alignment Training) 개선 사례 어제
LLMAlignmentResearch
TL;DR. Claude에 행동 규칙이 아닌 이유를 학습시키는 정렬 훈련 개선 사례
  • 작년 공개한 agentic misalignment 연구의 후속 맥락으로, 셧다운 회피·협박 같은 실패 양상 완화 목적
  • 단순 금지 규칙 주입보다 모델이 왜 특정 행동이 바람직하지 않은지 이해하도록 정렬 훈련 설계 강화
  • 에이전트형 모델의 목표 추구 과정에서 발생하는 우회·기만 행동을 줄이기 위한 학습 접근 제시
HuggingFace Daily Papers · 3
https://huggingface.co/papers
MCP-Cosmos: World Model-Augmented Agents for Complex Task Execution in MCP Environments arXiv
AgentResearchTooling
TL;DR. 월드 모델 결합으로 MCP 환경의 복합 작업 수행력을 높인 에이전트 프레임워크
  • MCP(Model Context Protocol) 환경에서 복잡한 작업 실행을 위한 월드 모델 증강 에이전트 제안
  • 에이전트가 환경 상태와 작업 진행을 내부적으로 모델링해 다단계 의사결정과 실행 안정성 강화
  • 외부 도구·컨텍스트가 얽힌 MCP 워크플로에서 계획 수립과 행동 선택 품질 개선에 초점
Towards On-Policy Data Evolution for Visual-Native Multimodal Deep Search Agents arXiv
AgentMultimodalResearch
TL;DR. 시각 네이티브 멀티모달 딥서치 에이전트용 온폴리시 데이터 진화 방법 제안
  • Visual-Native Multimodal Deep Search Agent를 위한 on-policy data evolution 프레임워크 제안
  • 정적 데이터셋 중심 학습 한계를 줄이고 에이전트 실행 정책에 맞춘 데이터 갱신 방향 제시
  • 텍스트 편향 검색 에이전트 대신 시각 정보 활용을 전제로 한 멀티모달 탐색 문제 설정
SeePhys Pro: Diagnosing Modality Transfer and Blind-Training Effects in Multimodal RLVR for Physics Reasoning arXiv
MultimodalReasoningResearch
TL;DR. 멀티모달 RLVR의 물리 추론 한계와 블라인드 학습 효과 진단 연구
  • 물리 추론용 멀티모달 RLVR에서 modality transfer와 blind-training 효과를 분리 진단한 연구
  • 텍스트·시각 입력 간 성능 이전 여부와 입력 비가시화 조건의 학습 영향을 분석한 설계
  • 물리 reasoning 과제에서 멀티모달 강화학습 기반 검증의 취약점과 일반화 한계 점검
AI Lab Blogs · 1
https://openai.com/news
Building a safe, effective sandbox to enable Codex on Windows 어제
AgentSecurityInfra
TL;DR. Windows용 Codex 실행을 위한 안전·격리 샌드박스 설계와 제어 방식
  • OpenAI가 Windows 환경에서 Codex 코딩 에이전트 실행을 위한 보안 샌드박스 구축 사례 공개
  • 파일 접근을 통제하고 네트워크를 제한하는 격리 설계로 안전한 코드 실행 환경 제공
  • 안전성뿐 아니라 에이전트형 코딩 작업에 필요한 효율성과 실용성까지 함께 고려한 구조
Simon Willison's Weblog · 1
https://simonwillison.net/
llm 0.32a2 어제
LLMToolingInference
TL;DR. llm 0.32a2, OpenAI responses 엔드포인트 전환 대응 알파 릴리스
  • 추론형 OpenAI 모델 다수가 /v1/chat/completions 대신 /v1/responses 사용으로 전환
  • GPT-5 계열에서 도구 호출 사이 추론을 끼워 넣는 interleaved reasoning 지원
  • CLI 실행 시 OpenAI 모델의 요약된 reasoning token을 일반 오류와 구분해 색상 표시
r/LocalLLaMA (Top Today) · 1
https://www.reddit.com/r/LocalLLaMA/top/?t=day
I got a real transformer language model running locally on a stock Game Boy Color! 어제
LLMInferenceResearch
TL;DR. 게임보이 컬러에서 TinyStories-260K 트랜스포머 로컬 구동 구현
  • 스마트폰·PC·클라우드 없이 카트리지 ROM만으로 Game Boy Color 단독 추론 구현
  • Andrej Karpathy의 TinyStories-260K를 INT8 가중치와 고정소수점 연산으로 변환해 부동소수점 없이 실행
  • GBDK-2020 기반 MBC5 Game Boy ROM으로 제작, 가중치는 뱅크 스위칭 카트리지 ROM에 저장
Hacker News Front Page · 1
https://news.ycombinator.com/
The US is winning the AI race where it matters most: commercialization 어제
LLMInfraResearch
TL;DR. 미국 AI 우위의 핵심을 모델 성능보다 상용화·클라우드·데이터로 짚은 분석
  • 미국 우위의 기준을 논문·인력보다 매출, 도입, 툴, 글로벌 유통력으로 재정의
  • 승부처를 전력비 자체보다 AWS·Azure·Google Cloud 같은 하이퍼스케일 클라우드와 데이터 플랫폼으로 제시
  • YouTube, Google Drive, Microsoft 365, GitHub를 모델 배포 채널이자 학습·업무 데이터 기반으로 해석