← 아카이브 목록
 TH—NEWS

Morning Digest — 2026-04-27

10 posts · 7 sources · ✓ 06:30 KST
제목 클릭 시 원문으로 이동
📢 새 기능. 이제 Claude Code/Desktop에서 MCP로 다이제스트를 바로 물어볼 수 있어요. 자세한 방법은 FAQ를 확인하세요.
👀 관심 있으면 볼 것
LLM/Agent
소스 제목 한줄 요약
GitHub openclaw/openclaw 개인 기기에서 구동되는 로컬 지향 멀티채널 AI 비서 플랫폼
GeekNews Gemini Enterprise Agent Platform — 구글 클라우드의 차세대 AI 에이전트 통합 플랫폼 어제 Vertex AI를 확장한 구글 클라우드의 엔터프라이즈 AI 에이전트 통합 플랫폼 출시
HF Papers 3D-VCD: Hallucination Mitigation in 3D-LLM Embodied Agents through Vi… 3D-LLM 에이전트 환각을 대비 디코딩으로 줄이는 3D-VCD 제안
HF Papers LLaTiSA: Towards Difficulty-Stratified Time Series Reasoning from Vis… 시각 인지부터 의미 해석까지 난이도별 시계열 추론을 정리한 LLaTiSA
Simon Willison's Weblog WHY ARE YOU LIKE THIS 어제 ChatGPT Images 2.0, 프롬프트 외 문구 삽입 사례 확인
r/LocalLLaMA (Top Today) Qwen3.6 35B A3B Heretic (KLD 0.0015!) Incredible model. Best 35B I ha… 어제 Qwen3.6 35B 기반 저검열 파생 모델, 24GB VRAM·262K 컨텍스트 구동 사례
Hacker News Front Page Show HN: AI memory with biological decay (52% recall) 에이전트용 지속 메모리 레이어 구현체, 망각 곡선 기반 감쇠와 하이브리드 검색 결합
Infra/MLOps
소스 제목 한줄 요약
HF Papers WorldMark: A Unified Benchmark Suite for Interactive Video World Mode… 인터랙티브 비디오 월드 모델 평가를 위한 통합 벤치마크 스위트 제안
Hacker News Front Page SWE-bench Verified no longer measures frontier coding capabilities 어제 OpenAI, SWE-bench Verified 중단 권고…코딩 벤치마크 오염·평가 결함 지적
Research
소스 제목 한줄 요약
PyTorch KR [2026/04/20 ~ 26] 이번 주에 살펴볼 만한 AI/ML 논문 모음 4월 넷째 주 주목할 AI·ML 논문을 분야별로 묶은 주간 큐레이션
📚 전체 목록 (소스별)
GitHub Trending · 1
https://github.com/trending
openclaw/openclaw TypeScript · 620 stars today · ⭐ 364,532
AgentProductivityTooling
TL;DR. 개인 기기에서 구동되는 로컬 지향 멀티채널 AI 비서 플랫폼
  • WhatsApp·Telegram·Slack·Discord·iMessage 등 다수 메시징 채널과 macOS·iOS·Android 음성 인터페이스 지원
  • Gateway를 제어 평면으로 두고 세션·채널·도구·이벤트를 통합 관리하는 local-first 단일 사용자 비서 구조
  • 채널·계정·상대별로 격리된 에이전트에 라우팅하는 멀티에이전트 구성과 Live Canvas 기반 시각 작업공간 제공
PyTorch KR 읽을거리 · 1
https://discuss.pytorch.kr/c/news/14
[2026/04/20 ~ 26] 이번 주에 살펴볼 만한 AI/ML 논문 모음
ResearchLLMGenerative
TL;DR. 4월 넷째 주 주목할 AI·ML 논문을 분야별로 묶은 주간 큐레이션
  • 2026년 4월 20~26일 공개·회자된 AI/ML 논문을 한데 모은 주간 아카이브
  • PyTorch Korea 커뮤니티 기반의 논문 큐레이션 형식, 최신 연구 동향 빠른 훑어보기 용도
  • 개별 논문 심층 해설보다 한 주간 주목할 연구를 폭넓게 탐색하는 출발점 성격
GeekNews 최신 · 1
https://news.hada.io/new
Gemini Enterprise Agent Platform — 구글 클라우드의 차세대 AI 에이전트 통합 플랫폼 어제
AgentLLMMLOps
TL;DR. Vertex AI를 확장한 구글 클라우드의 엔터프라이즈 AI 에이전트 통합 플랫폼 출시
  • 기존 Vertex AI를 확장·진화한 Gemini Enterprise Agent Platform 공식 공개
  • AI 에이전트 개발·배포·운영을 아우르는 엔터프라이즈용 통합 플랫폼 지향
  • 구글 클라우드 환경에서 Gemini 기반 에이전트 구축 워크플로 일원화
HuggingFace Daily Papers · 3
https://huggingface.co/papers
3D-VCD: Hallucination Mitigation in 3D-LLM Embodied Agents through Visual Contrastive Decoding arXiv
LLMRoboticsResearch
TL;DR. 3D-LLM 에이전트 환각을 대비 디코딩으로 줄이는 3D-VCD 제안
  • 3D-LLM embodied agent의 환각(hallucination) 완화를 위한 Visual Contrastive Decoding 기반 방법 제안
  • 3D 장면 이해와 행동 의사결정 과정에서 시각 신호 대비를 활용해 잘못된 생성 억제 목표
  • 학습 단계 변경보다 디코딩 단계 개입에 초점을 둔 접근으로 기존 모델 적용 가능성 시사
LLaTiSA: Towards Difficulty-Stratified Time Series Reasoning from Visual Perception to Semantics arXiv
Time SeriesReasoningResearch
TL;DR. 시각 인지부터 의미 해석까지 난이도별 시계열 추론을 정리한 LLaTiSA
  • 시계열 추론을 시각적 지각에서 의미적 해석까지 아우르는 난이도 계층 관점으로 구조화
  • LLaTiSA 프레임워크 제안 중심의 연구로, 시계열 이해 과제를 단계별 reasoning 문제로 재정의
  • 단순 패턴 인식과 고차 의미 추론을 구분해 평가·학습 체계 설계의 기준점 제공
WorldMark: A Unified Benchmark Suite for Interactive Video World Models arXiv
BenchmarkVideoResearch
TL;DR. 인터랙티브 비디오 월드 모델 평가를 위한 통합 벤치마크 스위트 제안
  • Interactive video world model 평가를 위한 통합 벤치마크 WorldMark 제안
  • 분절된 기존 평가를 묶어 상호작용성·예측·제어 성능 비교 기반 제공
  • 모델·방법 간 공정 비교를 위한 표준화된 태스크와 평가 프로토콜 지향
Simon Willison's Weblog · 1
https://simonwillison.net/
WHY ARE YOU LIKE THIS 어제
GenerativeMultimodalResearch
TL;DR. ChatGPT Images 2.0, 프롬프트 외 문구 삽입 사례 확인
  • Scott JLA 프롬프트로 생성한 이미지에 'WHY ARE YOU LIKE THIS' 표지판이 자발적으로 추가된 사례
  • 사용 프롬프트는 말-우주비행사-펠리컨-자전거를 층층이 쌓은 초현실 장면 구성
  • 모델은 ChatGPT Images 2.0으로 확인됐으며, 문구 삽입이 프롬프트 지시가 아님을 재검증
r/LocalLLaMA (Top Today) · 1
https://www.reddit.com/r/LocalLLaMA/top/?t=day
Qwen3.6 35B A3B Heretic (KLD 0.0015!) Incredible model. Best 35B I have found! 어제
LLMInferenceOpenSource
TL;DR. Qwen3.6 35B 기반 저검열 파생 모델, 24GB VRAM·262K 컨텍스트 구동 사례
  • Qwen 3.6 35B A3B Heretic 소개, KLD 0.0015를 강조한 저검열(uncensored) 파생 모델 언급
  • IQ4XS 양자화와 Q8 KV cache 조합으로 262K 컨텍스트를 24GB VRAM에 수용했다는 사용자 보고
  • 멀티턴 툴 호출에서 실패하지 않았다는 사용 경험 공유, 로컬 에이전트 활용 적합성 시사
Hacker News Front Page · 2
https://news.ycombinator.com/
Show HN: AI memory with biological decay (52% recall)
AgentMLOpsTooling
TL;DR. 에이전트용 지속 메모리 레이어 구현체, 망각 곡선 기반 감쇠와 하이브리드 검색 결합
  • 에빙하우스 망각 곡선 적용 메모리 강도 모델로 중요도·회상 빈도에 따라 감쇠 속도 조절
  • BM25·벡터·그래프·decay 결합 방식으로 LoCoMo-10 1,534개 QA에서 Recall@5 59% 기록, Zep Cloud 28% 대비 우세
  • DuckDB·NetworkX·sentence-transformers·spaCy 기반 로컬 실행 구조, Docker·외부 DB·외부 서비스 없이 설치 가능
SWE-bench Verified no longer measures frontier coding capabilities 어제
BenchmarkCodingResearch
TL;DR. OpenAI, SWE-bench Verified 중단 권고…코딩 벤치마크 오염·평가 결함 지적
  • 지난 6개월 SOTA가 74.9%→80.9%로 둔화되며, 점수 향상이 실제 코딩 역량인지 재검토한 분석
  • o3가 64회 실행에서도 못 푼 138개 문제 감사 결과, 59.4%에서 결함 있는 테스트·불충분 명세 확인
  • 감사 대상의 35.5%는 구현 세부를 강제하는 제한적 테스트, 18.8%는 명세 외 기능을 요구하는 광범위 테스트