| TH—NEWS |
DeepTeam: LLM과 AI 에이전트를 레드팀하는 오픈소스 보안 테스트 프레임워크와 AgentLens: Production-Assessed Trajectory Reviews for Coding Agent Evaluation처럼 실무 감각 있는 읽을거리가 섞여 있습니다.
| 01 |
OpenAI GPT 5.6 출시
GPT-5.6 GA와 Sol·Terra·Luna 3종이 공개돼 모델 선택지가 크게 넓어졌습니다.
💡 모델 성능·비용·제품 전략 변화를 한 번에 파악 가능
|
| 02 |
GPT-5.6 is now the preferred model in Microsoft 365 Copilot
GPT-5.6이 Microsoft 365 Copilot 기본 선호 모델이 되며 업무 도구 체감이 달라집니다.
💡 기업 사용자에게 즉시 체감될 배포 변화라서
|
| 03 |
DeepTeam: LLM과 AI 에이전트를 레드팀하는 오픈소스 보안 테스트 프레임워크
LLM·에이전트를 공격자 관점에서 점검할 수 있는 실전형 오픈소스 보안 평가 도구입니다.
💡 에이전트 배포 전 취약점 점검 흐름에 바로 연결됨
|
| 소스 | 제목 | 한줄 요약 |
|---|---|---|
| GitHub | anthropics/claude-cookbooks | Claude 활용법을 노트북·레시피로 정리한 Anthropic 실전 예제 모음 |
| HF Papers | AgentLens: Production-Assessed Trajectory Reviews for Coding Agent Ev… | 프로덕션 관점의 궤적 리뷰로 코딩 에이전트 평가 한계 보완 |
| Simon Willison's Weblog | The new GPT-5.6 family: Luna, Terra, Sol | OpenAI GPT-5.6 3종 공개, 에이전트 성능·API 기능·가격 동시 확장 |
| Simon Willison's Weblog | Rewriting Bun in Rust 어제 | Bun의 Zig→Rust 재작성과 에이전트 기반 대규모 코드 이관 사례 |
| Hacker News Front Page | Muse Spark 1.1 어제 | Meta, 100만 토큰·멀티에이전트 최적화한 Muse Spark 1.1 공개 |
| 소스 | 제목 | 한줄 요약 |
|---|---|---|
| r/LocalLLaMA (Top Today) | What China Said at the UN’s First Global Dialogue on AI Governance 어제 | 중국, UN 첫 AI 거버넌스 대화서 오픈소스 AI 확산 기조 강조 |
| 소스 | 제목 | 한줄 요약 |
|---|---|---|
| Simon Willison's Weblog | Introducing GPT‑Live 어제 | OpenAI GPT‑Live 공개, 음성 대화 중 GPT‑5.5 백그라운드 위임 지원 |
Jupyter Notebook · 194 stars today · ⭐ 47,096