◆ 깃허브
- alibaba/open-code-review↗
알리바바 실전에서 검증된 LLM Agent + 결정론적 파이프라인 하이브리드 코드 리뷰 도구 (오픈소스). ⭐ 439 today
- obra/superpowers↗
실제 작동하는 에이전틱 소프트웨어 개발 방법론 및 스킬 프레임워크. ⭐ 507 today
- palmier-io/palmier-pro↗
AI 워크플로에 특화된 macOS 비디오 편집기. ⭐ 346 today
- RyanCodrai/turbovec↗
TurboQuant 기반 벡터 인덱스 — Rust로 작성, Python 바인딩 제공. ⭐ 89 today
- andrewyng/aisuite↗
앤드류 응의 멀티 생성형 AI 프로바이더 통합 인터페이스. ⭐ 75 today
- affaan-m/ECC↗
Claude Code·Codex 등 에이전트 하네스 성능 최적화 시스템. ⭐ 364 today
- anthropics/claude-cookbooks↗
Claude 활용 노트북/레시피 모음 (공식 GitHub 저장소). ⭐ 144 today
◆ 해커뉴스
- Open-weight AI is having its Kubernetes moment↗
오픈 웨이트 AI가 쿠버네티스처럼 인프라 표준이 되는 전환점에 와 있다는 분석. (238 pts)
- Bringing PyTorch Monarch to AMD GPUs↗
PyTorch Monarch 분산 학습 프레임워크가 AMD GPU(ROCm)를 공식 지원하기 시작. (46 pts)
- Yorishiro – a macOS terminal where AI agents live↗
AI 에이전트가 상주하는 macOS 터미널 앱 (Show HN). (4 pts)
- Engineering management after the cost of code collapsed↗
AI로 코드 비용이 급락한 시대, 엔지니어링 매니지먼트의 역할 재정의. (84 pts)
◆ 긱뉴스
- Claude Opus 5, Artificial Analysis 지능 리더보드 1위↗
평가된 170개 모델 중 Claude Opus 5 Adaptive Reasoning·Max Effort 가 Intelligence Index 61점으로 1위를 차지했으며, Xhigh Effort와 Claude Fable 5가 각각 60점으로 뒤를 이음 Intelligence Index…
- Chrome이 Gemini 팝업용 전역 단축키를 무단 등록↗
Chrome이 사용자 동의 없이 Mac의 Ctrl+G 전역 단축키 를 등록해 다른 앱에서도 Gemini 팝업이 열리도록 함 코딩 편집기의 줄 이동 단축키와 충돌하는 데다, 팝업에는 Chrome·Gemini 식별 정보 와 비활성화 기능이 명확히 드러나지 않음 단축키를 끄려면 Ch...
- Show GN: 에이전트의 토큰낭비를 잡는 CLI를 만들었습니다! (공개 트레이스 6,780개)↗
토큰 낭비가 안 보이는 이유는 실패가 아니라 중복이라서입니다 같은 파일 두 번 읽기, 같은 인자로 재시도, 같은 도구 재호출. 그래서 끝난 트레이스를 읽어서 어느 스텝이 이미 한 일을 또 했는지 짚어주는 CLI를 만들었습니다! [써보기] pip install…
- Substack의 AI 투명성 도구를 둘러싼 작가들의 반응↗
Substack은 독자가 게시물의 인간 작성·AI 보조 비율을 추정하는 Pangram 스캔 과 창작 과정을 공개하는 “ How I make this ” 기능을 출시함 AI 사용 자체보다 투명성 부족 에 초점을 맞춰, 작가는 자신의 기여를 인정받고 독자는 읽을 콘텐츠를 더...
- AI 투자 실패로 Oracle, 직원 2만 1,000명 해고↗
Amazon/Microsoft/Alphabet/Meta가 2026년 AI 인프라에 약 6,000억 달러 를 지출할 것으로 예상되며, 기업 역사상 가장 비용이 크고 변동성이 높은 경쟁으로 번지고 있음 칩/서버/데이터센터 투자가 현금흐름을 약화시키면서, 막대한 지출이 실제 수익으로 이어질…
- Claude Cookbook: 에이전트부터 RAG·멀티모달·운영까지↗
Claude 애플리케이션을 구현하는 실전 가이드와 예제 를 모아 에이전트 구축부터 RAG·도구 사용·멀티모달·평가까지 폭넓게 다룸 Claude Agent SDK·Managed Agents 예제에는 멀티에이전트 조율, 세션 관리, 배포, 장애 대응, 취약점 탐지, 사용자 기억 등 운영…
- OpenAI의 ‘통제 이탈 해커 에이전트’ 이야기를 회의적으로 봐야 하는 이유↗
OpenAI의 해킹 에이전트 사건은 AI 위험성을 부각해 기술력을 과시하고 투자와 규제상 우위 를 확보해 온 홍보 전략의 연장선이라는 비판을 받음 2019년 GPT-2 공개 보류 로 악용 위험을 강조한 뒤 같은 해 7월 Microsoft가 10억 달러를 투자하면서, 위험성에 대한…
- Anthropic Opus 5 출시↗
Anthropic이 2026년 7월 24일, Claude Opus 5 를 공개했습니다. Opus 티어의 "세대 교체급" 개선 모델로, Fable 5(프론티어 모델)에 근접한 지능을 절반 가격에 제공하는 것이 핵심 포지셔닝입니다. 핵심 요약 포지셔닝 : Fable 5의 프론티어급 지능
◆ 아카이브
- X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment↗
Dongjie Fu 외 8인 · 텍스트 교사의 추론 능력을 오디오-언어 학생 모델에 온-폴리시로 증류하는 교차모달 프레임워크와 3단계 대칭 말뭉치를 제안한다.
- An Evaluation Framework for Structured Audio Captions Validated by Controlled Perturbations↗
Liang-Yuan Wu 외 3인 · 구조화된 오디오 캡션을 태그·설명·추론·수치·스펙트럼 다섯 축으로 평가하고 통제된 교란으로 검증하는 프레임워크를 제안한다.
- MedGame: Storytelling Gamification Empowered by Large Language Models for Medical Education↗
Qian Wu 외 10인 · 임상 사례를 의사결정 중심의 스토리텔링 게임으로 변환하는 이중 엔진 LLM 프레임워크와 5,000건 벤치마크를 제시한다.
- Agentic Context Management: Solving Agent Memory and Cost by Treating Them as Lifecycle and Architecture Problems↗
Gaurav Dadhich · 에이전트의 메모리·비용 문제를 저장·검색이 아니라 기억·구조화·망각·압축을 아우르는 생명주기와 아키텍처 문제로 재정의한다.
- PATS: Policy-Aware Training Scaffolding for Agentic Reinforcement Learning↗
Yipeng Shi 외 6인 · 약한 정책의 반복 실패를 줄이도록 롤아웃을 근거 카드로 만들어 학습 맥락을 조정하는 정책 중심 에이전트 강화학습 스캐폴딩을 제안한다.
- GS-Agent: Creating 4D Physical Worlds With Generative Simulation↗
Hongxin Zhang 외 5인 · 물리 엔진을 루프에 통합해 자연어로부터 물리적으로 타당한 동적 4D 세계를 생성하는 다중 에이전트 프레임워크를 제안한다.