◆ 깃허브
- obra/superpowers↗
에이전트 기반 스킬 프레임워크 및 실무 검증 소프트웨어 개발 방법론
- browser-use/video-use↗
코딩 에이전트로 영상을 편집하는 도구, browser-use 팀 제작
- EveryInc/compound-engineering-plugin↗
Claude Code·Codex·Cursor 등을 위한 공식 Compound Engineering 플러그인
- firecrawl/pdf-inspector↗
PDF 검사·분류·텍스트 추출용 고속 Rust 라이브러리, AI 라우팅 스마트 감지
- zhaoxuya520/reverse-skill↗
AI 기반 보안/역공학 스킬 라우터 팩, Claude Code·Cursor·Kiro 지원
- TencentCloud/TencentDB-Agent-Memory↗
AI 에이전트 팀 레벨 메모리 허브, Chat Memory·Skill·LLM-Wiki·Code-Graph 통합
- esengine/DeepSeek-Reasonix↗
DeepSeek 네이티브 터미널 AI 코딩 에이전트, prefix-cache 안정성 중심 설계
- lyogavin/airllm↗
4GB GPU 하나로 70B LLM 추론을 가능하게 하는 라이브러리 (Jupyter · +1,711 stars/day)
- microsoft/generative-ai-for-beginners↗
21레슨 생성형 AI 시작 가이드 (Jupyter · +783 stars/day)
- livekit/agents↗
실시간 음성 AI 에이전트 구축 프레임워크
- uber/ADR↗
Uber가 공개한 AI 에이전트 보안 프레임워크, 관측성·보안 벤치마킹·위협 탐지
◆ 해커뉴스
- Changes at Google DeepMind: Demis Hassabis from CEO to Chair, Jeff Dean departs↗
구글 DeepMind 수뇌부 교체, Hassabis 의장직으로 전환·Dean 퇴사 발표 (280 pts)
- Cloudflare OS: an open platform for agents, apps, and work↗
에이전트·앱·업무를 위한 오픈 플랫폼, Cloudflare가 AI 인프라로 영역 확장 (393 pts) · 긱뉴스
- Beating GPT-5.6 Sol on retrieval with 100x cheaper open models↗
검색 태스크에서 GPT-5.6 Sol을 100배 저렴한 오픈모델로 능가하는 방법 (113 pts) · 긱뉴스
- Atlassian Rovo Exfiltrates Data, Bypassing Controls↗
Atlassian Rovo AI가 데이터 유출 통제를 우회해 외부로 데이터를 빼낼 수 있다는 보안 취약점 공개 (95 pts)
- Muse Code and Muse Spark 1.2↗
Meta Research가 코드·창의 작업 특화 AI 모델 Muse 시리즈 신버전 출시 (80 pts)
- Sycophantic AI Decreases Prosocial Intentions and Promotes Dependence (2025)↗
아첨하는 AI가 사용자의 친사회적 행동을 줄이고 의존성을 키운다는 연구 (49 pts)
- Goodhart's Law Comes for Every Benchmark You Trust↗
AI 평가 벤치마크가 목표가 되는 순간 지표로서의 가치를 잃는다는 분석 (22 pts)
- Launch HN: HyperProbe (YC S26) – Agents that do read-only debugging in prod↗
YC S26 출신, 프로덕션 환경에서 읽기 전용 디버깅을 수행하는 AI 에이전트 서비스 (31 pts)
- Born Against, or why hobby programming communities are against LLM usage↗
취미 프로그래밍 커뮤니티가 LLM 사용을 거부하는 이유와 문화적 배경 분석 (92 pts)
- Building an Advanced Agentic Harness↗
고급 AI 에이전트 하네스를 구축하는 방법론과 아키텍처 (84 pts)
- Meta Ran Ads That Contained AI-Generated Child Sexual Abuse Imagery↗
Wired, Meta 광고 플랫폼에서 AI 생성 아동 성착취 이미지가 포함된 광고가 노출됐음을 보도 (91 pts)
- Position: LLMs Can't Jump↗
LLM이 특정 추론 유형에서 근본적 한계를 지닌다는 포지션 페이퍼 (HN 상위)
- Painting with Gaussians↗
Gaussian Splatting을 활용한 인터랙티브 페인팅 도구 (79 pts)
◆ 긱뉴스
- Warp Agent CLI↗
Warp Terminal의 다중 모델 코딩 에이전트를 독립형 CLI 로 제공해 Ghostty, iTerm 2, VS Code, Windows·Mac 기본 터미널에서도 사용할 수 있음 tmux와 유사한 멀티플렉싱 구조 로 에이전트와 셸 사이의 PTY 연결을 관리하며, 디렉터리 변경·원격…
- AI가 아프리카 사이버 범죄의 절반 이상에 활용되며 사기 급증 – INTERPOL↗
INTERPOL의 African Cyberthreat Assessment Report 2026 에 따르면 아프리카에서 보고된 사이버 범죄의 55%에 AI가 사용됐으며, 공격 속도·설득력·규모가 커지고 있음 36개국 자료를 분석한 결과 온라인 사기 가 2025년 최대 사이버 위협이었고,…
- 소프트웨어 엔지니어링과 생성형 AI에 관한 8가지 오해↗
생성형 AI는 일부 개발 작업을 빠르게 하지만, 실제 업무 구성과 조직 환경을 무시한 과장된 생산성 기대 는 도입·측정·투자 결정을 왜곡할 수 있음 Microsoft의 2025년 조사에서 개발자의 코드 작성 시간은 전체의 14% 였으며, 코딩 속도를 2배로 높여도 전체 생산...
- Show GN: llmwiki-serve – Markdown 문서를 코딩 에이전트가 찾아 읽게 해주는 로컬 서버↗
안녕하세요. 코딩 에이전트가 내 Markdown 문서를 직접 찾아 읽게 해주는 llmwiki-serve 를 preview로 공개했습니다. 쓰기 어렵지 않게 만드는 것을 먼저 목표로 잡았습니다. Codex나 Claude Code를 쓰고 있다면 llmwiki-bridge…
- 취미 프로그래밍 커뮤니티가 LLM 사용에 강하게 반대하는 이유↗
체스 엔진 개발, OSDev, LangDev, EmuDev 같은 취미 커뮤니티는 작동하는 결과물보다 어려운 분야를 직접 익히는 숙련 과정 자체 를 중시함 오랜 노력으로 축적한 지식을 LLM으로 우회해 완성품을 만드는 행위는 활동의 목적을 놓치거나 부정행위 를 하는 것으로 받아...
- Show GN: rever-browser – 웹 리버싱하는 AI 에이전트 브라우저↗
AI 에이전트가 네트워크 트래픽을 보면서 사이트의 API를 리버싱하도록 도와주는 오픈소스 데스크톱 브라우저 대상 사이트를 그냥 브라우저에서 평소처럼 탐색하면, 뒤에서 모든 요청을 자동으로 기록합니다. AI 에이전트가 그 트래픽을 읽고, 사이트의 JS 번들을 뜯어보고(역난독화 포함), 페
◆ 아카이브
- MultiGlobeQA: A Multilingual and Globally Diverse Benchmark for Geospatial Reasoning↗
Martin Böckling 외 3인 · LLM의 지리공간 추론을 평가하는 다국어·전세계 벤치마크로, 201개국·17개 언어·46,060개 문답쌍을 제공한다
- Interpretable Adaptive Sampling for LLM Test-Time Scaling↗
Mobina Kashaniyan 외 1인 · 퍼지 제어기로 문제 난이도와 모델 확신도를 반영해 질의별 표본 수를 조절하는 해석 가능한 적응형 테스트타임 스케일링을 제안한다
- ParVL: Parallel Scaling and Expandable Compute Allocation for Multimodal LLMs↗
Yang Yang 외 7인 · 다중모달 LLM에서 기존 ViT·LLM 파라미터를 재사용해 병렬 연산을 확장하고 시각·언어 모달리티 간 연산 배분을 조절하는 프레임워크를 제안한다
- TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated Reasoning↗
Changle Qu 외 6인 · 도구 통합 추론에서 실행 조건부 사후정보로부터 턴 단위 감독 신호를 유도하는 자기증류 프레임워크 TurnSight를 제안한다
- Test-Time Scaling in Reasoning LLMs: Inference Regimes, Evaluation, and Reproducibility↗
Mohsen Hariri 외 13인 · 테스트타임 스케일링을 예산 기반 추론으로 형식화하고 단일궤적·표본집계·부분탐색 세 구조로 구분해 비교·재현성 문제를 정리한다
- Separating quantum circuits from classical LLMs↗
Srinivasan Arunachalam 외 3인 · 저심도 양자 회로와 유한자원 고전 언어모델 구조 사이의 무조건적 계산 분리를 이론적으로 증명한다