◆ 깃허브
- cloudflare/computer↗
AI 에이전트에게 컴퓨터 조작 능력을 부여하는 Cloudflare 오픈소스 프레임워크
- addyosmani/agent-skills↗
AI 코딩 에이전트를 위한 프로덕션급 엔지니어링 스킬 컬렉션
- huangruiteng/loopx↗
장기 실행 AI 에이전트 팀을 위한 경량 루프 엔지니어링 상태 커널
- unclecode/crawl4ai↗
LLM 친화적 웹 크롤러·스크래퍼로 AI 파이프라인에 바로 통합 가능
- NousResearch/hermes-agent↗
"함께 성장하는" 오픈소스 AI 에이전트 프레임워크
- tirth8205/code-review-graph↗
MCP 및 CLI 지원, 로컬 우선 코드 인텔리전스 그래프 도구
- K-Dense-AI/scientific-agent-skills↗
어떤 AI 에이전트든 AI 과학자로 전환시키는 스킬 패키지
- ComposioHQ/awesome-claude-skills↗
Claude 스킬 및 AI 워크플로우 큐레이션 목록
- langchain-ai/open-swe↗
LangChain이 공개한 오픈소스 비동기 코딩 에이전트
- usestrix/strix↗
AI 기반 오픈소스 자동 침투 테스트 도구, 앱 취약점 탐지·수정
- Unclecheng-li/VulnClaw↗
AI Agent + MCP 도구 체인으로 정보 수집→취약점 발견→익스플로잇→보고서 자동 생성
- aws/agent-toolkit-for-aws↗
AWS 공식 MCP 서버·스킬·플러그인, AI 에이전트가 AWS 위에서 빌드하도록 지원
- TencentCloud/TencentDB-Agent-Memory↗
AI 에이전트 팀 레벨 메모리 허브, 대화·문서·코드를 4가지 재사용 자산으로 변환
- esengine/DeepSeek-Reasonix↗
DeepSeek 네이티브 터미널 AI 코딩 에이전트, prefix-cache 안정성 중심
◆ 해커뉴스
- Qwen3.8 Max now ranked as the best overall model by agentic index↗
Qwen3.8 Max가 에이전틱 인덱스 기준 전체 최상위 모델로 선정, 오픈웨이트 모델의 약진 (273 pts)
- Humans missed 1 in 3 threats approving AI agent commands across 40k game runs↗
40,000회 게임 실험에서 인간 감독자가 AI 에이전트의 위협 명령 중 3건에 1건을 놓쳤다는 보안 연구 (214 pts) · 긱뉴스
- Improving GPT-5.6 Sol in ChatGPT—and expanding access for free users↗
OpenAI가 GPT-5.6 Sol 성능을 개선하고 무료 사용자 접근 범위를 확대 발표 (74 pts)
- Show HN: The Channels SDK – Bring Any Agent to Any Channel (Slack, MS Teams)↗
CopilotKit이 공개한 AI 에이전트를 Slack·MS Teams 등 어느 채널에든 연결하는 오픈소스 SDK (72 pts)
- Taste Is All That's Left — AI 시대에 남는 것은 '취향'뿐↗
AI가 실행을 대체하면서 개발자에게 남은 경쟁력은 심미적·기술적 취향이라는 에세이 (72 pts)
- AMD acquires Taalas to boost inference performance by etching models in silicon↗
AMD가 모델 웨이트를 칩에 하드와이어링하는 스타트업 Taalas를 인수, Nvidia 독주에 도전
- SnapState - Persistent state for AI agent workflows↗
AI 에이전트 워크플로우를 위한 영속 상태 관리 서비스 (6 pts)
◆ 긱뉴스
- Meta, AI 생성 아동 성적 학대 이미지가 포함된 광고 게재↗
지난 9개월간 AI 생성 아동 성적 학대물(CSAM) 과 성적으로 암시적인 문구를 담은 유료 광고 수십 건이 Facebook·Instagram·Messenger·Threads의 심사를 통과해 노출됨 Tech Transparency Project(TTP)는 Meta 광고 라이브러리에서…
- 100배 저렴한 오픈 모델로 검색에서 GPT-5.6 Sol 능가하기↗
Castform으로 강화학습 후처리한 4B 오픈 소스 모델 이 GPT-5.6 Sol과 같은 수준의 검색 정확도를 달성하면서 비용은 100분의 1 로 낮춤 에이전트 검색은 한 번의 임베딩 검색에서 여러 차례 계획·검색하는 방식으로 진화했으며, GPT-5.6 Sol 기반 다중 턴 검색은…
- rust-lang/rust가 LLM 사용 정책을 도입함↗
Rust 프로젝트의 5개 팀이 rust-lang/rust 모노레포 기여 시 LLM 사용 방식 을 규정하는 정책을 채택했으며, Rust 전체의 공식 입장이나 프로젝트 전역 정책은 아님 질문·분석·정제·검사·제안·리뷰에는 LLM을 사용할 수 있지만 새 콘텐츠 생성 은 엄격...
- Cloudflare OS: 에이전트·앱·업무를 위한 개방형 플랫폼↗
Cloudflare가 전 직원을 대상으로 운영해 온 Cloudflare OS 의 새 버전을 오픈소스로 공개해, 조직별 지식·업무 절차·내부 시스템을 활용하는 에이전트 작업 공간을 직접 배포할 수 있게 함 플랫폼은 회사가 선별한 맥락과 기술을 사용하는 에이전트 작업 공간 , 내부...
- AI가 아프리카 사이버 범죄의 절반 이상에 활용되며 사기 급증 – INTERPOL↗
INTERPOL의 African Cyberthreat Assessment Report 2026 에 따르면 아프리카에서 보고된 사이버 범죄의 55%에 AI가 사용됐으며, 공격 속도·설득력·규모가 커지고 있음 36개국 자료를 분석한 결과 온라인 사기 가 2025년 최대 사이버 위협이었고,…
- 소프트웨어 엔지니어링과 생성형 AI에 관한 8가지 오해↗
생성형 AI는 일부 개발 작업을 빠르게 하지만, 실제 업무 구성과 조직 환경을 무시한 과장된 생산성 기대 는 도입·측정·투자 결정을 왜곡할 수 있음 Microsoft의 2025년 조사에서 개발자의 코드 작성 시간은 전체의 14% 였으며, 코딩 속도를 2배로 높여도 전체 생산...
- Show GN: llmwiki-serve – Markdown 문서를 코딩 에이전트가 찾아 읽게 해주는 로컬 서버↗
안녕하세요. 코딩 에이전트가 내 Markdown 문서를 직접 찾아 읽게 해주는 llmwiki-serve 를 preview로 공개했습니다. 쓰기 어렵지 않게 만드는 것을 먼저 목표로 잡았습니다. Codex나 Claude Code를 쓰고 있다면 llmwiki-bridge…
◆ 아카이브
- ContinualSkillBench: Can LLM Agents Truly Evolve Their Capabilities?↗
Tianyi Guan 외 7인 · LLM 에이전트의 스킬 진화 능력을 평가하는 벤치마크를 제안하고, 성능 향상 대부분이 스킬 재사용이 아닌 문맥 적응에서 온다고 밝혔다.
- OmniPack: Unified Token Compression for Efficient Omni-modal Large Language Models↗
Wanshun Su 외 12인 · 긴 시청각 토큰을 학습 없이 압축하는 옴니모달 LLM 프레임워크로, LLM 이전 구조적 압축과 내부 의미 정제를 결합했다.
- SocietyBench: Forecasting Counterfactual Social-World Evolution↗
Zhenran Wang 외 3인 · 한 줄 사건 주제로부터 뉴스·SNS를 타임라인으로 정리해 반사실적 사회 사건 전개를 예측하는 능력을 측정하는 벤치마크를 제안했다.
- ReflectRL: Learning from Golden Negative Trajectories via Reflective-to-Direct Reasoning↗
Jinhe Bi 외 12인 · 전문가 모델이 실패한 오답 궤적을 모방이 아닌 반성 대상으로 활용해 어려운 문제의 추론을 학습하는 강화학습 기법을 제안했다.
- UniWorld-Design: From Pixel Generation to Layer-Native Design↗
Zongjian Li 외 11인 · 이미지를 평면 픽셀이 아닌 의미 단위 RGBA 레이어로 생성·이해·편집하는 레이어 기반 디자인 생성 프레임워크를 제안했다.
- MAFIA: Query-Only Memory Attacks via Probing and Factual Injection against Audited LLM Agents↗
Jiaming Chen 외 5인 · 대규모 정상 메모리와 입력 감사 환경에서도 통하는, 질의만으로 LLM 에이전트 메모리를 오염시키는 공격 기법을 제안했다.