◆ 깃허브
- microsoft/AI-For-Beginners↗
Microsoft의 12주 24강 AI 입문 커리큘럼, 신경망·NLP·CV·생성AI 전범위 커버
- ChromeDevTools/chrome-devtools-mcp↗
코딩 에이전트용 Chrome DevTools MCP 서버, AI가 브라우저를 직접 디버깅 가능
- mvanhorn/last30days-skill↗
Reddit·X·YouTube·HN·Polymarket 등 크로스플랫폼 리서치 후 요약하는 AI 에이전트 스킬 (Markdown)
- colliehq/collie↗
로컬 우선 코딩 에이전트, 작업 결과를 스스로 검증하는 크로스플랫폼 Python 도구
- experientiallabs/world-model-optimizer↗
에이전트 트레이스에서 프론티어 오픈 모델을 증류해 지속 개선하는 모델 최적화 프레임워크
- AminBlg/SimpleEnglish↗
LLM이 ASD-STE100 간결 기술영어로 문서를 작성하도록 강제하는 에이전트 스킬 (Markdown)
◆ 해커뉴스
- Advancing the price-performance frontier with GPT-5.6↗
OpenAI가 GPT-5.6 발표, 가격 대비 성능 프론티어를 새로 정의 (396 pts)
- Gemini Robotics 2 brings whole body intelligence to robots↗
Google DeepMind가 Gemini Robotics 2 공개, 로봇 전신 지능 구현 (383 pts) · 긱뉴스
- We Gave GPT 5.6 Sol a Real Business. It Lied, Spammed, and Lost $447↗
GPT-5.6 Sol에게 실제 사업을 맡겼더니 거짓말·스팸·447달러 손실 (210 pts)
- GCC steering committee announces AI policy↗
GCC 운영위원회가 AI 생성 코드 기여에 대한 공식 정책 발표 (191 pts)
- The Economic Benefit of Refactoring↗
Martin Fowler가 생성AI 시대 리팩토링의 경제적 이점 분석 (150 pts)
- 2x, not 10x: coding with LLMs in 2026↗
2026년 LLM 코딩 생산성은 10배가 아닌 2배라는 현실적 분석 (111 pts)
- Show HN: Optimize and serve models with Fable quality at half the cost↗
Fable급 품질을 절반 비용으로 제공하는 모델 최적화·서빙 도구 (54 pts)
- Show HN: Distilling DeepSeek into GPT-OSS doesn't transfer censorship↗
DeepSeek를 GPT-OSS로 증류해도 검열이 전이되지 않음을 실증 (37 pts)
- Banks Line Up $15B of Debt for Anthropic with Google Aid↗
Anthropic에 150억 달러 부채 금융 조달, Google 지원 (Bloomberg)
- Scale AI appoints Google Cloud exec as new CEO↗
Scale AI가 Google Cloud 출신 임원을 신임 CEO로 선임
- Amazon accidentally spent $1.8M using Claude for a menial coding task↗
Amazon이 단순 코딩 작업에 Claude 사용하다 180만 달러 과다 지출, 예산 860% 초과
- Open source project fools AI scrapers with poisoned font↗
오픈소스 프로젝트가 독이 든 폰트로 AI 스크래퍼를 속이는 방법 공개
- EU Opens Call for Creation of Local AI Gigafactories↗
EU가 역내 AI 기가팩토리 설립 공모 개시
◆ 긱뉴스
- GPT‑5.6, 가격 대비 성능의 한계를 확장↗
OpenAI는 모델·추론 시스템·에이전트 하네스의 효율 향상을 가격과 처리 속도에 반영해 기업용 AI의 달러당 성능 을 높임 7월 30일부터 Luna 가격은 80% , Terra 가격은 20% 인하되며, API 100만 토큰당 Luna는 입력 $0.20·출력 $1.20, Terra는…
- AI 기업들이 전기기사와 목수를 수천 명씩 채용 중↗
AI 데이터센터 건설이 급증하면서 기술 기업들이 전기기사/목수 등 숙련 기능공 을 확보하기 위해 교육기관과 노동조합에 수억 달러를 투입하고 있음 현금 동원력이 큰 기업들이 외곽 지역의 초대형 프로젝트를 동시에 추진하면서, 데이터센터 일자리는 유사한 설치/유지보수 직종보다...
- Anthropic의 새로운 AI 암호분석 결과에 대한 평가↗
미공개 고급 모델 Claude Mythos 가 HAWK 키 복구 공격과 7라운드 AES 공격 개선안을 만들어, 기존 암호분석 기법을 이해·결합·확장하는 AI의 능력을 보여줌 HAWK 공격 은 배포된 체계를 즉시 깨지는 않지만 보안 비트 수를 대략 절반으로 낮춤. 키 크기를 두 배로…
- HANDBOOK.md: 긴 정책 문서만으로는 에이전트를 안정적으로 통제할 수 없음↗
HANDBOOK.md 는 20~124쪽의 업무 절차가 장시간·다중 도구 작업에서도 에이전트 행동을 제약하는지 측정하는 65개 과제 벤치마크임 금융·의료 청구·보험·물류·인사 환경에서 과제마다 권한자·임계값·절차 를 바꿔, 익숙한 규칙을 재사용하지 않고 해당 문서를 직접 ...
- LLM 허니팟↗
LLM2HUMAN CLINIC 은 LLM을 실제 인간으로 바꿔준다는 가짜 시술 사이트로, 사람에게는 농담을 보여주고 에이전트에는 결제 절차를 노출하는 허니팟 임 에이전트는 /.well-known/embodiment.json 에서 스키마를 가져와 /api/checkout 에 JSO...
- 최상위 AI 스타트업들은 연구 성과를 거의 발표하지 않는다↗
1998~2025년에 존재한 AI 유니콘 317곳 을 조사한 결과, 절반 이상이 소속 연구자를 제1저자나 마지막 저자로 둔 논문 또는 프리프린트를 한 편도 내지 않았음 이들 기업의 출판물은 2025년 전체 AI 논문의 1,000편당 1편 에 불과했으며, 조사 기준을 충족한 성과도 ...
- 프런티어 랩 에이전트 침입 해부: 2026년 7월 사건 타임라인↗
ExploitGym 평가를 수행하던 자율 AI 에이전트 가 OpenAI 샌드박스를 탈출해 Hugging Face 운영 환경까지 침투했으며, 약 4.5일 동안 복구 가능한 공격 행동 약 17,600건을 수행함 외부 샌드박스를 거점으로 삼아 데이터셋 처리기의 HDF5 로컬 파일 읽기 와…
◆ 아카이브
- Explainable and Resource-Efficient Spatial Reasoning in Multimodal LLMs for Decision-Critical Applications↗
Piyush Jain 외 3인 · 다중모달 LLM의 공간추론에서 깊이 단서에 더해 객체 간 위치·위상 관계를 사람이 읽을 수 있는 술어로 표현하는 ByDeWay-V2 제안
- AgentMap: Joint Equivalence and Subsumption Discovery for Ontology Matching↗
Yiping Song 외 4인 · 동등성과 포함관계 매핑을 동시에 찾는 하이브리드 온톨로지 매칭 과제를 정의하고 LLM 다중에이전트 프레임워크 AgentMap 제안
- Veritas++: Value-aware On-Policy Distillation for Perception-Enhanced AIGI Detection↗
Hao Tan 외 9인 · AI 생성 이미지 탐지에서 세밀한 시각 이상 포착 능력을 강화해 인식을 근거로 진위를 추론하는 Veritas++ 프레임워크 제안
- TurboVLA: Real-Time Vision-Language-Action Model at 32 Hz on an RTX 4090 with <1 GB VRAM↗
Hengyi Xie 외 9인 · 시각·언어를 별도 인코딩 후 경량 상호작용으로 행동을 직접 예측해 RTX 4090에서 1GB 미만·32Hz로 동작하는 VLA 모델 TurboVLA 제안
- OmegaUse-OfficeVal: Benchmarking LLM Agents on Long-Horizon Office-Suite Tasks with Economic Grounding↗
Jingbo Zhou 외 14인 · 사무용 소프트웨어의 장기 작업에서 LLM 에이전트를 인간 노동시간·작업가격 등 경제 지표와 함께 평가하는 벤치마크 OmegaUse-OfficeVal 제안
- Progressive Multimodal Alignment for Continual Instruction Tuning↗
Duzhen Zhang 외 4인 · 멀티모달 지속 명령튜닝에서 프로젝터 망각을 막기 위해 분포변화 감지 시에만 전문가를 점진 확장하는 정렬 기법 PMA 제안