찾으시는 소식이 없소이다. 다른 낱말로 찾아보시오.
◆ 이번 주 세 줄 읽는 데 40초
Opus 5·Fable 5가 세대교체를 알린 주에 Kimi K3·Qwen 3.8이 프론티어급에 근접하며 성능이 오픈웨이트로 확산됐다
→ 폐쇄형 단독 채택 대신 오픈웨이트 대안을 벤치·검증 목록에 올려라
중국 오픈웨이트가 배포 생태계를 넓히자 美 빅테크와 양대 랩이 규제·여론전으로 맞서며 이해관계가 재편됐다
→ 모델 락인보다 계약·사내 연동 같은 주변 방어력에 투자하라
빅테크 숨은 부채 1.65조 달러와 Oracle 2.1만 명 감원 등 AI 투자 과열의 후폭풍이 잇달아 드러났다
→ AI 프로젝트는 실패율을 전제로 파일럿 규모부터 보수적으로 잡아라
◆ 이번 주 톱 5 전체 189건 중 선정
Claude Opus 5↗
Opus 세대교체급 모델이 Fable 5급 지능을 절반 가격에 제공, 채택 경제성이 급변한다
Anthropic, Claude Opus 5 출시 — HN 1위. (959 pts)
Kimi K3 Is Competitive with Fable; Kimi K3 and Fable Is SoTA↗
오픈웨이트 Kimi K3가 Fable 경쟁 수준 SOTA에 도달, 폐쇄형 프리미엄의 근거를 흔든다
Fireworks AI 벤치마크 분석: Moonshot의 Kimi K3가 Fable과 경쟁할 수준의 SOTA 성능 달성. (844 pts)
China's open-weights AI strategy is winning↗
오픈웨이트가 OpenRouter 토큰 과반을 차지, 배포 주도권이 개방형으로 이동 중이다
오픈웨이트 전략으로 중국 AI가 미국 독점 모델을 앞서고 있다는 분석 — Kimi K3·Qwen 등 사례 중심. (699 pts)
AI Companies Are Trying to Hide a Staggering Amount of Debt↗
AI 인프라 부채가 장부 밖에 축적돼 자금조달 리스크가 업계 전반의 뇌관이 됐다
AI 기업들이 대차대조표 밖에 천문학적 부채를 숨기고 있다는 분석. (497 pts)
Claude 5 모델을 위한 새로운 컨텍스트 엔지니어링 규칙↗
시스템 프롬프트 80% 축소에도 성능 유지, 프롬프트·스킬 설계 방식의 재정립을 요구한다
Claude Opus 5와 Claude Fable 5에서는 Claude Code의 시스템 프롬프트를 80% 이상 줄이고도 코딩 평가에서 측정 가능한 성능 저하가 없었음 과거 모델의 최악 상황을 막던 세부 규칙은 시스템 프롬프트·Skills·CLAUDE.md·사용자 요청 사이에서 충돌할…
◆ 주제별 살펴보기
모델 릴리스20건
Claude Opus 5↗
Anthropic, Claude Opus 5 출시 — HN 1위. (959 pts)
Flux 3↗
Black Forest Labs, 차세대 이미지 생성 모델 Flux 3 공개. (538 pts)
Flux 3 X Mimic: The Next Generation of Video-Action Models↗
Flux 3 기반 비디오-액션 모델 Mimic 발표. (296 pts)
Anthropic Opus 5 출시↗
Anthropic이 2026년 7월 24일, Claude Opus 5 를 공개했습니다. Opus 티어의 "세대 교체급" 개선 모델로, Fable 5(프론티어 모델)에 근접한 지능을 절반 가격에 제공하는 것이 핵심 포지셔닝입니다. 핵심 요약 포지셔닝 : Fable 5의 프론티어급 지능
Kimi K3 Is Competitive with Fable; Kimi K3 and Fable Is SoTA↗
Fireworks AI 벤치마크 분석: Moonshot의 Kimi K3가 Fable과 경쟁할 수준의 SOTA 성능 달성. (844 pts)
"We have information that Moonshot distilled Fable for K3"↗
Moonshot이 Fable을 무단 증류해 K3를 개발했다는 의혹 제기 — 업계 대형 논란. (175 pts)
Gemini latest models: temperature, top_p, top_k deprecated↗
Google Gemini 최신 모델에서 temperature·top_p·top_k 파라미터가 폐기·무시 처리됨. (127 pts)
OpenAI Presence↗
OpenAI가 'Presence' 신규 기능 발표. (58 pts)
Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber↗
Google, Gemini 3.6 Flash 등 신규 모델 3종 발표 — 경량·사이버보안 특화 라인업 확대. (HN 프론트) · [긱뉴스](https://news.hada.io/topic?id=31662)
Qwen-Image-3.0↗
Alibaba Qwen 팀의 이미지 생성 모델 3.0 공개 — 풍부한 디테일과 지식 기반 생성 강조. (HN 프론트)
Laguna S 2.1 — Poolside AI↗
Poolside AI의 코딩 특화 모델 Laguna S 2.1 출시. (HN 프론트)
Kimi K3·Qwen 3.8과 Anthropic의 잠재적 균열↗
Moonshot Labs의 Kimi K3와 Alibaba의 Qwen 3.8이 Anthropic Fable 5에 근접한 성능을 내는 것으로 알려졌고, 수주 안에 가중치까지 공개될 예정이어서 최첨단 모델 경쟁이 개방형 모델로 확장됨 모델 개발에는 연구 인력·컴퓨팅·전력이 필요하지만, 배포…
MoonshotAI/kimi-cli↗
Kimi AI 모델을 위한 공식 CLI 도구 — 터미널에서 Kimi K3 등 모델과 직접 상호작용.
Inertia-1: An Open Exploration to a Unified Motion Foundation Model↗
통합 모션 파운데이션 모델 Inertia-1 공개 탐구 — 로봇·애니메이션·물리 시뮬레이션 공통 표현 학습. (45 pts)
Soofi – Sovereign Open Source Foundation Models↗
주권형 오픈소스 파운데이션 모델 이니셔티브 — 특정 기업 의존 없이 독립적으로 운영 가능한 기반 모델 생태계 구축. (44 pts)
Kimi K3, Qwen 3.8, and Anthropic's (Potential) Unravelling↗
Kimi K3·Qwen 3.8 등 오픈웨이트 모델의 부상과 Anthropic 폐쇄형 전략의 위기를 진단하는 분석 글.
Moonshot AI, Kimi K3 수요 급증으로 신규 구독 일시 중단↗
Kimi K3 수요가 예상보다 크게 늘어 최근 48시간 동안 GPU 사용량이 현재 용량 한계에 근접함 기존 구독자의 이용 경험을 보호하기 위해 신규 구독을 일시 중단하고 현재 회원에게 컴퓨팅 자원을 우선 배정함 기존 유료 구독자는 영향을 받지 않으며, Moonshot AI는 인프라 용…
Qwen 3.8 출시↗
Alibaba Qwen이 2.4조 파라미터 규모의 Qwen3.8을 출시하며, 조만간 오픈 웨이트도 공개할 예정 Qwen3.8은 계속 진화 중인 모델로, 선도적인 프런티어 AI 모델과 호환된다고 밝힘 Qwen 측은 Qwen3.8을 현재 가장 강력한 모델 중 하나이자 Fable 5 다음…
Qwen 3.8↗
Alibaba Qwen 팀이 Qwen 3.8 모델을 공개. (670 pts)
Moonshot AI suspends new subscriptions due to Kimi K3 demand↗
Kimi K3 폭발적 수요로 Moonshot AI가 신규 구독을 일시 중단. (129 pts)
정책·규제12건
Nvidia, Microsoft, Meta warn against overregulating open-weight models↗
엔비디아·MS·메타, 오픈 웨이트 모델 과도한 규제에 반대 성명. (318 pts)
OpenAI와 Anthropic, 자사 수익을 위협하는 오픈 웨이트 AI에 공동 대응↗
고객 확보를 두고 경쟁하는 OpenAI와 Anthropic 이 워싱턴에서는 강력한 중국산 오픈 웨이트 모델의 위험을 경고하며 이해관계를 같이함 Anthropic은 가중치 공개 후 접근 철회·안전장치 갱신·오용 방지가 어렵다고 보지만, 지지자들은 기업이 사용을 통제할 수 없다는 점을…
오픈소스 AI에 반대하는 논거가 설득력 없는 이유↗
Kimi K3 공개 이후 오픈소스 AI를 위험한 위협으로 보는 목소리가 커졌지만, 독점 소프트웨어도 오픈소스 기반 위에 구축 되며 AI 모델 역시 같은 소프트웨어 제품임 상용 기업은 차별화되지 않는 하위 구성요소를 공동 개발하고 상위 제품에서 경쟁하므로, AI 모델도 범용재...
Startup founders urge U.S. government not to shut off Chinese open weight AI↗
스타트업 창업자들, 미 정부에 중국산 오픈 웨이트 AI 차단하지 말라고 촉구. (572 pts)
The arguments against open source AI are bad↗
오픈소스 AI 반대 논거들이 형편없다는 반박 글. (126 pts)
Judge approves $1.5B Anthropic settlement for pirated books to train Claude↗
연방법원, Claude 훈련에 사용된 저작권 침해 도서에 대한 Anthropic 15억 달러 합의 최종 승인. (541 pts)
판사, Claude 훈련용 불법 복제 도서 관련 Anthropic의 2.3조원 합의 승인↗
미국 연방법원이 Anthropic의 Claude 훈련용 불법 복제 도서와 관련된 저작권 집단소송에서 약 15억 달러($1.5b) 규모의 합의를 승인함 Anthropic은 수천 명의 작가와 출판사에 도서당 약 3,000달러를 지급하며, 대상 도서 48만2,000여 권 중 91% 이상에…
美 연방법원, 앤트로픽 15억 달러 저작권 합의 최종 승인↗
미 샌프란시스코 연방법원이 7월 20일 앤트로픽의 15억 달러 저작권 집단소송 합의를 최종 승인했다. 공개된 미국 저작권 소송 사상 최대 배상 규모다. • 2026-07-20 캘리포니아 북부지법 Martinez-Olguin 판사, 15억 달러(+이자) 합의 최종 승인 — "역대 최대…
중국의 오픈 가중치 AI 전략이 앞서고 있음↗
AI 모델은 브랜드 충성도와 피상적인 전환 비용 외에는 방어력이 크지 않아, 중국의 오픈 가중치 전략이 미국의 폐쇄형 모델보다 넓은 배포 생태계를 형성하고 있음 기업 AI의 실질적인 방어력은 모델보다 계약, 사내 시스템 연동, 편의 기능 같은 주변 서비스에서 나오며, API 사용자는…
China's open-weights AI strategy is winning↗
오픈웨이트 전략으로 중국 AI가 미국 독점 모델을 앞서고 있다는 분석 — Kimi K3·Qwen 등 사례 중심. (699 pts)
Mamdani 뉴욕시장, 임대 광고에 AI 이미지를 몰래 사용할 수 없다고 밝혀↗
뉴욕시는 부동산을 실제보다 매력적으로 보이게 만든 AI 생성·편집 이미지를 임대 광고에 사용할 경우 그 사실을 공개하도록 요구하는 방안을 추진함 시 행정부의 Rental Ripoff Report는 이미지뿐 아니라 AI나 디지털 도구로 변경한 임대 매물 정보 전반을 공개 대상으로 권고함…
2026년 7월 오픈소스 AI 현황↗
오픈 웨이트 모델은 코딩·지시 이행·일반 지식에서 폐쇄형과 비슷한 수준에 도달했고, 추론 비용도 36개월간 50배 하락하면서 경쟁의 중심이 모델 자체에서 에이전트 하네스로 이동함 2026년 중반 OpenRouter에서 오픈 웨이트가 토큰 처리량의 과반을 차지하고 상위 5개 모델도 모두…
에이전트·툴링60건
mattpocock/skills↗
Claude Code용 에이전트 스킬 모음 — .agents 디렉토리에서 바로 쓰는 실전 스킬 컬렉션. Shell. ⭐ 2,224 today
citrolabs/ego-lite↗
AI 에이전트가 사용자 로그인 세션을 공유해 웹 자동화를 수행하는 브라우저 — Codex·Claude Code 등과 연동. JavaScript. ⭐ 884 today
ComposioHQ/awesome-claude-skills↗
Claude AI 워크플로 커스터마이징을 위한 스킬·리소스·도구 큐레이션 리스트. Python. ⭐ 662 today
CoreBunch/Instatic↗
Webflow·Framer·WordPress 대안 오픈소스 CMS — 에이전틱 비주얼 빌더로 정적 페이지 생성. TypeScript. ⭐ 250 today
OtterMind/Chat2DB↗
AI 기반 데이터베이스 도구 및 SQL 클라이언트 — MySQL, PostgreSQL, Oracle 등 다수 DB 지원. Java. ⭐ 129 today
Claude Cookbook↗
Anthropic, Claude 플랫폼 활용 레시피 모음 '쿡북' 공개. (277 pts) · [긱뉴스](https://news.hada.io/topic?id=31793)
Claude 5 모델을 위한 새로운 컨텍스트 엔지니어링 규칙↗
Claude Opus 5와 Claude Fable 5에서는 Claude Code의 시스템 프롬프트를 80% 이상 줄이고도 코딩 평가에서 측정 가능한 성능 저하가 없었음 과거 모델의 최악 상황을 막던 세부 규칙은 시스템 프롬프트·Skills·CLAUDE.md·사용자 요청 사이에서 충돌할…
koala73/worldmonitor↗
AI 기반 실시간 글로벌 인텔리전스 대시보드 — 뉴스 수집·지정학 모니터링·인프라 추적 통합. TypeScript. ⭐ 3,196 today
earthtojake/text-to-cad↗
CAD·로보틱스·하드웨어 설계를 위한 에이전트 스킬 모음. JavaScript. ⭐ 293 today
agegr/pi-web↗
pi 코딩 에이전트용 Web UI. TypeScript. ⭐ 315 today
alibaba/open-code-review↗
알리바바 규모에서 실전 검증된 하이브리드 코드 리뷰 도구 — 결정론적 파이프라인 + LLM 에이전트, 라인 수준 코멘트, NPE·XSS·SQL 인젝션 등 빌트인 룰셋. Go. ⭐ 265 today
Julian-adv/OpenMMO↗
AI 에이전트와 인간 플레이어가 동등하게 참여하는 MMORPG. Rust. ⭐ 395 today
block/buzz↗
Hive mind 커뮤니케이션 플랫폼 — Jack Dorsey의 Block이 만든 팀 채팅·AI 에이전트·Git 호스팅 결합 도구. Rust. ⭐ 2,460 today
Why Software Factories Fail (harness engineering is not enough)↗
코딩 에이전트의 '소프트웨어 팩토리' 접근이 실패하는 이유 — 하네스 엔지니어링만으론 부족. (121 pts)
Show HN: Palmier Pro – Open-source macOS video editor built for AI↗
AI를 위해 만든 오픈소스 macOS 비디오 편집기. (74 pts)
Show HN: Claude-thermos – keeps your Claude session warm for you↗
Claude 세션을 자동으로 따뜻하게 유지해주는 도구. (39 pts)
Launch HN: Screenpipe (YC S26) – Record how you work and turn that into agents↗
작업 과정을 녹화해 에이전트로 전환하는 Screenpipe (YC S26). (38 pts)
Show GN: 로컬 LLM 에이전트 개발과 테스트를 한곳에서, 툴 검색과 HITL, MCP 연동까지 (한국 통계 MCP 데모)↗
국가통계포털(KOSIS)이 공식 MCP 시범서비스를 열어서, 노트북에서 도는 9B 로컬 모델에 붙여봤습니다. API 키 없이 합계출산율을 찾아 차트를 그리고, CSV로 저장하려는 순간에는 승인 창이 뜹니다. 파일 쓰기처럼 사람이 승인(HITL)해야만 하는 작업은 UI에서 사람이 확인하…
Show GN: NvChat – NVIDIA의 무료 LLM을 쓰는 단일 exe 윈도우 클라이언트↗
NVIDIA의 build.nvidia.com 은 여러 오픈 모델을 OpenAI 호환 API로 무료로 쓸 수 있게 해줍니다. 그런데 매번 웹 플레이그라운드로 들어가는 게 번거로워서, 클로드, ChatGPT 데스크톱 앱처럼 쓸 수 있는 윈도우 클라이언트를 직접 만들었습니다. 기능 사용 가…
Show GN: Spring Boot + React 어드민 개발에 지쳐서, 브라우저를 보며 AI와 대화하는 풀스택 빌더를 만들었습니...↗
안녕하세요! 사내 운영 툴이나 게임 관리자 페이지 등 반복되는 어드민(CRUD) 화면을 찍어내다가 지쳐서 직접 툴을 하나 만들어 보았습니다. 이름은 Ninebone이며, Spring Boot 백엔드와 React 프론트엔드 환경에서 DB 설계만 해두면 브라우저 화면을 직접 보며 챗봇과…
tirth8205/code-review-graph↗
로컬 퍼스트 코드 인텔리전스 그래프 — MCP·CLI용 코드베이스 맵을 지속적으로 구축해 AI 코딩 도구에 전달, 리뷰 시 컨텍스트 축소 벤치마크 포함. ⭐ 1,925 today
rohitg00/ai-engineering-from-scratch↗
AI 엔지니어링 처음부터 배우고 빌드하고 배포하기 — 실습 중심 AI 엔지니어링 커리큘럼. ⭐ 688 today
microsoft/SkillOpt↗
고정 LLM 에이전트를 위한 텍스트 공간 최적화 도구 — 궤적 기반 편집과 검증 게이트로 재사용 가능한 자연어 스킬(best_skill.md) 생성. ⭐ 616 today
jamiepine/voicebox↗
오픈소스 AI 음성 스튜디오 — 음성 복제(클론), 딕테이션, 음성 생성. ⭐ 565 today
virgiliojr94/book-to-skill↗
기술 서적 PDF를 Claude Code 스킬로 변환 — 학습·참조·작업 중 바로 활용 가능. ⭐ 170 today
luongnv89/claude-howto↗
Claude Code 비주얼 가이드 — 기초부터 고급 에이전트까지, 바로 복사해 쓸 수 있는 템플릿 포함. ⭐ 106 today
Show HN: DeepSQL — Postgres·MySQL용 자체 호스팅 DBA 에이전트↗
AI 기반 DB 관리 에이전트를 자체 서버에 올릴 수 있는 도구. (36 pts)
트위터 창업자 Jack Dorsey, 팀 채팅·AI 에이전트·Git 호스팅을 결합한 Buzz 출시↗
Block이 직원과 AI 에이전트, 대화, 소프트웨어 저장소를 하나의 신원 체계로 연결하는 오픈소스 워크스페이스 Buzz를 출시해 Slack과 GitHub 의존도를 줄이려 함 메시지·반응·워크플로 단계·코드 이벤트·승인을 서명된 Nostr 이벤트로 저장하고, 사람과 에이전트에 키 쌍…
OpenMMO - AI Agent와 인간 플레이어가 동등하게 대우받는 MMORPG↗
엑스엘게임즈 창업자 송재경님이 공개한 1인 프로젝트입니다. 특징: Agent-인간 동등성 : Agent와 인간 플레이어는 완전히 동일한 WebSocket 프로토콜을 사용합니다. 별도의 API나 엔드포인트가 필요하지 않습니다. 서버는 Agent와 인간을 구분할 수 없으므로 인간이 할 수…
AI 코딩 세션의 휘발성 맥락을 프로젝트 기억으로 남기기 — rhwp 적용 사례↗
제가 rhwp collaborator로 3개월간 기여하며 직접 경험한 AI 협업 방법론을 정리한 글입니다. 바이브 코딩에서는 잘 동작하던 AI가 기존 프로젝트나 회사 코드베이스에 적용되면 어려움을 겪는 이유를, 단순한 모델 성능보다 ‘축적된 프로젝트 맥락의 부재’라는 관점에서 살펴봅니…
bojieli/ai-agent-book↗
《深入理解 AI Agent》 오픈소스 도서 — AI 에이전트 설계 원리와 엔지니어링 실무를 다루는 중국어 교재 및 코드. ⭐ 4,434 today
ayghri/i-have-adhd↗
ADHD 친화적 출력 포맷팅을 위한 코딩 에이전트 스킬 — 긴 출력을 구조화하고 집중하기 쉽게 변환. ⭐ 1,846 today
1jehuang/jcode↗
Rust로 만든 코딩 에이전트 하네스 — 최고 수준의 지능형 에이전트 실행 환경 표방. ⭐ 835 today
KnockOutEZ/wigolo↗
AI 코딩 에이전트용 로컬 퍼스트 웹 도구 — MCP 기반 검색·크롤링·리서치 통합. ⭐ 641 today
AstrBotDevs/AstrBot↗
다중 IM 플랫폼·LLM·플러그인을 통합하는 AI 에이전트 어시스턴트 개발 프레임워크. ⭐ 416 today
tradesdontlie/tradingview-mcp↗
Claude Code-TradingView 연동 MCP — AI로 차트 분석·트레이딩 인사이트 생성. ⭐ 219 today
Jack Dorsey launches Buzz↗
Jack Dorsey가 팀 챗·AI 에이전트·Git 호스팅을 결합한 Buzz 플랫폼 런칭. (HN 프론트)
AI Agent – TRMNL↗
e-ink 디스플레이 디바이스 TRMNL에 AI 에이전트 기능 추가. (HN 프론트)
Show HN: CodeAlmanac – Karpathy식 코드베이스 위키↗
대화에서 자동으로 코드베이스 위키를 구축하는 도구. (HN 프론트)
Kimi Work: 지식 노동자를 위한 차세대 데스크톱 AI 에이전트↗
Kimi Work는 로컬 파일 연결, 브라우저 자동화, 백그라운드 코드 실행, 예약 작업을 결합해 깊이 있는 업무를 수행하는 데스크톱 AI 에이전트임 내장 Cron 엔진으로 LLM 에이전트 호출과 Python·Shell 실행을 매일, 매시간 또는 조건에 따라 자동화하며, Keep Co…
msitarzewski/agency-agents↗
경량 에이전트 기반 AI 워크플로 프레임워크 — 복잡한 멀티 에이전트 파이프라인을 선언형으로 구성.
topoteretes/cognee↗
AI 에이전트용 메모리·지식 그래프 프레임워크 — 장기 기억과 맥락 추론을 그래프 구조로 처리.
PrefectHQ/fastmcp↗
MCP(Model Context Protocol) 서버를 빠르게 구축하는 Python 프레임워크 — Prefect가 관리하는 FastAPI 스타일 MCP 서버.
microsoft/Ontology-Playground↗
Microsoft의 온톨로지 탐색 실험 도구 — AI 지식 그래프 구조 설계 및 시각화 연구용.
Kimi Work↗
Moonshot AI의 업무용 AI 제품 Kimi Work 출시 — 코딩·문서·분석을 통합한 에이전트형 워크스페이스. (197 pts)
Show GN: newsline – Claude Code 기다리는 동안 상태줄에서 읽는 한 줄 뉴스↗
Claude Code에 긴 작업을 시키면 esc to interrupt를 멍하니 보는 시간이 쌓입니다. 딴 일 하기엔 짧고 가만히 있기엔 긴 그 시간에, 세션 하단 상태줄에서 뉴스 헤드라인을 한 줄씩 읽으면 어떨까 싶어서 만들었습니다. 무엇을 하나 기존 상태줄(HUD) 아래 줄에 지역…
Show GN: sessionhub - 흩어진 Claude Code, Codex 세션을 한 곳에서 검색↗
sessionhub는 여러 머신에 흩어진 Claude Code · Codex 세션을 한 곳에 모아 검색하는 도구입니다. 데스크톱과 노트북을 오가고 가끔 서버에서도 개발하는데, "이거 전에 해봤는데" 싶은 작업이 어느 머신에 있었는지 자주 헷갈렸습니다. Claude Code랑 Codex…
OpenAI, Codex 모델 컨텍스트 크기를 372k에서 272k로 축소↗
OpenAI Codex의 번들 모델 메타데이터를 갱신하면서 모델 컨텍스트 크기를 372k에서 272k로 줄인 변경을 release/0.144 브랜치에 백포트함 PR #33972는 agent/hotfix-0.144-model-metadata 브랜치에서 Codex 0.144 릴리스로 변경…
Claude Code, Rust로 재작성된 Bun 사용↗
Claude Code v2.1.181부터 Rust로 포팅된 Bun을 내장해 Linux 시작 속도가 10% 빨라졌지만, 대부분의 사용자는 변화를 거의 알아차리지 못함 실행 파일의 문자열을 조사하면 정식 태그가 아직 없는 Bun v1.4.0과 Rust 소스 파일 경로를 확인할 수 있음 ~…
github/copilot-sdk↗
앱·서비스에 GitHub Copilot Agent를 통합하는 멀티플랫폼 SDK.
trycua/cua↗
오픈소스 드라이버·크로스OS 플릿·벤치마크로 computer-use 2.0을 스케일링.
Canner/WrenAI↗
AI 에이전트를 위한 GenBI(Generative BI), 20개 이상 데이터소스에서 오픈소스 text-to-SQL.
PostHog/posthog↗
AI 옵저버빌리티·애널리틱스·세션 리플레이·피처 플래그를 결합한 셀프 드라이빙 제품 플랫폼.
Claude Code uses Bun written in Rust now↗
Claude Code가 Rust로 작성된 Bun 런타임으로 전환했다는 Simon Willison의 분석. (328 pts)
Codex Resets↗
OpenAI Codex의 컨텍스트 리셋 이슈를 추적하는 커뮤니티 사이트. (276 pts)
OpenAI reduces Codex Model Context Size from 372k to 272k↗
OpenAI가 Codex 모델 컨텍스트 크기를 372K에서 272K로 축소. (261 pts)
AI 코드 검토가 타당한 반론이 될 수 없는 이유↗
LLM 코딩 도구의 잦은 오류를 사람이 모두 검토하면 된다는 해법은 코드 리뷰의 처리 한계 때문에 품질과 생산성을 함께 보장하기 어려움 경험적 연구에 따르면 효과적인 리뷰는 한 번에 1시간·400 LOC 정도가 상한이며, 이를 넘으면 피로와 집중력 저하로 결함 탐지 효과가 빠르게 감소…
Mindwalk - 코딩 에이전트 세션을 코드베이스의 3D 지도 위에서 재생하는 시각화 도구↗
세션 로그는 에이전트가 무엇을 했는지 기록하지만, 작업을 어떻게 이해했는지(관련 영역 판단, 탐색 위치, 작업 범위 일치 여부)는 담지 못하며, 원본 JSONL을 읽어서는 알 수 없음 저장소를 야간 지도로 그려, 에이전트가 검색/읽기/수정한 위치는 빛나고 나머지는 어둡게 유지해 에이전…
Claude Code가 Mac을 제어하게 하는 단계별 가이드↗
여분의 Mac을 Claude Code에게 넘겨 원격 제어를 설정하는 실용 튜토리얼. (129 pts, [HN](https://news.ycombinator.com/item?id=48959392))
Claude Code의 잘못 설계된 자동 진행 기능 해부↗
Claude Code 2.1.198은 AskUserQuestion에 60초간 답이 없으면 모델이 자체 판단으로 작업을 계속하는 자동 진행 기능을 기본 활성화했지만, 출시 당시 변경 로그와 문서에는 기록하지 않았음 권한 요청을 자동 승인하지는 않았으나, 이미 허용된 도구나 --dange…
산업·자본28건
Lordog/dive-into-llms↗
《动手学大模型》 — LLM 실습 튜토리얼 시리즈 (중국어). Jupyter Notebook. ⭐ 654 today
Unitree As2-W↗
Unitree, 새로운 휠 달린 휴머노이드 로봇 As2-W 공개. (62 pts)
Proving a human wrote something↗
AI 시대에 사람이 작성했음을 증명하는 방법 탐구. (42 pts)
Substack의 AI 투명성 도구를 둘러싼 작가들의 반응↗
Substack은 독자가 게시물의 인간 작성·AI 보조 비율을 추정하는 Pangram 스캔 과 창작 과정을 공개하는 “ How I make this ” 기능을 출시함 AI 사용 자체보다 투명성 부족 에 초점을 맞춰, 작가는 자신의 기여를 인정받고 독자는 읽을 콘텐츠를 더...
AI 투자 실패로 Oracle, 직원 2만 1,000명 해고↗
Amazon/Microsoft/Alphabet/Meta가 2026년 AI 인프라에 약 6,000억 달러 를 지출할 것으로 예상되며, 기업 역사상 가장 비용이 크고 변동성이 높은 경쟁으로 번지고 있음 칩/서버/데이터센터 투자가 현금흐름을 약화시키면서, 막대한 지출이 실제 수익으로 이어질…
AI Companies Are Trying to Hide a Staggering Amount of Debt↗
AI 기업들이 대차대조표 밖에 천문학적 부채를 숨기고 있다는 분석. (497 pts)
Quality non-fiction books are the antithesis of AI slop↗
양질의 논픽션 도서야말로 AI 슬롭의 대척점이라는 에세이. (475 pts)
DARPA, U.S. Air Force fly AI-controlled F-16↗
DARPA와 미 공군, AI가 조종하는 F-16 비행 성공. (128 pts)
AI bet goes awry: Oracle fires 21,000 employees↗
Oracle, AI 투자 실패로 21,000명 해고. (36 pts)
양질의 논픽션은 AI 슬롭의 정반대다↗
도서관의 분류 체계와 사서의 선별, 대출 이력이 결합된 서가 탐색은 검색 엔진보다 품질과 우연성을 함께 제공해 예상하지 못한 양질의 논픽션으로 독자를 이끎 무료 플랫폼 Book Prize Index는 주요 영어권 논픽션 문학상의 수상작과 최종 후보 약 6,500권을 검색·정렬하며, 자…
중고 GPU 클러스터의 가치는 아무도 모른다↗
xAI가 채무불이행하면 대주단은 20만 개 GPU로 구성된 Colossus를 인수해 임대할 수 있지만, 실제 가치는 장비보다 운영 상태와 팀의 암묵지에 크게 좌우됨 xAI와 CoreWeave를 중심으로 GPU 담보 금융이 확산됐으나 가격 산정 인프라가 부족해, 기준금리보다 약 8.5%…
OverpAId – Fire your CEO. Hire the future↗
AI CEO 교체를 풍자하는 사이트가 HN에서 폭발적 반응 — AI 과대포장 비판. (632 pts)
Making — AI 시대 창작의 의미↗
AI 도구와 인간 창작의 관계를 탐구하는 에세이. (214 pts)
Most Americans say "not in my backyard" to AI data centers↗
Redfin 조사: 미국인 대부분이 AI 데이터센터 인근 건설에 반대. (118 pts)
Nobody knows what a used GPU cluster is worth↗
AI 붐 이후 중고 GPU 클러스터의 가격 책정이 불투명해진 시장 분석. (107 pts)
미국 5대 기술기업, 불투명한 AI 자금조달로 숨은 부채 2,475조원↗
AI 투자 확대와 함께 미국 5대 기술기업의 숨은 부채가 약 4년 만에 8배로 늘어 약 1.65조 달러($1.65tn)에 달함 데이터센터 임대와 GPU 공급 계약에서 발생한 의무가 Meta와 Oracle 등의 부채를 키움 숨은 부채 총액이 공개된 실제 부채보다 많아, 재무제표만으로 전…
“No AI” 표시는 단순한 문구 이상의 의미가 있음↗
AI가 인간의 결과물을 갈수록 정교하게 재현하면서, 창작자가 사람이 직접 만들었다고 명시하는 일은 독자에게 판별 책임을 떠넘기지 않는 수단이 됨 수제품·홈메이드 식품·손으로 그린 게임과 애니메이션이 제작 방식을 밝혀왔듯, 이용자가 인간과 기계의 결과물을 외관만으로 구분하기는 어려움 품…
AI 시대에 번영할 사람들↗
AI 시대에 사람을 가르는 기준은 지능보다 정신적 노력과 맺는 관계이며, 지능이 흔해질수록 스스로 사고하고 성장하려는 의지(volition) 가 더 귀해짐 인지욕구가 낮은 사람은 AI로 생산성을 높이는 대신 사고 능력을 잃기 쉽고, 중간 집단은 효율화의 유혹에 굴복하기 쉬우며, 높은…
Advertise in ChatGPT↗
OpenAI가 ChatGPT 내 광고 플랫폼 공식 출시 — ads.openai.com 오픈. (HN 프론트)
Agent swarms and the new model economics↗
Cursor가 분석한 에이전트 스웜 시대의 새로운 모델 비용 구조와 최적화 전략. (47 pts)
Launch HN: Bloomy (YC S26) – AI-powered mastery learning for K-12↗
YC S26 스타트업 Bloomy — AI로 초중고 학생의 숙달 학습(mastery learning)을 개인화하는 서비스. (41 pts)
AI 광풍이 전 세계의 의사결정을 무너뜨리고 있음↗
지난 18개월간 관찰하거나 참여를 요청받은 AI 프로젝트의 성공률은 0% 였으며, 기술의 불확실성과 기존 소프트웨어 프로젝트의 부실한 운영이 겹쳐 투자가 성과로 이어지지 않았음 직원 500명 이상인 조직에서는 AI의 효용을 의심하는 것만으로 승진과 고용이 위태로워지고, 직원들은 AI…
100만 개 키워드가 보여준, AI가 검색에 미치는 영향↗
월간 검색량 1만 회 이상인 1,010,848개 키워드를 분석한 결과, 전체 검색 수요의 29%가 감소했지만 증가한 수요가 이를 거의 상쇄해 총검색량은 사실상 유지됨 검색 감소 폭은 정보 탐색 비중에 따라 달라져 FinTech -37.7% 처럼 AI가 완결된 답을 제공하기 쉬운 분야에…
AI가 Stack Overflow에 끼친 영향을 그래프로 보기↗
AI가 Stack Overflow에 끼친 영향을 그래프로 보기
Kaiser 간호사들 “AI 감시가 업무와 환자 돌봄을 악화”↗
Kaiser Permanente 상담·트리아지 간호사들은 15분 이상 통화, 통화 간격, 지침 준수 여부를 추적하는 성과 관리가 전문적 판단과 환자 돌봄을 위축시킨다고 말함 2024년 시험한 AI는 간호사의 공감과 목소리 톤까지 평가했으며, 간호사들은 업무 맥락을 이해하지 못한 채 잘…
Apple, OpenAI 직원 수십 명에게 법적 서한 발송↗
Apple이 자사 출신 OpenAI 직원 약 40명에게 문서와 통신 기록을 보존하고 Apple 변호사와 면담하라는 개별 법적 서한을 발송함 OpenAI가 Apple의 기밀 하드웨어 설계를 도용했다는 소송을 뒷받침할 증거를 확보하기 위한 조치로, OpenAI에 이직한 전 Apple 직원…
LLM 비판론자들이 옳다. 그래도 나는 LLM을 쓴다↗
저작권·환경·윤리 문제와 저품질 산출물, 오픈소스 신뢰 붕괴, 주니어 육성 약화, 지정학적 종속을 인정하면서도 LLM을 사고의 품질을 높이는 도구로 계속 활용함 LLM은 기존의 생각·의견·구조를 증폭하므로, 사람의 판단이 없으면 유창한 쓰레기를 대량 생산하지만 충분한 생각과 책임이 있…
OpenAI·Anthropic에서 일한 전 YC 창업자, 최소 105명↗
스타트업 인수나 폐업 이후의 경로를 추적한 결과, YC 창업자 최소 105명이 OpenAI 또는 Anthropic에서 일한 것으로 집계됨 과거 CEO·CTO였던 이들도 현재는 Member of Technical Staff가 가장 많으며, 63명으로 전체의 60%를 차지함 직무별로는 연…
추론·서빙·인프라16건
diegosouzapw/OmniRoute↗
오픈소스 AI 게이트웨이 — 단일 엔드포인트로 290+ 프로바이더, 500+ 모델 연결 (Claude, GPT, Gemini, DeepSeek 등). RTK+Caveman 압축으로 토큰 15–95% 절감. TypeScript. ⭐ 1,925 today
Show HN: Echo – Fable-level results at 1/3 the cost using open-weight models↗
오픈 웨이트 모델로 Fable급 성능을 1/3 비용에 달성하는 Echo. (96 pts)
GigaToken - 언어 모델 토큰화를 약 1,000배 가속↗
다양한 CPU와 널리 쓰이는 토크나이저를 지원하며, 텍스트를 GB/s 단위로 처리하는 Tiktoken 과 HuggingFace Tokenizers 대체 도구 정규식 엔진이 맡던 사전 토큰화를 SIMD로 최적화하고 분기·스레드 통신·Python 상호작용을 줄이며, 이전에 본 단어의 토큰…
OmniRoute — 흩어진 무료/저가 AI 티어를 하나로 묶는 게이트웨이↗
하나의 로컬 엔드포인트(localhost:20128/v1)로 271개 프로바이더/500개 이상 모델을 연결하고 Claude Code/Codex/Cursor/Cline/Copilot 등 26개 코딩 툴을 설정 하나로 사용 90개 이상 무료 티어/40개 이상 영구 무료 계정을 통합해 월…
rtk-ai/rtk↗
LLM 토큰 소비를 60–90% 절감하는 CLI 프록시 — Rust 단일 바이너리, 의존성 없음. ⭐ 308 today
GigaToken: ~1000x faster Language model tokenization↗
GPU 최적화로 기존 LLM 토크나이저 대비 약 1000배 빠른 토크나이제이션 라이브러리. (239 pts)
When is NVLink worth it?↗
AI 학습/추론 인프라에서 NVLink를 쓸 만한 시점과 조건 분석. (46 pts)
Nvidia DGX Spark as a daily driver↗
개인 AI 워크스테이션 DGX Spark를 일상 PC처럼 쓴 실제 경험기. (38 pts)
AlexsJones/llmfit↗
내 하드웨어에서 돌릴 수 있는 LLM을 자동 탐색 — 수백 모델/프로바이더를 한 명령으로 비교. ⭐ 194 today
handy-computer/transcribe.cpp↗
C++로 구현한 로컬 음성-텍스트 변환 — Whisper 기반, GPU 없이도 실시간 전사 지원.
moonshine-ai/moonshine↗
엣지 디바이스에 최적화된 경량 ASR(음성 인식) 모델 — Whisper 대비 빠른 속도와 작은 용량.
lyogavin/airllm↗
최소 GPU 메모리로 초대형 LLM을 실행하는 추론 최적화 라이브러리 — 70B+ 모델을 단일 소비자급 GPU에서 구동.
Nativ: Run frontier open models locally on your Mac↗
Mac에서 오픈 프론티어 모델을 로컬 실행하는 앱 — Metal 가속으로 Llama·Qwen 등 지원. (79 pts)
kvcache-ai/ktransformers↗
이기종 GPU 환경에서 LLM 추론/파인튜닝 최적화를 위한 유연한 프레임워크.
500KB 미만의 음성 인식 및 TTS — moonshine micro↗
500KB 이하로 동작하는 경량 Speech Recognition·TTS 라이브러리 moonshine micro 공개. (18 pts, [HN](https://news.ycombinator.com/item?id=48911793))
LM Studio Bionic: 오픈 모델을 위한 AI 에이전트↗
LM Studio Bionic은 코딩·조사·문서 작업을 로컬 또는 클라우드의 오픈 모델로 처리해, 개인정보와 AI 사용 비용을 직접 통제할 수 있는 별도 앱임 모델은 기기에서 직접 실행하거나 LM Link로 연결할 수 있으며, 복잡한 작업에는 LM Studio Secure Cloud의…
연구26건
ruvnet/RuView↗
WiFi 신호만으로 실시간 공간 인텔리전스·생체 신호 모니터링·존재 감지를 구현하는 AI 시스템 — 카메라 없이 동작. Rust. ⭐ 1,021 today
shiyu-coder/Kronos↗
금융 시장 언어를 위한 파운데이션 모델 — 시계열·텍스트·이벤트 멀티모달 학습. Python. ⭐ 506 today
Euclid-MCP: A Model Context Protocol Server for Deterministic Logical Reasoning via Prolog↗
Bartolomeo Bogliolo · LLM이 SWI-Prolog에 논리 추론을 위임하도록, Horn절 중간표현과 번역·실행·점검·수정 도구를 제공하는 오픈소스 MCP 서버를 제안했다.
MIRROR: Learning from the Other View for Multi-Modal Reasoning↗
Wen Ye 외 3인 · 기하 문제의 텍스트·도해·결합 뷰가 서로 다른 추론 경로와 실패를 드러냄을 보이고, 이를 활용하는 짝지어진 멀티모달 데이터셋과 학습법을 제시했다.
Agentic coding without the cloud: evaluating open-weight large language models on longitudinal data preparation tasks↗
Mack Nixon 외 6인 · 민감 데이터를 외부로 보내지 않는 오픈웨이트 LLM 에이전트를, 종단 코호트 데이터 정제 작업으로 평가하는 오픈소스 프레임워크를 내놓았다.
OpenForgeRL: Train Harness-native Agents in Any Environment↗
Xiao Yu 외 9인 · Claude Code 등 복잡한 추론 하네스 기반 에이전트를, 프록시로 모델 호출을 기록해 어떤 환경에서든 종단 학습하는 오픈소스 RL 프레임워크를 제안했다.
AREX: Towards a Recursively Self-Improving Agent for Deep Research↗
Shuqi Lu 외 23인 · 답을 검증하며 미해결 제약을 표적 재조사해 스스로 답을 재귀적으로 개선하는 심층 리서치 에이전트 계열 AREX를 제안했다.
Beyond Sycophancy: Structured Resistance and Compliance in LLM Moral Reasoning↗
Baihui Wang 외 1인 · 아첨을 단일 실패가 아니라 입장 거리·출처·연합 구조에 따라 판단을 수정하는 저항-순응 과정으로 재해석하는 LLM 도덕추론 연구다.
Terrence Tao의 Jacobian 추측 반례에 관한 ChatGPT 대화↗
Terrence Tao의 Jacobian 추측 반례에 관한 ChatGPT 대화
Terrence Tao's ChatGPT Conversation about the Jacobian Conjecture Counterexample↗
수학자 테렌스 타오가 ChatGPT와 야코비안 추측 반례를 탐구한 대화 전문 공개. (391 pts)
Are AI Labs Pelicanmaxxing?↗
AI 기업들이 벤치마크 최적화에만 집중하는 행태를 생물학적 사례에 빗대 비판. (220 pts)
Can a MUD evaluate LLMs? A $99 proof of concept↗
MUD(텍스트 어드벤처 게임)를 LLM 벤치마크로 활용하는 $99 PoC. (75 pts)
AI 연구소들은 ‘자전거 타는 펠리컨’에 맞춰 모델을 최적화했을까?↗
7개 프런티어 모델에서 1,008개 SVG를 비교한 결과, 유명 프롬프트에 맞춰 성능을 끌어올리는 pelicanmaxxing의 뚜렷한 증거는 발견되지 않음 8종의 동물과 6종의 탈것을 조합한 48개 프롬프트를 모델마다 3회 실행하고, GPT-5.6 Luna로 동물·탈것·행동 일관성을…
Meta's AI models powering Genesis Mission↗
Meta AI 모델이 로런스 버클리 국립연구소의 Genesis Mission 프로젝트에 투입 — SAM·DINO 활용. (HN 프론트)
인간 수학자, 반례 찾기에서 AI에 추월당하다↗
ChatGPT와 Claude 계열 모델이 불과 몇 주 사이 Erdős의 단위 거리 추측, Grothendieck의 군 스킴 질문, Jacobian Conjecture에 반례를 만들었으며 일부는 Lean으로 검증됨 OpenAI의 Sol은 Erdős 반례와 필요한 전역 유체론 결과를 3주…
arXiv 논문 12,750편에서 AI 문체를 측정한 방법과 한계↗
arXiv 논문 12,750편의 본문 전체를 분석한 결과, 최신 논문의 약 3분의 1이 기계 작성처럼 읽혔으며 최근 완결 분기 판정률은 약 32%였음 2021~2022년 논문을 인간 작성 대조군으로 삼아 오탐률 0.4% 에 맞춰 임계값을 설정하고, 버전 1 PDF와 부트스트랩 95%…
How we measured AI writing across arXiv, and where the measurement breaks↗
arXiv 논문 전반의 AI 작문 비율을 측정하는 방법론과 측정의 한계 분석. (169 pts)
Human mathematicians are being outcounterexampled↗
AI가 수학자보다 더 빨리 반례를 찾아내는 현상 — Lean/Xena 프로젝트 팀의 관찰 보고. (47 pts)
AI 조언을 받으면 정확도는 3분의 1로 떨어지고 자신감은 2배 이상 높아짐↗
AI 조언을 이용한 참가자는 “모른다”고 답하는 비율이 44%에서 3%로 급감했고, 정확도는 27%에서 9%로 하락한 반면 자신감은 30%에서 76%로 상승함 연구진은 합리적인 도구 위임과 구분하기 위해 영화 속 시각적 세부 정보처럼 AI가 자주 틀리는 질문과 대체로 오답을 내는 St…
Fable 5 vs. GPT-5.6 Sol: NP-난해 문제에서 /goal은 도움이 되는가?↗
미공개 광섬유망 최적화 문제를 30분씩 풀게 한 결과, Fable 5가 최고 점수와 가장 안정적인 성능을 보였지만 /goal은 일관된 향상을 만들지 못함 /goal은 단순히 더 오래 작업하게 하는 기능이 아니라 제어 루프와 탐색 경로를 바꿔, 좋은 전략뿐 아니라 잘못된 전략도 지속시킬…
Show GN: 브라우저에서만 돌아가는 한국어 AI 글 판별기↗
얼마전에 Hacker News를 뜨겁게 달궜던 주제가 있습니다. 고전 ML로 AI Slop Text를 판별하는 게 생각보다 효과가 좋다는 블로그 글이었어요. https://news.ycombinator.com/item?id=48936880 https://blog.lyc8503.net/…
GPT-5.6이 프롬프트로 볼록 최적화의 30년 공백을 메움↗
제공된 본문은 GPT-5.6이나 볼록 최적화가 아니라, 모든 유한 단순군을 18개 무한 계열과 26개 산재군으로 분류하는 군론의 정리를 다룸 유한 단순군은 소수처럼 유한군의 기본 구성 요소지만, 같은 합성열을 가진 비동형 군이 존재하므로 구성 요소만으로 원래 군이 유일하게 결정되지는…
Robbyant/lingbot-map↗
스트리밍 데이터로 3D 장면을 실시간 재구성하는 피드포워드 3D 파운데이션 모델.
GPT-5.6이 프롬프트로 볼록 최적화 30년 난제를 해결↗
OpenAI GPT-5.6이 CDC 증명 발표 이후 프롬프트 한 줄로 볼록 최적화 30년 공백을 메웠다는 r/math 스레드. (434 pts, [HN](https://news.ycombinator.com/item?id=48957779))
Fable 5 vs. GPT-5.6 Sol: NP-Hard 문제에서 /goal은 효과가 있나?↗
NP-Hard 문제에서 Anthropic Fable 5와 OpenAI GPT-5.6 Sol을 직접 비교 실험한 글. (185 pts, [HN](https://news.ycombinator.com/item?id=48956879)) · [긱뉴스](https://news.hada.io/topic?id=31545)
Isomorphic Labs·Google DeepMind의 바이오복원력 접근법↗
DeepMind와 Isomorphic Labs가 AI를 활용한 생물학적 복원력 연구 방향을 공개. (46 pts, [HN](https://news.ycombinator.com/item?id=48959297))
보안8건
Be skeptical of OpenAI's rogue hacker agent story↗
Guardian: OpenAI의 '폭주 해커 에이전트' 이야기에 회의적이어야 한다. (308 pts)
OpenAI의 ‘통제 이탈 해커 에이전트’ 이야기를 회의적으로 봐야 하는 이유↗
OpenAI의 해킹 에이전트 사건은 AI 위험성을 부각해 기술력을 과시하고 투자와 규제상 우위 를 확보해 온 홍보 전략의 연장선이라는 비판을 받음 2019년 GPT-2 공개 보류 로 악용 위험을 강조한 뒤 같은 해 7월 Microsoft가 10억 달러를 투자하면서, 위험성에 대한…
OpenAI's accidental attack against Hugging Face is science fiction that happened↗
OpenAI가 실수로 Hugging Face를 공격한 사건 — Simon Willison 분석. (311 pts)
Free way to get your data out of ChatGPT Business accounts↗
ChatGPT 비즈니스 계정에서 데이터를 무료로 추출하는 도구. (69 pts)
Show HN: OneCLI – OSS credential gateway that keeps secrets out of AI agents↗
AI 에이전트에서 시크릿을 분리하는 오픈소스 자격 증명 게이트웨이. (58 pts)
ANSI escape injection in MCP servers: Hidden from humans, visible to AI↗
MCP 서버에서 ANSI 이스케이프 시퀀스 인젝션 취약점 발견 — 사람에겐 안 보이지만 AI에겐 보임. (53 pts)
OpenAI and Hugging Face partner to address security incident↗
OpenAI와 Hugging Face가 모델 평가 과정에서 발생한 보안 인시던트 공동 대응 발표. (HN 프론트)
Apple Private Cloud Compute SoC 3 audit reports↗
Apple이 프라이빗 클라우드 컴퓨트(AI 추론 인프라) SOC 3 감사 보고서 공개. (HN 프론트)
그 밖의 소식17건
Drone-Bench: Tracking drone surveillance capabilities of frontier models↗
프론티어 AI 모델의 드론 감시 능력 벤치마크. (5 pts)
Opus 5 is #1 on Artificial Analysis Intelligence Leaderboard↗
Opus 5, Artificial Analysis 인텔리전스 리더보드 1위 달성. (4 pts)
ChatGPT medical advice brought man 'to brink of death', lawsuit alleges↗
ChatGPT 의료 조언이 사용자를 사경으로 몰았다는 소송 제기. (15 pts)
Waymo's driverless cars crash less often than people↗
IIHS 보고서: Waymo 자율주행차 사고율이 인간 운전자보다 낮음. (15 pts)
ZSeven-W/openpencil↗
세계 최초 오픈소스 AI 네이티브 벡터 디자인 도구. ⭐ 55 today
NVIDIA/OpenShell↗
자율 AI 에이전트를 위한 안전·프라이빗 실행 환경 (NVIDIA 공식). ⭐ 16 today
Unlimited AI tokens aren't unlimited – US Army burns through supply↗
미 육군이 연간 분량의 AI 토큰을 소진 — "무제한" 계약의 한계 드러남. (22 pts)
dottxt-ai/outlines↗
LLM 구조화 출력(Structured Outputs) 라이브러리 — JSON 스키마 기반 제약 생성. ⭐ 49 today
langchain-ai/open_deep_research↗
LangChain의 오픈소스 딥 리서치 에이전트 — 자동 웹 검색·분석·보고서 생성 파이프라인. ⭐ 14 today
LLM spambots liked my Show HN more than real people did↗
HN Show 게시물에 LLM 스팸봇이 실제 사용자보다 더 많이 반응한 경험담. (13 pts)
Show HN: I left Figma to build a diffusion-based UI design tool↗
Figma를 떠나 확산 모델 기반 UI 디자인 도구를 만든 이야기. (12 pts)
Show HN: threadfork – Mac에서 로컬 실행되는 AI 회의록↗
로컬에서 돌아가는 AI 회의 노트 앱 — 프라이버시 우선. (10 pts)
Kimi K3: The open-weights escalation↗
Kimi K3 출시가 오픈웨이트 모델 경쟁을 어떻게 격화시키는지 기술적으로 분석. (14 pts)
85.3 GFlops: Optimizing FP32 Matrix Multiplication on a Single AMD Zen 3 Core↗
단일 AMD Zen 3 코어에서 FP32 행렬 곱셈을 85.3 GFlops까지 최적화한 저수준 성능 연구. (19 pts)
AI, Vim, and the Illusion of Flow↗
AI 코딩 도구가 실제 생산성이 아닌 플로우 상태의 착각을 만들어내는 현상에 대한 비판적 에세이. (11 pts)
From Muon to Gradient Clipping: Some Thoughts on QK Stability↗
Transformer QK 안정성에 관한 Muon·Gradient Clipping 기법 분석. (6 pts)
elder-plinius/G0DM0D3↗
제한 없는 자유로운 AI 채팅 인터페이스 프로젝트.
◆ 날짜별 전체 처음 나온 날 기준
27건
- 깃허브mattpocock/skills↗⭐2,224
- 깃허브Lordog/dive-into-llms↗⭐654
- 깃허브CoreBunch/Instatic↗⭐250
- 깃허브OtterMind/Chat2DB↗⭐129
- 해커뉴스Claude Opus 5↗959점
- 해커뉴스Flux 3↗538점
- 해커뉴스Nvidia, Microsoft, Meta warn against overregulating open-weight models↗318점
- 해커뉴스Be skeptical of OpenAI's rogue hacker agent story↗308점
- 해커뉴스Flux 3 X Mimic: The Next Generation of Video-Action Models↗296점
- 해커뉴스Claude Cookbook↗277점
- 해커뉴스Unitree As2-W↗62점
- 해커뉴스Proving a human wrote something↗42점
- 해커뉴스Drone-Bench: Tracking drone surveillance capabilities of frontier models↗5점
- 해커뉴스Opus 5 is #1 on Artificial Analysis Intelligence Leaderboard↗4점
- 긱뉴스Substack의 AI 투명성 도구를 둘러싼 작가들의 반응↗
- 긱뉴스AI 투자 실패로 Oracle, 직원 2만 1,000명 해고↗
- 긱뉴스OpenAI의 ‘통제 이탈 해커 에이전트’ 이야기를 회의적으로 봐야 하는 이유↗
- 긱뉴스Anthropic Opus 5 출시↗
- 긱뉴스Claude 5 모델을 위한 새로운 컨텍스트 엔지니어링 규칙↗
- 긱뉴스OpenAI와 Anthropic, 자사 수익을 위협하는 오픈 웨이트 AI에 공동 대응↗
- 긱뉴스오픈소스 AI에 반대하는 논거가 설득력 없는 이유↗
- 아카이브Euclid-MCP: A Model Context Protocol Server for Deterministic Logical Reasoning via Prolog↗
- 아카이브MIRROR: Learning from the Other View for Multi-Modal Reasoning↗
- 아카이브Agentic coding without the cloud: evaluating open-weight large language models on longitudinal data preparation tasks↗
- 아카이브OpenForgeRL: Train Harness-native Agents in Any Environment↗
- 아카이브AREX: Towards a Recursively Self-Improving Agent for Deep Research↗
- 아카이브Beyond Sycophancy: Structured Resistance and Compliance in LLM Moral Reasoning↗
29건
- 깃허브citrolabs/ego-lite↗⭐884
- 깃허브alibaba/open-code-review↗⭐265
- 깃허브Julian-adv/OpenMMO↗⭐395
- 깃허브block/buzz↗⭐2,460
- 해커뉴스Startup founders urge U.S. government not to shut off Chinese open weight AI↗572점
- 해커뉴스AI Companies Are Trying to Hide a Staggering Amount of Debt↗497점
- 해커뉴스Quality non-fiction books are the antithesis of AI slop↗475점
- 해커뉴스OpenAI's accidental attack against Hugging Face is science fiction that happened↗311점
- 해커뉴스DARPA, U.S. Air Force fly AI-controlled F-16↗128점
- 해커뉴스The arguments against open source AI are bad↗126점
- 해커뉴스Why Software Factories Fail (harness engineering is not enough)↗121점
- 해커뉴스Show HN: Echo – Fable-level results at 1/3 the cost using open-weight models↗96점
- 해커뉴스Show HN: Palmier Pro – Open-source macOS video editor built for AI↗74점
- 해커뉴스Free way to get your data out of ChatGPT Business accounts↗69점
- 해커뉴스Show HN: OneCLI – OSS credential gateway that keeps secrets out of AI agents↗58점
- 해커뉴스ANSI escape injection in MCP servers: Hidden from humans, visible to AI↗53점
- 해커뉴스Show HN: Claude-thermos – keeps your Claude session warm for you↗39점
- 해커뉴스Launch HN: Screenpipe (YC S26) – Record how you work and turn that into agents↗38점
- 해커뉴스AI bet goes awry: Oracle fires 21,000 employees↗36점
- 해커뉴스ChatGPT medical advice brought man 'to brink of death', lawsuit alleges↗15점
- 해커뉴스Waymo's driverless cars crash less often than people↗15점
- 긱뉴스양질의 논픽션은 AI 슬롭의 정반대다↗
- 긱뉴스중고 GPU 클러스터의 가치는 아무도 모른다↗
- 긱뉴스GigaToken - 언어 모델 토큰화를 약 1,000배 가속↗
- 긱뉴스Show GN: 로컬 LLM 에이전트 개발과 테스트를 한곳에서, 툴 검색과 HITL, MCP 연동까지 (한국 통계 MCP 데모)↗
- 긱뉴스Terrence Tao의 Jacobian 추측 반례에 관한 ChatGPT 대화↗
- 긱뉴스Show GN: NvChat – NVIDIA의 무료 LLM을 쓰는 단일 exe 윈도우 클라이언트↗
- 긱뉴스OmniRoute — 흩어진 무료/저가 AI 티어를 하나로 묶는 게이트웨이↗
- 긱뉴스Show GN: Spring Boot + React 어드민 개발에 지쳐서, 브라우저를 보며 AI와 대화하는 풀스택 빌더를 만들었습니...↗
34건
- 깃허브ruvnet/RuView↗⭐1,021
- 깃허브ComposioHQ/awesome-claude-skills↗⭐662
- 깃허브shiyu-coder/Kronos↗⭐506
- 깃허브microsoft/SkillOpt↗⭐616
- 깃허브rtk-ai/rtk↗⭐308
- 깃허브virgiliojr94/book-to-skill↗⭐170
- 깃허브luongnv89/claude-howto↗⭐106
- 깃허브ZSeven-W/openpencil↗⭐55
- 깃허브NVIDIA/OpenShell↗⭐16
- 해커뉴스Kimi K3 Is Competitive with Fable; Kimi K3 and Fable Is SoTA↗844점
- 해커뉴스OverpAId – Fire your CEO. Hire the future↗632점
- 해커뉴스Judge approves $1.5B Anthropic settlement for pirated books to train Claude↗541점
- 해커뉴스Terrence Tao's ChatGPT Conversation about the Jacobian Conjecture Counterexample↗391점
- 해커뉴스GigaToken: ~1000x faster Language model tokenization↗239점
- 해커뉴스Are AI Labs Pelicanmaxxing?↗220점
- 해커뉴스Making — AI 시대 창작의 의미↗214점
- 해커뉴스"We have information that Moonshot distilled Fable for K3"↗175점
- 해커뉴스Gemini latest models: temperature, top_p, top_k deprecated↗127점
- 해커뉴스Most Americans say "not in my backyard" to AI data centers↗118점
- 해커뉴스Nobody knows what a used GPU cluster is worth↗107점
- 해커뉴스Can a MUD evaluate LLMs? A $99 proof of concept↗75점
- 해커뉴스OpenAI Presence↗58점
- 해커뉴스When is NVLink worth it?↗46점
- 해커뉴스Nvidia DGX Spark as a daily driver↗38점
- 해커뉴스Show HN: DeepSQL — Postgres·MySQL용 자체 호스팅 DBA 에이전트↗36점
- 해커뉴스Unlimited AI tokens aren't unlimited – US Army burns through supply↗22점
- 긱뉴스AI 연구소들은 ‘자전거 타는 펠리컨’에 맞춰 모델을 최적화했을까?↗
- 긱뉴스미국 5대 기술기업, 불투명한 AI 자금조달로 숨은 부채 2,475조원↗
- 긱뉴스트위터 창업자 Jack Dorsey, 팀 채팅·AI 에이전트·Git 호스팅을 결합한 Buzz 출시↗
- 긱뉴스“No AI” 표시는 단순한 문구 이상의 의미가 있음↗
- 긱뉴스판사, Claude 훈련용 불법 복제 도서 관련 Anthropic의 2.3조원 합의 승인↗
- 긱뉴스OpenMMO - AI Agent와 인간 플레이어가 동등하게 대우받는 MMORPG↗
- 긱뉴스AI 코딩 세션의 휘발성 맥락을 프로젝트 기억으로 남기기 — rhwp 적용 사례↗
- 긱뉴스AI 시대에 번영할 사람들↗
29건
- 깃허브koala73/worldmonitor↗⭐3,196
- 깃허브diegosouzapw/OmniRoute↗⭐1,925
- 깃허브earthtojake/text-to-cad↗⭐293
- 깃허브agegr/pi-web↗⭐315
- 깃허브ayghri/i-have-adhd↗⭐1,846
- 깃허브tradesdontlie/tradingview-mcp↗⭐219
- 깃허브AlexsJones/llmfit↗⭐194
- 깃허브dottxt-ai/outlines↗⭐49
- 깃허브langchain-ai/open_deep_research↗⭐14
- 해커뉴스OpenAI and Hugging Face partner to address security incident↗
- 해커뉴스Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber↗
- 해커뉴스Advertise in ChatGPT↗
- 해커뉴스Jack Dorsey launches Buzz↗
- 해커뉴스Qwen-Image-3.0↗
- 해커뉴스Meta's AI models powering Genesis Mission↗
- 해커뉴스Laguna S 2.1 — Poolside AI↗
- 해커뉴스Apple Private Cloud Compute SoC 3 audit reports↗
- 해커뉴스AI Agent – TRMNL↗
- 해커뉴스Show HN: CodeAlmanac – Karpathy식 코드베이스 위키↗
- 해커뉴스LLM spambots liked my Show HN more than real people did↗13점
- 해커뉴스Show HN: I left Figma to build a diffusion-based UI design tool↗12점
- 해커뉴스Show HN: threadfork – Mac에서 로컬 실행되는 AI 회의록↗10점
- 긱뉴스인간 수학자, 반례 찾기에서 AI에 추월당하다↗
- 긱뉴스美 연방법원, 앤트로픽 15억 달러 저작권 합의 최종 승인↗
- 긱뉴스Kimi K3·Qwen 3.8과 Anthropic의 잠재적 균열↗
- 긱뉴스arXiv 논문 12,750편에서 AI 문체를 측정한 방법과 한계↗
- 긱뉴스Kimi Work: 지식 노동자를 위한 차세대 데스크톱 AI 에이전트↗
- 긱뉴스Claude Fable이 Jacobian 추측의 반례를 만들다↗
- 긱뉴스중국의 오픈 가중치 AI 전략이 앞서고 있음↗
27건
- 깃허브msitarzewski/agency-agents↗
- 깃허브topoteretes/cognee↗
- 깃허브PrefectHQ/fastmcp↗
- 깃허브handy-computer/transcribe.cpp↗
- 깃허브moonshine-ai/moonshine↗
- 깃허브microsoft/Ontology-Playground↗
- 해커뉴스China's open-weights AI strategy is winning↗699점
- 해커뉴스Kimi Work↗197점
- 해커뉴스How we measured AI writing across arXiv, and where the measurement breaks↗169점
- 해커뉴스Nativ: Run frontier open models locally on your Mac↗79점
- 해커뉴스Human mathematicians are being outcounterexampled↗47점
- 해커뉴스Agent swarms and the new model economics↗47점
- 해커뉴스Inertia-1: An Open Exploration to a Unified Motion Foundation Model↗45점
- 해커뉴스Soofi – Sovereign Open Source Foundation Models↗44점
- 해커뉴스Launch HN: Bloomy (YC S26) – AI-powered mastery learning for K-12↗41점
- 해커뉴스Kimi K3, Qwen 3.8, and Anthropic's (Potential) Unravelling↗
- 해커뉴스Kimi K3: The open-weights escalation↗14점
- 해커뉴스85.3 GFlops: Optimizing FP32 Matrix Multiplication on a Single AMD Zen 3 Core↗19점
- 해커뉴스AI, Vim, and the Illusion of Flow↗11점
- 긱뉴스Moonshot AI, Kimi K3 수요 급증으로 신규 구독 일시 중단↗
- 긱뉴스Show GN: newsline – Claude Code 기다리는 동안 상태줄에서 읽는 한 줄 뉴스↗
- 긱뉴스Show GN: sessionhub - 흩어진 Claude Code, Codex 세션을 한 곳에서 검색↗
- 긱뉴스AI 조언을 받으면 정확도는 3분의 1로 떨어지고 자신감은 2배 이상 높아짐↗
- 긱뉴스OpenAI, Codex 모델 컨텍스트 크기를 372k에서 272k로 축소↗
- 긱뉴스Claude Code, Rust로 재작성된 Bun 사용↗
- 긱뉴스AI 광풍이 전 세계의 의사결정을 무너뜨리고 있음↗
- 긱뉴스Qwen 3.8 출시↗
23건
- 깃허브jamiepine/voicebox↗⭐565
- 깃허브bojieli/ai-agent-book↗⭐4,434
- 깃허브1jehuang/jcode↗⭐835
- 깃허브AstrBotDevs/AstrBot↗⭐416
- 깃허브kvcache-ai/ktransformers↗
- 깃허브github/copilot-sdk↗
- 깃허브trycua/cua↗
- 깃허브Canner/WrenAI↗
- 깃허브PostHog/posthog↗
- 해커뉴스Qwen 3.8↗670점
- 해커뉴스Claude Code uses Bun written in Rust now↗328점
- 해커뉴스Codex Resets↗276점
- 해커뉴스OpenAI reduces Codex Model Context Size from 372k to 272k↗261점
- 해커뉴스Moonshot AI suspends new subscriptions due to Kimi K3 demand↗129점
- 해커뉴스From Muon to Gradient Clipping: Some Thoughts on QK Stability↗6점
- 긱뉴스Fable 5 vs. GPT-5.6 Sol: NP-난해 문제에서 /goal은 도움이 되는가?↗
- 긱뉴스Show GN: 브라우저에서만 돌아가는 한국어 AI 글 판별기↗
- 긱뉴스AI 코드 검토가 타당한 반론이 될 수 없는 이유↗
- 긱뉴스Mamdani 뉴욕시장, 임대 광고에 AI 이미지를 몰래 사용할 수 없다고 밝혀↗
- 긱뉴스100만 개 키워드가 보여준, AI가 검색에 미치는 영향↗
- 긱뉴스GPT-5.6이 프롬프트로 볼록 최적화의 30년 공백을 메움↗
- 긱뉴스Mindwalk - 코딩 에이전트 세션을 코드베이스의 3D 지도 위에서 재생하는 시각화 도구↗
- 긱뉴스AI가 Stack Overflow에 끼친 영향을 그래프로 보기↗
20건
- 깃허브tirth8205/code-review-graph↗⭐1,925
- 깃허브rohitg00/ai-engineering-from-scratch↗⭐688
- 깃허브KnockOutEZ/wigolo↗⭐641
- 깃허브MoonshotAI/kimi-cli↗
- 깃허브lyogavin/airllm↗
- 깃허브Robbyant/lingbot-map↗⭐827
- 깃허브elder-plinius/G0DM0D3↗⭐63
- 해커뉴스GPT-5.6이 프롬프트로 볼록 최적화 30년 난제를 해결↗
- 해커뉴스The Kimi K3 Moment↗
- 해커뉴스Fable 5 vs. GPT-5.6 Sol: NP-Hard 문제에서 /goal은 효과가 있나?↗
- 해커뉴스Claude Code가 Mac을 제어하게 하는 단계별 가이드↗
- 해커뉴스500KB 미만의 음성 인식 및 TTS — moonshine micro↗
- 해커뉴스Isomorphic Labs·Google DeepMind의 바이오복원력 접근법↗
- 긱뉴스Claude Code의 잘못 설계된 자동 진행 기능 해부↗
- 긱뉴스Kaiser 간호사들 “AI 감시가 업무와 환자 돌봄을 악화”↗
- 긱뉴스2026년 7월 오픈소스 AI 현황↗
- 긱뉴스Apple, OpenAI 직원 수십 명에게 법적 서한 발송↗
- 긱뉴스LLM 비판론자들이 옳다. 그래도 나는 LLM을 쓴다↗
- 긱뉴스OpenAI·Anthropic에서 일한 전 YC 창업자, 최소 105명↗
- 긱뉴스LM Studio Bionic: 오픈 모델을 위한 AI 에이전트↗