◆ 깃허브
- firecrawl/pdf-inspector↗
PDF 검사·분류·텍스트 추출을 위한 고속 Rust 라이브러리, 스캔/텍스트 기반 PDF 자동 판별
- esengine/DeepSeek-Reasonix↗
DeepSeek 네이티브 터미널 AI 코딩 에이전트, prefix-cache 안정성 중심 설계
- lyogavin/airllm↗
4GB GPU 하나로 70B LLM 추론을 가능하게 하는 라이브러리
- Panniantong/Agent-Reach↗
AI 에이전트에게 Twitter·Reddit·YouTube·GitHub 등 인터넷 전체를 읽고 검색하는 눈을 부여, API 비용 없음
- jamiepine/voicebox↗
오픈소스 AI 음성 스튜디오, 음성 복제·딕테이션·생성
- Alishahryar1/free-claude-code↗
터미널·앱·IDE에서 Claude Code·Codex·Pi를 무료로 사용, 음성 지원
- shiyu-coder/Kronos↗
금융시장 언어를 위한 파운데이션 모델
- livekit/agents↗
실시간 음성 AI 에이전트 구축 프레임워크
- zhaoxuya520/reverse-skill↗
AI 기반 보안/역공학 스킬 라우터 팩, Claude Code·Cursor 등 지원 (PowerShell · ★15,543 · +2,442/day) ▲연속
- TencentCloud/TencentDB-Agent-Memory↗
AI 에이전트 팀 레벨 메모리 허브, Chat Memory·Skill·LLM-Wiki·Code-Graph 4종 자산 관리 (TypeScript · ★11,978 · +1,091/day) ▲연속
- microsoft/AI-For-Beginners↗
12주 24레슨 구성 AI 입문 커리큘럼 (Jupyter Notebook · ★60,615 · +1,902/day) ▲연속
- microsoft/generative-ai-for-beginners↗
21레슨 생성형 AI 시작 가이드 (Jupyter Notebook · ★115,473 · +776/day) ▲연속
◆ 해커뉴스
- Don't be a meat proxy↗
AI가 생성한 코드를 무비판적으로 복붙하는 "고기 프록시" 역할을 경계하라는 에세이 (1,614 pts)
- SQLite Critical CVEs or LLM Slop?↗
LLM이 생성한 가짜 CVE 보고서가 SQLite에 등록된 사례, AI 코드 보안 신뢰도 문제 (679 pts)
- Prevent cognitive debt by manually retyping LLM-generated code↗
LLM 생성 코드를 손으로 다시 타이핑해야 인지 부채를 줄일 수 있다는 주장 (332 pts)
- Ten advances in mathematics and theoretical computer science↗
OpenAI가 발표한 수학·이론 컴퓨터과학 분야 10가지 연구 성과 (296 pts)
- MiniMax H3 Day-0 Support in ComfyUI↗
MiniMax H3 오픈 웨이트 모델이 ComfyUI에 즉시 지원, 네이티브 오디오·2K 비디오 생성 (214 pts)
- AirLLM 70B inference with single 4GB GPU↗
4GB GPU 하나로 70B LLM 추론이 가능한 오픈소스 프로젝트 (164 pts)
- Why we write our own C and C++ inference engines↗
LocalAI가 자체 C/C++ 추론 엔진을 직접 작성하는 이유와 성능 이점 (113 pts)
- Show HN: Nightcrawler – A local AI pentesting agent on a smartphone↗
스마트폰에서 로컬로 동작하는 AI 기반 침투 테스트 에이전트 (93 pts) · 긱뉴스
- Smaller, faster, safer: running Kimi and GLM at scale↗
Cloudflare가 Kimi·GLM 모델을 대규모로 서빙하며 얻은 최적화 경험 (72 pts)
- Launch HN: Hoplite (YC S26) – Effortlessly deploy cloud coding agents↗
YC S26 출신, 클라우드 코딩 에이전트를 손쉽게 배포하는 플랫폼 (32 pts)
- Show HN: Product analytics and evals for agent sessions on MCP↗
MCP 기반 에이전트 세션에 대한 제품 분석·평가 도구 (27 pts)
- Explanation of INT8 ConvRot (FP8 is no longer needed)↗
INT8 ConvRot 기법 설명, FP8이 더 이상 필요 없다는 주장 (20 pts)
- The AI Bailout Could Be Baked into the AI Bubble↗
AI 버블에 이미 구제금융이 내장돼 있다는 분석, 사모펀드·보험사 대출 리스크 (19 pts)
- AI's debt binge can't last, hidden borrowing reaches $1.65T↗
AI 하이퍼스케일러 숨겨진 차입이 1.65조 달러에 달해 지속 불가능 (12 pts)
◆ 긱뉴스
- LLM 생성 코드를 직접 다시 입력해 인지 부채 막기↗
기능 전체를 코딩 에이전트에 맡기는 대신, 채팅으로 생성된 코드를 직접 입력해 코드 이해와 통제권 을 유지함 에이전트는 명시적 요청 없이는 파일·의존성·저장소 상태를 변경하지 않고, 모든 편집안과 명령을 채팅에만 출력하도록 제한함 직접 입력하는 동안 작동 방식과...
- 웹앱과 AI↗
웹앱은 설치 없이 브라우저만 있으면 PC·스마트폰·태블릿·자동차 등 어떤 기기에서든 주소만으로 쓸 수 있고, 중앙에서 한 번 업데이트하면 모든 기기에 반영되는 애플리케이션이다. AI가 개발 업무를 거의 다 맡아주는 시대에는 AI 사용자가 곧 개발자이므로, 웹앱이 무엇인지 아는 것만으로…
- 가장 빠른 AI-First 기업은 실제로 어떻게 일하는가↗
빠른 AI-First 기업은 단순히 인원을 줄이고 도구를 도입하는 데 그치지 않고, AI를 동료로 취급 하며 훌륭한 제품이라는 공동 목표에 맞춰 사람과 시스템을 구성함 AI로 초안을 만드는 0→1 보다 프로토타입을 출시하고 검증·학습·반복하는 1→2 가...
- Show GN: 온글 – 브라우저 안에서 작동하는 로컬 AI 번역 및 TTS 크롬 익스텐션↗
안녕하세요. 웹페이지를 한국어로 번역하고 음성으로 읽어주는 Chrome 확장 프로그램을 만들었습니다. 이미 브라우저에서 번역 잘되는데 뭐하러 만들었냐고 물으신다면, 이 것 마저도 보안에 막혀있는 곳이 있습니다. ㅠ 선택한 텍스트, 전체 웹페이지, 유튜브 자막을 번역할 수 있습니다. 번역
- Show GN: 클로드코드 세션 탐색기 만들어 봤습니다.↗
여러 프로젝트를 오가다 보니 세션이 디렉토리별로 흩어졌습니다. 예전에 나눴던 대화에서 필요한 내용을 찾지 못해 같은 걸 다시 묻거나, 이미 했던 논의를 또 반복하는 일이 잦아졌습니다. claude --resume 의 인터랙티브 피커로 세션을 고를 수는 있지만 탐색 범위가 현재
- 질문을 제대로 하면 AI 금융 조언은 놀라울 정도로 좋아짐↗
22~89세의 재무 결정을 시뮬레이션한 결과, LLM 조언은 30세 이상 거의 모든 사람에게 저축 완충 자금 을 마련하고 저축·주식시장 참여·분산투자를 늘리는 데 도움을 줌 근로 기간에는 저축하고 은퇴 후에는 자산을 인출하며 45세 이후 주식 비중을 낮추도록 권했지만, 실직 ...
◆ 아카이브
- AMTFV: Agentic Mathematical Tool-Flow Verification for LLM Self-Correction↗
Rui Zou 외 3인 · LLM 수학 답 검증에서 중단-실행-재개 인터페이스로 검증 설계와 실행을 분리해 정확한 계산을 지원하는 에이전트 방식을 제안했다.
- CodeShrink: Adaptive Visual Compression for Efficient Multimodal Code Understanding↗
Wenxin Tang 외 8인 · 코드를 이미지로 렌더링할 때 여백 제거와 강화학습 기반 입력별 압축 설정으로 멀티모달 코드 이해의 시각 토큰 비용을 줄였다.
- MoRoute: Dynamic Routing for In-Context Multimodal Video Generation↗
Chong Gao 외 7인 · 고정 VLM과 사전학습 비디오 확산 트랜스포머를 동적 라우팅으로 연결해 다양한 조건을 다루는 통합 멀티모달 비디오 생성 프레임워크를 제안했다.
- Studying quantization trade-offs for efficient inference deployment in machine translation↗
Jim Zhao 외 4인 · 번역 모델에서 문서 청킹과 W4A8·W8A8 양자화를 결합해 지연-처리량 파레토 곡선을 개선하는 배포 트레이드오프를 분석했다.
- FibVLA: An Efficient Temporal Vision-Language-Action Model with Fibonacci Sampling↗
Li Lin 외 5인 · 로그 스케일 회상 샘플링으로 긴 이력을 적은 중복으로 담아 시간 정보와 추론 효율을 함께 잡는 시각-언어-행동 모델을 제안했다.
- DungeonBench: A Benchmark for Rules-Rich Tactical Reasoning in Dungeons & Dragons Combat↗
Ismayil Ismayilov 외 2인 · 이동·공격·주문·자원이 얽힌 D&D 전투 상황에서 규칙 기반 전술 추론을 평가하는 벤치마크 DungeonBench를 만들었다.