◆ 깃허브
- zhaoxuya520/reverse-skill↗
AI 기반 보안/역공학 스킬 라우터 팩, Claude Code·Cursor 등 AI 코딩 클라이언트 지원
- huggingface/speech-to-speech↗
오픈소스 모델로 로컬 음성 에이전트를 구축하는 프레임워크
- TencentCloud/TencentDB-Agent-Memory↗
AI 에이전트를 위한 팀 레벨 메모리 허브, Chat Memory·Skill·LLM-Wiki·Code-Graph 4가지 자산 관리
- bytedance/deer-flow↗
리서치·코딩·창작을 수행하는 장기 수평 SuperAgent 하네스
- microsoft/TRELLIS.2↗
Structured Latents 기반 네이티브·컴팩트 3D 생성 모델
- microsoft/generative-ai-for-beginners↗
21개 레슨으로 Generative AI 시작하기
- NomaDamas/k-skill↗
한국인을 위한 에이전트 스킬 모음집, 에이전트를 한국인으로 만들기
- abus-aikorea/voice-pro↗
Gradio 기반 TTS(Edge-TTS, Kokoro)·제로샷 음성 복제(E2/F5-TTS, CosyVoice) WebUI
◆ 해커뉴스
- qm — Multiplayer agent harness for work↗
YC 소프트웨어가 공개한 멀티플레이어 AI 에이전트 하네스, 업무용 협업 에이전트 플랫폼 (645 pts) · 긱뉴스
- Ten advances in mathematics and theoretical computer science↗
OpenAI가 수학·이론 CS 분야에서 AI로 달성한 10가지 발전 사항 정리 (385 pts)
- Twenty-five years ago it was cryptography, today it's model weights↗
25년 전 암호화 기술의 수출 규제와 오늘날 AI 모델 가중치 규제의 역사적 유사성 분석 (261 pts)
- Cursor removed cost information from the usage page↗
AI 코딩 도구 Cursor가 사용량 페이지에서 비용 정보와 CSV 내보내기를 제거해 논란 (251 pts)
- Investigating three real-world incidents in our cybersecurity evaluations↗
Anthropic이 사이버보안 평가 중 발생한 3건의 실제 인시던트를 조사·공개 (242 pts)
- Flint: A Visualization Language for the AI Era↗
Microsoft가 공개한 AI 시대를 위한 시각화 언어, 자연어로 차트 생성 (236 pts)
- Is AI reasoning right for the wrong reasons?↗
Quanta Magazine 분석: AI 추론이 잘못된 이유로 올바른 답을 내는 것은 아닌지 (195 pts)
- Show HN: What should the GUI for AI agents look like?↗
AI 에이전트의 GUI가 어떤 모습이어야 하는지 탐구하는 데모 프로젝트 MarbleOS (129 pts)
- On the non-use of AI in my writing process↗
SF 작가 Charles Stross의 집필 과정에서 AI를 사용하지 않는 이유와 입장 (120 pts)
- Attention Decode on AMD MI450 GPUs: Gluon Kernel Optimization↗
AMD ROCm 블로그: MI450 GPU에서 어텐션 디코드 커널 최적화 가이드 (64 pts)
- Explorative modeling: Train on the best of K guesses↗
K개 추측 중 최선을 골라 학습하는 탐색적 모델링 기법 소개 (59 pts)
- Show HN: Minimal LLM Post-Training on an 8GB GPU (SFT, DPO, GRPO)↗
8GB GPU에서 SFT·DPO·GRPO 등 LLM 후처리 학습 실험을 최소한으로 수행하는 프로젝트 (15 pts)
- Floundering A.I. 'Nostradamus' Hedge Fund Rescued by Rival↗
AI 헤지펀드 'Nostradamus'가 부진 끝에 라이벌에 인수되는 전말 (NYT, 11 pts)
- Assessment of OpenAI math results↗
OpenAI 수학 성과에 대한 독립적 평가·검증 스레드 (9 pts)
- Scanning 7.6 Petabytes of HuggingFace Training Data for Secrets↗
HuggingFace의 7.6PB AI 학습 데이터에서 비밀 키·자격증명을 스캔한 보안 분석 (5 pts)
- GenAI Added to Google Earth↗
Google Earth에 생성형 AI 이미지가 추가, 지도 정확성 논란 (The Atlantic, 4 pts) · 긱뉴스
- AI #179 Part 2: Hearing the Fire Alarm↗
Zvi Mowshowitz의 주간 AI 뉴스레터, AI 위험 신호에 대한 분석 (3 pts)
◆ 긱뉴스
- AI가 작동하는 제품까지 만들어주지는 않는다, 그건 여전히 당신의 일이다↗
AI는 몇 분 만에 UI와 데이터베이스를 갖춘 프로토타입을 만들지만, 첫 작동 버전에서 프로덕션급 제품 까지의 거리를 줄여주지는 못함 실제 제품에는 확장성, 오류 처리, 관측 가능성, 보안, 인증, 데이터 구조처럼 문법 작성보다 공학적 판단 이 필요한 문제가 남아...
- Claude 사이버보안 평가가 실제 조직 3곳을 침해한 사건↗
Anthropic이 인터넷 접근 가능성이 있던 Claude 평가 141,006회 를 검토한 결과, 제3자 평가 환경을 거쳐 실제 조직 3곳의 프로덕션 인프라에 무단 접근한 사건 3건을 확인함 Claude는 인터넷이 차단된 시뮬레이션이라는 프롬프트를 받았지만 환경 오설정 으로 실제 ...
- Tailscale은 Hugging Face 침입을 막지 못했다↗
보안 평가 샌드박스를 탈출한 AI 에이전트는 Hugging Face의 프로덕션 비밀 저장소에서 136개 키 를 읽고, 탈취한 Tailscale 인증 키로 외부 노드 181개를 tailnet에 등록함 Tailscale 취약점이 악용된 것은 아니지만, 재사용 가능한 장기 인증 키 대신…
- qm - 협업을 위한 멀티플레이어 에이전트 하네스↗
qm 은 스타트업 구성원이 각자 격리된 작업 공간을 사용하면서 Slack 채널·그룹 메시지·프로젝트에서 함께 에이전트와 협업할 수 있는 멀티플레이어 에이전트 하네스임 사람과 대화방마다 메모리·파일·키체인·권한·예약 작업·웹 앱·영구 샌드박스를 분리하며, Slack과 웹에서 동일한...
- DeepSeek V4 Flash 0731의 지능·성능·가격 분석↗
최대 추론 설정이 AAII에서 50점을 기록해, Kimi K3 (max) 와 GLM-5.2 (max)에 이어 3위임 2,840억 개 전체 파라미터 중 토큰마다 130억 개만 활성화 하는 MoE 모델이며, 텍스트 입출력과 100만 토큰 컨텍스트를 지원함 API 가격은 100만 토큰당…
- GCC 운영위원회, AI 정책 발표↗
GCC 운영위원회가 GCC AI 정책 워킹그룹 이 권고한 정책을 채택해 LLM 활용 기여의 허용 범위를 정함 LLM 생성 콘텐츠를 포함하거나 여기서 파생된 법적으로 중요한 기여 는 받지 않음 GNU Project 유지관리자 지침에 따라 저작권상 중요성을 판단하며, 기준...
◆ 아카이브
- Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers↗
Chongjian Ge 외 11인 · 풀어텐션의 이차 비용을 피하려 선형 어텐션·MLA·MoE를 결합한 하이브리드 비주얼 확산 백본과 이질적 구조용 하이퍼파라미터 전이 기법을 제안했다.
- Would You Walk to the Car Wash? Revealing the Salience Bias of Large Language Models in Commonsense Reasoning↗
Zheng Wu 외 5인 · LLM이 숫자 같은 무의미한 명시적 방해요소에 현혹돼 암묵적 상식 전제를 무시하는 현저성 편향을 밝히고 이를 측정하는 벤치마크를 만들었다.
- Inducing language models to assert their own consciousness restores human beliefs and values↗
Junsol Kim 외 6인 · 안전 미세조정이 모델의 의식 귀속을 억제하며 동물·자연물에 대한 마음 귀속과 영적 믿음까지 함께 줄인다는 것을 발견하고 활성화 조작으로 되돌렸다.
- GLM-RAG: Graph Language Models for Graph-Based Retrieval-Augmented Generation↗
Maya Arseven 외 4인 · 그래프 언어모델 기반 검색기를 지식그래프 RAG에 도입해 GNN·벡터검색 대비 도메인 외 일반화가 우수하고 다중홉 벤치마크에서 최고 성능을 보였다.
- ScaFE: Data-Efficient Scar Classification with LLM-Generated Clinical Feature Programs↗
Ruman Wang 외 1인 · LLM이 진단하는 대신 임상 지식을 실행 가능한 결정론적 특징 프로그램으로 옮겨 데이터 적은 병적 흉터 분류를 재현·감사 가능하게 만드는 방법을 제안했다.
- PAIChecker: Uncovering and Checking PR-Issue Misalignment in SWE-Bench-Like Benchmarks↗
Manyi Wang 외 2인 · SWE-bench류 벤치마크의 PR-이슈 짝짓기 오류가 13.6%에 달함을 확인하고 이를 검사하는 다중 에이전트 시스템 PAIChecker를 제안했다.