◆ 깃허브
- addyosmani/agent-skills↗
AI 코딩 에이전트를 위한 프로덕션급 엔지니어링 스킬 모음
- TauricResearch/TradingAgents↗
멀티 에이전트 LLM 기반 금융 트레이딩 프레임워크
◆ 해커뉴스
- Denmark Requires Oral Defenses for Students' Written Work to Counter AI Cheating↗
덴마크가 AI 부정행위 대응으로 학생 과제에 구술 심사를 의무화함 (299pts)
- "Code was never the hard part" is an insult to all programmers↗
AI 시대에 "코딩은 어렵지 않다"는 주장이 프로그래머를 폄하한다는 반론 (324pts)
- DeepMind's WeatherNext model achieves breakthrough forecasting cyclones↗
DeepMind의 WeatherNext AI 모델이 사이클론 예측에서 획기적 성과를 달성함 (328pts)
- Timeline of the OpenAI accidental attack against Hugging Face↗
OpenAI가 Hugging Face를 실수로 공격한 사건의 전체 타임라인 분석 (262pts)
- Amazon Is Creating the Biggest Pollution Source in the Country↗
AI 수요로 폭증한 아마존 데이터센터가 미국 최대 오염원으로 부상 (120pts)
◆ 긱뉴스
- 덴마크, AI 부정행위 막기 위해 서면 과제 구두 소명 의무화↗
덴마크 정부는 집에서 작성한 과제를 학생이 구두로 직접 소명 하게 해 AI를 이용한 부정행위를 막는 규정을 즉시 시행함 주 대상은 16세 안팎의 상급 중등교육 학생으로, 매년 주요 과제를 제출하는 2년제 HF 과정 약 9,000명 이 포함됨 학교에는 시험 중 ...
- 대규모 AI 코딩 비용을 관리하는 방법↗
AI 코딩은 개발 생산성을 크게 높이지만 사용량과 함께 비용도 기하급수적으로 늘어날 수 있어, 폭넓은 도구 접근성 과 사용자당 예측 가능한 비용을 함께 달성해야 함 가장 큰 절감 수단은 최고 지능보다 주어진 품질에서 가격 경쟁력이 높은 효율성 프런티어 를 추...
- AI 시험지는 함정이 9할이다 - LLM 테스트 케이스 설계법↗
주문 메시지를 읽는 LLM 파이프라인을 검증하려고 테스트 29개를 만들었는데, 그 중 정상 케이스는 4개뿐입니다. 나머지는 전부 함정입니다. 제일 많은 그룹은 "주문이 아닌 것" 6개. 상품명과 숫자가 다 있는 단순 문의를 주문으로 잡으면 안 시킨 물건이 출고됩니다 문제만 어렵게
- Kitesurf - V8 격리 환경에서 실행되는 에이전트 우선 브라우저↗
AI 에이전트의 브라우저 수요와 Workers 기술 성숙이 맞물리자 Cloudflare가 Kitesurf 를 12주 만에 개발해 Browser Run 베타에서 무료로 공개함 Engine·PageScript·PageRenderer를 여러 Workers 격리 환경 으로 분리하고, 네트워크…
- xAI·SpaceX와 AI 인프라 구축 경쟁↗
SpaceX 산하 xAI는 Memphis의 Colossus 데이터센터 에서 무허가로 가동한 가스터빈을 2027년 7월까지 철거하고, 천연가스 발전소로 대체하기로 Mississippi 환경 당국과 합의함 Colossus I은 착공 후 122일 만에 가동 됐지만, 69기의 임시 이동식…
- Show GN: 외부 AI 결과를 여러 SNS에 예약하고 실제 발행 상태를 추적하는 ANKK↗
SNS 자동화에서 API가 202를 반환한 시점과 실제 게시물이 공개된 시점은 다릅니다. 이 차이를 운영하면서 반복해서 겪어, 외부 AI·스크립트에서 만든 콘텐츠를 여러 SNS에 예약하고 accepted → queued → publishing → published/failed 를…
- AI가 재편하는 차세대 사이버보안 스택↗
AI가 취약점을 찾아 악용하는 속도가 빨라지면서 평균 악용까지 걸리는 시간(TTE) 은 공개 9시간 전인 -9시간 까지 줄었고, 공개 전 제로데이로 악용되는 취약점 비율도 5년 전 약 30%에서 현재 80% 이상으로 증가함 보안 조직은 여러 도구를 직접 운용하는 방식에서 벗...
- AI가 린 스타트업 플레이북을 무너뜨리고 있는가? [유튜브]↗
AI로 소프트웨어를 더 빠르고 저렴하게 만들 수 있게 되면서, 좁은 틈새에서 출발하는 린 스타트업 방식 뿐 아니라 처음부터 차별화된 영역에서 크고 야심 찬 제품을 만드는 선택지도 넓어짐 AI에 지식을 맡길 수 있어도 머릿속 인지적 L1 캐시 에서 꺼내는 편이 훨씬...
◆ 아카이브
- RP-OPSD: Reasoning-Pivot-Guided On-Policy Self-Distillation for Multilingual Reasoning Transfer↗
Xinye Wang 외 2인 · 고자원 언어 밖으로 추론을 옮길 때 추론 전환점에 집중해 온폴리시 자기증류를 하는 RP-OPSD를 제안했다.
- A Six-Dimensional Taxonomy of Post-Training Adaptation Techniques with Applications in AI Governance↗
Fardin Afdideh 외 2인 · 사후학습 적응 기법들을 메커니즘·목표·데이터·지속성·범위·모델형의 6차원으로 분류하는 체계를 제시했다.
- On-Policy Self-Distillation without Any Supervision↗
Yijiang Li 외 5인 · 정답이나 외부 지도 없이 자기 생성물의 다수결 의사해답만으로 온폴리시 자기증류를 하는 U-OPSD를 제안했다.
- DASH: Divergence-Adaptive Supervision Horizons for On-Policy Self-Distillation of Reasoning Models↗
ZhiYan Hou 외 11인 · 롤아웃의 시간적 구조를 반영해 국소 발산마다 감독 계수를 다르게 주는 온폴리시 자기증류 기법 DASH를 제안했다.
- iARCS: Iterative Agentic RL for Controllable 3D Scene Generation↗
Saugat Adhikari 외 4인 · 자연어 과제 제약을 만족하도록 3D 장면 생성기를 반복적 에이전트 강화학습으로 미세조정하는 iARCS를 제안했다.
- TRAJDEBUG: Tracing Error Lifecycle to Identify Critical Failures in Long-Horizon Agent Trajectories↗
Yunjia Qi 외 12인 · 긴 에이전트 궤적에서 최종 실패를 유발한 최초 오류 단계를 이력 압축과 증거 기반으로 찾는 TrajDebug를 제안했다.