◆ 깃허브
- PrimeIntellect-ai/prime-agent↗
코딩 워크플로우와 장기 자율 작업을 위한 자기 개선형 RLM 에이전트
- mattpocock/skills↗
실전 엔지니어를 위한 에이전트 스킬 프레임워크, .agents 디렉토리 기반
- obra/superpowers↗
에이전틱 스킬 프레임워크 & 소프트웨어 개발 방법론
- semantica-agi/semantica↗
그래프 네이티브 컨텍스트 인프라 및 책임 있는 AI 시스템 구축 도구
- 666ghj/MiroFish↗
범용 군집 지능 엔진, 모든 것을 예측
- chenyme/grok2api↗
Grok Build/Web/Console 멀티 계정 API 게이트웨이
- Significant-Gravitas/AutoGPT↗
누구나 사용 가능한 AI 에이전트 플랫폼
- unclebob/swarm-forge↗
여러 AI 에이전트를 조율하는 경량 도구 (Clojure · 85 stars/day)
- google/skills↗
Google 제품·기술을 위한 공식 에이전트 스킬
- goauthentik/authentik↗
오픈소스 인증 플랫폼, AI 에이전트 통합 인증에 활용 급증
◆ 해커뉴스
- Oracle bans AI-generated code from OpenJDK↗
Oracle이 OpenJDK 프로젝트에서 AI 생성 코드 기여를 금지, AI 코드 저작권·라이선스 논쟁 격화 (273 pts) · 긱뉴스
- DeepSeek V4 Flash 0731↗
DeepSeek V4 Flash가 ARC Prize 벤치마크에서 주목할 성적 기록 (260 pts) · 긱뉴스
- What happens if an entire class of workers loses faith in their careers↗
AI 시대에 테크 종사자들의 커리어 불안과 직업적 신뢰 상실에 대한 심층 분석 (193 pts)
- 2027 memory capacity reportedly sold out↗
AI 수요로 2027년 메모리 생산 용량이 이미 완판, 공급 부족 우려 (138 pts)
- Kitesurf: Agent-first browser in V8 isolates↗
Cloudflare가 V8 격리 환경에서 동작하는 에이전트 전용 브라우저 Kitesurf 공개 (124 pts)
- Responding to the next frontier of critical cyber capabilities↗
OpenAI가 AI의 사이버 보안 역량 발전에 대한 대응 방향과 정책 발표 (111 pts)
- Databricks drove down AI coding spend 70%↗
Databricks가 AI 코딩 비용을 70% 절감한 대규모 운영 전략 공유 (102 pts)
- The Claudyssey: Homer's Odyssey translated line-for-line by Claude Fable 5↗
Claude Fable 5가 호메로스 오디세이아를 행 단위로 번역한 프로젝트 (31 pts)
◆ 긱뉴스
- 인간은 AI 에이전트 명령 승인 과정에서 위협 3개 중 1개를 놓침↗
AI 코딩 에이전트 명령을 승인·거부하는 게임의 4만 회 이상 실행과 40만9천 건의 결정을 분석한 결과, 평균 위협 탐지 정확도는 66.3% 에 그쳐 인간 승인을 최후의 보안 경계로 삼기 어려웠음 명백한 파괴 명령의 누락률은 11.7%였지만 자격 증명 접근 같은 범위 위반
- Show GN: 만화 이미지의 대사와 말풍선을 번역하는 AI Manga Translate를 만들었습니다↗
안녕하세요. 이미지 기반 만화를 좀 더 쉽게 번역할 수 있도록 AI Manga Translate를 만들고 있습니다. 일반 번역기는 텍스트를 복사해서 입력하는 방식이 대부분인데, 만화는 텍스트가 이미지 안에 있고 말풍선, 세로쓰기, 배경 위의 글자, 작은 폰트 등 때문에 단순 OCR +…
- AI한테 시험을 냈는데 출제자가 5번 틀렸다 - LLM 파이프라인 검증기↗
카톡 주문 메시지를 상품 코드로 바꿔주는 LLM 파이프라인을 만들기 전에, 테스트 29개(정답지·채점기 포함)부터 만들었습니다. 결과는 두 모델 모두 치명 오류 0건 통과. 그런데 그 과정에서 제가 쓴 정답지가 3번, 채점기가 2번 틀렸습니다. 헷갈리게 심어둔 함정에 출제자인 제가…
- AMD, 모델을 실리콘에 새기는 AI 칩 스타트업 Taalas 인수↗
AMD가 모델 가중치를 실리콘에 직접 새기는 Taalas 를 인수해 Nvidia가 주도하는 고성능 추론 시장 공략을 강화함 TSMC 6nm 공정의 모델 전용 칩 HC1 은 Meta Llama 3.1 8B를 초당 16,960토큰으로 처리해 발표 당시 Nvidia GPU보다 48배,…
- LLM은 ‘점프’할 수 없다↗
현재 생성형 AI는 데이터에서 규칙을 찾는 귀납(Induction) 과 주어진 공리에서 결과를 도출하는 연역(Deduction) 은 빠르게 기계화하고 있지만, 감각 경험에서 새로운 설명과 공리로 넘어가는 귀추(Abduction) 의 ‘점프’는 수행하지 못한다는 입장임
◆ 아카이브
- EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning↗
Zishan Xu 외 11인 · LLM 에이전트 훈련에서 외부 환경 상호작용을 정책이 환경 역할까지 맡는 "월드 리허설"로 대체해 환경 동역학을 파라미터에 내재화하는 강화학습법 EnvACE 제안.
- Tracing the Heart: An Evidence-Linked Pipeline for Heart-Failure Feature Engineering↗
Soorya Ram Shimgekar 외 12인 · 근거 연결·루브릭 기반 다중 에이전트 파이프라인 nMAS로 심부전 EHR 특징 공학을 자동화하고 출처 추적과 검증을 지원함.
- Benchmarking and Enhancing LLMs for Rule-Intensive Review of National Standard Documents↗
Tao Wang 외 6인 · 중국 GB/T 국가표준 문서의 구조·용어·규범표현 검토를 평가하는 최초 벤치마크 GB/T-Bench와 계층적 검토 분류체계를 제안.
- NeSy-RAG: Neuro-Symbolic RAG for Explainable Question Answering↗
Jonas Gann 외 1인 · 검색된 텍스트를 출처 추적 가능한 Prolog 모듈로 변환하고 지식 공백을 기호적으로 탐지하는 신경-기호 RAG 프레임워크 NeSy-RAG 제안.
- QuanTiMedAI: Quantum-Enhanced Time-Series Model guided by Agentic AI for Cardiac Arrest Mortality Prediction↗
Mutasim Fuad Sarker 외 5인 · 에이전트 LLM의 임상 특징 선택과 양자 순환망을 결합해 시계열로 심정지 환자 사망률을 예측하는 QuanTiMedAI 제안.
- The Bitter Lesson of Tool Calling↗
Ishan Patel 외 3인 · 14개 모델을 BFCL v4에서 비교해 도구를 파이썬 코드로 호출하는 방식이 JSON 도구 호출과 대등하거나 더 우수함을 보임.