2026-09-18 트렌드 위키
AI 에이전트·모델 압축·벤치마크 부상
오늘은 AI 에이전트 관련 도구와 하네스, 터미널 코딩 에이전트 등 개발 인프라가 집중 조명되었습니다. 동시에 Bonsai 2 27B 모델이 98.2% 성능을 유지하며 5.9GB로 압축되는 등 모델 경량화와 벤치마크 논의가 활발했습니다. 임베딩 측정, 로봇 조작, 확산 모델, PDE 대리 모델, 오프폴리시 강화학습 안정화 등 최신 연구 논문도 다수 등장했습니다.
오늘의 핵심
- AI 에이전트 개발 도구(Harness, 터미널 에이전트, AI 코딩)가 생태계 중심으로 부상함
- 모델 압축·성능 최적화와 벤치마크 평가가 긴밀히 연계됨
- 임베딩·기하·분포 변화 등 표현 학습 심층 분석이 이어짐
- 로봇 조작·확산 모델·강화학습 등 멀티모달·제어 연구가 활발함
트렌드 — 라이저 / 폴러
| 엔티티 | 오늘 | 최근7 | 직전7 | 추세 |
|---|---|---|---|---|
| AI 에이전트 | 7 | 32 | 24 | ▲ |
| 벤치마크 | 6 | 15 | 11 | ▲ |
| LLM | 3 | 23 | 13 | ▲ |
| AT | 3 | 14 | 19 | ▼ |
| 성능 최적화 | 3 | 8 | 11 | ▼ |
| 모델 추론 | 3 | 7 | 9 | ▼ |
| Question | 3 | 8 | 4 | ▲ |
| Simple | 3 | 7 | 7 | — |
| Geometry | 3 | 5 | 6 | ▼ |
| Distributional | 3 | 9 | 4 | ▲ |
| Components | 3 | 7 | 1 | ▲ |
| Fundamental | 3 | 3 | 0 | ▲ |
그래프 개요
성능 최적화와 벤치마크가 3회 공출현해 모델 평가 흐름을 주도하며, AI 에이전트가 AI 코딩·Harness·벤치마크와 각각 2회씩 함께 등장해 에이전트 중심 개발 파이프라인을 시사합니다. Components‑Shape, Geometry‑Shape, Distributional‑Estimating 쌍은 기하·분포 기반 표현 연구의 연관성을 보여줍니다.
오늘 같이 등장한 상위쌍(공출현):
| A | B | 공출현 |
|---|---|---|
| 성능 최적화 | 벤치마크 | 3 |
| AI 에이전트 | AI 코딩 | 2 |
| AI 에이전트 | Harness | 2 |
| AI 에이전트 | 벤치마크 | 2 |
| Components | Shape | 2 |
| Components | Distributional | 2 |
| Distributional | Estimating | 2 |
| Geometry | Shape | 2 |
| Real | 벤치마크 | 2 |
| Reconstruction | 벤치마크 | 2 |
| Simple | Finite | 2 |
| Actions | Manipulation | 1 |
| Actions | Conditioning | 1 |
| Actions | Supervision | 1 |
| Actions | VLM | 1 |
주목 관계
AI 에이전트는 MCP·LLM·Claude·Gemini 등 상위 개념의 하위 유형(is_a)이자 RAG·ML·MCP·Codex·터미널·Python·API·오픈소스·CLI·Cursor·클라우드·Windows·프롬프트 엔지니어링을 사용(uses)하는 중심 노드입니다. Harness는 AI 에이전트의 부분(part_of)으로, LLM은 에이전트의 구성 요소(part_of)로 위치합니다.
- MCP → AI 에이전트 (상위 개념)
- AI 에이전트 → LLM (상위 개념)
- AI 에이전트 → AI (상위 개념)
- Claude → AI 에이전트 (상위 개념)
- AI 에이전트 → RAG (사용/의존)
- AI 에이전트 → ML (사용/의존)
- AI 에이전트 → MCP (사용/의존)
- AI 에이전트 → Codex (사용/의존)
- Harness → AI 에이전트 (구성요소)
- AI 에이전트 → 터미널 (사용/의존)
- AI 에이전트 → Python (사용/의존)
- Gemini → AI 에이전트 (상위 개념)
- LLM → AI 에이전트 (구성요소)
- AI 에이전트 → API (사용/의존)
- AI 에이전트 → 오픈소스 (사용/의존)
- AI 에이전트 → CLI (사용/의존)
- Cursor → AI 에이전트 (사용/의존)
- AI 에이전트 → 클라우드 (사용/의존)
- AI 에이전트 → Windows (사용/의존)
- AI 에이전트 → 프롬프트 엔지니어링 (사용/의존)
기사 하이라이트
- Bonsai 2 27B 모델이 5.9GB로 압축되며 98.2% 성능 유지(성능 최적화·벤치마크)
- jcode: 수십 개 세션 병렬 실행 터미널 코딩 에이전트 공개(AI 에이전트·AI 코딩·Rust)
- Embedding Models Measure in Peculiar Ways: 임베딩 거리·정렬 특성 분석(임베딩·Study)
- Workspace Models: Saliency‑Driven Supervision으로 경량 로봇 메모리 구현(로봇·조작·Supervision)
- SplashSplat: 실세계 다중 뷰 비디오에서 액체 재구성(AT·Reconstruction)
- Score Centering으로 오프폴리시 강화학습 안정화(AT·RL·강화학습)
오늘의 기사
- x86 에뮬레이션의 골칫거리 — Arm
- LLM과 함께 글 쓰는 법 — LLM
- Show GN: 묻기 전에 먼저 움직이는 Slack AI 팀원 — Slack
- Show GN: 채널톡, intercom 에 지친 팀들을 위해,, 레닛(lenit)을 소개합니다. — SaaS
- Show GN: Booklog - 읽은 책과 마음에 남은 문장을 기록하고, 친구와 나누는 독서 기록장
- Show GN: SQLBraid - SQL을 그대로 쓰는 TypeScript 라이브러리 — SQL, Java, TypeScript
- 섹스, AI, 그리고 종말
- [스타트업을 피벗해야 할까? [동영상]](https://www.youtube.com/watch?v=yGqJrVvuyaM) — 스타트업
- Show GN: 커넥팅 - 로그인 없이 함께하는 모임 취향·케미 테스트
- [SpaceXAI가 한 달 만에 Grok Bot을 만든 방법 [동영상]](https://www.youtube.com/watch?v=maSdsTLaMuU) — Grok, AI 에이전트, RUNE-BOT
- Bonsai 2 27B, 성능 98.2%를 유지하며 모델 크기를 5.9GB로 압축 — Qwen3-3, 성능 최적화, 벤치마크
- jcode - 수십 개 세션을 병렬로 실행하는 터미널 코딩 에이전트 — 터미널, Rust, AI 에이전트, AI 코딩
- Show GN: Log Lens - JetBrains IDE에서 수 GB 로그를 그대로 여는 뷰어 (CP949/EUC-KR 지원) — Log, 에디터, Lens, JetBrains
- Astra for Law - 법률 업무용 AI — Astral, GPT, OpenAI
- 모두가 제정신을 잃었다
- 셀프스토리지라는 미국의 종교
- Jevlike - 문장 대신 선택지별 확률을 반환하는 Jev 방식의 오픈소스 모델 — 오픈소스
- 마틴 파울러: 나는 LLM이 마음에 들지 않는다 — LLM, 생산성
- Coding Agents with an Obstacle-Aware Harness for Safe Robot Manipulation — Robot, Controller, Manipulation, AI 에이전트, Harness
- Embedding Models Measure in Peculiar Ways — Distance, 임베딩, Study, Alignment, Measure
- Workspace Models: Lightweight Robotic Memory via Saliency-Driven Supervision — through, Actions, Manipulation, Conditioning, Supervision
- Can 4D Foundation Models Remember? — Reconstruction, Environment, Fundamental, Dynamic, Current
- SplashSplat: Reconstructing Splashing Liquids from Real-World Multi-View Videos — AT, Trace, Reconstruction, Appearance, View
- FAMOS: Feed-Forward 3D Articulation Modeling from Sparse Observations — 이미지 분할, Point, View, Geometry, Priors
- Paint-Anything: Unified Any-Color Control for Image Generation and Editing — Compact, Writing, Point, 디퓨전 모델, Bit
- ERCPMP-Gx: Endoscopic Image and Video Dataset for Morphological, Histopathological, and Genomic Characterization of Colorectal Polyposis — Cancer, AT, Early, Spectral, Support
- How Does Distribution Shift Shape Pretraining Gains in Neural PDE Surrogates? — Components, 물리학, Settings, Geometry, Shape
- Quantifying Overclaiming Propensity in Frontier LLM Agents — LLM, Completion, Frontier, AI 에이전트, Coverage
- Unifying Models of Intergroup Hostility in Online Discourse — Parallel, DRAW, Real, Modal, Science
- Score Centering Stabilizes Off-policy Reinforcement Learning — AT, RL, 강화학습, Drift, Training
- An Empirical Study of Harness Design for Coding Agents — Long-Horizon, Components, Study, AI 에이전트, Harness
- JEPA-Anything: Learning Predictive Models across Different Worlds — through, 임베딩, Support, Shared, Worlds
- Prediction-Powered Smoothing and Validation for Disaggregated AI Evaluation — Simple, AI 에이전트, 테스팅, Assessment, 성능 최적화
- Instance-Optimal Adaptive Location Estimation via Multiscale Mid-Summaries — Simple, Robot, Behavior, Noise, Question
- Robust Multi-Task Learning for Principal Component Analysis — Components, 취약점, Multiple, High-Dimensional, Fundamental
- Show GN: JD 기반 자기소개서 첨삭 Codex Skill — Codex
- Epidemiological Causal Graph Identification: Challenges, Identifiability and Algorithms — Causal, Noise, 머신러닝, Fundamental, 알고리즘
- TAP Accuracy Below the Fluctuation Scale and Universal Posterior Geometry in Spherical Linear Models — Simple, Spectral, Study, Geometry, Linear
- Show GN: CPGuard – SAST 취약점을 AI 에이전트가 동적으로 실증하는 오픈소스 (CPG taint + MCP) — MCP, 취약점, 보안, AI 에이전트, 오픈소스
태그
AI 에이전트 · 벤치마크 · LLM · AT · 성능 최적화 · 모델 추론 · Question · Simple · Geometry · Distributional · Components · Fundamental · Shape · Study · Measurements · 오픈소스 · AI 코딩 · IT · Training · Real · Harness · 취약점 · PACER · 임베딩 · Support · View · Reconstruction · Estimating · Manipulation · Robot · Individual · through · Finite · Shared · Spectral · Improve · Lightweight · Noise · Point · Domains