$ tree wiki/
위키
한국어로 번역된 218개 페이지입니다. 번역이 원문과 일치하는 문서만 여기 실립니다 — 나머지는 영어 위키에서 보실 수 있습니다.
논문 · 69
- 2028: Two Scenarios for Global AI Leadership — Anthropic
- Achieving Gold-Medal-Level Olympiad Reasoning via Simple and Unified Scaling
- 에이전트 데이터 주입 공격은 AI 에이전트에 대한 현실적 위협이다
- Agent Lightning v1.0: Towards Harnessed Agentic RL (arXiv:2608.17528)
- Agentic ESOpt: Fine-Tuning Long-Horizon LLM Agents with Minimal GPU Requirements (arXiv:2608.17310)
- Agentic Misalignment in Summer 2026
- AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses (arXiv:2608.12307)
- An OpenAI model has disproved a central conjecture in discrete geometry
- Apodex Discovery: Reality Benchmarks and Environments for Evaluating and Building Discoverative Artificial Intelligence (arXiv:2608.11341)
- AREX: Towards a Recursively Self-Improving Agent for Deep Research
- ASI-Bench: At the Dawn of Artificial Superintelligence (arXiv:2608.17271)
- ASPIRE: 로봇을 위한 에이전트 스킬 발견
- Automated Weak-to-Strong Researcher (AAR)
- BDH-CQ: In-Context Learning with Recurrent Latent Reasoning (arXiv:2608.09888)
- Beyond Final Scores: A Systematic Evaluation of Agents for Long-Horizon AI Research and Development (arXiv:2608.13417)
- ClawGym II: Exploring Black-Box RL on Agent Harness (arXiv:2608.16798)
- Co-RL: Unsupervised Reasoning Emerges from Diverse Cohort in Multi-agent RL (arXiv:2608.17253)
- Cook and Clean Together: Teaching Embodied Agents for Parallel Task Execution (GRANT)
- DarwinX: Evolving Agent Harnesses Through Natural Selection (arXiv:2608.07545)
- DataPrep-Bench: Benchmarking LLMs as Training Data Preparators
- Demystifying Agent Skills: Why They Work — Until They Don't (arXiv:2608.14036)
- DFM Mimir v1: An Open HRM Delivering Frontier Performance at 1B Parameters Using Only Permissible Post-Training Data (arXiv:2608.13517)
- Diffuse AI Control on Fuzzy Tasks
- ENPIRE: 실세계 에이전트 로봇 정책 자기개선
- FreeToken: Efficient Edge-Native MoE Serving with Bandwidth-Adaptive Execution (arXiv:2608.16157)
- Full-bandwidth transformer (arXiv:2608.08888)
- Generative design of bacteriophages with genome language models (Science, DOI 10.1126/science.aec2657)
- HarmProfile: Characterizing Harmful Distributions in Frontier LLMs (arXiv:2608.14577)
- Harness the Memory: A Holistic Evaluation of Memory Substrates in Memory Agents (arXiv:2608.15008)
- How Can Rhetoric Reward-Hack AI Reviewers? Dissecting Rhetorical Sensitivity in AI-Based Peer Review (arXiv:2608.08975)
- How Do Agents Fail on AutoResearch: End-to-End Diagnostic Evaluation on 100 Real-World Frontier Research Tasks (arXiv:2608.14905)
- Improving the matrix multiplication exponent with modern optimization and AlphaEvolve (arXiv:2608.16884)
- Intern-S2-Mobius: Foundation Model with Decoupled Knowledge and Reasoning (arXiv:2608.14290)
- Intern-S2-Preview: Scientific Agentic Foundation Model (arXiv:2608.13505)
- Knowing When to Quit: Diagnosing and Training LLMs to Abort Futile Reasoning (arXiv:2607.29211)
- LEGO-RL: Harness-Native Reinforcement Learning for Coding Agents (arXiv:2608.17393)
- LLMRouter: Unified Infrastructure for Developing, Evaluating, and Deploying LLM Routers (arXiv:2608.06867)
- Long-Horizon-Terminal-Bench (LHTB)
- Looped Language Models Improve Compositional Tool Calling (arXiv:2608.18171)
- Mechanist: AI as a Scientific Instrument for Discovering the Mechanisms of Intelligence (arXiv:2608.12036)
- Molt: A Scalable PyTorch-Native Training Framework for Agentic Reinforcement Learning
- More than two thirds of the zeros of the Riemann zeta function lie on the critical line
- OmniScientist: An Omni-Modal Omni-Discipline AI Scientist (arXiv:2608.13558)
- OpenAI Parameter Golf — What It Taught Us
- OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution (arXiv:2608.00677)
- Positive Alignment: Artificial Intelligence for Human Flourishing
- Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents
- R³-Bench: LLMs Struggle with Resource-Rational Reasoning under Shared Budgets (arXiv:2608.16033)
- Ring-Zero: 창발적 추론을 위한 Zero RL의 1조 매개변수 규모 확장
- Round-Trip Consistency: Bidirectional Diffusion Models Can Predict Their Own Rollout Errors (arXiv:2608.00675)
- 매개변수가 아닌 수평선을 확장: 35B 에이전트로 1조 매개변수 성능 달성
- SEED: 에이전트 강화학습을 위한 자기 진화 온폴리시 증류
- Self-Distilled Agentic Reinforcement Learning
- SemaPLC: A Project-Grounded, Verification-Gated Agent Harness for PLC Code Generation (arXiv:2608.18565)
- Shieldstral (arXiv:2607.25857)
- SimpleOPD: Simple Tokenizer-Agnostic On-Policy Distillation for Long-Context Reasoning (arXiv:2608.14277)
- Skill Self-Play: Pushing the Frontier of LLM Capability with Co-Evolving Skills
- SLEIGHT-Bench: Finding Blind Spots in AI Monitors
- Solipsistic Superintelligence is Unlikely to be Cooperative
- SPADE: Self-Play in Adaptive Synthetic Executable Environments (arXiv:2608.19197)
- Spatial Memory Agent: Experience-Grounded Procedure Memory for Spatial Intelligence (arXiv:2608.12743)
- StateM: Reaching 95.3% Raw Accuracy, or a $15 Frontier Run, on Terminal-Bench 2.1 via Harness Scaling (arXiv:2608.15089)
- Stealing Reasoning Traces from Proprietary LLM APIs (arXiv:2608.09867)
- The Mirage of Optimizing Training Policies: Monotonic Inference Policies as the Real Objective for LLM Reinforcement Learning
- Thought-Level Beam Search for Reasoning (arXiv:2608.08020)
- Training Leaves Traces: Centered Residual Signatures for Language Model Lineage Verification (arXiv:2608.14929)
- Ventor-QTest: Threat-Model-Driven Verification of Vendor-Hosted LLM APIs (arXiv:2608.16391)
- 직접 온폴리시 증류를 통한 약한 모델에서 강한 모델로의 일반화
- Zetta ζ: An Efficient Closed-Loop Embodied Harness for Self-Evolving Physical Intelligence (arXiv:2608.16590)
개념 · 27
- 에이전틱 강화학습
- 에이전트 (LLM Agents)
- AI 정렬 (Alignment)
- AI 통제 로드맵
- 수학을 위한 AI (AI for Mathematics)
- AI 거버넌스
- AI 기반 사이버 공격
- Claude Managed Agents
- Conceptual Reasoning Index (CRI)
- 콘텐츠 프로버넌스 (AI 출력 마킹)
- 체화 에이전트 (Embodied Agents)
- 평가 환경 격리
- 평가 하네스 설정
- 프런티어 속도 조절 (Frontier Pacing)
- Google ADK (Agent Development Kit)
- GRAM — Gradient-Routed Auxiliary Modules
- LLM 지식 베이스 (LLM 이 관리하는 개인 위키)
- MCP — Model Context Protocol
- 기계적 해석가능성
- 모델 라우팅 (Model Routing)
- 오픈 웨이트 정책 공방
- 사후 학습 스케일링
- Preparedness Framework
- 추론 모델
- 안전 모니터링과 데이터 보관
- Software 3.0
- 테스트 타임 연산 (추론 시점 연산 스케일링)
조직 · 21
모델 · 77
- AlphaEvolve
- Astra
- Claude Fable 5
- Claude Mythos Preview
- Claude Opus 4.7
- Claude Opus 4.8
- Claude Opus 5
- Claude Science
- Claude Sonnet 5
- Co-Scientist (Google DeepMind)
- Cosmos 3 Super
- Cosmos-H-Dreams
- Deep Research Max
- DeepSeek V4
- DeepSeek V4-Flash
- DeepSeek V4-Pro-0813
- Devstral 2
- DiffusionGemma
- Gemini 3.1 Deep Think
- Gemini 3.5 Flash
- Gemini 3.5 Flash Cyber
- Gemini 3.5 Flash-Lite
- Gemini 3.5 Pro
- Gemini 3.6 Flash
- Gemini 3.7 Flash
- Gemini 4
- Gemini Omni
- Gemini Robotics 2
- Gemini Robotics ER 1.6
- Gemini Robotics ER 2
- Gemini Spark
- Gemma 3n
- Gemma 4 12B
- GLM-5.2
- GLM-5.3
- GPT-5.5 Instant
- GPT-5.6 Sol (및 Terra, Luna)
- GPT-5.6-Cyber
- GPT-Live-1
- GPT-Realtime-2 (OpenAI)
- GPT-Rosalind
- Grok 4.1 Fast (xAI)
- Grok 4.5
- Grok 4.6
- Grok Build
- Grok Imagine Image 2.0
- Grok Imagine Video 1.5 (Preview)
- Grok V9-Medium
- Grok Voice Think Fast 2.0
- Inkling
- Kimi K3
- Laguna S 2.1
- Leanstral 1.5
- LFM2.5-2.6B
- LongCat-2.0
- Lyria 3.5
- MAI-Code-1 / MAI-Code-1-Flash
- MAI-Thinking-1
- MiniMax H3
- MiniMax M3
- MiniMax Music 3.0
- Mistral Large 3
- Mistral Medium 3.5
- Muse Glimmer
- Muse Image
- Muse Spark (1.0 / 1.1)
- Muse Spark 1.2
- Muse Video
- Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)
- Nemotron 3.5 Lightning
- Project Polaris
- Qwen 3.8 27B
- Qwen 3.8 Max
- Robostral Navigate
- Shieldstral 1.0
- SL2T
- WeatherNext Cyclones
인물 · 9
동향 · 15
- 2026년 7월 — 월간 다이제스트
- 월간 종합 — 2026년 6월
- 주간 종합 — 2026-W21 (2026-05-11 ~ 2026-05-17)
- 주간 종합 — 2026-W22 (2026-05-18 ~ 2026-05-24)
- 주간 종합 — 2026-W23 (2026-05-25 ~ 2026-05-31)
- 주간 종합 — 2026-W24 (2026-06-01 ~ 2026-06-07)
- 주간 종합 — 2026-W25 (2026-06-08 ~ 2026-06-21)
- 주간 종합 — 2026-W26 (2026-06-22 ~ 2026-06-28)
- 주간 종합 — 2026-W27 (2026-06-29 ~ 2026-07-05)
- 주간 종합 — 2026-W28 (2026-07-06 ~ 2026-07-12)
- 주간 종합 — 2026-W29 (2026-07-13 ~ 2026-07-19)
- 주간 종합 — W30 (2026년 7월 20~26일)
- 주간 종합 — W31 (2026년 7월 27일 – 8월 2일)
- 주간 종합 — W32 (2026-08-03 → 2026-08-09)
- 주간 종합 — W33 (2026-08-10 → 2026-08-16)