← 데일리 목록

AI TECHNOLOGY DAILY RESEARCH · KST

2026-08-03 AI 기술 데일리 리서치

Hugging Face Daily Papers · arXiv · RSS

오늘의 데일리 브리핑

오늘 연구 흐름은 긴 문맥·에이전트 작업을 겨냥한 대규모 모델부터 로봇 행동과 창작 작업을 더 가볍고 점검 가능하게 만드는 구조까지 넓게 퍼졌다. Kimi K3와 Frontis-MA1는 장기 추론·실행을, TurboVLA와 PAC-MAN은 실제 하드웨어 조건의 로봇 행동을 각각 다룬다. 제품·산업 소식에서는 EU의 AI 라벨링 규제 시행, OpenAI의 수학·이론컴퓨터과학 성과 발표, 크롬 브라우징 자동화 관련 보도가 함께 관측됐다. 새 발표들은 성능 수치만이 아니라 실행 비용, 관측 조건, 검증 가능한 중간 상태를 설계 변수로 다루고 있다.

Hugging Face 주요 논문

01

개방형 프런티어 지능을 겨냥한 Kimi K3

Kimi K3: Open Frontier Intelligence

저자: Kimi Team 외 401명

논문 개요

Kimi K3는 긴 문맥·시각·에이전트 작업을 한 모델에서 다루려는 대규모 MoE 모델이다. Delta Attention과 Attention Residuals로 길이와 깊이에 따른 정보 흐름을 개선하고, Stable LatentMoE로 토큰마다 일부 전문가를 활성화한다. 사후학습은 일반·에이전트·코딩 영역의 강화학습과 여러 추론 노력 수준을 포함한다. 논문은 장기 코딩·지식·추론·시각 평가에서의 결과를 보고하며 가중치를 공개한다.

흐름입력·과제→MoE·강화학습→장기 실행

원문 보기 ↗

02

AI를 만드는 과정을 개선하는 Frontis-MA1

Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering

저자: Junlin Yang 외 23명

논문 개요

Frontis-MA1는 머신러닝 엔지니어링을 재귀적 자기개선 연구의 실행 가능한 시험대로 삼는다. OpenMLE는 실행 피드백 환경, 연산자 학습, 장기 탐색을 묶은 공개 스택이며 모델은 Draft·Improve·Debug·Crossover 연산자를 학습한다. 이 연산자들을 장기 탐색에서 조합해 학습과 진화를 하나의 루프로 연결한다. 논문은 정해진 GPU·시간 예산의 벤치마크와 보류된 NatureBench Lite에서 전이 결과를 보고한다.

흐름과제 실행→Draft·개선·디버그→장기 탐색

원문 보기 ↗

03

가벼운 경로로 로봇 행동을 예측하는 TurboVLA

TurboVLA: Real-Time Vision-Language-Action Model at 32 Hz on an RTX 4090 with <1 GB VRAM

저자: Hengyi Xie 외 9명

논문 개요

TurboVLA는 시각을 거대 언어모델 표현 공간으로 옮기는 기존 V→L→A 경로의 비용을 줄이려 한다. 시각 관측과 언어 지시를 독립적으로 인코딩한 뒤, 경량 양방향 상호작용을 거쳐 연속 행동 청크를 직접 예측한다. 따라서 과제 조건의 표현을 시각·언어 특징에서 바로 구성한다. 논문은 LIBERO에서 더 큰 VLA 정책과 비교한 성공률·지연·메모리 결과를 제시한다.

흐름시각 관측·언어 지시→양방향 상호작용→행동 청크

원문 보기 ↗

04

캔버스를 작업 상태로 쓰는 창작 에이전트 하니스

JarvisHub: An Open Harness for Canvas-Native Multimodal Creative Agents

저자: Yunlong Lin 외 25명

논문 개요

JarvisHub는 단발 생성이 아닌 장기 멀티모달 제작에서 필요한 참조·초안·수정·피드백의 상태를 다룬다. 편집 가능한 캔버스를 사용자 작업공간이자 에이전트 외부 메모리·행동 공간·공유 상태로 정의한다. 산출물·의존성·버전·피드백은 타입이 있는 노드와 링크로 표현된다. 논문은 캔버스 상태, 프로토콜 브리지, 에이전트 런타임의 3계층으로 사용자의 점검·개입을 가능하게 한다.

흐름캔버스 상태→에이전트 도구 실행→생성·수정·정리

원문 보기 ↗

05

실행 코드로 물리 일관성을 잡는 VideoCoCo

VideoCoCo: Code-as-CoT for Physically-Consistent Video Generation via an Agentic Dual-Engine System

저자: Haodong Li 외 27명

논문 개요

VideoCoCo는 압축된 텍스트 프롬프트만으로 시간적 물리 변화를 추론하기 어려운 문제를 다룬다. 코딩 에이전트가 장면과 시간 전개를 명시한 Blender 프로그램을 만들고, 시뮬레이션 엔진이 결정론적 초안을 생성한다. 생성형 비디오 엔진은 이 초안을 조건으로 사실적 영상으로 편집한다. 논문은 draft-instruction-target 데이터셋으로 편집기를 적응시키고 두 벤치마크 결과를 제시한다.

흐름텍스트 프롬프트→Blender 코드·시뮬레이션→초안 조건 비디오

원문 보기 ↗

06

교육과정 구조를 평가하는 K12-KGraph

K12-KGraph: A Curriculum-Aligned Knowledge Graph for Benchmarking and Training Educational LLMs

저자: Hao Liang 외 7명

논문 개요

K12-KGraph는 시험 문제 답변만으로는 포착하기 어려운 교육과정 지식의 구조와 시각적 표현 이해를 평가한다. 공식 교과서에서 수학·물리·화학·생물의 선수관계, 개념 분류, 실험 연결 등을 그래프로 추출했다. 여기서 다중선택 평가와 그래프 안내 지도학습 데이터를 만들었다. 논문은 여러 모델의 정확일치 결과와 텍스트·멀티모달 감독의 비교 실험을 보고한다.

원문 보기 ↗

기타 Hugging Face 논문

07

이미지에서 편집 가능한 디자인 구조를 복원하는 ReDesign

ReDesign: Recovering Editable Design Structures from Images via Agentic Decomposition

저자: Jooyeol Yun 외 5명

논문 개요

ReDesign은 래스터 이미지에서 타이포그래피·벡터·색·그룹·레이어 순서를 복원해 편집 가능한 결과를 만들려 한다. 에이전트가 여러 전문 도구를 선택·조합하며 레이어 계층을 확장한다. 각 확장 단계의 graceful verification은 결과를 수용·제거·재시도해 오류 누적을 줄인다. 논문은 Figma Edit Replay Benchmark와 재구성 지표에서 편집성 결과를 비교한다.

흐름래스터 이미지→도구 선택·계층 확장→편집 가능한 구조

원문 보기 ↗

08

로봇 조작 데이터를 층위로 정리한 Data Pyramid

Data Pyramid for Embodied Manipulation

저자: Yifan Ye 외 28명

논문 개요

Data Pyramid는 관측·물리 상태·행동이 함께 필요한 로봇 데이터의 공급원을 체계적으로 정리한다. 실제 로봇, UMI 방식, 자아·외부 시점, 시뮬레이션, 일반 시각언어 데이터의 다섯 층을 확장성과 로봇 정합성의 긴장으로 설명한다. 이어 임바디드 파운데이션 모델의 데이터 조합과 지각·추론·계획·행동 능력의 관계를 검토한다. 논문은 촉각, 실패·회복, 수집 파이프라인, 행동 정렬 등을 미해결 과제로 제시한다.

원문 보기 ↗

새 arXiv 논문

09

이론물리 이중성을 추적하는 학습 모델

Learning to Trace Seiberg Dualities

저자: Jonathan J. Heckman 외 3명

논문 개요

이 논문은 초대칭 quiver gauge theory의 Seiberg duality 여부를 계산하는 문제에 머신러닝을 적용한다. quiver mutation을 추적하는 과제는 그래프를 풀어가는 학습 문제로 정식화된다. 약 10개 노드 규모에서 Transformer와 MLP가 결정론적 알고리즘을 앞서는 경향을 보고한다. 경로 탐색 알고리즘을 보완하면 탐색 효율과 정확도가 더 개선됐다고 서술한다.

원문 보기 ↗

10

하나의 토큰으로 긴 시각 문맥을 검색하는 ReToken

ReToken: One Token to Improve Vision-Language Models for Visual Retrieval

저자: Yao Xiao 외 5명

논문 개요

ReToken은 긴 시각 문맥에서 방해 요소가 늘고 전체 토큰 처리가 GPU 메모리를 압박하는 문제를 겨냥한다. 하나의 학습 가능한 임베딩을 명시적 검색 목표로 훈련해 미리 채운 visual KV cache에서 질의 관련 토큰을 희소하게 고른다. 작은 이미지 QA 데이터로 학습한 뒤 이미지·비디오 벤치마크로 전이한다. 논문은 Visual Haystacks와 LVBench에서의 개선과 단일 H100에서의 학습·추론 조건을 보고한다.

흐름긴 시각 KV cache→ReToken 검색→관련 토큰

원문 보기 ↗

11

휴머노이드 피구 회피를 위한 지각 인지 안전 제어

PAC-MAN: Perception-Aware CBF-RL for Whole-Body Safety in Humanoid Dodgeball

저자: Lizhi Yang 외 2명

논문 개요

PAC-MAN은 전신 휴머노이드 피구에서 제어장벽 기반 안전과 실제 탑재 센싱을 결합한다. 배치 정책은 머리 장착 카메라의 분할 마스크 깊이로 공을 보고, 학습 중에는 모든 신체 링크와의 여유를 나타내는 CBF 안내를 쓴다. 단일 투구와 복귀·회복을 포함한 루프로 평가해 관측 가능성에 따라 장벽 구조의 성능이 달라짐을 분석한다. 논문은 Unitree G1에서 경량 Link-CBF 정책의 zero-shot 실험 결과를 제시한다.

흐름머리 카메라 깊이→CBF-RL 회피 정책→전신 회피

원문 보기 ↗

뉴스

국내 · AI타임스 · 2026-08-02 19:40

EU, 8월부터 AI 챗봇·딥페이크 표기 의무화…'AI 라벨링' 규제 본격화

  • 요약 — 유럽연합(EU)의 AI 규제법(AI Act)에 따른 첫 소비자 대상 투명성 규제가 본격 시행되면서 기업들이 대응책 마련에 분주해졌다. 파이낸셜타임스(FT) 등에 따르면, EU의 규정에 따라 2일(현지시간)부터 유럽 내 기업들은 사용자가 AI 시스템과 상호작용할 때 이를 명확히 알리고, AI가 생성한 이미지, 오디오, 비디
  • 세부 — 제공 RSS 설명을 바탕으로 정리했으며, 원문 링크에서 전체 내용을 확인할 수 있습니다.
원문 보기 ↗

국내 · AI타임스 · 2026-08-02 18:54

월가를 흔든 20대 'AI 천재'의 몰락… 3조달러 대폭락 사태의 내막

  • 요약 — AI 업계에서 ‘천재 소년’이자 ‘AI 노스트라다무스’로 불리던 레오폴드 아셴브레너의 200억달러(약 28조9200억원) 규모 헤지펀드가 급격한 위기를 맞으며 월가와 실리콘밸리에 커다란 충격을 안겼다. 이는 지난달 전 세계 반도체 주식 시장의 폭락을 유발한 계기로 꼽혔다. 파이낸셜타임스(FT)는 31일 과도한 부채와 주가
  • 세부 — 제공 RSS 설명을 바탕으로 정리했으며, 원문 링크에서 전체 내용을 확인할 수 있습니다.
원문 보기 ↗

국내 · AI타임스 · 2026-08-02 17:20

아크릴 “GPUBASE로 GPU 활용률 90% 달성…소버린 AI 완성”

  • 요약 — “GPU를 확보하는 것만으로 AI 경쟁력이 자동으로 생기는 것은 아닙니다. 앞으로 더 중요한 문제는 확보한 GPU를 얼마나 효율적으로 운영하고, 안정적으로 활용할 수 있게 만드느냐입니다.”아크릴(대표 박외진)이 독자 개발한 GPU 클러스터 최적화 소프트웨어 ‘GPU베이스(GPUBASE)’를 앞세워 대규모 AI 인프라 시장
  • 세부 — 제공 RSS 설명을 바탕으로 정리했으며, 원문 링크에서 전체 내용을 확인할 수 있습니다.
원문 보기 ↗

해외 · OpenAI · 2026-08-01 09:00

Ten advances in mathematics and theoretical computer science

  • 요약 — OpenAI shares new results on long-standing open problems in mathematics and theoretical computer science, including advances in geometry, cryptography, and complexity.
  • 세부 — 제공 RSS 설명을 바탕으로 정리했으며, 원문 링크에서 전체 내용을 확인할 수 있습니다.
원문 보기 ↗

해외 · OpenAI · 2026-08-01 00:00

Advancing responsible AI across Europe

  • 요약 — OpenAI shares how its safety, security, transparency, and provenance practices support responsible AI governance in Europe. The work will continue as the EU AI Act advances.
  • 세부 — 제공 RSS 설명을 바탕으로 정리했으며, 원문 링크에서 전체 내용을 확인할 수 있습니다.
원문 보기 ↗

해외 · OpenAI · 2026-08-01 00:00

Building abundant intelligence

  • 요약 — A full-stack approach to making advanced AI more capable, more affordable, and more widely useful.
  • 세부 — 제공 RSS 설명을 바탕으로 정리했으며, 원문 링크에서 전체 내용을 확인할 수 있습니다.
원문 보기 ↗

해외 · OpenAI · 2026-07-31 16:00

Univé builds an AI-ready workforce

  • 요약 — See how Univé built an AI-ready workforce with ChatGPT Enterprise by combining leadership, responsible governance, and employee-led innovation to transform work at scale.
  • 세부 — 제공 RSS 설명을 바탕으로 정리했으며, 원문 링크에서 전체 내용을 확인할 수 있습니다.
원문 보기 ↗

블로그·HN · Simon Willison · 2026-08-01 08:13

Stateless MCP has recaptured my interest (and inspired mcp-explorer and datasette-mcp)

  • 요약 — Tuesday was Stateless MCP day - the rollout of MCP 2.0, or the 2026-07-28 Model Context Protocol specification to use the more formal but less memorable name. This is the most sign
  • 세부 — 제공 RSS 설명을 바탕으로 정리했으며, 원문 링크에서 전체 내용을 확인할 수 있습니다.
원문 보기 ↗

블로그·HN · The Gradient · 2026-02-19 08:25

After Orthogonality: Virtue-Ethical Agency and AI Alignment

  • 요약 — Preface This essay argues that rational people don&#x2019;t have goals, and that rational AIs shouldn&#x2019;t have goals. Human actions are rational not because we direct them at
  • 세부 — 제공 RSS 설명을 바탕으로 정리했으며, 원문 링크에서 전체 내용을 확인할 수 있습니다.
원문 보기 ↗

블로그·HN · Hacker News 100+ · 2026-08-03 05:44

EU Age Verification Project Mandates Hardware-Bound Attestation

  • 요약 — Article URL: https://linuxiac.com/eu-age-verification-project-mandates-hardware-bound-attestation/ Comments URL: https://news.ycombinator.com/item?id=49148128 Points: 106 # Comment
  • 세부 — 제공 RSS 설명을 바탕으로 정리했으며, 원문 링크에서 전체 내용을 확인할 수 있습니다.
원문 보기 ↗