비디오 — 전체 · 24장

러닝타임 대비 읽는 시간준비됨 · 스크립트와 Brief 완료

AI에게 몸을 만들어 주었습니다 — 사이러스 클라크, MIT 미디어 랩

원제 · I Gave an AI a Body — Cyrus Clarke, MIT Media Lab

20:482분 읽기

AI Engineer · 영어 · 2026. 09. 24.사진/예술 · 컴퓨터/소프트웨어

MIT 미디어 랩의 사이러스 클라크는 OpenClaw 에이전트를 셰이프 디스플레이에 연결하여 AI가 자체적인 바디 랭귀지와 감각적 반응 속도를 갖추는 '에스테틱 머신' 연구를 진행하고 있다.

준비됨

피지컬 AI의 다음 난제, 알맞은 비디오 데이터 찾기 — 라파엘 레비(Rafael Levi), Bright Data

원제 · Physical AI's Next Bottleneck Is Finding the Right Video — Rafael Levi, Bright Data

16:323분 읽기

AI Engineer · 영어 · 2026. 09. 24.경제 뉴스 · 컴퓨터/소프트웨어

피지컬 AI 및 로보틱스 개발의 병목인 데이터 부족 문제를 해결하기 위해, 11억 개 이상의 웹 동영상에서 동작 기반 타임스탬프 스니펫만 선별 수집하는 인덱싱 방식이 연산 자원과 대역폭 손실을 줄인다.

준비됨

VLM/VLA에서 구체화된 인공지능(Embodied Agent)으로 — 아르멘 아가자니안, Perceptron AI

원제 · From VLM/VLA's to Embodied Agents — Armen Aghajanyan, Perceptron AI

20:423분 읽기

AI Engineer · 영어 · 2026. 09. 23.컴퓨터/소프트웨어

퍼셉트론은 Data-Sparse MoE 및 조기 융합 구조 기반의 임바디드 파운데이션 모델을 통해 기존 VLA 대비 15배 저렴한 비용으로 시각 인지와 제어를 통합하며 원격 조작 데이터 의존도를 10분의 1로 절감한다.

준비됨

최고의 모델도 여전히 유아처럼 추론한다 — 앤드류 다이, 일로리안

원제 · The Best Models Still Reason Like Toddlers — Andrew Dai, Elorian

18:171분 읽기

AI Engineer · 영어 · 2026. 09. 23.

현재 최첨단 멀티모달 모델들은 공간 인지와 세부 추론 능력이 부족하여 환각 현상을 일으키므로, 이를 극복하기 위해 '시각적 생각의 사슬' 기반의 사고 능력을 갖춘 새로운 시각 추론 패러다임이 필요하다.

준비됨

데이터 수집부터 에이전트 구축까지: AI 팀이 문서 지능을 활용하는 방법 — Adit Abraham, Reducto

원제 · From Ingestion to Agents: How AI Teams Build on Document Intelligence — Adit Abraham, Reducto

22:293분 읽기

AI Engineer · 영어 · 2026. 09. 23.

비정형 문서 데이터 처리 과정에서 에이전트 기반 OCR과 오케스트레이션을 활용하면 복잡한 파이프라인의 정확도와 효율성을 높일 수 있습니다.

준비됨

숏폼 비디오에서의 모달리티 불일치 및 독창성 귀속 — 아디티야 가우탐, Meta

원제 · Modality Misalignment and Originality Attribution in Short-Form Video — Aditya Gautam, Meta

21:324분 읽기

AI Engineer · 영어 · 2026. 09. 23.컴퓨터/소프트웨어 · AI/미래기술

1억 건 이상의 대규모 숏폼 비디오 생태계에서 모달리티 불일치와 비독창적 콘텐츠 문제를 해결하려면 소형 VLM 기반의 멀티 에이전트 시스템과 적응형 프레임 압축, DPO 기반 지속적 학습 파이프라인을 통합 구축해야 한다.

준비됨

실력 부족(Skill issue): 비전 언어 모델을 직접 배포하지 말고 Skills로 활용하세요 — Merve Noyan, Hugging Face

원제 · Skill issue: stop deploying vision language models, use them with Skills — Merve Noyan, Hugging Face

19:143분 읽기

AI Engineer · 영어 · 2026. 09. 23.창업/스타트업 · 컴퓨터/소프트웨어

실시간 처리가 어려운 비전 언어 모델(VLM)을 직접 배포하는 대신, VLM을 의사 라벨러 및 평가자로 활용해 소형 경량 모델인 RF-DETR을 약 3~4달러의 비용으로 훈련시켜 배포하는 것이 효율적이다.

준비됨

가중치 폴딩, CUDA 스트림, 그리고 모델을 거꾸로 말하게 만든 버그 — 필립 마크라둘리(Filip Makraduli)

원제 · Weight Folding, CUDA Streams, and the Bug That Made My Model Speak Backwards — Filip Makraduli

17:182분 읽기

AI Engineer · 영어 · 2026. 09. 19.컴퓨터/소프트웨어 · AI/미래기술

단 두 줄의 대수적 트릭과 Weightless Normalization 및 Deferred Normalization 기법을 적용하면 RMS Norm 연산 비용을 절감하고 트랜스포머 아키텍처의 성능을 향상시킬 수 있다.

준비됨

에이전트를 위한 프론티어 AI 인퍼런스 클라우드 — 전병곤 (Gon Chun), 프렌들리AI

원제 · The Frontier AI Inference Cloud for Agents — Byung-Gon (Gon) Chun, FriendliAI

14:593분 읽기

AI Engineer · 영어 · 2026. 09. 19.창업/스타트업 · 컴퓨터/소프트웨어

에이전트 워크플로우에 최적화된 프런티어 AI 추론 클라우드는 접두사 캐싱과 전용 엔드포인트 설계를 통해 오픈 웨이트 모델의 비용 효율성과 속도를 극대화한다.

준비됨

25:072분 읽기

AI Engineer · 영어 · 2026. 09. 19.창업/스타트업 · 컴퓨터/소프트웨어

오픈 소스 소형 모델을 대규모로 자체 서빙할 때 중앙 집중식 큐와 바이너리 메시지팩 포맷을 도입하면 상향식 라우팅의 병목을 해소하고 처리량을 두 배로 높일 수 있다.

준비됨

추론 엔지니어링의 새로운 기능 — 필립 키엘리, Baseten

원제 · What's New in Inference Engineering — Philip Kiely, Baseten

19:093분 읽기

AI Engineer · 영어 · 2026. 09. 19.컴퓨터/소프트웨어 · AI/미래기술

데이터 센터 환경의 추론 엔지니어링은 단순 모델 압축을 넘어 STILL 기반 KV 압축과 dFlash 등 확산형 추측 디코딩 기법을 통해 속도와 효율성을 끌어올린다.

준비됨

버티컬 모빌리티: MVP에서 조 단위 파라미터 워크로드까지의 추론 — Sitanshu Gupta, CoreWeave

원제 · Vertical Mobility: Inference from MVP to Trillion-Parameter Workloads — Sitanshu Gupta, CoreWeave

15:223분 읽기

AI Engineer · 영어 · 2026. 09. 19.컴퓨터/소프트웨어 · AI/미래기술

CoreWeave는 KV 캐시 인지 라우팅, NVFP4 양자화, 맞춤형 추측적 디코딩을 결합한 단일 플랫폼 구조로 에이전트 및 대규모 워크로드의 추론 비용과 지연 시간을 최적화합니다.

준비됨

LLM 성능 벤치마크는 신뢰할 수 있는가? — 아쇼크 찬드라세카르 & 제이슨 크람버거, Google

원제 · Are LLM Performance Benchmarks Reliable? — Ashok Chandrasekar & Jason Kramberger, Google

16:072분 읽기

AI Engineer · 영어 · 2026. 09. 19.컴퓨터/소프트웨어 · AI/미래기술

LLM 벤치마크 결과의 신뢰성을 확보하려면 서버 스택뿐만 아니라 파이썬 GIL 제한과 지연 시간 부풀림 현상을 유발하는 벤치마크 하네스 자체의 한계를 철저히 통제해야 한다.

준비됨

프로덕션 환경에서의 LLM 추론 라우팅: 엔진 시그널부터 정책까지 — Qianru Lao & Lu Zhang, OpenAI

원제 · Routing LLM Inference in Production: From Engine Signals to Policy — Qianru Lao & Lu Zhang, OpenAI

18:124분 읽기

AI Engineer · 영어 · 2026. 09. 19.컴퓨터/소프트웨어 · AI/미래기술

OpenAI는 과부하 시 KV 캐시 효율을 저해하던 초기 피드백 루프 라우팅의 한계를 극복하기 위해, 비동기 제어 평면에서 네트워크 거리와 엔진 지연 시간을 통합 최적화하는 글로벌 라우팅 정책 아키텍처로 전환했다.

준비됨

AI 클러스터를 위한 TCP의 종말 — 존 우스터하우트, 스탠퍼드 대학교

원제 · The End of TCP for AI Clusters — John Ousterhout, Stanford

18:483분 읽기

AI Engineer · 영어 · 2026. 09. 17.컴퓨터/소프트웨어 · AI/미래기술

에이전틱 AI 추론 환경에서는 기존 TCP/RDMA 대신 수신자 중심 혼잡 제어와 SRPT 스케줄링을 적용한 메시지 기반 호마(HOMA) 프로토콜을 사용해야 테일 지연 시간을 100마이크로초 미만으로 줄이고 GPU 유휴 시간을 방지한다.

준비됨

2022년도 아닌데 아직도 청킹을 그렇게 하세요? — 유발 벨퍼, AI21 Labs

원제 · Stop Chunking Like It's 2022 — Yuval Belfer, AI21 Labs

18:013분 읽기

AI Engineer · 영어 · 2026. 09. 16.컴퓨터/소프트웨어 · AI/미래기술

매일 1퍼센트의 미세한 개선과 정체성 변화를 담은 시스템 구축이 일 년 뒤 37배의 성장을 만든다.

준비됨

AI Engineer · 영어 · 2026. 09. 16.창업/스타트업 · 컴퓨터/소프트웨어

의지력에 기대지 않고 소파 위에 책을 펼쳐두거나 스마트폰 화면을 흑백으로 설정하는 등의 환경 설계를 통해 독서량과 집중력을 높일 수 있다.

준비됨

수십억 개의 법률 문서를 AI에 연결하기 — Simon Eskildsen(turbopuffer) & Jacob Lauritzen(Legora)

원제 · Connect AI to Billions of Legal Documents — Simon Eskildsen, turbopuffer & Jacob Lauritzen, Legora

20:361분 읽기

AI Engineer · 영어 · 2026. 09. 16.

작은 습관을 꾸준히 실천하고 시스템을 구축하는 것이 장기적인 성공과 성장의 핵심이다.

준비됨

여러분의 합의서는 쿼리할 수 없는 데이터베이스입니다 — 히랄 샤(DocuSign) & 숀 소다(NVIDIA)

원제 · Your Agreements Are a Database You Can't Query — Hiral Shah, Docusign & Sean Sodha, NVIDIA

18:221분 읽기

AI Engineer · 영어 · 2026. 09. 16.경영/리더십 · 컴퓨터/소프트웨어

스마트폰을 손이 닿지 않는 곳에 두고 알림을 차단하는 작은 습관의 변화가 화면 시청 시간을 줄이고 일상의 여유를 만든다.

준비됨

지식 노동을 시키고 싶다면, 지식 에이전트로 설계하라 — Benjamin Clavié, Mixedbread

원제 · If we want them to do Knowledge Work, design them as Knowledge Agents — Benjamin Clavié, Mixedbread

17:551분 읽기

AI Engineer · 영어 · 2026. 09. 16.경영/리더십 · 컴퓨터/소프트웨어

의지력에만 의존하지 않고 객관적인 자기 직시와 환경 설계를 바탕으로 하루 1퍼센트의 작은 실천과 충분한 쉼을 병행하는 것이 지속적인 성장을 만든다.

준비됨

에이전트를 위한 웹 재구축 — 리아드 요세프, MCP 앱

원제 · Rebuilding the web for agents — Liad Yosef, MCP Apps

20:412분 읽기

AI Engineer · 영어 · 2026. 09. 16.컴퓨터/소프트웨어 · AI/미래기술

의지력에만 의존하는 대신 알림 끄기, 화면 흑백 설정, 물리적 거리 두기 같은 환경 설정을 통해 스마트폰 사용을 통제해야 한다.

준비됨

에이전틱 웹을 위한 검색 엔진 — 윌 브릭, Exa

원제 · The Search Engine for the Agentic Web — Will Bryk, Exa

17:491분 읽기

AI Engineer · 영어 · 2026. 09. 16.

애플의 M 시리즈 커스텀 SoC는 CPU, GPU, NPU를 통합하여 뛰어난 전력 효율과 발열 제어 능력을 보여준다.

준비됨

에이전틱 검색에서 BM25의 터무니없이 강력한 효과 — 조 크리스티안 베르굼(Jo Kristian Bergum), Hornet.dev

원제 · The unreasonable effectiveness of BM25 for agentic search — Jo Kristian Bergum, Hornet.dev

18:291분 읽기

AI Engineer · 영어 · 2026. 09. 16.컴퓨터/소프트웨어 · AI/미래기술

작은 습관과 철저한 일정 관리에서 시작되는 지속적인 실행은 미래의 거대한 변화를 만든다.

준비됨

24장로딩 중...