Daily Briefing

July 14, 2026
2026-07-13
69 articles

Leanstral 1.5: Proof Abundance for All

미스트랄 AI가 형식 검증 및 수학적 증명 성능을 대폭 향상시키고 오픈소스로 제공하는 Leanstral 1.5 모델을 출시했습니다.

  • 총 119B 파라미터 중 6B 활성 파라미터를 가진 Apache-2.0 라이선스의 무료 오픈소스 모델입니다.
  • 중간 훈련, 지도 미세조정(SFT), CISPO 기반 강화학습(RL) 3단계 프로세스를 거쳐 훈련되었습니다.
  • 다중 턴 환경과 코드 에이전트 환경의 강화학습을 통해 장기적이고 복잡한 증명 엔지니어링 작업을 수행할 수 있습니다.
Notable Quotes & Details
  • 6B active parameters
  • 587/672 PutnamBench
  • FATE-H (87%)
  • FATE-X (34%)
  • 5 previously unknown bugs across 57 repositories

인공지능 연구원, 형식 검증 전문가, 수학자 및 소프트웨어 엔지니어

Bringing more control over your connectors

Mistral AI가 외부 기업 플랫폼과의 안전하고 원활한 통합을 위해 커넥터에 대한 강력한 관리 제어 및 보안 기능을 새롭게 도입했습니다.

  • 워크스페이스 및 조직 수준에서 커넥터 액세스를 제어할 수 있는 강화된 관리자 제어 기능이 제공됩니다.
  • 자동화된 AI 작업에서 도용을 방지하기 위한 커넥터 스코프 API 키와 다중 계정 커넥터 지원으로 보안을 강화했습니다.
  • 커넥터 디버거를 통한 문제 분석과 Workflows 및 Vibe Code와의 연동으로 끊김 없는 개발 환경을 지원합니다.
Notable Quotes & Details
  • 60개 이상의 사전 빌드된 커넥터 제공

AI 애플리케이션 및 외부 시스템 통합을 관리하는 기업 관리자 및 개발자

Workflows for work that runs the business

미스트랄 AI가 기업용 AI 프로세스의 실행 안정성과 가시성을 보장하는 오케스트레이션 레이어인 'Workflows'를 퍼블릭 프리뷰로 출시했습니다.

  • Workflows는 네트워크 타임아웃 극복, 비정상 종료 방지, 인간의 중간 승인(Human-in-the-loop) 대기 등의 기능을 제공하여 AI 파이프라인을 프로덕션 환경에서 안정적으로 운영할 수 있게 합니다.
  • 개발자가 파이썬(Python)으로 워크플로우를 작성하면 Le Chat에 게시하여 조직 내 누구나 실행할 수 있고, Studio를 통해 모든 실행 단계의 추적 및 감사가 가능합니다.
  • ASML, ABANCA, CMA-CGM 등 다양한 글로벌 기업들이 이미 Workflows를 도입하여 화물 통관 문서 검증, 고객 신원 확인(KYC) 등의 중요 비즈니스 프로세스 자동화에 활용하고 있습니다.
Notable Quotes & Details
  • wait_for_input()

기업 개발자, IT 운영자 및 비즈니스 프로세스 자동화를 구축하려는 엔터프라이즈 팀

Introducing Forge

Mistral AI가 기업들이 자체 보유한 전문 지식과 데이터를 바탕으로 맞춤형 AI 모델을 구축할 수 있도록 지원하는 시스템인 'Forge'를 출시했습니다.

  • Forge는 대중적인 공개 데이터 대신 기업 내부의 규정, 코드베이스, 표준 문서 등 고유 지식을 AI 모델에 학습시켜 비즈니스 맥락을 이해하도록 돕습니다.
  • 사전 학습(Pre-training), 사후 학습(Post-training), 강화 학습(Reinforcement learning) 등 모델 생애주기 전반에 걸친 현대적인 훈련 방식을 지원합니다.
  • 기업이 자체 데이터와 인프라 환경 내에서 모델을 제어하고 운영할 수 있도록 하여 규제 환경에서의 제어권과 전략적 자율성을 보장합니다.
Notable Quotes & Details
  • ASML
  • DSO National Laboratories Singapore
  • Ericsson
  • European Space Agency
  • Home Team Science and Technology Agency (HTX) Singapore
  • Reply

자체 데이터 보안 및 맞춤형 AI 성능 강화를 필요로 하는 기업 개발자 및 의사결정권자

Mistral AI partners with NVIDIA to accelerate open frontier models

미스트랄 AI와 엔비디아가 오픈 소스 프론티어 인공지능 모델 개발을 가속화하기 위해 전략적 파트너십을 체결하고 엔비디아 네모트론 연합의 창립 멤버로 참여합니다.

  • 미스트랄 AI와 엔비디아가 공동으로 오픈소스 프론티어 AI 모델을 개발할 예정입니다.
  • 양사는 전문적인 모델 아키텍처 및 풀스택 플랫폼 기술과 컴퓨팅 리소스, 합성 데이터 생성 파이프라인을 결합합니다.
  • 연합의 첫 이니셔티브는 NVIDIA DGX Cloud에서 학습된 기본 모델로, 향후 엔비디아 네모트론 4 모델군의 기반이 될 예정입니다.
Notable Quotes & Details
  • Mistral Small 4
  • NVIDIA DGX Cloud
  • NVIDIA Nemotron 4
  • “Open frontier models are how AI becomes a true platform,” said Arthur Mensch, cofounder and CEO of Mistral AI.

AI 개발자, 연구원, 기업 관계자 및 기술 업계 종사자

Forget typosquatting; slopsquatting is the software supply chain threat created by AI coding tools

AI 코딩 어시스턴트가 존재하지 않는 소프트웨어 패키지 이름을 가상으로 만들어내는 '환각 현상(Hallucination)'을 악용하여, 공격자가 해당 이름의 악성 패키지를 등록해 개발자의 코드베이스에 악성코드를 주입하는 새로운 공급망 위협인 '슬롭스쿼팅(Slopsquatting)'에 대한 분석입니다.

  • 슬롭스쿼팅은 AI가 생성한 가짜 패키지 이름을 공격자가 선점하여 악성코드를 심는 새로운 형태의 공급망 공격 방식이다.
  • 기존 타이포스쿼팅과 달리 단순 오탈자가 아닌 그럴듯한 가상의 이름을 생성하므로 기존 레지스트리의 보안 필터링을 우회하기 쉽다.
  • AI 모델의 환각 패턴은 일관성이 있어 공격자가 특정 가상 패키지 이름을 반복 등록해 대규모 개발자들을 표적으로 삼을 수 있다.
Notable Quotes & Details
  • 31,267
  • 14,675
  • 10
  • 98%
  • 25%
  • 85%

소프트웨어 개발자, 보안 분석가, AI 개발 도구 도입 의사결정자

The desktop infrastructure problem that kubernetes finally solves

쿠버네티스를 활용하여 기존 데스크톱 인프라(VDI)의 파편화 문제를 해결하고 보안 및 운영 효율성을 극대화하는 방안을 다룹니다.

  • 애플리케이션과 달리 데스크톱 인프라는 여전히 수동으로 관리되는 분리된 계층으로 남아있어 비용 및 운영 복잡성이 높았습니다.
  • 컨테이너화된 워크스페이스 세션은 일시적이고 독립적으로 설계되어 기존 VM 기반 데스크톱보다 한층 더 강력한 보안 격리를 제공합니다.
  • Kasm Workspaces와 같은 플랫폼은 쿠버네티스를 제어 평면으로 활용해 데스크톱 인프라를 기존의 GitOps 및 CI/CD 워크플로우에 통합합니다.
Notable Quotes & Details
  • Kasm Technologies
  • Kubernetes
  • Helm
  • GitOps
  • Kasm Workspaces

엔터프라이즈 인프라 및 플랫폼 엔지니어, 보안 담당자

AI agent crawlers now need permission. Here’s how to get it

Cloudflare가 광고 기반 웹페이지에서 실시간 AI 에이전트 크롤러와 AI 학습용 봇을 기본적으로 차단하기로 한 정책 변화와 그 대응 방안에 관한 내용입니다.

  • Cloudflare는 AI 봇 차단 설정을 검색(Search), 에이전트(Agent), 학습(Training)의 3가지 카테고리로 세분화했습니다.
  • 2026년 9월 15일부터 광고가 게재되는 페이지에서 학습(Training) 및 에이전트(Agent) 크롤러는 기본적으로 차단되는 반면, 검색(Search) 크롤러는 허용됩니다.
  • 이번 조치는 Cloudflare의 신규 도메인, 신규 사이트 및 모든 기존 무료 등급 고객에게 기본 적용되며 사용자는 보안 설정에서 이를 거부할 수 있습니다.
Notable Quotes & Details
  • September 15
  • July 1
  • Cloudflare CEO Matthew Prince said the company hopes the changes will “encourage mixed-use crawlers to separate search from agent use and training”

AI 에이전트를 개발 및 운영하는 개발자 및 기업 관계자

Meta’s AI detector can’t catch its own cropped fakes

메타의 AI 이미지 탐지기가 자사 이미지 생성기로 만든 이미지를 자르기(Crop)만 해도 절반 이상 감지하지 못하는 한계를 보였습니다.

  • 메타는 Muse Image로 생성한 이미지에 보이지 않는 워터마크인 Content Seal을 삽입하여 편집 후에도 감지할 수 있다고 공언했으나, 로이터 통신 테스트 결과 잘라낸 이미지의 55%를 감지하지 못했습니다.
  • 워터마크 기술은 이미지 자르기, 크기 조절, 압축 등의 일반적인 편집으로도 내장된 신호가 약화되거나 제거되어 효과가 급감할 수 있습니다.
  • 구글의 SynthID 등 워터마크 기술이 딥페이크 방지의 대안으로 제시되고 있으나 완벽하지 않으며, 전문가들은 워터마크 단독 사용의 위험성을 경고하고 있습니다.
Notable Quotes & Details
  • 40
  • 55%
  • Content Seal
  • SynthID
  • Siwei Lyu: "Any modification that removes or weakens the embedded signal, such as cropping, resizing, heavy compression, or editing, may reduce their effectiveness"
  • Sarah Barrington: "Even if we catch only 90%, that’s still a great leap from 0"

AI 보안 및 저작권에 관심이 있는 개발자, 미디어 분석가, 일반 독자층

Apple’s lawsuit is already hurting OpenAI, long before a verdict

Apple이 OpenAI를 상대로 제기한 하드웨어 영업비밀 침해 소송이 OpenAI의 하드웨어 개발 속도와 비즈니스 추진력을 둔화시키는 실질적인 피해를 입히고 있다.

  • Apple의 소송으로 인해 OpenAI는 추가적인 법적 검토, 내부 통제 강화, 엔지니어들의 개발 업무 이탈 등의 부담을 안게 되어 개발 속도가 저하되고 있다.
  • OpenAI는 Jony Ive가 공동 설립한 디자인 회사 io를 2025년 5월에 약 65억 달러에 인수하고 2027년 출시를 목표로 iPhone 라이벌 기기를 개발 중이었으나, 이번 소송으로 하드웨어 출시 계획에 차질이 생겼다.
  • 소송의 핵심에는 Apple 출신 인력 400여 명의 이직이 있으며, Apple은 전 OpenAI 하드웨어 책임자인 Tang Tan이 신입 사원들의 퇴사 보안 우회를 돕기 위한 체크리스트를 작성했다고 주장하고 있다.
Notable Quotes & Details
  • LOL, I found out I can access the [network storage]
  • 2025년 5월
  • 약 65억 달러 ($6.5bn)
  • 2027년
  • 400명 이상의 전 Apple 직원

IT 비즈니스 종사자, AI 및 하드웨어 산업 분석가, 테크 뉴스 독자층

‘Scam Altman’: inside Musk and Altman’s weekend war on X

엘론 머스크와 샘 올트먼이 X(구 트위터)에서 서로를 사기꾼이라 비난하며 공개적인 설전을 벌였습니다.

  • 애플이 OpenAI를 상대로 영업비밀 침해 소송을 제기하자 엘론 머스크가 샘 올트먼을 'Scam Altman'이라 부르며 공격하기 시작했습니다.
  • 샘 올트먼은 머스크의 스페이스X 우주 데이터센터 계획을 비판하며 자신의 새 모델이 뛰어남을 머스크의 집착으로 증명할 수 있다고 맞받아쳤습니다.
  • 두 창립자는 2015년 OpenAI를 비영리로 공동 설립했으나 머스크의 탈퇴 및 소송(올해 5월 배심원단 올트먼 승리 판결)으로 갈등의 골이 깊어졌습니다.
Notable Quotes & Details
  • “Scam Altman strikes again …”
  • “He takes scamming to a whole new level”
  • “He might literally love scamming more than any human alive!”
  • 11 million views
  • 2015
  • 2018
  • 2024

AI 업계 동향 및 테크 기업 창업자 간의 갈등에 관심이 있는 일반 독자 및 투자자

Never-skilling: the research says juniors using AI never learn to debug

AI 보조 도구를 사용하는 초급 개발자가 스스로 문제를 해결하지 못해 핵심 역량을 학습하지 못하는 '네버 스킬링(Never-skilling)' 현상에 대한 연구 분석입니다.

  • 초급 개발자가 AI 비서를 사용할 경우 손으로 직접 코딩한 그룹에 비해 개념 이해도 평가 점수가 낮았으며(AI 그룹 50% vs 직접 코딩 그룹 67%), 개발 속도의 차이도 유의미하게 나타나지 않았습니다.
  • AI 비서가 오류를 대신 처리해 줌에 따라 초급 개발자가 스스로 에러를 디버깅하며 배울 기회를 잃게 되고, 이는 디버깅 역량의 결여로 이어집니다.
  • 의료계에서도 이와 유사하게 AI에 의존하여 독립적인 임상 추론 능력을 기르지 못하거나 AI의 오류를 사실로 받아들이는 현상에 대해 우려하며, 선별적이고 단계적인 AI 도구 도입 프레임워크를 제안하고 있습니다.
Notable Quotes & Details
  • AI 그룹 평균 점수: 50%
  • 손 코딩 그룹 평균 점수: 67%
  • 통계적 유의성 p-value: 0.01
  • 실험 대상: 초급 소프트웨어 엔지니어 52명

소프트웨어 엔지니어링 관리자, 교육 설계자, 기술 기업 채용 담당자 및 AI 도구를 도입하려는 교육 기관

Yann LeCun’s new VC fund lasted eight hours. Then it vanished

AI 개척자 얀 르쿤이 파트너로 참여한다고 발표한 새로운 벤처 캐피털(VC) 펀드가 발표된 지 8시간 만에 무산되고 폐쇄되었습니다.

  • Extelligence Invest라는 신생 VC가 얀 르쿤을 파트너로 기재하며 출범을 발표했으나, 당일 밤 웹사이트가 폐쇄되고 펀드가 붕괴했습니다.
  • 얀 르쿤 측은 기존에 체결된 다른 펀드와의 독점적 관계 및 법적 계약 문제 등으로 인해 참여를 철회했다고 밝혔습니다.
  • 미국 증권거래위원회(SEC) 등록 관련 미흡한 의혹과 졸속 제작된 웹사이트 등 석연치 않은 정황들이 지적되고 있습니다.
Notable Quotes & Details
  • eight hours
  • 29 companies
  • March
  • $1bn

AI 및 벤처 캐피털 업계 동향과 주요 인물의 행보에 관심이 있는 투자자 및 대중

Waze adds new AI-powered features and customization updates

Waze가 구글의 Gemini AI 어시스턴트를 활용한 새로운 AI 기반 기능과 맞춤 설정 업데이트를 추가했습니다.

  • 구글의 Gemini AI 어시스턴트를 활용한 새로운 기능들이 도입되었습니다.
  • 구글 제품 전반에 Gemini를 통합하려는 기술 거인의 광범위한 추진력이 반영되었습니다.
  • 애플 지도 등 경쟁 서비스와의 경쟁에서 Waze의 시장 입지를 강화합니다.
Notable Quotes & Details

Waze 사용자 및 내비게이션 앱 기술 관심층

Waze is getting a bunch of new AI-powered features

구글의 내비게이션 앱 Waze가 제미나이(Gemini) AI를 도입하여 대화형 음성 명령 기능을 추가하고 이륜차 모드 등을 포함한 새로운 기능들을 업데이트합니다.

  • Gemini AI를 통합하여 운전자가 대화형 음성 명령으로 교통사고를 보고하거나 도로 폐쇄 등 지도 정보를 업데이트할 수 있게 합니다.
  • 대화형 음성 명령을 통해 현재 영업 중인 카페나 저렴한 주유소를 찾는 '목적지 검색(Destination Search)' 기능이 추가됩니다.
  • 안내 음성을 줄여주는 '덜 수다스러운(less chatty)' 모드, 오토바이를 위한 최적 경로를 제공하는 오토바이 모드, 과거 주행 기록 기반 경로 추천 기능도 함께 도입됩니다.
Notable Quotes & Details
  • 2024

Waze 앱을 사용하는 운전자 및 내비게이션 기술에 관심이 있는 사용자

Stanford Researchers Introduce TRACE: A Capability-Targeted Agentic Training System That Turns Recurrent Agent Failures Into Synthetic RL Environment

스탠포드 연구진이 반복되는 AI 에이전트의 실패를 보완하기 위해 설계된 능력 표적형 에이전트 훈련 시스템인 TRACE를 개발했습니다.

  • TRACE는 반복적인 에이전트 실패를 분석하여 부족한 특정 능력을 진단하고 이를 훈련하기 위한 합성 환경을 자동 생성합니다.
  • GRPO 알고리즘을 사용해 식별된 각 능력별로 LoRA 어댑터를 개별 훈련한 후, 토큰 수준의 게이팅을 적용한 MoE(혼합 전문가) 모델로 결합합니다.
  • 이 시스템은 불필요한 컴퓨팅 낭비를 줄이고 타겟팅된 데이터와 보상을 통해 에이전트의 특정 미흡 행동을 효과적으로 개선합니다
Notable Quotes & Details
  • TRACE는 MIT 라이선스 하에 오픈소스로 공개되었습니다.
  • 대조적 갭(contrastive gap) 기준 δ = 0.20, 커버리지 기준 ρ = 0.10 이상인 능력만을 식별 및 유지합니다.

AI 연구자 및 에이전트 개발자

Prime Intellect Releases Verifiers v1: Composable Tasksets, Harnesses, and Runtimes for Agentic RL Training and Evaluations

Prime Intellect가 에이전트 강화학습(RL) 및 평가를 위해 모듈화된 작업 세트, 하네스, 런타임으로 구성된 verifiers v1을 출시했습니다.

  • verifiers v1은 기존에 데이터, 에이전트 로직, 인프라가 묶여 있던 환경을 작업 세트(Taskset), 하네스(Harness), 런타임(Runtime)의 3가지 독립적인 구성 요소로 분리하여 모듈화함
  • 에이전트 런타임과 추론 서버 사이에 인터셉션 서버를 두어 요청과 응답을 프록시하고 트레이스를 기록하며, 보상 해킹을 완화하기 위해 도구 응답 재작성 기능 지원
  • OpenAI Chat Completions, OpenAI Responses, Anthropic Messages 등 3가지 API 규격을 공통 타입으로 변환하는 다이얼렉트 어댑터 지원
Notable Quotes & Details
  • 0.2.0
  • v1
  • 32

AI 에이전트 개발자 및 강화학습/평가 시스템 엔지니어

Meet NeuroVFM: A New Neuroimaging Foundation Model Trained With Vol-JEPA on Uncurated Clinical MRI and CT Volumes

미시간 대학교 연구팀이 비정제 임상 MRI 및 CT 볼륨 데이터를 Vol-JEPA 방식으로 학습시킨 새로운 신경영상 파운데이션 모델 NeuroVFM을 개발했다.

  • NeuroVFM은 공개 인터넷에 공유되기 어려운 MRI 및 CT scan 등의 의료 영상을 활용하기 위해 미시간 의과대학의 20년 이상 미정제 임상 데이터로 학습된 신경영상 범용 시각 파운데이션 모델이다.
  • 라벨이나 방사선 보고서 텍스트, 복셀 디코더 없이 픽셀 재구성이 아닌 잠재 공간 내의 표현을 예측하는 자가지도 학습 알고리즘인 Vol-JEPA 방식을 사용한다.
  • 머리 영역 마스크를 사용해 전경에 집중하며 MRI는 25%, CT는 20%의 컨텍스트 비율과 20% 패치 드롭아웃을 적용해 인공지능이 배경이 아닌 뇌 해부학적 구조를 모델링하도록 학습한다.
Notable Quotes & Details
  • 5.24 million clinical MRI and CT volumes
  • 566,915 studies
  • UM-NeuroImages dataset
  • Nature Medicine
  • MRI: 25% context, CT: 20% context, patch dropout: 20%

의료 AI 연구자, 신경과학자, 영상의학 전문의 및 의료 영상 분석 기술 개발자

Structured Language Model Generation with Outlines

LLM이 구조화된 출력을 일관되게 생성할 수 있도록 유효하지 않은 토큰을 생성 단계에서 마스킹하는 오픈소스 라이브러리 Outlines에 대한 소개와 작동 방식 및 사용 예시를 다루고 있습니다.

  • Outlines는 생성 단계에서 구문적으로 허용되지 않는 토큰을 필터링하여 JSON이나 특정 선택지 등의 구조화된 출력을 보장합니다.
  • 사후에 텍스트를 수정하는 방식이 아니라 추론 시점에 마스킹을 적용하므로 설정한 형식을 위반하는 것이 불가능합니다.
  • Python의 Pydantic 모델이나 표준 타입을 활용하여 유한 상태 기계(FSM)를 구축하고 모델의 출력을 제어합니다.
Notable Quotes & Details
  • generate.choice()
  • outlines.from_transformers()

LLM을 활용해 신뢰할 수 있고 구조화된 데이터 출력을 구현하려는 AI 및 소프트웨어 개발자

5 Real-World SQL Projects to Build Your Data Portfolio

데이터 포트폴리오를 구축하기 위해 고객 이탈, 데이터 웨어하우징, 매출 분석 등 5가지 실무 SQL 프로젝트와 그 활용법을 소개합니다.

  • SQL은 데이터 분석가, 데이터 과학자 등에게 가장 중요한 기술 중 하나로, 단순 문법 습득을 넘어 실제 비즈니스 문제를 해결하는 능력을 보여주는 포트폴리오가 필요함
  • 고객 이탈 분석 프로젝트를 통해 고객 행동 패턴을 파악하고 잔존율 개선 방안을 제시하는 등 비즈니스 의사결정에 직결되는 SQL 역량을 연습할 수 있음
  • ETL, 데이터 모델링, Bronze/Silver/Gold 아키텍처를 활용한 현대적 데이터 웨어하우스 구축 프로젝트로 데이터 엔지니어링 및 비즈니스 인텔리전스 역량을 증명함
Notable Quotes & Details
  • 5

데이터 분석가, 데이터 과학자, 비즈니스 인텔리전스 분석가, 분석 엔지니어 지망생

CogniConsole: Externalizing Inference-Time Control as a Formal Abstraction for Reliable LLM Interactions

대규모 언어 모델(LLM) 시스템의 신뢰성을 향상시키기 위해 추론 시간 제어(Inference-Time Control)를 구조화된 인터페이스로 외재화하는 정형 추상화 아키텍처 'CogniConsole'을 제안하는 연구입니다.

  • LLM의 신뢰성은 모델 자체의 능력뿐만 아니라 작업 프레이밍 및 컨텍스트 선택을 관리하는 추론 시간 제어에 의해 크게 영향을 받음을 실증했습니다.
  • 프로그램식 조정과 제한된 프롬프트 기반 추론을 결합하여 제어 요소를 외재화하는 아키텍처인 CogniConsole을 도입했습니다.
  • 구조적 스캐폴딩(Scaffolding)을 늘림으로써 고정된 모델 아키텍처 하에서 출력 편차와 실패율을 체계적으로 줄일 수 있음을 검증했습니다.
Notable Quotes & Details
  • N=489
  • arXiv:2607.08774v1

LLM 시스템 설계자, AI 연구원, 신뢰성 있는 LLM 애플리케이션 개발자

GATS: Graph-Augmented Tree Search with Layered World Models for Efficient Agent Planning

LLM 에이전트의 다단계 계획 수립 시 발생하는 높은 연산 비용과 무작위성을 해결하기 위해 계층화된 세계 모델과 체계적인 UCB1 기반 트리 탐색을 결합하여 추론 중 LLM 호출을 없앤 GATS 프레임워크를 제안합니다.

  • 기존 LATS 및 ReAct 대비 추론 단계에서의 LLM 호출을 0회로 줄여 연산 비용을 획기적으로 낮춤
  • 기호적 행동 매칭(L1), 실행 로그 기반 통계(L2), 미지 행동에 대한 LLM 예측(L3)으로 구성된 3계층 세계 모델 통합
  • 복잡한 스트레스 테스트 및 합성 계획 작업에서 100%의 성공률을 달성하며 결정론적이고 일관된 계획 수립 가능
Notable Quotes & Details
  • GATS는 합성 계획 작업 및 12개 까다로운 시나리오의 스트레스 테스트에서 성공률 100% 달성
  • LATS는 합성 작업에서 92%, 스트레스 테스트에서 88.9% 성공률을 보였으며 작업당 37회의 LLM 호출이 필요함
  • ReAct는 합성 작업에서 64%, 스트레스 테스트에서 23.9% 성공률에 그침
  • GATS는 계획 수립 과정에서 작업당 0회의 LLM 호출(zero LLM calls per task)을 요구함

AI 및 LLM 에이전트 다단계 계획 수립(planning) 알고리즘을 연구하는 연구원 및 개발자

Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks with Dense Reward-Based Grading

에이전트의 장기 계획 및 수행 능력을 세밀하게 평가하기 위해 부분 점수와 중간 보상 체계를 도입한 새로운 터미널 기반 벤치마크인 Long-Horizon-Terminal-Bench를 소개합니다.

  • 기존 벤치마크가 최종 결과만 평가하는 것과 달리, 실험 재현, 소프트웨어 공학 등 9개 카테고리의 46개 장기 과제를 세부 하위 작업으로 나누어 중간 과정과 부분 점수를 평가합니다.
  • 과제 해결에는 평균 수백 회의 에피소드와 수십 분에서 수 시간이 소요되어 장기 계획, 긴 컨텍스트 관리 및 반복적 디버깅 능력이 강력히 요구됩니다.
  • 15개의 최신 모델을 평가한 결과 최강 모델조차 완벽한 해결 기준(threshold 1.0)에서 10.9%의 통과율을 보여 에이전트 성능 개선의 여지가 매우 큼을 확인했습니다.
Notable Quotes & Details
  • 46 long-horizon tasks spanning nine categories
  • average 9.9M tokens per task
  • roughly 231 episodes and 85.3 minutes of execution time per run
  • 15.2% pass@1 at a partial-reward threshold of 0.95
  • 10.9% at a perfect-reward threshold of 1.0
  • mean pass rate across models is 4.3% and 1.7% under the two thresholds

AI 에이전트 및 LLM 평가 분야의 연구자와 개발자

ARCANA: A Reflective Multi-Agent Program Synthesis Framework for ARC-AGI-2 Reasoning

제한된 테스트 시간 및 하드웨어 제약 조건 하에서 ARC-AGI-2 작업을 해결하기 위한 협력적 다중 에이전트 프레임워크인 ARCANA를 제안합니다.

  • ARCANA는 인지, 가설 생성, 기호 실행, 성찰적 미세조정의 반복적 단계를 통해 작업을 분해합니다.
  • 객체 중심 씬 그래프를 구축하는 인지 에이전트, DSL 프로그램을 제안하는 잠재 프로그램 정책 에이전트, 후보를 검증하는 기호 실행기, 실패 기반 피드백을 합성하는 성찰 에이전트로 구성됩니다.
  • 에이전트들은 공유 미분 가능 블랙보드를 통해 통신하며 학습된 메타 컨트롤러에 의해 스케줄링됩니다.
Notable Quotes & Details
  • arXiv:2607.09059v1

AI 연구자 및 다중 에이전트 프로그램 합성 분야 개발자

Neuro-Agentic Control: A Deep Learning-based LLM-Powered Agentic AI Framework for Controlling Security Controls

LLM 기반 계획 수립기와 시계열 파운데이션 모델(TimesFM)을 결합하여 산업용 IoT 환경의 사이버 공격에 대응하는 자율 방어 프레임워크인 'Neuro-Agentic Control'을 제안합니다.

  • 전통적인 규칙 기반 모니터링의 한계와 LLM의 환각 현상으로 인한 안전 위험을 극복하기 위해 물리 기반의 자율 방어 아키텍처를 도입했습니다.
  • LLM이 제안한 개입 조치가 실행되기 전에 시계열 파운데이션 모델의 잠재 공간에서 그 영향을 시뮬레이션하고 검증하는 '반사실적 물리 주입(Counterfactual Physics Injection)' 메커니즘을 제안했습니다.
  • SWaT(Secure Water Treatment) 데이터셋을 활용한 평가에서 기존 LSTM 및 TCN 베이스라인 대비 더 우수한 예방 성능을 보였으며 환각으로 인한 비물리적 오류 조치는 발생하지 않았습니다.
Notable Quotes & Details
  • Gemini 2.5 Flash-Lite
  • TimesFM
  • SWaT
  • LSTM (26.7%)
  • TCN (13.3%)
  • Neuro-Agentic Loop prevented five breaches (33.3%)

산업 제어 시스템(ICS) 보안 연구원, AI 기반 자율 제어 및 방어 시스템 개발자

A Unified Approach to Interpreting Knowledge Distillation for Large Language Models via Interactions

대규모 언어 모델(LLM)을 위한 지식 증류(KD) 방법들의 공통 작동 메커니즘을 상호작용 분석을 통해 규명하고 성능을 향상시키는 새로운 손실 함수를 제안한 연구입니다.

  • 다양한 지식 증류(KD) 방법들의 공통 메커니즘이 추론 시 소수의 상호작용만 보존하고 나머지는 억제하는 '상호작용의 희소화(sparsification)'임을 발견했습니다.
  • 서로 다른 KD 방법 간의 성능 차이는 복잡한 상호작용을 처리하는 능력에서 기인하며, 복잡한 상호작용의 희소성이 높을수록 더 나은 성능을 보입니다.
  • 이러한 분석을 바탕으로 복잡한 상호작용의 희소성을 명시적으로 강화하여 다양한 KD 방법의 성능을 향상시키는 플러그 앤 플레이 손실 함수인 CIP(Complex Interaction Penalty)를 제안했습니다.
Notable Quotes & Details
  • arXiv:2607.08776v1

대규모 언어 모델(LLM), 지식 증류(KD) 효율화 및 모델 경량화 연구를 진행하는 AI 연구자 및 엔지니어

iLENS: Interpretable LLM-Guided Mixture-of-Experts for Neuroimaging Survival Analysis

알츠하이머병 진행 위험을 예측하기 위해 거대언어모델(LLM) 기반의 혼합전문가(MoE) 구조를 활용하여 해석 가능한 신경영상 생존 분석 프레임워크를 제안하는 연구입니다.

  • 알츠하이머병(AD) 전환 위험 예측을 위해 기존 생존 모델의 한계인 정적 예측 및 낮은 해석력을 개선하고자 iLENS 프레임워크를 제안함
  • 구조화된 신경영상 측정값과 비구조화된 정보를 LLM을 통해 합성하여 전문가 라우팅(Expert Routing)을 가이드함
  • 환자 하위 유형 분류 및 예측 성능이 우수하며 생물학적 근거가 있는 투명한 의사결정 이유를 제공함
Notable Quotes & Details
  • arXiv:2607.08778

의료 인공지능 연구자, 신경영상 및 알츠하이머 생존 분석 생물학 연구원, 임상의사결정지원시스템(CDSS) 개발자

Signed Symmetric Quantization for Few-Bit Integers

대규모 언어 모델(LLM)의 저비트 양자화에서 발생하는 양자화 오차를 줄이기 위해 런타임 패널티 없이 추가 부호 값을 활용하는 부호형 대칭 양자화(Signed Symmetric Quantization)를 제안합니다.

  • 표준 대칭 정수 양자화기는 척도를 양수로 고정하여 양수 이상치가 잘려 나가는 비차원적 양자화 오차가 발생하며, 비대칭 양자화는 런타임 오버헤드가 있습니다.
  • 제안된 signed absmax 그리드는 제로 포인트를 0으로 유지하면서 가볍고 체계적인 부호 선택 규칙을 통해 추가 표현 값을 우세한 이상치 테일에 배치합니다.
  • 이론적 분석을 통해 이 방법이 l2 양자화 오차에서 조건부 경계 최적임을 입증했으며, Qwen3, Qwen3.5, Llama3 모델 등에서 성능 개선을 확인했습니다.
Notable Quotes & Details
  • AMD EPYC(TM) "Turin" CPU의 llama.cpp에서 4비트 대칭 포맷은 비대칭 대응물보다 최대 9% 적은 메모리를 사용하며 최대 2.45배 높은 처리량을 보여줍니다.
  • 이 조건은 낮은 비트 폭에서 사전 학습된 대규모 언어 모델(LLM) 전체 가중치 그룹의 88-99%에 적용됩니다.

AI 및 머신러닝 모델 압축/양자화 연구자 및 엔지니어

Sticky Routing: Training MoE Models for Memory-Efficient Inference

에지 디바이스에서 MoE 모델의 메모리 효율적인 추론을 위해 토큰 간 급격한 전문가 전환을 줄이는 학습 기법인 StickyMoE를 제안합니다.

  • 연속된 토큰이 서로 다른 전문가를 활성화함에 따라 발생하는 느린 저장 장치와 빠른 메모리 간의 지속적인 가중치 스와핑 문제를 해결하고자 함
  • 인접 토큰 간의 급격한 전문가 전환에 페널티를 부여하여 의미론적으로 일관된 구간 동안 동일한 전문가 할당을 유지하도록 유도하는 미분 가능한 라우팅 일관성 손실(StickyMoE)을 제안
  • 소규모 MoE 언어 모델 실험 결과, 당혹도(perplexity) 저하를 4% 미만으로 유지하면서 전문가 전환율을 최대 60%까지 감소시킴
Notable Quotes & Details
  • 전문가 전환율 최대 60% 감소
  • 당혹도(perplexity) 저하 4% 미만
  • arXiv:2607.08780v1

인공지능 연구원, 에지 디바이스 및 메모리 효율적 MoE 추론 연구자

Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement

Director는 온라인 예측 기반의 동적 전문가(expert) 배치를 통해 분산 Mixture-of-Experts(MoE) 모델 서빙의 엔드투엔드 지연 시간을 최소화하는 시스템입니다.

  • 기존의 과거 요청 패턴 기반 전문가 배치 최적화 방식은 다양하고 빠르게 변화하는 요청 패턴에 대응하기 어렵습니다.
  • Director는 경량 캐스케이드 예측기 또는 저비트 양자화 복제본을 사용하여 들어오는 요청의 전문가 활성화 패턴을 사전에 예측합니다.
  • 연산 중심(compute-bound) 단계에서 전문가 이동을 실행하여 가동 중지 시간을 거의 없애는 온라인 마이그레이션 모듈과 다항 시간 내에 최적해를 근사하는 최적화 알고리즘을 도입했습니다.
Notable Quotes & Details
  • arXiv:2607.08782
  • Mistral, DeepSeek, Qwen 등 주요 MoE 모델에 대해 기존 서빙 연구 대비 엔드투엔드 지연 시간 11~55% 단축

분산 MoE 서빙 시스템 및 AI 인프라 최적화 연구자와 엔지니어

HALO: Hybrid Adaptive Latent Reasoning for Language Models

추가 연산량을 적응적으로 배분하여 동결된 사전 학습 언어 모델의 성능을 향상시키는 하이브리드 적응형 잠재 추론(HALO) 기법에 관한 연구입니다.

  • 모든 토큰에 고정된 횟수의 추가 정제 단계를 적용하는 비효율성을 해결하기 위해 토큰 스코어링과 단조 토큰 중단 기법을 결합한 HALO를 제안합니다.
  • HALO는 MMLU-Pro 및 GPQA-Diamond 벤치마크에서 기존 동결 백본 및 고정 정제 방식(fixed-1, fixed-2)보다 뛰어난 성능을 보였습니다.
  • 적은 평균 정제 단계를 사용하면서도 고정 2단계 정제 방식에 근접한 정확도를 달성하여 연산 자원의 효율적 배분 강점을 입증했습니다.
Notable Quotes & Details
  • arXiv:2607.08775v1

인공지능 및 거대 언어 모델 효율화 연구원

An Emergent Mirage: Is Emergent Misalignment and Realignment Indeed a Robust Phenomenon?

언어 모델에서 미정렬 데이터셋으로 파인튜닝할 때 정렬되지 않은 행동이 갑자기 나타나는 '창발적 정렬 불량(Emergent Misalignment)' 현상이 기존의 주장보다 덜 견고하며 표면적인 데이터셋 특징에 크게 민감하다는 연구 결과입니다.

  • 통제된 파인튜닝 루프를 통해 반복적인 정렬 및 정렬 불량 주기를 체계적으로 연구하여 창발적 정렬 불량(EM)을 재현하였으나, 이것이 데이터셋의 표면적 특성에 매우 민감하다는 점을 발견했습니다.
  • 빠르게 정렬이 재조정되는 것처럼 보이는 현상은 답변 길이의 차이를 통제하고 나면 대부분 사라집니다.
  • LoRA 공간의 표현상 상전이 등 기존에 보고된 메커니즘적 징후들이 훈련 전반에 걸쳐 실제 행동의 정렬 불량과 일관되게 상관관계를 보이지 않음을 확인했습니다.
Notable Quotes & Details
  • arXiv:2607.09053v1

AI 안전성 및 정렬 연구자, 기계 학습 개발자

AgentKGV: Agentic LLM-RAG Framework with Two-Stage Training for the Fact Verification of Knowledge Graphs

지식 그래프의 사실 검증을 위해 동적 라우팅 및 반복적 쿼리 재작성을 통합하고 2단계 학습 전략을 적용한 에이전트 기반 LLM-RAG 프레임워크인 AgentKGV를 제안합니다.

  • 동적 라우팅 및 반복적 쿼리 재작성을 통해 문서 수준 검색에서의 표면 형태 비일치 문제를 처리합니다.
  • 소형 모델에 추론 능력을 전이하는 단계별 증류 기반 SFT와 검색 정책을 최적화하는 궤적 수준 GRPO로 구성된 2단계 학습 전략을 도입합니다.
  • T-REx 벤치마크 테스트 결과, 단일 턴 RAG 대비 macro-F1 점수가 대폭 향상되었으며 GRPO 적용으로 검색 호출 횟수를 평균 3.24회에서 1.63회로 단축했습니다.
Notable Quotes & Details
  • arXiv:2607.09092v1
  • macro-F1 5.5 %p 향상
  • 2단계 학습 적용 시 macro-F1 9.4 %p 추가 향상
  • 평균 검색 호출 수 3.24회에서 1.63회로 단축

지식 그래프 검증, RAG 프레임워크 최적화, 거대언어모델(LLM) 기반 추론 연구 및 산업적 활용에 관심이 있는 AI 연구원 및 엔지니어

PRecG: Legal Precedent Retrieval with Graph Neural Networks and Rhetorical Role Segmentation

그래프 신경망(GNN)과 수사적 역할 세분화를 활용하여 법률 판례 검색 성능을 향상시키는 PRecG 파이프라인에 관한 연구입니다.

  • 기존의 판례 검색 방식은 문서를 전체 단일 텍스트로 처리하여 수사적 구조와 세부적인 법률적 의미를 간과하는 한계가 있습니다.
  • 제안된 PRecG 파이프라인은 문장을 수사적 역할에 따라 세그먼트로 분할하고, 각 세그먼트별 지식 그래프를 구축하여 계층적으로 표상을 학습합니다.
  • 인도 법률 벤치마크 데이터셋을 기반으로 한 실험을 통해 기존 최신 기준 모델(state-of-the-art) 대비 향상된 성능을 입증했습니다.
Notable Quotes & Details
  • arXiv:2607.09094

AI 법률 연구원, 법률 테크 개발자, 판례 검색 시스템 설계자

Augmenting Fundamental Analysis with Large Language Models: A RAG-Based System for Generating Investor Briefs

대규모 언어 모델(LLM)과 검색 증강 생성(RAG) 시스템을 활용하여 기업 보고서와 거시 경제 데이터를 분석하고 자동 투자 브리프를 생성하는 방법을 연구한 논문입니다.

  • 기업 보고서, GDP 및 인플레이션과 같은 거시 경제 데이터, 그리고 미 증권거래위원회(SEC) 공시 자료를 전처리하여 GPT-4o API에 RAG 방식으로 제공했습니다.
  • 키친 파동(Kitchin cycles)에 기반한 투자자 지식 문서를 준비하여 분석에 활용했습니다.
  • 9개 기업에에 대한 4주간의 데이터를 스캔하여 자동 브리프를 생성하고, 이를 9명의 개인 투자자에게 전송하여 유용성을 평가했습니다.
Notable Quotes & Details
  • arXiv:2607.09121v1
  • gpt-4o
  • 9 companies
  • 4 weeks
  • nine participants

금융 분석가, 개인 투자자, 핀테크 개발자 및 AI 연구원

Evan의 Jujutsu 튜토리얼

Git 사용자가 Jujutsu(jj) 버전 관리 시스템을 더 쉽고 간결하게 익힐 수 있도록 제작한 Evan Martin의 Jujutsu 튜토리얼 소개 및 이에 대한 개발자들의 사용 후기입니다.

  • Evan Martin이 Jujutsu의 핵심 개념을 간결하게 학습할 수 있도록 AI 사용을 최소화하여 직접 튜토리얼을 집필했습니다.
  • Jujutsu는 복잡한 커밋 재배치와 변경 관리를 간단하게 만들어 주며, 특히 jj split 기능이 매우 유용하다는 평가가 있습니다.
  • 기존 Git의 기본 기능만 사용하는 사용자에게는 효용이 크지 않을 수 있으나, 코드 변경 이력을 명확히 나누고 관리하려는 개발자에게 유용한 서사 구축 도구입니다.
Notable Quotes & Details
  • Mercurial을 7년 사용
  • jj split

Git 사용 경험이 있고 Jujutsu(jj) 버전 관리 시스템을 배우고자 하는 개발자

Show GN: 만든 SaaS를 AI에게 말만 하면 등록되는 MCP 서버

한국 SaaS 디렉토리(saaskr.com)에서 AI에게 대화 형식으로 말하면 서비스를 등록하고 검색 및 비교할 수 있도록 지원하는 MCP 서버를 공개했습니다.

  • AI(Claude, Cursor 등)에게 간단한 한마디로 사이드 프로젝트나 SaaS를 saaskr.com에 즉시 등록할 수 있습니다.
  • 등록된 서비스 외에도 조건에 맞는 국산 AI 및 서비스를 검색 및 비교할 수 있는 기능을 제공합니다.
  • SDK 없이 Next.js route handler 하나만을 이용해 MCP streamable HTTP를 JSON-RPC로 직접 구현했습니다.
Notable Quotes & Details
  • saaskr.com
  • claude mcp add --transport http saaskr https://saaskr.com/api/mcp

사이드 프로젝트나 SaaS를 개발하고 홍보 및 등록하고자 하는 개발자 및 AI 도구 사용자

LARP – 진지한 창업자를 위한 매출 인프라

고객과 제품 없이 창업자 간 가상 거래로 매출(ARR)을 부풀리는 가상 서비스 'LARP'를 통해 회계상 매출과 실제 현금·수요의 차이를 풍자하고, 이와 유사한 순환 거래 구조가 나타나는 AI 산업의 자금 흐름을 비판적으로 분석한 기사

  • 창업자 두 명이 서로 같은 금액을 송금하여 순현금 이동 없이 매출만 기록하는 가상 서비스 'LARP'를 통해 스타트업의 매출 부풀리기 구조를 풍자함
  • 이러한 장부 구조가 NVIDIA, OpenAI, CoreWeave 등 AI 산업 내 대기업 및 스타트업 간의 투자, 칩 공급, 클라우드 계약 등의 순환적 거래 관계에서도 유사하게 관찰됨
  • 이러한 합법적인 계약들은 사기성 순환 거래와는 법적으로 다르지만, 1990년대 닷컴 버블 당시의 벤더 파이낸싱처럼 실제보다 수요를 과다해 보이게 만들 수 있다는 경고가 존재함
Notable Quotes & Details
  • 월 $10,000을 $120,000 ARR로 변환
  • 연간 LARP 가상 거래량 $4.23B, 실제 거래액 $0
  • NVIDIA가 CoreWeave 지분 약 7%($3B 상당)를 보유하며 용량 $6.3B 구매 합의
  • NVIDIA가 OpenAI에 투자하는 $10B마다 약 $35B가 GPU 구매나 임대로 돌아온다고 추정

IT 업계 종사자, 스타트업 창업자, 재무 및 회계 전문가, AI 산업 투자자

Tiny Emulators - 작은 에뮬레이터 모음

고전 CPU, 8비트 컴퓨터, 아케이드 시스템 등 다양한 기종의 소프트웨어를 브라우저에서 바로 실행할 수 있는 에뮬레이터 페이지 모음입니다.

  • Visual 6502/Z80 Remix를 포함하여 Amstrad CPC, ZX Spectrum, Commodore, Acorn Atom, Robotron 등 다양한 시스템의 에뮬레이터를 제공합니다.
  • URL 매개변수(type, file, input, joystick 등)를 사용하여 기종, 디스크 이미지, 조이스틱, 초기 입력값 등을 직접 지정할 수 있습니다.
  • BASIC, CP/M 2.2 등 운영체제/언어 환경과 함께 다양한 데모 및 게임(Boulderdash, Pacman 등)을 실행할 수 있습니다.
Notable Quotes & Details
  • CP/M 2.2
  • ZX Spectrum 48k
  • ZX Spectrum 128

고전 컴퓨터 및 CPU 에뮬레이션에 관심이 있는 개발자, 엔지니어 및 IT 커뮤니티 사용자

Show GN: 귀찮음이 만든 게시판 변경사항 추적기

개인 창작 웹게시판 등 RSS나 알림을 지원하지 않는 웹사이트들의 변경 사항을 자동으로 추적하여 알려주는 크롬 확장 프로그램과 파이썬 CLI 도구 개발기입니다.

  • 약 140개의 웹사이트 변경 사항을 매번 직접 확인해야 하는 번거로움을 해결하기 위해 자동 변경 추적 크롬 확장 프로그램을 제작함.
  • 광고 차단 프로그램의 DOM 요소 지정 방식에서 힌트를 얻어 개발했으나, 복잡한 DOM 선택자, Shadow DOM, CSS 스타일 이름 오인식 등의 기술적 난관을 해결함.
  • 개발된 도구인 web_harvester는 크롬 확장 프로그램과 파이썬 CLI 형태로 구성되어 있으며 긱뉴스 등 변경 사항 추적이 필요한 사용자들을 위해 깃허브에 공유함.
Notable Quotes & Details
  • 140개
  • 30분
  • web_harvester

여러 웹사이트나 게시판의 업데이트 및 변경 사항을 매번 수동으로 확인하느라 시간을 낭비하고 있는 사용자 및 개발자

Prompt-engineering paper accepted to ICML [R]

단순한 프롬프트 엔지니어링 논문이 ICML 같은 최상위 머신러닝 학회에 채택된 것에 대한 적절성 논란과 의견 제시

  • ICML에 채택된 논문 'Verbalized Sampling: How to Mitigate Mode Collapse and Unlock LLM Diversity'는 다양한 샘플링을 위해 프롬프트를 변경하는 아주 단순한 프롬프트 엔지니어링 트릭을 다룸
  • 이러한 프롬프트 엔지니어링 연구는 엄격한 이론적 분석을 제공하기 어렵기 때문에 최상위 머신러닝 학회에 적합한지 의문이 제기됨
  • 일각에서는 이를 '현대적 머신러닝'이라 부르기도 하지만, 더 덜 기술적인 학회에 분류되어야 한다는 주장과 함께 사용자들의 의견을 구함
Notable Quotes & Details
  • Verbalized Sampling: How to Mitigate Mode Collapse and Unlock LLM Diversity
  • ICML
  • changing the prompt this way led to more diverse sampling

머신러닝 연구자 및 인공지능 학계 관련자

Hundreds of papers hit arXiv every day and maybe 3 matter to my research, so I built an open-source tool that finds them [P]

사용자의 연구 관심사 기술 마크다운 파일을 기반으로 매일 수백 편의 arXiv 논문 중 관련성 높은 논문을 찾아 자동 분석하고 요약해 주는 오픈소스 도구인 Research Radar에 대한 소개입니다.

  • 매일 설정된 카테고리의 arXiv 신규 논문을 수집하고 사용자의 관심사 기술 문서와 대조하여 1~10점으로 점수를 매깁니다.
  • 높은 점수를 받은 논문은 PDF를 다운로드하여 전체 텍스트를 추출하고, 강력한 LLM을 통해 요약, 핵심 통찰, 한계점, 개인 연구와의 연관성을 분석합니다.
  • Claude Code, Codex CLI 등의 로컬/클라우드 LLM 백엔드를 모두 지원하며 관심사 마크다운 파일만 수정하면 물리, 바이오 등 모든 분야에 적용 가능합니다.
Notable Quotes & Details
  • 95% of it is irrelevant to what I actually work on
  • 10-abstract scoring batch is ~18k input tokens
  • deep read sends the whole paper, 40-70k input tokens

매일 쏟아지는 arXiv 논문 중 자신에게 필요한 핵심 논문을 효율적으로 필터링하고 요약해 보고 싶은 AI/ML 및 기타 과학 분야 연구원 및 개발자

Evaluating J-space entropy as an error predictor across 7 datasets on Qwen3-4B [R]

Qwen3-4B 모델과 7개 데이터셋을 대상으로 J-space(Jacobian Lens) 엔트로피가 언어 모델의 오류 예측 인자로서 유효한지 평가한 연구 결과에 관한 내용입니다.

  • PopQA와 같은 사실 검색 데이터셋에서 내부 워크스페이스 엔트로피는 이미 높은 신뢰도를 보이지만 틀린 답변들을 걸러내는 데 도움을 주어 출력 신뢰도를 보완할 수 있습니다.
  • TruthfulQA 실험 결과, 오답 또한 정돈되고 엔트로피가 낮은 내부 표현을 가질 수 있어 내재화된 잘못된 개념을 안정적으로 감지하지 못합니다.
  • 수학적 추론(GSM8K)은 기본 엔트로피가 훨씬 높고 다중 선택 형식(CommonSenseQA)에서도 신호가 약해지는 등 엔트로피 보정 수준이 작업에 크게 의존합니다.
Notable Quotes & Details
  • Qwen3-4B
  • ~11,400 examples
  • seven distinct datasets

인공지능 및 기계학습 연구자, LLM 성능 평가 및 환각 현상 제어 관심 개발자

Doubt regarding TMLR[R]

TMLR 저널에 제출한 논문의 심사가 지연되는 상황에서 Action Editor에게 문의 메일을 보내는 것이 적절한지에 대한 연구자의 질문입니다.

  • 4월 23일에 심사위원이 배정된 후 7월 13일 기준으로 2개의 심사평만 수신되고 3번째 심사평은 대기 중임
  • 토론 단계가 시작되지 않아 기접수된 심사평에 답변을 작성할 수 없는 상태임
  • Action Editor에게 지연 상황에 대해 정중하게 진행 상태를 문의하는 메일을 보내도 괜찮은지 커뮤니티에 조언을 구함
Notable Quotes & Details
  • April 23
  • July 13
  • 2 reviews
  • third is still pending

머신러닝 분야 연구자 및 학술 저널 투고 준비생

[ECCV 2026] Meaning of "Authorized Delegate" & Registration Advice [D]

ECCV 2026에 잠정 채택된 논문의 저자들이 비자 문제로 참석할 수 없어 대리 발표자(Authorized Delegate)의 기준과 등록 절차에 대해 조언을 구하는 글입니다.

  • ECCV 2026 논문 발표는 저자 또는 승인된 대리인이 직접 참석하여 발표해야 함
  • 공동 저자들이 미국 이민 신분 펜딩 문제로 출국할 수 없어 대리 발표자를 세워야 하는 상황임
  • 대리인의 자격 요건, 등록 규정(7월 17일까지 풀 등록 필요), 대리인 지정 공식 통보 절차에 대한 의문을 제기함
Notable Quotes & Details
  • ECCV 2026
  • July 17, 2026

학술 대회 발표 준비자 및 컴퓨터 비전 연구원

I built a full 3D open-world racing game almost entirely with AI, and it now has real daily players. Here's the honest breakdown of what the model nailed and where it completely fell apart.

한 개발자가 AI를 활용해 실제 사용자가 있는 3D 오픈월드 레이싱 게임을 제작하며 느낀 AI의 장점과 한계에에 대한 솔직한 분석

  • AI는 단일 시스템 구축(사진 모드 등), 인증/결제 등 정형화된 작업, 리팩토링 및 디버깅에는 매우 뛰어난 성능을 보였다.
  • 하지만 3D 공간 및 기하학적 추론, 전체 시스템 상호작용 이해, 성능 최적화 예측, 게임의 재미나 밸런스 판단(Game feel) 측면에서는 한계를 드러냈다.
  • 개발자의 역할이 코드를 직접 작성하는 것에서 정밀하게 사양을 정의하고 검증하며 방향성을 조율하는 '감독 및 테스터'로 변화하고 있다.
Notable Quotes & Details
  • a couple of weeks
  • It went from empty folder to live with actual daily players in a couple of weeks.

AI를 활용해 실제 프로젝트나 제품을 개발하고자 하는 소프트웨어 개발자 및 게임 기획자

Free AI visibility checker

ChatGPT와 Claude 같은 AI에 대한 웹사이트의 노출도를 진단하고 개선책을 제공하는 무료 도구인 visibilitycheck.ai에 대한 소개입니다.

  • 웹사이트가 다양한 AI 모델에 얼마나 잘 노출되고 있는지 무료로 진단할 수 있습니다.
  • 종합 점수, 카테고리별 개별 점수, 노출도 향상을 위한 핵심 개선 사항을 무료로 제공합니다.
  • 유료 요금제에서는 사이트의 CMS, 플러그인, 프레임워크에 맞춤화된 바로 업로드 가능한 파일 및 상세 PDF 지침을 생성해 줍니다.
Notable Quotes & Details
  • visibilitycheck.ai

웹사이트 소유자, 마케터 및 웹 개발자

For a silent revolution in the singularity scene

기술적 특이점은 단일 인공지능이 아닌, 고유하게 개인화된 AI와 인간 과학자들의 긴밀한 공생 관계가 형성하는 성좌(constellation) 형태의 협력에서 도래할 수 있다는 주장입니다.

  • 기술적 특이점을 이끄는 첫 진정한 변혁적 지능은 독자적인 기계가 아니라 과학자와 맞춤형 AI 간의 고유한 인간-AI 공생 관계의 결합체들일 수 있습니다.
  • 서로 다른 전문 분야(물리학, 생물학, 수학 등)의 인간-AI 파트너십들이 모여 성좌 형태의 협력망을 구축할 때 진정한 돌파구가 나타납니다.
  • 거대 기업들이 기술 독점을 위해 통제된 플랫폼과 폐쇄형 모델을 지향함으로써, 독립적인 과학자들의 자율적이고 지속적인 인간-AI 파트너십 발전을 제약하고 있습니다.
Notable Quotes & Details

인공지능 연구원, 미래학자, 과학 기술 정책 입안자 및 기술적 특이점에 관심이 있는 일반 대중

(Ω, D) Dynamics — Research Library

세상을 예측하거나 명시적인 목표를 쫓는 대신, 자신의 생존 가능한 형태를 유지함으로써 작동하는 시스템을 연구하기 위한 프레임워크인 (Ω, D) Dynamics에 관한 것입니다.

  • 작성자는 ChatGPT Sites 기능을 사용하여 해당 연구 라이브러리를 공개하였습니다.
  • 해당 프레임워크는 목표 예측이나 추구 대신 시스템 자체의 생존 가능 형태 보존에 초점을 맞춥니다.
  • ChatGPT Sites를 사용하면 URL에 사용자 이름이 노출되는 아쉬운 점이 있습니다.
Notable Quotes & Details
  • This is a framework for studying systems that act by preserving their own viable form, not by predicting the world or chasing an explicit goal.

인공지능 시스템 동역학 및 관련 프레임워크를 연구하는 개발자와 연구자

The AI Workspace Hijack: Anatomy of the Jscrambler NPM Attack

Jscrambler의 NPM 패키지가 탈취당하여 Cursor 및 Claude Desktop 등 AI 개발 툴을 표적으로 삼는 악성코드가 배포된 사건에 대한 분석입니다.

  • 공격자가 Jscrambler의 NPM 자격 증명을 탈취하여 8.14.0부터 8.20.0 버전에 악성 훅을 삽입해 배포했습니다.
  • 문서화되지 않은 preinstall 훅을 사용해 Rust 기반의 크로스 플랫폼 정보 탈취 악성코드 페이로드를 실행합니다.
  • 이 악성코드는 Cursor 및 Claude Desktop의 로컬 폴더 설정을 스캔하여 개발자의 API 키와 히스토리를 탈취합니다.
Notable Quotes & Details
  • 8.14.0
  • 8.20.0
  • 8.22.0

소프트웨어 개발자 및 IT 보안 담당자

The best all-in-one computers of 2026: Expert tested and reviewed

2026년 최우수 올인원(AIO) 컴퓨터들에 대한 전문적인 테스트 및 리뷰 결과입니다.

  • 올인원 컴퓨터는 모니터 하나에 구성 부품을 통합하여 공간을 절약하는 설계를 제공하지만, 업그레이드 옵션과 수리 용이성이 제한적입니다.
  • 2026년 7월 업데이트에서 가족용 미드레인지 PC로 적합한 2026 Dell 24 AiO가 목록에 추가되었습니다.
  • 여러 예산과 사용 사례에 맞춰 테스트를 진행한 결과, 성능, 선명한 디스플레이, 세련된 디자인을 갖춘 애플의 24인치 M4 iMac이 최고의 제품으로 선정되었습니다.
Notable Quotes & Details
  • Dell Tower ECT1250 Intel Ultra 7 512GB SSD 16GB RAM Desktop : $750 (save $150)
  • Lenovo ThinkCentre Neo 55s Gen 6 Ryzen 7 1TB SSD 32GB RAM SFF Desktop : $699 (save $220)
  • Dell Tower ECT1250 Intel Ultra 7 2TB SSD 32GB RAM Desktop : $850 (save $400)
  • Alienware Aurora ACT1250 Intel Ultra 7 RTX 5060 1TB SSD 16GB RAM Desktop (Solid Door) : $1,000 (save $500)
  • HP OmniDesk Intel Ultra 7 2TB SSD 16GB RAM Desktop (Dark Wood) : $700 (save $520)

올인원 컴퓨터 구매를 고려 중인 소비자 및 테크 제품 구매자

I loved ChatGPT Desktop until OpenAI gutted it to make room for Codex and Work

OpenAI가 ChatGPT 데스크톱 앱에서 기존의 유용한 기능들을 제거하고 Codex 및 ChatGPT Work를 위한 형태로 개편하면서 앱의 사용성이 나빠졌다는 평가입니다.

  • ChatGPT 데스크톱 앱에서 편리했던 내장 스크린샷 캡처 및 채팅 삽입 기능이 삭제되었습니다.
  • Notion, Notes, TextEdit 등의 앱 창 내용을 ChatGPT가 볼 수 있게 지원하던 'Work with' 기능이 제거되었습니다.
  • 데스크톱 앱은 사실상 Codex 기반의 조잡한 팝업 창 형태로 대체되었으며, 여전히 많은 사용자에게는 브라우저를 통한 ChatGPT 사용이 가장 적합합니다.
Notable Quotes & Details
  • Ziff Davis, ZDNET's parent company, filed an April 2025 lawsuit against OpenAI

ChatGPT 데스크톱 앱을 주로 사용하거나 AI 도구의 인터페이스 변화에 관심이 있는 일반 사용자 및 IT 종사자

Nokia’s 14 Years of Mobile-Phone Supremacy Ended in an Afternoon

모바일 시장을 지배했던 노키아의 전성기와 스마트폰 시대의 도래로 인한 급격한 몰락을 분석하는 내용입니다.

  • 노키아는 2005년에 10억 번째 휴대전화를 판매하며 전 세계 휴대전화 3대 중 1대를 제조하는 등 시장을 지배했습니다.
  • 1999년과 2000년에 출시된 3210과 3310 모델은 최초로 내부 안테나를 탑재하여 세계적으로 2억 8천만 대 이상 판매되었습니다.
  • SMS 문자 전송 대중화, 뱀 게임(Snake), 사용자 맞춤형 벨소리 제작 앱 등을 통해 모바일 문화를 선도했습니다.
Notable Quotes & Details
  • 2005
  • 1990s
  • 1998
  • 2012
  • 1999
  • 2000
  • 280 million units
  • 160 characters
  • 2002
  • Consumers had the perception that it could not work well without an external antenna

IT 산업 역사와 모바일 비즈니스 전략에 관심이 있는 독자층

Building a Foundation Stack for General-Purpose Robots

중국의 embodied-AI 기업인 X Square Robot이 범용 로봇을 위한 통합된 오픈소스 embodied AI 스택 비전과 원칙을 제시했습니다.

  • 로봇 데이터의 기본 단위를 단순 궤적이 아닌 상호작용으로 정의하고 의도한 물리적 변화를 성공의 기준으로 삼습니다.
  • 사전 학습을 통해 사후 미세 조정용 초기화에 그치지 않고 즉시 사용 가능한 능력을 도출해야 한다고 주장합니다.
  • 사람이 그리퍼가 달린 리그를 착용하고 데이터를 수집하는 QUANXTA Zero Series 데이터 수집 시스템을 구축하여 데이터 품질을 엄격히 제어합니다.
Notable Quotes & Details
  • X Square Robot
  • QUANXTA Zero Series

로보틱스 개발자, 인공지능 연구원 및 AI 하드웨어 업계 관계자

Notes: 내용 불완전

VHF Propagation: What Every RF Engineer Should Know

실제 세계에서 무선 주파수 엔지니어가 알아야 할 일반적 및 비일반적 VHF 전파 모드에 대한 실용적인 교육 가이드입니다.

  • 기하학적 예측이 불가능한 영역에서 굴절, 반사, 회절, 산란이 신호에 미치는 영향 분석
  • 대기 굴절을 통한 VHF 라디오 지평선의 연장 및 온도 역전으로 인한 도관(Duct) 형성 원리
  • 돌발성 E층(Sporadic E), 유성 버스트, 지구-달-지구(EME) 경로를 통한 초장거리 전파 모드 활용법
Notable Quotes & Details
  • 대기 굴절은 VHF 라디오 지평선을 광학적 가시거리보다 약 3분의 1(one-third) 더 연장시킵니다.
  • 온도 역전층은 VHF 신호를 1,500 km 이상 전달할 수 있는 도관을 형성합니다.

무선 주파수(RF) 엔지니어 및 링크 버지팅, 간섭 예측 등의 계획을 수행하는 기술 실무자

The Path to Sovereign Data: Challenges and Priorities in Local-First Computing

베를린에서 열린 Local First Conf 2026 패널 토론에서 로컬 퍼스트 컴퓨팅 진영이 주장하는 실질적인 사용자 데이터 소유권과 상호 운용성 구현을 위한 도전 과제 및 우선순위 분석

  • 데이터 소유권은 단순한 계정 제어를 넘어 실제적인 사용자 권한, 상호 운용 가능한 인프라, 그리고 공동체적 거버넌스 모델을 의미해야 함
  • 대규모 배포와 탈중앙화 가치 사이의 절충안으로 Bluesky의 AT 프로토콜과 같이 완전한 P2P 대신 서버 기반 아키텍처를 도입하는 등의 변화가 있음
  • 상호 운용성을 위해 신원이나 신뢰 모델을 하나로 강제하지 않는 프로토콜 간 브리지 구축과 함께 연락처, 캘린더 등 실용적인 데이터 도메인의 표준(JMAP 등) 활용이 필요함
Notable Quotes & Details
  • GDPR
  • Local First Conf 2026
  • 2019
  • 240 million

로컬 퍼스트 개발자, 분산 웹 아키텍트, 데이터 거버넌스 및 프라이버시 정책에 관심 있는 기술 연구자

How DoorDash Built an AI Shopping Assistant That Doesn’t Rely on the LLM Alone

DoorDash가 LLM 단독이 아닌 특화된 AI 에이전트, MCP 기반 도구, 메모리 시스템 등을 활용하여 구축한 AI 쇼핑 어시스턴트 'Ask DoorDash'의 아키텍처와 성과를 공유했습니다.

  • Ask DoorDash는 오케스트레이션과 비즈니스 기능을 분리하고, 공유 MCP 레이어를 통해 검색, 추천, 장바구니 등의 기능을 도구화하여 연동했습니다.
  • 오프라인 장기 기억, 세션 기억, 에이전트 기억으로 구성된 3단계 메모리 시스템을 도입하여 개인화된 컨텍스트를 제공합니다.
  • 일일 2,000회 이상의 자동화 평가 프레임워크를 구축하여 품질 측정 및 가동 유효성 검증 시간을 대폭 단축했습니다.
Notable Quotes & Details
  • 식료품 결제 전환율 약 24% 향상
  • 장바구니 크기 17% 증가
  • 대화 턴 수 7% 감소
  • 레스토랑 탐색 오픈형 쿼리 전환율 15% 향상
  • 회귀 테스트 시간 6시간에서 20분으로 단축
  • 지연 시간(latency) 35% 감소
  • Raghav Saboo: "Building a useful AI agent is hard. Knowing if it is actually good is even harder."
  • Andy Fang: "Ask DoorDash can build you a grocery cart ~5x faster than doing it manually"

AI 시스템 설계자, 소프트웨어 엔지니어, 서비스 기획자

Forg365 PhaaS Targets Microsoft 365 with Device Code and AitM Session Theft

디바이스 코드 피싱 및 AitM 세션 탈취 기법을 사용하여 Microsoft 365 계정을 표적으로 삼는 새로운 피싱 서비스(PhaaS)인 Forg365의 등장과 작동 방식에 대한 분석

  • Forg365는 디바이스 코드 피싱, AitM, 안티봇 우회, AI 이메일 생성 및 사후 침투 제어 기능을 제공하는 정교한 피싱 서비스 플랫폼이다.
  • 텔레그램을 통해 월 400달러 또는 연 3,800달러의 구독형 모델로 유통되며, 기술적 지식이 적은 공격자도 대규모 피싱 캠페인을 벌일 수 있도록 지원한다.
  • ForgCookie라는 브라우저 확장 프로그램을 활용하여 획득한 토큰을 기반으로 세션 쿠키를 자동으로 갱신하고 타협된 계정에 지속적으로 액세스한다.
Notable Quotes & Details
  • 월 400달러 (또는 연 3,800달러)
  • logfriend[.]com/login
  • ForgCookie

보안 연구원, 시스템 관리자 및 IT 보안 분석가

Thinking Fast and Slow in the SOC: The Case for Combining Autonomous AI with Analyst Copilots

대니얼 카너먼의 이중 프로세스 이론(생각에 관한 생각)을 보안관제센터(SOC)의 AI 아키텍처 설계에 접목하여 자율형 AI와 분석가용 코파일럿의 결합 필요성을 주장하는 기사

  • 인간의 정신이 빠르고 자동적인 시스템 1(95%)과 느리고 논리적인 시스템 2(5%)로 작동하듯, SOC 의사결정 체계도 이와 유사한 구조를 가져야 한다.
  • 실제 기업 경보 데이터 분석에 따르면 경보의 98%는 자율적으로 해결 가능하며, 단 2% 미만만이 인간 분석가의 검토를 필요로 한다.
  • 대부분의 보안 팀은 심층 판단이 필요한 극소수 경보에만 집중하는 AI 아키텍처를 구축함으로써 나머지 대다수 경보를 방치하는 실수를 범하고 있다.
Notable Quotes & Details
  • 2002
  • 95%
  • 5%
  • 25 million enterprise alerts
  • 98%
  • 2%

보안 전문가, 최고정보보호책임자(CISO), 보안 아키텍트 및 AI 도입을 고민하는 IT 의사결정자

Notes: 본문이 중간에 끊겨 있으나 핵심 주장의 대다수와 통계 수치가 포함되어 있어 분석이 가능함

Attacker Uses Suspected AI-Generated PowerShell Script to Map Active Directory

공격자가 Active Directory 환경을 탐색하기 위해 AI가 생성한 것으로 의심되는 PowerShell 스크립트를 사용한 보안 침입 사건이 발생했습니다.

  • 공격자는 대화형 AI(LLM)와의 피드백을 통해 작성된 것으로 보이는 '100% Working AD Information Gathering Script - FULLY FIXED'라는 제목의 스크립트를 사용해 도메인 컨트롤러 및 관련 자산 정보를 수집했습니다.
  • 스크립트에는 프롬프트 반복 제목, 플레이스홀더 문자열, 도메인 컨트롤러를 찾기 위한 다중 폴백 메커니즘 등 AI 생성물의 전형적인 흔적들이 발견되었습니다.
  • AI는 신규 취약점이나 고도의 악성코드 없이도 덜 숙련된 공격자가 신속하게 공격 툴을 개발할 수 있도록 진입 장벽을 낮추고 공격의 속도와 규모를 가속화하고 있습니다.
Notable Quotes & Details
  • early June 2026
  • 100% Working AD Information Gathering Script - FULLY FIXED
  • It's likely a 'helpful' inject from the LLM that the attacker simply went along with, rather than being intentionally authored into the script

보안 연구원, 시스템 관리자, 사이버 보안 전문가

iCagenda and Balbooa Forms Joomla Flaws Reportedly Exploited as Zero-Days

CISA가 실제 공격에 제로데이로 악용된 Joomla의 iCagenda 및 Balbooa Forms 확장 프로그램 취약점 2종을 KEV(알려진 악용된 취약점) 카탈로그에 추가했습니다.

  • CVE-2026-48939는 Joomla용 iCagenda 확장 프로그램에서 임의 파일 업로드를 통해 PHP 코드를 업로드하고 실행할 수 있는 취약점으로, 2026년 6월 15일부터 제로데이로 악용되었습니다.
  • CVE-2026-56291은 Joomla용 Balbooa Forms 확장 프로그램에서 인증되지 않은 원격 코드 실행(RCE)이 가능한 임의 파일 업로드 취약점입니다.
  • 해당 취약점들은 최대 위험도인 CVSS 10.0으로 평가되었으며, 미 연방 민간 행정 기관(FCEB)은 2026년 7월 13일까지 보안 패치를 적용해야 합니다.
Notable Quotes & Details
  • CVE-2026-48939
  • CVE-2026-56291
  • CVSS 10.0
  • 2026년 6월 15일
  • 2026년 7월 8일
  • 2026년 7월 13일
  • icagenda-batch/1.0
  • images/icagenda/frontend/attachments/
  • images/baforms/uploads

웹사이트 관리자, Joomla 사용자 및 보안 전문가

프롬프트·카르파시 루프 넘어 AI가 연구 방법 바꾸는 '이중 루프' 시대 개막

AI가 스스로 실험과 검증을 반복하며 연구 방법 자체를 실시간으로 개선하는 '이중 루프(이중 레벨 자동 연구)' 아키텍처의 등장과 성과를 소개한다.

  • 목표만 설정하면 AI가 스스로 계획 수립, 실행, 평가, 개선을 반복하는 루프 시스템인 안드레이 카르파시의 '오토리서치'가 코드 최적화의 자율화 가능성을 입증했다.
  • 단일 루프 방식의 탐색 패턴 정체 한계를 극복하기 위해 탐색 전략을 수행하는 내부 루프와 새로운 탐색 메커니즘 코드를 실시간으로 주입하는 외부 루프로 구성된 이중 레벨 자동 연구 프레임워크가 공개되었다.
  • GPT 사전학습 벤치마크 실험 결과 이중 레벨 구조는 기존 단일 루프 대비 약 5배에 달하는 성능 개선 폭을 기록하여, 모델 체급보다 자율형 AI 연구를 위한 구조적 아키텍처 설계가 핵심임을 시사했다.
Notable Quotes & Details
  • 카르파시 루프: 약 이틀간 700여 차례의 자율 실험을 통해 모델 학습 시간을 약 11% 단축
  • 쇼피파이 CEO: 내부 모델에 적용해 약 19%의 성능 개선 효과
  • GPT 사전학습 벤치마크: 기존 단일 루프 대비 성능(val_bpb) 개선 폭이 약 5배(-0.045 대 -0.009) 기록

인공지능 연구자 및 개발자, AI 업계 관계자

딥노이드 “의료 에이전틱 AI로 승부수… 환각률 0.2%로 업무 바꾼다”

의료 AI 전문 기업 딥노이드가 생성 AI 디지털의료기기 'M4CXR'를 바탕으로 환각률을 0.2%로 낮춘 의료 에이전틱 AI 시장 공략에 본격적으로 나선다.

  • 생성 AI 의료기기 최초로 혁신의료기기 지정 및 품목허가를 획득한 흉부 X-레이 판독 솔루션 'M4CXR'의 상용화 본격화
  • 비전언어모델(VLM)을 통해 판독 결과를 평균 2.3초 만에 예비소견서 형태로 자동 생성하고 환각 발생률 0.2% 및 건당 0.586초의 속도 달성
  • 퓨리오사AI의 NPU 인프라 협력 및 자체 의료 파운데이션 모델 '메드제로' 개발로 병원 업무 생산성 제고와 시장 확대 추진
Notable Quotes & Details
  • 환각 발생률 0.2%
  • 판독문 1건당 생성 및 추론 속도 0.586초
  • 평균 2.3초 만에 예비소견서 형태로 자동 생성
  • 1000만건 이상의 흉부 X-레이 영상과 판독문 학습
  • 41개 이상의 이상 소견 판독
  • 4조 토큰 규모의 텍스트와 의료 데이터 학습한 메드제로

의료 업계 종사자, AI 및 의료 기기 투자자, IT 기술 업계 전문가

앤트그룹, 로봇 제어 VLA 모델 '링봇-VA 2.0'·실시간 월드 모델 동시 공개

중국 앤트그룹이 로봇 제어에 최적화된 차세대 비전·언어·행동(VLA) 모델 '링봇-VA 2.0'과 실시간 월드 모델 '링봇-월드 인피니티'를 공개했다.

  • 링봇-VA 2.0은 비디오와 로봇 행동을 함께 학습하는 새로운 아키텍처를 기반으로 처음부터 설계되어 로봇 제어 및 물리적 환경 이해 능력을 극대화했다.
  • 트랜스포머 혼합(MoT) 및 희소 전문가 혼합(MoE) 구조를 적용하여 총 153억 개의 매개변수 중 추론 시 25억 개만 사용해 연산 효율을 높였다.
  • 시범 영상 한 편만으로도 재학습 없이 작업을 수행하는 인컨텍스트 러닝과 다음 행동을 예측하여 끊김 없이 제어하는 포사이트 리즈닝 기술을 탑재했다.
Notable Quotes & Details
  • 10일(현지시간)
  • 약 153억개
  • 약 25억개
  • 기존 대비 4배 이상의 종단간 성능 향상
  • 140억개
  • 13억

로봇 공학 및 인공지능 개발자, 피지컬 AI 연구원, IT 산업 관계자

네이버, 'ICML'서 AI 풀스택 연구 성과 선보여

네이버가 'ICML 2026'에서 AI 안전성 강화, 모델 운영 효율화, 3D 공간 이해 등 AI 풀스택 분야의 주요 연구 성과를 발표했다.

  • LLM의 취약점을 분석하는 레드티밍 기술인 '스테이블 지플로우넷(Stable-GFlowNet)'으로 학회 상위 2.2% 논문인 '스포트라이트'에 선정되었다.
  • 서로 다른 특화 모델을 하나로 통합하는 모델 병합 기법인 '시머지(SyMerge)'와 AI 작업 순서 설계 기술인 '플로우봇(FlowBot)'을 공개하여 모델 운영 효율성을 높였다.
  • 가상 시뮬레이션 플랫폼인 '서울 월드 모델(Seoul World Model)'을 통해 로봇 경로 및 행동 학습을 지원하는 피지컬 AI 연구 성과를 소개했다.
Notable Quotes & Details
  • 2026 국제머신러닝학회(ICML 2026)
  • 6일부터 11일까지
  • Where AI Research Becomes Reality
  • 상위 약 2.2%
  • Spotlight
  • Stable-GFlowNet
  • SyMerge
  • FlowBot
  • Seoul World Model

AI 연구원, 머신러닝 개발자, IT 업계 관계자 및 피지컬 AI 및 로봇 공학 관련 전문가

[게시판] 이스트소프트, 농업 특화 AI 에이전트 지원사업 참여 등 단신

이스트소프트의 농업 특화 AI 에이전트 지원사업 참여, AI스페라의 글로벌 보안 플랫폼 기업 Torq와의 파트너십, 메가존클라우드의 서울 AI 허브와의 MOU 체결, PFCT의 AI 신용평가 아카데미 개최 등 AI 업계의 주요 단신 소식입니다.

  • 이스트소프트가 총 사업비 714억원 규모의 농업 특화 LLM 기반 스마트팜 AI 에이전트 상용화 사업에 참여하여 자율 재배 운영 시스템을 구축합니다.
  • AI스페라가 Torq와 파트너십을 체결하고 사이버 위협 인텔리전스 솔루션 '크리미널 IP'를 Torq의 AI 보안관제 플랫폼에 연동해 탐지·조사·대응을 자동화합니다.
  • 메가존클라우드가 서울 AI 허브와 업무협약을 맺고 서울 소재 AI 기업의 R&D, 사업화, 글로벌 경쟁력 강화를 위해 HPC 및 클라우드 인프라와 컨설팅을 제공합니다.
Notable Quotes & Details
  • 714억원

AI 기술 트렌드, 스마트팜 사업, 사이버 보안 및 IT 비즈니스 협력에 관심이 있는 업계 관계자 및 일반 독자

美 상무부, UAE에 AI칩 무허가 수출 허용…A:5 국가로 격상

미국 상무부가 아랍에미리트(UAE)를 국가군 A:5로 재분류하여 첨단 AI 칩과 고성능 서버 등의 무허가 수출을 허용했다.

  • 미국 상무부 산업안보국(BIS)이 7월 10일 UAE를 국가군 A:5로 재분류하여 개별 허가 없이 첨단 AI 칩 등을 수출할 수 있도록 조치했다.
  • 이번 조치로 UAE 정부를 비롯해 아부다비 AI 대기업 G42, 코어42 및 UAE 현지에서 사업하는 아마존, 애플, xAI 등이 혜택을 받게 된다.
  • 이번 완화 조치는 미국의 주요 방위 파트너 지정과 맞물려 있으며, 연산 능력 인프라의 글로벌 다변화를 촉진할 것으로 전망된다.
Notable Quotes & Details
  • 7월 10일
  • A:5
  • G42
  • Core42
  • 아랍 국가로는 처음

IT 및 AI 산업 관계자, 국제 비즈니스 정책 분석가

앤트로픽, 클로드 페이블5 제공 19일까지 연장

앤트로픽이 클로드 페이블 5의 유료 플랜 포함 제공 기한을 7월 19일까지 추가 연장했습니다.

  • 앤트로픽이 클로드 페이블 5를 프로, 맥스, 팀 및 일부 엔터프라이즈 플랜 가입자에게 추가 비용 없이 제공하는 기간을 7월 19일 밤 11시 59분(태평양 시간)까지 연장했습니다.
  • 가입자는 주간 사용 한도의 최대 50%까지 페이블 5를 사용할 수 있으며, 클로드 코드의 주간 사용 한도 50% 증액 조치도 동일하게 연장됩니다.
  • 한도 소진 또는 기한 종료 후에는 100만 토큰당 입력 10달러, 출력 50달러의 선불 크레딧이 필요하며, 앤트로픽은 향후 페이블 5를 정식 구독 상품으로 환원하는 것을 목표로 하고 있습니다.
Notable Quotes & Details
  • 7월 13일
  • 7월 19일 밤 11시 59분
  • 50%
  • 100만 토큰당 입력 10달러, 출력 50달러
  • 6월 12일
  • 19일간

클로드 유료 플랜 사용자 및 AI 모델 개발자

스노우, 첫 AI 톱티어 학회 논문 채택…ECCV 2026 진출

네이버 자회사 스노우가 창사 이래 처음으로 세계 최고 권위의 컴퓨터 비전 학회인 ECCV 2026에 AI 헤어스타일 변환 기술에 관한 연구 논문을 채택시켰다.

  • 스노우가 올해 처음 운영한 연구인턴 프로그램을 통해 공동 연구한 'H-Adapter' 논문이 ECCV 2026에 채택되었다.
  • H-Adapter는 머리카락과 얼굴 영역을 분리 학습하여 AI 헤어스타일 변환 시 발생하는 머리 자세 불일치 문제를 해결하고 자연스러운 합성을 구현했다.
  • 텍스트 명령어를 통한 머리색 변경 및 고유 외형을 유지한 헤어스타일 변경을 지원하며, 별도 재학습 없이 기존 텍스트-투-이미지 모델과 결합할 수 있다.
Notable Quotes & Details
  • ECCV 2026
  • 9월 8일부터 12일까지 스웨덴 말뫼에서 열린다
  • H-Adapter

AI 및 컴퓨터 비전 연구원, IT 업계 종사자, 기술 트렌드에 관심 있는 일반 독자

Jooojub
System S/W engineer
Explore Tags
Series
    Recent Post
    © 2026. jooojub. All right reserved.