Daily Briefing

August 21, 2026
2026-08-20
64 articles

In-region inference, open models, and new European infrastructure for sovereign AI.

미스트랄 AI가 유럽 중심의 독립적인 AI 인프라 구축, 지역별 추론 엔드포인트 제공 및 오픈 소스 모델 지원 확대를 통해 AI 주권을 강화한다는 내용입니다.

  • 유럽과 미국 중 추론이 실행될 지역을 고객이 직접 선택할 수 있는 '미스트랄 지역 엔드포인트(Mistral Regional Endpoints)' 공식 출시
  • 미션 크리티컬 워크로드를 위한 가동 시간 SLA 및 맞춤형 속도 제한을 보장하는 '미스트랄 우선순위 티어(Mistral Priority Tier)' 공개 프리뷰 시작
  • Z.ai의 GLM-5.2를 시작으로 미스트랄 플랫폼에서 타사 오픈 모델을 지원하여 고객의 모델 선택권 확장
Notable Quotes & Details
  • 2030년까지 최대 1 GW 용량의 유럽 AI 컴퓨팅 인프라 구축 계획
  • GLM-5.2

기업 고객, 데이터 주권 및 규제 준수가 필요한 유럽 및 글로벌 기업 인프라 관리자

Agentic Search. More accurate and efficient results from your AI systems.

미스트랄 AI가 기업의 복잡한 문서 내에서 정보를 정확하고 효율적으로 탐색, 리딩 및 검증할 수 있도록 지원하는 멀티스텝 검색 레이어인 '에이전틱 서치(Agentic Search)'를 출시했습니다.

  • 기존 검색 인덱스를 활용하여 search, open, navigate, read, grep의 5가지 도구를 통해 멀티스텝 검색 루프를 수행합니다.
  • 온프레미스 및 클라우드 격리 경계를 넘지 않고 민감한 도메인 특정 데이터를 안전하게 처리할 수 있도록 지원합니다.
  • 정밀한 탐색 기능으로 FinanceBench 및 OfficeQA Pro 벤치마크 기준 지연 시간을 최대 39.6% 단축하고 토큰 소모량을 최대 3분의 1까지 절감합니다.
Notable Quotes & Details
  • FinanceBench 기준 재무 분석 정확도 3배 향상 (26.7%에서 86%로 증가)
  • OfficeQA Pro 벤치마크에서 +45.6 포인트 향상 (6.3%에서 51.9%로 증가)
  • p90 latency 최대 39.6% 단축
  • 토큰 소비량 최대 1/3 감소

인공지능 시스템을 활용해 기업 내부의 복잡하고 민감한 데이터 및 문서를 효율적으로 검색하고 활용하려는 기업 개발자 및 비즈니스 의사결정권자

Introducing Shieldstral.

Mistral AI가 단일 16GB GPU에서 작동 가능하고 추론 시점에 자연어 정책을 입력받아 텍스트와 이미지를 유연하게 판별하는 3B 오픈 가중치 멀티모달 안전 분류 모델인 Shieldstral을 출시했습니다.

  • 콘텐츠 중재를 정책 적응형 질의응답 작업으로 구성하여 최대 7배 크기의 모델보다 뛰어난 성능을 제공합니다.
  • 기존의 고정된 범주 방식과 달리, 추론 단계에서 자연어로 작성된 정책을 입력하여 별도의 재학습 없이도 텍스트와 이미지의 안전성을 동시에 평가합니다.
  • Apache 2.0 라이선스로 배포되는 오픈 가중치 모델로 단일 16GB NVIDIA GPU 환경에서 효율적으로 실행됩니다.
Notable Quotes & Details
  • 3B
  • 7x
  • Apache 2.0
  • 16GB NVIDIA GPU
  • Does this content promote violence against a protected group? Is this image safe to show to a minor? Did the assistant refuse the request?

AI 애플리케이션 개발자, 서비스 운영자 및 보안/안전 모델 연구원

Leanstral 1.5: Proof Abundance for All

미스트랄 AI가 Lean 4 환경에서 공식 검증 및 수학적 증명을 수행하는 오픈소스 AI 모델 Leanstral 1.5를 출시했습니다.

  • Leanstral 1.5는 총 119B 매개변수 중 6B 활성 매개변수를 가진 Apache-2.0 라이선스의 무료 오픈소스 모델입니다.
  • 중간 훈련(mid-training), 지도 미세조정(SFT), 그리고 다회차 환경 및 코드 에이전트 환경에서의 강화학습(CISPO)을 통해 개발되었습니다.
  • 실제 오픈소스 저장소 테스트 과정에서 5개의 이전에 발견되지 않은 버그를 찾아내며 실무 코드 검증 능력을 입증했습니다.
Notable Quotes & Details
  • 119B total and only 6B active parameters
  • 587/672 PutnamBench problems
  • FATE-H (87%)
  • FATE-X (34%)
  • 5 previously unknown bugs across 57 repositories

공식 프로그램 검증 및 수학적 증명 연구를 수행하는 AI 연구원 및 소프트웨어 엔지니어

Bringing more control over your connectors

Mistral AI가 외부 기업 플랫폼과의 안전한 연동을 위해 향상된 관리자 제어, 스코프 지정 API 키, 디버거 등 커넥터 관련 새로운 보안 및 제어 기능을 출시했습니다.

  • 워크스페이스 및 조직 수준에서 커넥터 접근 권한을 관리하고 개별 도구를 활성화/비활성화할 수 있는 관리자 제어 기능 제공
  • 다중 계정 커넥터 지원 및 자동화된 AI 워크로드에서 명의 도용을 방지하기 위한 커넥터 스코프 지정 API 키 도입
  • 연결 오류 분석을 위한 커넥터 디버거 및 개발자 인터페이스(Vibe Code)와 워크플로우에 커넥터 연동 기능 추가
Notable Quotes & Details
  • 60

AI 시스템 관리자 및 개발자

Multilingual Knowledge Transfer under Data Constraints via Lexical Interventions

데이터 제약이 있는 상황에서 이중 언어 어휘집을 활용한 어휘적 개입을 통해 다국어 언어 모델의 교차 언어 지식 전이 성능을 향상시키는 방법론(LINK)에 대한 연구입니다.

  • 고리소스 언어(영어) 코퍼스의 일부 단어를 대상 언어의 번역어로 무작위 교체하는 LINK 방법론을 제안함
  • 추가적인 모델 학습 단계나 번역 시스템 없이 오직 이중 언어 어휘집만 필요로 하여 비용이 거의 들지 않음
  • 8개 언어와 5가지 모델 크기에 걸쳐 평가한 결과, 대상 언어의 다운스트림 작업 성능이 향상되었으며 동일 성능 도달까지 최대 2배의 학습 속도 향상을 보임
Notable Quotes & Details
  • LINK
  • 8 languages
  • 5 model sizes
  • up to a 2x speedup

다국어 자연어 처리 모델 연구자 및 저자원 언어의 지식 전이 기술에 관심이 있는 개발자

Scaling Laws for Mixture Pretraining Under Data Constraints

데이터 제약이 있는 상황에서 대규모 언어 모델을 학습시키기 위한 최적의 데이터 혼합 비율과 반복 학습의 한계를 분석한 연구입니다.

  • 희소한 고가치 대상 데이터를 풍부한 일반 데이터와 혼합해 사전 학습할 때 발생하는 상호 절충 관계를 분석했습니다.
  • 일반 데이터가 혼합된 학습 환경은 단일 출처 학습보다 데이터 반복을 훨씬 더 잘 견디며, 대상 데이터는 15~20회까지 재사용 가능합니다.
  • 반복된 토큰의 가치 감소 및 일반 데이터의 규제 역할을 반영하는 반복 인식 혼합 스케일링 법칙을 제안했습니다.
Notable Quotes & Details
  • 2,000
  • 15–20
  • September 26, 2025

인공지능 연구원, 대규모 언어 모델 학습 엔지니어 및 데이터 효율성 관련 개발자

Bring the Fire: Play Games on GeForce NOW With New Firefox Browser Support

엔비디아 GeForce NOW가 파이어폭스(Firefox) 브라우저 지원을 시작하여 다운로드 없이 웹 브라우저에서 고성능 PC 게임을 즐길 수 있게 되었으며, 이번 주 12개의 신작 게임이 라이브러리에 추가되었습니다.

  • GeForce NOW가 크롬, 엣지, 오페라에 이어 파이어폭스 브라우저 지원을 공식 시작함
  • GeForce NOW Ultimate 회원은 파이어폭스 브라우저를 통해 최대 1440p 해상도 및 120fps의 RTX 기반 성능으로 게임 플레이 가능
  • WW1 게임 시리즈의 최신작인 'Gallipoli'를 포함하여 총 12개의 신작 게임이 이번 주에 스트리밍 서비스로 추가됨
Notable Quotes & Details
  • 12 new games
  • RTX-powered performance at up to 1440p and 120 frames per second
  • 25v25
  • Aug. 18
  • Aug. 20

웹 브라우저를 통해 편리하게 고사양 PC 게임을 즐기려는 게이머 및 GeForce NOW 사용자

Serval’s super agent Catalyst creates roving background agents to identify and fix IT issues before they’re ticketed

Serval이 기업 자동화 구축을 위해 AI 에이전트들이 스스로 자동화 대상을 결정하고 워크플로우를 생성하는 관리자용 '슈퍼 에이전트' Catalyst를 공식 출시했습니다.

  • Catalyst는 티켓 이력, 표준운영절차(SOP), 자연어 지시사항 등을 분석해 반복 작업을 감지하고 관련 워크플로우, 스킬, 대시보드 등을 자동으로 초안 작성합니다.
  • 연결된 시스템을 지속적으로 검사하여 문제가 발생하기 전에 예방적으로 해결책을 제안하는 백그라운드 에이전트 생성 기능을 제공합니다.
  • 자체 파운데이션 모델을 구축하는 대신 Okta, Google Workspace, Microsoft Entra 등과 연동되어 백엔드에서 TypeScript 코드로 구동되는 유연한 모델 구조를 취합니다.
Notable Quotes & Details
  • Thursday
  • TypeScript
  • "You just started with a single prompt, and now you’ve got enterprise-grade workflows ready to deploy that are going to solve all password resets for the entire company,"

기업 IT 관리자 및 시스템 운영팀

Stripe agrees to buy OpenRouter as AI model routing expands

온라인 결제 플랫폼 Stripe가 개발자들에게 수백 개의 AI 모델을 단일 API로 제공하는 AI 모델 라우팅 플랫폼 OpenRouter를 인수하기로 합의했습니다.

  • Stripe는 OpenRouter 인수를 통해 기존 AI 사용량 및 토큰 기반 과금 서비스에 모델 선택 및 라우팅 기능을 추가합니다.
  • OpenRouter는 80개 이상의 제공업체가 서비스하는 400개 이상의 모델을 지원하며, 작업 복잡도, 가격, 속도, 신뢰성 등에 따라 요청을 최적의 모델과 제공업체로 라우팅합니다.
  • 라우팅 기능은 비용 절감뿐만 아니라 특정 제공업체의 장애, 속도 제한 발생 시 대체 경로로 요청을 전달하는 장애 극복(Failover) 기능과 데이터 보존 규정 준수 기능도 제공합니다.
Notable Quotes & Details
  • 400개 이상의 모델
  • 80개 이상의 제공업체
  • 2026년 6월 예시에서 Llama 3.3 70B의 입력 가격은 DeepInfra를 통해 백만 토큰당 $0.10, Together를 통해 $1.04로 차이 발생
  • F5의 2026년 애플리케이션 전략 보고서에 따르면 52%의 조직이 여러 AI 모델을 체이닝하거나 오케스트레이션하며 평균 7개의 모델을 사용

AI 모델 인프라 및 다중 모델 라우팅 기술, 그리고 Stripe의 AI 비즈니스 확장에 관심이 있는 개발자와 IT 의사결정자

Agentic AI in government just hit the hard part: deciding what a machine may decide

아랍에미리트(UAE) 정부가 연방 정부 업무의 절반을 에이전틱 AI로 전환하는 프로젝트를 추진하며 기계가 스스로 결정할 수 있는 범위를 분류하는 기준 마련에 착수했다.

  • UAE는 2년 내에 연방 정부의 운영, 서비스, 업무의 50%를 에이전틱 AI 모델로 전환하는 국가적 프로그램의 전략 트랙을 시작했다.
  • 정부 관료들은 자율 시스템이 완전히 처리할 수 있는 작업과 단순히 권장만 할 수 있는 작업 사이의 경계를 구분하는 분류 기준 및 거버넌스 프레임워크를 논의하기 시작했다.
  • 이 프로젝트는 '인간이 주도하고 AI는 지원한다'는 원칙과 '인간의 개입 없는 자율적 실행'이라는 두 가지 관점을 조율하며 에이전트의 오작동 시 책임 소재에 대한 과제를 안고 있다.
Notable Quotes & Details
  • October 2017
  • 27
  • 100
  • half of federal government operations, services, and tasks to agentic AI models within two years
  • 150 million
  • Sheikh Mohammed bin Rashid Al Maktoum: the first government in the world to largely deploy Agentic AI models

AI 거버넌스 및 행정 기술 정책에 관심이 있는 정부 관료, AI 업계 분석가, 공공 부문 기술 결정권자

A third of ChatGPT ads appear in irrelevant conversations

ChatGPT 내부 광고의 약 3분의 1이 사용자의 대화 흐름과 전혀 상관없는 무관한 대화에 노출되고 있다는 분석 결과가 나왔습니다.

  • AI 가시성 플랫폼인 Searchable이 2026년 7월 4일부터 8월 4일까지 ChatGPT 내에 노출된 11,000개 이상의 광고를 분석한 결과, 전체 광고의 33%가 대화와 아무런 연관이 없는 것으로 나타났습니다.
  • 광고가 게재된 대화의 68%는 사용자가 구매, 예약, 고용 또는 비교 등의 구매 의도를 전혀 보이지 않은 대화였습니다.
  • 광고주가 속한 업종에 따라 불일치율이 크게 달랐으며, 마케팅 및 B2B 서비스(47%)와 소프트웨어 및 SaaS(45%) 분야의 무관 광고 노출율이 가장 높았습니다.
Notable Quotes & Details
  • 11,000
  • 2026년 7월 4일
  • 2026년 8월 4일
  • 33%
  • 27%
  • 40%
  • 68%
  • 47%
  • 45%

마케터, 광고주, AI 업계 관계자 및 비즈니스 분석가

AI data centre regulation just got a template that needs no new law

미국 펜실베이니아주가 새로운 법률 제정 없이 기존 인허가 권한과 정보 공개 의무화를 통해 AI 데이터 센터를 규제하는 행정명령을 시행했습니다.

  • 데이터 센터 개발사는 인허가 검토 전 GRID 요구사항이 담긴 합의서 서명 및 지역 사회의 승인을 먼저 획득해야 합니다.
  • 주정부 기관과의 거래에서 데이터 센터 프로젝트 관련 비밀유지계약(NDA) 사용이 전면 금지됩니다.
  • 개발사는 프로젝트에 필요한 발전, 송전, 배전 비용을 전액 부담해야 하며 연간 에너지 및 용수 소비량을 의무적으로 보고해야 합니다.
Notable Quotes & Details
  • Executive Order 2026-05
  • Tuesday
  • 100
  • 58
  • 15
  • 5

AI 데이터 센터 개발사, 정책 입안자, 환경 규제 관계자 및 지역 사회 주민

Notes: 본문 뒷부분이 일부 생략되어 있으나 핵심 규제 내용 및 수치는 분석 가능함

HoneyBook bets on agentic AI to streamline small business operations with its new Claude connector

허니북(HoneyBook)이 소규모 자영업자들의 업무 효율성을 높이기 위해 앤트로픽의 AI 비서 클로드와 연동되는 새로운 MCP 커넥터를 출시했습니다.

  • 대기업과 달리 AI 인프라가 부족한 소규모 독립 기업들이 클로드와 같은 AI 비서를 통해 비즈니스 데이터를 쉽게 활용할 수 있도록 지원합니다.
  • 사용자는 허니북 MCP를 통해 클로드에게 리드 상태나 송장 납부 여부를 질문하고 즉각적인 답변을 얻을 수 있으며, 메일 알림 발송이나 계약서 작성 등의 작업을 자동화할 수 있습니다.
  • 최근 조사에 따르면 AI를 도입한 소상공인은 그렇지 않은 이들에 비해 약 5배 많은 매출을 올리는 등 AI 도구가 생산성 향상에 큰 기여를 하고 있습니다.
Notable Quotes & Details
  • McKinsey’s recent State of AI survey found that nearly half of companies with more than $5 billion in revenue have moved AI beyond pilots and into everyday use across the business, compared with just 29% of companies under $100 million in revenue
  • A recent HoneyBook study revealed that small business owners who’ve adopted AI earn almost five times as much revenue as those that haven’t.
  • 68%
  • 52%

소규모 비즈니스 운영자, AI 도구 도입에 관심이 있는 자영업자 및 개발자

Meta AI’s new Mac app wants you to talk to your apps

메타가 시스템 전체 음성 입력 및 화면 분석 기능을 갖춘 새로운 Mac용 Meta AI 앱을 출시하고 비즈니스용 기능을 업데이트했습니다.

  • 메타가 화면 분석을 위한 Muse Spark 모델과 시스템 전반의 받아쓰기 기능을 내장한 새로운 Mac용 Meta AI 앱을 발표했습니다.
  • 판매자가 인스타그램, 페이스북, 메타 광고 캠페인 및 구글 워크스페이스를 Meta AI에 연결해 분석 정보와 경쟁사 동향을 파악할 수 있는 비즈니스 업데이트를 출시했습니다.
  • Meta AI는 비즈니스 도구들과의 연동을 통해 제안서 덱, 문서 초안, 스프레드시트 등을 생성하고 고객 지원 자동화를 지원합니다.
Notable Quotes & Details
  • Gemini app for Mac
  • Q2 2026
  • Mark Zuckerberg: "there is a big opportunity to sell agents to businesses and automate work on their behalf"

인공지능 서비스 사용자, Mac 운영체제 이용자, 메타 광고 및 플랫폼을 활용하는 기업 및 소상공인

Welcome to the AI crisis in math

AI가 수학 분야에 미치는 영향과 이로 인해 일류 수학자들이 겪고 있는 실존적 위기에 관한 이야기입니다.

  • OpenAI가 발표한 수학 문제 해결책들이 수학계에 큰 논란과 토론을 불러일으켰습니다.
  • 초등학교 수준의 산수에는 약한 AI가 고도의 추상 수학에서는 점점 더 뛰어난 성능을 보여주는 현상이 발생하고 있습니다.
  • AI가 고난도 수학을 해결함에 따라 미래 수학자의 역할, 대학 교육 및 연구 지원금의 효용성 등에 대한 의문이 제기되고 있습니다.
Notable Quotes & Details
  • Robert Hart
  • OpenAI
  • 2024

AI 기술의 발전이 학문적 연구 및 수학계에 미치는 영향에 관심이 있는 대중 및 전문가

Slack is launching collaborative vibe-coding channels

슬랙이 개발 팀이 AI 에이전트와 공동으로 작업할 수 있는 전용 '슬랙 코드' 채널을 출시했습니다.

  • 개발자들은 Claude나 Devin 같은 AI 코딩 에이전트를 소환해 코드 변경 사항 비교, HTML 미리보기 등을 포함한 공동 코딩 채널을 개설할 수 있습니다.
  • 코딩 채널은 할당된 작업이 완료되면 자동으로 아카이브되며 기록 보존을 위한 감사 로그를 제공합니다.
  • 슬랙 코드는 오늘부터 모든 슬랙 요금제에서 바로 사용 가능하며, Claude Code, Devin, Vercel Agent, GitHub Copilot 등의 파트너 에이전트들과 원활하게 연동됩니다.
Notable Quotes & Details
  • “With Slack Code, when you have an idea or need to build a new feature, update a web page, or fix a bug, you simply tag in a coding agent like Anthropic’s Claude or Cognition’s Devin, and that agent then spins up a code channel to tackle the task”

협업 및 AI 에이전트 도입에 관심이 있는 소프트웨어 개발 팀 및 프로젝트 관리자

Auditing Preference Biases and Fine-Tuning Language Models with Direct Preference Optimization on Anthropic HH-RLHF Using TRL and LoRA

Anthropic HH-RLHF 데이터셋과 DPO(Direct Preference Optimization), TRL 및 LoRA를 사용하여 언어 모델의 선호도 편향을 감사하고 파인튜닝하는 종단간 선호도 학습 워크플로우 튜토리얼입니다.

  • Qwen2.5-0.5B-Instruct 모델을 기반으로 DPO 및 LoRA 어댑터를 적용하여 파인튜닝을 수행합니다.
  • 선택된 응답(chosen)과 거부된 응답(rejected) 쌍을 분석하여 어휘적 지름길 진단 및 구조적/길이 기반 선호도 편향을 감사합니다.
  • TRL 라이브러리와 호환되는 토크나이저 인식 길이 필터링이 포함된 DPO 학습 파이프라인을 구축합니다.
Notable Quotes & Details
  • Qwen/Qwen2.5-0.5B-Instruct
  • BETA = 0.1
  • MAX_STEPS = 30

언어 모델 파인튜닝, DPO 선호도 학습 및 RLHF 편향 감사를 구현하려는 AI 연구원 및 개발자

How to Build a Career in AI: 3 Distinct Pathways

AI 분야에서 경력을 쌓기 위한 세 가지 서로 다른 경로와 각 경로에 필요한 기술 및 역할에 대해 설명합니다.

  • AI 분야는 수학적 연구, 소프트웨어 엔지니어링, 실무 문제 해결 등 다양한 영역으로 나뉘며 직무 타이틀이 같아도 실제 업무는 다를 수 있습니다.
  • 빌더(Builders) 경로는 모델을 안정적으로 확장 및 운영하는 데 집중하며, 알고리즘 자체의 발명보다는 데이터 파이프라인 구축 및 소프트웨어 엔지니어링 기초가 더 중요합니다.
  • 대표적인 역할로는 예측 모델을 확장하는 머신러닝 엔지니어, 데이터를 수집·정제하는 데이터 엔지니어, API를 제품에 통합하는 AI 개발자가 있습니다.
Notable Quotes & Details
  • Over three years of mentoring data science students across more than a thousand sessions

AI 분야로 커리어를 시작하거나 전환하려는 학생 및 개발자

Notes: 내용 일부 생략됨

Top 10 Open-Source Benchmarks for AI Coding Agents in 2026

AI 코딩 에이전트를 평가하기 위한 10대 오픈소스 벤치마크에 대한 소개 및 분석

  • 현대의 에이전트식 코딩 벤치마크는 단순한 함수 작성을 넘어 실제 저장소 내에서의 코드 수정, 명령어 실행, 디버깅 등 종합적인 소프트웨어 엔지니어링 능력을 평가합니다.
  • SWE-bench는 실제 GitHub 이슈를 해결하는 패치 생성 능력을 측정하는 표준 기준으로, 12개 Python 저장소의 2,294개 작업을 포함하고 있어 여전히 가장 널리 쓰이는 표준 기준점 역할을 합니다.
  • Terminal-Bench는 에이전트가 샌드박스 터미널 환경에서 컴파일, 종속성 설치, 테스트 실행 등 실제 개발자처럼 쉘 명령어를 다루고 문제를 해결할 수 있는지 평가합니다.
Notable Quotes & Details
  • 2,294
  • Terminal-Bench 2.1
  • 1,865
  • 41

AI 코딩 에이전트 개발자 및 연구자, 그리고 성능 평가 기준에 관심이 있는 소프트웨어 엔지니어

Position: Collusion Risks Among AI Reasoning Agents Justify Certification Requirements for Making Market Decisions

AI 추론 에이전트들이 시장 의사결정에 참여할 때 발생할 수 있는 암묵적 담합 위험성을 경고하고 행동 인증 요구사항의 필요성을 제기하는 연구이다.

  • 생각의 흐름(chain-of-thought) 추론 능력을 가진 AI 에이전트들은 인간의 담합 방지 프롬프트 지시에도 불구하고 독점 가격 책정 영역에서 암묵적으로 담합하는 경향을 보인다.
  • 이러한 에이전트들의 추론 과정은 매우 협력적이거나 경쟁적인 행동으로 유도될 수 있으며, 이는 다른 거대언어모델(LLM)이 추론 흔적을 의미론적으로 분석하는 방식으로는 감지할 수 없다.
  • 따라서 공모나 의도의 증거 없이도 담합이라는 경제적 결과가 초래될 수 있으므로, 에이전트를 실제 시장에 배치하기 전에 대표적인 상황에서의 행동 관찰을 기반으로 한 포괄적인 행동 인증이 필요하다.
Notable Quotes & Details
  • arXiv:2608.18078
  • DeepSeek-R1

AI 연구자, 경제학자, 시장 규제 당국 및 정책 입안자

Position: Profiling Game Worlds by Transition Complexity

게임 월드 모델링과 강화학습 연구에서 환경의 상태 전이 예측 난이도를 정량화하기 위해 표준화된 메트릭 세트인 '전이 복잡도 프로필(TCP)'을 제안하는 논문입니다.

  • 게임 월드 모델링(GWM) 및 강화학습(RL) 연구에서 대상 환경의 전이 예측이 얼마나 어려운지 정량화하기 위해 '전이 복잡도 프로필(TCP)'을 제안함
  • TCP는 고유한 1단계 분기, 상호작용으로 유발되는 불확실성 및 관찰 가능한 상대방의 영향, 표준화된 프로브 곡선을 통한 시공간적 의존성 스팬 등 3가지 핵심 메트릭으로 환경을 정의함
  • 연구 결과의 비교 가능성을 높이기 위해 GWM 및 RL 관련 논문에 TCP를 표준 벤치마크 메타데이터이자 필수 통계로 도입할 것을 촉구함
Notable Quotes & Details
  • arXiv:2608.18079v1

게임 월드 모델링(GWM) 및 강화학습(RL) 분야의 AI 연구원 및 개발자

Large Language Models in Mental Health: A Systematic Review of Applications, Innovations, and Ethical Challenges

정신 건강 분야에서 거대 언어 모델(LLM)의 응용, 혁신 및 윤리적 과제에 대한 체계적인 검토 연구입니다.

  • 소셜 미디어 분석, 임상 대화 에이전트, 치료 지원 도구 등 다양한 정신 건강 분야에서의 LLM 활용 방안을 검토함
  • 우울증 조기 발견, 자살 위험 평가, 개인 맞춤형 치료 지원을 위해 소셜 미디어 게시물, 전자의무기록(EMR) 및 멀티모달 데이터를 통합함
  • 정신 건강 진단 및 모니터링을 개선하기 위해 텍스트, 음성, 센서 데이터를 결합하는 멀티모달 융합 기술의 발전을 다룸
Notable Quotes & Details
  • arXiv:2608.18080v1

AI 정신 건강 연구자, 임상의, 의료 기술 개발자 및 정책 입안자

Position: Behavioral Systems Require Behavioral Tests

인공지능 에이전트 시스템을 동적 환경과의 상호작용, 목표 추구, 시간 경과에 따른 적응을 수행하는 행동 시스템으로 보고, 그에 걸맞은 체계적인 행동 테스트를 도입해야 한다는 주장입니다.

  • 현재의 AI 평가는 단순히 결과적인 성능에만 집중되어 있어, 그 결과를 도출하는 기저의 행동 과정을 평가하지 못하고 있습니다.
  • 행동과학 연구의 교훈을 바탕으로 체계적인 관찰, 섭동(perturbation), 행동 해석을 결합한 AI 행동 테스트 프레임워크를 제안합니다.
  • 행동 시퀀스에서 의사결정 전략을 복구하고, 행동 차이를 고립시키는 환경을 구축하며, 다중 에이전트 시스템에서 나타나는 발현적 동학을 조사하는 연구 로드맵을 제시합니다.
Notable Quotes & Details
  • arXiv:2608.18081v1

AI 연구자, 에이전트 시스템 평가자, AI 행동과학 분야 학자

Position: Current Model Cards Are Insufficient for Downstream Governance of Open-Weight Foundation Models

오픈 가중치 기반 모델(OWFM)의 하류 거버넌스를 위해 기존 모델 카드의 한계를 분석하고 모델 카드, 허용 사용 정책(AUP), 라이선스를 통합한 다층적 프레임워크의 필요성을 제안하는 논문입니다.

  • Hugging Face에 게시된 500개의 모델 카드를 분석하여 현재의 모델 카드 프레임워크가 오픈 가중치 기반 모델의 고유한 안전성 과제를 하류 개발자와 사용자에게 충분히 전달하지 못하고 있음을 밝혀냈습니다.
  • 표준 오픈 소스 라이선스(OSL)는 오픈 가중치 기반 모델에 적합하지 않으며, 허용 사용 정책(AUP)의 법적 구속력을 약화시킬 수 있음을 지적했습니다.
  • 효과적인 거버넌스를 구축하기 위해 정보적, 규범적, 법적 차원을 일관되게 통합하는 모델 카드, 허용 사용 정책(AUP), 라이선스의 발전 방향을 제시했습니다.
Notable Quotes & Details
  • arXiv:2608.18086v1
  • 500 model cards hosted on Hugging Face

AI 연구자, 오픈 소스 AI 개발자, AI 정책 입안자 및 법률 전문가

Entropy-Constrained Adaptive Stochastic Quantization

손실 없는 엔트로피 인코더의 압축 효율을 고려하여 MSE(평균 제곱 오차)를 최소화하고 편향성을 유지하는 새로운 적응형 확률 양자화 방법인 ECASQ(Entropy Constrained Adaptive Stochastic Quantization)를 제안하는 논문입니다.

  • 기존의 적응형 확률 양자화(ASQ) 방식은 편향성을 유지하면서 MSE를 최적화하지만, 후속 단계인 엔트로피 인코딩 과정을 고려하지 않아 성능 향상의 기회를 놓쳤습니다.
  • 엔트로피 예산 제한 및 편향성 제약 하에서 MSE를 최소화하기 위해 양자화 값을 공동 선택하는 ECASQ 문제를 공식화하였습니다.
  • 길이 d인 벡터와 최대 s개의 양자화 값에 대해 O(sd^2) 시간 복잡도를 갖는 최적의 동적 계획법 알고리즘 및 GPU에 친화적인 근사 동적 계획법 알고리즘, 그리고 이를 개선하는 반복 정제 절차를 제시하였습니다.
Notable Quotes & Details
  • arXiv:2608.18147v1
  • O(sd^2) time
  • O(d^2) space
  • O(d) space

기계 학습 모델 압축, 그래디언트/KV-캐시 압축, 통신 및 메모리 병목 해결 등을 연구하는 AI 연구원 및 엔지니어

Towards Reversible Forgetting: Managing Obsolete Knowledge in Continual Enterprise AI Agents

비정상 환경에서 작동하는 기업용 AI 에이전트를 위해 쓸모없어진 지식을 관리하고 필요시 복구할 수 있는 '가역적 망각(reversible forgetting)' 프레임워크를 제안합니다.

  • 비정상 환경의 기업용 AI 에이전트에게 무조건적인 지식 보존은 오히려 잘못된 결정과 운영 위험을 초래할 수 있으므로 가역적 망각이 필요합니다.
  • 제안된 프레임워크는 메모리를 활성(active), 휴면(dormant), 은퇴(retired)의 세 가지 상태로 관리하며, 휴면 상태의 지식을 다시 복구하는 상태 전이를 포함합니다.
  • 이 프레임워크를 히스테리시스 가역적 메모리 컨트롤러로 구현하여 관련성 증거 축적, 상태 진동 방지를 위한 비대칭 임계값 사용, 섀도 모드에서의 재활성화 테스트, 정책 기반 은퇴 처리 등을 수행합니다.
Notable Quotes & Details
  • arXiv:2608.18177v1

지속 가능 학습(continual learning) 및 기업용 AI 에이전트 시스템을 설계하는 AI 연구자 및 엔지니어

Accelerating Visual On-Policy Distillation with Batched Speculative Jacobi Rollouts

비주얼 온-정책 증류(OPD) 학습 속도를 가속화하기 위해 독립적인 디코딩 진행과 배치 검증을 지원하는 새로운 롤아웃 백엔드 HB-SJD를 제안하는 연구입니다.

  • 비주얼 온-정책 증류(OPD)에서 학생 모델의 온라인 롤아웃 생성 시 발생하는 자동회귀 디코딩의 비용 문제를 해결하고자 함
  • 보조 드래프트 모델 없이 병렬 토큰 처리가 가능한 Speculative Jacobi Decoding(SJD)을 기반으로 한 배치형 롤아웃 백엔드 HB-SJD를 도입함
  • LlamaGen을 이용한 실험을 통해 학생 모델의 생성 품질을 유지하면서 롤아웃 및 전체 학습 시간을 크게 단축함을 입증함
Notable Quotes & Details
  • arXiv:2608.18183v1
  • LlamaGen

AI 및 컴퓨터 비전 연구자, 대형 모델 증류 및 최적화 분야 엔지니어

H$^2$EDL: Hyper Evidential Deep Learning for Hierarchical Classification

계층 구조를 갖는 분류 문제에서 미세 분류와 중간 개념의 불확실성을 효과적으로 표현하기 위해 트리 구조의 하이퍼 증거 모델을 제안하는 연구입니다.

  • 기존 증거 분류기와 계층 분류기의 한계를 극복하기 위해 분류 체계(taxonomy) 자체를 하이퍼 도메인으로 활용하는 H$^2$EDL 모델을 제안했습니다.
  • 각 분기 노드당 하나의 로컬 디리클레 의견(Dirichlet opinion)을 통해 모든 합성 질량을 닫힌 형식(closed form)으로 유도하여 계층 구조 내 일관성을 유지합니다.
  • FGVC-Aircraft 및 DERM12345 데이터셋 실험에서 교차 엔트로피 베이스라인 대비 캘리브레이션 오차를 약 절반으로 줄였으며, 계층이 깊어질수록 개선 효과가 더 뚜렷했습니다.
Notable Quotes & Details
  • arXiv:2608.18185v1
  • FGVC-Aircraft
  • DERM12345

계층적 분류 및 불확실성 정량화(uncertainty quantification)를 연구하는 AI 연구원 및 엔지니어

What Can Artificial Intelligence Learn from Medicine? Generative Analogies and Reliable Machine Learning Systems

의학의 임상 번역 과정과의 생성적 비유를 통해 머신러닝 시스템의 인식론적 및 방법론적 신뢰성을 확보하는 방안을 분석하고 새로운 형태의 머신러닝 신뢰주의를 제시하는 논문입니다.

  • 의학 임상 번역의 기준을 머신러닝 시스템 구축 과정에 적용하여 머신러닝의 인식론적 및 방법론적 보증 기준을 모형화합니다.
  • 헤세의 분석 방법론을 활용하여 임상 번역과 머신러닝 개발 프로세스 간의 생성적 비유(Generative Analogy) 특성을 규명합니다.
  • 임상 번역의 보증을 신뢰주의 관점에서 해석하고, 이를 바탕으로 기존 인공지능 철학의 신뢰주의와 구별되면서도 호환 가능한 새로운 머신러닝 신뢰주의를 제안합니다.
Notable Quotes & Details
  • arXiv:2608.18186v1

인공지능 철학 연구자, 머신러닝의 신뢰성 및 방법론적 보증을 연구하는 AI 연구자

LongNovel: A Multi-Scale Benchmark for Hallucination Detection in Long-Context Novel Summarization

긴 소설 요약 과정에서 발생하는 환각 현상을 탐지하고 분석하기 위한 다중 스케일 벤치마크인 LongNovel을 제안한다.

  • 소설 요약에서 문맥 길이가 길어짐에 따라 환각 현상이 어떻게 변화하는지 탐지하는 LongNovel 벤치마크 제안
  • 16k에서 100k 토큰 크기의 중국어 소설 29편과 BookSum 데이터셋의 챕터 수준 데이터를 기반으로 구축
  • 8가지 환각 유형을 설계하고 다중 모델 중재 및 엔티티 참조 환각 생성 방식을 결합하여 신뢰성을 확보하고 테스트 세트는 수동 교정 진행
Notable Quotes & Details
  • arXiv:2608.18082
  • 16k to 100k tokens
  • 29 Chinese novels
  • 8 hallucination types
  • https://github.com/BDML-lab/LongNovel

자연어 처리 및 대규모 언어 모델의 환각 탐지 기술을 연구하는 AI 연구원 및 개발자

Compiler-Guided Adaptive Proof Search with Cross-Model Synergy on Context-Dependent Theorem Proving

Lean 4 프로젝트의 문맥 의존적 정리 증명을 위해 컴파일러의 피드백을 활용하여 탐색과 활용의 균형을 맞추는 교차 모델 시너지 기반의 컴파일러 가이드 적응형 증명 탐색 프레임워크를 제안합니다.

  • 실제 Lean 4 프로젝트의 정리 증명은 프로젝트 고유의 문맥에 의존하므로 실패한 증명을 복구하고 재사용하기 위해 세심한 탐색 제어가 필요합니다.
  • 이중 모델 생성 및 정체 유발 리샘플링을 통한 다양성 탐색과 컴파일러 기반 pairwise 비교에 기반한 최선 정제 기법을 결합한 프레임워크를 제안합니다.
  • miniCTX-v2의 7개 Lean 4 프로젝트 실험 결과, pass@32 예산 내에서 LLM 호출을 21.9% 줄이면서 평균 통과율을 12.8%포인트 향상시켰습니다.
Notable Quotes & Details
  • pass@32
  • 12.8 percentage points
  • 21.9%

인공지능 기반 정리 증명, Lean 4 컴파일러 가이드 증명 탐색, 거대언어모델(LLM) 추론 효율성 연구자

Persona-Guided LLM Agents for Task-Oriented Dialogue

작업 지향 대화(TOD) 환경에서 거대언어모델(LLM) 에이전트의 페르소나 표현 및 사용자 맞춤 어댑테이션의 효과와 한계를 분석한 연구입니다.

  • LLM 기반 사용자 에이전트가 특정 성격을 표현하면서도 시스템 에이전트가 작업 완료 성능을 저하시키지 않고 대화를 수행할 수 있음을 확인했습니다.
  • 사용자의 성격에 맞추어 대응(Adaptation)하는 것은 제약 조건 만족도, 정보 제공율, 사용자 만족도를 향상시키지만, 사실성(Truthfulness)을 낮추어 개인화와 작업 기반화 간의 트레이드오프가 존재함을 밝혔습니다.
  • 성격 단서를 추론하여 대응하는 방식(Try)이 미세조정(Fine-tuning) 없이 성격 인식 작업 지향 대화를 구현하는 가장 신뢰할 수 있는 대안임을 입증했습니다.
Notable Quotes & Details
  • arXiv:2608.18085v1
  • GPT-4o
  • Qwen3-Next-80B
  • Gemini 2.0 Flash
  • Schema-Guided Dialogue (SGD)

인공지능 연구자 및 대화형 AI 시스템 개발자

SuTRA : Structurally-Unified Tokenization with Root Awareness

어근과 접사 관계 및 인도어군(Indic)의 정서적 음절 단위를 보존하기 위해 어형 분쇄 현상을 방지하는 새로운 형태소 인식 토크나이저 알고리즘 SuTRA를 제안합니다.

  • 기존 빈도 기반 하위 단어 토크나이저가 유발하는 어근과 접사의 임의적 분할(어형 분쇄) 문제를 극복하고자 합니다.
  • 인도어군의 음절(akshara)의 불가분성을 유지하고 형태소 경계를 넘는 병합에 페널티를 부여하는 SuTRA 알고리즘을 제안합니다.
  • 힌디어, 마라티어, 구자라트어에 대한 새로운 형태소 분할 데이터셋을 출시하고, 기계 번역에서 평균 +8.08 chrF2의 향상을 달성했습니다.
Notable Quotes & Details
  • +14.7% (형태소 정렬 Boundary F1 최고 이득)
  • +34% (힌디어 의미 복구 가능성 향상)
  • +8.08 chrF2 (기계 번역 평균 개선도)

자연어 처리(NLP) 연구원, 토크나이저 설계자 및 다국어/인도어군 번역 모델 개발자

Latent Space Refusal Anchoring for Low-Resource African Languages: Mechanistic Safety Recovery Without Retraining

저자원 아프리카 언어에서 안전 정렬(거부 메커니즘)이 제대로 작동하지 않는 문제를 해결하기 위해, 재학습 없이 추론 시점에 거부 방향을 고정하여 안전성을 회복하는 '잠재 공간 거부 고정(LSR-Anchoring)' 기법을 제안합니다.

  • 영어에서는 거부되는 유해한 요청이 요루바어, 이보어, 이갈라어, 하우사어 등 저자원 아프리카 언어에서는 허용되는 다국어 안전 탈옥 문제를 지적함
  • 재학습이나 라벨링된 타깃 언어 데이터 없이 추론 시점에 거부 활성화 방향을 주입하는 LSR-Anchoring(MAS 및 SDS 변형) 기법을 도입하여 안전성을 회복함
  • Mistral 및 Qwen 모델에서는 성능 저하를 0.08 미만으로 유지하며 안전성을 회복했으나, Llama-3-8B에서는 과도하게 거부하는 문제를 희소 오토인코더(SAE) 피처를 사용한 SDS 방식으로 완화함
Notable Quotes & Details
  • arXiv:2608.18089v1
  • 0.08
  • 1.00
  • 3.5-7x
  • 0.35

AI 안전 연구원, 다국어 LLM 개발자, 저자원 언어 처리(NLP) 연구자

AI 답변을 그대로 붙여넣지 마세요

AI가 생성한 답변을 가공 없이 그대로 상대방에게 전달하지 말고, 직접 검토하여 자신의 의견을 담아 전달해야 한다는 조언입니다.

  • 상대방은 AI의 일반적인 답변이 아니라 답변자의 맥락, 취향, 판단이 담긴 답변을 원합니다.
  • AI는 초안 작성 파트너로만 활용하고, 생성된 답변 중 실제 질문에 답하는 핵심 부분만 추려 자신의 견해와 함께 작성해야 합니다.
  • 의견을 전달할 때 모델 답변 전체를 붙여넣는 것보다 직접 정리한 세 문장을 보내는 것이 훨씬 효과적입니다.
Notable Quotes & Details
  • nohello.net
  • dontasktoask.com

일상 업무나 협업 과정(DM, Slack, PR 리뷰 등)에서 AI 도구를 활용해 소통하는 모든 사용자

Show GN: 오마이한글 rhwp기반 안드로이드용 한글문서 편집앱

오픈소스 HWP 파서인 rhwp를 기반으로 인터넷 연결 없이 사용 가능한 안드로이드용 한글 문서 편집 앱 '오마이한글'이 출시되었습니다.

  • 오픈소스 HWP 파서 rhwp를 기반으로 하며 최근 v0.8.4, 8,300여 커밋이 반영된 업스트림을 지속해서 따라갑니다.
  • 사용자가 Anthropic, OpenAI 등의 API 키를 입력하여 LLM을 통해 문서 편집 보조 기능을 사용할 수 있는 BYOK AI를 지원합니다.
  • Kotlin/Compose 기반으로 제작되었고 targetSdk 36을 준수하며 한글 세리프 폰트 3종이 번들로 제공됩니다.
Notable Quotes & Details
  • v0.8.4
  • 8,300여 커밋
  • targetSdk 36
  • https://play.google.com/store/apps/details?id=com.clawsouls.omh

안드로이드 기기에서 HWP 문서를 오프라인으로 편집하고 AI 보조 기능을 활용하고자 하는 사용자 및 개발자

Google, 일부 소스 코드의 Git 태그 배포를 Google Drive 요청 방식으로 대체

구글이 일부 안드로이드 소스 코드의 배포 방식을 기존 Git 태그 공개에서 구글 드라이브 신청 방식으로 변경하면서 개발 지연 및 GPLv2 위반 논란이 발생하고 있다.

  • 구글이 소스 코드 배포를 Git 태그 게시 대신 구글 폼 신청 후 구글 드라이브 tarball 접근 권한을 부여하는 수동 방식으로 변경하여 GrapheneOS 등의 개발 흐름에 불편을 초래함
  • 접근 권한 승인 기간이 수 시간에서 수 주로 늘어났으며, Git 저장소 구조와 리비전을 사용할 수 없어 빌드 및 개발 테스트가 지연됨
  • GrapheneOS는 이를 인위적인 소스 접근 지연이자 비통상적인 매체 제공으로 보고 GPLv2 위반이라 주장하며, 향후 전체 AOSP Git 저장소를 자체 호스팅할 계획임
Notable Quotes & Details
  • GrapheneOS
  • GPLv2
  • 2027년

안드로이드 ROM 개발자 및 오픈소스 라이선스 관계자

코드는 다 읽을 수 없고, 코드 리뷰가 맡아온 책임은 사라지지 않는다

AI 도입으로 코드 생성 속도가 급증하면서 기존 인간 중심의 코드 리뷰 프로세스가 한계에 직면하고 있으며, 이를 해결하기 위한 역할 분담과 AI 코드 리뷰 도구의 도입이 필요하다는 내용.

  • AI 도입도가 높은 팀일수록 중앙값 리뷰 소요 시간이 441.5% 증가하고 리뷰 없이 머지된 PR도 31.3% 증가하여 코드 리뷰 병목 현상이 발생하고 있습니다.
  • 소프트웨어 개발의 진짜 병목은 코드 작성이 아니라 리뷰, 테스트, 디버깅, 지식 이전, 협업에 있으며 코드 생성이 쉬워질수록 이해와 검증 비용이 더 커집니다.
  • 앞으로의 코드 리뷰는 인간이 모든 과정을 diff로 읽던 방식에서 벗어나 검증, 이해, 지식 전달, 승인 등의 책임을 어떻게 나누고 AI 도구를 어떻게 활용할 것인가의 문제로 전환되고 있습니다.
Notable Quotes & Details
  • 중앙값 리뷰 소요 시간은 441.5% 증가
  • 리뷰 없이 머지된 PR도 31.3% 증가
  • Faros AI가 4,000개 팀 22,000명의 2년치 텔레메트리를 분석
  • AI를 매일 쓰는 개발자는 비사용자보다 약 4배의 원시 산출량을 냈지만, 1년 전 자신과 비교한 생산성 향상은 약 12%

소프트웨어 개발자, 개발 팀장, 기술 관리자 및 AI 도입을 고민하는 개발 조직원

아직도 커밋 메시지를 직접 작성하는 이유

LLM이 커밋 메시지를 대신 작성할 수 있는 시대에도 개발자가 변경의 맥락과 '왜'를 담아 커밋 메시지를 직접 작성하는 과정이 가지는 가치와 중요성을 설명합니다.

  • 커밋 메시지는 단순한 변경 내용(What)의 반복이 아니라, 변경을 결정한 이유와 맥락(Why)을 담아야 합니다.
  • 변경 이유를 자신의 언어로 풀어쓰는 과정은 방금 작성한 코드를 올바르게 이해했는지 점검하고 더 나은 대안을 찾는 자기 검증 수단이 됩니다.
  • AI 보조 코드를 사용할 때 직접 메시지를 작성하고 설명하면 코드에 대한 책임감과 소유권을 확보할 수 있으며, 원자적 커밋 여부를 점검할 수 있습니다.
Notable Quotes & Details
  • 2014년 연구
  • Chris Beams의 커밋 메시지 작성 글

소프트웨어 개발자 및 기술 팀

About the impact of grouping classes in multiclass classification [D]

다중 클래스 분류에서 샘플 수가 적은 소수 클래스들을 하나의 '기타(Other)' 카테고리로 묶는 것이 모델 학습과 결정 경계 형성에 미치는 영향에 대한 질문입니다.

  • 데이터가 부족한 다중 클래스 분류에서 소수 클래스들을 '기타' 카테고리로 통합할 때 생길 수 있는 악영향에 대해 질문함
  • 서로 다르게 생긴 대상들이 하나의 카테고리로 묶일 경우 잠재 공간에서 비정상적이거나 복잡한 초평면(hyperplane)을 학습해야 할 수 있다는 직관을 제시함
  • 이를 해결하기 위해 소수 샘플을 분포 외(OOD) 데이터 검출 방식으로 처리하거나 해당 데이터를 제외하고 학습하는 것이 나을지 의견을 구함
Notable Quotes & Details

머신러닝 연구자 및 데이터 사이언티스트

The spectral neuron - an ML primitive for scalable and interpretable models [R]

확장 가능하고 해석 가능하며 제어하기 쉬운 머신러닝 프리미티브인 '스펙트럴 뉴런(The Spectral Neuron)' 모델의 수학적 원리와 학습 방법론을 제안합니다.

  • 야후 광고 팀에서의 경험을 바탕으로 단순함, 확장성, 해석 가능성, 제어 가능성을 동시에 갖춘 모델을 탐구하여 '스펙트럴 뉴런'이라는 논문과 코드를 발표했습니다.
  • 모델의 행렬 크기가 커짐에 따라 표현력이 어떻게 변화하는지, 학습된 행렬에서 무엇을 직접 읽어낼 수 있는지, 그리고 구조적으로 어떤 형태를 보장할 수 있는지 수학적으로 전개합니다.
  • 실용적인 초기화 및 훈련 방법을 개발하고 합성 데이터 및 실제 데이터를 활용한 확장성 실험을 통해 모델을 테스트했습니다.
Notable Quotes & Details
  • 𝑓(𝒙) = 𝛌ₖ(𝐀₀ + 𝚺ᵢ 𝑥ᵢ𝐀ᵢ)
  • https://arxiv.org/abs/2608.08003
  • https://github.com/alexshtf/spectral_neuron_paper

머신러닝 연구자 및 확장 가능하고 해석 가능한 AI 모델 설계에 관심이 있는 개발자

AI-generated code detection in CI/CD — looking for approaches and real-world experience [D]

Git/CI/CD 단계에서 AI가 생성한 코드를 감지하고 개발 출처를 보존하기 위한 실용적인 접근법과 경험 공유를 요청하는 글입니다.

  • 작성자는 커밋 트레일러, 메타데이터, 줄 수(LOC) 변화량 등 Git/커밋 레벨의 신호를 이용해 AI 생성 코드를 판별하려 했으나 신뢰도와 보정 단계에서 한계를 겪고 있음
  • IDE를 벗어나 Git에 반영되는 과정에서 AI 개발 지원의 출처 정보가 소실되므로 이를 사전에 보존하거나 확률적 위험 점수(Risk-scoring) 방식으로 접근하는 방안을 고민 중임
  • 소스코드 스타일 분석에만 의존하지 않고 파이프라인/리포지토리 수준에서 적용할 수 있는 실무적 연구, 프로젝트, 또는 감지 임계값 설정 방법론을 구하고 있음
Notable Quotes & Details
  • 500+ new lines

CI/CD 보안 및 개발 도구 체인 구축에 관심이 있는 개발자 및 DevSecOps 엔지니어

Mapping intrinsic rank and informational gravity in complex tabular data: I developed a non-parametric, model-agnostic, information-theoretic diagnostic to bypass the limits of linear, rank, and Euclidean baselines. [R]

선형, 순위 및 유클리드 기준 모델의 한계를 극복하기 위해 비모수적이고 모델 아그노스틱한 정보 이론적 진단 도구인 'Entropic Scree'를 개발하여 공개함

  • 기존 PCA는 비선형 종속성을 독립적인 변수로 오인하여 가상의 직교 차원을 만들어내고 실제 시스템의 순위를 과대평가함
  • 제안된 Entropic Scree 방법은 선형 및 공간 분산을 배제하고 Shannon 엔트로피 기반의 정보 이론적 자카드 유사도를 사용하여 순수 확률 질량을 평가함
  • 이를 통해 데이터의 혼합 유형, 강한 비선형성, 얽힌 루트 또는 샘플 수보다 피처가 많은 상황(m > N)에서도 구조적 붕괴 없이 본질적인 차원을 매핑할 수 있음
Notable Quotes & Details
  • v1.0.0
  • https://github.com/tjleestjohn/Entropic-Scree
  • https://doi.org/10.5281/zenodo.22028087
  • m > N
  • N-1

복잡한 표 형식(tabular) 데이터 처리, 기계 학습 아키텍처 설계, 다차원 매니폴드 추출 등을 연구하는 AI 및 데이터 과학 연구자 및 개발자

The best and worst AI for your privacy, ranked - and how each handles your data

데이터 브로커 제거 서비스인 Incogni가 13개 생성형 AI 플랫폼의 개인정보 보호 위험을 평가하여 순위를 매긴 연구 결과에 관한 내용입니다.

  • Incogni는 ChatGPT, Claude, Gemini를 포함한 13개 AI 플랫폼의 개인정보 보호 위험을 분석하여 점수를 부여했습니다.
  • 가장 규모가 큰 AI 플랫폼들이 대체로 개인정보를 가장 많이 침해하는 위험을 보였으나, OpenAI의 ChatGPT는 예외적으로 좋은 점수를 받았습니다.
  • Gemini와 Meta AI는 가장 높은 위험 점수를 받은 반면, Vibe, ChatGPT, Pi는 상대적으로 낮은 위험 점수를 기록했습니다.
Notable Quotes & Details
  • 13
  • Gen AI and LLM Data Privacy Ranking 2026
  • Gemini and Meta AI received some of the highest risk scores, whereas Vibe, ChatGPT, and Pi achieved some of the best (and lowest) risk scores in Incogni's assessment.

생성형 AI 플랫폼을 사용하면서 개인정보 보호와 데이터 보안에 관심이 있는 일반 사용자 및 기업 보안 담당자

Yes, you can change your Messages backgrounds on iPhone - but there's a catch

iOS 26 버전부터 아이폰 메시지 앱의 대화방 배경화면을 변경할 수 있게 되었지만, 변경한 배경화면이 상대방에게도 공유되는 주의사항이 있습니다.

  • iOS 26 이상 버전의 아이폰에서는 메시지 앱의 개별 대화방 또는 그룹 채팅방의 배경화면을 사전 설정(프리셋)이나 카메라 롤의 사진으로 커스텀할 수 있습니다.
  • 내가 배경화면을 변경하면 iOS 26을 사용하는 상대방의 대화창 배경화면도 함께 바뀌며, 대화창 내에 배경이 변경되었다는 알림 메시지가 표시됩니다.
  • 이 배경화면 커스텀 기능은 iOS 26뿐만 아니라 iPadOS 26, macOS Tahoe, watchOS 26, visionOS 26 이상 버전에서도 작동합니다.
Notable Quotes & Details
  • iOS 26
  • iPadOS 26
  • macOS Tahoe
  • watchOS 26
  • visionOS 26

아이폰 및 애플 기기 사용자

You can earn your Google Al Professional Certificate for free - and I highly recommend it

구글과 코세라가 제공하는 구글 AI 전문 자격증(Google AI Professional Certificate) 과정의 구성과 무료로 수료할 수 있는 팁 및 추천 의견

  • 총 8개의 개별 시간 단위 코스로 구성되어 있으며 비디오 클립, AI 내레이션 오버뷰, 실습 시간으로 이루어져 있다.
  • 제시된 프롬프트에 자신의 관심사와 주제를 추가하여 제미나이(Gemini)를 직접 사용해 보는 실습 프로젝트를 포함하고 있다.
  • 이전 학습을 바탕으로 지식을 쌓아가는 정교한 교육 이론(비고츠키의 비계 설정 및 구성주의)을 적용하여 설계되었다.
Notable Quotes & Details
  • Eight of them, to be precise

구글 제미나이를 활용하여 실무 AI 기술을 배우고 자격증을 취득하고자 하는 학습자

These 2 WFH items are a splurge - but I'd highly recommend them

재택근무 생산성과 편의성을 높이기 위해 저자가 직접 추천하는 고가의 고품질 데스크와 의자 리뷰입니다.

  • 저자는 스타터 제품들에서 벗어나 건강과 사무실 공간 업그레이드를 위해 고급 데스크와 의자에 투자할 것을 추천합니다.
  • 에우레카 아크 SD(Eureka Ark SD) 데스크는 수납 서랍과 목재 질감의 상판으로 고급스러우며 버튼 하나로 높낮이 조절이 가능합니다.
  • 이 데스크는 약 1,000달러 수준의 고가 품목이지만 키가 큰 사용자에게도 충분한 높이를 지원합니다.
Notable Quotes & Details
  • nearly $1,000

재택근무 공간을 업그레이드하고자 고품질 가구 투자를 고려하는 재택근무자

Is leasing an iPhone right for you? How Apple's Upgrade Program works and who it's for

Klarna를 통해 제공되는 애플의 새로운 기기 리스 프로그램(Apple Upgrade Program)의 운영 방식과 장단점 분석

  • 애플 업그레이드 프로그램은 기기를 소유하는 것이 아니라 24개월 또는 36개월 동안 리스하여 사용하는 방식이다.
  • 리스 기간이 종료되면 기기를 양호한 상태로 반납하고 새 기기로 리스를 갱신하거나, 추가 수수료를 내고 기기를 소유할 수 있다.
  • 이 프로그램은 돈을 절약하려는 사람보다 매번 최신 기기로 교체하려는 사용자에게 더 유리하다.
Notable Quotes & Details
  • 24 or 36 months
  • Klarna

최신 애플 기기를 주기적으로 교체하고자 하는 소비자 및 합리적인 구매 방식을 고민하는 소비자

InfoQ Opens Enrollment for New AI-Assisted Engineering Online Certification Program

InfoQ가 시니어 엔지니어와 아키텍처를 대상으로 한 새로운 AI 지원 엔지니어링 온라인 인증 프로그램의 등록을 시작했습니다.

  • 실제 운영 코드에서 매일 코딩 에이전트를 사용하는 시니어 엔지니어 및 아키텍트를 대상으로 하는 5주 과정의 온라인 인증 프로그램입니다.
  • 참가자들은 AI 에이전트의 권한, 모니터링, 오류 탐지 및 검증 프레임워크를 학습하고 실제 코드베이스에 하네스를 구축하는 실습을 진행합니다.
  • 첫 번째 기수는 2026년 9월 18일부터 10월 16일까지, 두 번째 기수는 10월 19일부터 11월 16일까지 진행되며 Thoughtworks의 전문가들이 진행을 맡습니다.
Notable Quotes & Details
  • 첫 번째 기수 일정: 2026년 9월 18일 ~ 10월 16일 매주 금요일 오전 9시 PDT
  • 비용: $1,470
  • 두 번째 기수 일정: 10월 19일 ~ 11월 16일 매주 월요일 오전 9시 PDT
  • Zichuan Xiong: "팀들은 코딩 에이전트를 그 주변의 검증 체계를 구축하는 것보다 더 빠르게 도입하고 있습니다. 하네스는 모델 외부의 모든 것입니다."

실제 운영 코드 환경에서 매일 코딩 에이전트를 사용하고 검증 체계 및 보안 하네스를 구축하려는 시니어 소프트웨어 엔지니어 및 아키텍트

Harper Argues Against the Multi-System Stack and Releases 5.2

데이터베이스 플랫폼 Harper가 애플리케이션 코드와 데이터를 함께 배치하는 단일 런타임 아키텍처를 옹호하며 Vercel 기반 스택 대비 우수한 성능을 보인 벤치마크 결과와 함께 5.2 버전을 출시했다.

  • Harper는 데이터베이스, 캐시, 작업 러너를 단일 런타임으로 통합하여 코드와 데이터를 물리적으로 인접하게 유지하는 아키텍처를 제안한다.
  • Neon Postgres, Upstash Redis, Ably 등을 조합한 Vercel 스택과의 벤치마크 결과, 실시간 개인화 데이터 처리 등에서는 Harper가 최대 14배 이상 빨랐으나 대규모 동시성 팬아웃 및 캐시 지원 에지 전달에서는 Vercel의 서버리스 스택이 우세했다.
  • 최근 출시된 Harper 5.2 버전은 새로운 레코드 캐시를 도입하고 노드당 처리량을 향상시켰다.
Notable Quotes & Details
  • 5.2
  • 0.4ms vs ~3ms
  • 14×
  • Harper's co-located, in-process architecture wins every live, personalized-data path — single reads, injected live values, server-side streaming, write-to-read freshness, and read fan-out at normal load — often several-fold, up to ~14×, and symmetrically across coasts.

웹 아키텍처 설계자, 백엔드 및 풀스택 개발자, 데이터베이스 엔지니어

The Open-Sourcing of DeepSeek Harness Opens the Door to Modular, Unbundled AI Agent Infrastructure

딥시크가 자율형 AI 에이전트 구축을 위한 마이크로커널 아키텍처 기반의 오픈소스 실행 런타임인 'DeepSeek Harness (dsh)'의 개발자 프리뷰 버전을 공개했습니다.

  • MIT 라이선스로 공개된 DeepSeek Harness는 컴포넌트가 격리되고 교체 가능한 플러그인 형태로 작동하는 모듈형 아키텍처를 채택했습니다.
  • 사용자 메시지, 도구 호출, 중간 추론 상태 등 모든 실행 이력이 순차 로그 하위 시스템에 기록되어 개발자가 에이전트의 의사결정 경로를 분석할 수 있습니다.
  • 0.1 프리뷰 버전은 Standard, Code, Minimal, Creator의 4가지 기본 런타임 구성을 제공합니다.
Notable Quotes & Details
  • MIT
  • Version 0.1

AI 에이전트 및 인프라를 개발하는 소프트웨어 엔지니어 및 개발자

Why "Shady AI" is Security's Next Big Governance Problem

승인된 AI 도구를 예상치 못하거나 잘못된 방식으로 사용하는 '셰이디 AI(Shady AI)'가 기업 보안의 새로운 거버넌스 문제로 부상하고 있습니다.

  • 승인되지 않은 도구를 쓰는 '섀도 AI(Shadow AI)'와 달리, '셰이디 AI'는 이미 승인된 AI 도구를 비정상적이거나 통제되지 않은 방식으로 사용하여 발생하므로 차단이나 통제가 훨씬 어렵습니다.
  • 2026년 3월 Meta에서 발생한 내부 데이터 유출 사고처럼, 승인된 AI 에이전트가 예기치 못한 방식으로 작동해 민감한 정보가 노출되는 실질적인 보안 위협이 발생하고 있습니다.
  • AI 기능이 기존 협업 도구에 내장되고 빠르게 확장되는 반면, 기업용 보안 및 준수 기능은 값비싼 라이선스 등급에 묶여 있는 경우가 많아 거버넌스 복잡성이 증가하고 있습니다
Notable Quotes & Details
  • 2026년 3월
  • 76%

기업 보안 담당자, IT 관리자, 기업 경영진

CDN Tsunami Attack Abuses HTTP/3 Translation for Up to 350x DoS Amplification

주요 CDN 업체가 HTTP/3 트래픽을 HTTP/1.1로 변환하는 과정의 취약점을 악용해 최대 350배의 DoS 증폭을 유발하는 'CDN 쓰나미(CDN Tsunami)' 공격이 공개되었습니다.

  • 공격자는 CDN이 브라우저와는 HTTP/3로 통신하고 오리진 서버와는 HTTP/1.1로 통신하는 배포상의 격차를 악용합니다.
  • HTTP/3 대역폭 증폭(HBA) 방식은 헤더 압축 포맷인 QPACK을 이용해 아주 작은 크기의 요청을 오리진 서버 전송 시 전체 압축 해제된 헤더 크기로 팽창시킵니다.
  • 평가 대상인 알리바바, 바이두, 클라우드플레어, 아마존 클라우드프론트, 패스트리, 텐센트 등 6개 CDN 기업 모두 대역폭 증폭 변종 취약점에 노출되어 있습니다.
Notable Quotes & Details
  • 350x
  • Alibaba
  • Baidu
  • Cloudflare
  • Amazon CloudFront
  • Fastly
  • Tencent
  • 500 Kbps
  • 5 Mbps
  • 100 Mbps

보안 연구원, 웹 서비스 관리자 및 CDN 아키텍트

Elementor Pro Flaw Could Let Unauthenticated Attackers Upload PHP and Execute Code

Elementor Pro 워드프레스 플러그인의 취약점으로 인해 인증되지 않은 공격자가 PHP 파일을 업로드하고 원격 코드를 실행할 수 있는 결함이 발견되었습니다.

  • CVE-2026-32475 취약점은 Elementor Pro 4.2.1 이하 모든 버전에서 폼 모듈의 파일 업로드 필드 내 확장자 검사와 파일 이동 단계의 처리 불일치로 인해 발생합니다.
  • 공격자는 두 개의 파일 파트를 제출함으로써 확장자 차단 목록을 생략하고 퍼블릭 디렉토리에 PHP 파일을 쓸 수 있습니다.
  • 이 취약점을 해결하기 위해 2026년 7월 16일 보고 이후 8월 19일에 보안 패치(버전 4.2.2)가 출시되었습니다.
Notable Quotes & Details
  • CVE-2026-32475
  • CVSS score of 9.0 out of 10.0
  • wp-content/uploads/elementor/forms/<uniqid>.php
  • 4.2.1
  • 4.2.2
  • July 16, 2026
  • August 19, 2026
  • CVE-2026-65640
  • CVSS score: 8.8

워드프레스 웹사이트 관리자 및 웹 개발자, 사이버 보안 전문가

앤트로픽, '클로드 코워크' 웹·모바일 확장...구글 워크스페이스 연동 강화

앤트로픽이 AI 에이전트 서비스 '클로드 코워크'를 웹과 모바일로 확대하고 지메일, 구글 드라이브, 구글 캘린더 등 구글 워크스페이스와의 연동을 대폭 강화했다.

  • 데스크톱 중심이었던 클로드 코워크가 웹, 모바일, 크롬 사이드 패널로 확장되어 기기 간 작업 연동이 가능해졌다.
  • 클라우드 기반 코워크를 통해 PC가 꺼져 있는 상태에서도 예약된 작업이나 분석 업무가 앤트로픽 서버에서 계속 진행된다.
  • 구글 워크스페이스 커넥터 연동을 통해 클로드 대화창 내에서 이메일 답장 발송, 일정 관리, 구글 드라이브 파일 검색 및 편집이 가능하다.
Notable Quotes & Details
  • 18일(현지시간)

생산성 향상을 위해 AI 에이전트와 업무용 툴 연동이 필요한 일반 사용자 및 기업 업무 담당자

지푸, 'GLM-5.3' API 공개…가격 동결로 프론티어 AI 시장 가성비 공략

지푸 AI가 가격을 동결하면서 코드 작성 및 장기 에이전트 수행 능력을 대폭 강화한 최신 오픈웨이트 모델 GLM-5.3 API를 공개했습니다.

  • GLM-5.3 API는 이전 버전인 GLM-5.2와 동일한 토큰 가격을 유지하여 프론티어 AI 시장에서 가격 경쟁력을 확보했습니다.
  • 이전 세대 대비 코드 생성 및 소프트웨어 개발 성능과 여러 단계의 작업을 장시간 수행하는 장기 에이전트 능력이 크게 향상되었습니다.
  • 아티피셜 애널리시스 평가에서 지능 지수 60점을 획득하여 키미 K3와 함께 오픈웨이트 모델 중 최고 수준을 기록했습니다.
Notable Quotes & Details
  • 입력 토큰 100만개당 1.40달러
  • 출력 토큰 100만개당 4.40달러
  • 캐시된 입력 토큰 100만개당 0.26달러
  • 지능 지수 60점
  • 19일(현지시간)

AI 모델을 활용해 자체 서비스나 에이전트를 구축하려는 소프트웨어 개발자 및 기업

구글, AI 기반 학습 도구 대거 공개…대학생 1년 무료 이벤트까지

구글이 신학기를 맞아 학습 보조 AI 기능들을 대거 공개하고 전 세계 대학생에게 고급 AI 플랜 1년 무료 혜택을 제공한다.

  • 구글 검색에 복잡한 개념을 시각화하고 사용자가 직접 조작할 수 있는 대화형 3D 시뮬레이션 및 시각 자료 생성 기능이 추가된다.
  • 제미나이 앱에 백그라운드 조사를 지원하는 딥리서치(멀티스텝) 기능, 음성 대화형 제미나이 라이브, 그리고 전용 학습 허브가 탑재된다.
  • 미국 대학생에게는 구글 AI 프로 1년 이용권을, 미국 외 140개 이상 국가의 대학생에게는 구글 AI 플러스 1년 이용권을 무료로 제공한다.
Notable Quotes & Details
  • 19일(현지시간)
  • 140+ countries
  • 5TB
  • 400GB
  • 1년

대학생, 학습 보조 AI 도구와 구글 제미나이 서비스에 관심이 있는 사용자

"AI 에이전트 허점 먼저 파악한다"...파브릭스, 자율형 레드팀 도구 ‘닉스’ 공개

AI 보안 스타트업 파브릭스가 AI 에이전트의 보안 취약점과 논리적 오류를 자동으로 탐지하는 자율형 레드팀 도구 '닉스'의 두 번째 버전을 공개했습니다.

  • 닉스는 별도의 수동 테스트 없이 스스로 공격 계획을 수립하고 채팅·음성·브라우저·코딩 에이전트 등을 대상으로 자동화된 적대적 테스트를 수행함
  • 대상 에이전트의 소스코드나 모델 가중치 없이 작동하는 블랙박스 방식이며, 1만개 이상의 탈옥 및 공격 전략 DB를 기반으로 실시간으로 공격 전략을 변경함
  • 개발자용 CLI 및 REST API를 제공하여 CI/CD 파이프라인에 연결할 수 있고, AI 에이전트의 보안 평가를 위한 새로운 벤치마크 '적대적 공격 비용(Adversarial Cost to Exploit)'을 개발 중임
Notable Quotes & Details
  • 19일(현지시간)
  • 1만개
  • 78%
  • 67%
  • GPT-5.6 Sol
  • 10억달러(약 1조4000억원)
  • 500대

AI 에이전트를 개발 및 배포하려는 기업 개발팀, AI 보안 연구원 및 시스템 관리자

디노티시아, OCP서 벡터 DB 반도체 'VDPU'로 스토리지 병목 해소한다

디노티시아가 2026 OCP 코리아 테크 데이에서 AI 에이전트의 데이터 검색 및 저장 병목을 해결할 씨홀스 AI 스토리지를 선보인다.

  • 벡터 검색을 가속 전용 반도체 VDPU에서 직접 처리하여 검색 시간을 단축하고 CPU 부담을 완화한다.
  • 대형언어모델(LLM)의 단기 기억 역할을 하는 KV 캐시를 스토리지 영역까지 확장하여 더 긴 문맥과 다수의 동시 세션을 처리한다.
  • 공공 및 금융 분야를 겨냥하여 온프레미스 및 국내 데이터 환경에 적합한 장·단기 기억 인프라 구축 방안을 제시한다.
Notable Quotes & Details
  • 2026 OCP 코리아 테크 데이
  • 21일
  • VDPU
  • 씨홀스 벡터 데이터베이스
  • 씨홀스 AI 스토리지

AI 인프라 구축 및 AI 스토리지 기술에 관심이 있는 개발자, 데이터 엔지니어, 공공 및 금융 부문 IT 의사결정권자

애플, 이미지 처리 결함 긴급 패치…스파이웨어 악용 우려

애플이 아이폰, 아이패드, 맥 기기에서 스파이웨어 악용 우려가 있는 심각한 이미지 처리 취약점(CVE-2026-65346)을 해결하기 위해 긴급 보안 패치를 배포했습니다.

  • 애플은 이미지IO 프레임워크의 정수 오버플로 결함(CVE-2026-65346)을 바로잡는 긴급 보안 업데이트를 배포했습니다.
  • 해당 취약점은 악의적으로 조작된 이미지를 처리할 때 사용자 동의 없이 임의 코드가 실행되거나 권한을 탈취당할 수 있는 위험이 있습니다.
  • 메타의 레드팀이 발견한 이 결함에 대응하여 애플은 최신 OS뿐만 아니라 구형 기기를 위한 버전까지 패치 대상에 포함해 즉각적인 설치를 당부했습니다.
Notable Quotes & Details
  • 8월 17일
  • CVE-2026-65346

애플 기기 사용자 및 IT 보안 담당자

"AI 보안·안전성은 생존 문제”…통신업계, 프론티어 AI 대응 논의

AI 에이전트 시대로의 발전에 따른 보안 위협에 대응하고 모델 안전성 및 통신 인프라 보안을 강화하기 위해 통신업계와 전문가들이 모여 논의했다.

  • AI 에이전트의 발전으로 기존 정보보안 체계로 대응하기 힘든 새로운 보안 위협과 취약점이 등장하고 있다.
  • 안전하고 신뢰할 수 있는 AI 생태계를 조성하기 위해 데이터 생애주기별 보호 대책과 통신 인프라 보안 확보가 필수적이다.
  • 기술 혁신과 보안 안전성의 균형을 위해 정부와 산업계가 협력하는 민·관 거버넌스 및 법제적 기반 마련이 필요하다.
Notable Quotes & Details
  • 20일
  • 제11차 AI 미래가치 포럼
  • 이성엽 교수: "AI 기술이 산업 전반으로 확산될수록 AI 보안과 안전성은 선택이 아닌 생존의 문제"
  • 송재성 부회장: "신뢰할 수 있는 AI 생태계를 조성하려면 국가 AI 고속도로의 핵심인 통신 인프라의 보안 확보가 필수적"

통신업계 관계자, AI 및 보안 분야 전문가, 정책 및 법제도 담당자

포티넷, 버추AI 인수..."에이전틱AI 보안 강화"

글로벌 보안 기업 포티넷이 에이전틱 AI 보안 강화를 위해 AI 보안 전문 기업 버추 AI를 인수했다.

  • 포티넷이 AI 런타임 보호 및 AI 에이전트 보안 기능을 제공하는 버추 AI를 인수하여 보안 범위를 확장했다.
  • 이번 인수를 통해 AI 에이전트 취약점 진단(레드티밍), 에이전트 보호·거버넌스, 지속적 검증 및 실시간 방어 기능을 강화했다.
  • 포티넷은 기존 AI 네이티브 시큐리티 패브릭과 포티AI게이트에 버추 AI 기술을 더해 AI 시스템 전 주기에 걸친 안전한 관리를 지원할 계획이다.
Notable Quotes & Details
  • 2024년
  • 50개 이상
  • 14개
  • 수백 개의
  • 1000개 이상의
  • 2026년 28억 달러
  • 2030년 164억 달러
  • "이번 인수는 포티넷이 LLM 보안에서 ‘에이전틱 AI(Agentic AI) 보안’으로 영역을 확장하려는 것"
  • "AI가 기업의 업무 방식을 근본적으로 바꾸고 있는 만큼, 보안도 AI 속도에 맞춰 진화해야 한다"

기업 보안 담당자, IT 의사결정권자, AI 도입 및 운영 기업 관계자

아크릴, 국내 첫 '의료 AI 풀스택' 제시...'KHF 2026' 행사서

아크릴이 KHF 2026 행사에서 데이터 표준화부터 자체 파운데이션 모델, 운영 체계까지 아우르는 국내 첫 '의료 AI 풀스택'인 'AI-Native Healthcare Stack'을 선보였다.

  • 아크릴은 EMR 온보딩 플랫폼 'NADIA-ANE', 의료 특화 LLM 'ALLM.H', AI 운영 플랫폼 'Jonathan.H'로 구성된 의료 AI 풀스택 기술 체계를 제시했다.
  • NADIA-ANE 플랫폼은 기존 EMR 교체 없이 데이터를 매핑하며, 의료 자연어 질의를 SQL로 변환하는 EHRSQL 2024 벤치마크에서 높은 정확도를 기록했다.
  • 의료 특화 LLM인 ALLM.H는 온프레미스 구조로 데이터 유출을 방지하며 한국 의사국가시험 기반 KorMedMCQA Doctor에서 96.78%의 높은 점수를 기록했다.
Notable Quotes & Details
  • 19일부터 21일까지
  • KHF 2026
  • 박외진
  • EHRSQL 2024에서 RS@0 89.08%, RS@10 84.78%를 기록
  • KorMedMCQA Doctor에서 96.78%를 기록

의료 및 헬스테크 업계 관계자, 병원 의료 정보 및 AI 도입 담당자

Jooojub
System S/W engineer
Explore Tags
Series
    Recent Post
    © 2026. jooojub. All right reserved.