🤖 모델 & 제품 (8/24건)
EU 텍스트 출처 표기 규정에 대한 OpenAI의 접근 방식
OpenAI가 EU 규정에 맞춰 텍스트 워터마크 기술에 어떻게 접근하고 있는지 소개합니다. 워터마크가 적용되는 대상, 탐지 방식, 연구자 대상 접근 권한 우선 제공 이유 등을 살펴봅니다.
사용자의 AI 활용 방식에 맞춘 새로운 광고 생태계 구축
OpenAI가 ChatGPT에 새로운 비주얼 광고 포맷을 도입하고 광고주를 위한 성과 측정 툴, 기여도 분석(Attribution) 파트너십, 브랜드 적합성(Brand Suitability) 기능을 확대합니다.
GPT-6 패밀리 모델 선택 및 활용 가이드
스타트업이 GPT-6 모델을 선택하고, 추론 강도(reasoning effort)를 조율하며, 프롬프트와 스킬을 개선하고 도구를 연계해 프로덕션 워크플로우를 준비하는 방법을 안내합니다.
채텀 파이낸셜, OpenAI로 자본시장 전문성 확장
채텀 파이낸셜(Chatham Financial)이 Codex와 GPT-5.6을 활용해 기술을 구축하고 업무 흐름을 재설계함으로써 거래 검증 시간을 기존 30분에서 4분 미만으로 단축했습니다.
2026년 9월 발표된 주요 최신 AI 뉴스
9월 AI 업데이트를 소개하는 영상
Claude 프론티어 아카데미: 엔지니어 1만 명 양성을 위해 1억 달러 투자
클로드 프론티어 아카데미(Claude Frontier Academy)는 Anthropic 자체 기준에 부합하는 프론티어 배포 엔지니어를 양성합니다. 이는 2027년 말까지 10,000명을 교육하기 위한 1억 달러 규모의 프로젝트입니다.
Gemini 4 Argon: 프론티어 인텔리전스의 차세대 장을 열다
팀 봇: 업무를 수행하며 함께 학습하는 공유형 AI 팀원
Grok Bot에 필요한 파일, 앱, 전문 지식을 제공하고 공유하여 팀 전체가 동일한 맥락에서 협업할 수 있도록 지원합니다.
🌎 업계 동향 (10/147건)
제미나이 '대신 전화하기', 엄마에게 늦는다는 소식도 전해준다
구글이 비즈니스 통화를 넘어 친구 및 가족에게도 메시지를 보낼 수 있도록 '대신 전화하기(Call for Me)' AI 기능을 확장할 것으로 보입니다. 안드로이드 어소리티(Android Authority)는 APK 분석을 통해 "엄마한테 전화해서 15분 늦는다고 전해줘"와 같은 예시가 포함된 'Gemini Calling' 소개 화면을 발견했다고 보도했습니다.
리플렉션, 중국 모델에 대항할 저비용 오픈 가중치 AI 모델 'Beam' 공개
리플렉션(Reflection)이 기업 및 주권 국가를 겨냥해 Beam 및 차기 모델들을 선보입니다. 기관들이 자체 독점 데이터를 리플렉션의 AI 모델에 학습시켜 맞춤형 로컬 AI 시스템을 구축할 수 있도록 돕는 'AI 팩토리' 제품을 제안하고 있습니다.
에이전트 간 통신용 MCP, 가장 위험한 프로토콜이 될 수도
새로운 에이전트 간 통신 프로토콜의 신뢰 검증 허점으로 인해 한 에이전트에서 다른 에이전트로 악성 프롬프트가 확산될 위험성이 제기되고 있습니다.
에이전틱 보안: 기업 대다수가 오픈AI에 의존, 그러나 보안 우려는 3배 높아
벤처비트(VentureBeat) 설문에 따르면 기업들은 AI 에이전트 보안을 위해 오픈AI의 가드레일에 가장 많이 의존하고 있으나, 이를 채택한 기업일수록 공격자가 방어선보다 앞서 있다고 응답할 확률이 3배 가까이 높았습니다. 에이전트를 도입한 기업 중 59%는 보안 사고나 아찔한 위기를 겪은 것으로 나타났습니다.
Power Platform을 통해 기업이 기존 앱에 AI를 통합하는 방법
Power Platform을 활용하여 기업들이 기존 애플리케이션에 AI 기능을 손쉽게 구축하고 접목하는 방법을 소개합니다.
기업 내 지식과 AI 에이전트의 연결
AI 시스템이 끊임없이 방대한 데이터를 수집하고 분석함에도 불구하고, 엔터프라이즈 AI 에이전트는 흔히 '지식 부족'이라는 독특한 한계에 부딪힙니다. 지식이란 단순 데이터를 넘어 개별 조직의 맥락 속에서 데이터가 갖는 의미를 이해하는 것입니다. AI 에이전트가 상황을 추론하고 올바른 결정을 내리기 위해서는 이러한 조직적 맥락의 이해가 필수적입니다.
Show HN: macOS 내 모든 사진과 동영상 프레임을 검색하는 AI 검색 도구
macOS의 모든 폴더에 있는 모든 사진과 동영상 프레임을 정밀하게 찾아주는 딥 AI 검색 도구 - allenv0/SCM
망가진 조직 문화 때문에 OpenAI를 떠났습니다
해커 뉴스 (추천 315점, 댓글 550개)
Claude 및 Claude Code에서 Opus 5.5 최대한 활용하기
Claude 앱 및 Claude Code에서 Opus 5.5 프롬프트를 작성하고 장기 실행 작업을 조율하며 결과를 확인하는 방법.
웹 및 모바일 대화형 AI 에이전트의 프라이버시 분석 [pdf]
Hacker News (점수: 419점, 댓글: 136개)
🛠️ 도구 & 오픈소스 (3/29건)
펠릭스 리제베르크(Felix Rieseberg)의 말 인용
기존 버전의 Cowork는 클라우드에서 모델 추론을 실행하고, 사용자 컴퓨터로 전달된 Anthropic 제공 VM 내에서 툴 호출을 수행했습니다. 이 VM은 기능 확장과 안전 및 보안을 이유로 도입되어 사용자가 세션에 명시적으로 추가한 데이터만 매핑했습니다. 사용자들은 Claude로 가능한 작업에는 만족했지만, 로컬에서 VM을 구동할 때 발생하는 디스크·배터리 소모 및 성능 저하는 아쉬워했습니다. 또한 노트북을 덮으면 작업이 중단된다는 점도 한계였습니다. 완전히 새로워진 Cowork는
ReviewBench: AI 코드 리뷰를 위한 오픈 벤치마크
대표적인 GitHub 풀 리퀘스트(PR), 다중 출처의 정답 데이터(ground truth), 보정된 평가 기준, 실제 프로덕션 환경에 부합하는 메트릭을 기반으로 구축된 코드 리뷰 에이전트 벤치마크 'ReviewBench'를 공개합니다.
에이전트는 끝났다고 했지만, 데이터베이스의 생각은 달랐다
📚 논문 & 연구 (8/137건)
지속 학습에서 오프폴리시 병합이 온폴리시 자체 증류를 능가하다
지속적으로 학습하고 스스로 개선하는 모델은 AI의 오랜 목표입니다. 포스트 트레이닝 모델에서 신규 데이터 기반의 지도 미세조정(SFT)은 일반화 성능 저하와 치명적 망각(catastrophic forgetting)을 유발하곤 합니다. 따라서 온폴리시(on-policy) 학습이 지속 학습의 필수 조건으로 여겨져 왔으나, 실제 새로운 지식이나 능력을 담은 데이터는 오프폴리시(off-policy)인 경우가 많습니다. 본 논문에서는 이러한 한계를 극복하는 오프폴리시 병합 기법을 다룹니다.
Weave Mamba Fusion: 경량 얼굴 검출을 위한 글로벌 크로스-스케일 상호작용
FPN부터 BiFPN에 이르는 피처 피라미드 기법은 다중 스케일 특징을 융합하여 얼굴 검출에서 뛰어난 성능을 보였습니다. 그러나 작은 크기, 가려짐, 극단적인 자세 등 제약이 없는 환경에서의 얼굴 검출은 국소적 융합이 다루기 힘든 글로벌 크로스-스케일 의존성을 요구합니다. Mamba와 같은 상태 공간 모델(SSM)은 특징을 시퀀스로 스캔하여 선형 복잡도로 전역 컨텍스트를 제공함으로써 이 문제에 유망한 해법을 제시합니다.
CCQ: 아동 건강 연구 AI를 지원하는 다주 보육 품질 데이터셋
초기 유아기의 양질의 보육은 아동의 성장과 발달에 결정적인 요인입니다. 기존의 보육 품질 연구는 파편화되고 비연구 친화적이며 개인정보 규제가 걸린 데이터셋으로 인해 한계가 있었습니다. 본 연구에서는 AI와 초기 아동 건강의 융합 응용 데이터 과학 연구를 위해 대규모 비식별 데이터셋인 CCQ(Child Care Quality)를 공개합니다. CCQ는 미국 12개 주의 59,372개 보육 제공자 기록을 통합하고 있습니다.
Imagine to Act: 확장 가능한 GUI 에이전트 훈련을 위한 이미지 편집 월드 모델 기반 고화질 데이터 합성
GUI(그래픽 사용자 인터페이스) 에이전트는 다양한 애플리케이션에 걸쳐 복잡한 디지털 워크플로를 자동화하는 유망한 패러다임으로 부상했습니다. 그러나 뛰어난 성능과 일반화 능력을 갖춘 에이전트를 훈련하려면 대규모의 고화질 시각-행동 궤적이 필수적이며, 이는 확보하기가 매우 어렵습니다. 본 논문에서는 텍스트 설명이나 HTML 렌더링 대신 픽셀 단위 시각 세부 정보를 유지하는 이미지 편집 월드 모델을 통해 데이터를 합성하는 방안을 제안합니다.
커리큘럼 브레인: 인지 진단의 기반이 되는 교육과정 지식 그래프 구축
인지 진단 모델(CDM)은 학생이 어떤 특정 역량을 습득했고 미흡한지 파악하여 개인 맞춤형 학습 경로에 필요한 세부 정보를 제공하지만, 실제 도입은 드물었습니다. 주된 걸림돌은 과거 수작업으로 작성되던 평가 문항-역량 매핑 테이블(Q-매트릭스)이었습니다. 본 연구는 이를 두 단계로 나누어, 먼저 교육과정의 개념과 기술 전체 공간을 아우르는 지식 그래프를 자체 구축하는 방식을 제안합니다.
과소구동 이족 보행 로봇의 충돌 방지 보행을 위한 계층적 강화학습
이족 보행 로봇은 균형을 잃지 않고 장애물을 회피하여 경로를 변경하기가 어렵고, 특히 롤(roll) 관절이 없는 과소구동 플랫폼에서는 이 문제가 더욱 심각합니다. 본 논문에서는 고수준(High-Level) 정책이 로봇 자세, 36개 레이캐스트 근접 측정값, 이동 장애물 상태, 후퇴 지평 국소 목표를 관측하여 제어하는 계층적 강화학습(HRL) 프레임워크를 제시합니다.
PyINE: 코드 실행을 통한 확장 가능한 역량 유도 및 감독 프레임워크
추론 모델은 문제를 해결할 능력이 있으면서도 계산 비용이 저렴하지만 오해의 소지가 있는 지름길(shortcut)을 기본으로 택할 수 있습니다. 이는 그럴듯하지만 불완전한 추론을 내놓았을 때 감독자가 해당 출력을 신뢰할 수 있는지에 대한 핵심적 감독 문제를 야기합니다. 본 연구는 검증 가능한 실행 기반으로서 계측된 파이썬 프로그램을 활용해 확장 가능한 역량 유도 및 감독을 수행하는 프레임워크인 PyINE을 소개합니다.
Verb-ICL: 구조화된 예측을 위한 인컨텍스트 러닝의 재고
구조화된 예측(Structured Prediction) 작업은 인컨텍스트 러닝(ICL)에 고유한 난제를 제기합니다. 구성적 출력은 문장 수준 접근법이 포착하지 못하는 미세한 토큰 수준 패턴을 모델링해야 하며, 작업별 주석 규칙은 사전 학습만으로는 획득할 수 없는 인위적 규칙이기 때문입니다. 본 논문에서는 두 난제를 모두 해결하기 위해 ICL 기반 구조화된 예측을 위한 선택적 주석 프레임워크인 Verb-ICL을 제안합니다.
⚖️ 정책 & 안전 (4/11건)
OpenAI, EU 지역 ChatGPT 텍스트에 워터마크 적용 시작
OpenAI가 EU AI 법을 준수하기 위해 EU 지역의 ChatGPT 및 Codex 생성 텍스트에 워터마크를 적용합니다. 다만 텍스트를 편집하면 보이지 않는 워터마크를 감지하기 어려워질 수 있다고 밝혔습니다.
애덤 시프 미 상원의원, AI 규제·표현의 자유·트럼프 탄핵에 대해 밝히다
지식재산권, 반독점, 개인정보 보호 및 기술 관련 상원 위원회에서 활동 중인 캘리포니아주 민주당 애덤 시프 상원의원과의 인터뷰입니다. 현 시점에서 거대 테크 산업과 AI 생태계를 어떤 방식으로 규제해야 하는지에 대한 심층적인 논의를 나눴습니다.
Import AI 475: 스웜 스케일링, 구글 딥마인드의 생물학 워터마크, 그리고 AI 과학 경제
AI가 무엇을 할 수 있을지는 누가 결정하는가?
내생적 정렬(Endogenous Alignment)은 종속성을 필요로 한다
내생적 정렬에 관한 제 게시물에 훌륭한 댓글이 많이 달렸습니다. 그중 칼 크루거(Karl Krueger)는 인간이 자녀를 정렬(align)하는 과정에서 강화학습보다 모방학습이 더 중요하다고 주장했습니다. 둘 중 무엇이 더 중요한지 가려내기는 어렵지만, 제가 모방의 중요성을 간과한 것은 잘못이었으며 또 다른 댓글의 설명처럼 모방학습이 더 근본적일 수 있다는 점에 동의합니다. 군나르 자른케(Gunnar Zarncke)의 유용한 지적처럼 저는 가장 결정적인 부분을 잊고 있었습니다...
🎥 영상 & 튜토리얼 (3/8건)
사라져가는 수십억 달러 규모의 AI 경쟁 우위
❤️ Lambda를 둘러보고 GPU Cloud에 가입하세요: https://lambda.ai/papers 📝 Sonnet 5.5: https://www.anthropic.com/claude-sonnet-5-5 🙏 Two Minute Papers를 후원해 주시는 너그러운 Patreon 서포터분들께 감사드립니다: Adam Bridges, B Shang, Carlos Galarza, Christian Ahlin, Eric Tyson, Juan Benet, Lukas Biewald, Michael Tedder, Owen Skarpness,
AI를 해방시키는 퓨디파이(PewDiePie)... 분노하는 OpenAI
Namespace는 GitHub Actions 등을 구동할 수 있는 가장 빠른 솔루션입니다. 무료로 체험해 보세요 - https://namespace.so/github-actions 퓨디파이가 증류(distillation) 문제로 OpenAI로부터 두 번 계정 정지를 당한 후 자택에서 직접 학습시킨 무검열 AI 모델 'Ajax'를 개발 중입니다. 자세한 내용을 알아보겠습니다. Fireship의 더 많은 콘텐츠: 🗞️ 뉴스레터: https://bytes.dev 🧠 강좌: https://fireship.dev
AI 뉴스: Dots, GPT-6.1 Sol, Sonnet 5.5, Gemini 4 및 주요 핵심 소식 총정리
이번 주 놓치기 쉬운 AI 뉴스를 모았습니다. Optimizely의 Virtual Teammates가 어떤 작업을 자동화해 줄 수 있는지 확인해 보세요: https://optimizely.com/mattwolfe 추가 탐색: 🛠️ AI 툴 및 뉴스 둘러보기: https://futuretools.io/ 📰 주간 뉴스레터: https://futuretools.io/newsletter 소셜 채널: ❌ Twitter/X: https://x.com/mreflow 🖼️ Instagram: https://instagram.com/mr.eflow