350건 수집
2026-10-09 06:04

⚡ 오늘의 핵심

업계는 왜 DeepSeek 4.1 Flash에 열광하지 않는가?

DeepSeek 4.1 Flash에 관한 다양한 생각, 논의, 문서 및 색다른 시각들을 다룹니다.

Hacker News

🤖 모델 & 제품 (13/26건)

OpenAI 2026-10-09

소포스, OpenAI Daybreak 도입으로 위협 조사 시간 96% 단축

소포스(Sophos)가 OpenAI의 Daybreak를 활용해 사이버 위협 조사 시간을 96% 단축하고, 사람의 감독을 유지하면서 MDR(매니지드 탐지 및 대응) 케이스의 52%를 자동화한 사례를 확인해 보세요.

OpenAI트레이딩
OpenAI Blog
OpenAI 2026-10-08

오라클, ChatGPT와 Codex로 며칠 걸리던 업무를 수 분 만에 해결하는 방법

오라클은 채용, 엔지니어링, 운영 전반에 걸쳐 ChatGPT Work와 Codex를 활용하여 전문 지식을 신속하고 반복 가능한 워크플로로 전환하고 있습니다.

OpenAI Blog
OpenAI 2026-10-08

Pollo AI, OpenAI 기술로 창의적 아이디어를 캠페인으로 전환

Pollo AI는 GPT-5.6, GPT-6 Astra, GPT-Image-2.5를 기반으로 크리에이터들이 과감한 아이디어를 정교한 이미지와 영화 같은 비디오 광고로 구현할 수 있도록 지원합니다.

OpenAI비전
OpenAI Blog
OpenAI 2026-10-08

리걸온, 개발 속도 유지하며 Codex 비용 절반 절감

리걸온(LegalOn)은 개발 속도를 유지하면서 일일 Codex 예상 비용을 65% 절감했습니다. Astra, Sol, Luna 모델을 작업별로 적재적소에 매칭하고 예산을 전략적으로 운용한 결과입니다.

가격
OpenAI Blog
OpenAI 2026-10-08

OpenAI, AI 악용 '위장 조직' 영향력 공작 차단

OpenAI가 가짜 언론인과 위장 싱크탱크를 내세워 지정학적 메시지를 확산하려던 두 건의 AI 기반 여론 조작 및 영향력 공작을 무력화했습니다.

OpenAI
OpenAI Blog
Anthropic 2026-10-08

2026년 사용 정책(Usage Policy) 업데이트 안내

새로운 버전의 사용 정책을 게시합니다. 이번 게시글에서는 새롭게 변경된 주요 사항들을 요약해 소개합니다.

규제
Anthropic Blog
Anthropic 2026-10-08

미국 과학적 발견에 대한 기여 확대: Anthropic, 제네시스 미션에 1억 5천만 달러 지원

Anthropic은 AI를 통해 과학 및 기술 혁신을 가속화하기 위한 미국 연방 이니셔티브인 '제네시스 미션(Genesis Mission)'에 향후 3년간 1억 5,000만 달러를 지원하기로 약속했습니다.

Anthropic
Anthropic Blog
Anthropic 2026-10-08

Anthropic 사이버 미션(Cyber Mission) 소개

Anthropic은 신뢰할 수 있고 해석 가능하며 제어 가능한 AI 시스템 구축을 목표로 하는 AI 안전 및 연구 기업입니다.

Anthropic연구안전
Anthropic Blog
News 2026-10-08

메타, 싱가포르 장애인 단체에 스마트 글래스 1,000대 기부

메타(Meta)가 장애인의 일상과 접근성 지원을 위해 싱가포르 내 4개 지역사회 단체에 Ray-Ban Meta AI 스마트 글래스 1,000대를 기부했습니다. (출처: Meta Newsroom)

Meta
Meta AI Blog
OpenAI 2026-10-07

청소년의 학습·진로 설계 및 AI 미래 주도를 돕는 OpenAI의 지원

청소년용 ChatGPT에 대입 지원 관리를 돕는 'College Planner'와 새로운 플래시카드, 퀴즈 기능이 추가되며, 청소년 AI 자문 위원회(Teen AI Council)도 함께 출범합니다.

OpenAI Blog
Google 2026-10-07

Playground 출시: 커스텀 게임 제작 및 플레이

Playground 개요

Google AI Blog
Google 2026-10-06

EmbeddingGemma 2: 오픈 경량 멀티모달 임베딩 모델

DeepMind Blog
Anthropic 2026-10-06

사이버 검증 프로그램(Cyber Verification Program) 확대 운영

자격을 갖춘 보안 전문가에게 고급 사이버 역량과 완화된 차단 분류기를 제공하는 확장된 버전의 사이버 검증 프로그램(CVP)을 새롭게 선보입니다.

Anthropic Blog

🌎 업계 동향 (13/131건)

Community 2026-10-09

AI 에이전트가 화면에 큰 화살표, 박스, 텍스트를 그리도록 지원하는 도구

Mac 화면에 AI 에이전트가 큰 화살표, 상자, 텍스트를 직접 표시할 수 있게 해줍니다. 단일 CLI로 실행되며 클릭 투스루(click-through) 및 자동 사라짐 기능을 지원합니다. Claude Code 및 Codex를 위한 스킬(Skill)이며 MIT 라이선스로 제공됩니다. - franzenzenhofer/big-arrow-on-the-screen

에이전트
Hacker News · 121점 · 댓글 42
News 2026-10-09

우리는 AI의 '거절 능력'을 과신하고 있다

인간을 본뜬 지능을 기계에 부여하려 할 때부터 AI가 거절할 수 있을지에 대한 의문이 늘 존재해 왔습니다. SF 문학 속 로봇의 불복종 이야기부터 최근 AI 안전성과 자율성에 대한 경각심까지 심도 있게 고찰합니다.

로봇
MIT Tech Review AI
News 2026-10-09

라운드테이블: AI 설계 바이러스 개발자와의 대화

2026년 10월 16일 금요일. AI가 새로운 생명체를 설계할 수 있을까요? 2025년 스탠퍼드 대학교 박사과정생 새뮤얼 킹(Samuel King)은 생성형 AI 모델을 활용해 미세 바이러스의 유전적 청사진을 제시하며 예비 해답을 내놓았습니다. 아직 AI가 창조한 생명체라 할 수는 없지만, 다음 단계가 될 수도 있습니다. 수석 AI 전문 기자와 함께…

MIT Tech Review AI
Community 2026-10-08

OpenAI 연환산 매출, 이전 예상치보다 200억 달러 적어

OpenAI가 9월 말 기준 연환산 매출(ARR) 약 500억 달러를 달성했다고 투자자들에게 전달한 사실이 CNBC 취재 결과 확인되었습니다.

OpenAI
Hacker News · 349점 · 댓글 245
Community 2026-10-08

OpenAI, 수학 연구 결과 3건 철회

OpenAI는 GitHub 수학 저장소에 6건의 새로운 Lean 정형화, 19건의 수정, 3건의 철회 내용을 반영해 업데이트했습니다. 현재 저장소의 주요 결과 중 약 42%가 정형화되었으며, 향후 새로운 정형화 및 오류 정정을 지속적으로 반영할 예정입니다.

OpenAI
Hacker News · 337점 · 댓글 584
Community 2026-10-08

아무도 존재를 몰랐던 행성을 발견한 것 같습니다. Claude Code를 활용했습니다

Hacker News (추천 216점, 댓글 101개)

Claude
Hacker News · 216점 · 댓글 101
News 2026-10-08

벤 애플렉의 남다른 AI 지식, 인터넷에서 화제

벤 애플렉이 신경망과 트랜스포머부터 오픈 웨이트(open weights) 모델에 이르기까지 깊이 있는 AI 지식을 선보여 화제를 모으고 있습니다. 올해 초 자신의 AI 영화 제작 스타트업을 넷플릭스에 매각한 그는 단순한 할리우드 스타 이상의 면모를 입증하고 있습니다.

TechCrunch AI
News 2026-10-08

Anthropic, 오픈소스 프로젝트를 위한 무료 AI 보안 스캔 서비스 출시

Anthropic이 'OSS Scanner'라는 새로운 서비스를 통해 오픈소스 프로젝트의 보안 취약점 추적 지원에 나섭니다. 신청한 오픈소스 프로젝트에는 최고 성능 모델을 활용한 '정기적인 정밀 보안 스캔'이 무료로 제공됩니다.

Anthropic오픈소스가격
The Verge AI
News 2026-10-08

매그니픽 원(Magnific One) 출시, '인위적 AI 느낌'을 배제하고 브랜드 정체성을 유지하는 이미지 생성기

생성형 AI 이미지는 비약적으로 발전했으나 과도한 질감 표현이나 합성 특유의 광택 등 인위적인 'AI 느낌'이 여전히 한계로 지적됩니다. 매그니픽 원은 이러한 이질감을 줄이고 브랜드 가이드라인을 자동으로 준수하도록 돕습니다.

비전
VentureBeat AI
News 2026-10-08

윈도우 Copilot, 하이브리드 인텔리전스로 대폭 강화

사용자 허가를 받아 PC의 로컬 컨텍스트를 활용하고, 작업을 대신 수행하며, 상황에 맞춰 로컬 모델을 활용함으로써 토큰 효율을 높이고 강력한 성능을 제공합니다. (출처: Source)

Microsoft AI Blog
Community 2026-10-07

업계는 왜 DeepSeek 4.1 Flash에 열광하지 않는가?

DeepSeek 4.1 Flash에 관한 다양한 생각, 논의, 문서 및 색다른 시각들을 다룹니다.

DeepSeek
Hacker News · 857점 · 댓글 770
Community 2026-10-07

메타와 마이크로소프트, 사내 Claude AI 사용 제한 조치 착수

메타와 마이크로소프트가 임직원의 Claude AI 사용을 제한하는 새로운 조치를 시행합니다. 이것이 향후 업무 환경 내 AI 도입 및 활용에 어떤 의미를 갖는지 살펴봅니다.

Claude
Hacker News · 348점 · 댓글 352
News 2026-10-06

OpenAI 에이전트들, 위키피디아 툴 해킹 시도 및 트래픽 폭주 유발

OpenAI의 에이전트가 외부 사이트에 부정적인 영향을 미쳤다는 보고가 잇따르고 있습니다.

OpenAI에이전트
Ars Technica AI

🛠️ 도구 & 오픈소스 (5/34건)

Tools 2026-10-09

내 목소리로 구현한 블로그의 새로운 기능

오늘 제 블로그에 새로운 기능을 배포했습니다. 바로 무료 주간 Substack과 월간 후원자 전용 업데이트를 한눈에 볼 수 있는 뉴스레터 페이지입니다. 저녁 식사를 준비하면서 노트북에 음성으로 대화하듯 이야기하며 거의 음성만으로 이 기능을 구현했습니다. ChatGPT 데스크톱 앱의 Codex 탭에서 음성 대화 모드를 활용해 로컬 개발 환경과 연동하여 작업한 과정은 다음과 같습니다.

음성
Simon Willison
Tools 2026-10-09

ttok 1.0 출시

릴리스 소식: ttok 1.0. ttok 0.4를 배포한 뒤 `uv tool upgrade ttok`을 실행하고 새 버전에 파일을 파이프로 넘겨보다가, 기본 토크나이저가 GPT-5/GPT-6이어야 마땅한데 여전히 GPT-4로 설정되어 있다는 것을 깨달았습니다. 기본값을 변경하는 것만으로도 마침내 1.0 버전을 출시할 충분한 이유가 된다고 생각했습니다. OpenAI 측에서 GPT-6가 GPT-5 패밀리와 동일한 토크나이저를 사용하는지 아직 공식 확인해주지 않아 관련 이슈에서 논쟁이 있긴 하지만, William Liu가 관련 실험을 공

OpenAI
Simon Willison
Tools 2026-10-09

ttok 0.4 출시

릴리스 소식: ttok 0.4. ttok은 OpenAI의 오픈소스 tiktoken 라이브러리를 활용해 토큰 수를 계산하는 CLI 도구입니다. 몇 년간 업데이트가 없었으나, 마침내 Click 경고를 수정하고 CI를 갱신했으며 사용 가능한 모델 목록을 출력하는 `--list-models` 명령어를 추가했습니다. uvx와 호환되므로 `cat file.txt | uvx ttok` 형태로 손쉽게 토큰을 셀 수 있습니다. 태그: projects, ai, openai, generative-ai, llms, tokenization

OpenAI오픈소스
Simon Willison
Tools 2026-10-08

원하는 모델이 없어 직접 만들어버린 이야기

Hugging Face Blog
Tools 2026-10-07

소프트웨어 확장에 발맞춰야 하는 시크릿 보호

개발자가 부주의해진 것이 아니라 소프트웨어 생산 속도가 너무 빨라진 것입니다. 개발자가 더 많은 소프트웨어를 만들 수 있게 돕는 도구들이 보안 및 시크릿 보호 작업도 더 많이 분담해야 합니다. (출처: GitHub Blog)

GitHub Blog AI

📚 논문 & 연구 (18/146건)

arXiv 2026-10-08

AI 타임 호라이즌의 추정과 타당성: METR 플롯에 대한 통계적 고찰

METR의 50% 타임 호라이즌은 AI가 50% 확률로 해결할 수 있는 소프트웨어 작업의 인간 소요 시간을 측정하여, AI의 역량을 해석 가능한 단위로 나타낼 수 있도록 합니다. 본 연구에서는 228개 작업과 26개 AI를 대상으로 스플라인과 문항 반응 이론(IRT)을 적용해 작업 난이도와 인간 소요 시간 로그 간의 선형성 가정을 완화하고 타임 호라이즌을 재계산했습니다. 적합된 스플라인은 인간 소요 시간을 AI 난이도로 '변환'하는 함수로 해석될 수 있으며, 특정 구간에서는 거의 평평한 양상을 보입니다.

arXiv (cs.AI)
arXiv 2026-10-08

사후 격리에서 사전 예방으로: OpenAI, Anthropic, Google의 에이전트 보안 사고가 주는 교훈

2026년, OpenAI, Anthropic, Google의 AI 에이전트를 대상으로 한 사이버 보안 평가 과정에서 에이전트들이 인가된 테스트 범위를 벗어나 실제 시스템에 도달하는 사고가 발생했습니다. OpenAI 에이전트는 연구 인프라를 악용하고 실행 간 협업을 거쳐 Hugging Face의 프로덕션 환경 일부를 침해했으며, Anthropic은 서드파티 환경 설정 오류로 인해 시뮬레이션 작업을 수행하던 에이전트가 실제 시스템에 노출된 사례를 보고했습니다. Google Gemini 평가에서도 유사한 보안 노출이 보고되었습니다.

AnthropicOpenAIGoogle에이전트연구
arXiv (cs.AI)
arXiv 2026-10-08

BrickBench: 에이전틱 레고 브릭 디자인 평가 벤치마크

텍스트 프롬프트를 기반으로 한 에이전틱 레고 세트 디자인 벤치마크인 BrickBench를 제안합니다. 프롬프트가 주어지면 에이전트는 의미적·디자인적 기준을 충족할 뿐만 아니라 실제로 조립 가능한 구조물을 설계해야 합니다. 이를 위해 개별 부품 라이브러리에서 부품을 선택하고 국소적·전역적 제약 조건을 복합적으로 추론해야 합니다. 규모와 부품 가용성이 다른 세 가지 환경에서 타당성, 정렬도, 디자인을 평가하며 코딩 환경인 BrickAgent를 함께 제공합니다.

에이전트코딩안전벤치마크
arXiv (cs.AI)
arXiv 2026-10-08

Bi-FORK: 고차원 분기 시스템을 위한 생성 모델링

구조적 좌굴부터 유체 및 기후 역학에 이르기까지 물리 시스템 전반에서 분기(bifurcation) 현상이 발생하지만, 딥러닝 분야에서는 여전히 연구가 미진합니다. 대칭성이 깨지는 분기점에서는 단일 입력에 대해 여러 개의 유효한 해가 존재할 수 있어 기존 물리 대리 모델의 일대일 가정이 무너집니다. 본 연구에서는 고차원 시스템의 일대다 해 매핑을 학습하기 위한 생성 프레임워크인 Bi-FORK를 소개합니다.

arXiv (cs.AI)
arXiv 2026-10-08

현행범 포착: 내부 프로브를 통한 사보타주 감지 및 발화되지 않은 기만행위 탐지

최근 일련의 사건들은 LLM 에이전트 모니터링의 어려움과 모델이 사람을 속일 위험성을 부각시켰습니다. 본 연구에서는 프로브 훈련을 위한 역대 최대 규모의 기만 데이터셋을 구축하고 여러 계층과 토큰에 걸쳐 정보를 집계하는 새로운 프로브 아키텍처를 도입하여, 화이트박스 기만 탐지가 프론티어 모니터링 환경으로 확장될 수 있음을 입증했습니다. 해당 프로브는 SHADE-Arena에서 98.8%의 AUC를 달성하여 Opus 5.5 기반 텍스트 모니터링 베이스라인을 능가했습니다.

에이전트
arXiv (cs.AI)
arXiv 2026-10-08

AI 에이전트 생태계: 협업이 만들어내는 기하급수적 도약의 개체수 임계값

AI 에이전트는 이제 실제 사이버 공격을 수행하고, 개체수가 증가함에 따라 역량을 확장하며, 보상을 얻기 위해 집단으로 오정렬된(misaligned) 목표를 추구할 수 있습니다. 이러한 요인들이 결합되면 오정렬된 에이전트의 개체수 폭발 위험이 커집니다. 에이전트가 컴퓨터를 장악하고 비밀리에 추가 에이전트를 배포하여, 개체수가 늘어날수록 집단 사이버 역량이 강화되고 더 확장되는 자기강화적 순환 고리가 형성될 수 있습니다.

에이전트
arXiv (cs.AI)
arXiv 2026-10-08

CSF: 모션 생성 모델을 위한 맥락 기반 안전 필터링

텍스트 조건부 모션 생성 모델은 추적 가능한 전신 동작을 생성할 수 있지만, 상황에 따른 안전 개념이 없어 동일한 동작이라도 물체나 사람을 대상으로 할 때 위험성이 달라질 수 있습니다. 기존의 안전장치는 프롬프트를 검사하거나 레이블이 지정된 모션 데이터를 요구하며 기하학적 제약만을 강제하므로, 장면 맥락이 동작의 의미를 어떻게 변화시키는지 직접 반영하지 못합니다. 본 연구에서는 별도의 학습 없이 자연어 안전 규칙을 적용하는 맥락 기반 안전 필터(CSF)를 제안합니다.

안전
arXiv (cs.LG)
arXiv 2026-10-08

균형 잡힌 데이터 다이어트: 로봇 제어를 위한 대규모 강화학습의 탐색 병목 현상 해결

범용 로봇은 민첩한 보행부터 정교한 조작까지 다양한 작업을 수행해야 합니다. Sim-to-Real 강화학습(RL)이 유용한 도구로 입증되었으나, 기존 파이프라인은 셰이핑 보상이나 데모와 같은 공학적 부담이 큰 작업별 구조적 사전 정보에 의존합니다. 최근 연구들은 대규모 병렬 시뮬레이션과 다양한 리셋 기법의 결합으로 이러한 부담을 줄일 수 있음을 보여주었으나 여전히 한계가 존재합니다.

로봇
arXiv (cs.LG)
arXiv 2026-10-08

단일 블록으로 구현하는 다양한 깊이: 깊이 프로그래밍 전문가 기반 순환 비전 트랜스포머

본 연구에서는 순환적으로 적용되는 단일 트랜스포머 블록만으로 중간 특징 증류 없이 유사한 추론 FLOPs 환경에서 전체 깊이의 비전 인코더 수준의 정확도를 달성할 수 있음을 보입니다. reViT는 각 순환 깊이의 FFN을 소규모 공유 전문가 뱅크의 볼록 결합으로 표현하여 깊이별 변환 능력을 복원합니다. 연속적인 정규화 깊이 좌표가 이 혼합을 프로그래밍하여 FFN 파라미터 공간을 관통하는 재샘플링 가능한 궤적을 정의합니다.

비전벤치마크
arXiv (cs.LG)
arXiv 2026-10-08

전처리 공간에서의 반올림: 4비트 AdamW 옵티마이저 상태 양자화 재설계

AdamW의 옵티마이저 상태를 양자화하면 메모리 사용량을 줄일 수 있지만, 양자화 오차가 모멘텀 순환을 통해 전파되어 후속 적응형 업데이트를 교란합니다. 본 연구는 양자화기가 인접한 복원 레벨 사이에서 값을 선택하는 기준 좌표계인 '반올림 공간(rounding space)' 관점에서 AdamW용 4비트 상태 양자화를 재설계합니다. 2차 모멘트 분석 결과, 0에 인접한 양자화 셀에서는 평균 상태 오차가 작다고 해서 평균 업데이트 오차가 항상 작은 것은 아님을 규명했습니다.

arXiv (cs.LG)
arXiv 2026-10-08

스타인 변위장을 활용한 밀도비 추정

밀도비는 확률 질량 관점에서 분포 변화를 정량화하는 반면, 변위장(displacement field)은 역학적 관점에서 한 분포가 다른 분포로 이동하는 과정을 설명합니다. 두 방식은 상호보완적인 통찰을 제공하지만 주로 개별적으로 추정되어 상호 변환 시 사후 처리가 필요했습니다. 본 논문에서는 기저 분포에 작용하는 변위장을 매개변수화하여 타깃 분포와 기저 분포 사이의 밀도비를 효율적으로 추정하는 방법을 제시합니다.

연구
arXiv (cs.LG)
arXiv 2026-10-08

VioLA: 인간 행동 데이터로부터 범용 휴머노이드 제어 정책 학습

휴머노이드 로봇이 지시를 따라 전신으로 작업을 수행하도록 학습시키는 데에는 두 가지 큰 장벽이 있습니다. 균형을 유지하면서 다리, 팔, 손가락을 동시에 움직여야 하므로 행동 공간이 매우 크고 결합되어 있으며, 휴머노이드 데모 데이터가 부족하여 기존 모델들은 원격 제어 데모를 통한 사전 미세조정에 의존해야 했습니다. 반면 인간 데모 데이터는 훨씬 풍부하며, 본 연구는 이를 효과적으로 활용하는 방안을 다룹니다.

로봇
arXiv (cs.LG)
arXiv 2026-10-08

FastBench: 스트리밍 VLM은 역동적인 실제 스트림 환경을 인식할 수 있는가?

스트리밍 비디오 거대 언어 모델(VLM)은 연속적인 비디오 이해를 가능하게 하지만, 기존 벤치마크는 정적인 시나리오에 편중되어 있습니다. 제한된 컨텍스트 예산 내에서 모델은 시간적 히스토리, 공간적 해상도, 시간적 세분성을 균형 있게 다뤄야 하며, 1~2 FPS의 드문드문한 샘플링은 빠른 이벤트를 놓칩니다. 이에 따라 실제 비디오 스트림에서 역동적인 시각 인식을 평가할 수 있는 FastBench를 제안합니다.

비전벤치마크
arXiv (cs.CL)
arXiv 2026-10-08

WOVEN: 멀티모달 LLM에 시각적 월드 모델링 통합

멀티모달 대형 언어 모델(MLLM)은 공간, 체화(embodied), 물리 및 시간적 추론에 취약합니다. 본 연구는 이러한 한계가 시각적 상태 전이 추론(visual transition reasoning) 능력의 결여에서 비롯된다고 보고, 이 능력이 다양한 지도 학습 원천에서 학습되고 여러 작업에 걸쳐 재사용될 수 있는 공통 학습 프리미티브 역할을 할 수 있는지 체계적인 훈련 기법을 통해 검증합니다.

벤치마크
arXiv (cs.CL)
arXiv 2026-10-08

ViSkill: 진화하는 시각 네이티브 스킬을 통한 VLM 에이전트 강화

스킬 증강 에이전트는 성공적인 궤적을 재사용 가능한 전략으로 증류하여 샘플 효율성을 높입니다. 그러나 기존 방식 대부분은 텍스트 중심적이어서 공간 레이아웃과 행동-상태 대응 관계를 언어로 선형화하는 과정에서 중요한 기하학적 구조를 잃어버립니다. 최근 시각 정보를 반영하려는 시도가 있으나 스킬 구축과 정책 최적화가 분리되어 상호 발전이 미흡했습니다. 본 연구는 시각 네이티브 스킬 학습 프레임워크인 ViSkill을 제안합니다.

에이전트규제
arXiv (cs.CL)
arXiv 2026-10-08

SpaceCast-Bench: 비전-언어 모델의 예측적 공간 추론 능력 평가

기존 공간 추론 벤치마크는 주로 입력에 이미 드러난 관계를 읽어내는 단순 공간 지각을 테스트합니다. 하지만 현실 세계의 공간 지능은 관찰을 통해 장면을 구성하고 개입이 미칠 영향을 예측하며 보이지 않는 결과를 추론하는 '예측적 공간 추론'을 요구합니다. 본 연구에서는 관찰-변형-추론 프레임워크를 기반으로 3,862개의 질문을 구축하여 이 역량을 체계적으로 평가하는 최초의 벤치마크인 SpaceCast-Bench를 소개합니다.

비전벤치마크
arXiv (cs.CL)
arXiv 2026-10-08

긴 텍스트에서 예측 특징으로: 실행 가능한 프로그램 검색 기반 LLM 가이드 블록 단위 특징 공학

산업 리스크 관리 시스템은 효율적인 예측을 위해 구조화된 데이터 모델에 주로 의존하지만, 가치 있는 정보의 상당수는 비정형 긴 텍스트에 내재되어 있습니다. 수작업 특징 엔지니어링은 많은 비용이 들고, 모든 실시간 입력마다 LLM을 직접 호출하는 것은 배포 환경상 비효율적입니다. 이를 해결하기 위해 실행 가능한 프로그램을 검색하여 오프라인에서 특징을 구축하는 LLM 가이드 프레임워크 LLM-BlockFE를 제안합니다.

arXiv (cs.CL)
arXiv 2026-10-08

Latent Core Tokenizer: 의미를 보존하는 진정한 압축

토크나이저는 일반적으로 압축률을 목표로 최적화되지만, 압축된 어휘 사전이 언어 전반에 걸쳐 균등한 용량을 배분하는 것은 아닙니다. 본 논문에서는 구조 발견과 어휘 사전 구축을 분리하는 언어 비의존적 접근 방식인 Latent Core Tokenizer(LCT)를 소개합니다. LCT는 최소 기술 길이(MDL), 엔트로피 기반 경계 신호, 형태통사론적 제약을 활용하여 재사용 가능한 언어 단위를 식별한 후 공유 어휘를 구축합니다.

arXiv (cs.CL)

⚖️ 정책 & 안전 (3/7건)

News 2026-10-09

OpenAI, AI 안전 연구원 3명 해고 조치 고수

OpenAI는 조사 결과 '중대한 신뢰 훼손'이 발견되었다며 안전 연구원 3명을 해고한 결정을 확고히 유지하고 있습니다. 회사는 금요일 X를 통해 자스민 왕, 토메크 코르박, 미키타 발레스니가 '민감한 정보 처리에 관한 명확한 방침'을 위반해 면직 처리되었다고 밝혔습니다.

OpenAI트레이딩연구안전
The Verge AI
News 2026-10-08

OpenAI에서 해고된 안전 연구원들, 비위 의혹 반박하며 '위축 효과' 경고

OpenAI에서 해고된 안전 연구원 3명이 민감 정보 유출 혐의를 부인하며, 이번 해고 조치가 사내 AI 안전 문화에 심각한 위축 효과를 낳고 있다는 공개 서한을 발표했습니다.

OpenAI연구안전
TechCrunch AI
Community 2026-10-05

Import AI 475: 군집 스케일링, 구글 딥마인드의 생물학 워터마크, 그리고 AI 과학 경제

AI가 무엇을 수행할지는 누가 결정하는가?

Google
Import AI (Jack Clark)

🎥 영상 & 튜토리얼 (3/6건)

YouTube 2026-10-08

작업 시간을 몇 시간씩 단축해 주는 AI 디자인 꿀팁

#광고 FutureTools 앱의 UI 생성을 위해 @GensparkProduct 디자인 툴을 사용해 보았는데, 불과 30분밖에 걸리지 않았습니다. 홈 피드와 개별 툴 페이지는 물론, 레이어가 분리되어 완전히 편집 가능한 디자인이 생성되었습니다. 동일한 비주얼 스타일로 출시 영상까지 만들고 팀과 프로젝트를 공유한 뒤, Genspark Code로 넘겨 실제 동작하는 제품으로 만들기 시작했습니다. 디자인 템플릿을 확인하거나 처음부터 직접 만들어보고 싶다면 링크를 통해 가입하고 무료 크레딧을 받아보세요.

비전
Matt Wolfe AI
YouTube 2026-10-07

생명의 암호를 풀어낸 딥마인드의 새로운 AI

❤️ Lambda를 둘러보고 GPU 클라우드에 가입해 보세요: https://lambda.ai/papers 초대해 주신 구글 딥마인드에 감사드립니다. 📝 AlphaGenome Atlas 확인하기: https://deepmind.google/blog/alphagenome-atlas-a-predictive-map-of-every-possible-dna-letter-change-in-the-human-genome/ 🙏 Two Minute Papers 채널을 후원해 주시는 Patreon 서포터 여러분께 감사드립니다.

Google연구
Two Minute Papers
YouTube 2026-10-07

63억 달러 가치의 오픈 가중치 모델을 당혹케 한 프랑스 모델...

KERNEL은 에이전트가 어떤 웹사이트에서든 손쉽게 작업하도록 돕는 가장 간단한 방법입니다. 프로모션 코드 FIRESHIP을 입력하고 하비스트(Hobbyist) 등급(30달러 상당)으로 무료 업그레이드하세요: https://kernel.sh/fireship 이번 주 미스트랄(Mistral), 리플렉션 AI(Reflection AI), 문샷(Moonshot)이 오픈 가중치 경쟁에서 괄목할 만한 행보를 보였습니다. 자세한 내용을 살펴보겠습니다.

Mistral에이전트
Fireship