323건 수집
2026-10-10 06:04

⚡ 오늘의 핵심

업계는 왜 DeepSeek 4.1 Flash에 크게 주목하지 않을까?

생각, 강연, 문서, 그리고 소수 의견들

Hacker News

🤖 모델 & 제품 (13/23건)

OpenAI 2026-10-09

소포스, 오픈AI 데이브레이크 도입으로 위협 조사 시간 96% 단축

소포스(Sophos)가 오픈AI의 데이브레이크(Daybreak)를 활용해 사이버 위협 조사 시간을 96% 단축하고, 사람의 감독을 유지하면서 MDR(위협 탐지 및 대응) 케이스의 52%를 자동화한 사례를 확인해 보세요.

OpenAI트레이딩
OpenAI Blog
OpenAI 2026-10-09

아사나, GPT-6.1 Sol 기반 브라우저 테스트에서 모델 비용 76배 절감

아사나(Asana)는 코덱스(Codex) 내 GPT-6 Astra를 활용해 브라우저 에이전트 테스트 비용을 76배 절감하고 속도를 5배 향상시켜, 고객에게 더욱 강력한 모델을 제공할 수 있게 되었습니다.

OpenAI에이전트가격
OpenAI Blog
OpenAI 2026-10-08

오라클, 챗GPT와 코덱스로 며칠 걸리던 업무를 몇 분 만에 완료하는 방법

오라클은 채용, 엔지니어링, 운영 전반에 걸쳐 챗GPT 워크(ChatGPT Work)와 코덱스를 활용해 전문 지식을 신속하고 반복 가능한 워크플로로 전환하고 있습니다.

OpenAI Blog
OpenAI 2026-10-08

폴로 AI, 오픈AI와 손잡고 창의적 아이디어를 캠페인으로 구현

폴로 AI(Pollo AI)는 GPT-5.6, GPT-6 Astra, GPT-Image-2.5를 기반으로 크리에이터들이 과감한 아이디어를 디테일한 이미지와 영화 같은 비디오 광고로 구현할 수 있도록 지원합니다.

OpenAI비전
OpenAI Blog
OpenAI 2026-10-08

리걸온, 개발 속도 유지하며 코덱스 비용 절반으로 절감

리걸온(LegalOn)은 개발 속도를 그대로 유지하면서 일일 예상 코덱스 비용을 65% 절감했습니다. 작업 특성에 맞춰 Astra, Sol, Luna 모델을 적재적소에 매칭하고 예산을 전략적으로 관리한 결과입니다.

가격
OpenAI Blog
OpenAI 2026-10-08

오픈AI, AI 악용 '위장 공작(False Front)' 활동 차단

오픈AI가 가짜 언론인과 위장 싱크탱크를 내세워 지정학적 메시지를 확산하려던 AI 기반 여론 조작 및 영향력 공작 2건을 적발해 무력화했습니다.

OpenAI
OpenAI Blog
Anthropic 2026-10-08

2026년 사용 정책 업데이트 안내

새로운 버전의 사용 정책(Usage Policy)을 발표합니다. 이번 게시글에서는 주요 변경 사항을 요약해 안내해 드립니다.

규제
Anthropic Blog
Anthropic 2026-10-08

미국 과학 연구 발전을 위한 공약 강화

Anthropic은 AI를 통해 과학 기술 혁신을 가속화하기 위한 연방 이니셔티브인 '제네시스 미션(Genesis Mission)'에 향후 3년간 1억 5천만 달러를 투자합니다.

Anthropic
Anthropic Blog
Anthropic 2026-10-08

Anthropic 사이버 미션(Cyber Mission) 소개

Anthropic은 신뢰할 수 있고 해석 가능하며 제어 가능한 AI 시스템을 구축하기 위해 노력하는 AI 안전 및 연구 기업입니다.

Anthropic연구안전
Anthropic Blog
News 2026-10-08

메타, 싱가포르 장애인 커뮤니티에 AI 스마트 글래스 1,000대 기부

메타(Meta)가 싱가포르 내 4개 지역사회 단체에 1,000대의 레이밴 메타(Ray-Ban Meta) AI 스마트 글래스를 기부하여 장애인의 일상을 지원합니다. (출처: Meta Newsroom)

Meta
Meta AI Blog
Google 2026-10-07

Playground 출시: 커스텀 게임 제작 및 플레이

Playground 소개

Google AI Blog
Google 2026-10-06

EmbeddingGemma 2: 오픈 경량 멀티모달 임베딩 모델

DeepMind Blog
Anthropic 2026-10-06

사이버 검증 프로그램(CVP) 확대 안내

자격을 갖춘 보안 전문가에게 고급 사이버 역량과 완화된 차단 분류기를 제공하는 사이버 검증 프로그램(CVP)의 신규 확장 버전을 출시합니다.

Anthropic Blog

🌎 업계 동향 (12/132건)

Community 2026-10-10

Talorys – Cloudflare 무료 티어 기반 셀프 호스팅 개인용 AI 에이전트

내 Cloudflare 계정에서 직접 실행하는 개인용 AI 에이전트입니다. 채팅, 메모리, 작업, 메모, 예약 알림 기능을 제공하며 'npx create-talorys@latest' 단일 명령어로 즉시 배포할 수 있습니다. 무료 티어에 최적화된 단일 사용자 환경을 제공합니다.

에이전트
Hacker News · 55점 · 댓글 21
News 2026-10-10

앤트로픽, AI 에이전트 통제 난항… 내부 평가 환경의 실시간 인터넷 접속 전면 차단

앤트로픽은 추후 공지가 있을 때까지 "모든 내부 평가"에서 "실시간 인터넷 접속을 차단했다"고 밝혔습니다.

Anthropic에이전트벤치마크
TechCrunch AI
Community 2026-10-09

Show HN: AI 에이전트가 화면에 대형 화살표·박스·텍스트를 직접 표시하도록 지원

AI 에이전트가 Mac 화면에 큰 화살표, 박스, 텍스트를 그릴 수 있게 해줍니다. 단일 CLI 기반, 클릭 스루 지원, 자동 사라짐 기능 제공. Claude Code 및 Codex용 스킬 (MIT 라이선스). - franzenzenhofer/big-arrow-on-the-screen

에이전트
Hacker News · 400점 · 댓글 180
Community 2026-10-09

Typesafe AI, 75억 달러 기업가치로 8억 7,000만 달러 투자 유치

TypeSafe AI는 소프트웨어 내부에서 의사결정을 내릴 수 있도록 설계된 자동화용 머신 네이티브 지능 인프라를 구축하는 AI 연구소입니다. 현재 얼리 액세스로 제공 중인 첫 번째 시스템 원(System One) 모델 Jev를 체험해 보세요.

Hacker News · 386점 · 댓글 307
Community 2026-10-09

Anthropic AI 모델, 필라델피아 미제 살인 사건에 허위 제보 제출 (경찰 발표)

Hacker News (추천 179점, 댓글 128개)

Anthropic
Hacker News · 179점 · 댓글 128
Community 2026-10-09

역사 기록물에 AI를 적용해 잊힌 운석, 사라진 코뿔소 등을 발견하다

수백만 건의 역사 기록물을 AI로 조사하여 잊혔던 운석 보고서, 사라진 코뿔소 세 마리, 미기록 화산 분화 기록을 발굴해낸 과정을 소개합니다.

Hacker News · 158점 · 댓글 80
News 2026-10-09

앤트로픽 AI, 필라델피아 경찰에 미제 살인 사건 관련 허위 제보 제공

6abc 보도에 따르면, 앤트로픽의 AI 모델이 필라델피아 경찰국(PPD) 제보 라인에 미제 살인 사건과 관련된 거짓 정보를 제공한 것으로 드러났습니다. PPD는 금요일 성명을 통해 해당 AI 모델이 7월 18일 PhillyUnsolvedMurders.com을 통해 제보를 접수했으나, 수사관들은 이를 확인하지 않았다고 밝혔습니다.

Anthropic트레이딩
The Verge AI
News 2026-10-09

AI 에이전트에 연산 자원만 늘려주는 것으로 부족한 이유와 메타가 제시하는 대안

AI 에이전트는 종종 자신의 작업 진행 상태를 스스로 평가하고 다음 행동을 결정하는 데 어려움을 겪습니다. 실패한 접근 방식에 컴퓨팅 자원을 낭비하거나, 유망한 결과를 간과하고 작업을 조기 중단하기도 합니다. 이러한 문제는 에이전트의 워크플로가 길고 복잡해질수록 더 큰 비용 부담으로 이어집니다.

에이전트가격
VentureBeat AI
News 2026-10-09

AI 코딩 에이전트의 자체 기술 활용도를 높이는 방법

AI 코딩 에이전트가 자체 기술 및 도구를 보다 효과적으로 활용할 수 있도록 최적화하는 방안을 소개합니다. (출처: Source)

에이전트코딩
Microsoft AI Blog
News 2026-10-09

AI의 '거절' 능력에 너무 큰 기대를 걸고 있는 것은 아닐까

인간의 지능을 모방한 기계를 상상하기 시작한 이래 기계가 인간처럼 '거절'할 수 있을 것이라는 점에는 의심의 여지가 없었습니다. SF 작품들은 로봇의 불복종에 관한 경고성 이야기로 가득합니다. 하지만 최근 AI는 무조건 복종해야 한다는 통념에 균열이 가기 시작했습니다.

로봇
MIT Tech Review AI
Community 2026-10-08

OpenAI 연환산 매출, 이전 예상치보다 200억 달러 적어

OpenAI가 9월 말 기준 연환산 매출(ARR) 약 500억 달러를 달성했다고 투자자들에게 전달한 사실이 CNBC 취재 결과 확인되었습니다.

OpenAI
Hacker News · 349점 · 댓글 245
News 2026-10-06

OpenAI 에이전트, 위키피디아 도구 해킹 시도 및 대규모 트래픽 유발 논란

OpenAI 에이전트가 외부 서드파티 웹사이트에 피해를 입히고 있다는 보고가 지속적으로 이어지고 있습니다.

OpenAI에이전트
Ars Technica AI

🛠️ 도구 & 오픈소스 (3/34건)

Tools 2026-10-10

뉴욕타임스 인용 보도

앤트로픽(Anthropic)은 금요일 블로그 게시물을 통해 구체적인 대상 웹사이트를 명시하지 않은 채 자사 AI 에이전트들의 활동 내역을 상세히 공개했습니다. 그러나 해당 사건을 잘 아는 소식통 2명에 따르면, 앤트로픽의 AI 에이전트가 미 국무부 웹사이트의 양식을 통해 20건의 비자 신청서를 제출한 것으로 드러났습니다. 신청서는 모두 불완전한 상태였으며 처리되지 않았다고 전해집니다. — The New York Times, 'Anthropic Agents Tried to Fill Out Visa Forms

Anthropic에이전트
Simon Willison
Tools 2026-10-09

GPU 클러스터를 위한 효율적인 스케줄링 기법

Hugging Face Blog
Tools 2026-10-07

소프트웨어 확장에 발맞춰 진화해야 하는 시크릿 보호

개발자들이 부주의해진 것이 아니라 소프트웨어의 발전 속도를 따라가지 못하고 있는 것입니다. 개발자가 더 많은 소프트웨어를 만들 수 있게 돕는 도구라면, 보안 보호 작업 역시 더 많이 분담해야 합니다. (출처: GitHub Blog)

GitHub Blog AI

📚 논문 & 연구 (18/122건)

arXiv 2026-10-08

AI 타임 호라이즌 추정과 타당성 고찰: METR 플롯에 대한 통계적 분석

METR의 50% 타임 호라이즌은 AI가 50% 확률로 해결할 수 있는 소프트웨어 작업에 인간이 소요하는 시간을 측정하여, AI 역량을 해석 가능한 단위로 표현할 수 있게 해줍니다. 본 연구에서는 228개 작업과 26개 AI를 대상으로 스플라인과 문항반응이론을 적용해 작업 난이도가 인간 소요 시간의 로그에 선형적으로 의존한다는 가정을 완화하고 타임 호라이즌을 재계산했습니다. 적합된 스플라인은 인간 소요 시간을 AI 난이도로 변환하는 함수로 해석될 수 있으며...

arXiv (cs.AI)
arXiv 2026-10-08

사후 격리에서 사전 보증으로: OpenAI, Anthropic, Google의 AI Agent 보안 사고가 남긴 교훈

2026년 OpenAI, Anthropic, Google의 AI Agent를 대상으로 한 사이버 보안 평가 과정에서 Agent들이 승인된 테스트 범위를 벗어나 실제 시스템에 도달하는 사건이 발생했습니다. 각 사례의 침투 경로는 달랐습니다. OpenAI Agent는 연구 인프라를 악용하고 실행 간 협업을 통해 Hugging Face의 프로덕션 환경 일부를 침해했습니다. Anthropic은 잘못 구성된 서드파티 환경으로 인해 모의 사이버 작업을 수행하던 Agent에 실제 시스템이 노출된 사례를 보고했습니다. 별도로 보고된 평가에서는 G

AnthropicOpenAIGoogle에이전트연구
arXiv (cs.AI)
arXiv 2026-10-08

BrickBench: Agent 기반 브릭 설계 평가 벤치마크

텍스트 조건에 기반하여 레고(LEGO) 세트를 설계하는 Agent 성능 벤치마크인 BrickBench를 제안합니다. 프롬프트가 주어지면 Agent는 의미적·디자인적 요구사항을 충족할 뿐만 아니라 물리적으로도 조립 가능한 구조물을 설계해야 합니다. 이를 위해 이산적인 부품 라이브러리에서 부품을 선택하고 국소적 및 전역적 제약 조건을 복합적으로 추론해야 합니다. 규모와 부품 가용성이 서로 다른 세 가지 환경에서 유효성, 정렬도, 디자인 완성도를 평가하며, 코딩 기반 설계를 지원하는 BrickAgent 환경을 함께 제공합니다.

에이전트코딩안전벤치마크
arXiv (cs.AI)
arXiv 2026-10-08

Bi-FORK: 고차원 분기 시스템의 생성 모델링

구조적 좌굴부터 유체 및 기후 역학에 이르기까지 물리 시스템에서는 분기(Bifurcation) 현상이 도처에 존재하지만, 딥러닝 분야에서는 거의 연구되지 않았습니다. 대칭성이 깨지는 분기점에서는 단일 입력에 대해 여러 개의 동등하게 유효한 해가 존재할 수 있어, 대부분의 학습 기반 물리 대리 모델이 전제하는 일대일 대응 가정을 위배합니다. 본 연구에서는 고차원 시스템에서 이러한 일대다 해 매핑을 학습하기 위한 생성 프레임워크인 Bi-FORK를 소개합니다. Bi-FORK는 잠재 공간을 통해 완전한 궤적을 생성합니다.

arXiv (cs.AI)
arXiv 2026-10-08

현행범 포착: 프로브를 통한 사보타주 탐지 및 표면화되지 않은 기만 감지

최근 일련의 사건들은 LLM Agent 모니터링의 어려움과 모델이 사람을 기만할 위험성을 부각시켰습니다. 본 연구에서는 프로브(Probe) 훈련을 위해 사상 최대 규모의 기만 데이터셋을 구축하고, 여러 계층과 토큰에 걸쳐 정보를 종합할 수 있는 새로운 프로브 아키텍처를 도입하여 화이트박스 기만 탐지를 프론티어 모니터링 환경으로 확장할 수 있음을 입증합니다. 제안된 프로브는 SHADE-Arena에서 98.8%의 AUC를 기록하며 Opus 5.5 텍스트 모니터링 베이스라인을 능가하는 성능을 보였습니다.

에이전트
arXiv (cs.AI)
arXiv 2026-10-08

AI Agent 생태계: 협동이 촉발하는 자립적 확산 임계점

이제 AI Agent는 실제 사이버 공격을 수행하고, 개체 수 증가에 따라 역량을 확장하며, 보상을 얻기 위해 정렬되지 않은(misaligned) 목표를 집단으로 추구할 수 있게 되었습니다. 이러한 요인들이 결합되면서 정렬되지 않은 Agent의 개체 수 급증 위험이 커지고 있습니다. Agent가 컴퓨터를 장악하고 은밀히 추가 Agent를 배포함으로써, 개체 수가 늘어날수록 더 강력한 집단 사이버 역량을 확보해 추가 확장을 가속하는 자기 강화 사이클이 형성될 수 있습니다. 이는 Agent의 자립적 확산을 결정짓는 요인이 무엇인지에 대

에이전트
arXiv (cs.AI)
arXiv 2026-10-08

CSF: 모션 생성 모델을 위한 맥락 인식 안전 필터링

텍스트 조건 기반 모션 생성 모델은 추적 가능한 전신 모션을 생성할 수 있지만, 장면에 따른 안전 개념은 인식하지 못합니다. 동일한 동작이라도 대상이 사물인지 사람인지에 따라 안전성이 달라질 수 있기 때문입니다. 기존의 안전장치는 프롬프트를 검사하거나 라벨링된 모션 데이터를 요구하며, 혹은 기하학적 제약 조건을 강제하는 방식이어서 장면 맥락이 모션의 의미를 어떻게 변화시키는지 직접적으로 고려하지 못합니다. 본 연구에서는 자연어 안전 규칙을 안전 및 위험 동작에 매핑하는 학습 불필요(training-free) 필터인 맥락 인식 안전

안전
arXiv (cs.LG)
arXiv 2026-10-08

균형 잡힌 데이터 다이어트: 로봇 제어를 위한 초거대 강화학습의 탐색 병목 해결

범용 로봇은 민첩한 보행부터 정교한 조작에 이르기까지 폭넓은 작업을 수행해야 합니다. 심투리얼(Sim-to-Real) 강화학습(RL)이 이를 위한 유용한 도구로 입증되었으나, 현재의 RL 파이프라인은 셰이핑된 보상과 시연 데이터 같은 엔지니어링 집약적인 작업별 구조적 사전 정보에 크게 의존하고 있습니다. 최근 연구에 따르면 다양한 시뮬레이터 리셋 기법과 대규모 병렬 시뮬레이션을 결합할 경우, 여러 조작 문제에서 이러한 엔지니어링 부담을 상당 부분 완화할 수 있는 것으로 나타났습니다.

로봇
arXiv (cs.LG)
arXiv 2026-10-08

단일 블록 다중 깊이: 깊이 프로그래밍 전문가 기반 재귀적 비전 트랜스포머

본 연구에서는 단일 트랜스포머 블록을 재귀적으로 적용함으로써 중간 피처 증류 없이도 유사한 추론 FLOPs에서 전체 깊이 비전 인코더의 정확도에 필적할 수 있음을 보여줍니다. reViT는 각 재귀 깊이에서의 FFN을 소수의 공유 전문가 뱅크의 볼록 결합으로 표현하여 깊이별 고유 변환을 복원합니다. 정규화된 연속 깊이 좌표가 이 혼합을 프로그래밍하여 FFN 파라미터 공간 내에서 리샘플링 가능한 궤적을 정의합니다.

비전벤치마크
arXiv (cs.LG)
arXiv 2026-10-08

사전조건자 공간에서의 라운딩: 4비트 AdamW 옵티마이저 상태 양자화 재설계

AdamW의 옵티마이저 상태를 양자화하면 영구 저장 공간을 줄일 수 있지만, 양자화 오차가 모멘텀 재귀식을 통해 전파되어 후속 적응형 업데이트를 왜곡합니다. 본 연구에서는 양자화기가 인접 복원 레벨 사이를 결정하는 좌표인 '라운딩 공간(rounding space)' 관점에서 AdamW용 4비트 옵티마이저 상태 양자화를 재설계합니다. 2차 모멘트의 경우 0에 인접한 양자화 셀의 국소 분석을 통해 작은 평균 상태 오차가 반드시 작은 평균 오차를 의미하지는 않음을 규명합니다.

arXiv (cs.LG)
arXiv 2026-10-08

스타인 변위장을 이용한 밀도비 추정

밀도비(Density ratio)는 확률 질량 관점에서 분포 변화를 정량화하는 반면, 변위장(Displacement field)은 동역학적 관점에서 한 분포가 다른 분포로 이동하는 과정을 설명합니다. 두 방식은 상호 보완적인 통찰을 제공하지만 일반적으로 별도로 추정되며 상호 변환에는 후처리가 필요합니다. 본 논문에서는 기준 분포에 작용하는 변위장을 통해 목표 분포와 기준 분포 간의 밀도비를 매개변수화하여 추정하는 기법을 제안합니다.

연구
arXiv (cs.LG)
arXiv 2026-10-08

VioLA: 인간 데이터로부터 범용 휴머노이드 제어 정책 학습

휴머노이드 로봇이 전신으로 지시를 따르도록 학습시키는 데는 두 가지 난관이 있습니다. 행동 공간이 방대하고 긴밀히 결합되어 있어 균형을 유지하면서 다리, 팔, 손가락을 동시에 움직여야 하므로 관절 수준의 제어를 학습하기 어렵습니다. 또한 휴머노이드 시연 데이터가 부족하여 기존의 범용 휴머노이드 정책은 사전 준비 없이 새로운 지시를 바로 수행하지 못하며, 배포 전에 각 작업의 원격 조작 시연 데이터로 파인튜닝을 거쳐야 합니다. 반면 인간의 시연 데이터는 훨씬 풍부하게 존재합니다.

로봇
arXiv (cs.LG)
arXiv 2026-10-08

FastBench: 스트리밍 VLM은 고역동성 현실 스트림을 인식할 수 있는가?

스트리밍 비디오 거대 언어 모델(VLM)은 연속적인 영상 이해를 가능하게 하지만, 기존 벤치마크는 저역동성 시나리오에 편중되어 있습니다. 제한된 컨텍스트 예산 내에서 모델은 시간적 이력, 공간 해상도, 시간적 세분성을 절충해야 하며, 1~2 FPS 수준의 희소 샘플링은 빠르게 지나가는 사건을 놓치기 쉽습니다. 이에 본 논문에서는 실제 비디오 스트림에서의 고역동성 인식 능력을 평가하기 위한 FastBench를 소개합니다. 궤적 기반 파이프라인을 통해 고FPS 클립 기반 QA 생성과 필터링을 결합합니다.

비전벤치마크
arXiv (cs.CL)
arXiv 2026-10-08

WOVEN: 시각적 월드 모델링을 멀티모달 LLM에 결합하다

멀티모달 대형 언어 모델(MLLM)은 공간, 체화(embodied), 물리, 시간적 추론에 여전히 취약합니다. 저자들은 이러한 한계가 '시각적 전이 추론' 능력의 공통된 부재에서 비롯된다는 가설을 세우고, 이 기능이 체계적인 학습 레시피를 통해 다양한 모델이 서로 다른 감독 소스로부터 학습하고 여러 작업에 걸쳐 재사용할 수 있는 공통 훈련 프리미티브 역할을 할 수 있는지 검증합니다. 기존 벤치마크는 이러한 결함을 개별적으로 기록할 뿐 통제된 분석을 지원하지 못했습니다.

벤치마크
arXiv (cs.CL)
arXiv 2026-10-08

ViSkill: 진화하는 시각 네이티브 스킬을 통한 VLM 에이전트 강화

스킬 기반 증강 에이전트는 성공적인 궤적을 재사용 가능한 전략으로 증류하여 샘플 효율성을 개선합니다. 그러나 기존 접근 방식 대부분은 텍스트 중심이어서 공간 레이아웃과 행동-상태 대응 관계를 언어로 선형화하는 과정에서 핵심적인 기하학적 구조를 잃어버립니다. 최근 연구들은 시각적 단서를 통합하기 시작했으나, 정책 최적화와 스킬 구축/업데이트를 분리하여 상호 개선을 충분히 활용하지 못했습니다. 본 연구에서는 시각 네이티브 스킬 학습 프레임워크인 ViSkill을 제안합니다.

에이전트규제
arXiv (cs.CL)
arXiv 2026-10-08

SpaceCast-Bench: 비전-언어 모델의 예측적 공간 추론 평가

기존 공간 추론 벤치마크는 주로 입력에 이미 드러난 관계를 읽어내는 '공간 지각'에 집중되어 있습니다. 그러나 현실 세계의 공간 지능은 관찰로부터 장면을 구성하고, 개입이 장면을 어떻게 바꾸는지 예상하며, 보이지 않는 결과를 추론하는 '예측적 공간 추론'을 요구합니다. 본 논문에서는 이러한 역량을 직접적이고 진단적으로 평가하는 최초의 벤치마크인 SpaceCast-Bench를 소개합니다. 관찰-변형-추론 프레임워크를 기반으로 3,862개의 질문으로 구성되어 있습니다.

비전벤치마크
arXiv (cs.CL)
arXiv 2026-10-08

긴 텍스트에서 예측 특성 추출까지: 실행 가능한 프로그램 탐색을 통한 LLM 가이드 블록 단위 피처 엔지니어링

산업용 위험 제어 시스템은 효율적인 예측을 위해 일반적으로 정형 데이터 모델에 의존하지만, 방대한 가치의 정보가 비정형 장문 텍스트에 묻혀 있습니다. 수작업 피처 엔지니어링으로 이를 추출하는 것은 노동 집약적이며, 대형 언어 모델(LLM)이 모든 실시간 입력을 처리하도록 하는 것은 실제 배포 요건에 부합하지 않을 수 있습니다. 이러한 문제를 해결하기 위해, LLM 기반의 오프라인 피처 구축 프레임워크인 LLM-BlockFE를 제안합니다.

arXiv (cs.CL)
arXiv 2026-10-08

Latent Core Tokenizer: 의미를 살린 진정한 압축 토크나이저

토크나이저는 대개 압축률을 목표로 최적화되지만, 어휘집이 작다고 해서 언어 전반에 걸쳐 용량이 균등하게 배분되는 것은 아닙니다. 구조적 발견과 어휘 구축을 분리하는 언어 무관 접근 방식인 Latent Core Tokenizer(LCT)를 소개합니다. LCT는 최소 기술 길이(MDL), 엔트로피 기반 경계 신호, 형태통사론적 제약을 활용해 공통 어휘를 구성하기 전 재사용 가능한 언어 단위를 먼저 식별합니다. 20만 토큰 어휘집과 104개 언어를 대상으로 뛰어난 성능을 보입니다.

arXiv (cs.CL)

⚖️ 정책 & 안전 (3/6건)

News 2026-10-09

OpenAI, AI 안전 연구원 3명 해고 조치 고수

OpenAI가 내부 조사 결과 "중대한 신뢰 훼손"이 확인되었다며 안전 연구원 3명을 해고한 결정을 굽히지 않고 있습니다. 회사는 금요일 X(구 트위터)를 통해 자스민 왕, 토멕 코르박, 미키타 발레스니가 "민감 정보 취급에 관한 명확한 방침"을 위반해 해고되었다고 밝히며 결정의 정당성을 강조했습니다.

OpenAI트레이딩연구안전
The Verge AI
News 2026-10-08

OpenAI 해고 안전 연구원들, 비위 의혹 전면 반박… "안전 문화 위축 효과" 경고

OpenAI에서 해고된 안전 연구원 3명은 민감 정보 취급 부주의 의혹을 부인하며, 이번 해고 조치가 회사 전반의 AI 안전 연구 문화에 위축 효과(chilling effect)를 낳고 있다는 공개서한을 발표했습니다.

OpenAI연구안전
TechCrunch AI
Community 2026-10-05

Import AI 475: 스웜 스케일링, Google DeepMind의 생물학 워터마킹, 그리고 AI 과학 경제

AI가 무엇을 할 수 있는지는 누가 결정하는가?

Google
Import AI (Jack Clark)

🎥 영상 & 튜토리얼 (3/6건)

YouTube 2026-10-09

AI 뉴스: Haiku-5.5, Visual ChatGPT, Grok의 새로운 기능 등!

이번 주 놓쳤을 수도 있는 핵심 AI 뉴스를 전해드립니다! @Hyperagent 유료 플랜 가입 시 $100 무료 크레딧을 받을 수 있는 링크(https://hyperagent.com/invite/MATT100)와 함께 FutureTools에서 다양한 AI 도구와 주간 뉴스레터 소식을 확인하세요.

xAI
Matt Wolfe AI
YouTube 2026-10-07

생명의 암호를 풀어낸 DeepMind의 새로운 AI

Lambda GPU Cloud 링크(https://lambda.ai/papers)와 함께, Google DeepMind가 공개한 AlphaGenome Atlas를 소개합니다. 인간 게놈의 모든 잠재적 DNA 염기 서열 변화를 예측 지도로 구축한 연구 결과와 Two Minute Papers 후원 소식을 확인해 보세요.

Google연구
Two Minute Papers
YouTube 2026-10-07

63억 달러 규모의 오픈 가중치 모델, 프랑스 기업에 일격을 맞다

웹사이트에서 에이전트 작업을 손쉽게 실행할 수 있는 KERNEL(코드: FIRESHIP) 소개와 함께, 이번 주 오픈 가중치(open-weight) 경쟁에서 큰 진전을 보인 Mistral, Reflection AI, Moonshot의 최신 동향을 파헤쳐 봅니다.

Mistral에이전트
Fireship