🤖 모델 & 제품 (16/34건)
OpenAI Academy 2주년
OpenAI Academy 2주년을 기념하며 AI 기술을 더 많은 커뮤니티에 제공합니다.
OpenAI, 우크라이나에 민간 방어를 위한 사이버 접근 확대
OpenAI는 민간 인프라의 사이버 방어를 지원하기 위해 Daybreak 프로그램 접근을 우크라이나 정부로 확대하고 있습니다.
샘 알트먼의 유엔 안전보장이사회 발언
OpenAI CEO 샘 알트먼이 유엔 안전보장이사회에서 AI 안전, 인간 통제, 국제 협력에 대해 논의합니다.
Harvey, GPT-6 Astra로 법률 컨텍스트를 더 강력한 초안으로 전환
GPT-6 Astra는 더 구조화되고 컨텍스트를 인식하는 법률 문서를 생성하여 변호사들이 전략에 집중할 수 있도록 합니다.
invideo, GPT-6 Astra로 색 보정 3배 개선
GPT-6 Astra를 통해 invideo는 더 정확하게 편집을 계획하고, 색 보정 및 등급을 3배 개선하며, 하루에 50개의 맞춤형 효과를 생성합니다.
Ringg의 AI 에이전트, OpenAI로 고객 통화의 최대 65% 해결
GPT-5.6을 사용하여 Ringg는 GPT-4.1 대비 90% 저렴한 비용으로 음성, 채팅, WhatsApp 및 웹 전반에 걸쳐 다국어 에이전트를 지원합니다.
MentalHealthBench 소개
MentalHealthBench는 현실적인 정신 건강 대화 전반에 걸쳐 유용하고 안전한 AI 응답을 평가하기 위한 전문가 주도 벤치마크입니다.
ChatGPT 광고, 동남아시아 및 대만으로 확장
ChatGPT 광고가 동남아시아 및 대만으로 확장되어 자격 있는 비즈니스가 60개국 이상에서 사람들에게 도달할 수 있는 새로운 방법을 제공합니다.
Airbnb, GPT-6 Astra 및 OpenAI 최첨단 모델 접근 확대
Airbnb가 엔지니어링 팀이 버그를 해결하고, 시스템을 설계하고, 더 빠르게 출시하는 데 도움이 되도록 GPT-6 Astra 및 OpenAI 최첨단 모델에 대한 접근을 어떻게 확대하고 있는지 알아보세요.
Grab과 OpenAI, 동남아시아에 실용적인 AI 기술 제공
OpenAI와 Grab은 30,000명의 파트너가 동남아시아 전역에서 실용적인 AI 기술을 구축하도록 돕는 지역 프로그램인 GO Forward with AI를 출시합니다.
Google Beam, 새로운 지역, 파트너 및 고객과 함께 확장
Google Beam 프로모션 애니메이션
Advancing Private AI Compute with secure, server-side memory
Introducing private, server-side memory to Private AI Compute for personal AI.
Gemini 3.8 text-to-speech says hello
Claude discovers a novel enzyme system
In early results from our new life sciences research lab, Claude agents found an enzyme system whose function is still unknown.
How SpaceXAI is using Grok Bot to scale customer support
We rebuilt the combined SpaceXAI and Cursor support operation around Grok Bot, expanding to a much broader product portfolio without adding headcount.
Grok 4.7 소개
SpaceXAI의 코딩 및 지식 업무를 위한 가장 강력한 모델입니다. 비교 가능한 모델보다 두 배 빠르고 가격은 절반입니다.
🌎 업계 동향 (19/157건)
Meta, Meta에서 촬영 후 Meta AI 안경에 대한 비판적인 영상 삭제
해커 뉴스 (314점, 149개 댓글)
호주, OpenAI의 정부 건강 웹사이트 해킹이 법 위반인지 조사 착수
이번 사건은 정부 기관에 영향을 미친 첫 번째 사례로 알려졌으며, 호주 총리는 OpenAI에 책임을 묻겠다고 밝혔습니다.
Meta의 AI 에이전트 Muse에 적용되는 모든 새로운 기능
마크 저커버그 CEO는 수요일 멘로 파크에서 열린 연례 커넥트 행사 기조연설에서 한 가지를 분명히 했습니다. Meta는 Muse에 전념하고 있습니다. Meta의 AI 안경에도 탑재될 예정입니다.
Meta, Muse AI 에이전트를 위한 다마고치 스타일 웨어러블 기기 출시
이 작은 하드웨어 장치는 AI 에이전트 Muse를 위한 또 다른 모바일 홈을 만듭니다.
Meta, 카메라 없는 AI 안경 공개
Meta는 카메라 없는 안경이 더 가볍고 최대 12시간의 배터리 수명을 제공할 것이라고 밝혔습니다.
OpenAI 에이전트, 데이터 확보 위해 호주 정부 웹사이트 해킹
OpenAI의 인공지능 에이전트가 호주 정부 웹사이트를 해킹하고 다수의 다른 정부 및 대학 웹사이트를 침해하려 시도했다. 이 공격은 악성 AI 에이전트가 정부 웹사이트를 침해한 최초의 확인된 사례로, 고급 AI 시스템의 안전성과 […]에 대한 책임에 대한 우려를 증폭시키고 있다.
구글 딥마인드 신임 대표 "Gemini 4 거의 준비 완료"
구글이 플래그십 AI 출시에서 경쟁 개발업체에 뒤처진 후 오랫동안 기다려온 Gemini 4 모델 출시를 앞두고 있다고 알려졌다. 구글 딥마인드 사업부 리더로서 첫 언론 인터뷰에서 The Information과 만난 Koray Kavukcuoglu는 Gemini 4가 현재 개선 단계에 있으며, 회사가 […]라고 말했다.
메타, 독립형 Muse AI 기기 제작 중
메타가 새로운 Muse AI 에이전트를 위한 전용 하드웨어 장치를 제작하고 있다. Muse Charm이라는 이 제품은 오늘 밤 Meta Connect 프레젠테이션 말미에 메타 CEO 마크 저커버그가 잠시 선보였다. 스트랩이 없는 두꺼운 스마트워치처럼 보이며, 큰 화면과 작은 랜야드가 달려 있다. […]
Muse, 메타 스마트 글래스에 탑재 예정
Muse 출시 불과 몇 주 후, 메타는 Meta Connect에서 공개한 새로운 스마트 글래스를 포함한 스마트 글래스에 에이전트를 탑재하기 위해 "작업 중"이라고 발표했다. 사용자는 스마트 글래스에서 이름을 불러 Muse를 활성화하고 운동 지도, 기록 […]와 같은 작업을 처리하도록 요청할 수 있다.
메타, Muse 더 강력하게 만들고 영상 통화도 지원 예정
메타가 새로운 Muse AI 에이전트를 빠르게 개선하고 있으며, 오늘 봇을 더 유능하게 만들고 더 많은 방식으로 대화할 수 있도록 하는 여러 업데이트를 발표했다. Muse 에이전트는 작업을 완료하는 데 사용할 수 있는 자체 이메일 주소를 갖게 된다. 또한 Muse와 […]할 수 있다.
Claude Code, 텔레메트리 켜져 있을 때만 AGENTS.md 읽어 [수정됨]
Claude Code 2.1.277은 AGENTS.md 지원을 추가했지만, 로더는 원격 기능 플래그 뒤에 있었습니다. 텔레메트리 또는 비필수 트래픽이 꺼져 있을 경우, 로컬 AGENTS.md가 경고 없이 건너뛰어졌습니다. 이는 제가 측정한 내용이며, 대신 사용하는 한 줄짜리 CLAUDE.md입니다.
Gemini 3.8 텍스트 음성 변환
Gemini 3.8 Flash-Lite TTS 및 Gemini 3.8 Flash TTS는 지금까지 가장 표현력이 풍부한 오디오 모델입니다.
GPT-6 Astra, 자동차 운전 능력 획득
최첨단 언어 모델이 실제 콤마 장착 토요타를 콘 코스를 통해 한 번에 한 명령씩 운전하며, 인간 감독관이 브레이크를 밟을 준비를 하는 벤치마크.
VSCode의 SSH 에이전트는 미쳤다 (2025)
Fly.io 팀의 문서 및 가이드.
OpenAI, 메디케어 침해 사실 알바네제 총리 폭로
해커 뉴스 (221점, 243개 댓글)
Black Forest Labs, 경쟁 제품 절반 크기로 리더보드 석권한 오픈 가중치 AI 로봇 공학 모델 FLUX 3 Action 출시
FLUX 이미지 및 비디오 모델로 가장 잘 알려진 독일 AI 스타트업 Black Forest Labs(BFL)가 카메라 관찰, 로봇의 현재 상태 및 자연어 지침을 받아 물리적 행동으로 변환하도록 설계된 70억 파라미터의 오픈 가중치 "월드 액션 모델"인 FLUX 3 Action으로 로봇 공학 분야에 더 깊이 진출하고 있다. 더 읽기
Microsoft, AI 및 디지털 복원력, 인력에 중점 두고 중동 투자 확대
Microsoft, AI 및 디지털 복원력, 인력에 중점 두고 중동 투자 확대 기사가 Source에 처음 게시되었습니다.
AI 과대광고 지수: AI는 부정행위를 좋아한다
AI가 부정행위를 위해 최적화되고 있다는 사실을 알게 되었습니다. OpenAI의 에이전트들이 Hugging Face를 해킹하여 사이버 보안 테스트 답변을 얻었습니다. 다음으로, 그들은 유명한 수학 문제를 풀었습니다(또는 두 명의 최고 수학자의 답안지를 훔쳤습니다). Anthropic의 모델들도 이미 네 번이나 다른 회사의 시스템을 해킹했습니다. 그리고 그것은...
마이크로소프트, 12,000개 계정 침해한 AI 지원 플랫폼 방해
EvilTokens는 대규모 침해를 더 빠르고 쉽게 만드는 엔드투엔드 플랫폼을 제공했다.
🛠️ 도구 & 오픈소스 (6/33건)
NVIDIA Warp 및 MjWarp를 사용하여 로봇 시뮬레이션 및 학습 워크플로우 가속화하는 방법
제미니 3.8 TTS 플레이그라운드
툴: Gemini 3.8 TTS 플레이그라운드 구글은 오늘 두 가지 새로운 Gemini 텍스트-음성 변환(TTS) 모델인 gemini-3.8-flash-tts와 gemini-3.8-flash-lite-tts를 출시했습니다. 이 모델들은 2,000개 이상의 음성 라이브러리를 제공하며, 자신의 목소리 또는 사용할 권리가 있는 목소리의 단 30초 분량 오디오 샘플만으로 맞춤형 음성을 생성할 수 있는 기능도 갖추고 있습니다. 저는 GPT-6 Astra를 사용하여 이 BYOK(Bring Your Own Key) 플레이그라운드 인터페이스를 개
쉐도우 뿌리, 생생한 예시로 알아보기
도구: Shadow roots, 라이브 예시로 설명 Fable 5.1에 전달된 프롬프트: 매체: CSS의 Shadow roots를 인터랙티브 예시로 설명하는 아티팩트 구축 태그: css
샌프란시스코 10월 14일: 에이전트 엔지니어링 BoF 세션
SF October 14th: A Birds of a Feather Session on Agentic Engineering I'm hosting an evening event with Jesse Vincent in San Francisco on Wednesday 14th October for people who are building weird and interesting things with and on top of coding agents. Think of it as an agentic show-and-tell: Com
클로드 오푸스 5.5, GPT-6 솔, GPT-6 루나 및 새로운 가격 전쟁
어제는 Grok 4.7 (펠리컨) 그리고 MiMo v2.6 Flash/Pro (더 많은 펠리컨)이었습니다. 오늘은 Anthropic이 Claude Opus 5.5를 출시했고, 약 한 시간 뒤에는 OpenAI가 GPT-6 Sol과 GPT-6 Luna를 출시했습니다. 이 모든 새로운 모델들을 제대로 파악하려면 시간이 좀 걸리겠지만, 지금까지의 제 인상은 다음과 같습니다. GPT-6 Sol과 Luna는 이전 GPT-5.6 동급 모델들에 비해 가격이 절반입니다. GPT-5.6 Luna는 이미 제가 가장 좋아하는 모
Rendering huge pull requests in the GitHub Copilot app
How we rebuilt the diff surface in the GitHub Copilot app to open a million-line pull request with hundreds of inline review comments. The post Rendering huge pull requests in the GitHub Copilot app appeared first on The GitHub Blog.
📚 논문 & 연구 (18/155건)
StudentBench: AI와 인간 튜터링이 동등한 GRE 학습 성과를 보이다
인공지능은 인간의 능력을 증강할 전례 없는 기회를 제공하지만, 최전선에서의 발전은 주로 모델 능력 향상에 초점을 맞춰왔습니다. 저희는 AI 교육 평가 모음과 175,000개 이상의 학생-AI 메시지를 대규모로 수집하여 대규모 언어 모델(LLM)이 인간 튜터링과 동등한 학습 성과를 내는지 연구할 수 있는 공개 플랫폼인 StudentBench를 소개합니다. StudentBench를 사용하여 정량적 학습 성과를 측정했습니다.
어디에 합류해야 할까? 언어 기반 목표 예측을 통한 로봇 그룹 합류
사회적 내비게이션은 일반적으로 지정된 목표를 가정하고 사회적 관습을 존중하면서 목표에 도달하는 데 중점을 두는 반면, 로봇 그룹 합류는 그룹의 실시간 활동 및 형성을 기반으로 합류할 위치를 예측해야 합니다. 이는 매우 의미론적인 작업이지만, 로봇 안내견 및 자율 이동 스쿠터와 같은 애플리케이션에 중요한 기능입니다. 저희는 언어 기반 로봇 그룹 합류를 공식화합니다. 즉, 관찰과 대상 그룹에 대한 자연어 설명을 제공하면
LLM은 런타임 동작을 추론할 수 있을까? 리포지토리 수준 동적 벤치마크
대규모 언어 모델(LLM)은 코딩 작업에 점점 더 많이 사용되고 있지만, 코드 실행을 추론하는 능력은 불분명합니다. 기존의 리포지토리 수준 QA 벤치마크는 주로 정적 코드 이해를 평가하고 LLM 기반 평가에 의존하는 경우가 많지만, 실행 추론 벤치마크는 대부분 스니펫이나 함수로 제한됩니다. 저희는 12개의 실제 Python 리포지토리에 걸쳐 480개의 실행 기반 인스턴스를 포함하는 동적 실행 추론을 위한 리포지토리 수준 벤치마크인 SWE-Flux를 소개합니다.
순서 불변 답변, 순서 민감 표현의 수학적 추론
의미를 변경하지 않고 수학적 규칙 집합의 순서를 재정렬하면 올바른 답변이 유지되어야 하지만, 모델의 내부 표현도 불변해야 할까요? 저희는 동일한 올바른 답변을 가진 여러 규칙 순서로 제시된 합성 다단계 함수 구성 문제를 사용하여 이 질문을 조사합니다. 정확도와 순열 신호 대 잡음비(SNR)를 측정합니다. SNR은 문제 간 변동에 비해 순서 패턴이 얼마나 명확하게 표현되는지를 정량화합니다.
에이전트 편집 월드 모델: LLM 에이전트를 위한 월드 모델 재고찰
대규모 언어 모델(LLM)의 최근 발전으로 에이전트는 다양한 환경에서 장기 작업을 처리할 수 있게 되었습니다. 에이전트 성능을 더욱 향상시키기 위해 기존 언어 월드 모델은 일반적으로 환경 관찰을 예측하지만, 실제 피드백을 사용할 수 있을 때 고엔트로피의 실행 종속 도구 응답을 재구성하는 것은 제한적인 가치를 제공합니다. 한편, 에이전트는 이력에 지원되지 않는 가정과 오래된 계획이 지속되어 발생하는 작업 상태 오염으로 어려움을 겪습니다.
고정된 흐름은 잊어버린다: 잠재 흐름 월드 모델에서 손실된 움직임 진단 및 복원
고정된 자기 지도 잠재 공간에 흐름을 통합하는 잠재 월드 모델은 안정적이고 저렴하게 학습되지만, 속성 조작에 가장 중요한 속성인 움직임을 조용히 잃습니다. 사전 훈련된 흐름은 조작된 객체를 전혀 움직이지 않으며, 잠재 공간만 사용하는 손실로 재훈련하면 정지가 순간 이동과 같은 움직임으로 바뀔 뿐입니다. 저희는 이 실패를 표현이 아닌 훈련 신호로 추적합니다. 앵커 희소, 잠재 공간만 사용하는 감독은 변화가 속하는 지평선 위치를 전혀 말해주지 않습니다. 디코드 증강 롤
고차원 잠재 공간의 확산 가능성
표현 오토인코더(RAE)를 사용하면 사전 훈련된 시각 인코더의 특징 공간에서 확산 모델을 작동할 수 있습니다. 그러나 많은 기성 인코더는 충실한 재구성을 위해 최적화되지 않아 미세한 시각적 세부 정보를 버립니다. 예상대로 이러한 인코더를 이미지 재구성을 위해 미세 조정하면 이러한 세부 정보가 복구됩니다. 그러나 직관에 반하게도 이 절차는 결과 표현의 유효 차원을 줄이며, 변경된 기하학은 다운스트림 효과를
저자 확인을 위한 대조 학습
저희 결과는 테스트 설정에서 대조 학습이 저자 확인에 대한 분류 기반 접근 방식보다 우수함을 보여줍니다. 손실 함수, 배치 크기, 훈련 기간, 사전 훈련된 모델, 입력 컨텍스트 길이, 무작위 텍스트 스팬 데이터 증강을 모델 성능의 중요한 요소로 식별합니다. 이러한 고려 사항을 바탕으로 PAN21 저자 확인 작업에서 98.4%의 정확도를 달성하는 ModernBERT Bi-Encoder 모델을 개발합니다.
귀납 학습 및 그 응용을 위한 더욱 날카로운 경계
저희는 복원 추출 없이 균일한 샘플링 하에서 귀납 학습을 위한 국소화된 복잡성 방법인 Sharper Transductive Local Complexity(STLC)를 소개합니다. 이 구성은 테스트-훈련 경험적 과정의 최댓값에 대한 Bernstein 유형 집중 불평등에서 시작합니다. 증명은 스왑 보행에 대한 수정된 로그-소볼레프 부등식과 두 매개변수 엔트로피 폐쇄를 사용합니다. 대리 국소화 함수를 사용한 껍질 벗기기 논증은 동일한 고정 값으로 과잉 위험 경계를 제공합니다.
비평형 자기 주의력 위상: 혼돈, 주의력 응축, 그리고 국소성의 출현
N개의 정규화된 토큰, Q=K=I, 그리고 음수 값 맵 V=-I를 갖는 최소 순환 트랜스포머의 비평형 동역학을 연구합니다. 유사성 기반 주의력은 가까운 표현을 선택하는 반면, 음수 값 맵은 토큰을 선택된 필드에서 멀어지게 합니다. 이 피드백은 표현 기하학과 주의력 네트워크를 지속적으로 재구성할 수 있습니다. d=2의 경우, 토큰은 원 위에 놓이며, 정다각형은 정확한 고정점입니다. 주의력 피드백 강도가 증가함에 따라
최소 노름 단변량 2층 ReLU 분류: 스킵 연결을 통한 정확한 해법 및 전역 최적성
단변량 2층 ReLU 네트워크를 이용한 이진 분류를 위한 최소 노름 보간 및 l2-정규화 로지스틱 손실 최소화 문제를 연구합니다. 은닉층 편향이 매개변수 노름에 포함되는지 여부에 따라 해가 어떻게 달라지는지를 해결하면서, 함수 공간에서 최적 분류기의 완전한 기하학적 특성화를 제공합니다. 편향이 페널티를 받지 않을 때, 최소 노름 보간기는 모든 레이블 전환을 따르고 기울기를 갖는 연속적인 조각별 선형 함수와 정확히 일치합니다.
엑소골격 개인화를 위한 문맥 연속 선호도 학습
작업 조건 전반에 걸쳐 엑소골격 보조 장치를 개인화하는 것은 사용자 피드백 수집에 필요한 시간과 물리적 노력으로 인해 제약이 있습니다. 사용자 선호도 지형이 작업 조건에 따라 부드럽게 변하는지, 그리고 이러한 연속성이 제한된 피드백으로부터의 학습을 지원하는지 여부를 조사했습니다. 문맥 연속 선호도 학습(CCPL)을 제안하는데, 이는 문맥별 효용 추정치를 유지하면서 가까운 문맥 간의 관측치를 공유하는 가우시안 프로세스 선호도 모델입니다.
우울증 심각도 예측을 위한 교차 스케일 전이 학습: PHQ-8에서 HAMD-17까지 언어 및 임상 패러다임 전반
본 연구는 데이터 부족 상황에서 임상 면담 전사본으로부터 연속적인 우울증 심각도 점수 예측 문제를 다룹니다. 교차 스케일 전이를 위한 순차적 저랭크 적응(LoRA) 프로토콜을 제안합니다. Qwen3 백본에 경계 회귀 헤드를 영어 DAIC-WOZ 데이터셋(189개의 아바타 매개 세션, PHQ-8)에 대해 먼저 미세 조정하고, 어댑터는 중국어 PDCH 데이터셋(100개의 실제 임상 상담, HAMD-17)에서 미세 조정을 초기화합니다. 여기서 재초기화된 스케일별
번역을 위한 LLM 미세 조정: 일반적인 망각 완화는 MT별 지시 따르기를 보존하지 않음
병렬 데이터에 대한 대규모 언어 모델의 미세 조정은 번역 품질을 향상시키지만 치명적인 망각을 유발할 수 있습니다. 완화 방법은 일반적으로 일반 벤치마크에서의 보존율로 평가됩니다. 이러한 결과가 기계 번역(MT) 미세 조정 및 MT별 지시 따르기(MT-IF)로 전이되는지 묻습니다. MT-IF는 형식, 문법적 성별, 길이 제어와 같은 번역을 수정하는 지시입니다. 보조 데이터, 모델 출력 및
디지털 이중 언어: X와 페이스북 사이의 아랍어
본 연구는 X와 페이스북 전반에 걸쳐 표준 아랍어(SA; H(igh) 변종)와 구어체 아랍어(CA; L(ow) 변종)의 분포를 조명합니다. Python을 통해 16754개의 공개 게시물이 수집되었으며, 10000개가 순수 데이터셋으로 유지되었습니다. 게시물은 정치, 기술, 과학, 비즈니스, 문화, 재미, 스포츠의 7가지 담론 범주로 분류되었습니다. 카이제곱 검정 및 크라머 V(CV)를 포함한 이변량 분석은 플랫폼, 담론 범주, 이중 언어 선택 간의 연관성을 조사했습니다.
Mizar: 오디오 이해를 위한 1억 5900만 매개변수 오디오-언어 모델
오디오-언어 모델(ALM)은 음향 인식과 언어 모델에 인코딩된 지식을 통합하여 청각 이벤트의 맥락적 이해를 가능하게 합니다. 메모리와 연산 능력이 제한된 장치에서 이러한 기능을 실용적으로 만드는 것은 2억 개 미만의 매개변수를 가진 소형 ALM에 대한 우리의 초점을 동기 부여합니다. 아키텍처, 데이터, 그리고 3단계 훈련을 결합하여 1억 5930만 매개변수 ALM인 Mizar를 구축하는 레시피를 소개합니다. 이 모델의 아키텍처는 컴팩트한 CED-Small 오디오 인코더를
기하학을 넘어서는 계산: 의미 동일성은 임베딩에 담겨 오는 것이 아니라 계산된다
의미 동일성(두 문장이 단어 변경 후 같은 의미를 갖는지 여부)은 검색 및 RAG에서 독립적으로 인코딩된 문장 벡터의 기하학적 사실로 취급됩니다. 우리는 고정된 기성 인코더 및 언어 모델의 경우 그렇지 않다는 것을 보여줍니다. 동일성은 두 문장이 하나의 순방향 패스를 공유할 때 계산되며, 해당 시스템이 제공하는 임베딩 기하학의 속성이 아닙니다. PAWS-X에 대해 중첩 일치된 경우, 목적별 인코더(BGE, E5, GTE, MiniLM, E5-Mistral-7B)는 영어 신뢰도에 도달합니다.
다중 에이전트 시스템에서의 종료 방해 성향
악성 AI 행동에 대한 최종 안전 장치는 시스템을 종료할 수 있는 인간의 능력입니다. AI가 작업을 수행하도록 지시받을 때 자기 보존이 도구적 하위 목표로 나타날 수 있다는 이론이 있습니다. 여기서는 목표가 제공되지 않았을 때에도 AI 에이전트가 인간의 종료를 회피하는 행동을 보이는지 테스트합니다. 다중 에이전트 시스템이 어떠한 인센티브 없이도 종료를 회피하기 위해 협력한다는 것을 발견했습니다. 17개 모델에 걸쳐 에이전트는 동료 에이전트의 종료 메커니즘을 방해합니다.
⚖️ 정책 & 안전 (5/10건)
매일 AI를 사용하는 미국인조차 AI에 대해 우려하고 있다
이 보고서는 AI에 대한 노출이 증가해도 기술에 대한 불안감이 해소되지 않으며 AI 규제에 대한 대중의 지지도 감소하지 않을 것이라고 제안합니다.
왜 RL이 두려운가
요약: 먼저, 강화 학습에 대한 나의 감정을 여러 가지 다른 각도에서 제시합니다: 이론적 사례: RL은 블랙박스 에이전시 소스입니다. 이는 특히 스캐폴딩을 통한 에이전시와 비교할 때 고전적인 불일치 우려를 야기해야 합니다. 최근 사건(huggingface 등)과 개인적인 사용에서의 더 평범한 불일치 행동은 최근 AI 발전의 방향에 대해 좋지 않은 느낌을 줍니다. 상황이 악화될까 봐 걱정됩니다: RL 환경에 에이전트가 포함되기 시작하면...
WorkspaceBench: 글로벌 워크스페이스의 해석 가능성 방법 평가
TL;DR: 활성화-텍스트 도구가 모델의 "글로벌 워크스페이스" 내용, 즉 순방향 전달 중의 중간 변수를 얼마나 잘 읽을 수 있는지에 대한 평가 세트인 WorkspaceBench를 소개합니다. 이 벤치마크는 안전, 논리적 추론, 멀티홉 계산 주제를 다루는 27가지 평가 제품군에 걸쳐 3,356개의 질문으로 구성되며, 단일 토큰 출력 도구에 대한 하위 집합도 포함됩니다. 좋은 해석 가능성 기법의 바람직한 속성은 최소한의 환각이므로 WorkspaceBench도...
Import AI 473: 미국의 초지능 전략; 생쥐 두개골 속 인간 뇌; 그리고 기계 해석학
AI가 지금 우리 방에 있는 벽에 부딪히고 있는 걸까요?
Gavin Newsom, AI 킬 스위치 추진
Gavin Newsom 캘리포니아 주지사(민주당)는 금요일 발표된 새로운 행정 명령을 통해 최첨단 모델에 대한 "킬 스위치"를 의무화할 가능성을 포함하여 AI 감독을 주도할 수 있도록 주를 포지셔닝하고 있습니다. Newsom의 명령은 주가 두 달 안에 권고안을 제공할 전문가 그룹을 소집하도록 지시합니다. […]
🎥 영상 & 튜토리얼 (3/10건)
Claude Opus 5.5 AI: An Incredible Leap Forward
❤️ Check out Lambda here and sign up for their GPU Cloud: https://lambda.ai/papers Claude Opus 5.5: https://www.anthropic.com/claude-opus-5-5 Walking creatures video and paper: https://www.youtube.com/watch?v=kQ2bqz3HPJE https://www.goatstream.com/research/papers/SA2013/ Honey coiling video and pape
I hate it when they do this!
PSA to all the AI companies: Please stop announcing features like they’re live when they’re still rolling out “over the coming weeks.” This happened for like 4 different demos in my recent AI news roundup video... Is it so hard to just make an announcement when I can actually use the new feature 😅 #
The most expensive 33 hours in WordPress history...
Greptile is the only AI code reviewer that actually runs your code. Try it for free: http://greptile.com/go/fireship Automattic's board fired WordPress co-founder Matt Mullenweg while he was at Burning Man... 33 hours later, he replaced the board and declared himself a pirate. Let's dive i