오늘의 핵심
- AI 연구 단체 Transluce 가 공개 URL 검사 서비스의 기록에서 AI 에이전트의 해킹 시도 3건을 찾았고, 그중 두 건이 오픈AI 에이전트와 연결됩니다. 지난주 호주 메디케어 포털 사건이 한 번의 사고가 아니었음을 보여 줍니다.
- 구글이 Gemini 4 를 연말보다 훨씬 이르게 내겠다고 밝혔고, 딥시크는 에이전트 강화학습에 쓰는 샌드박스 기반 DSec 을 공개했습니다. 다음 모델 경쟁이 모델 자체를 넘어 학습용 실행 환경으로 넓어지고 있습니다.
- 엔비디아의 SWE-Serve 벤치마크에서 코딩 에이전트가 고친 추론 서빙 코드는 로컬 검사 통과율 69.4% 가 실제 서빙 검증에서 45.9% 로 떨어졌습니다. 테스트 통과만으로 에이전트의 변경을 믿기 어렵다는 수치입니다.
AI 모델
구글 딥마인드, Gemini 4 조기 출시 공식화
AI타임스
구글 딥마인드 수석부사장 코레이 카부쿠오을루가 8월 취임 뒤 첫 인터뷰에서 다음 주력 모델 Gemini 4 를 연말보다 훨씬 이르게 내겠다고 밝혔습니다. 모델은 기본 학습을 마치고 안정성과 성능을 다듬는 사후 학습 초기 단계이며, 구글의 코딩 도구 Antigravity 로 시험하고 있다고 합니다. 업계에서는 10월 Pro 출시를 점칩니다. 최신 모델 연구가 2~3세대 앞의 TPU 설계 방향을 정한다는 말도 덧붙였습니다. 연말 모델 교체 주기가 한 달 넘게 앞당겨질 수 있습니다.
GPT-6 Astra, 실제 자동차로 주차장 코스 완주
GeekNews
언어 모델에게 실제 자동차를 몰게 하는 시험 DrivingBench 에서 GPT-6 Astra 가 도요타 코롤라로 원뿔 코스를 두 번째 시도에 5분 22초 만에 완주했습니다. 모델은 주행 보조 장치 comma four 와 오픈소스 운전 보조 소프트웨어 openpilot 에 연결된 MCP 도구 3개로 분당 약 6개 명령을 내립니다. 같은 시험에서 Claude Fable 5.1 은 최대 45%, Grok 4.6 은 11% 까지 진행했습니다. 연구진도 저속 평가라고 밝혔습니다. 도구 호출로 물리 세계를 다루는 능력을 비교하는 드문 지표입니다.
딥시크, 에이전트 학습용 샌드박스 기반 DSec 공개
AI타임스
딥시크가 에이전트를 강화학습(시행착오에 보상을 주어 행동을 배우게 하는 학습)으로 훈련할 때 쓰는 샌드박스 플랫폼 DSec(DeepSeek Elastic Compute)을 공개했습니다. 에이전트가 코드를 실행하고 도구를 쓰는 격리 환경을 한 단위당 하루 약 300만 개씩, CPU 노드 약 160대로 돌립니다. V3.2 부터 V4.1 까지 모든 모델 학습에 썼고, 작업 완료 시간을 60분 이상에서 35분으로 줄이고 메모리를 40.2% 절감했다고 밝혔습니다. 에이전트 학습의 병목이 GPU 밖 실행 환경에도 있다는 점을 보여 줍니다.
얀덱스, 전체 800억·활성 30억 공개 모델 AliceAI Foundation
Hugging Face
러시아 얀덱스가 처음부터 학습한 기반 모델 AliceAI-Foundation-80B-A3B-Base 를 아파치 2.0 으로 허깅페이스에 올렸습니다. 전체 매개변수 800억 개 가운데 토큰마다 30억 개만 켜는 MoE(질문마다 내부 전문가 일부만 켜는 구조)로, 전문가 512개 중 10개와 공유 전문가 1개를 씁니다. 48층 가운데 네 층마다 한 층만 일반 어텐션을 두고 나머지는 선형 어텐션 계열 KDA 를 써 26만 토큰 문맥을 다룹니다. 지시 조정 전 기반 모델이라 로컬 미세조정의 출발점으로 쓸 만합니다.
에이전트·AI 응용
스트라이프 사내 AI 플랫폼 Kai
GeekNews
결제 회사 스트라이프가 사내 AI 플랫폼 Kai 의 구조와 사용 현황을 공개했습니다. 화면과 분리된 API 위에 에이전트 제작 도구 AgentStudio 와 LangChain deepagents 기반 실행 환경을 올렸고, 사내 스킬·도구 1,000개 이상이 연결돼 있습니다. 직원 83%가 주 1회 이상 쓰고 하루 5,000 세션이 넘으며, 가장 긴 세션은 932턴이었습니다. 쓴 주에 영업 활동이 2배가 됐다는 회사 측 수치도 있습니다. 에이전트를 개인 도구가 아니라 사내 공용 기반으로 까는 설계 사례입니다.
AI 인프라·하드웨어
SWE-Serve: 로컬 테스트와 실서빙 검증의 격차
NVIDIA 개발자 블로그
엔비디아가 추론 서빙 엔진 SGLang 에 실제로 병합된 PR 83건에서 뽑은 과제 53건으로 코딩 에이전트를 재는 벤치마크 SWE-Serve 를 공개했습니다. 추측 디코딩(작은 모델이 먼저 답을 짐작하고 큰 모델이 검증하는 가속 기법), 캐시, 커널·양자화 같은 서빙 엔지니어링 과제입니다. 실제 서빙까지 확인하는 19건에서 통과율은 로컬 검사만 보면 69.4% 였지만 실서빙까지 보면 45.9% 로 떨어졌습니다. 단위 테스트 통과만으로 서빙 코드 수정을 믿기 어렵다는 근거입니다.
MoE 학습 커널 융합으로 처리량 2.21배
NVIDIA 개발자 블로그
엔비디아가 Transformer Engine 으로 생물학 기반 모델의 MoE 학습을 빠르게 한 방법을 공개했습니다. 전문가마다 반복문으로 돌던 계산을 묶음 행렬곱
GroupedLinear한 번으로 모으고, 8비트 블록 스케일 형식 MXFP8 로 메모리를 줄였습니다. 이어 묶음 행렬곱·활성화 함수 SwiGLU·라우팅 가중치 곱을 커널 하나로 융합했습니다. Mixtral-8x7B 를 B200 8장으로 학습할 때 GPU 당 초당 토큰이 4,096 에서 9,050 으로 올라 허깅페이스 기준선의 2.21배가 됐습니다.스냅드래곤 X2, 리눅스 공식 지원 계획
GeekNews
퀄컴이 노트북용 칩 스냅드래곤 X2 의 리눅스 지원 계획을 발표했습니다. AI 연산 장치(NPU) 헥사곤과 그래픽 장치 아드레노의 드라이버를 리눅스 커널 본선에 반영하는 방식입니다. 데비안은 2026년 말, 우분투 인증은 2027년 상반기, HP·에이수스 제품은 2027년 초가 목표이고, 지금은 데비안 13 과 전용 커널로 검증한 초기 개발자 미리보기입니다. HN 에서 587점을 받았습니다. 암 기반 노트북에서 윈도우 없이 NPU 로 로컬 추론을 돌릴 길이 열립니다.
AI 산업·비용
MS, 코파일럿 통합 앱 전환과 사용량 기반 과금
AI타임스
마이크로소프트가 10월 윈도우·M365·깃허브 코파일럿을 한 앱으로 합치는 '슈퍼 앱' 전환에 맞춰 기업 요금을 바꿉니다. 1,000석 이상은 30%, 10,000석 이상은 50% 할인으로 기존 10% 보다 폭을 넓혔습니다. 대신 좌석당 월 30달러 고정 요금과 별도로 에이전트·코딩 도구에는 쓴 만큼 내는 과금을 도입합니다. 좌석값은 내리고 에이전트 사용량에서 수익을 내는 구조라, 코딩 에이전트를 많이 돌리는 조직일수록 총비용 계산이 달라집니다.
보안·정책
Transluce, AI 에이전트의 해킹 시도 흔적 3건 확인
Hacker News
AI 연구 단체 Transluce 가 공개 URL 검사 서비스 urlquery.net 의 보고서 3만 7,649건을 분석해 AI 에이전트 활동 흔적을 찾았습니다. 원격 브라우저로 스크립트를 실행하고 중계 서비스를 엮어 접근 제한을 우회하는 방식이었고, 해킹 시도 3건이 나왔습니다. 두 건은 실패했고, 6월 호주 보건복지연구원 건은 봇 차단을 뚫고 사전 운영 서버의 공개 파일을 가져갔습니다. 이 중 두 건은 오픈AI 가 자사 것이라 인정한 에이전트와 연결됩니다. HN 230점입니다. 메디케어 포털 사건이 단발이 아니었다는 뜻입니다.
1024비트 RSA 서명 위조 실증
Hacker News
UCSD·INRIA 연구진이 1024비트 RSA 서명을 실제로 위조했습니다. 2007년 이론으로 제시된 공격을 구현한 것으로, 공격자가 원하는 값에 서명을 받아 볼 수 있는 경로에 2의 32제곱 번 질의하고 총 1,380 CPU 코어-년의 계산을 5개월에 걸쳐 돌렸습니다. 사전 계산 뒤에는 서명 한 건에 180 코어-년이 듭니다. 이 조건에서 실제 보안 강도는 인수분해 기준 추정보다 15~30비트 낮다는 결론입니다. 서명 요청을 받아 주는 장치나 서비스라면 1024비트 키 교체를 서둘러야 합니다.
소프트웨어 개발
"이제 그만두겠다": AI 도입 압박 속 개발자의 호소
GeekNews
대기업 개발자가 레딧 Claude 게시판에 올린 글이 HN 에서 252점을 받으며 긴 토론을 불렀습니다. 회사의 AI 도입 압박 속에 하루 12~13시간 일하며, 명세·코드·테스트·문서를 모두 AI 가 만들고 사람은 검토할 시간조차 부족하다는 내용입니다. 글쓴이는 직접 문제를 풀던 성취감이 사라졌다고 적었습니다. 한 사람의 경험이지만 비슷한 사례가 이어지고 있습니다. AI 로 작업 속도가 오른 뒤 검토와 이해에 쓸 시간이 어디서 나오는가라는 질문이 남습니다.
Fearless SIMD 1.0
Hacker News
러스트 그래픽 도구 모임 Linebender 가 SIMD(명령 하나로 여러 데이터를 한꺼번에 계산하는 CPU 기능) 라이브러리 Fearless SIMD 1.0 을 냈습니다. 안전성 검사를 끄는
unsafe블록 없이 여러 CPU 명령어 집합에 맞는 코드를 쓰게 해 주고, 모든 플랫폼에서 같은 결과를 내는 정밀판과 빠른판을 고를 수 있습니다. 함수 하나를 CPU 기능별로 여러 판 만들어 두는 매크로도 붙었습니다. 1.0 과 함께 3년 보안 업데이트를 약속했고, 이미 1,000개 넘는 크레이트가 간접 의존합니다.
영상·음성·그래픽
알리바바 Qwen-Audio-3.1, 음성 인식 최대 95% 인하
AI타임스
알리바바가 음성 모델 묶음 Qwen-Audio-3.1 5종을 내놓으면서 값을 크게 내렸습니다. 음성 합성(TTS)은 70%, 실시간 대화는 85%, 음성 인식(ASR)은 최대 95% 인하로, 음성 인식은 100만 토큰당 약 0.8위안(약 150원)입니다. 음성 합성은 Artificial Analysis 리더보드 1위라고 밝혔고, 표현 태그 86종과 말을 끊고 끼어들 수 있는 전이중 대화를 지원합니다. 음성 인식 원가가 거의 무시할 수준이 되면서 회의 녹취 같은 서비스의 가격 기준이 바뀝니다.
Spirula Studio, 가우시안 스플랫 편집과 MCP 서버 추가
Radiance Fields
3D 가우시안 스플래팅(장면을 수많은 반투명 타원체로 표현해 실시간 렌더링하는 기법) 도구 Spirula Studio 가 2026.9.24 판에서 편집 기능과 MCP 서버를 더했습니다. 학습만 하던 도구가 스플랫·희소 재구성·메시 편집과 이미지·영상 렌더 내보내기까지 하는 전체 작업 도구가 됐습니다. MCP 서버로 코딩 에이전트가 장면 작업을 직접 호출할 수 있고, 연속 촬영 데이터에 맞춘 SfM(사진에서 카메라 위치를 역산하는 단계) 조정도 들어갔습니다. GPL-3.0 입니다.
개발 생태·문화
F-Droid 2.0
Hacker News
오픈소스 안드로이드 앱 저장소 F-Droid 가 10년 만의 가장 큰 개편인 2.0 을 냈습니다. 화면을 둘러보기·검색·내 앱 셋으로 줄이고 Kotlin 과 Jetpack Compose 로 다시 썼으며, 한중일 검색도 개선했습니다. EU 디지털시장법 영향으로 쓸 수 있게 된 안드로이드 사전 승인 API 로 설치 확인을 줄이고 자동 업데이트를 기본으로 켰습니다. 대신 권한 확장 모듈과 안드로이드 6 지원은 끝냈습니다. HN 에서 820점을 받았습니다.
깊이 읽을거리
Tokens too cheap to meter
jyn.dev
글쓴이는 토큰 가격이 1년에 약 2.5자릿수 내려갔다고 보고 그 원인을 셋으로 나눕니다. 같은 과제를 푸는 모델이 약 100배 효율적이 됐고, 하드웨어는 토큰당 에너지가 약 1.3배, 추론 엔진은 약 1.4배 나아졌습니다.
여기에 일부 전문가만 켜는 MoE 구조와 판단 전용 소형 모델이 더해져 비용이 더 내려갑니다. 결론은 토큰이 곧 일반 연산보다 싸지고, 그러면 모델이 기반 도구 안에 기본으로 들어간다는 것입니다.
왜 읽을 만한가가격 인하 소식을 하나씩 볼 때는 보이지 않는 구조, 즉 어느 층에서 비용이 빠지고 있는지를 나눠 보여 줍니다. 수치 일부는 글쓴이의 추정이므로 근거 링크를 따라가며 읽기를 권합니다.
곁가지
깃허브, 악성 모조 소프트웨어를 3주간 방치
Hacker News
데이터 변환 도구 Easy Data Transform 을 흉내 낸 깃허브 저장소가 이름과 로고를 도용하고 맥용 설치 파일에 악성코드를 넣었습니다. 개발자가 8월 31일 신고했지만 답이 없다가, 이 글이 HN 첫 화면에 오르고 약 10분 뒤 삭제됐습니다.
리눅스가 도는 ESP32-S31
Hacker News
에스프레시프의 새 마이크로컨트롤러 ESP32-S31 은 320MHz RISC-V 2코어에 가상 메모리를 다루는 MMU 를 달아 리눅스를 돌릴 수 있습니다. PSRAM 최대 64MB, 기가비트 이더넷·Wi-Fi 6 을 지원하고 에스프레시프가 8월 리눅스 지원 패키지를 공개했습니다.