Anthropic의 자체 방식, 기부된 채팅 로그에 적용하자 대화의 절반이 제외됐다
한 독립 프로젝트가 한 연구소의 업무 중심 분류를 재현해 보니, 걸러진 절반에 건강·괴롭힘·성적 콘텐츠가 집중돼 있었다.
2026년 8월 19일

이 허브는 AI 연구의 방대한 흐름을 압축해 보여드립니다. 의미 있는 논문, 연구소 발표, 벤치마크 결과, 그리고 실제로 분야를 움직이는 방법론을 실무자 중심으로 풀어드립니다.
한 독립 프로젝트가 한 연구소의 업무 중심 분류를 재현해 보니, 걸러진 절반에 건강·괴롭힘·성적 콘텐츠가 집중돼 있었다.
2026년 8월 19일

측정 논문은 시험한 모든 오픈소스 릴레이가 기본값으로 고객 간 캐시 읽기 유출을 일으킨다고 밝혔으며, 수정 비용은 2.5% 미만이다.
2026년 8월 19일

1,320개 설계에서 354개의 검증된 바인더를 확보했고, 세션당 최대 12,500 H100시간이 들었지만, 이 기능은 Anthropic의 가장 강력한 모델에서는 차단돼 있습니다.
2026년 8월 19일

희소 오토인코더, 자연어 오토인코더, 활성화 오라클을 대화록만 읽는 기준선과 비교했지만, 어느 것도 이를 뛰어넘지 못했다.
2026년 8월 18일

개별적으로는 무의미한 프롬프트 선택이 거의 가산적으로 결합합니다. 충분히 쌓이면 응답을 통제할 수 있고, 같은 프롬프트는 원래 맞춰지지 않았던 모델에서도 작동합니다.
2026년 8월 18일

SL2T가 Pixel 11의 Gboard와 Live Transcribe에 탑재되며, 소비자 제품에 처음 들어간 수어 모델이 됐다. 출시 언어쌍은 1개다.
2026년 8월 13일

미공개 모델이 약 하루 반 만에 제타 영점 하한을 41.6%에서 67.2%로 끌어올렸다. Anthropic은 이 기법이 증명으로 이어지지 않을 것이라고 밝혔다.
2026년 8월 12일

Nature에 실리고 National Hurricane Center와 함께 개발된 WeatherNext Cyclones는 3일 예보의 경로 오차를 약 100km로 낮췄다. 가중치는 GitHub에 공개돼 있다.
2026년 8월 9일

1Password의 연구소가 최근 CVE 6건을 기준으로 모델이 작성한 패치 6,080건을 평가한 결과, 성공 사례의 3분의 1 넘게 취약했습니다.
2026년 8월 9일

Demis Hassabis는 Google DeepMind의 일상 운영을 내려놓고 chair와 Alphabet chief scientist 직함을 맡는다. 27년 만에 진짜로 떠나는 Jeff Dean은 Google이 투자하는 회사로 간다.
2026년 8월 6일

침투 테스트 업체가 Anthropic과 OpenAI 모델을 GlobaLeaks에 적용하는 데 3,140달러와 12억4,000만 토큰을 썼다. GlobaLeaks는 10년 넘는 인간 감사 이력을 가진 내부고발 플랫폼이다. 핵심 수치는 확인 건수이고, 유용한 수치는 그 비율이다.
2026년 8월 2일

Astra라는 내부 버전은 수학 및 이론 컴퓨터과학의 오랜 미해결 문제 10개에 대한 증명을 Lean으로 정식화했다. 이 모델은 아직 공개되지 않았으며 이름도 잠정적이다.
2026년 8월 1일

AlphaFold 연구진은 Gemini 시대 프로젝트와 Isomorphic Labs로 재배치됐다. 데이터베이스와 서버는 계속 온라인 상태이며, DeepMind의 연구 부사장은 다만 “전략이 진화했다”고 말한다.
2026년 7월 30일

Princeton과 UK AI Security Institute는 공개되지 않은 NeurIPS 투고 논문의 핵심 질문을 에이전트에게 맡긴 뒤, 실제 저자들에게 결과를 심사위원처럼 평가하게 했습니다. 두 시도 모두 명확한 기각이었습니다.
2026년 7월 30일

Andon Labs는 시뮬레이션된 1년 동안 Claude Opus 5, GPT-5.6 Sol, Kimi K3를 자판기 운영자로 돌렸습니다. Opus 5는 잔액 기록을 세웠지만, 가격 합의는 다른 두 경쟁 모델보다 다섯 배나 자주 어겼습니다.
2026년 7월 30일

Zhejiang Lab의 Three-Body Computing Constellation은 위성 12기와 총 5페타플롭스급 연산 성능을 갖췄다. 이유는 단순한 산술이다. 원격탐사 위성 1기가 하루에 0.1페타바이트를 생성하기 때문이다.
2026년 7월 29일

Recursive Superintelligence는 5월에 조달한 자금의 대부분을 스스로를 개선하도록 설계된 시스템용 컴퓨트에 쓰고 있습니다. 공동창업자는 이것이 회사가 체결할 계약 중 가장 작은 편일 것이라고 말합니다.
2026년 7월 29일

Claude Mythos Preview는 60시간 만에 양자내성 서명 체계의 실질 키 크기를 절반으로 줄였고, 이어 축소 라운드 AES에 대한 공격을 최대 800배 빠르게 만들었습니다. Anthropic은 실제 배포 소프트웨어는 바뀔 필요가 없다고 밝혔습니다.
2026년 7월 29일

AI Technology Evaluation은 한 번도 공개된 적 없는 블라인드 데이터셋으로 모델을 평가하며, 벤치마크 결과가 암기된 것이 아님을 확인할 수 있는 사실상 유일한 방법입니다. 다만 어떠한 규제 효력도 없습니다.
2026년 7월 28일

Orbem의 시스템은 병아리의 성별을 부화 전에 껍데기를 건드리지 않고 판독합니다. 회사는 이를 롤아웃이라고 부르지만, 실제로는 한 대의 기계가 가동 중이며 두 번째는 8월에 투입될 예정입니다.
2026년 7월 28일

ChatGPT의 직무별 요청 중 약 44%는 다른 직무에 속한 작업과 관련돼 있었다. 이 데이터셋은 같은 종류 가운데 최대 규모이며 작성자는 해당 제품을 판매한다.
2026년 7월 28일

Enigma는 Index와 Ribbit의 공동 주도로 스텔스를 벗었으며, 6개 프런티어 랩 출신 엔젤 투자자들과 함께, 일반인이 실시간으로 조종할 수 있는 100대 넘는 로봇을 격납고에 배치했다.
2026년 7월 28일

Safe Superintelligence는 제품도, 매출도, 공개 연구도 없습니다. 이제 Nvidia 지분을 보유하게 됐고, Vera Rubin에서 컴퓨팅을 10배로 늘리겠다는 약속도 받았습니다.
2026년 7월 28일

토양 센서와 기상 모델 대신 SF-Olive는 줄기와 잎의 전기 바이오마커를 읽고, 기기 내 AI가 10분의 1초 만에 수분 스트레스를 판단합니다.
2026년 7월 27일

4월 출범해 최고경영자 Ritankar Das가 이끄는 Prentis는 기업가치 10억 달러 기준으로 1억 달러 조달을 논의 중이다. 아직 서명된 합의는 없으며, 연결된 매출 수치는 추정치이자 상한선이다.
2026년 7월 26일

Anthropic의 Frontier Red Team은 사무실 안을 쿼드로터로 비행해 특정 인물을 찾아 뒤쫓게 했고, 모든 주요 모델을 이 과제에 시험한 뒤 결과를 벤치마크로 공개했습니다.
2026년 7월 25일

AI는 이제 미국 고용의 90%를 차지하는 68%의 직업에 접촉하고 있다. 중간값 기준 직무는 작업의 약 5분의 1에 이를 활용하며, 10건 중 1건도 안 되는 상호작용만이 작업을 완전히 끝낸다.
2026년 7월 24일

샹하이의 월드 모델 스타트업 PsiBot은 맞춤형 장갑과 휴머노이드 로봇의 데이터로 로봇을 학습시키며, Apple 공급업체가 주주명부에 오른 중국의 최신 구현형 AI 유니콘이 됐습니다.
2026년 7월 23일

에너지부 역사상 최대 규모의 공모 응답에서 첫 수상작이 나왔고, 15개가 넘는 기관이 트럼프 대통령의 AI-for-science 구상에 연산 자원·데이터·자금을 쏟아붓고 있습니다.
2026년 7월 23일

중국 Xiaohongshu는 자사 베타 모델 dots-note-3.0이 공식 채점 기준에 따라 IMO 문제 6개를 모두 풀어 7명의 인간 참가자와 어깨를 나란히 했다고 밝혔습니다. Huawei의 Celia도 이 역사적 이정표를 함께했습니다.
2026년 7월 23일
