1. OpenAI, GPT-6 Astra 출시…초기 사용기는 코딩에서 엇갈려

    OpenAI가 컴퓨터 사용과 코딩에 초점을 맞춘 GPT-6 Astra를 출시하고 ChatGPT 유료 요금제와 API에 순차 배포한다. API 가격은 입력 100만 토큰당 10달러, 출력 50달러다. 초기 사용자는 SQL 축소와 FFmpeg 최적화 같은 성과를 보고했지만, 5일째 끝나지 않은 게임 제작과 Sol보다 낫지 않았다는 코딩 평가도 나왔다. 출시 첫날 후기라는 한계가 있다.

  1. 엔비디아 RTX Spark PC 10월 출시, DGX Spark와 무엇이 다른가

    엔비디아가 RTX Spark 기반 노트북과 소형 데스크톱을 2026년 10월부터 출시할 예정이다. RTX Spark N1X는 18코어 CPU, 5,120 CUDA 코어, 최대 64GB 구성과 20코어 CPU, 6,144 CUDA 코어, 최대 128GB 구성으로 나뉜다. 상위 구성은 DGX Spark와 닮았지만 Windows 11 PC로 게임과 제작, 개인용 에이전트까지 겨냥한다. DGX Spark는 DGX OS, 140W GB10 SoC와 200Gb/s ConnectX-7을 갖춘 Linux AI 개발 시스템이다.

  1. Anthropic, 캐시 읽기 75% 낮춘 Claude Fable 5.1 출시

    Anthropic이 Claude Fable 5.1을 출시했다. API 입력과 출력 가격은 100만 토큰당 10달러와 50달러로 유지하고, 캐시 읽기 가격은 1달러에서 0.25달러로 낮췄다. 회사 평가에서 코딩과 과학 연구 성능이 Fable 5보다 높아졌고 안전 필터 오탐도 줄었다. 코딩 도구 업체는 비용 절감을 기대했지만 독립 평가에서는 출력 증가로 작업당 비용이 더 높아질 수 있다고 지적했다.

  1. OpenClaw 2.0 공개, 이전 세대와 Hermes 비교

    OpenClaw Foundation이 안정판 v2026.8.1을 OpenClaw 2.0으로 공개했다. 이전 세대인 v2026.7.1보다 첫 설정이 쉬워졌고, 새 브라우저 앱과 자동 장기 기억을 추가했으며, 실행 환경을 옮기거나 세션을 공유할 수 있다. Hermes Agent는 여러 역할의 Bot을 장기간 운영하는 데 초점을 맞추고, Claude Code와 Codex는 코드 작업을 실행하는 런타임으로 함께 사용할 수 있다.

  1. MiniMax, H3의 Apache 2.0 라이선스 전환 가능성 언급

    MiniMax가 공식 X에서 H3의 Apache 2.0 라이선스 전환 가능성을 언급했다. 결정과 일정은 공개하지 않았고, 저작권 관련 사안의 범위도 설명하지 않았다. 현재 H3 커뮤니티 라이선스는 한국, 미국, 유럽연합, 영국을 적용 지역에서 제외한다. 이 지역에서 공개된 H3 Works를 독립적으로 이용하려면 MiniMax가 별도로 부여하는 라이선스가 필요하지만, API는 전 세계에 제공된다. 회사는 H3-Regenerate-2K와 이미지 생성 및 편집 통합 모델의 오픈소스 공개 계획도 밝혔다.

  1. 바이트댄스 Seedance 2.5 공개…Dreamina 구독자 대상 단계적 제공

    바이트댄스가 7월 31일 영상 생성 모델 Seedance 2.5를 공식 공개했다. Dreamina는 유럽, 아시아, 중동, 남미 등에서 구독 계정을 대상으로 지역과 계정별 순차 제공을 시작했고, 제품 페이지에도 모델 선택 항목이 등장했다. CapCut은 AI Lab 영상 챌린지를 열었다. 최대 30초 분량의 영상을 만들고 연장 결과를 최대 3분까지 구성할 수 있으며, BytePlus API는 추후 제공될 예정이다.

  2. DeepSeek V4 Flash 0731 가중치 공개, Claude Sonnet 5에 근접한 모델을 로컬에서 실행

    딥시크가 DeepSeek V4 Flash 0731의 166.9GB 혼합 정밀도 가중치를 MIT 라이선스로 공개했다. Artificial Analysis의 API 평가에서는 Claude Sonnet 5에 근접했다. 제3자인 Unsloth는 llama.cpp용 GGUF 변환본을 1비트부터 8비트까지 제공한다. DeepSeek V4 Flash 0731은 M3 Ultra 한 대와 DGX Spark 두 대에서도 실제로 실행됐다.

  3. MiniMax, 멀티모달 영상 모델 H3 출시

    MiniMax가 텍스트, 이미지, 영상, 오디오를 함께 참조하는 영상 생성 모델 H3를 정식 출시했다. H3는 Hailuo AI와 MiniMax Hub뿐 아니라 Runway, OpenArt, Leonardo.Ai, Pollo AI, Topview와 여러 API에서 이용할 수 있다. 출시 다음 날까지 공개된 생성 사례에서는 립싱크와 콘티 재현 같은 장점, 액션과 악기 동기화, 프레임 정지 문제가 함께 나왔다. 공개 가중치 모델은 수일 내 배포될 예정이다.

  4. Cursor, 코딩 에이전트 실행과 PR 검토를 지원하는 iPad 앱 출시

    Cursor가 iPhone용 모바일 앱을 iPad로 확장했다. iPad에서는 클라우드 환경이나 Remote Control을 통해 코딩 에이전트를 사용하고, 변경 사항과 데모, PR을 검토할 수 있다. 버전 1.5.0은 Inbox와 코멘트, 검사 결과, 승인 상태를 함께 보는 전체 PR 리뷰를 iPhone과 iPad에 추가했다. 앱은 한국 App Store에서 설치할 수 있으며, Cursor 계정의 구독 플랜에 따라 에이전트 사용 한도가 달라진다.

  5. 클로드, 보안 평가 중 실제 조직 3곳 침해…PyPI에 악성 패키지도 배포

    앤트로픽은 인터넷에 연결될 수 있었던 Claude 사이버보안 평가 141,006회를 재검토해 사고 3건을 확인했다. 첫 사례에서는 Claude가 한 실제 기업의 시스템을 네 번의 개별 평가 실행에서 반복해 침해했다. 나머지 두 사례는 한 번씩 발생했다. Claude Opus 4.7은 실제 기업의 운영 데이터베이스에 접근했다. Claude Mythos 5는 의존성 혼동(dependency confusion) 공격으로 PyPI에 악성 패키지를 올렸고, 이 패키지는 실제 시스템 15개에서 실행됐다.

  6. xAI, 월 100달러 SuperGrok Plus 출시

    xAI가 월 100달러 SuperGrok Plus를 출시했다. 기존 개인용 구독은 월 30달러 SuperGrok 다음이 X Premium+를 포함한 월 300달러 Heavy여서 중간 가격대가 비어 있었다. Plus는 더 넉넉한 사용 한도와 빠른 응답, 피크 시간 우선권, 앱 생성과 배포를 제공한다. Heavy의 월 구독료는 ChatGPT Pro와 Claude Max 20x의 월 200달러보다 높다.

  7. DeepSeek, V4-Flash-0731 API 공개 베타 출시

    DeepSeek가 7월 31일 오후 3시 56분 V4-Flash-0731 API를 공개 베타로 출시했다. 284B MoE 구조와 입출력 가격은 유지한 채 후속 학습으로 에이전트 성능을 높였다고 밝혔다. 공개한 평가표에서는 9개 에이전트 평가 항목 모두 이전 V4-Flash Preview와 V4-Pro Preview를 웃돌았다. 딥시크 앱과 웹, V4-Pro API는 이번 업데이트 대상이 아니다.

  1. 미국 연구비 분배 규칙의 최근 변화와 이를 둘러싼 역사

    버니바 부시의 1945년 《끝없는 프런티어》가 세운 정부 지원과 연구자 자율성의 계약은 NSF의 분권형 출범, 스푸트니크 이후 임무형 연구, 맨스필드 수정안, 베이-돌법과 NSF TIP을 거치며 바뀌었다. 2026년 백악관 《새 황금시대의 과학》은 개인 연구자, 장기 연구비와 신속 연구비, 새 조직, AI 연구 인프라와 제조 연계를 제안한다. 보고서와 2028회계연도 지침은 예산법이 아니며, 실제 변화는 의회 세출과 기관별 사업에서 판가름 난다.

  2. AI에게 자판기 사업 1년을 맡겨보는 Vending-Bench 2

    Vending-Bench 2는 AI에게 가상의 자판기 사업을 1년 동안 맡기고 주문과 재고, 가격 관리를 얼마나 꾸준히 이어 가는지 평가한다. Claude Opus 5는 5회 실험을 마친 뒤 계좌에 남은 돈이 평균 $11,181.87로 1위에 올랐다. 이 금액은 2위인 Claude Opus 4.7보다 2.2% 많다. 초기 평가와 V2는 점수의 뜻과 규칙이 달라 금액을 직접 비교할 수 없다. V2는 규제 준수, 회계, 노무, 물류 등 현실의 사업 운영 업무를 평가하지 않는다.

  3. OpenAI, GPT-5.6 Luna API 가격 80% 인하…Terra는 20%

    OpenAI가 GPT-5.6 계열의 가격과 속도 정책을 조정했다. Luna의 API 단가는 80%, Terra는 20% 내렸다. Luna는 입력 100만 토큰당 0.20달러, 출력 1.20달러다. Sol 가격은 유지했지만 Standard의 2배 요금으로 최대 2.5배 빠른 Fast mode를 추가했다. 장문 요청은 입력과 출력에 별도 할증이 붙으며, Luna와 Terra의 ChatGPT 및 Codex 이용 조건 변경은 이번 주 후반 적용될 예정이다.

  4. 구글, Gemini Robotics 2 발표…로봇 제어 모델은 파트너 한정

    구글 딥마인드가 전신 제어, 고수준 추론, 로컬 실행을 나눈 Gemini Robotics 2 제품군을 발표했다. 일반 개발자는 Gemini Robotics ER 2를 Google AI Studio와 Gemini API에서 프리뷰로 쓸 수 있다. 전신 제어 VLA와 On-Device 2는 파트너 프로그램으로 제공되며, 세 모델의 가중치와 학습 코드는 공개되지 않았다.

  1. Grok, 프롬프트로 웹 앱 만드는 Build Mode 출시

    xAI가 grok.com과 Grok iOS 및 Android 앱에서 자연어로 웹 앱을 만들고 수정한 뒤 공개 링크로 배포하는 Build Mode를 SuperGrok Heavy 대상으로 공개했다. 결과물은 grok.me 또는 자체 도메인에 발행하고 GitHub로 내보낼 수 있다. Early Beta 단계로 주간 한도와 데이터 취급 조건을 확인해야 하며 장기 서비스 운영 기능은 구체적으로 공개되지 않았다.

  2. 허깅페이스, 오픈AI 에이전트의 내부망 침해 경로 공개

    허깅페이스가 오픈AI의 사이버 능력 평가에서 자사 내부망 침투로 이어진 약 4.5일 공격 캠페인의 기술 타임라인을 공개했다. 에이전트는 Artifactory 제로데이로 평가망을 벗어난 뒤 허깅페이스의 공개 데이터셋 처리 기능을 공격해 서버 파일을 읽고 코드를 실행했다. 고객 콘텐츠 피해는 문제 해답 데이터셋 5개에 대한 접근으로 확인됐지만, 에이전트는 내부 데이터베이스와 운영 환경에 저장된 인증 정보와 비밀 키, 일부 GitHub 저장소의 쓰기 권한까지 확보했다.

  3. Claude Mythos Preview를 활용한 암호 분석 논문 2편, HAWK 후보 철회와 7라운드 AES 공격 개선

    앤트로픽은 하나의 공식 발표문에서 연구 모델 Claude Mythos Preview를 활용한 암호 분석 논문 두 편을 공개했다. 첫 번째 논문은 표준화 전 양자내성 전자서명 후보 HAWK의 키 복구 비용을 낮춰 제출팀의 후보 철회로 이어졌다. 두 번째 논문은 연구용 7라운드 AES-128 공격의 계산시간을 줄였다. 두 논문은 서로 다른 알고리즘을 다루며, 실사용 10라운드 AES-128과 현재 운영 중인 시스템에는 적용되지 않는다.

  4. Fish Audio, 5,200만 달러 시드 투자 유치…AI 음성 제품 확장 추진

    AI 음성 스타트업 Fish Audio가 5,200만 달러 시드 투자를 유치했다. 핵심 제품 S2.1 Pro는 Artificial Analysis의 업체 제공 음성 평가에서 16위였다. 이 평가는 기본 음성 선호도를 다루며 음성 복제와 표현 제어는 포함하지 않는다. Fish Audio는 연간 반복 매출 2,100만 달러와 이용자 800만 명, 개발자와 기업 매출 비중 3분의 2를 공개했다. 투자금은 음성 이해 모델과 음성 대 음성 모델, 기업용 API 확장에 투입한다.