OpenAI, GPT-6.1 Sol 출시…GPT-6 Sol 대비 개선 주장
OpenAI가 새 모델 GPT-6.1 Sol을 공개했다. 회사 측은 이 모델이 코드 작성 및 디버깅, 문서 이해, 다단계 업무 워크플로 실행 등 복잡한 전문 작업에서 이전 모델 GPT-6 Sol 대비 상당한 개선을 보인다고 밝혔다. 구체적인 성능 비교 수치는 공개되지 않았다.
검증된 피드 11개에서 자동 수집하고, AI 요약이 코드 게이트를 통과한 것만 게시합니다. 게이트는 카탈로그에 없는 모델명·원문에 없는 수치·상대 시점 표현을 막습니다.
파운데이션 모델·LLM 60건 · 필터 해제
OpenAI가 새 모델 GPT-6.1 Sol을 공개했다. 회사 측은 이 모델이 코드 작성 및 디버깅, 문서 이해, 다단계 업무 워크플로 실행 등 복잡한 전문 작업에서 이전 모델 GPT-6 Sol 대비 상당한 개선을 보인다고 밝혔다. 구체적인 성능 비교 수치는 공개되지 않았다.
앤트로픽이 차세대 모델 라인업의 두 번째 모델인 클로드 소네트 5.5를 공개했다. 앤트로픽은 이 모델이 오퍼스급 지능을 갖췄다고 소개했으며, 이전 세대 소네트 5 대비 출력 속도가 30% 이상 빨라지고 동일 작업 기준 비용은 최대 30% 절감됐다고 밝혔다. 상장을 준비 중인 앤트로픽은 이번 모델을 기업용 시장 주도권 확보를 위한 실용형 모델로 소개했다.
xAI의 프런티어 모델 Grok 4.7이 아마존 베드락에 추가됐다. xAI는 이 모델이 코딩과 지식노동에서 자사 최고 성능을 낸다며, 어려운 과제를 더 오래 수행하고 결과를 스스로 검증하도록 설계했다고 밝혔다. 베드락에서는 리전 간 추론 프로필로 제공되며 Responses·Chat Completions·Converse API를 지원한다. 독립 평가기관 Artificial Analysis는 자체 평가 결과 Grok 4.7의 지능 지수와 코딩 에이전트 지수가 전작 Grok 4.6 대비 상승했다고 밝혔다. xAI는 새로운 안전장치 체계를 적용해 사이버보안 등 이중용도 영역에서 위험한 요청은 걸러내면서도 정당한 보안 작업은 차단하지 않도록 했다고 설명했다.
AWS는 Anthropic의 Claude Sonnet 5.5를 Amazon Bedrock과 AWS의 Claude Platform에서 제공한다고 밝혔다. Sonnet 5.5는 코딩과 지식노동에 특화된 모델로, IAM·CloudTrail·CloudWatch·Bedrock Guardrails 등 AWS의 기존 관리 도구와 함께 사용할 수 있으며 사용량은 AWS 청구서에 반영된다. AWS는 판단이 필요한 작업은 Opus 5.5, 방향이 이미 정해진 실행 작업은 Sonnet 5.5로 나눠 쓰는 방식을 제안했다. Sonnet 5.5는 글로벌 CRIS 추론 프로필을 통해 북미 등 일부 AWS 리전에서 이용 가능하다.
정보 유출 전문 계정 라이라에 따르면 앤트로픽이 클로드 소네트 5.5의 두 번째 체크포인트 빌드를 파트너사에 배포하고 스텔스 테스트를 진행 중인 것으로 알려졌다. 라이라는 9월 28일 오전 중 정식 출시 가능성을 언급했다. 이번 출시 시점은 오픈AI의 개발자 행사 데브데이를 앞두고 있어, 양사의 개발자용 AI 모델 경쟁 구도가 부각되고 있다.
국내 AI 기업 비드래프트는 추론 모델 '다윈-180B-RSI'가 허깅페이스가 공인한 5개 리더보드에서 각 1위를 기록했다고 28일 밝혔다. 이 모델은 AIME 2026과 HMMT 2026에서 100% 만점을, GPQA 다이아몬드에서 94.44%를 기록해 기존 최고점(각각 97.1%, 92.7%)과 키미-K3(93.5%)를 앞섰다고 회사 측은 설명했다. MMLU-프로와 MMMU-프로에서도 각각 88.12%, 79.48%를 기록했다. 비드래프트는 자체 기술인 선택적 병합 '다윈', 재귀적 자가개선(RSI), 정답 확신도를 사전에 산출하는 'ZTC'를 적용했다고 밝혔다.
올여름 오픈AI와 앤트로픽 등 미국 기업이 주도한 최상위권 AI 모델 경쟁에서 중국 기업들도 잇따라 존재감을 드러냈다. 문샷AI의 '키미 K3'가 한때 전체 3위까지 오른 데 이어 즈푸AI의 'GLM', 알리바바의 '큐웬', 스텝펀 신모델이 상위권에 이름을 올렸고, 샤오미도 '미모' 신모델로 가세했다. 다만 이 기간 미국 기업들이 새로운 프런티어 모델을 내놓으며 격차를 다시 벌린 것으로 전해졌다.
오픈AI가 챗GPT의 새로운 최상위 요금제 '프로 맥스'를 준비 중인 것으로 보인다. AIPRM 리드 엔지니어 티보르 블라호는 9월 24일 챗GPT의 비공개 프런트엔드 설정에서 프로 맥스의 흔적을 발견했다고 밝혔다. 테스팅카탈로그 등 다른 곳에서도 관련 정황이 추가로 확인됐다. 기존 프로 요금제와 비교해 새롭게 확인된 핵심 기능은 챗GPT 워크와 코덱스를 더 빠르게 처리하는 기능으로 알려졌다.
포춘이 소식통을 인용해 오픈AI가 사이버보안 전용 모델 'GPT-6 사이버'를 공개할 예정이라고 24일(현지시간) 보도했다. 오픈AI는 오는 29일 미국 샌프란시스코에서 열리는 '데브데이 2026'에서 이 모델을 비롯해 12개 이상의 신규 제품을 발표할 계획이다. 이번 제품은 기존 API 공급 방식과 달리, 고객이 모델을 더 안전하고 자동화된 방식으로 배포·운용할 수 있도록 지원하는 오픈AI 최초의 사이버 보안 전용 제품으로 소개됐다.
앤트로픽이 오퍼스 5.5를 출시하고 약 90분 뒤 오픈AI가 GPT-6 모델 업데이트를 내놓으며 두 회사가 잇달아 신모델을 공개했다. 하지만 정작 관심을 끈 것은 메타의 개인용 AI 에이전트 '뮤즈'였다. 뮤즈는 챗GPT의 초기 수치를 앞지르고 있다고 알려졌으며, 스마트 글래스 탑재도 예정돼 있다고 전해졌다.
허깅페이스 트렌드를 분석하는 정원훈의 AI 칼럼이 9월 15일 등장한 스타트업 타입세이프(TypeSafe AI)의 모델 '제브(Jev)'를 소개했다. 타입세이프는 챗GPT의 전신인 인스트럭트GPT 논문 공저자 디오구 알메이다가 설립했으며 4000만 달러 규모의 시드 투자를 유치했다. 칼럼은 2주 전 다룬 '작아진 정상'(소형 모델 대세화) 흐름에 이어, 이번에는 텍스트로 말하는 대신 판단을 내리는 방식의 모델이 주목받고 있다고 전했다.
구글이 내부 코드명 '아르곤'으로 불리는 '제미나이 4 프로'의 초기 체크포인트를 테스트하고 있다는 정황이 포착됐다. 유출 전문 계정 '렌틸스80'이 X를 통해 처음 이 소식을 전했으며, 구글이 벤치마크 플랫폼 등에 '제미나이 3.8 플래시' 등으로 위장한 아르곤 체크포인트를 노출시켰다는 내용이다. 유출된 테스트 결과물에서는 프런트엔드 코드와 UI·웹 디자인 생성 능력이 개선됐다는 평가가 나왔으며, 이는 정형화되고 독창성이 부족하다는 지적을 받아온 기존 제미나이의 한계를 넘어섰다는 평이다.
구글 딥마인드의 새 수장 코레이 카부크추올루가 The Information과의 첫 언론 인터뷰에서 제미나이 4가 현재 정제(refinement) 단계에 있으며 연말보다 훨씬 이른 시점에 출시하는 것이 목표라고 밝혔다. 그는 "결과를 보고 있고 흥분되는 상황이라 가능한 한 빨리 초기 사후학습 결과물을 공개하려는 의도"라고 말했으며, 구글이 빠른 속도의 반복 개발을 이어갈 것이라고 덧붙였다. 구글은 그동안 경쟁 개발사들의 플래그십 모델 출시 속도에 뒤처져 있었다고 기사는 전했다.
AI 개발 속도조절론을 주도해온 앤트로픽과 오픈AI가 9월 23일 나란히 새 AI 모델을 공개했다. 도널드 트럼프 미국 대통령과 젠슨 황 엔비디아 CEO 등이 AI로 인한 인류멸망 가능성은 사실상 없다며 우려에 제동을 건 시점이라 두 회사의 행보가 주목된다. 앤트로픽은 최상위 모델 '클로드 페이블 5.1' 수준의 성능을 확보하면서도 비용을 낮춘 새 AI 모델을 내놨다.
AI 모델 라우팅 업체 AI/ML이 앤트로픽과 오픈AI의 API를 통해 클로드 오퍼스 5.5와 GPT-6 솔에 동일한 프롬프트를 입력해 3D 애니메이션 생성 결과를 비교했다. 테스트에는 움직이는 물고기 떼, 소용돌이, 폭풍 속의 배, 쓰나미 등 4가지 프롬프트가 사용됐으며 지시문은 단 한 단어로 간결하게 주어졌다. 비교 결과 두 모델의 결과물 퀄리티와 비용은 서로 엇갈린 양상을 보였다.
알리바바가 9월 22일 중국 항저우에서 열린 '아스파라 컨퍼런스'에서 차세대 AI 모델 '큐원 4'가 학습 단계에 들어갔다고 밝혔다. 이어 '큐원 4.5', '큐원 5'로 이어지는 로드맵을 공개하며 모델 규모를 앞으로 크게 확대하겠다는 계획을 설명했다. 같은 행사에서 차세대 AI 가속기 칩도 함께 선보이며, 모델부터 반도체, 클라우드 인프라까지 아우르는 '풀스택 AI' 전략을 본격화했다.
앤트로픽이 기업공개(IPO)를 앞두고 비용 효율성을 높인 새 AI 모델 '클로드 오푸스 5.5'를 공개했다. 이는 앤트로픽이 AI 개발 속도를 늦추자고 제안한 이후 내놓은 첫 모델이다. 앤트로픽은 오푸스 5.5가 대부분의 작업에서 기존 고성능 모델과 비슷한 수준의 성능을 제공한다고 밝혔다. 블룸버그통신 등은 오픈AI·구글 등과의 경쟁이 심화되는 가운데 나온 발표라고 전했다.
오픈AI가 2026년 9월 22일(현지시간) 새 모델 'GPT-6 솔(Sol)'과 'GPT-6 루나(Luna)'를 공개했다. 두 모델은 최고 성능 경쟁 대신 실무에 필요한 핵심 기능의 효율성을 극대화하는 데 초점을 맞췄다. 오픈AI는 기존 'GPT-5.6' 프로모션 가격 대비 API 이용료를 절반 이하로 낮췄다고 밝혔으며, 이를 통해 최첨단 모델의 대중화를 목표로 한다고 설명했다.
오픈AI가 'GPT-6 솔·루나'를, 앤트로픽이 '클로드 오퍼스 5.5'를 22일 공개했고 하루 앞서 스페이스XAI는 '그록 4.7'을 선보였다. 앤트로픽은 외부 기관 평가와 행동 감사로 안전 검증을 강화했고, 오픈AI는 상위 모델에서 확보한 기술을 더 저렴한 제품으로 옮겼으며, 스페이스XAI는 장시간 작업 수행과 자기 검증 능력을 키웠다. 독립 평가기관 아티피셜 애널리시스의 종합 성능 지표(AAII)에서는 오퍼스 5.5가 앞섰다. 세 회사 수장 모두 AI 개발 속도조절 필요성에는 공감을 나타냈지만, 실제 안전 검증 방식과 적용 강도는 회사마다 차이가 있었다.
앤트로픽이 복잡한 추론과 에이전틱 코딩 분야를 겨냥한 신형 프런티어 모델 '클로드 오퍼스 5.5'를 공개했다. 이 모델은 클로드 5.5 제품군의 첫 번째 플래그십으로 출시됐다. 아티피셜 애널리시스의 지능 지수 평가에서 1위에 올랐다고 앤트로픽 측은 밝혔다. 발표는 현지시간 22일 이뤄졌다.
NVIDIA는 9월 22~23일 싱가포르에서 열린 AI Day에서 파트너들과 함께 동남아시아 전역의 AI 활용 사례를 공개했다. 싱가포르 HTX는 공공안전 연구에 Nemotron 3 Super와 Nemotron 3 Nano Omni 모델 도입을 검토 중이며, NCS와 ST Engineering도 Nemotron 및 NeMo, cuOpt 기반 에이전트형 AI를 각자 업무에 적용하고 있다. 말레이시아 YTL AI Labs와 베트남 Viettel AI, 태국 iApp Technology 등은 Nemotron 모델을 자국어와 산업 특화용으로 미세조정하고 있으며, iApp의 법률 챗봇 '타노이'는 약 4만3000명이 이용 중이라고 밝혔다. 말레이시아 ITMAX와 태국 AS-TECH는 NVIDIA Cosmos와 VSS 블루프린트로 각각 교통 관제와 공항 승객 흐름 개선에 나섰다.
오픈AI가 GPT-6 아스트라에 이어 'GPT-6 솔'과 'GPT-6 루나'를 공식 출시했다. 솔은 코딩 등 복잡한 작업에, 루나는 문서 요약·정보 추출처럼 목표가 명확한 작업을 빠르게 처리하는 데 초점을 맞췄다. 오픈AI는 내부 사실성 평가에서 솔의 오류율이 이전 모델 대비 줄었고 코딩 과정의 오류도 낮아졌다고 밝혔다. 두 모델은 챗GPT 워크, 코덱스, 챗GPT API를 통해 제공되며 챗GPT 앱과 웹사이트에도 순차 배포될 예정이다.
샤오미가 9월 21일(현지시간) 오픈소스 AI 모델 '미모-V2.6' 시리즈를 공개했다. '미모-V2.6-프로'와 '미모-V2.6-플래시' 두 모델로 구성되며, 대규모 강화학습 컴퓨팅을 투입해 추론과 코딩 역량을 강화했다. 3D 공간 추론, 멀티모달 인식, 컴퓨터를 직접 조작하는 에이전트 능력도 함께 강화됐다. 미모-V2.6-프로는 아티피셜 애널리시스 지능 지수(AAII)에서 46.3점을 기록해 중국 AI 모델 중 역대 최고 성적을 냈다.
OpenAI의 GPT-6 Sol과 GPT-6 Luna가 아마존 베드록에서 정식 출시됐다. GPT-6 Sol은 코딩·디버깅·다단계 작업 등 반복적인 고난도 업무에, GPT-6 Luna는 문서 추출·요약·분류 등 대량 반복 작업에 적합하도록 설계됐다. OpenAI의 내부 사실성 평가에 따르면 GPT-6 Sol은 GPT-5.6 Sol 대비 사실 오류가 약 절반 수준으로 줄었다. 두 모델 모두 베드록의 프롬프트 캐싱을 지원하며, IAM 정책·클라우드트레일 감사·PrivateLink VPC 엔드포인트 등 보안·통제 기능과 함께 제공된다.
Anthropic의 신규 모델 클로드 오퍼스 5.5가 아마존 베드록과 AWS의 클로드 플랫폼에 출시됐다. 클로드 5.5 모델군 중 첫 모델로, 에이전틱 코딩과 지식 노동, 장시간 실행 작업에 적합하도록 만들어졌다. Anthropic에 따르면 이전 모델인 오퍼스 5보다 적은 토큰으로 더 많은 작업을 처리하며, 작업 중 수행한 일과 발견한 내용, 필요한 사항을 더 명확히 전달하도록 훈련됐다. 별도의 사고 예산 설정 없이 작업에 맞춰 추론량을 스스로 조절하는 적응형 사고 기능이 항상 켜져 있다. 생물학·사이버보안·AI 개발 분야에서 클로드 페이블 5.1과 유사한 안전 분류기가 처음 탑재되어, 이전 오퍼스 모델보다 요청을 거부하는 빈도가 높아졌다.
xAI가 9월 21일(현지시간) 코딩과 지식 작업에 특화한 신모델 '그록 4.7'을 공개했다. 장시간 복잡한 작업에서의 추론 능력과 자체 검증 기능, 사이버보안 성능을 강화했다고 밝혔다. 그러나 프런티어 성능에는 미치지 못해 본격적인 경쟁은 차기 모델 '그록 4.8'로 미뤄지게 됐다. 이는 '그록 4.6' 출시 약 한 달 만이며, 커서와 xAI의 '그록 빌드', 그록 API, 제3자 코딩 하네스 등에서 바로 사용할 수 있다.
알리바바가 연례 기술 행사 '압사라 컨퍼런스'에서 AI 칩, 클라우드 인프라, 파운데이션 모델, AI 에이전트를 아우르는 풀스택 AI 전략을 공개했다. 회사는 최대 10조개 파라미터 규모의 차세대 모델을 개발 중이며, 현재 '큐원4'를 학습하고 있고 후속작인 큐원4.5와 큐원5도 예고했다. 자체 AI 반도체와 대규모 데이터센터를 앞세워 모델부터 인프라까지 자체 구축하는 방향을 제시했다.
미국 스타트업 타입세이프(TypeSafe) AI가 9월 15일 문장을 전혀 쓰지 않고 숫자만 출력하는 AI 모델 'Jev'를 공개했다. 창업자 디오고 알메이다는 오픈AI에서 챗GPT의 토대가 된 작업에 참여한 인물이다. 출시 닷새 만에 개발자 커뮤니티 해커뉴스에서 하루 만에 추천 1500점, 댓글 400여 개가 달리며 화제가 됐다. 유창한 텍스트 생성 경쟁이 이어지는 가운데 말 대신 숫자로 답하는 방식이 이례적인 반응을 이끌어냈다.
알리바바가 압사라 컨퍼런스에서 칩·클라우드 인프라·모델·AI 에이전트를 아우르는 풀스택 AI 전략을 공개했다. 회사는 차세대 큐원 모델을 학습 중이며 후속 모델 로드맵도 함께 제시했다. 반도체 설계 부문 티헤드는 AI 학습·추론 프로세서 신제품과 CPU 개발 로드맵을 선보였고, 에이전트 실행·관리를 지원하는 에이전틱 클라우드 전략도 발표했다. 알리바바는 글로벌 데이터센터 용량을 2032년까지 20기가와트(GW) 이상으로 확대한다는 목표를 밝혔다. 에디 우 CEO는 향후 기계의 연산·사고량이 크게 늘어날 것이라며 인프라 확장의 필요성을 강조했다.
xAI의 그록(Grok) 4.6이 2026년 8월 18일 아마존 베드록에서 이용 가능해졌다. xAI가 베드록에 제공한 두 번째 모델로, 기존 bedrock-mantle에 더해 bedrock-runtime 엔드포인트와 Converse API(스트리밍 포함)를 새로 지원하며, 추론 강도를 낮음·중간·높음·xhigh 네 단계로 설정할 수 있다. xAI는 장기 실행 에이전트, 코딩, 지식노동 작업에 초점을 맞춰 훈련했다고 밝혔으며, 2026년 8월 12일 발표한 자체 벤치마크에서 GDPVal-AA v2, AA-Briefcase 등 다수 평가 결과를 공개했다. 이 중 일부 지표는 xAI 자체 측정이 아니라 독립 평가기관인 Artificial Analysis가 산출한 것이다.
중국 스텝펀이 에이전트 작업, 코딩, 전문 지식 업무, 금융 분석에 특화한 차세대 플래그십 모델 '스텝 5 프리뷰'를 9월 20일(현지시간) 공개했다. 희소 전문가 혼합(MoE) 구조를 적용해 높은 지능 수준을 유지하면서도 작업 비용을 낮추는 것을 목표로 개발됐다고 밝혔다. 시각적 멀티모달 입력도 지원한다. 스텝펀은 이 모델이 소프트웨어 엔지니어링 등 업무에 강점을 갖는다고 설명했다.
샤오미 AI 대형모델팀이 차세대 모델 '미모(MiMo)-V2.6'의 강화학습(RL) 사후훈련 과정을 실시간으로 볼 수 있는 대시보드를 9월 15일 공개했다. 대시보드에는 '미모-V2.6 프로'와 '미모-V2.6 플래시' 두 모델이 강화학습을 거치며 점수를 높여가는 과정이 실시간으로 표시된다. 기술보고서 발표나 모델 재현 공개를 넘어 훈련 과정 자체를 대중에 노출한 것은 주요 AI 기업 중 처음이라고 매체는 전했다.
미국 스타트업 타입세이프 AI가 9월 15일 첫 모델 'Jev'를 공개하고 4000만 달러 투자 유치를 발표했다. CEO 디오고 알메이다는 오픈AI 연구원 출신이다. Jev는 글쓰기·코드 작성 없이 정해진 선택지 중 하나를 고르거나 확률을 답하는 판단 전용 모델이며, 버셀은 이를 역사상 가장 빠르게 사용량이 늘어난 유료 모델이라고 발표했다. 타입세이프가 홈페이지에 내건 '193.6배 빠르고 444.6배 저렴'이라는 수치는 표에서 가장 느리고 비싼 모델만 골라 비교한 것으로, 정확도가 비슷한 모델 기준으로는 약 25배 빠르고 76배 저렴하다고 개발자들이 분석했다. 정답 기준도 사람이 아닌 GPT-6 Astra와 Claude Fable 5.1 응답의 평균이며, 확률의 실제 적중률을 보여주는 보정 검증은 아직 공개되지 않았다.
캘리포니아 공과대학(Caltech) 스핀오프 기업 프리즘ML이 270억 매개변수급 대형언어모델(LLM)을 5.9기가바이트(GB) 크기로 압축한 온디바이스 AI 모델을 공개했다. 해당 모델은 일반 PC와 노트북, 고성능 스마트폰에서도 구동 가능하다고 회사 측은 밝혔다. 프리즘ML은 앞서 7월 54GB 모델을 4GB 미만으로 압축해 아이폰 17 프로에서 구동하는 데 성공하며 애플 등 빅테크의 인수·협력 검토 대상으로 떠오른 바 있다.
서강대학교 수학과 김종락 교수 연구팀은 업스테이지의 경량 모델 '솔라 미니 4 프리뷰'가 수능 수학 평가에서 높은 정답률과 빠른 속도, 뛰어난 도구 활용 능력을 보였다고 18일 밝혔다. 연구팀은 자체 개발한 AI 수학 추론 평가 플랫폼 '앤트로피매스'를 통해 이 모델의 수능 수학 문제 해결 능력을 검증했다. 평가는 공통 22문항과 확률과 통계·미적분·기하 각 8문항 등 총 46문항으로 구성됐다.
정체가 공개되지 않은 AI 모델 '유니온 알파'가 등장해 개발자들의 관심을 모으고 있다. 이 모델은 9월 16일(현지시간) 오픈라우터와 오픈코드에 익명 모델로 등록됐으며, 제공 업체는 '스텔스'로만 표시됐다. 개발사 이름과 모델 카드, 가중치 등 세부 정보는 공개되지 않았다. 무료로 사용할 수 있다는 점과 최첨단 모델에 근접한 성능을 내세우고 있다는 점이 주목을 받고 있다.
구글이 고난도 수학 연산과 심층 추론에 특화된 미공개 모델 '딥씽크 V3 마세마티카'를 내부 테스트 중인 정황이 포착됐다. AI 전문 매체 테스팅카탈로그는 9월 16일(현지시간) 이 모델의 백엔드 정보와 사고 과정 스크린샷이 외부로 유출됐다고 보도했다. 이 소식은 X의 AI 전문 계정 '라이라(lyraxana)'의 게시물을 통해 처음 알려졌다. 해당 계정은 앞서 구글이 재귀적 자기개선에 도달했음을 암시하는 내용을 올려 주목받은 바 있다.
챗GPT와 RLHF 개발에 참여했던 오픈AI 출신 디오고 알메이다가 15일(현지시간) 새로운 AI 모델 '제브(Jev)'를 공개했다. 제브는 기존 대형언어모델처럼 텍스트를 토큰 단위로 생성하는 대신, 구조화된 의사결정 자체를 출력하도록 설계됐다. 2년간 개발됐으며, 개발진은 환각과 타입 오류가 없다고 주장했다. 속도와 비용, 안정성이 중요한 자동화 분야를 겨냥한 모델이다.
Anthropic이 Claude 채팅 안에서 문서와 프레젠테이션을 만들 수 있는 Docs와 Slides 기능을 출시했다. 생성된 결과물은 내보내기, 편집, 다른 사용자와 공유가 가능하다. 이와 함께 Anthropic은 일반 채팅과 Cowork를 하나의 Claude로 통합해, Cowork와 Design 기능을 별도 모드 구분 없이 모든 대화에서 쓸 수 있도록 인터페이스를 단순화했다. Artifacts와 Claude Design 기능도 새 통합 인터페이스에서 제공된다.
세일즈포스가 엔비디아와 협력해 영업·마케팅·고객지원 업무에 특화된 자체 AI 추론 모델 '코아(Koa)'를 공개했다. 9월 15일(현지시간) 드림포스 이벤트에서 발표됐으며, 엔비디아의 오픈웨이트 모델 '네모트론'을 기반으로 사후학습을 거친 세일즈포스 최초의 기업용 추론 모델이다. 27년간 축적된 세일즈포스의 CRM 전문성을 학습에 반영했다고 회사 측은 설명했다. 세일즈포스는 이를 통해 '클로드', '챗GPT' 등 외부 프론티어 모델에 대한 기업 의존도를 낮추겠다는 전략을 밝혔다.
딥시크의 'DeepSeek-V4.1' 개발에 참여한 류청후이 엔지니어가 위챗에 올린 글에서 미국 AI 기업들의 '속도 조절론'을 독점 시도라고 비판했다. 그는 앤트로픽과 오픈AI 등 폐쇄형 모델 중심 기업들이 최첨단 AI를 개방적이고 저렴하게 제공할 것이라 믿기 어렵다고 주장하며, 이를 '핵무기를 쥔 히틀러'에 비유했다. 최첨단 AI가 소수 미국 기업에 집중될 경우 기술과 경제적 기회도 편중될 수 있다며 오픈소스와 저비용 AI의 필요성을 강조했다. 그는 딥시크가 폐쇄형 중심의 미국 기업들과 달리 개방형 노선을 택하고 있다고 밝혔다. 사우스차이나모닝포스트가 14일 이 같은 내용을 보도했다.
오픈AI가 새 모델 'GPT-6 아스트라'의 순차 배포를 시작했다. 일반 대화창에서는 'GPT-6 프로' 명칭으로 제공되며, 상위 요금제 및 비즈니스·엔터프라이즈 사용자에게 먼저 적용된다. 플러스 구독자는 챗GPT 워크와 코덱스 환경에서 사용할 수 있지만, 무료 및 고 요금제 사용자는 대상에서 제외됐다. 추론 성능이 높아진 대신 이전 모델 'GPT-5.6 솔'보다 사용 할당량 소모 속도가 빨라져, 명확한 프롬프트 작성과 출력 형식 지정 등 사용 전략이 필요하다고 안내됐다.

데빈 개발사 코그니션이 문샷 AI의 '키미 K3'를 단 한 번의 강화학습으로 사후학습한 코딩 모델 'SWE-2'를 9월 11일(현지시간) 공개했다. 코그니션에 따르면 SWE-2는 주요 코딩 벤치마크에서 '페이블 5.1'에 근접한 성능을 보이면서도 추론 비용을 크게 낮춘 것이 특징이다. SWE-2는 코그니션의 전작 모델을 잇는 신형 코딩 모델이다.
업스테이지가 경량 모델 '솔라 미니 4'의 무료 프리뷰를 공개했다. 김성훈 대표는 13일 페이스북을 통해 이를 알렸으며, 정식 API는 22일 오픈될 예정이다. 솔라 미니 4는 상용 모델 '솔라 프로 4'보다 훨씬 작은 크기로도 비슷한 성능을 낸다고 회사 측이 설명했다. 응답 속도가 빠르고 GPU 부담이 적으며, '솔라 오픈2'에서 검증된 구조와 학습 데이터를 그대로 이어받았다고 강조했다.
프린스턴대학 연구진이 대형언어모델의 이전 계산 결과를 다음 토큰 생성에 직접 연결하는 새로운 트랜스포머 아키텍처 '순환 루프 변환기(RLT)'를 알파카이브를 통해 공개했다. 이 아키텍처는 토큰 처리 후 생성된 디코더의 최종 은닉 상태와 어텐션 캐시를 다음 단계의 첫 입력으로 전달하도록 설계됐다. 기존 디코더 전용 LLM은 이전 토큰 정보를 KV 캐시에 저장해 어텐션으로 재참조할 뿐, 마지막 계산 결과를 다음 단계에 직결하지는 않았다.
오픈AI가 10일(현지시간) 금융 서비스 특화 기업용 제품 '챗GPT 포 파이낸셜 서비스'를 공개했다. 투자은행과 증권사의 신입 애널리스트·은행원이 맡아온 기업 조사, 재무 분석, 투자 제안서 작성 등을 자동화하는 것이 목표다. 금융 데이터에 대한 직접 접근과 AI 모델의 추론 능력을 결합했으며, 기업용 AI 업무 환경인 '챗GPT 워크' 체제 안에서 제공된다.
딥시크가 장기 실행 AI 에이전트의 병목으로 꼽히는 메모리 사용량을 줄인 경량 모델 '딥시크 V4.1 플래시'를 공개했다. 초대형 컨텍스트 창을 지원하면서도 KV 캐시 사용량을 전작 대비 약 4분의 1 수준으로 낮춘 것이 핵심이다. 딥시크는 10일(현지시간) 새로운 아키텍처 제품군 중 가장 작은 모델로 이를 출시했다고 밝혔다. 오는 14일부터는 기존 '딥시크 V4 프로' API 요청이 V4.1 플래시로 자동 라우팅된다.
오픈AI가 'GPT-6 아스트라'에 대한 수요 급증으로 서버 과부하가 발생하자 최상위 유료 요금제 '챗GPT 프로'의 신규 가입과 업그레이드를 일시 중단했다. 티보 소티오 오픈AI 제품 담당 책임자는 9월 10일(현지시간) X를 통해 기존 사용자들이 안정적으로 서비스를 이용할 수 있도록 하기 위한 조치라고 밝혔다. 이번 중단은 신규 출시된 아스트라의 폭발적인 인기가 배경이라고 회사 측은 설명했다.
오픈AI가 새 AI 모델 '아스트라'에 대한 이용 수요가 크게 늘면서 최상위 등급인 프로 요금제의 신규 가입을 일시 중단했다. 오픈AI 제품·플랫폼 총괄 티보 소티오는 사회관계망서비스 엑스(X)를 통해 기존 이용자들이 아스트라를 계속 원활하게 이용할 수 있도록 하기 위한 조치라고 설명했다. 그는 해당 요금제 가입자 증가가 시스템에 영향을 준 상황이라고 언급했다.

오픈AI가 챗GPT 음성 모드에서 사용자가 원하는 모델과 추론 수준을 직접 고를 수 있도록 개편했다. 오픈AI 음성 제품 담당자 아티 엘레티는 챗GPT 음성이 GPT-5.6 솔과 GPT-6 아스트라를 지원한다고 밝혔으며, 프로 이용자는 GPT-6 아스트라도 쓸 수 있다. 이와 함께 음성 모드 사용 한도도 늘어나 플러스 이용자는 1시간에서 3시간으로, 프로 이용자는 15시간으로 확대됐다.
오픈AI가 차세대 모델 'GPT-6 아스트라'에 대한 수요 폭증으로 그래픽처리장치(GPU) 등 컴퓨팅 자원 부족을 우려하고 있다. 티보 소티오 오픈AI 제품 총괄은 10일(현지시간) 소셜미디어 X를 통해 아스트라 수요가 전례 없는 수준으로 폭증했다고 밝혔다. 그는 이전에도 가파른 성장을 경험했지만 이번과 같은 수요는 처음이라고 언급하며, 자체 컴퓨팅 능력이 이를 감당하지 못할 수 있다는 우려를 우회적으로 표현했다.
확산 언어모델 스타트업 인셉션 랩스가 초저지연·저비용 특성을 유지하면서 생성 품질을 높인 신모델 '머큐리 2.5'를 공개했다. 인셉션 측은 이 모델이 지금까지 나온 확산 LLM 중 가장 크고 뛰어나다고 밝혔다. 회사는 자체적으로 이전 버전 '머큐리 2' 대비 지능 성능이 40% 향상됐다고 발표했다. 기존 LLM의 약점으로 지적돼온 느린 응답 속도와 높은 비용 문제를 개선하는 데 초점을 맞췄다는 설명이다.
바이트댄스가 사용자의 움직임과 음성에 실시간으로 반응하는 가상 세계를 구현하는 '월드 모델' 개발에 나섰다. 블룸버그에 따르면 장이밍 창업자가 다음 달 출시를 목표로 '실시간 공간 비디오 생성' AI 모델 개발을 직접 진두지휘하고 있다. 그는 여러 사업부의 개발 역량을 조율하는 동시에 AI 인력과 컴퓨팅 자원을 이 프로젝트에 집중시키고 있는 것으로 전해졌다. 바이트댄스는 틱톡과 영상 생성 AI 시댄스(Seedance)로 쌓은 경쟁력을 바탕으로 월드 모델 시장에 진출하고 있다.
구글 딥마인드 수장으로 올라선 코레이 카부크추오글루 수석부사장이 취임 후 첫 인터뷰에서 경쟁사 대비 모델 품질 격차를 인정했다. 그는 구글 개발자 유튜브 채널 '릴리즈 노트' 대담에서 현재 모델이 최첨단 프론티어 수준에 다소 못 미친다는 시장 평가가 정당하다고 밝혔다. 동시에 프론티어 AI 주도권을 반드시 되찾겠다는 목표를 제시했다.
강화학습 연구자인 캐나다 앨버타대 리처드 서튼 교수와 제자 쿠람 자베드 박사가 대형언어모델 중심의 현재 AI 패러다임을 정면 비판했다. 이들은 연속 학습 방식을 기반으로 하면 인간 뇌 수준의 낮은 전력으로도 초대형 모델을 구동할 수 있는 초고효율 AI 시대가 가능하다고 주장했다. 서튼 교수는 세쿼이아 캐피털 팟캐스트에 출연해 AI 스타트업 '옥 랩' 창립을 알리며 현 AI 산업이 직면한 문제를 지적했다.
AI 성능 평가 플랫폼 아레나의 코딩 분야에서 오픈AI 모델이 앤트로픽을 처음으로 제쳤다. 아레나 발표에 따르면 오픈AI의 'GPT-6 아스트라(Max)'는 '코드 아레나: 웹개발' 부문에서 1797점으로 1위에 올랐다. 기존 1위였던 앤트로픽의 '클로드 페이블 5.1(Max)'은 1762점으로 2위, '클로드 오퍼스 5(Max)'는 1688점으로 3위를 기록했다. 이는 코딩·웹 개발 영역에서 강세를 보여온 앤트로픽 클로드 시리즈의 정상 자리가 처음으로 바뀐 사례다.

오픈AI가 'GPT-6 아스트라'를 공개했지만 출시 직후 유료 가입자 접근이 지연되며 혼란이 발생했다. 샘 알트먼 CEO는 이를 '엉망진창인 배포'라고 표현하며 직접 사과했다. 오픈AI는 3일(현지시간) 아스트라 출시 당시 '데이브레이크' 사이버 보안 플랫폼 등 일부 기업 고객에게 우선 제공했으며, 플러스·프로·비즈니스 등 기존 유료 회원과 API 개발자에게는 며칠에 걸쳐 순차적으로 배포 범위를 넓혔다.

아랍에미리트 아부다비의 모하메드 빈 자예드 인공지능 대학교(MBZUAI) 산하 기초 모델 연구소(IFM)가 9월 3일 6종의 파운데이션 모델로 구성된 'K2 호라이즌'을 발표했다. 가중치만 공개하는 오픈웨이트 방식을 넘어 소스 코드, 전체 학습 데이터셋, 평가 및 학습 레시피까지 함께 공개해 연구 재현성과 투명성을 강화했다. 최종 결과물만 내놓는 기존 방식과 달리 학습 과정의 변화까지 추적할 수 있도록 했다.

마이크로소프트가 음성 인식 모델 'MAI-트랜스크라이브-2'를 공개했다. 지난 4월 첫 모델 출시 이후 약 5개월 만에 내놓은 후속 모델로, 처리 속도와 다국어 정확도를 높였다고 밝혔다. MS는 이 모델이 자사가 개발한 음성 전사 모델 중 가장 뛰어나며, 오픈AI와 구글 등 경쟁 모델과 비교해도 성능과 효율성 면에서 앞선다고 설명했다.

오픈AI가 사전 학습, 강화 학습, 정렬 기술을 결합한 신규 플래그십 모델 'GPT-6 아스트라'를 공개했다. 오픈AI 측은 이 모델이 컴퓨터 제어, 브라우징, 소프트웨어 엔지니어링, 사이버 보안, 과학 연구 등 여러 실무 영역에서 성능을 보였다고 밝혔다. 그렉 브록먼 오픈AI 사장은 출시 발표에서 "AGI 시대에 오신 것을 환영합니다"라는 메시지를 전달했다.