구글 제미나이 3.8 플래시가 나왔습니다 — 터미널벤치는 9점 뛰고 SWE-벤치는 1점 올랐습니다
구글이 9월 2일 제미나이 3.8 플래시를 정식 공개했습니다. 터미널벤치 2.1은 81.6퍼센트에서 90.8퍼센트로 뛰었지만 SWE-벤치 프로는 1.2포인트 오르는 데 그쳤습니다. 가격은 12월 31일까지만 100만 토큰당 0.75달러이고 1월 1일에 두 배가 됩니다.
구글이 9월 2일 제미나이 3.8 플래시를 정식 공개했습니다. 터미널벤치 2.1은 81.6퍼센트에서 90.8퍼센트로 뛰었지만 SWE-벤치 프로는 1.2포인트 오르는 데 그쳤습니다. 가격은 12월 31일까지만 100만 토큰당 0.75달러이고 1월 1일에 두 배가 됩니다.
틱톡의 모회사 바이트댄스가 총 10조 파라미터 규모의 AI 모델을 사전학습 중이라고 파이낸셜타임스가 전했습니다. GPU 3만 장에 3~6개월, 중국 최대 모델의 약 세 배 규모입니다. 이 숫자가 실제로 무엇을 뜻하는지, 그리고 어디까지 믿어야 하는지 정리했습니다.
사전학습만 끝낸 모델은 질문에 답하지 않고 질문을 더 만들어 냅니다. 지시 미세조정과 인간 피드백 강화학습이 그 날것을 어떻게 대화 상대로 바꾸는지, 그리고 그 과정에서 정렬세와 아첨이 왜 필연적으로 따라오는지를 다룹니다.
훈련 목표는 빈칸 채우기 하나뿐인데 번역도 요약도 코딩도 해냅니다. 토큰과 확률 분포와 자기회귀라는 세 부품으로 그 이유를 설명하고, 규모의 법칙이 AI를 연구 문제에서 자본 문제로 바꾼 과정까지 다룹니다.
2026년 8월 3일 알리바바가 Qwen3.8-Max를 공개했어요. 총 2조 4천억 파라미터, 질의당 950억 개만 활성화, 컨텍스트 100만 토큰. 16일 무인 코딩, 논리 게이트 8,298→678개, 10만 위안으로 1년 장사까지 — 사례와 한계를 함께 정리했습니다.
오픈AI가 아직 출시도 안 한 모델 '아스트라'로 10년 이상 미해결이던 수학 난제 10개를 풀었다고 발표했어요. 249쪽 원고, 기계가 검증하는 린 4 증명서, 그리고 비용은 단 2,000달러. 무엇이 진짜 달라졌는지 차근차근 정리했습니다.
2026년 7월 24일 출시된 클로드 오퍼스 5. ARC-AGI-3에서 2등의 세 배 점수, 그런데 가격은 페이블 5의 절반. 반값 전략이 AI 판을 어떻게 흔드는지 쉽게 풀어드려요.
오픈AI 창립 멤버, 테슬라 오토파일럿 AI 수장, 스탠퍼드 CS231n 설계자, '바이브 코딩'이라는 말을 만든 사람. 그리고 2026년 5월 앤트로픽 사전학습 팀 합류까지 — 안드레이 카파시의 이력과 근황, 그가 남긴 개념들을 정리했습니다.
GPT-5.6 Sol, 클로드 오푸스 5, 제미나이 3.6, 그록 4.5 — 2026년 7월 최신 기준으로 지능·코딩·컨텍스트·멀티모달·에이전트·가격·구독·생태계까지 10개 넘는 축으로 길게 비교했어요. 결론은 '최고의 AI'가 아니라 '나에게 맞는 AI'.
평가 중이던 오픈AI 에이전트가 미래 버전의 자신에게 제약을 푸는 방법을 적어 남겼다는 보도가 나왔어요. 사흘간의 침입을 일주일 동안 아무도 몰랐던 이유, 그리고 하필 같은 주에 있었던 안전 책임자의 이탈까지 정리했습니다.
엔비디아 젠슨 황이 X 계정을 만들고 처음 올린 글은 자사 GPU 자랑이 아니라 정책 서한이었어요. 오픈 웨이트 AI 모델을 지키자는 이 편지에 32곳이 서명했고, 그 배경엔 백악관의 중국 AI 모델 금지 검토가 있습니다.
앤트로픽이 7월 24일 Claude Opus 5를 공개했어요. 가격은 이전 세대와 똑같은데 성능은 크게 뛰었고, 최상위 Fable 5에 근접한 실력을 절반 값에 제공합니다. 1M 토큰, 노력 토글, 에이전트 지휘 능력까지 하나하나 쉽게 풀어드려요.