MODELS · TOOLS · EVENTS
AI News
새 AI 모델과 도구, 개발자 행사 소식을 한곳에서 살펴봅니다.
무엇이 달라졌고, 어떻게 활용할 수 있는지 정리합니다.
모델 출시·업데이트AI 도구·서비스개발자 행사·발표
기존 LLM 브리핑을 모았습니다. 수록 내용 기준: 2026-09-22.
모델 소식매주
모델 출시와 가격·컨텍스트 변화, 오픈 가중치 라이선스, 규제 — 연구와 진료 현장에 실제로 영향이 가는 것만 골라 담습니다. 국내외를 구분하지 않습니다.
선정 기준 — 성능 순위 다툼이나 투자 유치 소식은 다루지 않습니다. 쓸 수 있는 모델이 바뀌었는지, 비용과 컨텍스트가 달라졌는지, 라이선스와 규제가 어떻게 바뀌었는지에 집중합니다.
2026-09-21
xAIGrok 4.7 — 값은 4.6 그대로, 대신 20만 토큰부터는 요청 전체가 두 배 — 9월 21일 API와 Cursor·Grok Build에 풀렸다. 컨텍스트 50만 토큰, 지식 컷오프 2026년 5월. 가격은 100만 토큰당 입력 $2·캐시된 입력 $0.50·출력 $6로 직전 4.6과 같다고 소개됐다. 짚어둘 대목은 두 가지다. 프롬프트가 20만 토큰 이상이면 그 요청의 모든 토큰이 입력 $4·캐시된 입력 $1·출력 $12로 계산되고, 미국 지역 엔드포인트로 보내면 1.1배가 붙는다. 더 큰 기반 모델에 더 긴 강화학습을 돌려 여러 시간짜리 작업에 맞췄다는 설명이라, 표시가가 같아도 추론 토큰이 늘면 실제 청구액은 올라갈 수 있다. 이달 초 GPT-6 Astra의 272K 경계와 같은 구조가 다른 회사에서도 반복된다 — 긴 차트나 논문 묶음을 통째로 넣는 작업이라면 문서 길이가 곧 단가 구간이다.출시 정리 · 가격·접근 정리
2026-09-21
XiaomiMiMo-V2.6 Pro·Flash — 1조 파라미터급 오픈 가중치가 MIT로, 발표회 없이 허깅페이스에 먼저 — Pro는 총 1.02조(활성 420억), Flash는 총 3,100억(활성 150억) 파라미터의 MoE이고, 둘 다 컨텍스트 약 100만 토큰에 텍스트·이미지·음성·영상을 받는다. 가중치는 MIT로 상업적 사용과 수정이 자유롭고, 샤오미 API 가격은 100만 토큰당 Pro 입력 $0.435·출력 $0.87, Flash 입력 $0.14·출력 $0.28로 보도됐다(VentureBeat 기준). 두 모델은 별도 발표 행사 없이 허깅페이스에 먼저 올라왔고 기술 보고서와 강화학습 도구도 함께 공개됐다. 지난주 DeepSeek V4.1 Flash에 이어 MIT 대형 모델이 연달아 나오면서 원내 서버에 직접 올려 해외 API를 거치지 않는 구성의 선택지가 넓어졌다 — 다만 Flash도 FP8 가중치만 170GB를 넘어 서버급 GPU가 필요하다. 라이선스의 문은 열렸지만 하드웨어의 문턱은 그대로다.Flash 정리 · LLM Stats
2026-09-17
PrismMLTernary Bonsai 2 27B — 27B 모델을 5.9GB로, 맥북과 아이폰에서 돌아가는 Apache 2.0 — Qwen3.8 27B를 가중치당 약 1.76비트로 압축해 파일을 5.9GB까지 줄였고, 회사 측 집계로 원 모델 벤치마크 성능의 98.2%를 유지한다. 컨텍스트 262K, 텍스트와 이미지 입력을 받으며, RTX 4090·5090 같은 소비자용 GPU와 Mac·iPhone·iPad(MLX)에서 돌아간다. 라이선스는 Apache 2.0이라 매출 기준 같은 조건 없이 상업적으로 쓸 수 있다. 의료 현장에서 의미가 있는 쪽은 성능이 아니라 위치다 — 환자 정보를 밖으로 보내지 않고 진료실 노트북 한 대에서 요약·정리 작업을 돌리는 구성이 현실적인 크기로 내려왔다. 압축 모델은 긴 추론이나 드문 사례에서 원 모델과 차이가 벌어질 수 있어, 임상 문서에 쓰려면 원 모델과 나란히 비교해 보는 편이 안전하다.MarkTechPost · 발표문
2026-09-11
Sakana AIFugu Max·Ultra v2 — 모델이 아니라 '모델을 고르는 모델', 대신 누가 내 데이터를 읽는지 보이지 않는다 — Fugu는 단일 모델이 아니라 작업마다 다른 모델에 일을 나눠 맡기고 답을 합치도록 학습된 오케스트레이터다. OpenAI 호환 API로 바로 쓸 수 있고, 가격은 Fugu Max가 100만 토큰당 입력 $2·출력 $6, Fugu Ultra v2는 표준 컨텍스트 기준 입력 $5·출력 $30로 보도됐다. 풀에는 엔비디아 Nemotron 계열 같은 오픈 가중치·특화 모델이 들어가며, Ultra v2는 Fable 5·5.1과 GPT-6 Astra를 풀에 넣지 않았다고 밝혔다. 짚어둘 점은 어떤 모델이 요청을 처리했는지 사용자가 볼 수 없다는 것이다 — 풀의 전체 구성과 라우팅은 공개되지 않았고, 출시 발표문에서는 데이터 보관·학습 사용 조건이 확인되지 않는다(약관·데이터 처리 계약을 따로 봐야 한다). 보도에 따르면 EU·EEA에서는 아직 서비스하지 않는다. 싸게 성능을 얻는 대신 데이터 경로를 감사할 수 없는 구조라, 환자 정보가 섞이는 작업이라면 단가보다 계약 조건을 먼저 봐야 한다.MarkTechPost · DataNorth
2026-09-11
Shanghai AI LabAtria Dawn Preview — 발표문 없이 가중치부터 올라온 MIT 에이전트 모델 — 상하이 인공지능실험실이 허깅페이스에 올린 장기 과제용 에이전트 모델로, GLM-5.2(744B MoE)를 기반으로 후속 학습했다. 가중치와 코드는 MIT이고, 모델 카드 기준 컨텍스트는 256K, 입력은 텍스트만 받는다. 문제 분석·설계·도구 사용·코드 작성·실험 실행·실패 복구를 잇는 연구 루프를 겨냥했다. 자체 호스팅(SGLang·vLLM)과 호스팅 API를 함께 열었지만 블로그·가격 발표 없이 저장소가 먼저 공개됐다. 일부 정리 사이트는 컨텍스트를 100만 토큰으로 적고 있어 모델 카드와 수치가 엇갈린다 — 도입을 검토한다면 카드 원문을 기준으로 삼는 편이 안전하다. 허용적 라이선스의 대형 모델이 기존 오픈 가중치를 재학습하는 방식으로 늘고 있다는 점도 눈여겨볼 만하다.OrcaRouter · GitHub
2026-09-10
DeepSeekDeepSeek V4.1 Flash — MIT 가중치에 100만 토큰, 그리고 같은 이름의 V4 Pro 호출을 조용히 대체 — 총 552B 파라미터의 MoE이고, 컨텍스트는 100만 토큰이며 이번 세대부터 이미지를 직접 읽는다. 가중치는 허깅페이스에 MIT로 공개됐다. API 가격은 오프피크 기준 100만 토큰당 입력 $0.15(캐시 적중 $0.003)·출력 $0.60이고, 피크 시간대에는 두 배다. KV 캐시 메모리는 이전 세대의 약 4분의 1로 줄였다. 실무적으로 더 큰 변화는 라인업 정리다 — V4-Flash는 은퇴했고, 9월 14일 04:00 UTC부터
deepseek-v4-pro 요청이 V4.1-Flash로 자동 전환돼 Flash 요금으로 처리된다(V4.1-Pro 출시 전까지). 모델 이름을 고정해 두고 쓰던 파이프라인이라면 같은 이름으로 다른 모델이 답하게 된 셈이라, 결과 재현성이 중요한 연구는 호출 시점의 모델 버전을 다시 확인해야 한다. 한편 가중치가 MIT라 원내 서버에 직접 올려 쓸 수 있고, 그러면 해외 API를 거치지 않는 구성이 가능하다 — 실제로 데이터가 밖으로 나가지 않는지는 배포·운영 설정을 따로 점검해야 한다.가격 정리 · Dataconomy
2026-09-04
OpenAIGPT-6 Astra 정식 공개 — 사이버 능력은 별도 승인 프로그램으로 떼어냈다 — 9월 1일 예고, 3일 제한 프리뷰를 거쳐 4일 정식 공개됐다. 컨텍스트 1,050,000 토큰·최대 출력 128K, 텍스트와 이미지 입력, 지식 컷오프는 2026년 4월 30일이다. 값은 100만 토큰당 입력 $10·출력 $50이고 캐시된 입력은 $1, 캐시 쓰기는 $12.50다. 주의할 대목은 입력이 272K 토큰을 넘으면 요청 전체가 다시 가격 책정된다는 점 — 긴 문서를 통째로 넣는 파이프라인이라면 이 경계선을 넘나드는 것만으로 단가가 달라진다. 더 중요한 변화는 접근 방식이다. 공개 모델은 개념증명 익스플로잇 같은 고급 사이버 요청을 거부하고, 완화된 안전장치는 Daybreak 신뢰 접근 프로그램을 통과한 조직에만 열린다. 같은 모델이 능력별로 두 겹으로 갈리기 시작했다는 뜻이다.개요 · 가격 정리
2026-09-02
GoogleGemini 3.8 Flash 출시 — 넉 달 만의 네 번째 Flash, 구글 스스로 "효율이 중요하면 3.7에 남으라" — 3주 전 이 자리에 적었던 3.7 Flash의 후속이다. 컨텍스트 100만 토큰·출력 64K, 텍스트·이미지·음성·영상·PDF를 받는다. 가격은 100만 토큰당 입력 $0.75·출력 $3.75로 3.7 Flash와 같고, 2026년 12월 31일까지만 유지된 뒤 2027년 1월 1일 두 배가 되는 일정도 그대로다. 배치·Flex는 절반, Priority는 1.8배. 짚어둘 점은 성능의 출처다 — 새 기반 모델이 아니라 3.7 Flash 위에 얹은 것이고, 벤치마크 향상의 상당 부분이 추론 토큰을 더 태워서 나온다. 구글 스스로 효율이 우선인 작업에는 3.7 Flash에 머무르라고 안내한다. 표시가가 같아도 실제 청구액은 올라갈 수 있다는 뜻이라, 대량 처리라면 토큰 사용량을 직접 재보고 옮기는 편이 안전하다. 사이버 능력을 다루는 3.8 Flash Cyber는 Fairwind 프로그램(정부·기반시설·오픈소스 관리자)으로 접근을 제한했다.리뷰 · DataCamp
2026-09-02
MetaMuse Spark 1.3 — 21배 싼 등급이 있지만, 값을 프롬프트로 치른다 — 표준 등급은 100만 토큰당 입력 $1.25·출력 $4.25(캐시된 입력 $0.15)로 직전 버전과 같다. 눈여겨볼 것은 새로 생긴 '기여자(Contributor)' 등급으로, 입력 $0.10·출력 $0.20·캐시된 입력 $0.002까지 내려간다 — 입력 12.5배·출력 21배, 캐시된 입력은 75배 싸다. 대신 조건이 붙는다 — 메타가 그 프롬프트와 응답을 학습에 쓴다. 컨텍스트는 100만 토큰이고 텍스트·이미지·영상을 받는다. 병원·연구실 관점에서는 이 등급이 쓸 수 없는 선택지라는 점을 분명히 해둘 필요가 있다. 진료기록이나 환자 영상이 조금이라도 섞이는 작업에서 단가만 보고 고르면 곧장 데이터 거버넌스 사고가 된다. "싼 모델"을 비교할 때 표에 학습 사용 여부 칸을 하나 더 두어야 하는 국면이다.Artificial Analysis · 기여자 등급 정리
2026-09-01
AnthropicClaude Fable 5.1 — 표시가는 그대로, 캐시 읽기만 75% 인하 — 입력 $10·출력 $50(100만 토큰당)은 Fable 5와 같고, 캐시 읽기만 $1.00에서 $0.25로 내렸다. Anthropic은 실제 청구액이 통상 작업에서 25%, 캐시 읽기가 비용의 대부분을 차지하는 복잡한 에이전트·코딩 작업에서는 최대 45%까지 줄어든다고 밝혔다. 컨텍스트 100만 토큰이며 Claude API와 AWS·Google Cloud·Azure에서
claude-fable-5-1로 바로 쓸 수 있다. 긴 지침이나 대량 문서를 매 요청마다 다시 붙이는 구조에서 절감 폭이 가장 크다는 점이 실무적으로 중요하다. 같은 날 나온 Mythos 5.1은 신뢰 접근 프로그램을 통과한 조직에만 열리는 쌍둥이 모델이다 — 이번 주 구글·OpenAI가 함께 보인, 능력별로 접근을 나누는 흐름의 한 조각이다.implicator.ai · gHacks
2026-08-28
Zhipu AIGLM-5.3 가중치, 결국 공개 — 다만 MIT가 아니라 자체 라이선스 — 2주 전 이 자리에서 "당일 오픈 가중치가 더 이상 기본값이 아니다"라고 적었던 그 모델이다. 8월 14일 출시 후 약 2주간의 안전성 검토를 거쳐 허깅페이스에 올라왔는데, 직전 세대 GLM-5.2가 썼던 MIT를 버리고 'glm-5.3'이라는 자체 라이선스가 붙었다. 핵심 조건은 연매출 100억 달러를 넘는 모델 서비스(MaaS) 사업자는 Z.ai의 보안 검토를 받아야 한다는 것이다. 국내 병원·연구실 규모에서는 사실상 걸리지 않는 문턱이지만, 중국 대형 모델의 라이선스가 세대마다 조건이 바뀌는 흐름은 그대로다 — 다음 버전을 전제로 계획을 세우지 말고 그때그때 문서를 읽어야 한다.The New Stack
2026-08-26
Zhipu AIGLM-5.3-Flash 공개 — 320B 멀티모달 모델이 MIT로, 100만 토큰당 입력 $0.15 — 같은 회사가 이틀 앞서 내놓은 작은 축은 MIT 그대로다. 총 3,200억 파라미터에 토큰당 180억만 활성화하는 MoE이고, 텍스트만 학습한 뒤 붙인 것이 아니라 처음부터 멀티모달로 만든 GLM-5 계열의 첫 모델이며 컨텍스트는 100만 토큰이다. 가격은 100만 토큰당 입력 $0.15·출력 $0.50(캐시된 입력 $0.03). 100만 토큰 컨텍스트, 기본 멀티모달, 허용적 라이선스 — 얼마 전까지 최상위 모델의 특징이던 세 가지가 저가 구간의 기본값이 되고 있다는 뜻이다. 판독 보고서와 영상을 함께 다뤄야 하는 원내 실험에서는 라이선스가 걸림돌이 되지 않는 쪽이 실제로 중요하다.8월 오픈 가중치 정리
2026-08-21
DeepSeekDeepSeek V4 Flash Vision Exp — 영상 입력이 붙었지만 가중치는 공개되지 않았다 — V4 Flash에 이미지 이해를 더한 실험 등급 모델로 API에만 올라왔다. 값은 기존 V4 Flash와 같은 100만 토큰당 입력 $0.14·출력 $0.28이고, 이미지는 자동 축소를 거쳐 장당 최대 384 토큰으로 계산된다. 주목할 점은 가중치가 없다는 것이다 — DeepSeek이 MIT로 풀어 온 것은 Pro·Flash 계열 본선이고, 이 실험 모델은 허깅페이스에 체크포인트가 올라오지 않았다. 환자 영상을 다루는 작업이라면 API로만 쓸 수 있는 모델과 내려받아 원내에서 돌릴 수 있는 모델의 구분이 곧 데이터가 어디로 나가는가의 문제가 된다.출시·가격 정리
2026-08-19
DeepReinforceOrnith-1.5 공개 — 397B·35B·9B 세 크기 모두 MIT 라이선스 — 397B MoE 플래그십, 토큰당 30억만 활성화하는 35B MoE, 그리고 스마트폰용 양자화 빌드가 있는 9B 밀집 모델까지 세 크기 전부와 FP8·GGUF·MLX·NVFP4 양자화판이 MIT로 나왔다. 매출 규모에 조건을 다는 중국 대형 모델들의 자체 라이선스와 달리 상업적 이용·원내 배포를 막는 조항이 없다. 개발사 자체 평가에서 397B가 Terminal-Bench 2.1 86.1점(Claude Opus 4.8은 85.0)이라고 밝혔는데 자사 평가라는 점은 감안해야 한다. 눈여겨볼 쪽은 오히려 작은 축이다 — 9B와 35B-A3B는 원내 서버나 노트북에서 돌릴 수 있는 크기이고, 라이선스가 걸림돌이 되지 않는다.DataNorth · OfficeChai
2026-08-14
Zhipu AIGLM-5.3 출시 — 이번엔 가중치를 당일 공개하지 않았다 — 743B MoE(토큰당 약 400억 활성화), 컨텍스트 100만 토큰, 출력 최대 12.8만 토큰. 사양보다 중요한 것은 배포 방식이 바뀌었다는 점이다. 직전 GLM-5.2는 출시 당일 MIT로 가중치를 풀었지만 5.3은 안전성 검토를 거쳐 약 2주 뒤 공개하는 방식으로 돌아섰고, 라이선스 조건도 아직 공개되지 않았다. API 요금표에도 5.3이 없어 출시 시점에는 코딩 플랜·ZCode 안에서만 쓸 수 있었다. 가중치는 8월 28일 공개됐고, MIT가 아닌 자체 라이선스가 붙었다(위 항목 참조). 중국 모델의 "당일 오픈 가중치"가 더 이상 기본값이 아니라는 신호로, 원내 도입을 전제로 계획을 세운다면 공개 시점과 라이선스를 확인한 뒤 움직이는 편이 안전하다.출시 정리
2026-08-14
AlibabaQwen3.8-27B, Apache 2.0으로 공개 — 이틀 전 Max와 라이선스가 갈렸다 — 277.8억 파라미터 밀집 모델로 텍스트·이미지·영상을 받고 기본 컨텍스트가 262,144 토큰이다(알리바바는 100만 토큰까지 확장 가능하다고 밝혔다). 주목할 대목은 라이선스다. 이틀 앞서 나온 최상위 Qwen3.8-Max가 매출 공유 조건이 붙은 자체 라이선스였던 것과 달리, 27B는 Apache 2.0이다. 같은 세대 안에서도 크기에 따라 라이선스가 갈리므로 "Qwen은 오픈"이라는 식의 일반화는 이제 성립하지 않는다. 공식 FP8 빌드가 함께 나와 있어 단일 GPU 서버급에서 다룰 만한 크기다.사양 정리 · 가중치
2026-08-13
GoogleGemini 3.7 Flash 출시 — 도입가 100만 토큰당 입력 $0.75·출력 $3.75, 내년부터 2배 — 3.6 Flash가 나온 지 3주 만이다. 컨텍스트는 그대로 104만 토큰. 주목할 대목은 가격 구조로, 이 단가는 2026년 12월 31일까지만 적용되고 2027년 1월 1일부터 입력·출력 모두 두 배가 된다. 지금 단가를 기준으로 대량 처리 파이프라인을 설계하면 해가 바뀔 때 비용이 그대로 두 배로 늘어난다는 뜻이라, 예산을 잡을 때 이 일정을 함께 넣어야 한다.가격 일정 · 사양 정리
2026-08-12
DeepSeekDeepSeek V4 Pro 정식 출시 — 가중치는 MIT로 공개, API 가격은 대폭 인상 — 4월부터 이어진 프리뷰가 끝나고 V4-Pro-0813이 정식 버전으로 올라왔다. 총 1.6조 파라미터에 토큰당 490억만 활성화하는 MoE 구조, 컨텍스트 100만 토큰, 최대 출력 38.4만 토큰이며 가중치는 MIT 라이선스로 허깅페이스에 공개돼 자체 호스팅에 제약이 없다. 반대로 API는 8월 16일 16시(UTC)부터 값이 올랐다 — 보도된 인상 폭은 모델·토큰 종류·시간대에 따라 50%에서 1,100%까지로, V4 Pro 입력은 100만 토큰당 $0.435에서 피크 시간 $1.32 수준이 됐다. 가중치를 받아 직접 돌리는 쪽과 API를 쓰는 쪽의 계산이 갈리는 사례다.가중치 · 가격 인상 정리
2026-08-12
AlibabaQwen3.8-2.4T-A95B 가중치 공개 — 다만 Apache 2.0이 아닌 자체 라이선스 — Max 등급 Qwen을 내려받을 수 있게 된 것은 처음으로, 2.4조 파라미터에 토큰당 950억을 활성화하는 MoE 체크포인트가 허깅페이스에 올라왔다. 문제는 라이선스다. 이전 세대 Qwen이 Apache 2.0이었던 것과 달리 이번에는 자체 라이선스가 붙었고, 규모가 큰 상업적 이용에 매출 공유를 요구하는 것으로 보도됐다(구체적 기준·비율은 아직 확정된 형태로 공개되지 않았다). Kimi K3에 이어 중국 대형 모델의 최상위 공개 가중치가 잇따라 조건부 라이선스로 나오고 있다 — 원내 도입을 검토한다면 라이선스 문서부터 읽어야 하는 이유다.사양 정리
2026-08-11
AnthropicClaude Sonnet 5 도입가를 정가로 확정 — 9월 1일 예정이던 50% 인상 철회 — 100만 토큰당 입력 $2·출력 $10은 원래 8월 31일까지만 적용되고 9월 1일부터 $3·$15로 오를 예정이었는데, 그 인상이 취소되고 현재 가격이 정가가 됐다. 값이 내린 것이 아니라 예정돼 있던 인상이 사라진 것이라, 9월 이후를 $3·$15로 잡아 둔 예산이 있다면 다시 계산할 여지가 생겼다. 배치 API는 절반인 $1·$5. 앞서 8월 13일 Gemini 3.7 Flash가 도입가를 연말까지만 유지하고 2027년 1월 두 배로 올린다고 예고한 것과 나란히 놓고 보면, "도입가"의 만료일을 계약서처럼 확인해야 하는 국면이다.Anthropic 공지
2026-08-10
MetaMeta, 300억 파라미터 Muse Glimmer를 Apache 2.0으로 공개 — 매출 규모에 제한을 두는 자체 라이선스가 아니라 Apache 2.0이라, 적어도 라이선스 측면에서는 상업적 이용과 원내 배포를 막는 조항이 없다(보안·개인정보·의료기기 해당 여부는 별개 문제다). 컨텍스트 13만 토큰, 텍스트·이미지 입력, 도구 사용에 맞춘 모델이다. 4비트 양자화하면 소비자용 GPU 24~32GB VRAM이나 M4/M5 Max 맥에서 구동 가능하다는 것이 공개된 측정치다(컨텍스트를 길게 쓰면 KV 캐시 때문에 요구량이 늘어난다). 환자 데이터를 밖으로 내보내지 않는 원내 로컬 구동을 검토할 만한 조건이다.VentureBeat · 가중치
2026-08-10
OpenAI보안 특화 GPT-5.6-Cyber 공개 — 심사를 통과한 기관에만 제공 — 취약점 연구·모의침투용으로 GPT-5.6 Sol 위에 학습했고, 신청 심사를 거치는 'Daybreak Red' 등급에서만 쓸 수 있다. 능력이 아니라 접근 자격으로 위험을 관리하는 방식이 등장했다는 점이 눈에 띈다.정리
2026-08-02
EUAI Act 제50조 투명성 의무 시행 — 챗봇 고지·AI 생성물 표시 — 사람이 AI와 대화하고 있다는 사실을 알리고, 생성·조작된 콘텐츠에 기계판독 가능한 표시를 붙여야 한다. 챗봇 고지 의무는 출시 시점과 무관하게 곧바로 적용되고, 이미 시장에 나와 있는 생성형 시스템의 표시 의무만 2026년 12월 2일까지 유예된다. 과징금은 최대 1,500만 유로 또는 전 세계 매출 3%.조문 해설
2026-08-02
EUAI Act, 범용 AI 모델에 대한 집행 권한 발효 — 유럽 AI 사무국이 정보 요구·모델 평가 접근·위험 완화 조치 요구·과징금(전 세계 연매출 3%까지)을 실제로 행사할 수 있게 됐다. 2025-08-02 이후 시장에 나온 모델은 이미 의무 적용 대상이고, 그 이전 모델은 2027-08-02까지 유예된다.AI Act 조문
2026-07-31
LGLG, 파라미터 7,500억 규모의 국내 최대 AI 모델 공개 — 국가 AI 모델 사업을 둘러싼 국내 경쟁이 규모 확대로 이어지고 있다.
2026-07-30
OpenAIGPT-5.6 Luna 가격 80%, Terra 가격 20% 인하 — 인하분은 Codex와 ChatGPT Work의 유료 구독 사용량 산정에도 그대로 반영된다. 대량 처리 작업의 비용 계산을 다시 해볼 만한 폭이다.
2026-07-27
Moonshot AIKimi K3 가중치 공개 — 공개 가중치 모델 중 최대 규모인 2.8조 파라미터 — 토큰당 1,040억 파라미터만 활성화하는 MoE 구조에 100만 토큰 컨텍스트. 다만 라이선스가 MIT가 아닌 자체 문서로, 연매출 2,000만 달러를 넘는 상업적 추론 이용에 제한을 둔다. 원내 도입을 검토한다면 라이선스 조항을 먼저 읽어야 한다.
2026-07-24
AnthropicClaude Opus 5 공개 — 작업별로 '노력(effort)' 수준을 조절하는 설정 도입 — 100만 토큰당 입력 $5·출력 $25. 높은 난도의 작업에만 최대 성능을 쓰고 나머지는 낮은 비용으로 돌리는 방식이라, 대량 문서 처리처럼 비용이 문제였던 작업의 계산이 달라진다.
2026-07-21
GoogleGemini 3.6 Flash 출시 — 같은 작업에 쓰는 출력 토큰을 줄이는 방향 — Artificial Analysis 지수 기준 출력 토큰 사용량이 이전 세대보다 17% 감소했고 출력 단가도 낮아졌다.
2026-07-13
과기정통부전 국민 무료 AI 에이전트 'AI for Everyone' 사업 공모 — 모든 국민에게 AI 챗봇과 공공서비스 도우미를 무료로 제공하겠다는 정부 사업으로, 제안 접수는 8월 11일까지였다.
2026-07-09
OpenAIGPT-5.6 출시와 함께 모델 이름 체계 개편 — Sol·Terra·Luna — 숫자는 세대를, 이름은 능력 등급을 나타내는 방식으로 바뀌었다. 최상위 Sol은 100만 토큰당 입력 $5·출력 $30에서 시작한다.