Claude Opus 4.6
- LLM Foundation: Anthropic은 자사의 최상위 모델을 업그레이드한 가장 강력한 성능을 자랑하는 파운데이션 모델의 최신 버전 공개
- 코드 작성·리팩터링뿐 아니라 코드 리뷰, 디버깅, 자체 실수 발견·수정 능력이 개선
Claude Opus 4.6
GPT-5.3-Codex
- LLM Foundation: OpenAI의 에이전트형 코딩 모델로 포지셔닝된 코드 작성뿐 아니라 장기·툴 기반 컴퓨터 작업 전반을 맡길 수 있는 범용 에이전트 공개
- 기존 GPT‑5.2‑Codex 대비 약 25% 빠른 속도로 작동하며, Codex 사용 시 인터랙션 지연이 줄어듬
- 주요 코딩·에이전트 벤치마크에서 상위권 성능 달성
Codex가 업그레이드되었습니다
Qwen3-Coder-Next
- Open Weight Coding LM: Alibaba에서는 코딩 에이전트·로컬 개발용 오픈가중치 언어 모델 공개
- 전체 파라미터는 약 80B이지만, 토큰당 3B 활성 파라미터만 사용하는 스파스 MoE 구조
- 256K 토큰(262,144) 컨텍스트 윈도를 기본 지원해, 대규모 코드베이스나 긴 파일을 한 번에 다루는 데 유리
Qwen Studio
Kimi K2.5
- LLM Foundation: Moonshot AI에서는 15T 규모의 비전·텍스트 데이터를 함께 학습한 네이티브 멀티모달 오픈소스 모델 공개
- 다양한 공개·내부 벤치마크에서 GPT-5.2, Claude 4.5 등과 비슷하거나 우수한 수준의 추론·비전·코딩 성능 달성
Kimi Research Articles & Technical Blogs
Green-VLA
- VLA Framework: Sber Robotics Center에서는 휴머노이드 Green 로봇 실세계 배치를 목표로 한 단계적 Vision-Language-Action 프레임워크로, 다양한 로봇 형태에 일반화되도록 설계된 모델 개발
- 약 3,000시간 규모의 데모 데이터를 흐름 기반 시간 정렬과 품질 필터링으로 정규화하고, 단일 정책이 여러 로봇을 제어할 수 있도록 통합 action 인터페이스를 사용
Green-VLA: Staged Vision–Language–Action Model for Generalist Robots
PaperBanana
- Automating Academic Illustration: Google에서는 고급 비전-언어 모델과 이미지 생성 기술을 활용하여 출판 가능한 학술 일러스트레이션의 생성을 자동화하는 에이전트 기반 프레임워크 공개
- 논문용이지만 아마도 업무용, 보고서 등에서도 충분히 사용가능
PaperBanana: Automating Academic Illustration for AI Scientists
GLM-OCR
- OCR Model: Z.AI에서는 기존 단순 텍스트 추출 OCR이 아니라 문서 구조를 같이 이해하는 경량 멀티모달 OCR·문서 이해 모델 공개