LangSmith, Jev와 SemIf를 포함한 의사결정 모델 지원
LangSmith는 Jev와 SemIf를 포함한 지원 대상 의사결정 모델의 모든 단계를 확인할 수 있게 한다.
LangSmith는 Jev와 SemIf를 포함한 지원 대상 의사결정 모델의 모든 단계를 확인할 수 있게 한다.
다국어 Controlled Voice Arena 리더보드는 9개 신규 언어의 텍스트 음성 변환 모델을 비교한다. 언어를 선택할 수 있는 리더보드, 공개 투표 아레나, 벤치마킹 방법론을 이용할 수 있다.
Artificial Analysis 순위에서 아홉 개 언어를 모두 앞서는 단일 오픈 웨이트 텍스트 음성 변환 모델은 없다. Higgs Audio V3 TTS, OpenAudio S1 Mini, Voxtral TTS, Breeze TTS 2가 각각 다른 언어에서 오픈 웨이트 분야 1위이며, 각 순위판에는 오픈 웨이트 모델이 2~6개만 포함된다.
Controlled Voice Arena가 이제 일본어, 만다린 중국어, 힌디어, 스페인어, 독일어, 프랑스어, 포르투갈어, 베트남어, 아랍어로 텍스트 음성 변환 모델을 순위화한다. Cartesia의 Sonic 제품군이 9개 보드 중 8개에서 선두이고, Inworld AI의 Realtime TTS-2가 만다린 중국어에서 1위다.
0.87.1 릴리스는 Pi 라이브러리가 최신 모델을 사용하도록 업데이트했으며, 릴리스는 pi.dev에 게시됐다.
Expedia는 Muse에 합류한다고 밝혔다. 곧 개인 AI 에이전트에 목적지를 알려주면 Expedia와 연동해 호텔과 그 사이 모든 일정을 정리할 수 있게 된다.
Artificial Analysis는 StepAudio 3 ASR의 전사 속도가 실시간의 88배라고 보고했다. 더 빠른 시스템 세 개보다는 뒤지고, ElevenLabs Scribe v2와 Gemini 3.5 Transcribe와는 비슷한 수준이며, Fun-Realtime-ASR-preview보다는 앞선다.
Artificial Analysis에 따르면 StepFun의 StepAudio 3 ASR가 StepFun API를 통해 비스트리밍 전사에 제공된다. AA-WER Index에서 WER 1.7%를 기록해 Alibaba의 Fun-Realtime-ASR-preview와 동률이며, StepAudio 2.5 ASR의 4.7%보다 낮아졌다. 전사 속도는 실시간의 88배이고 요금은 시간당 0.40달러다.
Pydantic는 에이전트가 TypeSafe AI의 Jev 분류기로 타입이 지정된 질문에 답하며, 각 에이전트의 기존 출력 모델과 필드별 신뢰도 점수 하나를 반환한다고 밝혔다.
Expedia는 Muse의 개인용 AI 에이전트가 곧 목적지를 받아 Expedia와 협력해 호텔과 여행의 다른 부분을 예약할 수 있게 된다고 밝혔다.
OpenCode가 이제 GPT 6 Sol, Luna, Opus 5.5를 제공한다. 가격, 한도, 이용 자격 조건은 밝히지 않았다.
OpenAI의 두 모델은 Arena에서 시험할 수 있으며, 실제 에이전트 작업에 대한 투표가 리더보드에 반영된다. Arena.ai는 petergostev가 같은 프롬프트와 최대 추론 설정으로 GPT-6 Sol과 GPT-5.6 Sol을 비교했다고도 밝혔다.
Pi는 세 모델이 Radius(radius.earendil.com)에서 이용 가능하다고 밝혔다.
GPT-6 Sol은 Perplexity와 Computer에서 사용할 수 있으며, Computer의 effort selector에서 기본 Light 옵션이다.
Claude는 Claude Opus 5.5가 오늘 제공된다고 밝혔다. 이 내용은 2026년 9월 22일 18:55 UTC에 게시됐으며, 플랫폼, 가격, 할당량, 이용 자격 조건은 밝히지 않았다.
Arena.ai에서 두 모델 모두 Battle Mode와 Agent Mode를 써볼 수 있다.
OpenAI의 GPT-6 Sol과 GPT-6 Luna를 이제 Arena.ai의 Agent Arena에서 시험할 수 있으며, 점수는 아직 나오지 않았다. Code Arena의 WebDev, Text, Vision, Search, Document에서도 시험할 수 있다. OpenAI는 이 모델들이 GPT-6 Astra를 기반으로 하며, API 가격이 GPT-5.6 프로모션 가격보다 50% 낮다고 밝혔다.
GitHub Copilot이 OpenAIDevs GPT-6 모델 두 가지를 추가로 정식 제공한다. 대화형·에이전트형 코딩용 GPT-6 Sol과, GitHub가 소규모 작업용 경량·최저가 옵션이라고 부르는 GPT-6 Luna다.
DAIR.AI는 연구 에이전트가 예산을 어디에 쓸지 적응형 MCTS 정책으로 정하는 PrimeScientist를 소개한다. 같은 예산의 AI 연구 과제 12개에서 AutoResearch보다 보상은 10.3% 높고 연구 시도는 50.6% 적었다고 보고한다.
샘 알트먼은 GPT-6 Sol과 Luna가 지능, 정렬, 작업 산출, 코딩, 컴퓨터 사용에서 5.6 계열 이전 모델보다 크게 개선됐으며, 토큰당 가격은 절반이고 작업당 가격은 그보다 더 낮다고 밝혔다. 그는 작업당 가격 기준으로는 시장에서 경쟁할 만한 것이 없다고 본다고 말했다.