Yomna Shousha, Worker Previews 소개
Worker Previews는 에이전트가 만드는 변경마다 프로덕션과 유사한 환경을 제공한다.
Worker Previews는 에이전트가 만드는 변경마다 프로덕션과 유사한 환경을 제공한다.
이 작업은 ggml의 Metal 커널을 transformers 생태계에 가져오며, Georgi Gerganov에 따르면 호환성과 성능을 높인다.
그는 SliceAttention 커널과 BatchedMuon 덕분이라고 밝혔으며, 현재 Transolver를 쓰고 있다고 전했다. 전체 학습 실행은 26시간에서 22시간으로 줄었고, 오차나 품질에는 유의미한 변화가 없었다고 한다.
개인 AI 어시스턴트 Today의 중국판이 9월 정식 출시되며, 9월 24일 사용자와 만난다. iOS, Android, Windows, Mac, Linux 버전을 제공한다.
oMLX는 같은 저장소에서 Apache 2.0 라이선스를 유지하며, Jun Kim이 Hugging Face에서 이 프로젝트를 전업으로 맡으면서 계속 이끈다. 그는 이 작업이 2월 개인 프로젝트로 시작됐다고 밝혔다.
Kimi.ai는 Kimi K3가 코딩, 문서 분석, 확장된 에이전트 워크플로를 위해 Amazon Bedrock에서 이용 가능하며, Bedrock의 액세스·암호화·감사 제어와 명시적 프롬프트 캐싱 지원을 제공한다고 밝혔습니다.
StepFun은 Artificial Analysis 결과를 강조하며 Step 5 Preview가 Intelligence Index에서 44점, 작업당 $0.71를 기록했다고 밝혔고, 10월 15일에 더 많은 내용이 나올 예정이다. 평가는 600B/27B MoE 플래그십으로 자사 API 접근이 가능하며 10월 15일에 오픈 웨이트가 계획되어 있다고 설명한다.
텐센트 훈위안은 Hy Image3.5 프리뷰가 공개됐으며, 텍스트-투-이미지와 이미지-투-이미지 생성이 최대 2K까지 가능하다고 밝혔다. 텐센트 클라우드 API 가격은 생성된 이미지당 $0.024이며, OnSolo와 Miora에서만 2주 무료를 제공했다.
텐센트 Hunyuan은 혼합 정밀도 양자화로 Hy4 preview의 770B 파라미터 가중치를 약 1.5TB에서 214 GiB로 줄인 것에 관한 Zhihu Frontier 해설글을 인용했다. 인용된 글은 파라미터 수가 변하지 않았다고 말하며, MRCR은 거의 변하지 않았고 수학에서 소폭 하락했다고 보고한다.
Command Code는 Grok 4.7이 이제 Command Code에서 라이브이며 GOAT, Pro, Max 및 API를 통해 이용 가능하다고 밝혔다. 또한 향후 7일 동안 40%와 GOAT에서 $35 크레딧(3.5배 사용량)을 명시했다.
Dax (@thdxr)는 Kit가 OpenCode 2.0이 실시간으로, 심지어 실행 중인 세션 중에도 자신에 관한 모든 것을 수정할 수 있는 방법을 다룬 블로그 글을 완성했다고 말했습니다.
TypeSafe는 TypeSafe의 Jev 모델로 구동되는 SQL 함수 prompt_jev()가 텍스트 분류를 약 50배 빠르게, 비용은 약 1%로 수행했다는 MotherDuck의 주장을 인용했다. MotherDuck은 LLM의 32분 및 $37과 비교해 100k rows를 40초에 $0.50로 처리했다고 보고했다.
알리바바 클라우드와 ZAKA가 10월 6–7일 ADNEC Centre Abu Dhabi에서 열리는 AI Everything Abu Dhabi 2026의 이틀간 Qoder AI 해커톤을 위해 협력하며, 참가자들은 Qoder로 작동하는 AI 솔루션을 구축할 수 있다.
Command Code는 MiMo V2.6 Pro와 Flash가 Command Code에서 라이브되며 모든 플랜에서 이용 가능하다고 밝혔다. $10 GOAT 플랜에서는 MiMo-V2.6 Flash를 72시간 동안 $67(6.7배 사용량), MiMo-V2.6 Pro를 $20(2배 사용량)으로 안내했다.
Vercel은 Grok 4.7과 Vercel로 더 낮은 비용으로 구축하라고 말했으며, 9월 27일까지 AI Gateway가 40% 할인된다고 했습니다. 게시물은 또한 @v0, @eve, fx로 시도해 보라고 했습니다.
이 1회성 방법은 질문을 단서로 나누고 상호 보완적인 검색을 실행한 뒤, 에이전트 루프가 시작되기 전에 모은 결과를 재순위화한다. BrowseComp-Plus에서 같은 검색기와 에이전트 루프를 사용했을 때 GPT-5.5의 정확도는 83.1%에서 90.5%로 올랐다.
Cline은 플래그십 모델 MiMo-v2.6-Pro가 공식 출시되어 이미 ClinePass에서 이용 가능하다고 밝혔다. 또한 이 모델을 인공지능 지수에서 최고 성능의 오픈 웨이트 모델이라고 평가했다.
마크 저커버그는 Muse가 Shopify와 협력하여 Muse에서 쇼핑과 체크아웃을 더 쉽게 만들 것이라고 말했다. 그는 또한 이와 같은 더 많은 파트너십이 곧 있을 것이라고 말했다.
v0는 Grok 4.7이 이제 v0에서 이용 가능하며 9월 27일까지 40% 할인된다고 밝혔다. 해당 게시물은 Grok 4.7이 출시되었다는 SpaceXAI의 발표를 인용했다.
Google은 지난주 Google DeepMind의 두 가지 새로운 오디오 모델인 Gemini 3.8 Live와 Gemini 3.8 Live Extended Thinking을 소개했으며, 팀원들이 창의적 애플리케이션, 실시간 지원 및 로봇공학 전반에 걸쳐 이를 사용해 구축하고 있다고 밝혔습니다.