Adithya S K, 검증 가능한 RL 과제 5,000개 이상을 담은 SmolDataEnvs 공개
SmolDataEnvs는 코드와 데이터 과학 분야에서 소형 모델을 점진적으로 개선하기 위한, 검증 가능한 강화학습 환경 과제 5,000개 이상을 모은 오픈소스 자료다. 이번 공개에는 환경, 평가, 학습 자료가 포함된다.
SmolDataEnvs는 코드와 데이터 과학 분야에서 소형 모델을 점진적으로 개선하기 위한, 검증 가능한 강화학습 환경 과제 5,000개 이상을 모은 오픈소스 자료다. 이번 공개에는 환경, 평가, 학습 자료가 포함된다.
Token Meter는 Splunk가 만든 무료 오픈소스 메뉴 막대 도구로, 실행이 진행되는 동안 코딩 에이전트 비용을 보여 준다.
inclusionAI가 Ming-Image-0.1-Design 제품군을 MIT 라이선스로 오픈소스 공개했다. 시각 디자인 워크플로를 위한 상호 보완적인 6B 모델 Design와 Layer 두 가지다. ModelScope는 Design가 Artificial Analysis UI/UX Design 리더보드의 오픈 웨이트 모델 중 1위이며, Layer는 평가된 Crello 설정 12개 전부에서 선두이고 평가된 20B 오픈 웨이트 기준 모델보다 4.3배 빠르다고 밝혔다.
Arena.ai는 두 아레나 모두에서 Qwen-Image-2.1을 오픈소스 모델 1위로 평가했다. Image Edit에서는 1,367점을 기록하고 전체 16위이며, GPT-Image-1.5-high-fidelity보다 3점 낮다.
2026년 9월 22일 Ahmad Awais는 Command Code에서 Jev를 무료로 출시하며, 사용은 헤드리스 모드 또는 Provider API로 제한된다고 밝혔다. 그는 또한 모드 cmd-mod-jev-nudge를 오픈소스로 공개했다.
Jev는 헤드리스 모드에서만 쓰거나 Provider API를 통해서만 사용할 수 있다. Ahmad Awais는 cmd-mod-jev-nudge 모드도 오픈소스로 공개했으며, 무료 이용은 할 일이 더 남아 있는 동안 에이전트를 계속 실행하기 위한 것이라고 말한다.
StepFun은 LLM 데이터 주석과 모델 검사용 내부 도구 onPanda를 오픈소스로 공개했다고 밝혔다. 수동 후편집보다 주석 시간 중앙값이 52% 낮고, 모델의 재샘플링 기준 대비 on-policy 충실도는 ΔPPL 1% 미만이라고 보고했다.
IBM, Meta, Hugging Face의 기여자들이 다양한 하드웨어에서 다양한 모델을 실행하는 사용자를 위해 최첨단 성능과 이식성의 균형을 맞추려는 하드웨어 독립 레이어를 소개한다.
StepFun이 명령줄 도구 Step Code v0.1.0을 MIT 라이선스로 오픈소스 공개했다. StepPage로 명령 한 번에 정적 사이트를 게시할 수 있다. StepFun은 자체 평가에서 Terminal-Bench 2.1 80.9%, 150개 과제의 장기 작업 벤치마크 Multi-Frame에서 73.3%를 기록했다고 밝혔다.
Step Code v0.1.0은 MIT 라이선스의 CLI 에이전트로, 하나의 명령줄에서 코드를 읽고 수정하며 테스트를 실행하고 배포한다. StepFun은 Terminal-Bench 2.1에서 80.9%, 자체 150개 과제 벤치마크인 Multi-Frame에서 73.3%를 기록했다고 밝혔으며, StepPage로 명령 한 번에 게시하는 기능도 포함한다.
책상 위 기기는 대기, 작업 중, 결정 필요, 완료 상태를 표시한다. Wahlin은 Copilot CLI로 여러 애니메이션과 웹 기반 캐릭터 스튜디오를 만들고, 프로젝트를 esp32-agent-companion으로 공개했다.
Clement Delangue(@ClementDelangue)는 스타트업 @eidon_ai가 일상 작업을 수행하는 인간의 13,451개 녹화본으로 구성된 1,274시간의 1인칭 시점 로봇 데이터를 로봇 커뮤니티에 선물로 오픈소스 공개했다고 밝혔다.
VIDEO REBIRTH는 HyperFlow를 오픈소스로 공개했으며, ComfyUI 커뮤니티가 이틀 만에 독자적으로 지원을 구현했고, 커뮤니티 빌드의 다운로드 수가 자사 빌드를 앞질렀다고 밝혔다.
Ghita는 Jev 사용자들에게 zerank-2가 신뢰도 점수도 반환하는 4B 오픈소스 리랭커이므로 임계값을 설정해 분류기로 사용할 수 있다고 전했습니다. 게시물에서는 Baseten 또는 Fireworks AI로 자체 호스팅할 수 있다고 했으며 Hugging Face 모델 페이지를 링크했습니다.