开源模型Ornith-1.5称跑分达到Claude Opus水平
DeepReinforce团队推出可自行生成任务、脚手架和解题过程的自我改进循环模型,发布397B、35B、9B三种规格——所有数据均为团队自测
10
每天早上一封邮件,把昨天的 AI 梳理好订阅邮件
오픈소스 에이전트 코딩 모델 오니스(Ornith) 계열을 만드는 딥리인포스(DeepReinforce) 팀. 모델이 스스로 발판(scaffold)과 과제를 만들어 강화학습하는 자기개선 루프를 내세운다. 가중치는 허깅페이스 ornith-ai 조직에 공개한다.
DeepReinforce团队推出可自行生成任务、脚手架和解题过程的自我改进循环模型,发布397B、35B、9B三种规格——所有数据均为团队自测
已经是最后一篇了。