DOE 제너시스 오픈 모델 이니셔티브, 제너시스 사이언스-1 오픈웨이트 기초 모델 출시
DOE의 제너시스 오픈 모델 이니셔티브는 과학을 위한 AI의 민주화를 목표로
미국 에너지부(DOE)는 제너시스 오픈 모델 이니셔티브를 출시하고, 과학적 발견을 위해 설계된 최초의 오픈웨이트 기초 모델인 제너시스 사이언스-1을 공개했다. 모델의 가중치와 아키텍처를 공개함으로써, DOE는 연구자, 국립연구소, 산업 파트너들에게 투명하고 확장 가능한 AI 도구를 제공하고자 한다. 이 도구는 재료 과학, 에너지 시스템, 지구 모델링, 핵융합, 생물학, 고에너지 물리학 등 다양한 분야에서 미세조정(fine-tuning)이 가능하도록 설계되었다.
제너시스-사이언스-1은 이 프로그램의 주력 모델
- 아르시 AI와 협력 – 미국의 오픈모델 연구소로, 데이터 파이프라인부터 4000억 파라미터 규모의 희소 전문가 혼합(MoE) 모델인 *트리니티 라지(Trinity Large)*까지 전체 모델 스택을 제공한다.
- 모델은 오픈웨이트 라이선스 하에 배포되며, 전체 파라미터 세트와 학습 기원이 공개된다.
- 발표에서 모델의 정확한 크기나 학습 데이터에 대한 세부 정보는 공개되지 않았고, 이로 인해 커뮤니티는 모델의 규모와 코퍼스에 대해 질문을 제기하고 있다.
기여 포털 오늘 오픈, 첫 마감일은 2026년 8월 14일
DOE는 기관들이 다음과 같은 자료를 제출할 수 있는 공개 포털(https://genesisopenmodels.anl.gov/)을 마련했다:
- 기초 단계 데이터 – 과학적 텍스트, 코드, 문서, 구조화된 데이터 코퍼스 (사전학습 또는 중간학습용)
- 학습 후 자산 – 미세조정 예시, 워크플로 환경, 강화학습 작업, 보류 평가, 평가 기준, 검증 세트
| 트랙 | 제출할 내용 | 신청 마감일 | 제출 마감일 |
|---|---|---|---|
| 기초 단계 데이터 | 텍스트, 코드, 문서, 구조화된 코퍼스 | 2026년 8월 14일 (3개월마다 반복) | 2026년 8월 28일 |
| 학습 후 데이터 및 환경 | 미세조정 데모, RL 게임 환경, 평가 세트 | 2026년 8월 25일 (3개월마다 반복) | 2026년 9월 14일 |
선정된 기여자는 모델 평가에 조기 접근할 수 있고, 기술 보고서 공동 저자 자격을 얻으며, 출시 자료에 이름이 명시된다. 직접적인 자금 지원은 언급되지 않았으며, 기여자는 데이터, 전문 지식, 또는 컴퓨팅 자원을 제공할 것으로 기대된다.
해커 뉴스 커뮤니티 반응
기존 미국 오픈웨이트 모델 부족
"지금까지 미국에서 오픈 모델은 거의 없었어요. 라마 시리즈가 중단된 이후로는 말이죠. 아마 제마(Gemma)나 GPT-OSS 정도가 있겠네요?" – firasd
이 댓글은 미국의 오픈웨이트 모델 공급 부족을 지적하며, 제너시스 사이언스-1이 이를 메울 수 있는 잠재적 해결책으로 부상할 수 있음을 시사한다.
성능 목표와 확장성에 대한 질문
"어떤 성능 수준에 도달하고 싶은지(즉, 확장 곡선에서 어떤 지점을 선택할지) 궁금하네요. 어떤 특화된 분야를 차지하고 싶은지요?" – lithobraking
사용자들은 모델 크기, 컴퓨팅 예산, 그리고 국제적 선도 모델들과의 경쟁 전략에 대한 구체적인 정보를 기대하고 있다.
인센티브에 대한 불확실성
"선정된 참여자들은 이 프로젝트에서 무엇을 얻게 되나요? 자금 지원은 전혀 제시되지 않은 것 같아요?" – Smith42
명시적인 재정적 인센티브가 부족하다는 점이 지적되었으며, 커뮤니티는 DOE가 후속 연구원 또는 학생 지원금을 연결해 기여를 유도할 수 있다고 제안했다.
투명성과 아키텍처에 대한 회의론
"이 모든 모델들은 실제로 의미 있는 아키텍처 차이점이나 학습 데이터 출처 차이가 있나요? 성능 차이를 만들어내는 요소는 무엇인가요?" – an0malous
커뮤니티는 제너시스 사이언스-1이 오픈웨이트라는 점 외에, 멀티모달 또는 과학 전용 아키텍처를 사용하는지 여부를 묻고 있다.
지정학적 및 수출 통제 우려
"이런 프로젝트에 기여하는 건 수출 통제 대상이 될 수 있는 위험한 길이에요." – victor9000
국제 협력자들이 연방 정부 지원 AI 프로젝트와 협력할 때 수출 통제 관련 법적 문제에 대한 우려를 표하고 있다.
제너시스가 DOE 제너시스 미션 전체에 어떻게 자리 잡는가
2025년 11월에 시행령을 통해 출범한 제너시스 미션은 10년 내 미국 과학 및 공학의 생산성을 두 배로 높이는 것을 목표로 한다. 이 미션은 DOE 산하 17개 국립연구소, 리더십 수준의 슈퍼컴퓨터, 과학 데이터 자원을 조율한다. 제너시스-사이언스-1은 이 미션의 첫 번째 구체적인 AI 산물로, 하류 과학 워크플로우를 위한 공유 인프라로 기능할 예정이다.
참여자가 현실적으로 기대할 수 있는 것
- 기술적 명성 – DOE 기술 보고서 공동 저자 자격 및 공개적 인정
- 조기 평가 접근 – 공개 출시 전에 진화하는 모델을 테스트하고 벤치마킹할 수 있는 기회
- 거버넌스에 대한 영향력 – DOE의 5단계 리뷰 프로세스를 통해 모델 라이선스, 데이터 사용 정책, 평가 기준에 대한 의견을 제시할 수 있음
- 잠재적 간접 자금 지원 – 직접 보장되진 않았지만, 커뮤니티 피드백을 반영해 특정 기여 트랙에 장학금 프로그램이나 박사 후 연구원 자리를 부여할 가능성 있음
여전히 남아 있는 질문들
- 정확한 모델 규모, 아키텍처, 학습 데이터 구성
- 국제 협력자들의 수출 통제 준수를 어떻게 처리할 것인지
- 기여자들에게 컴퓨팅 크레딧 또는 기타 실질적 자원을 제공할지 여부
- 제너시스 사이언스-1 이후 모델의 로드맵과 커뮤니티가 그 방향을 어떻게 영향을 줄 수 있을지
결론
DOE의 제너시스 오픈 모델 이니셔티브는 과학 연구를 위한 공개적이고 고성능 AI 모델을 창출하기 위한 중요한 연방 차원의 노력이다. 제너시스 사이언스-1을 공개하고 기여 포털을 열어 연구 생태계가 다음 세대 과학 AI를 공동 개발할 수 있도록 초대하고 있다. 그러나 이 프로그램의 성공 여부는 모델 사양의 명확성, 기여자에 대한 인센티브, 그리고 규제적 제약을 어떻게 극복할지에 달려 있다.
Sources
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch