1201

Hugging Face smolagents 출시

Hugging Face는 smolagents를 출시했는데, 이는 JSON 대신 실행 가능한 코드로 행동을 작성함으로써 LLM이 복잡한 작업을 수행할 수 있게 하는 경량 라이브러리로, 구성성과 범용성을 향상시킵니다.

1202

OpenAI 기업 구조 진화

OpenAI는 자본을 더 잘 유치하고 AGI가 인류에 이익이 되도록 하는 비영리 사명을 유지하기 위해 영리 부문을 델라웨어 공익 기업(Public Benefit Corporation)으로 전환할 계획을 세우고 있습니다.

1203

QVQ-72B-Preview 출시

Qwen은 Qwen2-VL-72B를 기반으로 한 오픈 웨이트 멀티모달 추론 모델인 QVQ-72B-Preview를 출시했으며, MMMU 벤치마크에서 70.3점을 달성했습니다.

1204

PyTorch에서 GPU 메모리 시각화 및 이해하기 – Hugging Face 블로그 요약

Hugging Face의 블로그 포스트는 torch.cuda.memory 도구를 사용하여 PyTorch에서 GPU 메모리 사용량을 시각화하는 방법을 설명하고, 모델 훈련 중 메모리 구성 요소를 분석하며, 총 메모리 요구사항을 추정하기 위한 공식을 제공합니다.

1205

NVIDIA LogitsProcessorZoo: 모듈러 로짓 프로세서를 사용한 언어 모델 생성 제어

NVIDIA's LogitsProcessorZoo는 Hugging Face Transformers용 모듈러 로짓 프로세서를 제공하여 개발자가 생성 길이를 제어하고, 문구 포함을 강제하며, 프롬프트 콘텐츠를 인용하고, 출력을 다중 선택 옵션으로 제한할 수 있게 합니다.

1206

의사결정 정렬: 추론이 더 안전한 언어 모델을 가능하게 함

OpenAI는 명시적 안전 사양에 대해 추론하도록 o-시리즈 모델을 가르치는 훈련 패러다임인 의의적 정렬을 도입하여 안전성을 개선하고 이전 모델에 비해 과소 및 과다 거부를 모두 줄입니다.

1207

Big Bench Audio 출시

Artificial Analysis는 음성 언어 모델의 추론 능력을 평가하기 위해 설계된 1,000개의 음성 질문으로 구성된 데이터셋인 Big Bench Audio를 공개했으며, 텍스트와 음성 추론 사이의 상당한 성능 격차를 드러냈습니다.

1208

ModernBERT 릴리스 노트

Hugging Face, Answer.AI, LightOn은 BERT의 속도, 정확도 및 문맥 길이를 8,192 토큰까지 개선한 최첨단 인코더 전용 모델 제품군인 ModernBERT를 출시했습니다.

1209

Bamba-9B: 추론 효율적인 하이브리드 Mamba2 모델

Bamba-9B는 IBM, Princeton, CMU, UIUC가 2.2조 개의 공개 토큰으로 학습한 하이브리드 Mamba2 모델로, vLLM에서 Llama 3.1 8B 대비 2.5배 높은 처리량과 2배 낮은 지연 시간을 달성하고, transformers, vLLM, TRL, llama.cpp에서 즉시 사용할 수 있습니다.

1210

GCP에서 5세대 Xeon에서의 언어 모델 성능 벤치마크

Hugging Face는 Google Cloud의 C4(5세대 Xeon)와 N2(3세대 Xeon) 인스턴스에서 텍스트 임베딩 및 생성 벤치마크를 수행했으며, C4가 임베딩 처리량에서 10‑24배 높고 생성 처리량에서 2.3‑3.6배 높은 결과를 보여주어 각각 총 소유 비용(TCO) 장점이 7‑19배 및 1.7‑2.9배임을 확인했습니다.

1211

Falcon 3 릴리스 노트 / 새로운 기능

Technology Innovation Institute (TII)가 높은 효율성과 강화된 과학, 수학, 코딩 능력을 갖추도록 설계된 100억 파라미터 미만의 디코더 전용 대규모 언어 모델 제품군인 Falcon 3를 출시했습니다.

1212

OpenAI o1 및 개발자 도구 업데이트 2024년 12월

OpenAI가 API에 프로덕션 준비가 완료된 o1 추론 모델을 출시하고, DPO를 통한 Preference Fine-Tuning을 도입했으며, WebRTC 지원 및 대폭적인 가격 인하를 포함한 Realtime API 업데이트를 발표했습니다.

1213

Hugging Face Synthetic Data Generator

Hugging Face는 사용자가 자연어 프롬프트를 사용하여 맞춤형 텍스트 분류 및 채팅 데이터셋을 생성할 수 있는 노코드 애플리케이션인 Synthetic Data Generator를 선보였습니다.

1214

OpenAI 타임라인: 일론 머스크의 영리 구조 제안 및 이탈

OpenAI는 상세한 타임라인과 내부 커뮤니케이션을 공개하여, 일론 머스크가 2017년에 OpenAI를 자신의 절대적인 통제 하에 있는 영리 기업으로 전환하려고 적극적으로 시도했음을 드러냈다.

1215

LeMaterial v1.0: LeMat-Bulk 데이터셋 출시

LeMaterial v1.0은 Materials Project, Alexandria, OQMD의 670만 개 항목을 7가지 속성을 가진 표준화된 형식으로 통합하여 재료 발견을 가속화하는 오픈 소스 이니셔티브인 LeMat-Bulk 데이터셋 출시와 함께 시작됩니다.

1216

Sora는 여기 있습니다 – OpenAI가 새로운 인터페이스와 구독 접근을 갖춘 비디오 생성 모델 Sora Turbo를 출시합니다

OpenAI는 ChatGPT Plus 및 Pro 사용자를 위한 독립형 제품으로 제공되는 더 빠른 비디오 생성 모델인 Sora Turbo의 출시를 발표했으며, 새로운 인터페이스, 최대 1080p 해상도 및 20초 클립, 그리고 내장된 안전 조치를 특징으로 합니다.

1217

허깅 페이스 오픈 선호 데이터셋 텍스트-이미지 생성

Data is Better Together 커뮤니티는 모델 정렬을 위한 오픈소스 선호 데이터 부족 문제를 해결하기 위해 텍스트-이미지 생성을 위한 Apache 2.0 라이선스 오픈 선호 데이터셋을 출시했습니다.

1218

허깅페이스 모델이 아마존 베드록 마켓플레이스에 제공됨

허깅페이스는 아마존 베드록 마켓플레이스에 83개의 오픈 모델을 통합하여 AWS 고객이 관리형 인프라에서 오픈 모델을 배포하면서 베드록 API와의 호환성을 유지할 수 있도록 했습니다.

1219

OpenAI Sora: 애니메이터 Lyndon Barrois를 위한 창의적 워크플로 통합

애니메이터 Lyndon Barrois는 OpenAI Sora를 사용하여 전통적인 스튜디오 생산 파이프라인을 우회하고, 상상력을 고충실도 비디오 콘텐츠로 직접 번역할 수 있게 합니다.

1220

Vallée Duhamel과 Sora

OpenAI는 Sora 비디오 생성 모델에 대한 Vallée Duhamel의 예술적 관점을 강조하지만, 해당 제품은 2026년 4월 26일 기준으로 더 이상 사용할 수 없다고 명시되어 있습니다.

1221

OpenAI Sora 시스템 카드

OpenAI는 Sora라는 비디오 생성 모델의 시스템 카드를 공개했는데, 이 모델은 diffusion-transformer 아키텍처를 사용하여 최대 20초 길이의 1080p 해상도 비디오를 생성할 수 있습니다.

1222

Minne Atairu와 Sora

다학제적 예술가 Minne Atairu는 OpenAI의 Sora를 사용하여 부권적인 이미지에 도전하고 문화적 아이콘을 재정의합니다.

1223

OpenAI 제품 팀 AI 통합

OpenAI는 제품 팀 워크플로에 AI를 통합하여 생산성과 제품 개발을 향상시키는 웨비나와 지침을 출시했습니다.

1224

ChatGPT Pro 출시

OpenAI는 월 200달러의 ChatGPT Pro 구독 계획을 출시했으며, o1, o1-mini, GPT-4o 및 복잡한 문제 해결을 위한 고성능 'o1 pro mode'에 무제한으로 접근할 수 있습니다.

1225

OpenAI o1 시스템 카드

OpenAI는 사고의 연쇄 추론 모델, 안전성 평가, 그리고 설득 및 CBRN에 대한 중간 위험, 사이버 보안 및 모델 자율성에 대한 낮은 위험을 상세히 설명한 o1 시스템 카드를 공개했습니다.

1226

PaliGemma 2 릴리스 노트

Google은 PaliGemma 2를 출시했습니다. 이는 세 가지 매개변수 크기와 여러 입력 해상도에 걸쳐 SigLIP 이미지 인코더와 Gemma 2 텍스트 디코더를 결합한 비전 언어 모델 가족입니다.

1227

LLM은 자신의 실수를 얼마나 잘 수정할까? Keras와 TPU를 이용한 챗봇 아레나 실험

Hugging Face는 여러 10B 미만의 LLM을 대상으로 간단한 캘린더 API 작업 테스트를 진행했으며, Gemma 2 9B는 최소한의 프롬프트로 실수를 일관되게 수정한 반면, 더 작은 모델과 구형 모델은 어려움을 겪거나 많은 교정 턴이 필요하다는 것을 발견했습니다.

1228

OpenAI와 Future의 전문 콘텐츠를 위한 전략적 파트너십

OpenAI와 Future는 Future의 200개 이상의 전문 미디어 브랜드 콘텐츠를 ChatGPT에 통합하여 사용자에게 신뢰할 수 있는 전문 정보를 제공하고 출판사의 배포 범위를 확장하는 파트너십을 체결했습니다.

1229

모건 스탠리 AI 통합 및 평가 프레임워크

모건 스탠리는 OpenAI와 협력하여 GPT-4와 Whisper 기반 도구를 배포했으며, 신뢰성과 규제 준수에 중점을 둔 엄격한 평가 프레임워크를 통해 어드바이저 채택률 98%를 달성했습니다.

1230

AraGen 벤치마크 및 리더보드: 아랍어 LLM을 위한 3C3H 평가 도입

Hugging Face는 아랍어 LLM의 정확성, 완전성, 간결성, 도움이 됨, 솔직함, 무해함을 평가하는 3C3H 측정을 사용하는 동적 벤치마크 및 리더보드인 AraGen을 도입했습니다.

1231

Hugging Face CFM 사례 연구: LLM 인사이트를 활용한 소형 모델 파인튜닝

Capital Fund Management (CFM)는 Llama 3.1을 사용하여 GLiNER와 SpanMarker와 같은 소형 모델의 파인튜닝을 위한 데이터 라벨링을 지원함으로써 금융 Named Entity Recognition(NER)의 정확도를 최대 6.4% 향상시키고 추론 비용을 최대 80배 줄였습니다.

1232

오픈소스 개발자를 위한 EU AI 법 가이드

허깅 페이스 가이드는 EU AI 법이 오픈소스 AI 개발자에게 어떻게 적용되는지 설명하며, 제한된 위험 AI 시스템과 비시스템적 위험 범용 AI 모델에 대한 의무를 정리하고 준수를 위한 도구를 제시합니다.

1233

QwQ-32B-Preview: 깊은 추론 기능 탐구

Qwen은 내부 사유 과정(chain-of-thought)을 통해 깊은 추론과 복잡한 문제 해결을 위한 모델인 QwQ-32B-Preview를 도입했습니다.

1234

허깅페이스 허브 스토리지 재아키텍처

허깅페이스는 콘텐츠 주소 저장소(CAS)를 도입하여 바이트 수준 중복 제거를 가능하게 하고巨大한 AI 모델의 전송 속도를 향상시키기 위해 업로드 및 다운로드 아키텍처를 재설계하고 있습니다.

1235

SmolVLM 출시 노트 / 새로운 기능

Hugging Face는 낮은 메모리 점유율과 엣지 디바이스에서의 높은 처리량에 최적화된, 완전한 오픈 소스인 2B 파라미터 Vision Language Model (VLM) SmolVLM을 선보입니다.

1236

당신은 최첨단 위치 인코딩을 설계할 수 있었을 것입니다

허깅 페이스 블로그 글은 트랜스포머를 위한 위치 인코딩의 반복적 설계를 안내하며, sinusoidal 인코딩이 어떻게 Rotary Positional Encoding (RoPE)로 이어지는지 보여주고, 이것이 토큰 관계 모델링에 왜 중요한지 설명합니다.

1237

사람과 AI를 통한 레드 팀링 발전 – OpenAI의 접근 방식 및 o1 패밀리 적용

OpenAI는 AI 모델에 대한 외부 레드 팀링 프로세스를 상세히 설명하는 백서를 출판하고, 이를 바탕으로 OpenAI o1 패밀리를 공개 출시 준비에 적용했습니다.

1238

GrabMaps를 위한 Grab의 GPT-4o Vision Fine-Tuning

Grab은 GrabMaps를 위한 교통 표지판 위치 식별 및 차선 수 계산을 자동화하기 위해 GPT-4o vision fine-tuning을 도입했으며, 이를 통해 속도 제한 표지판 위치 식별은 13%, 차선 수 정확도는 20% 향상되었습니다.

1239

Hugging Face와 LLM-jp, 오픈 일본어 LLM 리더보드 출시

Hugging Face와 LLM-jp가 투명한 평가 플랫폼인 Open Japanese LLM Leaderboard를 도입했습니다. 이 플랫폼은 20개가 넘는 데이터셋을 통해 일본어 대형 언어 모델의 성능을 벤치마킹합니다.

1240

Hugging Face가 저장 효율을 높이기 위해 콘텐츠 정의 청킹을 도입합니다

Hugging Face는 Xet 팀을 통해 콘텐츠 정의 청킹 저장 방식을 발표했으며, 이는 수정된 청크만 업로드하여 대용량 모델 및 데이터셋 파일의 저장 및 전송 비용을 줄입니다.

1241

자체 추측 디코딩을 통한 더 빠른 텍스트 생성

Hugging Face는 LayerSkip을 통해 자체 추측 디코딩을 소개합니다. 이는 단일 LLM의 초기 레이어를 초안 작성에 사용하고 posteriores 레이어를 검증에 사용하여 생성 속도를 높이고 메모리 오버헤드를 줄이는 방법입니다.

1242

FlagEval Debate: 새로운 다국어 LLM 평가 프레임워크

BAAI는 다국어 토론에서 LLMs가 경쟁하여 추론, 논리 및 적대적 능력을 더 잘 평가할 수 있도록 하는 동적 평가 플랫폼인 FlagEval Debate를 출시했습니다.

1243

Rox 수익 플랫폼 OpenAI 통합

Rox는 OpenAI의 API를 사용하여 데이터 통합, 판매 워크플로우 자동화 및 계정 모니터링을 수행하는 AI 에이전트 스웜 시스템을 통해 AI 기반 수익 관리 플랫폼을 출시했습니다.

1244

Hugging Face Judge Arena: LLM을 평가자로 벤치마킹하기

Hugging Face는 다른 AI 생성 응답을 채점하는 평가자로서 어떤 LLM이 가장 효과적인지 결정하기 위해 사용자 투표를 사용하는 크라우드소싱 플랫폼인 Judge Arena를 출시했습니다.

1245

OpenAI가 프랑스 AI 생태계 확장을 위해 파리 사무소를 개설

OpenAI는 프랑스 조직, 스타트업 및 정부 협력 전반에 걸친 AI의 빠른 채택을 지원하기 위해 파리에 새로운 사무소를 개설했습니다.

1246

Qwen2.5-Turbo 1M 토큰 컨텍스트 길이 출시

Qwen은 Qwen2.5-Turbo를 출시했으며, 이는 모델의 컨텍스트 윈도우를 1백만 토큰으로 확장하면서 추론 속도를 크게 향상시키고 짧은 시퀀스 작업에서 경쟁력 있는 성능을 유지합니다.

1247

에스티 로더 컴퍼니즈 ChatGPT Enterprise 구현

에스티 로더 컴퍼니즈는 ChatGPT Enterprise를 배포하여 75+ 년 이상의 소비자 및 임상 데이터를 분석하고, 제품 개발 및 시장 responsiveness를 가속화하기 위해 240개 이상의 맞춤형 GPT를 만들었습니다.

1248

연구자를 위한 Hugging Face Hub 데이터셋 공유

Hugging Face Hub는 탐색, 보안 및 커뮤니티 참여를 위한 통합 도구와 함께 대규모 ML 데이터셋을 호스팅하고 공유할 수 있는 포괄적인 플랫폼을 제공합니다.

1249

Qwen2.5-Coder 시리즈 릴리스 노트

Qwen은 0.5B부터 32B까지 여섯 가지 모델 크기를 갖춘 Qwen2.5-Coder 시리즈를 출시했으며, 32B-Instruct 모델은 코딩 작업에서 GPT-4o와 comparable한 SOTA 오픈소스 성능을 달성했습니다.

1250

허깅 페이스 PyCharm 통합

허깅 페이스는 허브를 PyCharm Professional에 직접 통합하여, 개발자가 IDE를 떠나지 않고 머신러닝 모델을 발견, 삽입, 관리할 수 있도록 합니다.