Argilla 2.4 릴리즈 노트 / 새로운 내용
Argilla 2.4는 인간 피드백을 통해 파인튜닝 및 평가 데이터셋을 구축하기 위해 Hugging Face Hub 데이터셋을 가져오는 노코드 UI를 도입했습니다.
ChatGPT 검색 소개
OpenAI는 ChatGPT에 새로운 웹 검색 기능을 통합하여 사용자가 관련 웹 소스에 대한 직접 링크와 함께 빠르고 시의적절한 답변을 얻을 수 있게 했습니다.
Promega ChatGPT 채택 사례 연구
Promega는 조직 전반에 ChatGPT를 통합했으며, 1,400개 이상의 맞춤형 GPT를 배포하여 제조, 영업 및 마케팅 워크플로를 가속화했습니다.
OpenAI SimpleQA 벤치마크 릴리스
OpenAI는 최첨단 언어 모델의 사실 정확도와 캘리브레이션을 평가하기 위해 4,326개의 짧은 사실 탐색 질문으로 구성된 오픈소스 벤치마크인 SimpleQA를 공개했습니다.
OpenAI와 함께하는 Decagon 고객 지원 자동화
Decagon은 GPT-3.5, GPT-4 및 o1-mini를 포함한 다중 모델 전략을 활용하여 기업 고객의 전 세계 지원을 최대 91%까지 자동화합니다.
범용 보조 생성: 모든 어시스턴트 모델을 활용한 빠른 디코딩
Hugging Face와 Intel Labs는 Universal Assisted Generation (UAG)을 도입했습니다. 이 방법은 토크나이저와 무관하게 어떤 작은 모델이든 어시스턴트로 활용할 수 있게 하여 LLM 추론 속도를 1.5배~2.0배 가속화합니다.
Digital Green Farmer.chat: LLM-as-a-Judge로 RAG 강화
Digital Green은 Farmer.chat(리트리벌-증강 생성 기반 농업 챗봇)을 위해 LLM-as-a-judge 평가 프레임워크를 구현하여 RAG 정확성을 객관적으로 측정하고 34만 건의 질의에 걸쳐 모델 선택을 최적화했습니다.
Aya Expanse 출시: 다국어 LLM 성능 향상
Hugging Face와 Cohere For AI가 8B와 32B 오픈-웨이트 모델군인 Aya Expanse를 출시했으며, 이는 다국어 성능에 대한 새로운 최첨단 벤치마크를 설정했습니다.
연속 시간 일관성 모델을 단순화하고, 안정화하며, 확장하기
OpenAI는 연속 시간 일관성 모델을 단순화한 sCM을 소개합니다. 이 모델은 단 두 번의 샘플링 단계만으로 확산 수준의 샘플 품질을 달성하며, 생성 속도를 약 50배 가속합니다.
HUGS 출시: 무구성, 하드웨어 최적화 추론을 위한 오픈 LLM
Hugging Face는 무구성, 하드웨어 최적화 추론 서비스인 HUGS를 출시했습니다. 이 서비스는 NVIDIA, AMD, 그리고 곧 AWS Inferentia와 Google TPU에서 실행되며, 기업이 OpenAI 호환 API를 통해 모델을 사내에 호스팅할 수 있게 합니다.
CinePile 2.0 릴리스: 적대적 정제가 비디오 QA 데이터셋 품질을 향상시킵니다
CinePile 2.0은 약한 QA 쌍을 시각‑종속 질문으로 업그레이드하는 적대적 정제 파이프라인을 도입하여 개선된 데이터셋과 전체 코드를 공개하고, 상업용 및 오픈소스 비디오‑LLM에서 상당한 성능 향상을 보여줍니다.
Transformers v4.46.0에서 SynthID Text 통합
Google DeepMind와 Hugging Face가 SynthID Text를 Transformers v4.46.0에 통합하여, AI 생성 텍스트에 눈에 띄지 않는 워터마크를 적용하고 훈련된 분류기로 탐지할 수 있는 방법을 제공했습니다.
OpenAI와 Microsoft, Lenfest Institute와 AI 협업 및 펠로우십 프로그램 파트너십 체결
OpenAI와 Microsoft는 Lenfest Institute for Journalism과 파트너십을 맺어 지역 뉴스룸이 비즈니스 지속 가능성과 혁신을 위해 AI를 구현할 수 있도록 1천만 달러의 자금 및 크레딧을 제공합니다.
Hugging Face Inference Endpoints에서 Speech-to-Speech 배포
Hugging Face는 높은 계산 요구량을 처리하고 지연 시간을 줄이기 위해 Inference Endpoints에서 커스텀 Docker 이미지를 사용해 Speech-to-Speech (S2S) 파이프라인을 배포하는 가이드를 제공합니다.
Outlines-core 0.1.0 릴리즈 노트 / 새로운 소식
Hugging Face와 dottxt가 구조화된 생성을 위한 Outlines 핵심 알고리즘을 Rust로 포팅한 `outlines-core` 0.1.0을 출시했으며, 인덱스 컴파일 속도와 이식성을 향상시켰습니다.
Stable Diffusion 3.5 Large와 Diffusers 통합
Hugging Face는 표준 및 타임스텝-디스틸 버전으로 제공되는 8B 파라미터 모델인 Stable Diffusion 3.5 Large를 Diffusers 라이브러리에 통합했습니다.
Hugging Face, Protect AI와 파트너십을 맺어 모델 보안을 위한 Guardian 스캐너를 추가
Hugging Face는 Protect AI와 파트너십을 맺어 Guardian 스캐너를 Hub에 통합했으며, 위험한 모델 직렬화 악용을 자동으로 감지하고 전체 ML 커뮤니티의 보안을 향상시킵니다.
Transformers.js v3 릴리스, WebGPU 가속, 확장된 모델 지원 및 서버‑사이드 JavaScript 호환성 추가
Transformers.js v3는 WebGPU 가속, 새로운 양자화 포맷, 120개의 모델 아키텍처 지원, 그리고 Node.js/Deno/Bun과의 호환성을 추가하여 브라우저와 JavaScript 런타임에서 빠른 온‑디바이스 추론을 가능하게 합니다.
Keras에서 Llama 3.2
Llama 3.2는 keras‑hub를 통해 Keras에서 완전히 지원되며, 사용자는 Hugging Face 체크포인트를 로드하고 모델을 JAX, PyTorch 또는 TensorFlow 백엔드에서 실행할 수 있습니다.
Hugging Face Transformers Gradient Accumulation 수정
Hugging Face는 Transformers Trainer를 업데이트하여 손실을 배치 간에 평균하는 방식을 수정함으로써 gradient accumulation이 전체 배치 학습과 수학적으로 동등하도록 보장했습니다.
OpenAI ChatGPT 연구에서 공정성 평가 요약
OpenAI의 연구에 따르면 이름 기반의 유해한 고정관념은 ChatGPT 응답의 0.1% 미만에서 나타나며, 전체 답변 품질은 성별 및 인종 이름 단서에 관계없이 일관적입니다.
OpenAI MLE-bench: 머신러닝 엔지니어링에서 머신러닝 에이전트 평가
OpenAI는 75개의 Kaggle 대회를 활용하여 AI 에이전트의 머신러닝 엔지니어링 역량을 측정하는 벤치마크인 MLE-bench를 소개했으며, o1-preview는 과제의 16.9%에서 브론즈 메달 수준을 달성했습니다.
Gradio 5 보안 검토
Hugging Face는 Trail of Bits와 함께 Gradio 5에 대한 포괄적인 보안 감사를 수행했으며, 식별된 모든 취약점을 수정하여 머신러닝 애플리케이션이 기본적으로 안전하도록 보장했습니다.
AMD EPYC Turin CPU가 Genoa 대비 2배 LLM 추론 처리량을 제공
AMD의 5세대 EPYC Turin CPU는 Genoa에 비해 LLM 추론 처리량을 대략 두 배로 제공하여 Hugging Face 작업에서 낮은 지연 시간과 높은 처리량을 가능하게 합니다.
Hugging Face와 Dask를 활용한 AI 데이터 처리 확장
Hugging Face와 Dask를 활용하면 분산 컴퓨팅과 멀티‑GPU 병렬 추론을 통해 작은 로컬 샘플에서 수억 행에 이르는 AI 기반 데이터 처리를 확장할 수 있습니다.
Gradio 5 릴리스 노트
Hugging Face는 Python을 사용해 성능이 뛰어나고 확장 가능하며 안전한 머신러닝 웹 애플리케이션을 구축할 수 있는 프로덕션 준비 프레임워크인 Gradio 5를 출시했습니다.
OpenAI와 Hearst 콘텐츠 파트너십
OpenAI는 Hearst와 파트너십을 맺어 20개 이상의 잡지 브랜드와 40개 이상의 신문의 콘텐츠를 ChatGPT를 포함한 AI 제품에 통합함으로써 사용자에게 보다 신뢰할 수 있고 출처가 명시된 저널리즘을 제공하고 있습니다.
Hugging Face Transformers 4.45.0 동적 추측 디코딩
Hugging Face와 Intel Labs는 Transformers 4.45.0에 동적 추측 디코딩을 도입했으며, 모델 신뢰도에 따라 초안 토큰 수를 동적으로 조정함으로써 텍스트 생성 속도를 최대 2.7배 가속합니다.
Hugging Face Hub에서 Parquet 중복 제거 개선
Hugging Face는 저장소 아키텍처를 최적화하여 Parquet 파일 중복 제거를 개선하고, 데이터셋 업데이트 시 저장 오버헤드를 줄이기 위해 콘텐츠 기반 행 그룹을 제안하고 있습니다.
Open FinLLM 리더보드 출시 – 금융 언어 모델을 위한 포괄적인 제로샷 벤치마크
Hugging Face가 Open FinLLM Leaderboard를 출시했습니다. 이 제로샷 벤치마크는 7개 카테고리의 40개 금융 전용 과제를 포괄하여 LLM이 실제 금융 애플리케이션에 얼마나 준비되어 있는지를 평가합니다.
OpenAI Canvas 베타 출시: ChatGPT를 위한 협업 글쓰기 및 코딩 인터페이스
OpenAI는 Canvas라는 베타 인터페이스를 도입했으며, 이를 통해 ChatGPT가 인라인 편집, 버전 관리 및 특수 단축키를 활용해 글쓰기와 코딩 프로젝트에 협업할 수 있게 되었습니다. 초기에는 Plus 및 Team 사용자에게 제공됩니다.
OpenAI, 재정 유연성을 위한 40억 달러 신용 시설 설립
OpenAI는 유동성을 높이고 AI 연구 및 인프라 확장을 지원하기 위해 글로벌 은행 컨소시엄과 함께 40억 달러 규모의 순환 신용 시설을 설립했습니다.
중국 AI 글로벌 확장 분석
중국 AI 기업들은 국내 시장 포화, 치열한 가격 전쟁, 규제 압박으로 인해 국제 확장을 가속화하고 있으며, 동남아시아, 중동, 서구 소비자 시장을 목표로 하고 있습니다.
OpenAI 자금 발표 2024년 10월
OpenAI는 최첨단 AI 연구를 가속화하고 컴퓨팅 용량을 늘리기 위해 사후 가치 1,570억 달러에서 66억 달러의 새로운 자금을 조달했습니다.
OpenAI 실시간 API 출시
OpenAI는 공개 베타에서 실시간 API를 출시하여 개발자들이 GPT-4o를 사용해 저지연, 다중모달 음성‑음성 경험을 구축할 수 있게 했습니다.
GPT-4o 비전 파인튜닝 API 출시
OpenAI는 GPT-4o에 대한 비전 파인튜닝을 도입하여 개발자들이 이미지-텍스트 데이터셋으로 모델을 맞춤화하고, 특화된 시각 이해 및 객체 탐지를 향상시킬 수 있게 했습니다.
OpenAI 프롬프트 캐싱 API 출시
OpenAI는 GPT-4o, GPT-4o mini, o1-preview 및 o1-mini에 대해 프롬프트 캐싱을 도입했으며, 재사용되는 입력 토큰에 대해 50% 할인과 지연 시간 감소를 제공합니다.
OpenAI 모델 증류 API 통합
OpenAI는 o1-preview 및 GPT-4o와 같은 최첨단 모델의 출력을 사용하여 GPT-4o mini와 같은 소형 모델을 미세 조정하고 성능을 향상시킬 수 있도록 통합된 모델 증류 스위트를 도입했습니다.
OpenAI와 Altera: GPT-4o를 활용한 협업 디지털 휴먼 만들기
Altera는 GPT-4o를 기반으로 하는 뇌 영감 아키텍처를 활용해, Minecraft와 같은 환경에서 사람과 협업할 수 있는 디지털 휴먼이라는 자율 AI 에이전트를 개발했습니다.
BenCzechMark: 체코어 LLM을 위한 포괄적인 평가 스위트
Hugging Face와 학계 파트너가 체코어 모델을 위한 최초의 포괄적인 평가 스위트인 BenCzechMark를 출시했습니다. 9개 카테고리에 걸친 50개의 작업과 새로운 듀얼 기반 점수 메커니즘을 특징으로 합니다.
OpenAI, STORM-0817 이란 연계 악성코드 활동 차단
OpenAI는 이란 기반 위협 행위자 STORM-0817이 Android 악성코드를 개발하고, Instagram 프로필을 스크랩하며, 파키스탄 사이버 보안 전문가들을 정찰하는 데 사용한 계정을 비활성화했습니다.
OpenAI, SweetSpecter의 중국 연계 사이버 활동 차단
OpenAI는 중국 기반 적인 SweetSpecter와 연계된 계정을 식별하고 차단했으며, 이 적은 ChatGPT를 공격적인 사이버 작전에 활용하려 시도하고 OpenAI 직원들을 스피어 피싱 공격으로 표적 삼았습니다.
OpenAI 조사: 가짜 러시아 트롤 오류 메시지 사기
OpenAI는 러시아 트롤 계정의 GPT-4o 오류 메시지를 폭로한다는 바이럴 게시물을 반박했으며, 이 사건이 미국에서 시작된 것으로 보이는 수작업 사기였음을 밝혔습니다.
OpenAI, 이란 연계 사이버 연구 활동을 수행하는 CyberAv3ngers 차단
OpenAI는 이란 연계 위협 행위자 CyberAv3ngers와 연결된 계정을 차단했습니다. 이들은 산업 제어 시스템을 표적으로 정찰, 코드 디버깅 및 취약점 연구에 LLM을 사용했습니다.
OpenAI, Stop News 러시아 영향력 활동 차단
OpenAI는 러시아 출신 영향력 작전인 Stop News가 사용한 ChatGPT 계정 클러스터를 차단했습니다. 이 작전은 AI 생성 텍스트와 이미지를 활용해 뉴스 매체를 흉내 내고 기만적인 파트너십을 구축했습니다.
OpenAI가 Operation A2Z 다국어 영향 활동을 방해함
OpenAI는 API를 이용해 다국어 영향 작전인 Operation A2Z를 수행하던 계정 클러스터를 차단했습니다. 이 작전은 AI를 활용해 가짜 페르소나를 관리하고 X와 Facebook에서 정치 콘텐츠를 생성했습니다.
OpenAI, Bet Bot 도박 스팸 네트워크 차단
OpenAI는 이스라엘 기반 스타트업을 통해 API를 사용해 X에서 도박 스팸 네트워크를 운영한 일련의 계정을 차단했으며, AI 생성 페르소나를 이용해 사용자를 도박 사이트로 유인했습니다.
OpenAI가 STORM-2035 이란 영향력 활동을 차단
OpenAI는 이란 출신 행위자(Storm-2035) 가 사용한 ChatGPT 계정을 차단하여, 미국 선거 및 기타 전 세계 정치 이슈를 목표로 하는 기만적인 장문 기사와 소셜 미디어 댓글을 생성하는 것을 막았습니다.
OpenAI, 르완다 선거 정치 댓글 네트워크를 차단
OpenAI는 르완다에서 선거 관련 편향된 콘텐츠를 생성하고 대량 댓글 스팸을 통해 X 트렌드를 조작하려는 ChatGPT 계정 네트워크를 차단했습니다.
OpenAI 토트 보고서: 남용 신고 활동 방해
OpenAI는 'Tort Report'에 연루된 계정을 차단했으며, 이는 AI를 사용해 페이스북과 유튜브의 독립 베트남 언론 매체에 대한 일반적인 신고를 생성한 카테고리 1 영향력 작전입니다.