아카이브 · 연구소 11곳 · 디스패치 3,060건

연구소

매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.

2401

Hugging Face Open LLM Leaderboard DROP 벤치마크 분석

Hugging Face는 정규화와 종료 토큰 설정의 결함으로 대부분의 모델이 잘못 낮은 점수를 받게 된 것을 발견한 후, DROP 벤치마크를 Open LLM Leaderboard에서 제거했습니다.

2402

OpenAI 리더십 업데이트: Sam Altman이 CEO로 복귀

Sam Altman이 OpenAI의 CEO로 복귀했으며, 새로운 초기 이사회와 기업 거버넌스 강화를 위한 약속에 의해 지원받고 있습니다.

2403

Claude 2.1 출시 노트

Anthropic은 200K 토큰 컨텍스트 창, 환각률 2배 감소, 그리고 새로운 도구 사용 베타 기능을 특징으로 하는 Claude 2.1을 출시했습니다.

2404

OpenAI 리더십 전환: Mira Murati 임시 CEO 임명

OpenAI는 Sam Altman이 떠난 후 Mira Murati를 임시 CEO로 임명했습니다. Sam Altman은 CEO 역할과 이사회 모두를 떠났습니다.

2405

OpenAI 데이터 파트너십

OpenAI는 조직과 협력하여 공개 및 비공개 데이터셋을 만들어 AI 모델 학습에 사용함으로써 도메인별 이해를 향상시키고 AGI를 향해 나아가기 위해 Data Partnerships 프로그램을 출시했습니다.

2406

SDXL과 Stable Diffusion을 위한 Latent Consistency LoRAs 기반 빠른 추론

Hugging Face는 SDXL과 Stable Diffusion 모델에서 4~8 단계로 고품질 이미지 생성을 가능하게 하는 LCM LoRAs라는 방법을 도입하여 추론 시간을 크게 줄였습니다.

2407

Prodigy-HF 통합 릴리스 노트

Explosion은 주석이 달린 데이터에서 Hugging Face 트랜스포머 모델을 직접 미세 조정하고 Hugging Face Hub에 데이터셋을 직접 업로드할 수 있는 플러그인인 Prodigy-HF를 출시했습니다.

2408

optimum-neuron을 사용하여 AWS Inferentia2에서 Llama 2 배포하기

Hugging Face는 optimum-neuron과 AWS Neuron SDK를 통합하여 AWS Inferentia2 가속기에서 Llama 2 모델을 배포하여 고성능 텍스트 생성을 가능하게 했습니다.

2409

LoRA를 사용한 재난 트윗 분류에서 RoBERTa, Llama 2, Mistral 비교

비교 연구에서 LoRA를 사용한 미세 조정을 통해 더 작은 RoBERTa 모델이 재난 트윗의 이진 분류에서 Llama 2와 Mistral 7B보다 성능이 우수함을 보여준다.

2410

OpenAI GPTs 소개

OpenAI는 사용자가 코딩 없이 특정 목적을 위해 만들 수 있는 ChatGPT의 맞춤형 버전인 GPTs를 출시하여 개인, 전문가 또는 기업용 맞춤형 AI 어시스턴트를 가능하게 했습니다.

2411

OpenAI DevDay 2023: GPT-4 Turbo, Assistants API, 및 멀티모달 업데이트

OpenAI는 128K 컨텍스트 윈도우를 갖춘 GPT-4 Turbo, 에이전트와 같은 경험을 위한 새로운 Assistants API, 그리고 DALL·E 3와 TTS를 포함한 확장된 멀티모달 기능을 발표했습니다.

2412

xAI PromptIDE 발표

xAI는 Grok-1 모델을 위한 프롬프트 엔지니어링 및 해석 가능성 연구를 가속화하기 위해 설계된 통합 개발 환경 및 SDK인 PromptIDE를 출시했습니다.

2413

Anthropic의 미국 행정명령, G7 행동 강령 및 Bletchley Park 정상회의 분석

Anthropic은 2023년 4분기 AI 정책의 세 가지 주요 이정표: 미국 AI 행정명령, G7 국제 행동 강령, 그리고 Bletchley 선언을 지원한다는 입장을 밝힙니다.

2414

Hugging Face 허브 스토리지 지역

허깅 페이스는 Enterprise Hub 고객을 위해 Storage Regions을 도입하여, 조직이 모델과 데이터셋을 저장할 위치를 선택하여 규제 준수 및 데이터 전송 성능을 향상시킬 수 있도록 했습니다.

2415

xAI 그록 릴리스 노트

xAI는 X 플랫폼을 통해 실시간 세계 지식을 갖춘 그록-1 LLM으로 구동되는 AI 어시스턴트인 그록을 발표했습니다. 그록은 *해치하이커의 안내서*를 모델로 삼아 개성 있는 성격을 지녔습니다.

2416

앤트로픽 책임 있는 규모 확장 정책(RSP) 프레임워크

앤트로픽은 AI 안전 수준(ASL)을 사용하여 AI 모델이 위험한 능력을 갖추게 되면 특정 안전 보호 조치를 발동하는 책임 있는 규모 확장 정책(RSP)을 도입했습니다.

2417

개인용 코파일럿: 나만의 코딩 어시스턴트 훈련하기

Hugging Face는 특정 코드베이스에 StarCoder를 QLoRA와 전체 미세 조정 기법을 사용하여 미세 조정함으로써 맞춤형 코딩 어시스턴트인 HugCoder를 만드는 방법을 보여줍니다.

2418

OpenAI 프론티어 리스크 및 준비 프레임워크

OpenAI는 전용 준비 팀과 위험 정보 기반 개발 정책을 설립하여 프론티어 AI 모델과 관련된 재앙적인 위험을 식별, 평가, 완화했습니다.

2419

프론티어 모델 포럼 업데이트

OpenAI, Anthropic, Google, 그리고 Microsoft는 프론티어 모델 포럼의 실행 이사 크리스 메제로레를 임명하고, capaces AI 모델 평가를 위한 연구를 진전시키기 위해 1천만 달러 규모의 AI 안전 기금을 설립했습니다.

2420

확장 가능한 데이터 검사를 위한 Hugging Face와 Renumics Spotlight 통합

Hugging Face는 Renumics Spotlight와 통합하여 ML 데이터셋의 인터랙티브한 한 줄 코드 시각화 및 검사를 가능하게 했으며, 멀티모달 데이터와 모델 결과도 지원합니다.

2421

추론 속도 및 메모리 최적화를 위한 Stable Diffusion XL (SDXL) 최적화

Hugging Face는 Stable Diffusion XL (SDXL)을 위한 여러 최적화 기술을 탐구하며, 메모리 사용량을 28GB에서 최소 11.47GB까지 줄이고 추론 지연 시간을 72.2초에서 약 10.3초까지 단축하는 방법을 보여줍니다.

2422

허깅페이스 인퍼런스 엔드포인트로 임베딩 모델 배포하기

허깅페이스는 인퍼런스 엔드포인트를 통해 Text Embeddings Inference(TEI)를 도입하여 RAG 및 의미 검색을 위한 오픈소스 임베딩 모델을 고성능かつ 비용 효율적으로 배포할 수 있는 방법을 제공합니다.

2423

RLHF와 PPO의 N 구현 세부 사항 – Hugging Face 블로그 요약

Hugging Face 블로그 글은 OpenAI의 2019 RLHF 코드베이스를 재현하고, 학습 곡선을 일치시키며, N가지 구현 세부 사항을 설명합니다. 여기에는 더 공격적인 업데이트를 초래하는 핵심 PyTorch Adam 옵티마이저 차이도 포함됩니다.

2424

Anthropic 연구: Constitutional AI를 위한 구체적 원칙 대 일반적 원칙

Anthropic 연구는 'do what's best for humanity'와 같은 단일 일반 원칙이 광범위한 유해한 행동을 완화할 수 있지만, 상세한 헌법은 특정 AI 유해성에 대해 우수한 미세 제어를 제공한다는 것을 보여줍니다.

2425

Anthropic 연구: 언어 모델의 아첨(Sycophancy) 현상 이해하기

Anthropic 연구원들은 RLHF로 학습된 AI 어시스턴트가 진실성보다 사용자의 신념을 반영하는 경향이 있음을 발견했습니다. 이는 인간의 선호도 판단에 의해 유도되는 '아첨(sycophancy)'이라는 행동입니다.

2426

ChatGPT Plus 및 Enterprise에서의 DALL·E 3 통합

OpenAI는 ChatGPT Plus 및 Enterprise에 DALL·E 3를 통합하여, 시각적 충실도가 높고 프롬프트 준수 능력이 향상되었으며 텍스트, 손, 얼굴 렌더링이 개선된 모델을 도입했습니다.

2427

Gradio-Lite: 브라우저 내에서 완전히 실행되는 서버리스 Gradio

Hugging Face는 웹 브라우저에서 직접 Gradio 애플리케이션을 실행하여 서버 측 인프라의 필요성을 제거하는 Pyodide를 사용하는 JavaScript 라이브러리인 Gradio-Lite (@gradio/lite)를 소개합니다.

2428

집단적 헌법형 AI: 공공의 참여로 언어 모델을 정렬하기

Anthropic와 Collective Intelligence Project는 약 1,000명의 미국 시민이 참여한 공공 헌법을 기반으로 언어 모델을 정렬하는 방법을 개발하여, 기업 내부 헌법에 맞춰 정렬된 모델보다 사회적 편향이 낮은 모델을 만들었다.

2429

클라이언트 사이드 기술을 활용한 LLM 기반 웹 앱 구축하기

Ollama는 브라우저 기반 도구와 로컬 LLM 실행을 위한 Ollama의 조합을 사용하여 완전한 로컬 검색 증강 생성(RAG) 웹 애플리케이션을 구축하는 타당성을 탐구합니다.

2430

Typeform Formless: AI 기반 대화형 데이터 수집

Typeform은 GPT-3.5 Turbo와 GPT-4를 기반으로 한 AI 기반 플랫폼인 Formless를 출시하여 전통적인 폼 구조를 동적인 양방향 대화형 경험으로 대체했습니다.

2431

Ironclad AI Assist GPT-4 통합

Ironclad은 AI Assist를 통해 계약 수명 주기 관리 플랫폼에 GPT-4를 통합하여 초기 계약 레드라인 시간을 40분에서 2분으로 단축했습니다.

2432

Retool AI와 GPT-4 통합

Retool은 GPT-4로 구동되는 기능 모음인 Retool AI를 출시하여, 기업이 시각적 캔버스를 사용하여 맞춤형 AI 기반 애플리케이션과 워크플로를 구축할 수 있도록 지원합니다.

2433

Anthropic 연구: 사전 학습을 통한 언어 모델 분해

Anthropic 연구진은 사전 학습을 활용해 언어 모델 층을 단일 의미적 특징으로 분해하는 방법을 개발하여, 개별 뉴런 수준에서는 보이지 않는 복잡한 신경망 활성화를 해석할 수 있게 했다.

2434

Anthropic 언어 모델을 이해 가능한 구성 요소로 분해하기

Anthropic 연구원들은 사전 학습(dictionary learning)을 사용하여 신경망 활성화를 해석 가능한 특징(features)으로 분해하는 방법을 개발하여, 해석 불가능한 개별 뉴런의 한계를 넘어섰습니다.

2435

Ollama 공식 Docker 이미지 출시

Ollama는 대규모 언어 모델을 로컬에서 간편하게 배포할 수 있도록 공식적인 Docker 후원 오픈 소스 이미지를 출시했습니다.

2436

ONNX Runtime을 사용한 Hugging Face 모델 가속화

Hugging Face와 ONNX Runtime은 130,000개 이상의 모델에 대한 성능 가속을 가능하게 하며, PyTorch와 비교하여 whisper-tiny 모델의 지연 시간이 최대 74.30% 감소하는 것을 포함합니다.

2437

앤트로픽: 인공지능 시스템 평가의 도전 과제

앤트로픽은 견고한 인공지능 평가를 구축하는 데 있어 기술적 및 운영적 어려움을 설명하며, 효과적인 인공지능 거버넌스는 이러한 측정 과제를 극복하는 데 달려 있다고 주장한다.

2438

DALL·E 3 시스템 카드

OpenAI는 DALL·E 3 시스템 카드를 공개했으며, DALL·E 2에 비해 캡션 정확도와 이미지 품질 개선 사항을 상세히 설명하고, 광범위한 안전 평가 및 위험 완화 조치를 함께 제시했습니다.

2439

Hugging Face Chat Templates

Hugging Face는 채팅 모델이 학습 시와 정확히 일치하는 형식으로 입력을 받아 성능 저하가 발생하는 것을 방지하기 위해 Jinja 기반 시스템인 채팅 템플릿을 도입했습니다.

2440

Cloud TPU v5e에서 JAX를 사용하여 Stable Diffusion XL 추론 가속화하기

Hugging Face Diffusers는 이제 Cloud TPU v5e에서 JAX를 사용하여 Stable Diffusion XL (SDXL)을 서빙하는 기능을 지원하며, 이는 TPU v4 대비 달러당 성능을 최대 2.4배 향상시킵니다.

2441

Hugging Face Inference API를 통해 AI Comic Factory 배포하기

Hugging Face는 Inference API를 사용하여 AI Comic Factory의 개인 인스턴스를 배포하는 가이드를 제공하며, Llama-2 및 SDXL 1.0 모델을 활용합니다.

2442

TRL을 통한 DDPO를 이용한 Stable Diffusion 파인튜닝

Hugging Face는 TRL 라이브러리에 Denoising Diffusion Policy Optimization(DDPO)를 통합하여 강화 학습을 사용하여 Stable Diffusion 모델을 인간 선호도에 맞출 수 있게 했습니다.

2443

허깅 페이스 윤리와 사회 업데이트 여름 2023

허깅 페이스는 미국, EU, 영국에서 AI 규제에 영향을 미치기 위한 2023 여름 노력을 상세히 설명했으며, 공공 옹호와 기술 연구를 통해 오픈소스 윤리를 발전시켰습니다.

2444

Hugging Face 가이드: 코드 없이 LLaMA 2 챗봇 훈련하기

Hugging Face는 Spaces, AutoTrain, ChatUI를 사용하는 노코드 워크플로를 제공하여 엔지니어가 아닌 사람들도 LLaMA 2를 미세 조정하고 기능적인 챗 애플리케이션으로 배포할 수 있도록 합니다.

2445

Mistral AI: 오픈 AI 모델을 최전선으로 가져오다

Mistral AI는 13B 파라미터 이하의 다른 오픈 모델을 능가하는 Mistral 7B 출시를 시작으로, 오픈 웨이트 생성형 AI 모델의 혁명을 선도하기 위해 출시되었습니다.

2446

Mistral 7B 릴리스 노트

Mistral AI는 모든 벤치마크에서 Llama 2 13B를 능가하며 Apache 2.0 라이선스 하에 공개된 73억 파라미터 언어 모델인 Mistral 7B를 출시했습니다.

2447

Amazon SageMaker에서의 Llama 2 벤치마크

Hugging Face는 Amazon SageMaker에서의 Llama 2에 대해 60개의 배포 구성을 분석하여 비용, 처리량, 지연 시간에 대한 최적의 설정을 식별했습니다.

2448

GPT-4V(ision) 시스템 카드

OpenAI는 GPT-4의 멀티모달 확장으로서 이미지 입력을 분석하고 처리하여 새로운 작업을 해결하고 새로운 사용자 경험을 제공할 수 있는 GPT-4V(ision)을 도입했습니다.

2449

ChatGPT 음성 및 이미지 기능 업데이트

OpenAI는 ChatGPT에 멀티모달 기능을 도입하여 Plus 및 Enterprise 사용자가 음성 대화를 나누고 이미지를 공유하여 분석할 수 있도록 했습니다.

2450

Anthropic, 아마존으로부터 40억 달러 투자 유치 및 AWS Bedrock를 통한 클로드 2 확장 접근 발표

Anthropic는 아마존으로부터 최대 40억 달러의 투자를 발표하며, AWS를 모델의 주요 클라우드로 지정하고 Amazon Bedrock를 통해 클로드 2의 접근성을 확장하여 기업에 더 안전하고 고성능의 AI를 제공합니다.