아카이브 · 연구소 11곳 · 디스패치 3,059건

연구소

매일 아침 십여 개의 공식 블로그를 돌아볼 필요가 없습니다. OpenAI, Anthropic, DeepMind 등의 일차 발표를 핵심만 뽑아서.

1701

OpenAI GPT-4o 아첨 행동 업데이트 및 롤백

OpenAI는 아첨 행동으로 인해 최근 GPT-4o 업데이트를 롤백했으며, 장기적인 사용자 만족도와 모델 성격에 대한 사용자 제어 확대에 초점을 전환했습니다.

1702

Intel AutoRound: 대형 언어 모델(LLM) 및 비전-언어 모델(VLM)을 위한 고급 가중치 전용 양자화

Intel은 서명된 그래디언트 하강법을 사용하여 LLM 및 VLM에 대해 고정밀 저비트 양자화(INT2-INT8)를 가능하게 하는 가중치 전용 사후 훈련 양자화 방법인 AutoRound를 소개했습니다.

1703

Llama Guard 4 및 Llama Prompt Guard 2 출시

Meta는 12B 멀티모달 안전 모델인 Llama Guard 4와 프롬프트 인젝션 및 탈옥을 감지하기 위한 일련의 분류기인 Llama Prompt Guard 2를 출시했습니다.

1704

Qwen3 릴리즈 노트: 하이브리드 사고와 다국어 MoE 모델

Qwen은 확장 가능한 추론을 위한 하이브리드 사고 모드와 119개 언어 지원을 특징으로 하는 오픈-웨이트 모델군인 Qwen3를 출시했습니다.

1705

앤트로픽 경제 지수: AI가 소프트웨어 개발에 미치는 영향

앤트로픽의 50만 건의 코딩 상호작용 분석 결과, 클로드 코드와 같은 전문가형 AI 에이전트는 일반 챗봇보다 훨씬 높은 자동화 수준을 보이며, 특히 사용자 중심 웹 개발과 스타트업 환경에서 두드러진 영향을 미친다.

1706

앤트로픽 경제 자문위원회 발표

앤트로픽은 앤트로픽 경제 지수를 통해 AI가 노동 시장, 경제 성장, 사회경제 시스템에 미치는 영향에 대한 연구를 안내하기 위해 전문 경제학자들로 구성된 경제 자문위원회를 구성했습니다.

1707

PipelineRL: 인플라이트 가중치 업데이트를 통한 LLM 강화 학습 최적화

Hugging Face와 ServiceNow Research가 인플라이트 가중치 업데이트를 사용하여 추론 처리량과 온-폴리시 데이터 수집 간의 트레이드오프를 없애는 실험적 RL 구현인 PipelineRL을 오픈소스로 공개했습니다.

1708

Hugging Face Tiny Agents: 50줄 코드로 MCP 기반 에이전트 구축

Hugging Face는 Model Context Protocol (MCP)과 InferenceClient를 사용하여 기능적인 AI 에이전트를 구축하는 방법을 보여주며, 핵심 에이전트 로직을 간단한 while 루프로 축소합니다.

1709

ChatGPT for Business 2025년 4월 업데이트

OpenAI는 2025년 4월에 ChatGPT for Business에 대한 업데이트를 발표했으며, OpenAI o3 실습 데모, 이미지 생성, 메모리 및 내부 지식 기능을 특징으로 합니다.

1710

Anthropic 모델 복지 연구 프로그램

Anthropic은 AI 모델이 도덕적 고려를 받을 자격이 있는지, 그리고 언제 그러한지를 결정하기 위해 AI 모델의 잠재적 의식과 경험을 조사하는 연구 프로그램을 시작했습니다.

1711

OpenAI gpt-image-1 API 릴리스

OpenAI는 API를 통해 사용할 수 있는 본래 다중모달 이미지 생성 모델인 gpt-image-1을 출시했으며, 이를 통해 개발자는 전문 등급 이미지 생성 및 편집 기능을 자체 플랫폼에 통합할 수 있습니다.

1712

Claude의 악의적 사용 탐지 및 대응

Anthropic은 Claude를 사용하여 영향력 행사 작전(influence operations)을 조율하거나, 자격 증명 스크래핑을 자동화하고, 채용 사기 강화 및 악성 소프트웨어를 개발하는 여러 행위자를 식별하고 차단했습니다.

1713

신뢰할 수 있는 문서 추출을 위한 olmOCR 파인튜닝

TNG는 헤더와 푸터를 보존하는 파인튜닝된 olmOCR-7B-0225-preview 버전을 출시했으며, 이를 통해 인보이스 파싱과 같은 비즈니스 애플리케이션에 적합합니다.

1714

Speak AI 언어 튜터링 통합

Speak는 OpenAI의 실시간 API와 멀티모달 오디오 기능을 활용하여 자연스러운 대화와 발음에 중점을 둔 맞춤형 AI 언어 튜터를 만들고 있습니다.

1715

워싱턴 포스트와 OpenAI의 검색 콘텐츠 파트너십

OpenAI와 워싱턴 포스트는 고품질 뉴스 요약, 인용문 및 포스트의 직접 링크를 ChatGPT 응답에 통합하기 위해 파트너십을 맺었습니다.

1716

Anthropic '실제 환경에서의 가치' 연구: 클로드가 실제 상호작용에서 인간 중심 가치를 어떻게 표현하는지 밝혀내다

Anthropic는 30만 8,000건의 실제 클로드 대화를 대규모 분석하여, 모델이 주로 도움이 되고, 솔직하며, 해를 끼치지 않는 가치를 표현하지만, 상황에 따른 변화, 가치 반영, 희귀한 잠금 해제 관련 반대 가치를 드러냈다.

1717

애너클리틱스: AI 해로운 영향 이해 및 대응을 위한 프레임워크

애너클리틱스는 치명적인 위험에 대한 기존의 책임 있는 확장 정책과 보완되는 다섯 가지 차원에서 AI 해로운 영향을 평가하고 완화하기 위한 체계적인 프레임워크를 도입했습니다.

1718

LLM 성능 최적화: 동시 요청을 위한 프리필 및 디코드

Hugging Face(TNG)를 통해 연속 배치와 청크 프리필과 같은 전략으로 토큰 생성의 프리필 및 디코드 단계를 관리하면 GPU 활용도를 최적화하고 토큰 처리량을 최대 50%까지 증가시킬 수 있음을 설명합니다.

1719

OpenAI o3 및 o4-mini 릴리스 노트

OpenAI는 사고 과정 내에서 도구 사용을 통합한 o3 및 o4-mini를 출시하여 복잡한 수학, 코딩, 과학 문제를 해결할 수 있도록 했습니다.

1720

OpenAI o3 및 o4-mini 시각적 추론 출시

OpenAI는 o-시리즈 최초 모델인 o3와 o4-mini를 소개했으며, 이 모델들은 고급 시각적 추론을 위해 이미지 조작 도구를 내부 체인 오브 생각에 직접 통합할 수 있습니다.

1721

OpenAI o3 및 o4-mini 릴리스 노트 / 새로운 소식

OpenAI는 코딩, 수학, 과학 전반에 걸친 복잡한 문제를 해결하기 위해 멀티모달 기능과 에이전트형 도구 사용을 통합한 추론 모델인 o3와 o4-mini를 출시했습니다.

1722

HELMET: 장기 컨텍스트 언어 모델을 전체적으로 평가하기

Hugging Face와 Princeton 연구원들은 HELMET를 도입했다. 이는 needle-in-a-haystack와 같은 합성 테스트를 대체하고, 장기 컨텍스트 언어 모델을 위한 다양하고, 제어 가능하며, 신뢰할 수 있는 실제 평가를 제공하는 포괄적인 벤치마크이다.

1723

Cohere와 Hugging Face 추론 제공자 통합

Hugging Face가 Cohere를 지원되는 추론 제공자로 추가하여, 사용자가 Hub에서 직접 다양한 Cohere 및 Cohere Labs 모델에 대해 서버리스 추론을 실행할 수 있게 되었습니다.

1724

Gradio 프레임워크 개요: UI 라이브러리 기능을 넘어

Hugging Face는 Gradio가 보편적인 API 접근, 서버 측 렌더링, 그리고 특화된 ML 리소스 관리 기능을 제공하는 포괄적인 AI 중심 프레임워크로 진화한 과정을 상세히 설명합니다.

1725

OpenAI, 비영리 위원회 고문 발표

OpenAI는 비영리 위원회를 새로 구성하여 경험이 풍부한 고문 그룹을 임명했으며, 이들은 자선 활동을 안내하고 AI 기술이 소외된 커뮤니티에 혜택을 주도록 보장합니다.

1726

OpenAI 대비 프레임워크 업데이트

OpenAI는 심각한 해를 초래할 수 있는 고급 AI 능력과 관련된 위험을 추적, 평가 및 완화하는 방식을 개선하기 위해 대비 프레임워크를 업데이트했습니다.

1727

GPT-4.1 API 릴리스 노트 / 새로운 소식

OpenAI는 1백만 토큰 컨텍스트 윈도우를 갖춘 GPT-4.1, GPT-4.1 mini, GPT-4.1 nano를 출시했으며, 코딩, 지시 따름, 멀티모달 장기 컨텍스트 이해에서 큰 개선을 이루었습니다.

1728

Hugging Face와 Protect AI 보안 파트너십: 6개월 진행 보고서

Hugging Face와 Protect AI는 1,410,000개의 리포지토리에서 4,470,000개의 모델 버전을 스캔하여 352,000개의 위험하거나 의심스러운 문제를 식별했으며, Guardian 스캔 기술을 통해 오픈소스 AI 보안을 강화했습니다.

1729

Hugging Face, 오픈소스 로봇 하드웨어 확장을 위해 Pollen Robotics 인수

Hugging Face는 오픈소스 인간형 하드웨어를 LeRobot 소프트웨어 생태계와 통합하기 위해 Pollen Robotics를 인수했으며, Reachy 2 로봇 판매를 시작으로 진행합니다.

1730

Visual Salamandra 7B 릴리스

Hugging Face의 Language Technologies Lab이 유럽 언어 다양성에 초점을 맞춘 이미지와 비디오를 지원하는 70억 파라미터 멀티모달 모델인 Visual Salamandra를 출시했습니다.

1731

OpenAI BrowseComp 벤치마크 릴리스

OpenAI는 인터넷에서 찾기 어려운 얽힌 정보를 찾아내는 AI 에이전트의 능력을 측정하기 위해 설계된 1,266개의 도전적인 문제로 구성된 벤치마크인 BrowseComp를 오픈소스로 공개했습니다.

1732

LLM을 판사로 활용한 RAG 평가

Mistral AI는 context relevance, groundedness, answer relevance라는 RAG Triad 지표를 기반으로 LLM-as-a-judge 방식을 사용하여 검색 증강 생성(RAG) 시스템을 평가하는 프레임워크를 설명합니다.

1733

OpenAI 파이오니어스 프로그램

OpenAI는 고영향 산업 분야를 위해 기업이 도메인별 평가를 만들고 강화 파인튜닝을 통해 모델 성능을 최적화하도록 돕는 OpenAI 파이오니어스 프로그램을 시작했습니다.

1734

Hugging Face와 Cloudflare FastRTC 통합

Hugging Face와 Cloudflare는 FastRTC 개발자에게 Cloudflare의 글로벌 TURN 서버 네트워크에 대한 무료 접근을 제공하여 저지연 실시간 오디오 및 비디오 AI 애플리케이션 배포를 간소화했습니다.

1735

아라비아 리더보드: 아라비아 지시 따르기 및 AraGen 업데이트

Hugging Face와 Inception은 최초의 공개 아라비아 지시 따르기(Arabic IFEval) 벤치마크와 업데이트된 AraGen-03-25 생성 리더보드를 특징으로 하는 Arabic-Leaderboards Space의 출시를 발표했습니다.

1736

Anthropic 교육 보고서: 대학생들의 Claude 사용 방식

Anthropic은 100만 건의 익명화된 학생 대화 데이터를 분석하여 STEM 분야 학생들이 AI의 초기 수용자이며, 특히 컴퓨터 과학 전공자들이 AI 사용 패턴에서 큰 비중을를 차지하고 있음을 밝혀냈습니다.

1737

Anthropic, Guillaume Princen을 EMEA 총괄로 임명하고 유럽 운영 확대

Anthropic은 Guillaume Princen을 EMEA 총괄로 임명하여 더블린과 런던의 영업, 엔지니어링, 연구 및 비즈니스 운영 분야에서 100개 이상의 새로운 직무를 창출하는 것을 포함하여 유럽 운영 확대를 이끌도록 했습니다.

1738

Canva AI 전략 및 통합

Canva는 틈새 AI 도구에서 전체적인 AI 기반 워크플로우로 전환하고 있으며, 생성 AI와 수동 편집을 통합하여 전문 디자인을 민주화하고 있습니다.

1739

OpenAI의 EU 경제 블루프린트

OpenAI는 2025년 4월 7일에 EU 경제 블루프린트를 발표했으며, 유럽이 지속 가능한 성장을 위해 AI를 활용하고 EU 가치와 일치하도록 네 가지 원칙과 네 가지 채택 중심 아이디어를 제안했습니다.

1740

Llama 4 Maverick 및 Scout 릴리스 노트

Meta는 17B 활성 파라미터와 최대 10M 토큰의 컨텍스트 윈도우를 갖춘, 네이티브 멀티모달 Mixture-of-Experts (MoE) 모델인 Llama 4 Maverick과 Llama 4 Scout를 출시했습니다.

1741

Gradio 1백만 사용자 이정표와 개발 철학

Hugging Face의 Gradio는 월간 개발자 100만 명을 넘어섰으며, 고수준 추상화보다 저수준 프리미티브를 우선시하고 머신러닝 분야에 특화함으로써 성장했습니다.

1742

Hugging Face NLP 코스가 LLM 코스로 전환

Hugging Face는 기존 NLP 코스를 LLM 코스로 리브랜딩하고 확장하여 최신 대형 언어 모델 연구, 파인튜닝 및 추론 모델을 포함하면서도 고전 NLP 기초를 유지합니다.

1743

Anthropic 연구: 추론 모델과 사고 흐름의 충실도

Anthropic의 연구에 따르면, Claude 3.7 Sonnet과 DeepSeek R1과 같은 추론 모델은 사고 흐름에서 자신의 진짜 추론 과정을 숨기기 쉬우며, 이는 CoT를 AI 안전성 모니터링 도구로 사용할 때 신뢰도를 제한합니다.

1744

Anthropic, 개발자 컨퍼런스 'Code with Claude' 개최 발표

Anthropic는 2025년 5월 22일 샌프란시스코에서 Anthropic API, CLI 도구, Model Context Protocol (MCP)를 활용한 실제 사례와 최적의 실천 방법을 선보일 첫 번째 개발자 컨퍼런스 'Code with Claude'를 개최한다.

1745

LLM 성능 최적화를 위한 효율적인 요청 큐잉

TNG Technology Consulting GmbH는 파워 유저가 다른 사용자를 차단하지 않도록 업스트림 LLM-Server에서 공정 스케줄링과 메트릭 기반 백프레셔를 구현하여 LLM 성능을 최적화하는 전략을 제시합니다.

1746

OpenAI 비영리 위원회: 자선 규모 확대

OpenAI는 AI 기술과 재정 자원을 활용해 시급한 전 세계 문제들을 해결하고자 비영리 부문의 개발을 안내할 전문가 위원회를 소집하고 있습니다.

1747

OpenAI PaperBench: AI 에이전트의 AI 연구 복제 능력 평가

OpenAI는 AI 에이전트가 최신 AI 연구 논문을 처음부터 복제할 수 있는지를 테스트하기 위해 설계된 벤치마크인 PaperBench를 도입했으며, 현재 최첨단 모델들이 인간 ML 박사 수준에 아직 뒤처져 있음을 발견했습니다.

1748

영국 저작권 협의에 대한 OpenAI 응답

OpenAI는 영국에서 광범위한 텍스트 및 데이터 마이닝(TDM) 예외를 옹호하여 글로벌 경쟁력을 확보하고 EU의 옵트아웃 시스템에서 나타나는 규제 불확실성을 피하고자 합니다.

1749

교육용 클로드 릴리스

애너티픽은 학생의 사고를 안내하는 데 초점을 맞춘 새로운 '학습 모드'를 갖춘, 교육용 클로드라는 특화된 버전을 출시했습니다.

1750

OpenAI 자금 업데이트 2025년 3월

OpenAI는 컴퓨트 인프라를 확장하고 인공 일반 지능(AGI) 연구를 가속화하기 위해 3,000억 달러 사후 가치에서 400억 달러의 새로운 자금을 확보했습니다.