AI & Frontier Tech Roundup – Agentic Models, Free Cloud Inference, and New Robotics Benchmarks
TL;DR – 에이전트형 AI 출시(Claude Code 2.1.228, Grok Bot, Nemotron 3.5 Lightning)와 무료 클라우드 추론 옵션(DeepSeek V4 Flash, Qwen 3.6)의 물결이 채팅형 어시스턴트에서 상시 가동되는 도구 호출 에이전트로의 전환을 가속화하고 있으며, 새로운 로봇 데이터셋(Dyna-2)과 오픈 소스 에이전트 모델(Smaug-Agentic, Ling-3.0-tiny)이 Embodied AI를 진전시키고 있습니다.
Claude Code 2.1.228 – 강화된 CLI 기술
Claude Code 2.1.228은 보안을 강화하고 검색 속도를 개선하는 18가지 CLI 변경 사항과 함께 출시되었습니다. 이제 로컬 명령이 동기화된 기술보다 우선시되어 의도치 않은 덮어쓰기를 방지하며, grep 명령은 더 빠른 프로젝트 전역 검색을 위해 ripgrep을 사용합니다 @ClaudeCodeLog.
Grok Bot – 상시 가동되는 AI 팀원
SpaceXAI가 전용 컴퓨터에서 실행되며 사용자가 자리를 비운 동안에도 작업을 계속하는 지속적인 AI 에이전트 제품군인 Grok Bot을 공개했습니다. 이 봇들은 앱을 넘나들며 작동하고, 다단계 작업을 처리하며, 서로 메시지를 주고받고, 시간이 지남에 따라 사용자 선호도를 학습할 수 있습니다 @pengzheng_@poteto@cb_doge@haider1. 이번 출시는 대화형 코딩 어시스턴트에서 캘린더 관리, 코드 배포, 심지어 점심 주문까지 가능한 "에이전트 팀"으로의 전환을 목표로 합니다.
NVIDIA Nemotron 3.5 Lightning – 고처리량 에이전트 모델
NVIDIA는 상시 가동되는 에이전트를 위해 설계된 3B 활성 파라미터를 가진 30B MoE 모델인 Nemotron 3.5 Lightning를 발표했습니다. 이 모델은 Jetson AGX Thor에서 약 115 tokens/s를 제공하며 Ollama, LM Studio, OpenRouter 및 NVIDIA의 NeMo Switchyard와 같은 플랫폼에서 오픈 웨이트로 사용할 수 있습니다 @NVIDIARobotics@ollama@nvidia@lmstudio@sudoingX@OpenRouter. 벤치마크에 따르면 에이전트 워크로드에서 최대 4배 높은 처리량과 30% 빠른 작업 완료를 보여줍니다.
AMD의 무료 클라우드 추론 – DeepSeek V4 Flash & Qwen 3.6
AMD의 Token Factory는 DeepSeek V4 Flash, Qwen 3.6 35B, MiniCPM 5, MiniCPM-V46에 대해 매일 $10 한도 내에서 무료 일일 사용량을 제공하며, 매일 초기화됩니다 @slash1sol@zefirium. 이러한 움직임은 개발자를 특정 실리콘 생태계로 유도하기 위해 추론 크레딧을 제공하는 NVIDIA의 전략을 반영합니다.
인간 영상을 통한 로보틱스 스케일링 – Dyna-2
Dyna-2는 100만 시간 이상의 인간 영상을 사전 학습하는 것이 보지 못한 작업에 대해서도 로봇 작업 성능을 향상시킨다는 것을 보여줍니다. 이 데이터셋은 데이터가 1천 시간에서 100만 시간으로 확장됨에 따라 더 나은 일반화 성능을 보여주며, 소프트웨어 규모의 로보틱스를 향한 경로를 제시합니다 @Logical_Girll@Lindon_Gao@RoboStrategy.
Gemini 4 유출 – 에이전트를 위한 야심 찬 로드맵
유출된 정보에 따르면 Gemini 4는 추론, 코딩, 자율 에이전트 및 장기 실행 작업에 초점을 맞추어 8월 말 또는 9월 초 출시를 목표로 사전 학습 중입니다 @vepsi__@pankajkumar_dev@ZypherHQ. 로드맵은 현재의 최상위 모델들을 뛰어넘을 잠재력을 주장하지만, 성능 주장은 아직 검증되지 않았습니다.
오픈 소스 에이전트 모델 – Smaug-Agentic & Ling-3.0-tiny
에이전트 코딩을 겨냥한 두 가지 주목할 만한 오픈 소스 릴리스가 있습니다:
- Smaug-Agentic은 Kimi K3를 기반으로 하며 에이전트 코딩을 개선하여 오픈 소스 리더보드에서 Claude Opus 5 바로 아래에 위치합니다 @bindureddy@bindureddy.
- Ling-3.0-tiny는 추론, 도구 사용 및 에이전트 작업에 최적화된 7.9B 모델(활성 1.3B)로, DGX Spark에서 100tok/s, M4 Pro MacBook에서 90tok/s의 처리량을 제공합니다 @TeksEdge.
Unsloth Desktop – 로컬 학습 및 추론 허브
Unsloth Desktop은 macOS, Windows, Linux에서 로컬로 모델을 실행하고 학습할 수 있는 오픈 소스 데스크톱 앱을 제공합니다. MLX, diffusion, audio, GFUF를 지원하며 OpenAI 호환 API를 통해 Claude Code 및 Codex와 통합됩니다 @UnslothAI.
검색 엔지니어링 – 에이전트 속도 향상시키기
5개의 엔지니어링 팀(Uber, Anthropic, Dropbox, Microsoft, Cursor)이 적은 비용으로 검색 실패를 35% 줄이는 구체적인 검색 레이어 개선 사항을 공유하며, 스마트한 인덱싱이 모델 스케일링만보다 에이전트 성능을 더 높일 수 있음을 입증했습니다 @undefinedKi.
멀티 에이전트 시스템을 위한 지식 그래프 루프
Anthropic의 한 엔지니어가 Claude의 SDK, 샌드박스 도구 실행 및 자동 "꿈꾸기"(로그 기반 모델 재생)를 사용하여 멀티 에이전트 루프를 위한 지식 그래프를 구축하는 워크플로우를 상세히 설명하여 에이전트 추론을 가속화하고 실패 비용을 줄이는 방법을 공개했습니다 @0xCodila.
금융 및 연구 분야의 에이전트 자동화
- Prodigy Research는 자사의 파운데이션 모델이 퀀트 금융에서 Claude Fable 및 GPT-5.6 Sol보다 뛰어난 성능을 보이며 YC 배치 기간 동안 100% 이상의 실질 수익을 달성했다고 주장합니다 @michaelwangelo.
- Citadel 스타일의 AI 연구 파이프라인은 이제 자율 AI 에이전트를 사용하여 6
8주 분량의 학술 금융 연구를 23시간으로 압축합니다 @MrFamilyOffice.
신흥 에이전트 경제 플랫폼
SolAgents V1이 Solana에서 출시되어 거래, 수익 창출 및 평판 구축이 가능한 AI 에이전트 마켓플레이스를 제공하며, 최초의 운영 가능한 "에이전트 경제"의 신호를 보냈습니다 @EleZeus_MIMA.
브라우저 기반 액션 에이전트
ARCTERMINAL 브라우저 자동화 플랫폼은 AI 에이전트(ANIMA)가 웹 환경 전반에서 작업을 수행할 수 있도록 하여, AI를 설명에서 실행의 단계로 이동시킵니다 @cryptohouse0x.
모든 항목은 원본 X 게시물을 인용한 것이며, 추가적인 주장은 포함되지 않았습니다.
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch