메타 Muse, 초기 사용자 지표서 ChatGPT 상회; AWS Strands 에이전트, 운영 비용 28% 절감 제시; AI 스팸 사례도 보고

메타의 새로운 AI 애플리케이션 Muse가 초기 시장 진입에서 상당한 사용자 유입을 기록하며 주요 지표에서 ChatGPT를 상회했다. 아마존 웹 서비스(AWS)는 AI 에이전트 개발 및 배포 효율성을 높이는 Strands harness를 공개하며 운영 비용 절감 효과를 제시했다. 이와 동시에, AI 에이전트를 활용한 무단 계정 생성 및 스팸 발생 사례가 보고되면서 AI 기술의 윤리적 배포에 대한 논의가 부상하고 있다. … 더 읽기

NVIDIA BioIR, 4,777개 프로테옴 분석 가속; Redis LangCache, LLM 비용 90% 절감 및 15배 속도 향상

NVIDIA가 생체 분자 구조 예측 워크플로우 가속화를 위한 BioNeMo Inference Runtime (BioIR) 라이브러리를 공개했다. 동시에 Redis는 대규모 언어 모델(LLM) 애플리케이션의 비용 및 응답 속도를 최적화하는 LangCache를 선보이며 AI 모델 배포 및 운영 효율성 증대에 중점을 둔 솔루션들을 제시했다. 핵심 기술 사양 및 성능 분석 NVIDIA BioNeMo Inference Runtime (BioIR)은 단일 타겟을 넘어 프로테옴 규모의 생체 … 더 읽기

OpenAI, ChatGPT Images 2.5 발표로 이미지 생성 지연시간 최대 50% 단축

OpenAI는 최근 자사의 최신 이미지 모델인 ChatGPT Images 2.5를 발표하며, 동시에 두 가지 보조 모델을 API에 추가했습니다. OpenAI에 따르면, 현재 ChatGPT Images 및 GPT-Image API 모델을 통해 매주 30억 개 이상의 이미지가 생성되고 있습니다. 핵심 기술 사양 및 성능 분석 ChatGPT Images 2.5는 이전 버전에 비해 이미지 생성 능력과 효율성에서 개선을 보였습니다. 이미지 생성 지연 … 더 읽기

폴렌 로보틱스, 399달러 이족보행 로봇 ‘마이크로덕’ 사전 주문 개시: 공개 학습 루프 특징

프랑스 보르도에 본사를 둔 폴렌 로보틱스(Pollen Robotics)는 최근 399달러의 이족보행 로봇 ‘마이크로덕(Microduck)’의 사전 주문을 시작했다. 이 25cm 크기의 로봇은 걷기, 앉기, 차기, 롤러 스케이팅, 낙상 후 스스로 일어서기 등 모든 동작이 물리 시뮬레이터에서 훈련된 신경 정책을 통해 제어된다. 학습 환경, 보상 함수, 도메인 무작위화 설정, 심투리얼(sim-to-real) 레시피 등 훈련 과정이 GitHub에 공개되어 로봇 개발의 접근성을 … 더 읽기

Z.ai, 멀티모달 코딩 모델 GLM-5.3-Flash 출시: 성능 및 비용 효율성 개선

Z.ai는 GLM-5 시리즈의 첫 네이티브 멀티모달 모델인 GLM-5.3-Flash를 공개했다. 이 모델은 기존 GLM-5.2 대비 벤치마크 및 실제 워크로드에서 성능 우위를 기록했으며, 비용은 약 10분의 1 수준으로 책정되었다. 100만 토큰 이상의 컨텍스트 윈도우를 지원하며 이미지 및 비디오 입력 기능을 탑재했다. 핵심 기술 사양 및 성능 분석 GLM-5.3-Flash는 효율성 극대화를 위해 Mixture-of-experts (MoE) 아키텍처를 기반으로 설계되었다. 모델 … 더 읽기