Devin.KR

GLOBAL TECH RADAR

기술이 바뀌는 순간,
세계 산업을 한눈에.

빅테크 제품 릴리스부터 지역별 산업·정책 소식까지.
출처를 확인하고, 한국어로 맥락을 읽어 보세요.

초기화

지역은 발행 기업·기관의 기반을 기준으로 분류합니다. 해당 지역 산업 전체를 망라하지는 않습니다. 공개된 한국어 기사 최신 30건이며, 피드 수집과 번역·요약에 시간이 걸릴 수 있습니다.

NVIDIA Developer BlogAI 한국어 요약·재구성

NVIDIA, 쿠버네티스 노드 플릿 관리를 위한 오픈소스 솔루션 'NodeWright' 공개

NVIDIA는 쿠버네티스 노드 운영체제를 선언적으로 구성하고 안전하게 업데이트하는 오픈소스 솔루션 'NodeWright'를 발표했다. 이 도구는 워크로드 중단 없이 대규모 호스트 인프라를 관리하며, NVIDIA AI Cluster Runtime(AICR)과 통합되어 AI 워크로드에 최적화된 노드 관리를 지원한다.

원문 발표: 2026-09-24

Meta EngineeringAI 한국어 요약·재구성

메타, 대규모 자원 할당 최적화 라이브러리 '리밸런서' 오픈소스 공개

메타가 지난 9년간 인프라 자원 할당에 활용해 온 라이브러리 '리밸런서'를 아파치 2.0 라이선스로 공개했다. 직관적인 모델링 언어와 표현 그래프, 최적해 및 지역 탐색 솔버를 결합해 대규모 할당 문제를 효율적으로 처리한다.

원문 발표: 2026-09-22

NVIDIA Developer BlogAI 한국어 요약·재구성

NVIDIA NemoClaw 기반 메모리 구동 에이전트: 기업 워크플로우 생산성 향상 방안

NVIDIA NemoClaw를 활용한 메모리 기반 에이전트가 기업 업무 맥락을 유지하고 사용자 의도를 우선시하여 생산성을 높인다. 셀프 모델과 OpenShell을 통해 구조화된 메모리, 사용자 수정, 보안을 강화하며, 특정 작업에서 최대 40%p의 정확도 향상을 보였다.

원문 발표: 2026-09-05

NVIDIA Developer BlogAI 한국어 요약·재구성

중앙 집중식 아이덴티티 게이트웨이 패턴으로 분산형 AI 플랫폼 사용자 인증 간소화

분산된 쿠버네티스 및 AI 플랫폼에서 사용자 아이덴티티를 일관되게 관리하기 위한 중앙 집중식 아이덴티티 게이트웨이 패턴이 소개되었다. 이 패턴은 단일 로그인 경험을 제공하고, 아이덴티티 공급자 부하를 줄이며, AI 어시스턴트의 위임된 아이덴티티 활용을 가능하게 한다.

원문 발표: 2026-09-04

NVIDIA Developer BlogAI 한국어 요약·재구성

NVIDIA Dynamo, 섀도 엔진 복구로 LLM 추론 엔진 장애 복구 시간 대폭 단축

NVIDIA Dynamo의 미리 보기 기능인 섀도 엔진 복구(Shadow Engine Recovery)는 LLM 추론 엔진 프로세스 실패 시 복구 시간을 기존 수분에서 수 초로 단축한다. GPU 메모리 서비스(GMS)를 통해 가중치를 공유하고 미리 초기화된 섀도 엔진을 대기시켜 서비스 중단을 최소화한다.

원문 발표: 2026-08-26

Meta EngineeringAI 한국어 요약·재구성

메타, AI 규모 이더넷을 위한 새로운 RDMA 전송 프로토콜 'MetaRoCE' 공개

메타는 대규모 AI 워크로드를 위해 설계된 새로운 RDMA 전송 프로토콜 MetaRoCE를 발표했다. 이 프로토콜은 엔드포인트에 지능을 배치하여 순서 없는 전달, 다중 경로, 손실 허용 및 양방향 혼잡 제어를 지원하며, OCP를 통해 사양, 참조 구현 및 적합성 테스트 스위트를 공개한다.

원문 발표: 2026-08-25

Qwen (Alibaba)AI 한국어 요약·재구성

Qwen-MT, 92개 언어 지원 및 맞춤형 번역 기능으로 업데이트

Qwen-MT(qwen-mt-turbo)가 Qwen API를 통해 업데이트되어 92개 언어 지원, 용어 개입, 도메인 프롬프트 등 맞춤형 번역 기능을 제공한다. 경량 MoE 아키텍처로 낮은 지연 시간과 비용 효율성을 달성하며, GPT-4.1 등 최첨단 모델과 경쟁하는 번역 품질을 선보인다.

원문 발표: 2025-07-24

Qwen (Alibaba)AI 한국어 요약·재구성

Qwen3 임베딩 시리즈, 기반 모델 기반 텍스트 임베딩 및 재순위화 성능 향상

Qwen 모델 제품군이 Qwen3 기반 모델을 활용한 텍스트 임베딩 및 재순위화 모델인 Qwen3 임베딩 시리즈를 공개했다. 0.6B~8B 크기로 다국어 및 교차 언어 지원, 사용자 정의 지침 기능을 제공하며, 여러 벤치마크에서 최첨단 성능을 달성했다. 아파치 2.0 라이선스로 오픈소스화되어 개발자 활용이 기대된다.

원문 발표: 2025-06-05

Qwen (Alibaba)AI 한국어 요약·재구성

알리바바 클라우드, 시각 추론 모델 QVQ-Max 공식 출시: 이미지·비디오 이해 넘어 문제 해결 능력 강화

알리바바 클라우드가 시각 추론 모델 QVQ-Max의 첫 공식 버전을 출시했다. 이 모델은 이미지와 비디오 콘텐츠를 이해하고 분석하며 추론하여 수학, 코딩, 예술 창작 등 다양한 분야의 문제 해결책을 제공한다. 상세 관찰, 심층 추론, 유연한 적용 능력을 통해 업무, 학습, 일상생활 전반에서 활용될 수 있다.

원문 발표: 2025-03-28

Qwen (Alibaba)AI 한국어 요약·재구성

Qwen2.5-Omni 공개: 실시간 멀티모달 상호작용을 위한 종단간 모델

Qwen 개발팀이 텍스트, 이미지, 오디오, 비디오를 처리하고 실시간 텍스트 및 음성 응답을 제공하는 플래그십 멀티모달 모델 Qwen2.5-Omni를 공개했다. Thinker-Talker 아키텍처와 TMRoPE를 도입하여 포괄적인 멀티모달 인식과 실시간 상호작용을 지원한다.

원문 발표: 2025-03-27

Qwen (Alibaba)AI 한국어 요약·재구성

Qwen2.5-VL-32B, 강화 학습으로 성능과 효율성 개선

Qwen2.5-VL-32B-Instruct 모델이 Apache 2.0 라이선스로 공개되었다. 이 모델은 강화 학습을 통해 인간 선호도에 부합하는 응답, 수학적 추론, 세밀한 이미지 이해 능력을 향상시켰으며, 동급 및 일부 대규모 모델 대비 우수한 성능을 보인다.

원문 발표: 2025-03-24

Qwen (Alibaba)AI 한국어 요약·재구성

QwQ-Max-Preview 공개: 심층 추론 및 다중 도메인 문제 해결 능력 강화

Qwen 시리즈의 최신 모델인 QwQ-Max-Preview가 공개되었다. Qwen2.5-Max 기반으로 심층 추론, 수학, 코딩, 에이전트 작업 등에서 뛰어난 성능을 보이며, 향후 오픈소스화 및 전용 앱 출시를 통해 AI 접근성을 확대할 계획이다.

원문 발표: 2025-02-25

Qwen (Alibaba)AI 한국어 요약·재구성

Qwen2.5-Max 공개: 대규모 MoE 모델의 지능 탐구 및 API 제공

Qwen 팀이 20조 개 이상의 토큰으로 사전 학습된 대규모 MoE 모델 Qwen2.5-Max를 공개하고 Alibaba Cloud API를 통해 제공한다. 이 모델은 주요 벤치마크에서 선도적인 모델들과 비교하여 우수한 성능을 보인다.

원문 발표: 2025-01-29

Qwen (Alibaba)AI 한국어 요약·재구성

Qwen2.5-1M 모델 공개: 100만 토큰 컨텍스트 길이 지원 및 추론 프레임워크 가속화

Qwen은 100만 토큰 컨텍스트 길이를 지원하는 오픈소스 Qwen2.5-1M 모델(7B, 14B)과 vLLM 기반의 추론 프레임워크를 공개했다. 이 모델은 장문 및 단문 컨텍스트 작업에서 우수한 성능을 보이며, 희소 어텐션(sparse attention) 기술을 통해 추론 속도를 최대 6.7배 향상한다.

원문 발표: 2025-01-27

Qwen (Alibaba)AI 한국어 요약·재구성

Qwen2.5-VL, 시각-언어 모델의 새로운 플래그십 공개

Qwen2.5-VL은 Qwen의 새로운 플래그십 시각-언어 모델로, 시각적 이해, 에이전트 기능, 장시간 비디오 분석, 정밀한 객체 위치 파악 및 구조화된 출력 생성을 강화했다. 3B, 7B, 72B 모델로 제공되며, 시공간 스케일 인식과 효율적인 시각 인코더를 통해 성능을 크게 향상했다.

원문 발표: 2025-01-26

Qwen (Alibaba)AI 한국어 요약·재구성

MoE LLM 훈련 효율성 및 전문가 특화 향상을 위한 전역 배치 부하 분산 기법

MoE(Mixture-of-Experts) 기반 대규모 언어 모델(LLM) 훈련에서 기존 마이크로 배치 부하 분산의 한계를 극복하고 전역 배치 부하 분산 기법을 도입하여 모델 성능과 전문가 특화를 개선한다. 이 방식은 전문가 선택 빈도 동기화를 통해 구현되며, 계산 효율성 저하 없이 성능 향상을 제공한다.

원문 발표: 2025-01-21

FROM THE SOURCE

공식 채널 디렉터리

2026년 9월 12일 RSS/Atom 응답을 확인한 채널입니다. 피드 연결 확인과 한국어 기사 발행 상태는 다릅니다. SAP 커뮤니티와 Ascend 생태계 릴리스는 각각 커뮤니티·프로젝트 소식입니다.