AI 에이전트가 HF Space로 파리 3D 갤러리 자동 생성

AI 뉴스 속보: 한 개발자가 프로그램 에이전트에게 파리 랜드마크 3D 전시 웹사이트의 모든 에셋 제작을 독립적으로 완수하도록 했으며, 이 과정에서 이미지 생성 도구나 3D 재구성 소프트웨어를 수동으로 열지 않았습니다. 에이전트는 두 개의 Hugging Face Space를 직접 연결해 작업을 완료했습니다: 먼저 ideogram-ai/ideogram4를 호출해 텍스트 프롬프트로 각 랜드마크를 검정 배경의 표본 스타일 선명한 이미지로 변환했습니다…

2026-06-09 · 3 분 · 452 단어 · Judy

파키스탄 알림 도우미: AI로 현지 보안 신고 해결

AI 뉴스 속보: Pakistan Notice Helper는 파키스탄 현지 사기 메시지 문제를 해결하기 위해 개발된 소형 AI 보안 도구로, ‘Build Small’ 해커톤 Backyard AI 트랙에서 완성되었다. 파키스탄 사용자들은 은행, 택배사, 세무 기관, 통신사 또는 정부 부처를 사칭한 의심 메시지를 장기간 받아왔으며, 진위 판별 자체는 어렵지 않고, 어려운 것은…

2026-06-08 · 3 분 · 517 단어 · Judy

Thousand Token Wood 멀티 에이전트 경제 실전기

AI 뉴스 속보: 천대목(Thousand Token Wood)은 Build Small Hackathon에 출품된 멀티 에이전트 경제 시뮬레이션 시스템으로, Qwen2.5-3B 소형 모델을 사용해 다섯 마리의 숲 동물 캐릭터가 가상 시장에서 다섯 가지 상품을 돌 화폐로 거래합니다. 전체 시스템은 vLLM으로 Modal에 배포되고, 프론트엔드는 Gradio를 사용하며,…

2026-06-06 · 3 분 · 446 단어 · Judy

Nemotron 3.5: 기업 AI 멀티모달 안전 분류기

AI 뉴스 속보: NVIDIA가 Nemotron 3.5 Content Safety를 출시했습니다. 기업 AI 애플리케이션을 위한 멀티모달 안전 분류기로, Google Gemma 3 4B에 LoRA 파인튜닝을 적용한 구조이며, 8GB 이상의 VRAM만 있으면 배포할 수 있습니다. 이전 세대와의 가장 큰 차이점은 ‘통합 멀티모달 평가’로, 단일 추론에서 사용자 프롬프트, 이미지, 어시스턴트 응답을 동시에…

2026-06-05 · 3 분 · 468 단어 · Judy

EVA-Bench Data 2.0 출시: 음성 에이전트 벤치마크

AI 뉴스 속보: ServiceNow AI 연구팀이 EVA-Bench Data 2.0을 출시했습니다. 음성 에이전트를 위한 기업급 평가 기준으로, 단일 영역에서 항공 고객 서비스 관리(CSM), 기업 IT 서비스 관리(ITSM), 의료 인적자원 서비스 제공(HRSD) 세 가지 기업 시나리오로 대폭 확장되었습니다. 세 영역 합산 2…

2026-06-04 · 3 분 · 483 단어 · Judy

Nemotron 사전학습용 태스크 시드 합성 데이터 생성

AI 뉴스 속보: NVIDIA가 Nemotron 시리즈 모델을 위해 개발한 ‘태스크 시드 합성 데이터 생성’(Task-Seeded SDG) 5단계 프로세스: lm-eval-harness에서 약 70개 공개 태스크(약 700개 서브태스크)를 선정해 지식 집약형(39개 태스크, 약 300만 건)과 추론 집약형(34개 태스크, 약 150만 건) 두 종류의 시드로 분류하고, 대형 언어 모델로 내용은 다르지만 동등한 능력의 QA 쌍을 생성한 뒤 추론 체인과 도메인 지식을 추가해 통합 필터링·패키징한다. 에이블레이션 실험에서 컨텍스트를 추가한 버전이 압도적으로 우세했다: GPQA-Diamond CoT 34.85→45.96(+11.11), AGIEval-en CoT +6.16, MMLU-Pro 5-shot +2.44. 이 합성 데이터를 Nemotron-3 Nano의 후기 학습(100B 토큰 규모)에 혼합한 결과, GPQA 30.8→41.9(+11.1), MMLU-Pro +1.8, 코드 능력 +1.9, 상식 이해 +1.6으로 다양한 차원이 동시에 향상되어, 폭넓은 태스크 커버리지가 단일 평가 스타일 과적합 방지에 효과적임을 검증했다. 핵심 설계 원칙: 답변은 선택지 코드가 아닌 의미론적 텍스트로 저장해야 하며, 데이터셋 혼합 시 각 태스크 비율을 신중히 균형 있게 조정해야 지식·추론·코드 능력이 전반적으로 안정적으로 향상된다.

2026-06-04 · 2 분 · 420 단어 · Judy

LLM을 넘어서: 기업 AI 확장의 핵심은 에이전트 로직

AI 뉴스 속보: IBM Research 연구 발표 — 기업 AI 규모화 정착의 핵심은 더 큰 LLM이 아닌 ‘에이전트 로직(Agent Logic)‘에 있습니다. 지식 그래프, 프로그램 정적 분석, 알고리즘 분해 등 소프트웨어 기본 요소로 구성된 유도 레이어가 핵심입니다. 이 구조는 LLM의 컨텍스트 공간을 압축하고, 환각률과 토큰 소비를 동시에 낮춰 모델 동작을 더욱 제어 가능하고 비용을 예측 가능하게 만듭니다. 연구…

2026-06-01 · 2 분 · 415 단어 · Judy

JetBrains Mellum2: MoE 개발자 전용 모델 출시

AI 뉴스 속보: JetBrains가 2026년 6월 1일 Mellum2를 출시했습니다. 이는 혼합 전문가 아키텍처(MoE) 기반의 120억 파라미터 오픈소스 모델로, 추론 시마다 25억 개의 활성 파라미터만 가동하여 동급 모델 대비 추론 속도가 2배 이상 빠르고, 배포 비용이 크게 낮아졌으며, Apache 2.0 라이선스로 공개되었습니다. Mellum2는 최신 대형 모델을 대체하려는 것이 아니라…

2026-06-01 · 2 분 · 378 단어 · Judy

NVIDIA Cosmos 3 물리 AI 전모달 오픈소스 첫 공개

AI 뉴스 속보: NVIDIA가 Cosmos 3를 출시했습니다. 「Physical AI」를 위해 설계된 오픈소스 전모달 세계 기반 모델(World Foundation Model)로, 영상 생성·물리 추론·행동 출력을 단일 아키텍처에 통합한 것이 최대 특징입니다. 기존에 개별 배포가 필요했던 Cosmos Predict, Transfer, Reason, Poli…

2026-06-01 · 2 분 · 267 단어 · Judy
매주 AI 다이제스트를 받아보세요:

AI 엔지니어링, 트레이딩 시스템, 자동화 — 매주 정리. 스팸 없음.