모델 801건 · 국산 131 · 가격 643 추적 중
뉴스

MLOps·개발도구

검증된 피드 11개에서 자동 수집하고, AI 요약이 코드 게이트를 통과한 것만 게시합니다. 게이트는 카탈로그에 없는 모델명·원문에 없는 수치·상대 시점 표현을 막습니다.

게시3150
보류839
매체34곳
중복 병합82

MLOps·개발도구 60건 · 필터 해제

라이너, 1100개 도구 연결하는 액션즈 MCP 출시

IT조선·2026-09-29MLOps·개발도구

라이너가 AI 에이전트용 도구 통합 연결 솔루션 '라이너 액션즈 MCP'를 출시했다. 클로드, 챗GPT 등 AI 에이전트에 액션즈 MCP를 연결하면 캘린더, 슬랙, 노션, 깃허브 등 외부 서비스를 활용할 수 있다. 모델 컨텍스트 프로토콜(MCP)은 AI 에이전트가 외부 서비스와 연결돼 실제 작업을 수행하도록 하는 기술이다. 1100여개 서비스를 한 번의 연동으로 지원하는 것이 특징이다.

#MCP #라이너 #AI 에이전트 #도구 연동

데이터도 AI가 찾는다··· 기업들의 AI 데이터 수명주기 관리

CIO Korea·2026-09-29MLOps·개발도구

가트너는 데이터 준비 부족으로 AI 프로젝트 다수가 중단될 것으로 전망했으며, 조직의 상당수가 현재 데이터 관리 방식이 AI에 적합한지 확신하지 못한다고 밝혔다. 볼보, 사노피, DP 월드 투어, 프레시웍스 등은 데이터 선별·오류 수정·메타데이터 태깅 등 수명주기 일부 단계에 AI를 적용하고 있다. 다만 사노피와 AOP 헬스 등 규제 산업의 리더들은 확률적 AI 모델의 불확실성을 이유로 사람의 개입 없이 데이터 관리 전체를 AI에 맡길 준비는 되지 않았다고 밝혔다.

#데이터 거버넌스 #AI 에이전트 #데이터 품질 #MLOps #데이터 수명주기

HCL소프트웨어, 금융테크컨퍼런스서 AI 자산관리 소개

전자신문 SW·2026-09-29MLOps·개발도구

HCL소프트웨어가 9월 22일 서울 여의도 FKI타워에서 열린 '금융 테크 컨퍼런스 2026'에 참가해 금융권의 IT 자산 식별·관리와 패치 조치 자동화를 위한 HCL 빅픽스(BigFix) 활용 방안을 소개했다고 29일 밝혔다. 이번 컨퍼런스는 금융 산업의 AI 혁신과 보안 대응 전략을 주제로 열렸다. 윤희성 HCL소프트웨어 상무는 'AI 기반 실시간 IT 자산관리 트렌드 및 전략'을 주제로 발표했다.

#HCL소프트웨어 #BigFix #금융IT #패치관리 #IT자산관리

엑스로그·비욘드에스앤씨, 무중단 DB 이관·동기화 협력

블로터·2026-09-28MLOps·개발도구

실시간 데이터베이스 이관·복제 전문기업 엑스로그가 IT 서비스 기업 비욘드에스앤씨와 데이터 기술 협력 및 사업 확대를 위한 업무협약(MOU)을 체결했다. 기업 IT 환경이 온프레미스와 클라우드, 이기종 DBMS가 혼재하는 구조로 재편되면서 무중단 데이터 이관과 실시간 동기화가 시스템 전환의 핵심 기술로 꼽힌다. 양사는 이러한 데이터 인프라 고도화 수요에 공동 대응하기 위해 협력하기로 했다.

#데이터베이스 #클라우드 이관 #MOU #IT인프라 #국내기업

AWS, SageMaker AI서 vLLM-Omni로 실시간 음성 스트리밍 구현 튜토리얼 공개

AWS ML Blog·2026-09-28MLOps·개발도구

AWS ML 블로그가 Amazon SageMaker AI에 vLLM-Omni 딥러닝 컨테이너(DLC)를 활용해 Qwen3-TTS 모델을 배포하는 방법을 다룬 시리즈 1편을 공개했다. 이 구성은 텍스트를 입력하고 오디오를 출력하는 양방향 지속 연결(HTTP/2 웹소켓)을 통해 응답 생성이 끝나기 전에 음성 재생을 시작할 수 있게 한다. Gradio 애플리케이션으로 워크플로를 시연했으며, 앞서 공개된 Voxtral-Mini-4B Realtime 기반 음성 인식(STT) 튜토리얼과 짝을 이뤄 음성 파이프라인의 출력 측을 담당한다. 2편에서는 같은 vLLM-Omni DLC를 이미지·비디오 생성에 적용할 예정이다.

#SageMaker AI #vLLM-Omni #Qwen3-TTS #음성 스트리밍 #AWS

AWS, SageMaker AI로 이미지·영상 생성 배포 가이드 공개

AWS ML Blog·2026-09-28MLOps·개발도구

AWS는 SageMaker AI에서 AWS vLLM-Omni 딥러닝 컨테이너를 사용해 텍스트 프롬프트로 이미지를 생성하고 이를 짧은 영상으로 변환하는 방법을 소개했다. 이미지 생성에는 FLUX.2-klein 모델을 실시간 엔드포인트로, 영상 생성에는 Wan2.1-VACE 모델을 비동기 엔드포인트로 각각 배포한다. 생성된 이미지는 Amazon S3를 거쳐 영상 모델로 전달되고, 완성된 MP4 파일도 S3에 저장된다. 명령줄 워크플로와 Streamlit 인터페이스를 포함한 샘플 코드가 GitHub 저장소로 공개됐다.

#AWS #SageMaker AI #vLLM-Omni #이미지생성 #영상생성 사진 Kelly Sikkema / Unsplash

AWS, Textract 어댑터 계정 간 자동 관리 방법 공개

AWS ML Blog·2026-09-28MLOps·개발도구

AWS ML 블로그가 Amazon Textract Custom Queries 어댑터를 훈련 환경에서 프로덕션 환경으로 계정 간 승격 관리하는 방법을 소개했다. 어댑터 ID를 AWS Systems Manager Parameter Store에 분리해 저장하면 애플리케이션 재배포 없이 프로덕션 참조를 업데이트할 수 있다. 문서 사전분류, 어댑터 선택, Textract 처리, 결과 전달로 이어지는 다단계 파이프라인 구조와 CloudFormation·Terraform 인프라 템플릿, PrivateLink·IAM·CloudTrail 기반 프로덕션 보안 구성도 함께 제공됐다.

#AmazonTextract #AWS #문서처리자동화 #MLOps #인프라템플릿

메가존클라우드, 포털26 생성형 AI 관리 플랫폼 국내 공급

IT조선·2026-09-28MLOps·개발도구

메가존클라우드가 생성형 AI 거버넌스·보안 전문 기업 포털26과 전략적 리셀러 파트너십을 맺고 기업용 생성형 AI 통합 관리 플랫폼 'AI Adoption Management Platform'을 국내에 공급한다고 28일 밝혔다. 이 플랫폼은 사내 개발 환경뿐 아니라 임직원이 개별적으로 사용하는 웹 기반 생성형 AI 서비스와 미승인 '섀도우 AI'까지 네트워크·브라우저 단에서 실시간으로 탐지한다.

#메가존클라우드 #포털26 #생성형AI 거버넌스 #섀도우AI #AI 보안

웨스트문, 위험 상황 가상 합성데이터로 AI 훈련

IT조선·2026-09-28MLOps·개발도구

서울 AI 허브에 입주한 스타트업 웨스트문은 실제 환경에서 수집하기 어렵거나 위험한 데이터를 합성데이터 기술로 만드는 AI 기업이다. 가상환경에서 위험 상황과 사람의 행동, 차량·장비 간 상호작용을 구현해 실제 사고 없이 데이터를 확보한다. 이렇게 만들어진 데이터는 AI 학습과 현장 적용에 활용된다. IT조선은 ‘서울 AI 허브 2027’ 기획시리즈를 통해 이 회사의 기술과 사업화 현황을 소개했다.

#합성데이터 #서울AI허브 #웨스트문 #AI훈련데이터 #가상환경

유니티, 메타 VR 글래스 개발환경 즉시 지원

ZDNet Korea·2026-09-28MLOps·개발도구

유니티가 메타 커넥트 2026에서 공개된 차세대 기기 '메타 VR 글래스'의 개발 환경을 즉시 지원한다고 28일 밝혔다. 개발자는 2027년 봄 정식 출시 전까지 유니티로 전용 콘텐츠를 제작·테스트할 수 있다. 'Cardmada', 'Dragon Grove' 등 주요 출시 타이틀 스튜디오들이 이미 유니티로 콘텐츠를 개발 중이며, 기존 메타 퀘스트 앱과 오픈XR 기반 타이틀도 그대로 확장 가능하다. 개발팀은 확장된 시선·손 추적 기능, GPU 비용을 낮추는 렌더링 모드, 공간 오디오 지원 등을 활용할 수 있다.

#유니티 #메타 #VR글래스 #게임엔진 #오픈XR

소프트프릭 "API 보안 핵심은 거버넌스"

바이라인네트워크·2026-09-28MLOps·개발도구

소프트프릭이 AI 시대 API 보안의 핵심으로 'API 거버넌스'를 제시했다. 공격 트래픽 차단에 그치지 않고 기업 내 존재하는 API를 찾아낸 뒤, 누가 어떤 권한으로 사용하는지와 오가는 데이터를 지속적으로 관리해야 한다는 전략이다. AI 에이전트가 확산되면서 API 보안의 중요성이 커지고 있다고 밝혔다. 기존에는 사용자나 애플리케이션이 개별 API를 호출했지만, AI 에이전트는 사용자 요청을 해석해 필요한 API를 스스로 선택하고 여러 API를 연속으로 호출한다는 점을 근거로 들었다.

#API보안 #API거버넌스 #AI에이전트 #소프트프릭 #사이버보안

메가존클라우드, 포털26과 미승인 생성형 AI 관리 솔루션 공급

전자신문 SW·2026-09-28MLOps·개발도구

메가존클라우드가 미국 생성형 AI 거버넌스·보안 기업 포털26과 전략적 리셀러 파트너십을 체결했다. 이를 통해 포털26의 기업용 통합 관리 플랫폼 'AI 도입 관리 플랫폼'을 국내 고객에 공급한다. 이 플랫폼은 기업 내 생성형 AI 사용 현황과 보안 위험, 비용을 통합 관리할 수 있도록 지원한다. 메가존클라우드는 해당 플랫폼에 대한 기술 지원과 고객 환경에 맞춘 도입을 맡는다.

#메가존클라우드 #포털26 #생성형AI거버넌스 #리셀러파트너십 #AI보안

데이터이쿠, AI 에이전트 통합 관리 도구 '에이전트 매니지먼트' 출시

ZDNet Korea·2026-09-28MLOps·개발도구

데이터이쿠가 기업이 여러 AI 플랫폼에 구축한 에이전트를 한곳에서 파악·관리하는 '에이전트 매니지먼트'를 10월 정식 출시한다고 28일 밝혔다. 이 도구는 아마존 베드록, 데이터브릭스 에이전트, 구글 버텍스, 마이크로소프트 코파일럿 스튜디오·애저 파운드리, 세일즈포스 에이전트포스, 스노우플레이크 코텍스 등을 연결해 에이전트 목록과 구조, 사용 모델·도구를 자동으로 파악한다. 고객 서비스나 민감 데이터 처리, 실시간 거래를 수행하는 고위험 에이전트는 별도로 인증 상태와 위험 요소, 정기 테스트 결과를 지속 기록해 감사·규제 대응에 쓸 수 있다. 데이터이쿠는 IBM 'AI 인 모션' 연구를 인용해 운영 중인 AI 시스템을 빠짐없이 파악·관리하는 조직이 전체의 20% 미만이라는 점을 출시 배경으로 들었다.

#데이터이쿠 #AI에이전트 #거버넌스 #MLOps #기업AI

앤트로픽, 클로드 플러그인 개발 포털 공개

AI타임스·2026-09-27MLOps·개발도구

앤트로픽이 9월 25일(현지시간) 클로드용 플러그인 개발과 배포를 지원하는 새 포털을 공개했다. 개발자는 이 포털에서 플러그인을 제출하고 안전성 검토 진행 상황과 피드백을 확인할 수 있다. 승인된 플러그인의 사용량과 검색 데이터도 한곳에서 관리할 수 있다. 플러그인은 MCP 커넥터 등과 연결되는 방식으로 제공된다.

#클로드 #앤트로픽 #플러그인 #MCP #개발자포털

KT 자체 AI 라우팅 기술, 라우터 아레나 2위 올라

ZDNet Korea·2026-09-27MLOps·개발도구

KT는 자체 개발한 AI 모델 라우팅 기술 '오토모델라우터'가 미국 라이스대 연구진이 개발한 LLM 라우터 평가 플랫폼 '라우터 아레나'의 정확도·비용 종합 평가에서 2위를 기록했다고 27일 밝혔다. 해당 연구는 ICLR 2026 논문으로 채택됐으며, 약 8400개 질의로 응답 정확도와 비용 효율성, 입력 변화 안정성을 평가한다. 오토모델라우터는 이용자 요청의 업무 유형과 난이도를 분석해 적합한 AI 모델로 자동 연결하는 기술로, 마이크로소프트 'Azure Model Router' 등 상용 제품과 함께 리더보드에 이름을 올렸다. 이 기술은 KT의 '토큰 팩토리'에도 활용될 예정이다.

#KT #AI라우팅 #벤치마크 #토큰팩토리 #멀티모델

AI, 클라우드 벗어나 현장으로…엣지 SW 시장 확대

ZDNet Korea·2026-09-26MLOps·개발도구

AI 모델을 클라우드가 아닌 공장·매장·로봇 등 현장에서 직접 구동하려는 수요가 늘면서 모델 최적화·배포·운영을 지원하는 엣지 AI 소프트웨어 시장이 커지고 있다. IDC는 엣지 AI 운영을 위해 데이터 파이프라인, 오케스트레이션, 플릿 관리, 거버넌스 소프트웨어가 함께 필요하다고 분석했다. 지멘스는 '인더스트리얼 AI 스위트'로 공장 엣지 장비의 AI 모델 배포·관리를 지원하며, 국내에서는 노타AI가 '넷츠프레소'로 모델 경량화와 변환·검증을, 마키나락스가 '런웨이'로 제조·국방 현장의 AI 운영체제를 제공한다. 마키나락스는 현대자동차와 함께 아산공장 등에서 산업용 로봇 예지보전 시스템을 약 1400대 로봇에 순차 적용하고 있다.

#엣지AI #MLOps #노타AI #마키나락스 #제조업AI

오픈AI, 앱 개발 전 과정 지원하는 새 플랫폼 준비

AI타임스·2026-09-25MLOps·개발도구

오픈AI가 개발자용 API 플랫폼을 개편해 아이디어 구상부터 프로토타입 제작, 서비스 운영까지 애플리케이션 개발 전 과정을 지원하는 방향으로 역할을 넓히려는 것으로 알려졌다. 테스팅카탈로그가 23일(현지시간) 전한 바에 따르면, 오픈AI는 '오픈AI 플랫폼'이라는 이름의 새로운 개발자 온보딩 절차를 준비 중이다. 이는 단순 모델 API 제공을 넘어 개발자 생태계를 확장하려는 움직임으로 풀이된다.

#오픈AI #개발자 플랫폼 #API #온보딩 #앱 개발

AWS, SkyRL로 SageMaker HyperPod서 멀티모달 RL 학습 시연

AWS ML Blog·2026-09-25MLOps·개발도구

AWS는 오픈소스 강화학습 프레임워크 SkyRL을 Amazon SageMaker HyperPod에서 활용해 Qwen3-VL-8B 비전-언어 모델이 시각적 미로를 탐색하도록 GRPO(Group Relative Policy Optimization) 기법으로 학습시키는 방법을 소개했다. HyperPod은 노드 장애를 자동으로 감지·교체하는 클러스터 복원력 기능과 체크포인트 기능을 제공해 다중 노드 RL 훈련이 중단 없이 이어지도록 돕는다. AWS에 따르면 VisGym SFT 체크포인트에서 시작해 GRPO 후속 학습을 거친 결과, 고정된 64개 미로 평가셋에서 미로 해결률이 43.75%에서 95% 이상으로 향상됐다. 학습은 GPU 워커 노드 3대와 CPU 헤드 노드 1대로 구성된 Ray 클러스터에서 진행됐으며, vLLM 추론 엔진과 FSDP로 샤딩된 정책 모델이 동일 GPU에서 함께 동작한다.

#SageMaker HyperPod #SkyRL #GRPO #Qwen3-VL #강화학습

AWS, Bedrock 기반 LLM 답변 품질보증 5가지 기법 공개

AWS ML Blog·2026-09-25MLOps·개발도구

AWS는 자사 블로그에서 4,000명이 넘는 AWS 경영진이 사용하는 대화형 비즈니스 인텔리전스 도구 'NarrateAI'의 실시간 품질보증 기법을 소개했다. 데이터 양에 따라 처리 경로를 나누는 적응형 파이프라인 오케스트레이션, 계정·모델 간 장애 대응(failover), 문단 단위 실시간 스트리밍 검증, 복수 평가기를 병렬로 돌리는 복합 평가 프레임워크, 정확 일치와 의미 검증을 단계적으로 적용하는 데이터 정확도 검증 등 5가지 기법을 결합했다. AWS는 이 시스템이 실시간 스트리밍을 유지하면서 약 99%의 수치 정확도를 달성했다고 밝혔다. Amazon Bedrock AgentCore 플랫폼 위에 구축됐다.

#AWS #Bedrock #LLM 품질보증 #AI 에이전트 #환각 방지

AWS, SageMaker서 Qwen3-TTS 음성 복제 모델 배포 지원

AWS ML Blog·2026-09-25MLOps·개발도구

AWS는 Alibaba Cloud Qwen팀이 공개한 텍스트음성변환 모델 Qwen3-TTS-12Hz-1.7B-Base를 Amazon SageMaker JumpStart를 통해 실시간 추론 엔드포인트로 배포하는 방법을 공개했다. 이 모델은 짧은 참조 음성과 그 대본만으로 재훈련 없이 특정 화자의 음색·억양을 복제해 새 텍스트를 말하게 할 수 있다. 중국어, 영어, 일본어, 한국어 등 10개 언어를 지원하며, 한 언어로 캡처한 음성을 다른 언어로 재생성하는 교차언어 복제도 가능하다. SageMaker AI가 GPU 서버 프로비저닝과 확장을 관리해 사용자는 인프라를 직접 운영하지 않아도 된다.

#Qwen3-TTS #SageMaker #음성복제 #AWS #TTS

깃허브, 폐쇄망서도 코파일럿 CLI 지원…권한관리 통합

ZDNet Korea·2026-09-25MLOps·개발도구

깃허브가 기업용 개발 플랫폼 '깃허브 엔터프라이즈 서버 3.22'를 정식 출시했다. 이번 버전은 깃허브 클라우드에 연결하지 않는 폐쇄망 환경에서도 관리자가 AI 모델 제공자를 설정하면 구성원이 코파일럿 CLI를 쓸 수 있게 했으며, 해당 기능은 기술 미리보기 단계다. '엔터프라이즈 팀' 기능이 정식화돼 여러 조직과 저장소의 사용자 접근 권한을 중앙에서 관리할 수 있고, 풀 리퀘스트 필수 검토자 규칙을 브랜치·파일별로 세분화할 수 있다. 비밀정보 관련 요청을 날짜순으로 정렬하는 기능과 이슈 화면에서 배포 반영 여부를 바로 확인하는 기능도 추가됐다.

#깃허브 #코파일럿 #엔터프라이즈 #폐쇄망 #코드리뷰

中, 2030년까지 소프트웨어 산업 전반 AI 전환 추진

ZDNet Korea·2026-09-25MLOps·개발도구주요

중국 공업정보화부가 'AI+소프트웨어 특별행동 실시방안'을 발표하고 2030년까지 AI와 소프트웨어·정보기술 서비스업 융합을 확대하기로 했다. 2028년까지 일정 규모 이상 소프트웨어 기업 2만 개사로 AI 활용을 넓히고, 지능화 기술개조 프로젝트 100건과 AI 에이전트 대표 적용 사례 100건을 구축할 계획이다. 코드 작성뿐 아니라 테스트·오류 탐지·운영유지보수까지 AI 기반 개발도구를 확대하고, 이를 제조·금융·의료 등 산업으로 확산시킨다는 구상이다. 소프트웨어 기업의 사업모델도 라이선스 판매에서 AI 모델·데이터·에이전트를 지속 제공하는 서비스 중심 구조로 전환하도록 지원한다. KOTRA는 지방정부의 컴퓨팅 자원 지원과 소프트웨어 산업정책 연계도 활발해질 가능성이 있다고 전했다.

#중국 #AI+소프트웨어 #산업정책 #AI에이전트 #KOTRA

퀄컴, 모듈러 인수로 스냅드래곤 AI 스택 통합 추진

ZDNet Korea·2026-09-24MLOps·개발도구주요

퀄컴이 미국 마우이에서 열린 '스냅드래곤 서밋 2026'에서 인수한 AI 소프트웨어 스타트업 모듈러를 통해 통합 AI 소프트웨어 스택 구상을 발표했다. 크리스 래트너 부사장은 하드웨어별로 스택을 따로 구축해야 했던 문제를 지적하며, 프로그래밍 언어 '모조', 프레임워크 '맥스', '모듈러 클라우드'로 구성된 엔드투엔드 스택을 데이터센터부터 PC, 엣지 디바이스까지 확대 적용하겠다고 밝혔다. 모조는 파이썬 문법에 C++ 수준 성능을 제공하며 아파치 2.0 라이선스로 오픈소스화된 1.0 버전이 공개됐다. 마이크로소프트도 윈도우에서 모조를 기본 지원하기 위해 퀄컴 모듈러 팀과 협력 중이라고 밝혔다.

#퀄컴 #모듈러 #스냅드래곤 #Mojo #마이크로소프트

앤트로픽, 오퍼스 5.5 프롬프트 작성 가이드 공개

AI타임스·2026-09-24MLOps·개발도구

앤트로픽이 9월 23일(현지시간) 클로드 오퍼스 5.5를 효과적으로 활용하기 위한 프롬프트 작성법과 장시간 작업 관리, 결과 검토 방법을 담은 사용 가이드를 공개했다. 단순히 모델에 더 많이 생각하라고 요구하기보다 작업의 목표와 완료 조건을 명확히 제시하는 것이 중요하다고 설명했다. 장시간 작업에서는 진행 상황을 체계적으로 관리해야 한다고 덧붙였다. 불필요한 문구를 삭제하라는 팁도 가이드에 포함됐다.

#앤트로픽 #클로드 #오퍼스5.5 #프롬프트엔지니어링 #사용가이드

딥시크, 에이전트 학습용 인프라 'DSec' 공개

AI타임스·2026-09-24MLOps·개발도구

딥시크가 대규모 AI 에이전트 학습에 특화된 샌드박스 플랫폼 '딥시크 엘라스틱 컴퓨트(DSec)'를 발표했다. 량원펑 창립자를 포함한 연구진이 9월 19일 온라인 아카이브를 통해 공개했다. DSec는 에이전트 학습 과정에서 수많은 실행 환경을 효율적으로 관리하고, 에이전트의 예기치 않은 돌발 행동을 차단하는 기능을 갖췄다. 이번 발표는 AI 경쟁이 단순 텍스트 생성에서 코드를 실행하고 작업을 수행하는 에이전트 영역으로 이동하는 가운데 나왔다.

#딥시크 #AI에이전트 #샌드박스 #학습인프라 #DSec

메타, 스마트폰에서 AI로 게임 만드는 도구 공개

The Verge AI·2026-09-24MLOps·개발도구

메타가 Horizon 플랫폼용 게임을 AI 프롬프트로 만들 수 있는 개발 도구 두 가지를 발표했다. 모바일 앱 'Horizon Create'와 더 세밀한 제어가 가능한 브라우저 앱 'Horizon Studio'로, 둘 다 얼리 액세스로 제공되며 대기자 명단 등록이 가능하다. 메타는 Horizon 플랫폼이 부진했다고 밝히며, 이 도구로 만든 게임을 Facebook과 Instagram에서 추천 노출하고 실제로 플레이할 수 있게 해 더 많은 사용자에게 도달시킬 계획이다.

#Meta #Horizon #게임 개발 #AI 프롬프트 #Instagram

AWS, WhisperX 기반 화자 분리 전사 SageMaker 배포 가이드 공개

AWS ML Blog·2026-09-24MLOps·개발도구

AWS ML 블로그가 오픈소스 WhisperX를 SageMaker AI에 배포하는 방법을 다뤘다. WhisperX는 OpenAI Whisper에 wav2vec2 강제 정렬로 단어 단위 타임스탬프를, 화자 분리 기능으로 '누가 말했는지' 라벨을 추가한다. AWS WhisperX 딥러닝 컨테이너는 GPU 이미지로 제공되며 실시간·비동기 SageMaker 엔드포인트 배포를 지원하고, 출력 형식으로 json, verbose_json, srt, vtt를 제공한다. 짧은 대화형 클립은 실시간 엔드포인트, 긴 오디오나 대량 배치는 비동기 엔드포인트 사용이 권장된다.

#WhisperX #AWS SageMaker #음성인식 #화자분리 #딥러닝컨테이너

재난 취재 뉴스룸 돕는 '이머전시 모드' 웹사이트 출범

Nieman Lab·2026-09-24MLOps·개발도구

2024년 허리케인 헬렌 당시 노스캐롤라이나 블루리지 퍼블릭 라디오는 단수·정전·통신두절 속에서 자체적으로 대응 체계를 급조해야 했다. 이 경험을 바탕으로 OpenNews, NC Local, Newspack이 프레스포워드의 300만 달러 규모 3년 보조금으로 'Emergency Mode for News' 서비스를 만들었다. 이 사이트는 허리케인·산불·폭염 등 재난 유형별 체크리스트, 재난 단계별 '액션 팩', 저용량 텍스트 전용 웹사이트 플러그인과 라이브블로그 플러그인, 3만 달러 규모 소액 보조금, 정신건강 자료 등을 제공한다.

#재난보도 #뉴스룸 #허리케인 #저널리즘 #비영리언론

짧은 판단에 특화된 AI 모델 '제브', 개발자 사이 빠른 확산

IT조선·2026-09-24MLOps·개발도구

AI 모델 '제브(Jev)'가 버셀(Vercel) AI 게이트웨이에 공개된 지 24시간 만에 유료 이용팀의 약 13%가 사용해 역대 가장 빠른 초기 채택 속도를 기록했다. 개발자들은 예·아니오 같은 짧은 판단 하나를 얻기 위해 매번 대형언어모델(LLM)을 호출해 왔는데, 제브는 이런 짧고 빠른 응답에 특화된 모델로 소개됐다. 버셀 측이 공개한 수치에 따르면 제브는 기존 프런티어 LLM보다 응답 속도가 훨씬 빠르고 비용도 낮다고 한다.

#Jev #버셀 #LLM #개발자도구 #AI모델

'LLM 마스터: 모델×시스템 엔지니어링' 도서 출간

AI타임스·2026-09-23MLOps·개발도구

프리렉이 에디 유·양기빈·장지선·조수현 저 'LLM 마스터: 모델 × 시스템 엔지니어링'을 2026년 9월 28일 출간한다. 이 책은 트랜스포머 원리부터 파인튜닝, 서빙 최적화, 고급 RAG, 에이전트까지 LLM 개발 전 과정을 다룬다. AI타임스는 API 활용법을 찾던 개발자들이 모델을 직접 다루고 서빙까지 책임지는 방향으로 관심을 옮기는 흐름이 감지된다고 전했다.

#LLM #파인튜닝 #RAG #AI 에이전트 #서빙 최적화

AWS, SageMaker '동시성 스윕'으로 AI 엔드포인트 용량 산정

AWS ML Blog·2026-09-22MLOps·개발도구

AWS가 Amazon SageMaker AI Inference Recommendations에 내장된 '동시성 스윕' 기능을 소개했다. 엔드포인트에 동시 요청 수를 점진적으로 늘리며 처리량과 지연시간을 측정해, 별도의 부하테스트 인프라 없이 최적의 인스턴스 유형과 서빙 구성을 찾을 수 있다. AWS는 NVIDIA Nemotron-3 Nano 모델을 vLLM 컨테이너로 배포하고 CreateAIBenchmarkJob API로 스윕을 실행하는 과정을 보여줬다. 이 과정을 통해 처리량이 최대화되는 지점, 지연시간이 서비스수준협약(SLA)을 넘는 지점, 피크 트래픽에 필요한 인스턴스 수를 파악할 수 있다.

#SageMaker #vLLM #추론 최적화 #AWS #Nemotron

감정 호소에도 반응하는 AI, 프롬프트 기법 총정리

CIO Korea·2026-09-22MLOps·개발도구

IT 매체 CIO코리아가 LLM을 원하는 방향으로 유도하기 위한 다양한 프롬프트 기법을 소개했다. 지시 기반, 퓨샷·제로샷, 소크라테스식 질문, 역할극, 사고 연쇄, 사고 트리, 사고 골격, 부정형 프롬프트, 메타 프롬프팅 등 스타일을 단독 또는 조합해 활용할 수 있다고 설명했다. 한 벤치마크에서는 GPT, 클로드, 라마 등 LLM에 감정적 호소를 담은 프롬프트를 넣었을 때 성능에 영향이 나타났다는 결과가 보고됐다. 또한 특정 표현으로 시스템 프롬프트의 제한을 우회하는 탈옥 프롬프트 사례도 존재해, AI 기업들이 이런 시도에 저항하는 모델을 지속적으로 연구하고 있다고 전했다.

#프롬프트엔지니어링 #LLM #탈옥프롬프트 #사고연쇄프롬프팅 #생성형AI

A10 네트웍스, 기업용 'AI 게이트웨이' 출시

전자신문 SW·2026-09-22MLOps·개발도구

네트워크 보안 기업 A10 네트웍스가 기업의 AI 활용을 중앙에서 관리하는 플랫폼 'A10 AI 게이트웨이'를 9월 22일 출시했다. 이 플랫폼은 기업이 쓰는 AI 에이전트, 애플리케이션, 대규모언어모델(LLM)을 하나의 플랫폼에서 관리할 수 있도록 설계됐다. 사용자·그룹별 AI 접근 제어, 지능형 라우팅(Smart Routing), AI 트래픽·비용 관리, 보안 기능 등을 통합 제공한다.

#A10네트웍스 #AI게이트웨이 #기업AI관리 #AI보안 #LLM관리

티맥스소프트·위베어소프트, WAS·인증서관리 협력

전자신문 SW·2026-09-22MLOps·개발도구

티맥스소프트가 API 관리·보안 기업 위베어소프트와 업무협약을 체결하고 애플리케이션 서버(WAS) 및 SSL/TLS 인증서 관리 자동화 솔루션 시장 공략에 나선다고 22일 밝혔다. 양사는 경기 성남시 티맥스소프트타워에서 협약을 맺었다. 이번 협약에 따라 티맥스소프트의 WAS 제품 '제우스'와 '웹투비', 위베어소프트의 SSL/TLS 인증서 자동화 관리 솔루션 'CertBear'를 기술적으로 연계해 공동 사업을 추진한다.

#티맥스소프트 #위베어소프트 #WAS #SSL/TLS 인증서 #업무협약

BMW, 1만4000개 클라우드 계정 비용 이상 자동 탐지 시스템 구축

AWS ML Blog·2026-09-21MLOps·개발도구

BMW 그룹은 AWS와 협력해 자체 FinOps 시스템 CLEA를 운영하며, 1만4000개 이상 클라우드 계정의 비용 이상 징후를 매일 자동으로 탐지한다. AWS Cost and Usage Reports 등 청구 데이터를 수집해 계정·서비스별 일일 비용 시계열을 만들고, 메타의 오픈소스 예측 라이브러리 Prophet으로 365일치 이력을 학습해 예상 지출 기준선을 계산한다. 실제 지출이 신뢰구간을 벗어나고 예상 대비 40% 이상 편차가 발생하면 계정 담당자에게 이메일 알림을 보낸다. AWS Step Functions와 Lambda 기반 서버리스 구조로 전체 계정 처리를 약 20분 만에 완료한다.

#FinOps #클라우드 비용관리 #이상 탐지 #Prophet #AWS Step Functions

Posit의 Positron IDE, AWS 세이지메이커서 실행 가능

AWS ML Blog·2026-09-21MLOps·개발도구

Posit의 데이터 과학용 통합개발환경(IDE) Positron이 Amazon SageMaker AI에서 실행되도록 지원된다. 데이터 과학자는 Space 실행 역할을 통해 별도 자격 증명 관리 없이 Amazon Athena, AWS Glue 데이터 카탈로그, Amazon S3에 직접 접근할 수 있다. Posit의 AI 코딩 어시스턴트인 Posit Assistant는 Amazon Bedrock을 모델 제공자로 사용해 사용자의 AWS 계정과 리전 내에서 동작한다. Posit이 SageMaker Distribution 이미지를 기반으로 배포한 Positron 컨테이너 이미지 정의를 관리자가 Amazon ECR에 등록하고 Studio 도메인에 연결하면, 데이터 과학자는 Space 생성 시 Positron을 선택해 사용할 수 있다.

#Positron #SageMaker #Posit #AWS #Bedrock

벤클링, Bedrock AgentCore로 멀티테넌트 AI 에이전트 보안 구축

AWS ML Blog·2026-09-21MLOps·개발도구

생명과학 소프트웨어 기업 벤클링(Benchling)이 수천 개 테넌트를 대상으로 AI 에이전트가 생성한 과학 코드를 실행하기 위해 아마존 베드록 애전트코어(Amazon Bedrock AgentCore)의 코드 인터프리터를 VPC 모드로 도입해 심층 방어 보안 구조를 구축했다고 AWS ML 블로그가 소개했다. 이 구조는 인터넷·NAT 게이트웨이가 없는 별도의 미신뢰 코드 실행용 AWS 계정, Route 53 리졸버 DNS 방화벽, VPC 엔드포인트 정책을 결합해 DNS를 통한 데이터 유출까지 차단한다. 테넌트별 IAM 역할을 두는 대신 AWS STS를 통해 작업 단위로 임시 자격 증명을 발급해 접근을 동적으로 제한한다. AWS에 따르면 이 시스템은 하루 600건 이상의 코드 실행 세션과 주간 250개 이상의 테넌트를 보안 사고 없이 처리하고 있다.

#Bedrock AgentCore #코드 인터프리터 #멀티테넌트 보안 #AWS #생명과학

바이브 코딩으로 신규 앱 폭증했지만 이용자는 외면

AI타임스·2026-09-21MLOps·개발도구

앤드리슨 호로위츠(a16z)가 9월 18일(현지시간) 발표한 보고서에 따르면, AI 코드 생성 도구를 활용한 '바이브 코딩' 확산으로 올해 iOS·안드로이드 등 주요 플랫폼의 월간 신규 앱 출시 건수가 2021~2023년 대비 2~4배 늘었다. 크롬 웹스토어의 경우 신규 출시가 최대 10배까지 증가했다. AI 코딩 도구로 개발 장벽이 낮아지면서 대량 생산된 서비스가 스토어에 쏟아진 결과다. 그러나 공급이 폭증한 것과 달리 이용자들에게 실제로 선택받는 앱은 드물어, 이른바 '앱 슬롭' 확산이 지적됐다.

#바이브코딩 #a16z #앱슬롭 #AI코딩도구 #앱스토어

한빛미디어, 'AI 시스템 설계' 출간…운영 환경 AI 안정화 다뤄

AI타임스·2026-09-21MLOps·개발도구

한빛미디어가 이한울 저자의 책 『AI 시스템 설계』를 9월 7일 펴냈다. 이 책은 LLM을 단순히 구현하는 것을 넘어 실제 운영 환경에서 AI 시스템을 안정적으로 통제하고 평가하는 하네스 아키텍처와 평가주도 개발(EDD) 방법론을 제시한다. 저자는 데모 단계와 실제 서비스 운영 사이의 간극을 설명하며, 지속적으로 개선 가능한 AI 시스템 설계 방법을 소개한다.

#AI시스템설계 #하네스아키텍처 #평가주도개발 #한빛미디어 #LLM운영

제약·바이오 GMP, 데이터·위험 관점 통합 요구 확산

바이라인네트워크·2026-09-21MLOps·개발도구

제약·바이오 등 생명과학 산업에서 디지털화가 확산되면서 의약품 제조 및 품질관리 기준(GMP)에 대한 요구가 데이터·위험·생애주기 관점에서 더 구체화되고 있다. 기존에는 전산화 시스템만 품질관리 대상으로 여겨졌지만, 이제는 제조설비와 시험·계측기의 상태·이력·성능 데이터까지 품질시스템의 일부로 포함하려는 접근이 확대되는 추세다. 이는 제약·바이오 산업이 글로벌화되는 흐름과 맞물려 있다.

#제약바이오 #GMP #품질관리 #디지털전환 #생명과학

라이너, 기업용 '모델 API'로 AX 시장 공략

전자신문 SW·2026-09-21MLOps·개발도구

라이너가 기업용(B2B) 오케스트레이션 솔루션 '라이너 모델 API'를 출시했다. 이 솔루션은 고가 프론티어 모델의 인프라 비용 부담과 저가 모델의 품질 저하 사이에서 고민하는 기업을 겨냥해 개발됐다. 회사 측은 거대언어모델(LLM) 인프라 비용을 50% 이상 절감하면서도 프론티어급 답변 품질을 유지한다고 설명했다. 라이너가 다년간 AI 에이전트 서비스를 직접 운영하며 축적한 독자 모델 운영 노하우를 기반으로 개발됐다.

#라이너 #모델 API #AX #LLM 오케스트레이션 #B2B

마키나락스, AI OS '런웨이'로 기업 AX 지원

전자신문 SW·2026-09-21MLOps·개발도구

마키나락스가 AI 운영체계(OS) 플랫폼 '런웨이'를 기반으로 기업의 AI 전환(AX)을 지원한다. 런웨이는 데이터센터부터 엣지 장비까지 AI 모델 개발·배포·운영 전 과정을 통합 관리하는 플랫폼이다. 클라우드·온프레미스·폐쇄망 등 다양한 인프라를 지원해 특정 클라우드나 파운데이션 모델에 종속되지 않는 AI 운영 환경을 제공한다. 이를 통해 기업이 AI 역량을 내부 자산으로 축적하도록 돕는다.

#마키나락스 #런웨이 #AX #AI OS #MLOps

노타, AI 모델 최적화로 기업 AX 효율화 지원

전자신문 SW·2026-09-21MLOps·개발도구

노타가 AI 모델 최적화 기술을 기반으로 기업의 AI 전환(AX)을 지원한다고 밝혔다. 적용 범위를 모델 경량화·최적화에서 AI 에이전트 운영, 데이터센터 인프라, 피지컬 AI까지 확대했다. GPU·NPU·CPU 등 하드웨어별 연산 특성을 분석해 서비스 환경에서 AI 구동 효율을 높이는 방식이다. 모델 경량화부터 하드웨어 최적화, 배포, 성능 검증까지 AI 서비스 적용 전 과정을 지원한다.

#노타 #AX #AI모델최적화 #온디바이스AI #피지컬AI

SageMaker AI, 2026년 추론 신기능 13종 공개

AWS ML Blog·2026-09-18MLOps·개발도구

아마존 SageMaker AI가 2026년 들어 관리형 엔드포인트와 HyperPod Inference 두 경로에 걸쳐 13개의 신규 추론 기능을 공개했다. 관리형 엔드포인트에는 인스턴스 추천 자동화, 용량 부족 시 자동 대체 인스턴스 풀, OpenAI 호환 API 지원 등이 포함된다. 인스턴스 추천 기능은 모델과 비용·지연·처리량 목표를 지정하면 인스턴스 유형 선정부터 벤치마킹까지 자동 수행해, 기존에 수 주가 걸리던 수작업 벤치마킹 과정을 대체한다고 설명했다. AWS가 공개한 시연 사례에서는 처리량 최적화를 적용한 GPT-OSS-20B 모델이 동일 요청 지연 시간에서 초당 토큰 처리량이 2배로 늘었다. OpenAI SDK나 LangChain 기반 애플리케이션은 엔드포인트 URL만 바꾸면 SageMaker로 이전할 수 있게 됐다.

#SageMaker #AWS #추론 인프라 #OpenAI API 호환 #HyperPod

AWS 베드록, 문샷AI 'Kimi K3' 모델 추가 지원

AWS ML Blog·2026-09-18MLOps·개발도구

AWS가 아마존 베드록에 문샷AI의 오픈웨이트 모델 Kimi K3를 추가했다. 문샷AI에 따르면 Kimi K3는 자사 최고 성능 모델로 네이티브 비전 처리와 긴 컨텍스트 유지 기능을 갖췄으며, 이전 모델 Kimi K2 대비 스케일링 효율이 개선됐다고 밝혔다. Kimi K3는 베드록에서 명시적 프롬프트 캐싱을 지원하는 첫 오픈웨이트 모델로, 반복되는 프롬프트를 재사용할 때 지연시간과 입력 비용을 줄일 수 있다. AWS는 2025년부터 딥시크, 구글, 미니맥스, 미스트랄AI, 엔비디아, OpenAI, Qwen 등의 오픈웨이트 모델을 베드록에 계속 추가해왔고, 2026년에는 툴 콜링, 구조화된 출력, 추론, 응답 스트리밍 등 플랫폼 차원의 추론 기능을 확장했다. 오픈웨이트 모델 이용 시에도 데이터는 AWS 경계 내에서 처리되며 모델 제공자와 공유되거나 학습에 사용되지 않는다.

#Kimi K3 #Moonshot AI #Amazon Bedrock #오픈웨이트 모델 #프롬프트 캐싱

AWS, Hugging Face 모델 배포용 에이전트 스킬 공개

AWS ML Blog·2026-09-18MLOps·개발도구

AWS는 Amazon SageMaker AI에 Hugging Face 모델을 배포할 때 Kiro와 Claude Code 같은 코딩 에이전트가 활용할 수 있는 여섯 가지 에이전트 스킬을 Hugging Face Skills 저장소를 통해 공개했다. 테스트에서 스킬 없이 작동한 에이전트는 서빙 컨테이너로 TGI를 먼저 선택했다가 Qwen3 모델의 헬스 체크 실패를 겪은 뒤 vLLM으로 전환했고, 새로 나온 멀티모달 MoE 확산 모델 배포에서도 TGI를 잘못 적용해 엔드포인트가 조용히 실패했다. 스킬을 설치하면 에이전트가 리소스 생성 전에 vLLM을 올바르게 선택하고, AWS Deep Learning Containers 카탈로그에서 이미지 URI를 확인하며, 오토스케일링과 지연시간·오류·오버헤드용 CloudWatch 알람을 자동으로 구성한다. 스킬은 오픈소스로 Python과 AWS CLI만 사용해 macOS, Linux, Windows에서 동일하게 동작한다.

#Hugging Face #SageMaker #코딩 에이전트 #Claude Code #에이전트 스킬

AWS, GPU 인식 추론 라우팅 '하이퍼팟 게이트웨이' 공개

AWS ML Blog·2026-09-18MLOps·개발도구

AWS는 아마존 세이지메이커 하이퍼팟용 쿠버네티스 네이티브 라우팅 시스템 'SageMaker HyperPod Inference Gateway'를 발표했다. 기존 라운드로빈·최소연결 방식 로드밸런서와 달리 KV 캐시 사용률, 요청 큐 깊이, LoRA 어댑터 탑재 여부 등 실시간 GPU 지표를 활용해 요청을 최적의 파드로 배분한다. EKS 관리형 애드온으로 설치되며 기존 모델 서버나 클라이언트 코드 변경 없이 OpenAI 호환 엔드포인트를 그대로 사용할 수 있다. AWS는 자체 사례로 첫 토큰 응답 지연이 4.4초에서 800밀리초 미만으로 줄었다고 밝혔다. 여러 클러스터·리전을 연결하는 2단계 '글로벌 추론 라우터'는 추후 제공될 예정이다.

#SageMaker #HyperPod #Kubernetes #추론 라우팅 #AWS

아크프라, 비LLM 모델 지원 확대한 뉴트리 1.2 출시

ZDNet Korea·2026-09-18MLOps·개발도구

아크프라가 9월 17일 기업용 AI 플랫폼 뉴트리의 새 버전 1.2를 발표했다. 자체 추론 엔진 플렉스 엔진을 도입해 vLLM, SGLang 기반 언어모델뿐 아니라 마이너U, 패들OCR 같은 비LLM·머신러닝 모델까지 하나의 플랫폼과 통합 게이트웨이로 관리할 수 있다. 시각적 모델 레지스트리, 자동 KV캐시·GPU 메모리 계산, 프로젝트 기반 API 키 관리 기능도 추가됐다. 제조업체와 조선업체 등이 이미 도입해 모델 배포와 리소스 관리를 통합한 사례가 소개됐다. 뉴트리 1.2는 깃허브에 오픈소스로 공개됐다.

#아크프라 #뉴트리 #MLOps #오픈소스 #모델관리

코딩 에이전트 여러 개 관리, IDE 밖에서 답 찾는 개발자들

CIO Korea·2026-09-18MLOps·개발도구

전 아마존·구글 엔지니어 스티브 예기가 여러 코딩 에이전트를 동시에 관리하는 방법을 X에 묻자 허더, 씨먹스, 컨덕터 등 다양한 도구와 개발자가 직접 만든 커스텀 기능이 600개 넘는 답변으로 소개됐다. 개발자들은 의사결정이 필요한 에이전트로 빠르게 이동하는 단축키, 대화 재확인 기능, 작업 그룹화 기능 등을 직접 만들어 쓰고 있다. AI가 코드 작성 능력은 뛰어나졌지만, 여러 에이전트가 동시에 만들어낸 변경 사항과 맥락을 개발자가 추적·검토하는 일은 여전히 수작업에 의존한다는 점이 드러났다. 구글은 IDE를 포함하지 않는 독립형 에이전트 앱 안티그래비티 2.0을 선보이며 개발자가 원하는 IDE와 함께 쓸 것을 권장했다.

#코딩에이전트 #IDE #개발자도구 #에이전틱AI #워크플로우

메가존클라우드·뉴렐릭, 장애 대응 자동화 방안 공개

IT조선·2026-09-17MLOps·개발도구

메가존클라우드가 옵저버빌리티 기업 뉴렐릭과 함께 9월 16일 'FROM CODE TO RECOVERY' 세미나를 열고 IT 서비스 장애 대응 자동화 통합 운영 방안을 제시했다. 이 방안은 장애 감지부터 원인 판단, 복구, 검증, 사후 기록까지 전 과정을 하나로 연결해 자동화하는 것이 핵심이다. 여러 솔루션과 조직에 흩어져 있던 장애 대응 절차를 연계해 복구 시간을 줄이고 수작업 과정에서 발생하는 오류를 최소화하는 것을 목표로 한다.

#메가존클라우드 #뉴렐릭 #옵저버빌리티 #장애대응자동화 #IT서비스 사진 Abdul Kayum / Pexels

AWS, Bedrock 지식베이스용 벡터 스토어 3종 비교 가이드 공개

AWS ML Blog·2026-09-17MLOps·개발도구

AWS가 Amazon Bedrock Knowledge Bases의 RAG(검색 증강 생성) 구축 시 선택 가능한 세 가지 고객 관리형 벡터 스토어인 Amazon OpenSearch Service, Aurora PostgreSQL(pgvector), Amazon S3 Vectors를 용도별로 비교하는 가이드를 게시했다. 상품 카탈로그 검색 사례에서는 하이브리드 검색과 필터링·집계 기능을 갖춘 Amazon OpenSearch Serverless가 적합하다고 설명했다. Amazon S3 Vectors는 기존 벡터 데이터베이스 대비 저장 비용을 최대 90%까지 낮추는 것을 목표로 한다고 소개했다. 글은 OpenSearch Serverless NextGen 컬렉션이 2026년 5월 정식 출시됐지만 아직 Bedrock Knowledge Bases와는 호환되지 않는다고 밝혔다.

#AmazonBedrock #RAG #벡터데이터베이스 #AWS #OpenSearch 사진 cottonbro studio / Pexels

AWS, Git 메트릭 서버리스 대시보드 솔루션 공개

AWS ML Blog·2026-09-17MLOps·개발도구

AWS ML Blog가 GitHub·GitLab 저장소 활동 데이터를 자동 수집해 Amazon QuickSight로 시각화하는 서버리스 파이프라인을 소개했다. EventBridge 스케줄러가 주기적으로 워크플로를 실행하면 Step Functions와 Lambda가 변경 감지, 전체·증분 수집, 대규모 저장소의 병렬 처리를 담당한다. 수집된 데이터는 Secrets Manager로 인증 정보를 보호하며 S3에 JSON·CSV로 저장되고, QuickSight 대시보드에서 조회할 수 있다. 이 솔루션은 AI 코딩 도구 도입 전후 개발 속도 변화를 측정하는 AWS AI-DLC 프레임워크의 관측성 원칙과 연계된다고 설명됐다.

#AWS #QuickSight #서버리스 #개발생산성 #Git메트릭 사진 olia danilevich / Pexels

AWS, 합성 데이터로 산업안전 AI 사람 탐지 성능 개선

AWS ML Blog·2026-09-17MLOps·개발도구

AWS는 SageMaker AI와 Amazon Rekognition을 결합한 합성 데이터 증강 파이프라인을 공개했다. 중장비 근처의 위험한 상황에 사람이 있는 실제 학습 이미지는 안전·윤리적 이유로 구하기 어렵고 실제 데이터셋에서도 드물어, 이를 보완하기 위해 디퓨전 모델 Qwen-Image-Edit-2509로 실제 장면 이미지에 사람을 합성해 삽입하고, Rekognition의 DetectLabels API로 바운딩박스 라벨을 자동 생성한다. 배경·조명·비율을 보존하는 방식으로 이미지를 편집해 완전 합성 장면 생성 시 발생하는 도메인 갭 문제를 줄였다. AWS는 자체 실험에서 사람 탐지 모델의 mAP50 지표가 수작업 라벨링이나 위험한 촬영 없이 최대 160% 개선됐다고 밝혔다.

#합성데이터 #산업안전 #SageMaker #Rekognition #컴퓨터비전

메가존클라우드, 뉴렐릭과 장애 대응 자동화 세미나 개최

전자신문 SW·2026-09-17MLOps·개발도구

메가존클라우드가 옵저버빌리티 플랫폼 기업 뉴렐릭과 공동으로 9월 16일 서울 강남구 구스아일랜드 브루하우스에서 '프롬 코드 투 리커버리' 세미나를 열었다고 17일 밝혔다. 세미나는 국내 기업 IT 관계자를 대상으로 진행됐으며, 코드 변경부터 서비스 복구까지 IT서비스 장애 대응 전 과정을 하나로 연결해 자동화하는 통합 운영 방안이 소개됐다. 양사는 이 과정에서 장애 대응을 자동화하는 구체적 시나리오를 제시했다.

#메가존클라우드 #뉴렐릭 #옵저버빌리티 #장애대응 #세미나

에버퓨어 "기업 99%가 다크데이터 보유해 AI 도입 발목"

전자신문 SW·2026-09-17MLOps·개발도구

데이터 관리업체 에버퓨어가 17일 서울 시그니엘에서 기자간담회를 열고 기업 대다수가 활용되지 않은 '다크 데이터'를 보유하고 있어 AI 도입이 실제 운영으로 이어지지 못하고 있다고 밝혔다. 매튜 우스트빈 에버퓨어 아시아태평양·일본(APJ) CTO는 데이터가 올바르지 않으면 원하는 AI 결과를 얻을 수 없다며, 기업이 애플리케이션 중심 접근에서 벗어나 흩어진 데이터를 통합 관리하는 체계를 갖춰야 한다고 조언했다.

#다크데이터 #데이터관리 #AI도입 #에버퓨어 #기업AI

기업 AI 성과, 데이터·에이전트·신뢰 운영이 좌우

전자신문 SW·2026-09-17MLOps·개발도구

전자신문은 기업 AI 경쟁이 대형 모델과 GPU 확보 경쟁에서 실제 업무 성과를 내는 운영 단계로 옮겨가고 있다고 전했다. 모델과 에이전트가 정확히 작동하려면 학습·추론 데이터를 안정적으로 저장하고 필요한 시점에 공급하는 데이터 인프라가 필요하다는 것이다. 데이터 품질과 접근권한, 컴퓨팅 자원, 전력과 비용 관리도 함께 이뤄져야 한다고 지적했다. AI 에이전트가 API와 업무시스템을 호출해 후속 작업까지 수행하는 만큼, 오작동과 정보 유출을 막고 처리 과정을 추적하는 통제 체계도 필요하다고 설명했다.

#데이터인프라 #AI에이전트 #거버넌스 #기업AI #MLOps

데이터스트림즈-에스에이티정보, AI용 데이터 관리 협력

전자신문 SW·2026-09-16MLOps·개발도구

데이터스트림즈가 에스에이티정보와 기업 내부 데이터를 AI가 활용할 수 있는 형태로 관리·연결하는 사업을 위한 전략적 업무협약을 체결했다. 생성형 AI와 AI 에이전트가 기업·공공기관 업무에 확산되면서, AI 모델 성능뿐 아니라 내부 데이터를 얼마나 정확하고 안전하게 활용하는지가 AI 도입 성과를 좌우하는 요소로 꼽혔다.

#데이터스트림즈 #에스에이티정보 #데이터관리 #AI에이전트 #국내기업협력

AWS, EKS서 NVRx로 장애 허용 분산 학습 구현

AWS ML Blog·2026-09-16MLOps·개발도구

AWS가 Amazon EKS 환경에서 NVIDIA Resiliency Extension(NVRx)을 PyTorch FSDP 학습에 통합해 장애 허용 분산 학습을 구현하는 방법을 블로그로 공개했다. 비동기 체크포인트로 I/O와 학습을 병행하고, 인프로세스 재시작으로 컨테이너를 건드리지 않고 소프트 장애를 복구하며, ft_launcher로 하드 크래시 시 워커를 자동 재생성하는 3단계 복구 계층을 소개했다. 동기 체크포인트가 전체 대기 시간의 최대 40%를 차지했다고 설명했다. p5.48xlarge H100 GPU 노드와 Amazon FSx for Lustre 공유 스토리지를 활용해 2~8노드 규모에서 벤치마크를 수행했다.

#NVRx #PyTorch FSDP #Amazon EKS #분산학습 #체크포인트 사진 Markus Spiske / Pexels

AWS, AgentCore로 에이전트 시스템 프롬프트 자동 최적화

AWS ML Blog·2026-09-16MLOps·개발도구

AWS는 Amazon Bedrock AgentCore의 시스템 프롬프트 최적화 기능을 상세히 소개하는 기술 후속 글을 공개했다. 이 기능은 AgentCore Observability에 기록된 실제 운영 트레이스와 평가 결과(리워드 신호)를 바탕으로 개선된 시스템 프롬프트를 제안한다. 제안된 변경은 오프라인 배치 평가와 실시간 트래픽 A/B 테스트를 거쳐 검증된 뒤 승격되며, 플랫폼 가드레일이 후보안을 사전에 걸러낸다. 추천 엔진은 하나의 리플렉터가 전체 트레이스를 분석하는 'Single Agent Reflector'와, 여러 서브에이전트가 트레이스를 분담 분석하는 실험적 오픈소스 'Sub-Agent Reflector' 두 방식으로 구성된다.

#AWS #Bedrock AgentCore #시스템 프롬프트 최적화 #AI 에이전트 #A/B 테스트 사진 Nemuel Sereti / Pexels

AWS, Bedrock 활용한 서버리스 PII 레닥션 파이프라인 공개

AWS ML Blog·2026-09-16MLOps·개발도구

AWS는 대량의 스캔 문서에서 개인식별정보(PII)를 자동으로 탐지·삭제하는 서버리스 파이프라인 구축 방법을 소개했다. Amazon Bedrock Data Automation의 커스텀 블루프린트 기능으로 문서 내 민감 필드를 자연어 지침으로 정의하고, 필드별 신뢰도 점수와 바운딩 박스 좌표를 얻어 AWS Step Functions·Lambda로 처리한다. 사례로는 보험 청구 전 의사소견서(Attending Physician Statement)에서 환자 이름·생년월일·주소 등만 골라 검게 칠하고, 의사 정보나 진료 기록은 남기는 방식을 제시했다. 기존 OCR과 패턴 매칭 기반 방식이 문서 손상이나 필드 단위 로직 처리에 한계가 있었던 점을 생성형 AI의 문맥 이해로 보완한다는 설명이다.

#PII레닥션 #AmazonBedrock #서버리스 #문서자동화 #AWS 사진 Christina Morillo / Pexels