Claude Code 2.1.269가 플러그인 평가와 실행 권한 검증을 보강했다
Claude Code 2.1.269는 플러그인을 같은 조건에서 반복 평가하고 JSON과 HTML 점수표로 비교하는 claude plugin eval을 추가했다. 출력 스타일을 명시하는 /output-style, Bash 실행 뒤 파일 차이를 남기는 옵션과 저장소 단위 OpenTelemetry 태그도 함께 들어왔다. 워크플로 에이전트 동시 실행 상한은 1개부터 256개까지 조정할 수 있다.
권한과 장시간 실행의 실패 경계도 손봤다. Bash의 tee를 통한 거부 경로 우회, 플러그인 압축 해제 때 과도한 파일 권한과 남은 파일 문제를 수정했고, 권한 거부 내역을 결과에 포함한다. 업데이트 뒤에는 플러그인 평가 입력을 고정하고, 파일 쓰기 거부 규칙과 캐시 재개 및 대규모 하위 에이전트 실행을 대표 작업으로 확인하는 편이 좋다.
OpenAI Habitat이 초대형 온라인 저장소를 중앙 서비스로 전환했다
Rapidly scaling online storage to serve over 1 billion ChatGPT users
OpenAI는 온라인 저장소 플랫폼 Habitat을 단일 데이터베이스용 Python 라이브러리에서 라우팅, 권한, 암호화, 데이터 위치와 요청 제한을 중앙 관리하는 서비스로 바꾼 과정을 공개했다. 현재 주간 10억 명 이상이 사용하는 제품에서 초당 7천만 건이 넘는 요청과 500PB 이상의 데이터를 약 40개 지역에 걸쳐 다룬다.
핵심은 기능을 많이 제공하기보다 비용을 예측할 수 있는 단순 NoSQL 계약으로 온라인 경로를 보호한 점이다. asyncio 지연을 별도 지표로 측정하고 LIFO 연결 재사용이 느린 서버에 부하를 다시 모으는 준안정 실패를 FIFO와 Envoy로 끊었다. 이후 Rust로 옮긴 서비스가 운영 요청의 95%를 처리하며 Python 대비 CPU 효율은 6배, 메모리 효율은 15배 높아졌다.
Copilot 코드 리뷰가 셸 검증과 다중 에이전트 분석을 결합했다
Copilot 코드 리뷰는 파일 읽기에 더해 빌드, 테스트와 표적 스크립트를 실행하는 Copilot SDK 셸 도구를 에이전트 방화벽 안에서 사용한다. Lite 리뷰도 단일 에이전트 대신 여러 에이전트의 관점을 합치는 방식으로 바뀌었고, GitHub 실험에서는 높은 심각도 지적의 실제 수정 비율이 늘면서 리뷰 비용은 약 8% 줄었다.
후속 커밋이 기존 지적을 해결하면 Copilot이 재검토 중 스레드를 자동으로 닫고, 자동 수정 제안을 적용할 때 변경에 맞는 커밋 메시지를 만든다. 자동 해결은 검토 대기열을 줄이지만 사람이 의도한 우회 수정까지 충분히 검증했다는 뜻은 아니다. 보호 브랜치에서는 테스트 실행 범위와 에이전트 방화벽의 네트워크 경계를 확인하고 높은 위험 지적은 사람의 확인을 유지해야 한다.
SageMaker HyperPod가 모델과 이미지 캐시로 추론 확장 지연을 줄였다
SageMaker HyperPod 모델 캐시는 추론 포드가 뜨기 전에 모델 가중치와 컨테이너 이미지를 클러스터 노드에 미리 적재한다. 대형 모델이 S3, FSx for Lustre 또는 Hugging Face에서 수십 분 동안 내려받던 경로를 로컬 NVMe 읽기로 바꾸며, 57GB에서 145GB 모델 벤치마크에서는 가중치 캐시가 확장 시간을 약 60% 줄였다.
캐시가 준비되지 않은 노드에서는 원본 저장소로 되돌아가므로 가용성을 유지하지만, 로컬 저장 용량과 새 모델 버전의 전환 시간을 운영 지표로 봐야 한다. modelCacheConfig로 가중치와 이미지 캐시를 따로 켤 수 있으므로 트래픽 급증 시점의 준비 시간, 노드별 캐시 적중률과 모델 교체 중 추가 디스크 사용량을 함께 측정하는 것이 좋다.
Bedrock 지식 기반이 영상과 음성을 원형 그대로 임베딩한다
Amazon Bedrock Managed Knowledge Base는 TwelveLabs Marengo Embed 3.0을 이용해 영상, 음성, 이미지와 텍스트를 512차원 벡터 공간에 함께 배치한다. 전사와 프레임 설명을 먼저 텍스트로 바꾸지 않고 장면, 말소리와 영상 단서를 직접 임베딩하며, 검색 결과에 영상과 음성 구간의 시작 및 종료 시각도 돌려준다.
원시 미디어를 직접 처리하면 전사에서 사라지는 시각·음향 의미를 보존하지만 기존 텍스트 청킹 설정을 그대로 적용할 수 없다. 별도 S3 멀티모달 저장 위치, 동기·비동기 모델 호출 권한과 임시 데이터 수명주기를 먼저 설계하고, 현재 native 방식이 Retrieve만 지원하는 범위도 생성 파이프라인과 분리해 확인해야 한다.
AWS DevOps Agent가 Slack 안에서 장애 조사 전체 흐름을 이어간다
AWS DevOps Agent adds support for bidirectional Slack communication
AWS DevOps Agent는 연결된 Slack 비공개 채널에서 호출해 AWS, 멀티클라우드와 온프레미스 장애 조사를 시작하고 방향을 조정할 수 있게 됐다. 리소스, 시스템 지표, 알람 상태, 배포 이력과 과거 장애 패턴에 대한 질문, 팀이 추가한 문맥, 에이전트의 조사 결과와 권장 조치를 하나의 스레드에 모은다.
대화창이 조사 콘솔이 되면 대응 속도는 빨라지지만 채널 구성원과 에이전트 권한이 곧 운영 데이터의 노출 경계가 된다. 연결 채널을 사건별 최소 인원으로 제한하고, 조사와 실제 변경 승인을 분리하며, Slack 보존 정책과 AWS 감사 기록이 동일한 사건 식별자를 공유하도록 맞추는 편이 안전하다.
Google Cloud가 API Gateway MCP와 감사·권한 경계를 함께 확장했다
Google Cloud API Gateway는 기존 REST API의 백엔드를 바꾸지 않고 OpenAPI 3.x 확장 주석으로 원격 MCP 서버를 구성하는 기능을 공개 미리보기로 열었다. 같은 날 AlloyDB for PostgreSQL은 감사 로그 파이프라인의 상태, 처리량과 적체를 Cloud Monitoring에서 관찰할 수 있게 했고 Cluster Toolkit에 영향을 주는 Slurm 보안 취약점도 수정됐다.
Google SecOps의 chronicle.readonly OAuth 범위에서 쓰기 권한은 2027년 1월 25일 제거된다. MCP로 기존 API를 도구화할 때는 각 작업의 인증 주체와 쓰기 권한을 기존 REST 정책에 기대지 말고 따로 검증해야 한다. SecOps 자동화는 읽기 범위로 쓰기를 수행하는 경로를 찾아 chronicle 범위로 옮기고, AlloyDB 감사 적체를 배포 차단 또는 경보 기준에 연결할 수 있다.
Lambda가 S3 Files의 처리량과 지연 경로를 직접 선택하게 했다
AWS Lambda now supports direct read configuration for Amazon S3 Files
Lambda의 S3 Files 직접 읽기 설정은 파일을 S3 Files 고성능 저장소에서 읽을지 원래 S3 버킷에서 읽을지 명시적으로 선택한다. 직접 읽기를 켜면 1MB 이상 파일은 처리량을 위해 S3 버킷에서 읽고 작은 파일은 고성능 저장소를 사용한다. 끄면 모든 읽기를 낮은 지연의 고성능 저장소로 보낸다.
기존 기본값은 메모리 512MB 이상 함수에만 S3 직접 읽기를 적용했지만 이제 함수 메모리 크기와 독립적으로 설정한다. 큰 순차 파일과 작은 무작위 파일의 분포가 다른 파이프라인은 동일한 설정을 복사하지 말고 p95 읽기 지연, 처리량과 S3 Files 비용을 함께 비교해야 한다. CloudFormation에서도 설정할 수 있어 성능 선택을 배포 구성으로 고정할 수 있다.
OpenTelemetry가 자식 프로세스까지 추적 문맥을 잇는 표준안을 냈다
OpenTelemetry는 네트워크 요청 없이 부모 프로세스가 셸, 빌드 도구와 테스트 프로세스를 차례로 실행할 때 환경 변수로 추적 문맥을 전달하는 사양을 릴리스 후보로 공개했다. W3C Trace Context와 Baggage를 TRACEPARENT, TRACESTATE, BAGGAGE 같은 이름으로 주입하고 자식이 시작할 때 추출한다.
각 자식마다 별도의 환경 복사본을 사용해야 동시 실행의 문맥이 섞이지 않는다. 환경 변수는 같은 프로세스의 코드나 권한 있는 다른 사용자에게 보일 수 있으므로 비밀정보를 담아서는 안 되고, trust boundary를 넘는 baggage는 검토해야 한다. CI/CD와 배치 추적에 적용하기 전 운영체제별 이름 정규화와 언어 SDK 구현 상태를 확인하는 것이 우선이다.