GPT-6 Astra의 API와 Bedrock 배포 경계가 구체화됐다
OpenAI는 앞서 공개한 GPT-6 Astra의 업무용 배치와 API 계약을 구체화했고 AWS도 같은 조사 구간에 Amazon Bedrock 정식 제공을 시작했다. API 모델 ID는 gpt-6-astra이며 컨텍스트 창은 105만 토큰, 최대 출력은 12만 8천 토큰이다. 입력과 출력 가격은 각각 100만 토큰당 10달러와 50달러이고, 27만 2천 토큰을 넘는 입력은 전체 요청에 더 높은 장문 요율이 적용된다. 기업용 ChatGPT Work와 Codex에서는 출시 시 기본 비활성화이므로 관리자가 직접 허용해야 한다.
이전 모델에서 옮길 때는 단순히 모델명만 바꾸면 안 된다. Astra는 none 추론 강도를 지원하지 않고 temperature, top_p, top_logprobs도 제거해야 한다. 도구 호출은 Responses API를 사용해야 하며 비동기 도구 호출, 작업 중 지시 변경과 configuration_update를 통한 추론 강도 변경이 새로 추가됐다. 높은 토큰 단가와 더 적은 재시도라는 작업 단위 효율을 함께 측정하고, 승인 정책과 접근 가능한 웹 및 데스크톱 애플리케이션 범위를 먼저 제한한 뒤 확대하는 편이 안전하다.
Codex CLI 0.154.0이 격리 작업공간과 승인 상태 보존을 강화했다
Codex CLI 0.154.0은 --worktree와 /worktree로 격리된 체크아웃을 만들고 새 세션 또는 포크를 이어가는 실험 기능을 추가했다. 사용자는 Codex가 작업 중인 동안 제안 선택지나 자유 입력으로 질문에 답할 수 있고, 외부에서 플러그인을 갱신하거나 되돌린 뒤에도 기존 세션이 새 도구와 Skill 및 hook을 다시 읽는다.
안전성 변화도 함께 봐야 한다. MCP OAuth 토큰 갱신은 여러 연결이 조정하며 실패한 요청을 자동 재실행하지 않고 로그인 문제를 드러낸다. 원격 재개와 포크는 저장된 권한을 보존하고, 자동 승인 검토는 대화 압축 이후에도 승인 문맥을 유지하면서 새 사용자 지시로 무효가 된 승인을 거부한다. 반면 오래된 codex mcp-server 진입점은 제거됐으므로 스크립트가 이를 직접 호출한다면 업그레이드 전에 새 경로로 옮겨야 한다.
Claude Code 2.1.267이 관리형 설정의 실패 닫힘과 대형 세션 복구를 바로잡았다
Claude Code 2.1.267은 관리형 allowedHttpHookUrls, httpHookAllowedEnvVars, allowedChannelPlugins를 읽지 못할 때 모든 항목을 허용하던 동작을 아무것도 허용하지 않는 방식으로 고쳤다. 마켓플레이스 경로의 역슬래시가 디렉터리 경계를 우회할 수 있던 문제도 수정됐다. 조직 정책을 쓰는 환경은 설정 파일이 손상되거나 권한 때문에 읽히지 않을 때 실제로 작업이 차단되는지 회귀 테스트할 필요가 있다.
5MB가 넘는 대형 세션을 재개할 때 병렬 도구 호출과 hook 출력이 사라지던 문제, 만료된 AWS 또는 Google Cloud 자격 증명에서 같은 요청을 열 번 반복한 뒤 일반 오류만 보이던 문제도 해결됐다. 장시간 자동화는 실패 횟수 감소뿐 아니라 재개 후 도구 결과의 완전성과 재인증 신호가 즉시 노출되는지를 확인해야 한다.
GitHub Copilot이 에이전트 작업 권한을 기업 정책으로 고정한다
GitHub Copilot Business와 Enterprise 관리자는 에이전트의 셸 명령, 파일 읽기 및 수정, 네트워크 도메인을 중앙 정책으로 차단하거나 사람 승인 또는 자동 허용으로 분류할 수 있다. 사용자 및 작업공간 설정, 자동 승인이나 과거 승인 기록은 이 제한을 약화할 수 없고 팀마다 다른 정책을 적용할 수도 있다.
이 기능은 Copilot 앱과 CLI, Agent Host를 사용하는 VS Code 세션에서 정식 제공된다. 조직은 도구 전체를 끄는 대신 배포 명령, 비밀 파일과 외부 도메인처럼 실제 위험 경계만 분리할 수 있다. 적용 전에는 같은 저장소를 여러 클라이언트에서 열었을 때 정책이 동일하게 내려오는지와 승인 로그가 감사 요구를 충족하는지 확인하는 편이 좋다.
Gemini CLI 0.59.0이 MCP OAuth SSRF와 작업공간 신뢰 우회를 막았다
Gemini CLI 0.59.0은 MCP OAuth 메타데이터 탐색과 인증 과정에서 내부 주소로 요청을 유도할 수 있던 SSRF 경로를 차단했다. 제한 모드에서는 작업공간 신뢰 정보를 읽거나 검증하지 못하면 허용하는 대신 닫히고, 설정된 MCP 서버도 제한 정책에 맞춰 필터링한다.
MCP 서버가 자체 OAuth 메타데이터를 제공하거나 사설 네트워크에 있는 환경이라면 업그레이드 뒤 정상 서버까지 막히지 않는지 확인해야 한다. 동시에 신뢰하지 않은 저장소를 열었을 때 로컬 파일, 내부 네트워크와 등록되지 않은 MCP 서버에 접근하지 못하는지를 음성 테스트가 아니라 실제 거부 테스트로 남기는 것이 중요하다.
Transformers 5.17.0이 비전 RoPE 구현을 통합하며 사용자 모델 이전을 요구한다
Transformers 5.17.0은 HYV4, VibeVoice, NeoMME, Fun-ASR-Nano, KimiLinear와 Canary 등 여러 모델 아키텍처를 추가했다. 생성 루프에서 매 디코드 단계의 불필요한 가속기 동기화를 줄이고 원격 Hub 파일을 무조건 내려받던 동작도 고쳤다. 모델 지원 폭과 추론 경로의 효율이 함께 넓어진 릴리스다.
호환성 경계는 비전 모델의 2D 및 3D rotary embedding이다. attention 계층이나 모델별로 RoPE 격자 interleaving을 구현한 사용자 모델은 중앙 modeling_rope_utils.py 방식으로 옮겨야 한다. Torch 2.14 이후 패키지 버전 판별 수정과 여러 FP8 및 cache 변경도 포함되므로 사용자 정의 모델은 로딩 성공만 보지 말고 같은 입력의 logits, 생성 결과와 처리량을 이전 버전과 비교해야 한다.
vLLM 0.29.0이 기본 실행기와 지원 아키텍처 경계를 바꿨다
vLLM 0.29.0은 모든 모델에서 Model Runner V2를 기본 실행기로 전환하고 FlashInfer all-reduce도 기본 활성화했다. 일부 오래된 아키텍처와 별칭을 제거했으며 PyAV 영상 디코더는 OpenCV 또는 Torchcodec으로, python -m vllm.entrypoints.openai.api_server는 vllm serve로 옮겨야 한다. 기본값 변화가 많아 같은 명령으로 실행돼도 메모리와 분산 통신 특성이 달라질 수 있다.
보안 측면에서는 cache_salt 길이를 1024로 제한해 스케줄러 CPU 고갈을 막고, 대용량 미디어는 전체 다운로드 전에 거부한다. 시작 로그와 컴파일 캐시 정보에서는 API 키와 Hugging Face 토큰을 가린다. 운영 환경은 제거된 모델과 플래그를 먼저 검색하고, 대표 모델별 첫 토큰 지연과 처리량, prefix cache 적중률, 분산 재구성 시간을 단계적으로 비교해야 한다.
Lambda Managed Instances가 90분 실행과 Graviton5를 지원한다
AWS Lambda Managed Instances는 비동기 호출과 이벤트 소스 매핑 호출의 최대 실행 시간을 15분에서 90분으로 늘렸다. 동기 호출은 기존 15분 제한을 유지한다. Durable Functions 안의 호출에도 늘어난 제한이 적용되고, 체크포인트와 재생을 사용하는 전체 비동기 실행은 최대 1년까지 이어질 수 있다. 단순 시간 초과 때문에 컨테이너나 별도 배치 시스템으로 옮겼던 일부 처리 작업을 Lambda 실행 모델 안에 둘 수 있게 됐다.
같은 날 C9g, C9gd, M9g, M9gd 등 Graviton5 기반 용량 공급자도 지원하기 시작했다. 하지만 90분짜리 단일 함수가 자동으로 신뢰성 있는 장기 작업이 되는 것은 아니다. 이벤트 재전달에 대비한 멱등성, 중간 체크포인트, 종료 직전 상태 저장과 비용 상한을 설계하고, 아키텍처 전환 시 네이티브 의존성과 메모리 대 vCPU 비율을 다시 측정해야 한다.
Bedrock Knowledge Base가 문서 ACL을 직접 검사하는 API를 제공한다
Amazon Bedrock Managed Knowledge Base는 CheckIngestedDocumentAcl과 GetIngestedDocumentAcl API를 추가했다. 전자는 특정 사용자가 수집된 문서를 볼 수 있는지 검사하고, 후자는 문서에 저장된 전체 ACL을 반환한다. 검색 결과에서 문서가 빠졌을 때 검색 품질 문제와 권한 설정 문제를 분리해 확인할 수 있다.
콘솔에서도 문서 ID와 사용자 이메일로 접근 여부를 검사할 수 있지만, 운영 자동화에서는 이메일과 문서 ID 자체가 민감한 감사 정보가 될 수 있다. 진단 API 권한을 일반 검색 권한과 분리하고, ACL 조회 기록과 결과의 보존 기간을 정해야 한다. 색인 원본의 권한과 수집 후 ACL이 어긋나는지 정기 표본 검사로 확인하는 것도 필요하다.
Timestream for InfluxDB 3가 관리형 Python 플러그인을 실행한다
Amazon Timestream for InfluxDB 3 Core와 Enterprise가 사용자 정의 Python 플러그인을 관리형 환경에서 실행한다. 공개 또는 비공개 저장소의 코드를 데이터 처리 트리거와 연결해 변환, 집계, 알림과 외부 서비스 연동을 데이터 가까이에서 처리할 수 있다. 비공개 저장소 토큰은 Secrets Manager에 저장하고 DB 파라미터 그룹에 플러그인 저장소를 지정한다.
별도 처리 파이프라인을 줄일 수 있는 대신 데이터베이스 안에서 실행되는 사용자 코드가 새 운영 경계가 된다. 허용 패키지와 네트워크 접근, 실행 시간 및 실패 재시도, 플러그인 버전 고정 방식을 확인해야 한다. 저장소의 기본 브랜치를 직접 따라가기보다 검증한 커밋이나 릴리스로 배포 단위를 고정하고, 플러그인 장애가 수집과 쿼리 지연에 미치는 영향을 분리해 관측하는 편이 안전하다.
Google Cloud 에이전트 샌드박스가 네트워크와 암호화 통제를 갖추고 GA가 됐다
Gemini Enterprise Agent Platform의 Computer Use와 Shell 샌드박스가 정식 제공됐다. Shell 샌드박스는 격리된 Linux 컨테이너에서 직접 /exec API로 명령 실행, 패키지 설치와 파일 조작을 지원한다. VPC Service Controls, Private Service Connect의 사설 ingress 및 egress, CMEK 기반 디스크와 체크포인트 암호화, 파일 상태와 연결 정체성을 보존한 일시 중지 및 재개도 함께 제공된다.
Agent Gateway에는 VPC Service Controls와 복수 Agent Registry 연결이 추가됐다. 다만 VPC 경계 적용은 9월 8일 이후 생성되고 ALL_TRAFFIC egress의 연결 템플릿을 쓰는 배포에만 지원된다. 기존 게이트웨이는 설정 토글만으로 같은 보호를 얻는다고 가정하면 안 된다. 생성 시점과 네트워크 템플릿을 인벤토리화하고, 샌드박스의 외부 통신과 CMEK 권한 상실 시 실패 동작을 검증해야 한다.
GitHub ruleset이 새 비밀 탐지 경고가 있는 PR 병합을 차단한다
GitHub repository ruleset에 PR이 새로 도입한 secret scanning 경고가 남아 있으면 병합을 막는 규칙이 공개 미리보기로 추가됐다. 헤드 커밋의 비밀 검사가 끝났고 새 경고가 모두 해결됐는지를 함께 확인한다. provider 패턴은 기본 대상이며 사용자 정의나 일반 패턴도 선택할 수 있다.
이 규칙은 push protection을 대체하지 않고 PR 경계의 두 번째 방어선을 만든다. 저장소, 조직 또는 기업 ruleset과 REST 및 GraphQL API로 설정할 수 있고 우회 권한이 있는 사용자는 예외 처리가 가능하다. 도입할 때는 검사 지연이 병합 대기 시간에 미치는 영향, 재작성된 커밋의 재검사와 우회 사용의 감사 로그를 함께 확인해야 한다.