OpenAI는 8월 25일 ChatGPT Work와 Codex를 위한 관리자 플러그인을 소개했습니다. 관리자는 워크스페이스 활동을 분석하고 구성원·그룹·접근 권한, 사용량 한도와 지출을 관리하는 작업을 자연어로 실행할 수 있습니다.
플러그인은 요청한 관리자의 기존 역할과 권한 범위 안에서 작동하며, 결과를 구조화해 보여줍니다. 영향 범위가 큰 변경은 실행 전 내용을 확인하는 운영 절차가 중요합니다.
새 기능을 더하는 속도만큼 누가 무엇을 실행할 수 있는지, 생성 결과를 얼마나 제어할 수 있는지, 실제 업무와 사람에 미치는 영향을 어떻게 평가할지 연결해서 설계해야 합니다.
일요일 휴장으로 한국거래소(KRX) 제공 시세를 Npay 증권에서 2026년 8월 30일 09:32 KST에 조회한 마지막 거래일(8월 28일) 장마감 정보입니다. 시세 제공 화면의 기준 시각은 8월 28일 16:10 KST입니다. 가격은 변동될 수 있으며 투자 권유가 아닙니다.
OpenAI는 8월 25일 ChatGPT Work와 Codex를 위한 관리자 플러그인을 소개했습니다. 관리자는 워크스페이스 활동을 분석하고 구성원·그룹·접근 권한, 사용량 한도와 지출을 관리하는 작업을 자연어로 실행할 수 있습니다.
플러그인은 요청한 관리자의 기존 역할과 권한 범위 안에서 작동하며, 결과를 구조화해 보여줍니다. 영향 범위가 큰 변경은 실행 전 내용을 확인하는 운영 절차가 중요합니다.
Google은 8월 27일 Gemini Omni 1.1 Flash를 프로덕션 환경에 제공한다고 발표했습니다. Gemini API와 AI Studio, Enterprise Agent Platform에서 장면 연장, 첫·마지막 프레임 지정, 참조 영상 활용과 고해상도 업스케일링을 지원합니다.
최대 40초까지 장면을 이어 만들고 낮은 해상도로 빠르게 미리 본 뒤 4K로 높일 수 있어, 영상 제작을 한 번의 생성보다 반복 가능한 제어 과정으로 바꾸려는 접근입니다.
AWS는 8월 26일 Amazon Bedrock AgentCore Evaluations로 여러 에이전트 프레임워크를 같은 방식으로 평가하는 방법을 공개했습니다. OpenTelemetry와 OpenInference 추적을 사용해 LangGraph, LlamaIndex, OpenAI Agents SDK, Google ADK, Claude Agent SDK, Strands 등에서 만든 에이전트를 평가할 수 있습니다.
정답 데이터와 함께 CI 과정에서 실행하는 온디맨드 평가, 운영 환경을 지속 관찰하는 온라인 평가를 나누고 목표 달성률·정확성·유용성 또는 사용자 정의 평가기를 적용할 수 있습니다.
Anthropic은 8월 25일 AI가 이용자 웰빙에 미치는 영향을 독립적으로 평가하는 연구에 500만 달러를 지원한다고 발표했습니다. 지원 대상에는 명확한 측정 기준과 통과·실패 조건, 임상·도메인 전문가 참여, 실제 사용에 가까운 다중 대화 시나리오를 갖춘 공개 평가가 포함됩니다.
평가는 해로운 조언뿐 아니라 사용자의 믿음에 지나치게 동조하는 행동과 필요한 도움까지 거절하는 행동을 함께 다루며, 자동 채점 결과를 전문가 판단과 비교해 검증하도록 요구합니다.