앤트로픽 자동 정렬 연구자 공개: AI가 10가지 정렬 실패를 완화한 실험
앤트로픽은 Claude가 10개 정렬 실패 범주에서 일반 역량 저하 없이 개선 방법을 찾았다고 밝혔습니다. 숨은 평가와 더 큰 모델에서도 효과가 이어졌지만 실제 안전을 보장하는 결과는 아닌 초기 연구입니다.
앤트로픽은 Claude가 10개 정렬 실패 범주에서 일반 역량 저하 없이 개선 방법을 찾았다고 밝혔습니다. 숨은 평가와 더 큰 모델에서도 효과가 이어졌지만 실제 안전을 보장하는 결과는 아닌 초기 연구입니다.
ChatGPT Work의 web·mobile 브라우저에서 사용자가 직접 로그인한 뒤 공과금 요금제 근거를 대조하고, 가입·결제 전에 검토표로 마무리하는 순서를 설명합니다.
ChatGPT의 Plugins 화면에서 플러그인의 skills·포함 앱·설정 요구를 먼저 확인하고, 첫 설치와 비민감 테스트까지 안전하게 진행하는 방법을 설명합니다. 앱 연결 전 중단선과 확인 항목도 안내합니다.
기업 비교표를 업데이트할 때 ChatGPT for Excel의 공개 웹·승인 앱 경로와 Claude for Excel의 승인 커넥터·셀 단위 인용 경로를 구분하고, 출처와 셀을 사람이 대조하는 선택법을 안내합니다.
Ask Gemini in Chat 전환 전에 기존 Chat 사이드 패널 기록을 Google Takeout 또는 관리자 Data Export로 보존한 뒤 Gemini in Workspace archive를 검증하는 절차입니다.
앤트로픽이 AI 에이전트와 로봇팔·현미경·실험 장비를 연결하는 Model Hardware Standard 연구 프리뷰를 공개했습니다. 표준 드라이버의 작동 방식, 파트너 초기 실험, 전문가 감독이 필요한 안전 한계를 공식 출처 기준으로 정리합니다.
Google Slides 오른쪽 Record에서 발표를 녹화하고 Google Vids에서 원본과 대조해 안전한 내부 검토 영상으로 마무리하는 순서를 설명합니다.
Codex CLI의 /title picker에서 프로젝트와 앱 이름을 골라 터미널 탭 제목을 구분한 뒤 격리된 config.toml의 tui.terminal_title 저장값까지 확인하는 첫 설정 순서입니다.
Claude Research의 다중 출처 탐색과 Claude Science의 코드·버전·provenance 분석을 비교해, 연구 근거 검토를 어떤 표면에서 시작할지와 검증 기준을 정리합니다.
세일즈포스와 앤트로픽이 Claudeforce를 발표했습니다. Claude 안에서 CRM 데이터와 37개 영업 스킬을 활용하고, 현재 일부 파일럿 고객에게 제공하며 2026년 9월 오픈 베타를 예고했습니다. 권한·거버넌스 조건도 함께 정리합니다.