Anthropic
이 태그가 붙은 글 7편입니다. 전체 태그 보기
Anthropic, Claude 응답에 보이지 않는 워터마크를 넣기 시작
Anthropic이 Claude Fable 5.1과 Mythos 5.1부터 텍스트 출력에 SynthID-Text 워터마크를 적용했습니다. EU AI Act 제50조 대응이자 상용 모델의 첫 기본 적용 사례입니다.
Anthropic, Claude Fable 5.1 공개하며 캐시 읽기 단가를 4분의 1로 인하
Anthropic이 Fable 5.1과 Mythos 5.1을 공개하며 기본 단가는 두고 캐시 읽기만 4분의 1로 내렸습니다. 벤치마크와 세이프가드 조정 내용, 그리고 그 한계를 정리했습니다.
Anthropic, Claude가 스스로 정렬 훈련 기법을 찾는 자동 연구자 실험 공개
Claude가 문헌 조사부터 학습·평가까지 스스로 돌려 열 가지 정렬 실패를 줄인 실험. 사람 연구자 28명과의 비교 결과와 감시 장치 설계를 정리했습니다.
OpenAI 등 100여 개 기업, AI 사이버 공격 대비 공동 서한에 서명
경쟁 관계인 프런티어 AI 기업과 보안·금융 기업 100여 곳이 8월 27일 공동 서한을 내고 AI를 활용한 사이버 공격 확산에 대비한 방어 강화를 요구했습니다.
Anthropic, 외부 연구기관 세 곳에 Claude 대화 25만 건 분석을 개방
Anthropic이 Stanford, Oxford, METR에 Claude 대화 25만 건의 집계 분석을 열었습니다. 무엇이 공개됐고 무엇이 여전히 닫혀 있는지 정리했습니다.
Anthropic, AI 에이전트가 실험 장비를 조작하는 규격 MHS를 프리뷰 공개
Anthropic이 AI 에이전트가 현미경과 로봇 팔 등 물리 장비를 조작하도록 하는 공통 규격 Model Hardware Standard의 리서치 프리뷰를 열었습니다.
미국 법원, 국방부의 Anthropic 공급망 위험 지정을 위법으로 판결
모델 사용 제한을 계약에 남기려던 Anthropic을 국방부가 공급망 위험으로 지정한 조치를 연방법원이 취소했습니다. 조달 계약에서 사용정책이 시험대에 올랐습니다.