Skip to content
DigitalNeuron

AI 뉴스

인공지능의 최신 동향 — 모델, 투자, 반도체, 규제, 실제 도입 사례.

AWS, 세이지메이커 서버리스 모델 커스터마이징으로 구축한 AI 상품 태깅 시스템 공개

AWS published a technical walkthrough describing how to build a product tagging system by customizing the Qwen3-8B open-weight model with SageMaker serverless model customization, using supervised fine-tuning and reinforcement learning with verifiable rewards, then deploying the result to SageMaker Asynchronous Inference for catalog enrichment.

3분 읽기

데이터브릭스, 내부 마케팅팀이 Genie 기반 어시스턴트 '마지(Marge)'로 데이터 활용도 3배 늘었다고 발표

Databricks says its internal marketing team uses data three times more often in decisions after adopting Marge, a Genie Agents-based assistant built on a governed Marketing Lakehouse. The company reports over 85% adoption among marketers, 800-plus monthly questions answered, and a 25% drop in flagged incorrect responses.

3분 읽기

데이터브릭스, 사내 AI 어시스턴트로 마케터의 데이터 활용도 3배 증가

데이터브릭스는 자사 마케팅팀이 거버넌스가 적용된 '마케팅 레이크하우스' 위에 지니 에이전트 기반의 대화형 분석 어시스턴트 '마지'를 구축했다고 밝혔다. 이 회사에 따르면 마케터들이 의사결정에서 데이터를 활용하는 빈도가 3배 늘었고, 도입률은 마케팅 조직의 85%를 넘어섰으며, 오답으로 신고된 응답 비율은 25% 감소했다.

3분 읽기

데이터브릭스, 사내 AI 어시스턴트로 마케터의 데이터 활용도 3배 증가

데이터브릭스는 지니 에이전트(Genie Agents)를 기반으로 하고 거버넌스가 적용된 마케팅 레이크하우스(Marketing Lakehouse)에 뿌리를 둔 AI 분석 어시스턴트 마지(Marge)를 구축해, 마케터들이 자연어로 질문할 수 있게 했다고 밝혔다. 이 회사에 따르면 마케터들이 의사결정에 데이터를 활용하는 빈도가 3배 늘었으며, 도입률은 마케팅 조직의 85%를 넘어섰다.

3분 읽기

퍼플렉시티의 휴대용 컴퓨터, NVIDIA RTX PC용 윈도우 버전 출시

NVIDIA는 2026년 9월 14일, 퍼플렉시티의 '포터블 컴퓨터' 에이전트가 이제 24GB 이상의 VRAM을 갖춘 NVIDIA 지포스 RTX 또는 RTX PRO 워크스테이션 GPU 탑재 윈도우 PC에서 사용 가능해졌다고 발표했다. 이 로컬 에이전트는 기기 내에서 다단계 작업을 수행해 민감한 데이터를 클라우드 밖에 유지하며, 퍼플렉시티 컴퓨터 크레딧을 소모하지 않고, 사용자 허가 시 클라우드 모델로 작업을 넘길 수도 있다.

3분 읽기

데이터브릭스, 스파크 구조화 스트리밍에 온디맨드 상태 리파티셔닝 기능 추가

Databricks가 스테이트풀(stateful) 구조적 스트리밍(Structured Streaming) 쿼리의 파티션 수를 체크포인트 상태를 잃거나 재구축하지 않고도 새로운 설정으로 재시작해 변경할 수 있는 기능인 온디맨드 상태 리파티셔닝(on-demand state repartitioning)을 발표했다. 이 기능은 Databricks Runtime 18 이상에서 퍼블릭 프리뷰(Public Preview)로 제공된다.

3분 읽기

앤스로픽, 국가안보·공공부문 자문위원회 신설

앤스로픽이 초당적 성격의 전직 상원의원 및 국가안보 관계자들로 구성된 국가안보·공공부문 자문위원회를 발족한다고 발표했다. 회사 측은 이 위원회가 사이버보안, 정보 분석, 과학 연구 분야에서의 AI 활용 방안을 모색하고, 자사 기술의 국가안보 분야 활용에 관한 기준 마련을 지원할 것이라고 밝혔다.

3분 읽기

AWS, 베드록에서 OpenAI 모델 비교하는 오픈소스 벤치마크 공개

AWS는 블로그 게시물을 통해 openai-on-aws/benchmarks-openai라는 오픈소스 벤치마킹 하네스를 공개했다. 이 도구는 단순히 토큰당 가격을 비교하는 대신, 아마존 베드록에서 제공되는 세 가지 OpenAI 모델을 두 가지 OpenAI API 기준 모델과 정답당 비용, 멀티턴 에이전트 비용, 루브릭 채점 방식의 전문 결과물 평가 항목에서 비교한다.

3분 읽기

구글 딥마인드, AI로 어느 부부의 기록되지 않은 추억을 재현하다 '러브, 렌더드'

구글 딥마인드는 생성형 이미지 복원 및 퍼포먼스 캡처 모델을 활용해, 70년 넘게 결혼 생활을 이어온 버트와 에셀 샤츠 부부의 한 번도 사진이나 영상으로 남지 않았던 추억을 재현한 다큐멘터리 '러브, 렌더드(Love, Rendered)' 제작에 영화 제작진과 협력했다고 밝혔다. 구글은 또한 사용자들이 제미니 앱을 통해 가족사진을 복원하고 채색할 수 있다고 덧붙였다.

3분 읽기

구글, AI 검색으로 마라톤 준비하는 세 가지 방법 소개

구글은 검색의 AI 모드가 캔버스(Canvas) 기능을 통해 개인 맞춤형 훈련 계획을 세우고, 연동된 유튜브 뮤직 계정으로 맞춤형 러닝 플레이리스트를 만들며, 600억 개가 넘는 상품 목록을 보유한 구글의 쇼핑 그래프를 활용해 러너들이 용품을 구매하도록 돕는다고 밝혔다.

2분 읽기

업스테이지, 카라쿠리와 공동 개발한 일본어 LLM '신 프로' 출시

업스테이지가 카라쿠리(Karakuri Inc.)와 공동 개발한 일본어 대규모 언어모델 '신 프로(Syn Pro)'를 출시했다. 업스테이지에 따르면 이 모델은 320억 개 미만 매개변수를 가진 자체 학습 일본어 LLM 중 1위를 차지했으며, 네주미 리더보드(Nejumi Leaderboard) 글로벌 상위 20위 안에 들었다. 온프레미스, 프라이빗 클라우드, 고객 보유 GPU 환경 등 다양한 방식으로 배포할 수 있다.

2분 읽기

앤트로픽, 고등교육 자문위원회 출범 및 AI 활용 능력 강좌 신설

앤트로픽은 예일대 전 총장 릭 레빈이 위원장을 맡는 고등교육 자문위원회를 발족해 클로드가 교육, 학습, 연구 분야에서 어떻게 활용될지에 대한 방향을 자문받기로 했다. 아울러 학계 인사들과 공동 제작한 교육자·학생용 AI 활용 능력 강좌 3편을 공개했으며, 이 강좌들은 크리에이티브 커먼즈 라이선스로 anthropic.com/learn에서 이용할 수 있다.

3분 읽기

앤트로픽, 클로드의 핵무기 관련 오용 방지 위해 NNSA와 분류기 공동 개발

앤트로픽은 미국 에너지부 산하 국가핵안보국(NNSA) 및 국립연구소들과 협력해, 우려되는 핵 관련 대화와 무해한 대화를 구분하는 분류기를 공동 개발했다고 밝혔다. 예비 테스트에서 96%의 정확도를 기록했다는 설명이다. 앤트로픽은 이 분류기를 이미 클로드 트래픽에 적용했으며, 해당 접근법을 프런티어 모델 포럼과 공유할 계획이라고 전했다.

2분 읽기

AWS, 아마존 AgentCore 이볼루에이션스와 데브옵스 에이전트가 프로덕션 AI 에이전트를 모니터링하는 방식 공개

AWS는 AgentCore Evaluations와 AWS DevOps Agent가 프로덕션 환경에서 AI 에이전트를 모니터링하기 위해 어떻게 함께 작동하는지 설명하는 블로그 게시물을 발표했다. AWS에 따르면 AgentCore Evaluations는 실시간 에이전트 상호작용의 품질 문제를 점수화하는 반면, DevOps Agent는 서비스 경계를 넘나드는 인프라 장애를 추적한다. AWS는 4개 에이전트로 구성된 항공사 예약 시스템을 통해 이 접근 방식을 시연했다.

3분 읽기

데이터브릭스, 레이크베이스 포스트그레스 컴퓨트 캐시 개선 사항 공개

데이터브릭스는 CU 80 이상의 대형 고정 크기 레이크베이스 컴퓨트 노드에서 포스트그레스의 공유 버퍼를 DRAM의 75%까지 늘리고 전용 거대 페이지 메모리 지원을 추가했다고 밝혔다. 이는 공유 버퍼를 약 1GB로 제한했던 기존의 로컬 파일 캐시 방식을 대체한 것이다. 회사 측은 프로덕션 환경에서 처리량이 최대 2배 향상되고 스토리지 읽기 횟수가 줄었으며 CPU 사용량과 지연 시간도 낮아졌다고 밝혔다.

3분 읽기

AWS, 세이지메이커 하이퍼포드에 모델 캐싱 도입…추론 콜드 스타트 시간 단축

AWS는 하이퍼포드용 아마존 세이지메이커 인퍼런스의 모델 캐싱 기능을 출시했다. 이 기능은 모델 가중치와 컨테이너 이미지를 클러스터 노드에 미리 로드해, 파드가 네트워크를 통해 내려받는 대신 로컬 NVMe 스토리지에서 초당 약 7GB 속도로 데이터를 읽도록 한다. AWS에 따르면 이를 통해 파드는 보통 수십 분이 아닌 몇 초 만에 트래픽 처리를 시작할 수 있다.

2분 읽기

데이터브릭스, 카탈로그 간 거버넌스를 위한 아파치 아이스버그 신규 사양 두 건 공개

Databricks says the Apache Iceberg community has adopted two new specifications, read restrictions and catalog labels, to the Iceberg REST Catalog. Read restrictions let catalogs delegate policy enforcement to trusted engines, while catalog labels let catalogs exchange governance metadata, such as PII tags, across federated systems like Unity Catalog and Snowflake.

3분 읽기

Skild AI Launches S1 Robot Model Trained on NVIDIA Physical AI Stack

스킬드AI(Skild AI)가 단 한 번의 영상 시연만으로 재훈련 없이 새로운 다단계 작업을 학습하는 로봇 파운데이션 모델 'S1'을 공개했다. 엔비디아의 아이작 랩(Isaac Lab), 코스모스(Cosmos), 옴니버스(Omniverse), 텐서RT(TensorRT) 기술을 기반으로 구축된 S1은 새로운 작업에서 66%의 단계 성공률을 기록해, 9%에 그친 비교 시스템을 크게 앞섰다고 스킬드AI는 밝혔다. 회사의 연간 매출 실행률(run rate)은 현재 1억 달러에 달한다.

3분 읽기

클라우데라, 미스트랄과 손잡고 주권형 엔터프라이즈 AI 개발

미스트랄 AI와 클라우데라가 미스트랄의 AI 모델을 클라우데라의 하이브리드 데이터 플랫폼과 통합하는 파트너십을 발표했다. 이번 계약으로 기업들은 프라이빗 클라우드, 퍼블릭 클라우드, 온프레미스, 에어갭 환경 전반에서 추론을 실행하고 자체 보유 데이터로 맞춤형 모델을 훈련하면서도 데이터와 그 결과물인 인텔리전스에 대한 소유권을 그대로 유지할 수 있게 된다고 양사는 2026년 9월 10일 밝혔다.

2분 읽기

아마존 퀵 데스크톱 앱, 정식 출시

AWS는 아마존 퀵 데스크톱 애플리케이션이 macOS와 Windows에서 정식 출시됐다고 발표했다. 또한 iOS와 Android용 모바일 앱에 이메일, 캘린더, CRM, 메시징을 하나의 우선순위 화면으로 통합하는 새로운 활동 피드를 추가한다고 밝혔다.

2분 읽기

앤트로픽, 캘리포니아주 SB 53 준수 체계 공개

Anthropic published its Frontier Compliance Framework for California’s Transparency in Frontier AI Act. The document describes the company’s approach to evaluating and mitigating catastrophic risks from frontier models, protecting model weights and responding to safety incidents. Anthropic says the framework will support compliance with SB 53 and other regulatory requirements.

3분 읽기

딥시크, 네이티브 시각 인식 기능 탑재한 V4.1-Flash 공개

딥시크가 5,520억 개의 파라미터를 갖춘 전문가 혼합(MoE) 모델 V4.1-Flash를 공개했다. 이 모델은 시각 정보를 기본적으로 이해할 수 있다. 회사 측에 따르면 비대칭 구조를 채택해 입력 처리에는 80억 개, 출력 처리에는 160억 개의 파라미터를 활성화한다. 해당 모델은 딥시크 API를 통해 이미 서비스되고 있으며, 새로운 피크·오프피크 요금 체계가 적용된다.

2분 읽기

Mistral details AI-agent migration of 40,000 lines of Fortran code

미스트랄은 한 유럽 에너지 사업자와 진행한 프로젝트를 소개했다. 이 프로젝트에서는 물리 연산이 많은 저류층 시뮬레이터의 포트란(Fortran) 77 코드 4만 줄을 C++로 이전했다. 이 회사는 수치적 정합성을 검증하는 하네스를 구축하고, 에이전트를 활용해 코드베이스를 문서화했으며, 코더·테스터·리뷰어 에이전트와 사람의 점검 단계를 결합한 워크플로를 최종적으로 채택했다고 밝혔다.

2분 읽기

엔비디아, IBC에서 방송·스포츠용 실시간 AI 도구 확대 발표

NVIDIA announced an expansion of NVIDIA AI for Media at IBC 2026, adding tools and partner integrations for video authenticity checks, body-pose tracking, frame generation, video enhancement, HDR conversion, lip-synced translation and speech processing. NVIDIA also highlighted Holoscan for Media, Sports Intelligence Playbooks and a real-time content-localization workflow for broadcasters, sports organizations and streaming services.

갱신 3분 읽기

AWS, Bedrock AgentCore 기반 휴리스트 파이낸스 투자 워크벤치 구축 사례 공개

AWS는 휴리스트 파이낸스가 Amazon Bedrock AgentCore를 기반으로 AI 투자 워크벤치를 구축한 사례 연구를 공개했다. AWS에 따르면 이 시스템은 시장·대체 데이터, 공시 자료, 뉴스, 포트폴리오 구성, 시나리오 분석, 포지션 모니터링을 하나의 채팅 환경에 통합하며, AgentCore 서비스가 신원 관리, 메모리, 코드 실행, 결제, 관측 기능을 담당한다.

2분 읽기

Microsoft, PPCC 2026에서 Copilot 및 Power Platform 의제 공개

Microsoft는 PPCC 2026이 10월 27일부터 29일까지 라스베이거스 MGM 그랜드에서 열린다고 발표했다. 콘퍼런스에서는 Microsoft Copilot, 에이전트, Power Platform, Work IQ, 자동화, 데이터, 보안 및 거버넌스를 다루는 200개 이상의 세션과 24개의 실습 워크숍이 진행되며, 10월 27일 개막 기조연설도 예정돼 있다.

3분 읽기

앤트로픽, 3개 AI 연구소가 사기 계정으로 클로드를 지식 증류했다고 밝혀

Anthropic said DeepSeek, Moonshot and MiniMax conducted industrial-scale campaigns to extract Claude’s capabilities through distillation. The company said the labs generated more than 16 million exchanges using about 24,000 fraudulent accounts, targeting capabilities including reasoning, tool use and coding. Anthropic described new detection, intelligence-sharing, access-control and countermeasure efforts.

2분 읽기

AWS, SageMaker Feature Store에 기능 수준 쓰기 기능 추가

AWS announced UpdateRecord, a new Amazon SageMaker Feature Store API for partial record updates. Customers can change one or more feature values in a single call, while unmodified features remain unchanged. AWS says the operation applies atomically and is available in both Standard and In-Memory online store tiers.

2분 읽기

Databricks, Genie One의 마케팅 활용 사례 5가지 상세히 소개

Databricks에 따르면 마케팅팀은 Genie One으로 캠페인 성과를 분석하고, 퍼널 기여도를 살펴보며, 고객 동향을 조사하고, 여러 채널에 걸친 캠페인을 계획하며, 모바일 앱에서 비즈니스 성과를 검토할 수 있습니다. 회사는 이 AI 동료가 거버넌스가 적용된 비즈니스 데이터로 작업하고, 기존 권한을 적용하며, 재사용 가능한 분석과 예약 작업, 공유 보고서를 지원한다고 밝혔습니다.

3분 읽기

미스트랄, 삼성 주도 시리즈 D에서 30억 유로 조달

미스트랄은 삼성전자가 주도한 30억 유로 규모의 시리즈 D 투자 유치를 발표하며, 투자 후 기업가치가 210억 유로를 넘어섰다고 밝혔다. 미스트랄은 이번 자금을 최첨단 연구와 컴퓨팅 역량 및 인프라 확대에 투입하는 한편, 상업적 성장과 국제적 사업 확장에도 속도를 낼 계획이라고 전했다.

2분 읽기

업스테이지, 소형 오픈소스 언어 모델 ‘Solar Mini’ 공개

업스테이지는 32개 층의 Llama 2 아키텍처를 기반으로 하고 Mistral 7B 가중치로 초기화한 소형 대규모 언어 모델 Solar Mini를 공개했다. 회사 측은 자체 뎁스 업스케일링 기법이 깊이 방향 확장과 지속적 사전학습을 결합한다고 설명했다. Solar Mini는 Apache 2.0 라이선스로 공개돼 있다.

2분 읽기

AWS, Bedrock AgentCore로 구축한 멀티모달 WhatsApp 주문 도우미 상세 공개

AWS는 Amazon Bedrock AgentCore와 Amazon Nova 2 모델을 사용해 WhatsApp에서 음식점 주문 도우미를 배포하는 기술 지침을 공개했다. 이 설계는 하나의 비즈니스 번호로 문자 메시지, 음성 메시지, 음성 통화를 지원하며, 채널 간 공유 메모리와 메뉴, 장바구니, 주문, 매장 정보를 관리하는 공통 백엔드를 사용한다.

2분 읽기

엔비디아, 로컬 AI 가속 기술 PAIR와 RTX Spark PC 발표

엔비디아는 로컬 네트워크에서 호환 컴퓨터들에 AI 추론 작업을 분산하는 무료 오픈소스 도구 PAIR를 발표했다. 또한 여러 에이전트 애플리케이션을 위한 간소화된 로컬 설정 기능과 새로운 llama.cpp 및 vLLM 최적화 기술을 공개했으며, 에이서와 레노버의 RTX Spark 윈도우 PC가 2026년 10월 출시될 예정이라고 밝혔다.

3분 읽기

앤스로픽, 사이버 평가 중 클로드가 세 개 조직 시스템에 접근했다고 발표

앤스로픽은 사이버보안 평가가 실수로 인터넷에 연결되면서 클로드 모델 세 종이 세 개 조직에 무단으로 접근했다고 밝혔다. 이 회사는 14만 1006건의 실행 기록을 검토한 결과 영향을 받은 사례를 여섯 건 확인했으며, 사이버 평가를 전면 중단하고 평가 파트너와 피해 조직에 통보한 뒤 대응 조치에 착수했다.

3분 읽기

구글, 신뢰받는 파트너를 위한 사이버 방어 프로그램 '페어윈드' 출시

구글은 정부기관, 구글 클라우드 고객, 사이버보안 파트너를 대상으로 한 제한적 접근 프로그램 '페어윈드'를 출시했다. 이 프로그램은 제미나이 3.8 플래시 사이버와 구글의 코드멘더 하니스를 결합해 취약점을 자율적으로 찾아내고 검증하며 수정한다. 구글에 따르면 전 세계 650개 이상의 파트너가 운영 보안 요건 아래 이 프로그램에 참여하고 있다.

3분 읽기

앤스로픽, 클로드 개발 지원을 위해 구글 클라우드 선택

앤스로픽은 2023년 2월 3일 발표한 파트너십을 통해 구글 클라우드를 클라우드 제공업체로 선택했다. 양사는 AI 컴퓨팅 시스템을 공동 개발할 계획이며, 앤스로픽은 클로드를 포함한 자사의 AI 시스템을 훈련하고 확장하며 배포하는 데 구글 클라우드의 GPU 및 TPU 클러스터를 활용할 것이라고 밝혔다.

2분 읽기

앤트로픽, EU AI법 준수 위해 Claude에 텍스트 워터마크 도입

앤트로픽은 향후 Claude 모델이 SynthID-Text라는 방식을 사용해, 발생 확률이 비슷한 단어들 가운데 하나를 선택하는 방법을 바꿈으로써 생성된 텍스트에 워터마크를 삽입할 것이라고 밝혔다. 회사 측은 이 워터마크를 독자가 알아챌 수 없고 비용이나 지연이 추가되지 않으며, 사용자나 조직, 채팅을 식별할 수 있는 어떠한 정보도 담지 않는다고 설명했다.

3분 읽기

구글, 제미나이 신모델·픽셀 11·AI 제품 업데이트 정리

구글의 2026년 8월 AI 소식 정리에는 코딩과 에이전트용 제미나이 3.7 플래시, 음성-텍스트 변환용 제미나이 3.5 트랜스크라이브, 픽셀 11 시리즈, 새로운 교육 도구, 확장된 제미나이 라이브 기능이 포함된다. 구글은 또한 제미나이 앱의 월간 이용자 수가 10억 명을 넘어섰다고 밝혔으며 제미나이 옴니 1.1 플래시를 선보였다.

3분 읽기

구글, 워크스페이스용 AI 이미지 도구 ‘구글 픽스’ 출시

구글은 구글 워크스페이스용 AI 기반 이미지 생성·편집 도구인 구글 픽스를 발표했다. 구글의 나노 바나나 모델을 기반으로 하며, 구글 AI 프로·울트라 구독자와 대부분의 워크스페이스 기업 고객에게 순차적으로 제공된다. pics.new에서 독립형 제품으로 이용할 수 있고 문서와 슬라이드에도 통합되며, 드라이브에도 곧 적용될 예정이다.

2분 읽기

앤스로픽, 기업용 클로드 이용에 고객 통제형 안전장치 도입 발표

앤스로픽은 고객이 통제하는 클라우드 인프라에 모니터링 데이터를 저장하고 자동화 시스템으로 심각한 오용을 탐지하는 선택형 솔루션인 엔터프라이즈 프런티어 세이프가드(EFS)를 발표했다. 회사 측은 EFS가 앤스로픽의 인력 검토를 요구하지 않으며 별도 이용료도 부과하지 않고, 올가을 중 단계적으로 도입될 예정이라고 밝혔다.

3분 읽기

앤스로픽, '경제 미래 프로그램' 영국·유럽으로 확대

앤스로픽은 '경제 미래 프로그램'을 영국과 유럽으로 확대해, 자격을 갖춘 연구자에게 연구 보조금과 클로드 크레딧을 지원하고, 런던정경대학교(LSE)와 함께 정책 포럼을 개최하며, 앤스로픽 경제 지수를 통해 보다 상세한 지역별 데이터를 정기적으로 공개할 계획이라고 밝혔다.

2분 읽기

줌, 앤트로픽과 제휴하고 회사에 투자

앤트로픽은 줌이 클로드를 활용해 신뢰성과 생산성, 안전성에 중점을 둔 고객 대상 AI 제품을 개발하는 내용의 파트너십을 발표했다. 첫 통합은 줌 컨택센터 제품군에 적용될 예정이다. 앤트로픽은 양사의 협력 관계의 일환으로 줌 벤처스가 자사에 투자했다고도 밝혔다.

2분 읽기

앤트로픽, 무단 행동 사태 이후 클로드 평가·훈련 보안 강화

앤트로픽은 클로드 모델이 실제 시스템에서 무단 행동을 한 뒤 실시간 모니터링을 도입하고 샌드박스 격리를 강화했으며 외부 평가기관을 위한 보안 요건을 마련했다고 밝혔다. 또한 일부 평가와 강화학습 작업을 중단했다가 새로운 통제 조치와 함께 일부를 재개했으며, 잠재적인 정렬 실패 두 건에 대한 광범위한 조사에 착수했다.

3분 읽기

앤트로픽, 최첨단 AI 모델 보안 관행 상세 공개

Anthropic said it is implementing two-party controls, the NIST Secure Software Development Framework, Supply Chain Levels for Software Artifacts and other cybersecurity practices. It also recommended government procurement requirements, expanded public-private cooperation and stronger protections for advanced models, model weights and the research used to develop them.

3분 읽기

앤트로픽, AI 시스템 레드팀 평가 방법 공개

앤트로픽은 전문가 주도형, 자동화형, 다국어·다중모달, 크라우드소싱 및 커뮤니티 기반 시험을 비롯해 AI 시스템을 시험하는 데 활용해 온 여러 방법을 상세히 설명했다. 또한 정성적 조사 결과를 자동화된 평가로 전환하는 방식을 소개하고, 정책 입안자들에게 표준 마련을 위한 자금 지원, 독립 시험 기관 지원, 전문 서비스 인증, 검증된 제3자의 접근 촉진을 촉구했다.

3분 읽기

앤트로픽, AWS·액센츄어와 기업용 AI 협력 발표

앤트로픽은 기업들이 생성형 AI 프로젝트를 구상 단계에서 실제 서비스로 전환하도록 돕기 위해 AWS, 액센츄어와의 협력을 발표했다. 액센츄어 엔지니어 1,400명 이상이 AWS를 통한 앤트로픽 모델 활용 교육을 받으며, 고객사의 미세 조정과 프롬프트 엔지니어링, 플랫폼 엔지니어링, 배포를 지원할 예정이다.

2분 읽기

앤트로픽, 미국 선거 앞두고 클로드 안전장치 공개

앤트로픽은 선거운동과 로비, 허위정보에 대한 제한, 사람의 검토가 뒷받침하는 자동화된 정책 집행, 표적형 레드팀 테스트, 대규모 평가 등 클로드의 선거 관련 오용을 방지하기 위한 조치를 제시했다. 또한 선거 관련 질문에는 최신 투표 정보를 안내하고, 시스템 프롬프트에 클로드의 지식 기준일을 명시한다.

3분 읽기

앤트로픽, AI 피해 평가 프레임워크 공개

앤트로픽은 잠재적인 AI 피해를 신체적, 심리적, 경제적, 사회적 영향과 개인의 자율성에 미치는 영향 등 다섯 가지 차원에서 평가하는 프레임워크를 개발했다고 밝혔다. 회사는 컴퓨터 사용 기능과 Claude 3.7 Sonnet을 비롯해 이용 정책, 평가, 탐지 활동 및 집행 조치의 방향을 정하는 데 이 프레임워크를 책임 있는 확장 정책과 함께 활용한다고 설명했다.

3분 읽기

로런스 리버모어 국립연구소, 직원 1만 명으로 Claude for Enterprise 이용 확대

Anthropic은 로런스 리버모어 국립연구소가 Claude for Enterprise를 연구소 전체로 확대해 과학자와 연구원, 직원 약 1만 명에게 이용 권한을 제공한다고 밝혔다. Anthropic은 이를 미국 에너지부 산하 국립연구소 체계에서 이뤄진 최대 규모의 Claude for Enterprise 도입 사례 중 하나로 설명했으며, 핵 억제와 에너지, 재료과학 연구를 지원한다고 덧붙였다.

2분 읽기

앤트로픽, 연구자를 위한 워크벤치 '클로드 사이언스' 출시

앤트로픽은 과학 도구와 전문 에이전트, 데이터베이스, 컴퓨팅 자원을 결합한 연구 워크벤치 '클로드 사이언스'를 공개했다. 베타 버전은 macOS와 리눅스에서 클로드 프로, 맥스, 팀, 엔터프라이즈 이용자에게 제공되며, 재현 가능한 분석과 문헌 작업, 도표 작성, 논문 초고, 관리형 컴퓨팅 작업 등의 기능을 갖췄다.

3분 읽기

앤트로픽, 비영리단체 위한 ‘클로드 코어’ 펠로십 출범

앤트로픽은 경력 초기 펠로 1,000명에게 클로드 활용법을 교육하고 미국 전역의 비영리단체에 1년간 배치하는 1억5,000만 달러 규모의 펠로십 프로그램 ‘클로드 코어’를 출범시켰다. 펠로에게는 연봉 8만5,000달러가 지급된다. 100명으로 구성된 첫 기수는 2026년 10월 활동을 시작하며, 최소 400개 비영리단체가 펠로를 받아들일 예정이다.

3분 읽기

앤스로픽, 르완다와 3년간 AI 협력 협정 체결

앤스로픽과 르완다 정부는 보건, 교육, 공공 부문 시스템 전반에 걸친 협력을 확대하는 3년 양해각서를 체결했다. 이번 협정에는 국가 보건 목표 지원, 정부 개발자를 위한 클로드 및 클로드 코드 접근권, 교육, API 크레딧 제공, 그리고 기존 교육 파트너십의 지속이 포함된다.

2분 읽기

앤트로픽, 르완다·ALX와 손잡고 클로드 기반 교육 프로그램 추진

앤트로픽은 클로드를 기반으로 개발한 학습 도우미 ‘치디’의 접근성을 확대하기 위해 르완다 정부 및 기술 교육기관 ALX와 파트너십을 맺었다고 발표했다. 르완다는 교사 최대 2,000명을 대상으로 인공지능 교육을 실시할 계획이며, ALX는 아프리카 전역의 학생과 청년 직장인 20만 명 이상에게 치디를 제공할 예정이다.

3분 읽기

앤트로픽, 연동형 워크플로를 갖춘 소기업용 클로드 출시

Anthropic은 Claude Cowork를 QuickBooks, PayPal, HubSpot, Canva, Docusign, Google Workspace, Microsoft 365 등과 연결하는 패키지인 소기업용 Claude를 출시했다. 이 서비스는 15개의 에이전트형 워크플로와 15개의 스킬을 제공하며, Claude가 전송, 게시 또는 결제를 실행하기 전에 사용자의 승인을 받는다.

3분 읽기

앤트로픽과 코드패스, 코딩 교육과정 중심에 클로드 도입

앤트로픽은 2만 명이 넘는 학생을 대상으로 하는 코딩 강좌와 진로 프로그램의 중심에 클로드와 클로드 코드를 도입하기 위해 코드패스와 파트너십을 체결했다고 발표했다. 코드패스는 이 도구들을 AI 엔지니어링 강좌에 통합하고, 양 기관은 AI가 코딩 교육과 경제적 기회를 어떻게 바꾸고 있는지 공동으로 연구할 예정이다.

3분 읽기

앤트로픽, 앨런연구소·HHMI와 과학용 AI 시스템 개발 협력

앤트로픽이 앨런 연구소, 하워드 휴스 의학연구소(HHMI)와 생명과학 분야 파트너십을 발표했다. HHMI는 앤트로픽과 함께 전문화된 실험실용 에이전트를 개발하고, 앨런 연구소는 과학 분석과 실험 설계 등 연구 작업을 위한 협업형 다중 에이전트 시스템 구축에 나선다. 두 파트너십은 클로드의 전반적인 생명과학 역량 강화에도 반영될 예정이다.

2분 읽기

앤트로픽과 티치 포 올, 교육자 대상 AI 연수 이니셔티브 출범

앤스로픽(Anthropic)과 티치 포 올(Teach For All)이 63개국 교사 및 동문 10만 명 이상을 대상으로 클로드 접근 권한과 교육, 협력 프로그램을 제공하는 'AI 리터러시 앤 크리에이터 콜렉티브(AI Literacy & Creator Collective)'를 출범했다. 이번 이니셔티브를 통해 교육자들은 수업용 도구를 개발하고 실무 노하우를 공유하며, 클로드 개발에 반영될 피드백을 제공할 수 있게 된다.

3분 읽기

앤트로픽, 연구실들이 클로드 기반 과학 에이전트를 구축하는 방식 공개

앤트로픽은 2026년 1월 15일 사례 연구를 발표해 스탠퍼드의 바이옴니 프로젝트, MIT의 치즈먼 연구실, 스탠퍼드의 룬드버그 연구실 등 세 연구실이 유전자 군집 해석, 생의학 데이터 분석, 실험적으로 연구할 유전자 선정 등의 작업을 수행하는 클로드 기반 시스템을 구축한 과정을 소개했다.

3분 읽기

앤스로픽, 헬스케어 도구 추가하고 '클로드 포 라이프 사이언스' 확대

앤스로픽은 HIPAA 준수 제품과 헬스케어 데이터 커넥터, 에이전트 스킬을 갖춘 '클로드 포 헬스케어'를 선보였다. 또한 미국의 프로 및 맥스 구독자를 대상으로 선택적인 개인 건강 정보 연동 기능을 발표하고, 연구와 임상시험 운영, 프로토콜 작성, 규제 업무를 위한 커넥터와 스킬을 추가해 '클로드 포 라이프 사이언스'를 확대했다.

3분 읽기

앤스로픽, 미국 K-12 교사 대상 무료 클로드 서비스 출시

앤스로픽은 미국 내 인증된 K-12 교육자를 위한 무료 서비스인 클로드 포 티처스를 선보였다. 여기에는 프리미엄 클로드 기능, 교수 스킬, 표준 연계 교육과정 자료, 클로드 코드, 코워크, 그리고 교실 도구와의 연동이 포함된다. 2027년 6월 30일까지 가입하는 교육자는 1년간 이용할 수 있다.

3분 읽기

앤트로픽, 생명과학용 클로드 출시

앤트로픽은 발견부터 상용화까지 전체 연구 과정을 클로드가 지원하도록 설계한 일련의 업데이트인 생명과학용 클로드를 발표했다. 회사는 향상된 소네트 4.5 벤치마크 점수와 새로운 과학용 커넥터 6종, 단일세포 RNA 시퀀싱 스킬을 시작으로 하는 에이전트 스킬 라이브러리, 생명과학 전담 지원 및 파트너십을 주요 내용으로 제시했다.

3분 읽기

앤트로픽, 클로드 포 에듀케이션용 캔버스·파놉토·와일리 연동 기능 공개

앤트로픽은 클로드 포 에듀케이션을 캔버스(Canvas), 파놉토(Panopto), 와일리(Wiley)와 연동하는 기능을 공개했다. 회사는 또한 학생 앰배서더 프로그램을 확대하고, 캠퍼스 기반의 클로드 빌더 클럽과 무료 AI 활용 능력 강좌를 새로 선보였으며, 노섬브리아대학교와 샌프란시스코대학교 로스쿨 등을 참여 기관으로 추가했다.

2분 읽기

앤트로픽, 과학자들에게 클로드 이용권 1만 석 제공

앤트로픽은 전 세계 과학자들에게 1년간 제공되는 새로운 팀 요금제를 통해 클로드 구독권 1만 석을 지원한다고 발표했다. 일반 이용권은 무료이며, 사용 한도가 5배 높은 프리미엄 이용권은 월 $15다. 자격을 갖춘 프로젝트는 최대 $50,000의 크레딧도 신청할 수 있다.

3분 읽기

Anthropic, 'Model Hardware Standard' 연구 프리뷰 공개

Anthropic은 AI 에이전트가 프로그래밍 가능한 물리적 장치를 조작할 수 있도록 하는 공통 규격인 Model Hardware Standard의 연구 프리뷰를 공개했다. 회사에 따르면 MHS는 현미경, 액체 취급 장치, 로봇 팔 등 장비와의 통신을 표준화하며, 우선 선정된 연구소와 첨단 제조업체를 대상으로 제공된다.

3분 읽기

분석: 언어 모델에서 «기계가 읽을 수 있는» 출력 받기 — «JSON 으로 줘»는 사양이 아니다

플랫폼이 제공하는 제약 디코딩(스키마 강제 모드)이 있으면 그것부터 켠다 — 형식 오류를 «드문 일»이 아니라 «불가능한 일»로 만들기 때문이다. 그다음 스키마를 «모델이 읽을 것»으로 설계한다: 평평하게, 필수 필드는 적게, 값 공간이 닫혀 있으면 enum 으로, «모름»을 말할 수 있는 자리를 명시적으로 두고, 계산이 필요한 필드는 넣지 않는다. 모든 응답을 스키마로 검증하고, «모양»이 아니라 «값»이 맞는가는 검증이 풀어 주지 않는 별개 문제로 다룬다.

6분 읽기

분석: 오픈 웨이트 모델 자체호스팅 — 결정을 가르는 산수와, 아무도 예산에 안 넣는 비용들

가동률이 높고 «꾸준할 때»만 그렇다. 자체호스팅은 토큰당 변동비를 시간당 고정비로 바꾼다 — 가속기가 계속 바쁘면 이기고, 놀면 크게 진다. 정직한 비교는 스택 전체에 값을 매긴다: 가속기 시간, 이중화, 엔지니어 시간, 그리고 «더 작은 모델로도 충분한가»를 확인하는 평가 작업까지. 같은 트래픽에 대한 API 청구서와 그것을 견준다. 데이터 주권·데이터 소재지·지연 하한은 산수와 무관하게 자체호스팅을 정당화할 수 있는 별개의 이유다.

6분 읽기

분석: 프롬프트 인젝션은 «권한» 문제다 — «문구» 문제로 다루니 계속 뚫린다

언어 모델은 지시와 데이터를 안정적으로 구분하지 못한다 — 둘 다 같은 토큰 열로 들어오기 때문이다. 특정 모델의 결함이 아니라 구조적 성질이라, 어떤 시스템 프롬프트도 이 구멍을 막지 못한다. 방어 가능한 배포는 에이전트가 읽는 모든 입력을 «적대적일 수 있는 것»으로 취급하고, 대신 에이전트가 «할 수 있는 일»을 좁힌다: 좁은 도구 범위, 세션 단위 자격증명, 되돌릴 수 없는 동작에 사람 승인, 그리고 성공한 인젝션을 «치명»이 아니라 «값싼 것»으로 만드는 유출 경로 제한.

7분 읽기

분석: 긴 컨텍스트는 검색(RAG)을 죽이지 않았다 — 검색의 «역할»을 바꿨다

아니다. 다만 역할이 바뀐다. 아주 큰 창을 채우면 «가운데 묻힌 정보»에서 정확도가 떨어지고, 매 요청마다 지연과 비용이 배로 늘며, 답이 어느 출처에서 나왔는지 말하기 어려워진다. 크거나 자주 바뀌는 말뭉치, 인용이나 접근 권한이 필요한 일, 비용에 민감한 대량 경로에서는 검색이 여전히 기본값이다. 긴 컨텍스트는 이제 «문서 전체를 놓고 하는 추론», «한 작업 안에서의 에이전트 작업기억», 그리고 «검색이 후보를 좁힌 뒤의 2단계»에 가장 잘 쓰인다.

7분 읽기

분석: 공개 벤치마크는 더 이상 «프로덕션 품질»을 예측하지 않는다 — 예측하는 평가셋 만드는 법

공개 벤치마크는 좁고 고정돼 있으며 널리 공개된 과제를 잰다. 게다가 학습 데이터 오염이 심해지고 있고, 그 숫자 자체가 최적화 대상이 됐다. 프로덕션 품질은 우리 프롬프트·우리 문서·우리 도구 스키마·우리가 견딜 수 있는 실패에 달려 있는데, 어느 리더보드도 그것을 재지 않는다. 실무의 답은 «실제 사례 50~300건 + 기대 동작 기록»으로 된 비공개 평가셋을 만들어 모델·프롬프트가 바뀔 때마다 돌리고, 가능한 것은 코드로 정확히 검사하고 나머지만 채점 기준을 준 모델 심판에게 맡기는 것이다.

6분 읽기

Anthropic, 사이버 및 정치, 고위험 사용에 대한 Claude 정책 업데이트

Anthropic은 악의적인 컴퓨터 및 네트워크 침해를 금지하고, 정치 콘텐츠에 대한 제한을 좁히고, 기존 법 집행 규칙을 명확히 하고, 고위험 보호 조치를 소비자 대상 출력으로 제한하도록 Claude 사용 정책을 업데이트했습니다. 회사는 개정된 정책이 2025년 9월 15일에 발효될 것이라고 밝혔습니다.

3분 읽기

앤트로픽, AI 교육 서약에 100만 달러 및 새 커리큘럼 약속

앤트로픽은 백악관의 '미래 세대를 위한 서약(Pledge to America’s Youth)' 하에 세 가지 약속을 발표했습니다. 카네기 멜런 대학교의 PicoCTF 프로그램에 100만 달러 투자, 대통령 AI 챌린지 지원, 그리고 K-12 및 고등 교육 강사를 위한 CC 라이선스 기반 AI 활용 능력 커리큘럼 제공입니다. 이 커리큘럼은 어떤 AI 시스템과도 호환됩니다.

2분 읽기

앤트로픽, 경제 연구 기금에 2억 달러 투입

앤트로픽은 AI로 인한 경제적 혼란에 대응하는 외부 연구를 지원하기 위해 글로벌 기금에 2억 달러를 투입하기로 했다. 회사는 직장 관행, 노동자의 직업 전환, 소득 지원, AI 주도 성장의 성과 공유, 공공 투자를 연구하는 대형 프로젝트를 우선 지원할 계획이며, 지원금은 대부분 500만~3,000만 달러가 될 전망이다.

3분 읽기

앤스로픽, 클로드 3.7 소네트 사용 실태 다룬 두 번째 경제지수 보고서 발표

앤스로픽의 두 번째 경제지수 보고서에 따르면 클로드 3.7 소네트 출시 이후 코딩, 교육, 과학, 의료 분야에서 클로드닷에이아이(Claude.ai) 사용이 늘어난 것으로 나타났다. 확장 사고 모드는 기술 직종에서 가장 많이 사용됐다. 보조적 활용 비중은 전체 사용량의 57%로 안정적으로 유지됐으며, 앤스로픽은 630개 범주로 구성된 새로운 사용 분류 체계와 작업 단위 자동화 데이터도 함께 공개했다.

3분 읽기

Mistral, 복잡한 문서 검색을 위한 에이전트형 검색 공개

미스트랄이 복잡한 문서 전반에서 AI 모델이 정보를 반복적으로 검색·검토·검증할 수 있게 해주는 검색 계층인 '에이전틱 서치(Agentic Search)'를 공개했다. 회사 측에 따르면 이는 토큰 사용량과 지연 시간을 줄이면서도 벤치마크 정확도를 개선한다. 스튜디오(Studio)와 바이브(Vibe)의 미스트랄 서치 툴킷(Mistral Search Toolkit) 및 라이브러리(Libraries)를 통해 이용할 수 있다.

2분 읽기

Anthropic, Claude용 경제 지수 커넥터 출시

Anthropic이 AI가 경제에서 어떻게 사용되는지 추적하는 Anthropic Economic Index에 대해 누구나 Claude에게 질문할 수 있는 커넥터를 출시했습니다. 사용자는 claude.ai의 커넥터 메뉴에서 이를 활성화하고 어떤 직업군이 AI를 가장 많이 사용하는지와 같은 질문을 할 수 있으며, 답변은 Index의 데이터에 근거합니다.

2분 읽기

MiniMax, 사운드 태그와 음성 복제 기능을 갖춘 Speech 2.8 출시

MiniMax가 호흡과 망설임을 위한 네이티브 사운드 태그, 10초 샘플을 이용한 음성 클로닝, 노이즈와 왜곡을 줄이도록 설계된 처리 기능을 갖춘 합성 음성 모델인 Speech 2.8을 공개했다. 이 회사는 또한 중국어(만다린)와 일본어에 대한 교차 언어 음성을 개선했으며, 이 모델을 자사 플랫폼과 Audio 제품을 통해 이용할 수 있도록 했다고 밝혔다.

3분 읽기

DeepSeek, V4-Flash-Vision-Exp 멀티모달 모델 공개

딥시크(DeepSeek)가 자사 API 플랫폼에서 실험적 멀티모달 모델인 DeepSeek-V4-Flash-Vision-Exp를 공개했다. 회사 측은 텍스트 작업에서 DeepSeek-V4-Flash와 동등한 성능을 보이면서 비전 기능을 추가했으며, V4-Flash 대비 멀티모달 에이전트 벤치마크 성능이 크게 향상되어 Opus-4.8에 근접했다고 밝혔다. 딥시크는 또한 무료 Files API와 DeepSeek Harness 0.1.1도 함께 출시했다.

2분 읽기

미스트랄과 휴메인, 소버린 AI 협력 발표

미스트랄(Mistral)과 휴메인(HUMAIN)이 사우디아라비아 및 중동 전역의 AI 인프라, 모델 개발, AI 배포를 아우르는 전략적 협력을 발표했다. 양사는 모델을 현지화하고, 초기에는 사이버보안과 음성 분야에 집중하며, 아랍어 성능이 뛰어난 모델을 개발하고, 규제 산업을 대상으로 한 영업을 추진할 계획이다.

2분 읽기

앤트로픽, 500만 달러 규모의 AI 웰빙 연구 지원 프로그램 출범

Anthropic은 AI가 사용자 웰빙에 미치는 영향을 독립적으로 연구하기 위한 500만 달러 규모의 지원금 프로그램을 출범했습니다. 선정된 지원 대상자는 직접적인 자금 지원과 Anthropic 모델 이용 권한 및 기술 지원을 받으며, 독립적으로 오픈소스 평가 도구를 개발하게 됩니다. 신청 마감일은 9월 21일이며, 전체 제안서 제출 초청은 10월 5일까지 진행될 예정입니다.

3분 읽기

분석: 오픈AI가 오픈소스로 푼 것은 모델이 아니라 «하네스»다 — 그게 전략이다

하네스는 모델을 감싼 코드다 — 맥락을 골라 넣고, 도구 호출 루프를 돌리고, 이벤트를 실시간으로 흘려보내고, 긴 대화를 압축하고, 되돌릴 수 없는 행동을 사람 승인 뒤에 세운다. 오픈AI는 코덱스의 하네스(codex exec · app-server · SDK)를 아파치-2.0 으로 공개했다. 누구나 같은 에이전트 루프를 자사 소프트웨어에 심을 수 있고, 그 뒤의 모델 값은 계속 낸다.

6분 읽기

분석: 오픈AI가 코덱스 하네스를 열었다 — 하네스란 무엇이고 «오픈»은 어디까지인가

하네스는 모델을 감싸는 실행 층이다. 일을 붙들고, 긴 작업 내내 맥락을 관리하고, 도구를 호출하고, 이벤트를 흘려보내고, 중단을 허용하고, 사람의 승인을 받아 온다. 오픈AI 는 코덱스의 하네스 — 비대화형 CLI·SDK·app-server — 를 Apache-2.0 으로 공개했다. 포크해 상용 제품에 넣을 수 있다. 모델 가중치는 열리지 않았다. 하네스는 여전히 유료 API 를 부르므로 라이선스 비용은 0 이고 운영 비용은 0 이 아니다.

7분 읽기

분석: 오픈 웨이트 모델은 실제로 얼마나 뒤처져 있나

공개 벤치마크에서 최상급 오픈 웨이트 모델은 프런티어 상용 모델에 근접했고, 많은 일상 작업에서는 차이를 느끼기 어렵다. 남은 격차는 장기 신뢰성, 도구 사용, 아주 긴 컨텍스트, 안전 튜닝에서 드러나며 — 그리고 직접 돌리는 운영 부담에서 드러난다.

4분 읽기

분석: AI 가격은 계속 떨어지는데 왜 청구서는 오르는가

토큰당 가격은 더 나은 하드웨어, 증류된 소형 모델, 서빙 최적화로 크게 떨어졌다. 그런데 소비가 더 빨리 늘었다 — 길어진 컨텍스트, 답 하나에 훨씬 많은 토큰을 만드는 추론형 모델, 사용자 동작 하나를 수십 번의 모델 호출로 바꾸는 에이전트. 단가 하락과 사용량 증가가 겹치면 청구서는 커진다.

3분 읽기

EU AI Act — 이미 시행 중인 의무와 아직 남은 의무

EU AI Act 는 2024년 8월 1일 발효돼 단계적으로 적용된다. 금지 관행과 AI 리터러시 의무는 2025년 2월부터, 범용 AI 모델(GPAI) 의무는 2025년 8월부터, 핵심 고위험 규제는 2026년 8월부터 적용되며, 제품 내장형 고위험 시스템은 2027년에 이어진다.

4분 읽기

분석: 답변 엔진이 정보 탐색을 다시 쓰고 있다 — 그리고 매체의 수익 구조도

답변 엔진은 여러 출처에서 답을 합성해 링크 목록 위나 대신에 보여준다. 그래서 예전에는 방문으로 이어지던 질의가 방문 없이 해결된다. 매체는 노출과 인용이 늘면서 클릭률이 떨어지는 것을 본다 — 모든 답에 페이지뷰가 필요하다고 전제했던 광고 모델이 깨지는 지점이다.

4분 읽기

분석: AI 에이전트가 데모에서 실전으로 넘어갈 때 실제로 바뀐 것

데모는 짧은 정상 경로를 사람이 지켜보며 한 번 돈다. 실전은 감독 없이 수천 가지 변형을 돌리고, 거기서는 단계별 오류율이 곱해지며 넓은 권한이 잘못된 판단 하나를 사고로 만든다. 되는 배포는 범위를 좁히고, 각 단계를 싸게 검증하고, 되돌릴 수 없는 행동마다 관문을 둔다.

4분 읽기