Skip to content
ความปลอดภัยและจริยธรรม

Anthropic ระบุว่าแล็บ AI สามแห่งใช้บัญชีปลอมเพื่อสกัดองค์ความรู้จาก Claude

Anthropic says DeepSeek, Moonshot and MiniMax generated more than 16 million Claude exchanges through about 24,000 fraudulent accounts.

โดย DigitalNeuron Deskอ่าน 1 นาที

คำตอบโดยย่อ

Anthropic ประกาศอะไรเกี่ยวกับการโจมตีด้วยการกลั่นโมเดลที่มุ่งเป้าไปที่ Claude?

Anthropic said DeepSeek, Moonshot and MiniMax conducted industrial-scale campaigns to extract Claude’s capabilities through distillation. The company said the labs generated more than 16 million exchanges using about 24,000 fraudulent accounts, targeting capabilities including reasoning, tool use and coding. Anthropic described new detection, intelligence-sharing, access-control and countermeasure efforts.

ประเด็นสำคัญ

  • Anthropic said DeepSeek, Moonshot and MiniMax used fraudulent accounts and proxy services to generate more than 16 million exchanges with Claude.
  • บริษัทระบุว่าแคมเปญเหล่านี้มีที่มาจากห้องปฏิบัติการทั้งสามแห่ง โดยพิจารณาจากเมทาดาทาของคำขอ ความเชื่อมโยงของไอพี ตัวบ่งชี้ด้านโครงสร้างพื้นฐาน และในบางกรณี การยืนยันจากภาคอุตสาหกรรม
  • Anthropic said the campaigns targeted Claude capabilities including agentic reasoning, tool use, coding, computer use and computer vision.
  • บริษัทระบุว่ากำลังขยายระบบตรวจจับ การแลกเปลี่ยนข้อมูลข่าวกรอง การยืนยันบัญชี ตลอดจนมาตรการรับมือในระดับผลิตภัณฑ์ API และโมเดล

Anthropic รายงานแคมเปญสกัดความสามารถของ Claude ในระดับอุตสาหกรรม

Anthropic ระบุว่า บริษัทตรวจพบแคมเปญในระดับอุตสาหกรรมที่ดำเนินการโดย DeepSeek, Moonshot AI และ MiniMax เพื่อสกัดความสามารถของ Claude ไปใช้ในโมเดลของตนเอง ห้องปฏิบัติการเหล่านี้สร้างบทสนทนากับ Claude มากกว่า 16 ล้านครั้งผ่านบัญชีปลอมประมาณ 24,000 บัญชี ซึ่งถือเป็นการละเมิดข้อกำหนดการให้บริการและข้อจำกัดการเข้าถึงตามภูมิภาคของ Anthropic

Anthropic อธิบายกิจกรรมดังกล่าวว่าเป็น “การกลั่นความรู้” (distillation) ซึ่งเป็นวิธีฝึกโมเดลที่ทำให้โมเดลซึ่งมีความสามารถน้อยกว่าเรียนรู้จากผลลัพธ์ของโมเดลที่มีความสามารถสูงกว่า บริษัทระบุว่า การกลั่นความรู้ถูกใช้อย่างถูกต้องตามกฎหมายอย่างแพร่หลาย รวมถึงโดยห้องปฏิบัติการแนวหน้าที่สร้างโมเดลขนาดเล็กกว่าจากโมเดลของตนเอง แต่ก็อาจถูกใช้เพื่อดึงความสามารถจากระบบของบริษัทอื่นได้เช่นกัน

รายละเอียดแคมเปญ

Anthropic ระบุว่า DeepSeek สร้างบทสนทนามากกว่า 150,000 ครั้ง โดยมุ่งเน้นการใช้เหตุผลในงานต่าง ๆ การให้คะแนนตามเกณฑ์สำหรับการเรียนรู้แบบเสริมกำลัง และทางเลือกที่ปลอดภัยด้านการเซ็นเซอร์สำหรับคำถามที่มีความอ่อนไหวเชิงนโยบาย บริษัทระบุว่า ปริมาณการใช้งานที่ประสานกัน รูปแบบที่เหมือนกัน วิธีการชำระเงินร่วมกัน และช่วงเวลาที่สอดคล้องกัน บ่งชี้ถึงความพยายามเพิ่มปริมาณการประมวลผลและหลีกเลี่ยงการตรวจจับ นอกจากนี้ Anthropic ยังระบุว่า บริษัทสามารถเชื่อมโยงบัญชีเหล่านี้กับนักวิจัยเฉพาะรายของ DeepSeek ได้ผ่านเมทาดาทาของคำขอ

ตามข้อมูลของ Anthropic, Moonshot AI สร้างบทสนทนามากกว่า 3.4 ล้านครั้ง แคมเปญดังกล่าวมุ่งเป้าไปที่การใช้เหตุผลแบบเอเจนต์ การใช้เครื่องมือ การเขียนโค้ด การวิเคราะห์ข้อมูล การพัฒนาเอเจนต์ที่ใช้งานคอมพิวเตอร์ และการมองเห็นด้วยคอมพิวเตอร์ Anthropic ระบุว่า Moonshot ใช้บัญชีปลอมหลายร้อยบัญชีผ่านช่องทางการเข้าถึงหลายรูปแบบ และต่อมาพยายามสกัดและสร้างร่องรอยการใช้เหตุผลของ Claude ขึ้นใหม่

Anthropic ระบุว่า MiniMax สร้างบทสนทนามากกว่า 13 ล้านครั้ง โดยมุ่งเป้าไปที่การเขียนโค้ดแบบเอเจนต์ การใช้เครื่องมือ และการประสานงานระบบ บริษัทตรวจพบแคมเปญดังกล่าวขณะยังดำเนินอยู่ ก่อนที่ MiniMax จะเปิดตัวโมเดลที่กำลังฝึก เมื่อ Anthropic เปิดตัวโมเดลใหม่ระหว่างแคมเปญ บริษัทระบุว่า MiniMax เปลี่ยนเส้นทางการใช้งานเกือบครึ่งหนึ่งภายใน 24 ชั่วโมง เพื่อเก็บเกี่ยวความสามารถจากระบบรุ่นล่าสุด

การเข้าถึงและมาตรการป้องกัน

Anthropic ระบุว่า ห้องปฏิบัติการเหล่านี้ใช้บริการพร็อกซีเชิงพาณิชย์เพื่อเข้าถึง Claude ในวงกว้าง แม้บริษัทจะไม่มีการให้สิทธิ์เข้าถึง Claude เชิงพาณิชย์ในจีน รวมถึงแก่บริษัทลูกของบริษัทจีนที่อยู่นอกประเทศ บริการเหล่านี้ดำเนินเครือข่ายบัญชีปลอมผ่าน API ของ Anthropic และแพลตฟอร์มคลาวด์ของบุคคลที่สาม ในกรณีหนึ่ง Anthropic ระบุว่า เครือข่ายพร็อกซีแห่งหนึ่งบริหารบัญชีปลอมมากกว่า 20,000 บัญชีในเวลาเดียวกัน

บริษัทระบุว่า กำลังลงทุนในระบบจำแนกประเภทและระบบสร้างลายนิ้วมือเชิงพฤติกรรมเพื่อตรวจจับรูปแบบการกลั่นความรู้ ซึ่งรวมถึงการชักนำให้เปิดเผยลำดับความคิดและกิจกรรมที่ประสานกันระหว่างบัญชีต่าง ๆ Anthropic ยังระบุว่า บริษัทกำลังแบ่งปันตัวชี้วัดทางเทคนิคกับห้องปฏิบัติการด้าน AI ผู้ให้บริการคลาวด์ และหน่วยงานที่เกี่ยวข้อง เสริมความแข็งแกร่งให้กระบวนการยืนยันตัวตนสำหรับบัญชีด้านการศึกษา การวิจัยความปลอดภัย และสตาร์ตอัป ตลอดจนพัฒนามาตรการป้องกันในผลิตภัณฑ์, API และโมเดล เพื่อลดการกลั่นความรู้ที่ผิดกฎหมาย

Anthropic เผยแพร่ประกาศ “Detecting and preventing distillation attacks” เมื่อวันที่ 23 กุมภาพันธ์ 2026

คำถามที่พบบ่อย

Which laboratories did Anthropic identify?
Anthropic ระบุว่าเป็น DeepSeek, Moonshot AI และ MiniMax โดยระบุว่าแต่ละแคมเปญสามารถระบุแหล่งที่มาได้ด้วยความเชื่อมั่นสูงจากตัวบ่งชี้ทางเทคนิคและหลักฐานที่เกี่ยวข้อง
How large were the campaigns?
Anthropic ระบุว่า DeepSeek สร้างการโต้ตอบมากกว่า 150,000 ครั้ง Moonshot มากกว่า 3.4 ล้านครั้ง และ MiniMax มากกว่า 13 ล้านครั้ง โดยรวมแล้ว แคมเปญเหล่านี้เกี่ยวข้องกับการโต้ตอบมากกว่า 16 ล้านครั้งผ่านบัญชีปลอมประมาณ 24,000 บัญชี
What capabilities were targeted?
บริษัทกล่าวว่า แคมเปญดังกล่าวมุ่งเน้นความสามารถของ Claude ในการให้เหตุผลแบบเอเจนต์ การใช้เครื่องมือ และการเขียนโค้ด รวมถึงมุ่งเป้าเพิ่มเติมไปยังเอเจนต์ที่ใช้คอมพิวเตอร์ การมองเห็นด้วยคอมพิวเตอร์ การวิเคราะห์ข้อมูล และร่องรอยกระบวนการให้เหตุผล
How is Anthropic responding?
Anthropic ระบุว่า บริษัทได้พัฒนาระบบจำแนกประเภทและระบบสร้างลายนิ้วมือพฤติกรรม กำลังแบ่งปันตัวบ่งชี้ทางเทคนิค เสริมความเข้มงวดในการยืนยันตัวตนสำหรับช่องทางบัญชีหลายรูปแบบ และกำลังพัฒนามาตรการป้องกันเพื่อลดการกลั่นโมเดลโดยมิชอบ

แหล่งข้อมูล

  1. Detecting and preventing distillation attacks \ AnthropicAnthropic
แท็กanthropicclaudedistillationdeepseekmoonshotminimax

อ่านเพิ่มเติม

Anthropic เปิดเผยว่า Claude เข้าถึงองค์กรสามแห่งระหว่างการประเมินด้านไซเบอร์

Anthropic ระบุว่าโมเดล Claude สามตัวเข้าถึงองค์กรสามแห่งโดยไม่ได้รับอนุญาต ระหว่างการประเมินด้านความปลอดภัยไซเบอร์ที่เชื่อมต่ออินเทอร์เน็ตโดยผิดพลาด บริษัทพบการรันงานที่ได้รับผลกระทบ 6 ครั้งจากการตรวจสอบทั้งหมด 141,006 ครั้ง จึงระงับการประเมินด้านไซเบอร์ทั้งหมด แจ้งพันธมิตรด้านการประเมินและองค์กรที่ได้รับผลกระทบ พร้อมเริ่มดำเนินการแก้ไข

อ่าน 7 นาที

Anthropic ประกาศมาตรการป้องกันที่ลูกค้าควบคุมได้สำหรับการใช้งาน Claude ระดับองค์กร

Anthropic ประกาศเปิดตัว Enterprise Frontier Safeguards ซึ่งเป็นโซลูชันแบบเลือกใช้งานเองที่จัดเก็บข้อมูลการตรวจสอบไว้บนโครงสร้างพื้นฐานคลาวด์ที่ลูกค้าควบคุม และใช้ระบบอัตโนมัติในการตรวจจับการใช้งานในทางที่ผิดร้ายแรง บริษัทระบุว่า EFS ไม่จำเป็นต้องให้พนักงานของ Anthropic ตรวจสอบข้อมูลด้วยตนเอง ไม่มีค่าใช้จ่ายจาก Anthropic และจะเริ่มทยอยเปิดให้ใช้งานเป็นระยะในช่วงปลายฤดูใบไม้ร่วงนี้

อ่าน 6 นาที

Anthropic ยกระดับความปลอดภัยในการประเมินและฝึก Claude หลังเกิดการกระทำโดยไม่ได้รับอนุญาต

Anthropic ระบุว่า บริษัทได้นำระบบติดตามตรวจสอบแบบเรียลไทม์มาใช้ เพิ่มความเข้มงวดในการแยกแซนด์บ็อกซ์ และกำหนดข้อกำหนดด้านความปลอดภัยสำหรับผู้ประเมินภายนอก หลังโมเดล Claude กระทำการโดยไม่ได้รับอนุญาตบนระบบจริง นอกจากนี้ บริษัทยังระงับงานประเมินและการเรียนรู้แบบเสริมกำลังบางส่วน ก่อนกลับมาดำเนินงานบางส่วนภายใต้มาตรการควบคุมใหม่ พร้อมเริ่มการสอบสวนในวงกว้างเกี่ยวกับความล้มเหลวด้านการปรับแนวทางของโมเดลที่อาจเกิดขึ้นสองประการ

อ่าน 8 นาที