Research

Research

15+ publications at top-tier AI conferences. 20 patents filed. Built with leading academic and industry partners — and every finding ships into product.
Full Publication List
arXiv 2026*

NOLLI: A Difficulty-Calibrated Puzzle Benchmark for Diagnosing the English-Korean Performance Gap

Difficulty-calibrated English-Korean puzzle benchmark with 7,500 items pinpointing where Korean performance gaps arise

NeurIPS 2026 (E&D)

Global PIQA: Evaluating Commonsense Reasoning Across 100+ Languages and Cultures

Participatory commonsense benchmark in 141 language varieties, hand-built by 350+ researchers from 65+ countries

arXiv 2026*

EgoSafetyBench: A Diagnostic Egocentric Video Benchmark for Evaluating Embodied VLMs as Runtime Safety Guards

1,200 robot-view video scenarios testing whether VLM guards catch real hazards without over-alarming

arXiv 2026*

When Context Flips, Safety Breaks: Diagnosing Brittle Safety in Aligned Language Models

Context-flip evaluation revealing models cling to safety rules even when the safe action becomes harmful

NeurIPS 2026 (E&D)

XL-SafetyBench: A Country-Grounded Cross-Cultural Benchmark for LLM Safety and Cultural Sensitivity

Country-grounded safety benchmark with 5,500 cases across 10 country-language pairs

arXiv 2026*

PHASOR: Phase-Anchored Universal Action Representations for Humanoid Embodiments

Embodiment-agnostic action embeddings anchoring humanoid robots to a shared human motion manifold

KDD WS 2026

NRT-Bench: Benchmarking Multi-Turn Red-Teaming of LLM Operator Agents in Safety-Critical Control Rooms

Multi-turn adversarial red-teaming of LLM operator agents in a simulated nuclear control room

ECCV 2026

When Cars Have Stereotypes: Auditing Demographic Bias in Objects from Text-to-Image Models

SODA framework revealing demographic bias in generated objects across 8,000 images

ACL 2026

COMPASS: Evaluating Organization-Specific Policy Alignment in LLMs

Framework for evaluating LLM compliance with enterprise-specific allow/deny policies

CVPR 2026

Fine-Grained Multi-Image Object Hallucination Benchmark

A comprehensive benchmark for evaluating object hallucination across multiple images in vision-language models

ACL 2026

What Users Leave Unsaid: Under-Specified Queries Limit Vision-Language Models

HAERAE-Vision benchmark revealing VLM failures on ambiguous and incomplete queries

Nature 2026

Humanity's Last Exam

Frontier AI evaluation benchmark with 3,000+ expert-level questions across disciplines

AISTATS 2026

Towards Motion-aware Referring Image Segmentation

Motion-aware approach for referring image segmentation with improved temporal understanding

WACV 2026

Better Safe Than Sorry? Overreaction Problem of Vision Language Models in Visual Emergency Recognition

VLMs misclassify 31–96% of safe situations as dangerous in visual emergency recognition

LREC 2026

Redefining Evaluation Standards: A Unified Framework for Evaluating the Korean Capabilities of Language Models

A unified framework for evaluating the Korean capabilities of language models

ICLR 2026

Jailbreaking on Text-to-Video Models via Scene Splitting Strategy

First systematic black-box jailbreak for T2V models, achieving 70–84% success rates

arXiv 2025*

When Good Sounds Go Adversarial: Jailbreaking Audio-Language Models with Benign Inputs

Jailbreaking audio-language models with benign-sounding adversarial inputs

arXiv 2025

Eliciting and Analyzing Emergent Misalignment

Conversational red-teaming to elicit misalignment through narrative immersion and emotional pressure

ICML 2025

ELITE: Enhanced Language-Image Toxicity Evaluation

Benchmark for evaluating toxicity across language-image multimodal models

IEEE-EMBS 2025

PatientSafeBench: Evaluating Safety of Medical LLMs

Safety evaluation framework for patient-facing medical AI systems

NeurIPS WS 2025

ObjexMT: Objective Extraction & Metacognitive Calibration

Benchmarking whether LLM judges can recover hidden objectives in jailbreak transcripts

NeurIPS WS 2025

X-Teaming Evolutionary M2S

LLM-guided evolution for automated multi-turn jailbreak template discovery

ACL WS 2025

One-Shot is Enough: Consolidating Multi-Turn Attacks into Efficient Single-Turn Prompts for LLMs

Compressing multi-turn jailbreak strategies into single-turn attacks

ACL 2025

sudo rm -rf agentic_security

Systematic security analysis of autonomous AI agent vulnerabilities · Industry Track

ACL 2025

Representation Bending for Large Language Model Safety

Manipulating LLM internal representations to reduce harmful outputs

* Under review / target venue

Patents
2025.12

AI Security Testing Integrated Framework and Visual Flow-Based Execution System

DB25-0017-KR0

2025.09

Multimodal Content Policy Violation Detection System

DB25-0016-KR0

2025.09

AI-Based NER Detection Guardrail

DB25-0015-KR0

2025.03

Domain-Specific AI Guardrail System

10-2025-0038904

2024.09

AI Guardrail System

10-2024-0124354

2024.08

Red Teaming Method for Security Assessment

10-2024-0116863

Open Source
GitHub

Video2Robot

200K+ views, 540+ stars on LinkedIn & X

Hugging Face

AIM Intelligence

Public models & datasets for AI safety research

Collaborate with us on AI safety research.

From joint publications to enterprise security assessments — let's advance AI safety together.

TALK TO AN EXPERTVIEW ON HUGGING FACE
aim

Ready to secure your AI?

Consult with AIM Intelligence's security experts and request a free red teaming demo optimized for your system.

EXPLORE PLATFORM