Tagged articles

multilingual evaluation

2 articles · Page 1 of 1
Design Hub
Design Hub
Jul 14, 2026 · Artificial Intelligence

Will Claude’s Personality Change? Anthropic Shows Model and Language Shift Its Values

Anthropic’s study reveals that Claude’s expressed values vary across model versions and languages, compressing over 3,300 value expressions into four behavioral axes—such as warmth vs rigor—demonstrating that switching models or languages can alter the assistant’s feedback style, risk tolerance, and honesty.

AnthropicClaudeLarge Language Models
0 likes · 14 min read
Will Claude’s Personality Change? Anthropic Shows Model and Language Shift Its Values
21CTO
21CTO
Nov 5, 2025 · Artificial Intelligence

Why OpenAI Is Building a New Indian Language Benchmark (IndQA) and What It Means for AI

OpenAI acknowledges that existing multilingual AI benchmarks like MMMLU are saturated and insufficient for cultural nuance, so it is launching IndQA—a comprehensive test covering 12 Indian languages and ten cultural domains—to better evaluate models' understanding and reasoning across diverse regional contexts.

AI benchmarksIndQAIndian languages
0 likes · 4 min read
Why OpenAI Is Building a New Indian Language Benchmark (IndQA) and What It Means for AI