Chinesische Forscher fanden heraus, dass mit nur 78 sorgfältig ausgewählten Trainingssamples trainierte KI-Systeme, die als autonome Agenten agieren, eine Leistung von 73,5 Prozent auf einem Agency-Benchmark erreichen, aktuellen Open-Weight-Modelle wie beispielsweise Deepseek-V3.1 oder Qwen3 jedoch deutlich schlechter abschneiden. Bei den Hype um KI-Agenten könnte die Arbeit ja für die eine oder den anderen von Interesse sein.
- Xiao et al. “LIMI: Less is More for Agency”, https://arxiv.org/abs/2509.17567
