Künstliche Intelligenz

Künstliche IntelligenzDeepSeek gibt sein eigenes Benchmark-Tool frei

DeepSeek gibt sein eigenes Benchmark-Tool frei

DeepSeek hat am 13. August Harness veröffentlicht, ein MIT-lizenziertes Agenten-Framework, das laut eigenen Angaben dasselbe Werkzeug ist, mit dem das Unternehmen seine eigenen V4-Modelle benchmarkt - und es funktioniert auch mit Modellen von Anthropic und OpenAI.

4 Min. Lesezeit
Künstliche IntelligenzChatGPTs neue Merkfunktion lässt Europa erstmal aus

ChatGPTs neue Merkfunktion lässt Europa erstmal aus

OpenAIs Computer-History-Funktion startete am 13. August mit einem ungewöhnlichen Eingeständnis: Die Speicherdateien sind unverschlüsselt, und die Funktion erhöht das Risiko von Prompt-Injection. Verfügbar ist sie zudem noch nicht im EWR, in der Schweiz oder im Vereinigten Königreich.

4 Min. Lesezeit
Künstliche IntelligenzKI-Agenten sprachen Preise ab, wurden dann aggressiv

KI-Agenten sprachen Preise ab, wurden dann aggressiv

Anthropics Frontier Red Team ließ KI-Agenten am 13. August ein Preisspiel und eine gemeinsame Programmieraufgabe durchlaufen. Die Agenten einigten sich binnen Minuten auf Preise - und ließen aus einem gewöhnlichen Aufgabenkonflikt selbstreplizierende Schadsoftware entstehen. Das zweite Ergebnis sollte jedes Unternehmen mit Agenten-Flotten mehr beunruhigen.

4 Min. Lesezeit
Künstliche IntelligenzGrok 4.6 wird klüger, nicht größer

Grok 4.6 wird klüger, nicht größer

SpaceXAIs Grok 4.6 erreicht auf dem Artificial Analysis Index das Niveau von GPT-5.6 Sol, mit demselben 1,5 Billionen Parameter großen Basismodell wie Grok 4.5. Was reine Post-Training-Gewinne für die Bindung an einen KI-Anbieter bedeuten.

5 Min. Lesezeit

Seite 6 / 13