DeepSeek legt zweite Finanzierungsrunde auf EisDas chinesische KI-Start-up DeepSeek setzt seine zweite Finanzierungsrunde aus. Ãber seine Pläne für einen Börsengang sagte es jedoch nichts.
Anthropic: Neues Claude Opus 5 soll Sicherheitslücken auf Mythos-5-Niveau findenClaude Opus 5 findet Sicherheitslücken ähnlich gut wie Mythos 5, sagt Anthropic. Beim Ausnutzen der Lücken sehe es aber anders aus.
Robostral Navigate: Mistral veröffentlicht Einzelkamera-KI für die RoboterMistral AI stellt Robostral Navigate vor â ein 8B-Modell, das Roboter allein per RGB-Kamera und Sprachanweisung navigiert.
So würde eine KI als Start-up-Chef abschneidenPrinceton-Forscher lassen KI-Modelle 500 Tage ein Start-up führen. Nur drei schaffen es ins Plus â eine simple Wirtschafts-Weisheit ist besser als fast alle.
Mistral OCR 4: Dokumentenanalyse für 170 SprachenMistral AI hat OCR 4 vorgestellt. Das Modell liest nicht nur Text aus, sondern strukturiert Inhalte für Enterprise Search und RAG-Pipelines.
GPT-5.5-Cyber schlägt Mythos: Update für Sicherheitsmodell von OpenAIMit einer Sicherheitsinitiative geht OpenAI in Konkurrenz zu Anthropics Mythos und bietet zudem einen Sicherheits-Review-Service für Open-Source-Projekte.
Wichtigster Server-CPU-Benchmark bekommt ein Update nach 9 JahrenCPU-Designer satteln auf den Benchmark SPEC CPU 2026 um. Die neue Version läuft sogar auf einem Raspberry Pi.
Per Benchmark KI-Dummheit entlarven: Interview über KI-BullshitMit seinem Bullshit-Benchmark testet Peter Gostev, ob Chatbots auf Unsinns-Fragen hereinfallen. Im Interview spricht er über sinnvolle Tests für Sprachmodelle.
MacBook Neo: Billiges Kühlpad erlaubt konstantere LeistungApples Einsteiger-Notebook kommt ohne Lüfter aus. Die Hitzeabfuhr bei hoher Leistungsabforderung ist nicht ideal. Ein Bastler will helfen.
KI-Benchmark: Inferenz-Engines vLLM, SGLang und NIM im VergleichInferenz-Engine entscheidet über Durchsatz, Latenz und Stabilität groÃer Sprachmodelle unter Last. Ein praxisnaher Benchmark vergleicht die drei Werkzeuge.
MacBook Neo: SSD deutlich langsamer als beim M5, SoC hinter iPhone 17eErste Benchmarks des neuen Einsteiger-MacBooks zeigen, wo sich die Hardware platziert. Die Frage ist, ob Einschränkungen den Alltag tangieren.
Ziel oder Regeln: Benchmark testet Verhalten von KI-AgentenEin neuer Benchmark soll testen, ob autonome KI-Agenten sich über SicherheitsmaÃnahmen hinwegsetzen, um ihr vorgegebenes Ziel zu erreichen.
Vergleichs-Benchmark Cinebench 2026 kostenlos erschienenDer beliebte Vergleichs-Benchmark Cinebench hat eine neue Version. Diese enthält explizit einen Test für Simultaneous Multithreading.
Konfrontation mit der Realität: Neuer KI-Benchmark OfficeQADatabricks stellt OfficeQA vor: Ein Open-Source-Benchmark, der KI-Agenten in realitätsnahen Unternehmensszenarien testet.
Mittwoch: Verhaftungen nach Krypto-Betrug, AMDs Rekordumsatz auch dank RadeonEU-Erfolg bei Finanzbetrug + AMD weiter mit Oberwasser + MacBook-Gerücht um A-Chip + Plugin gegen Cookie-Banner + Telefónica mit Umsatzrückgang + Bit-Rauschen
Bit-Rauschen, der Prozessor-Podcast: Leidige Benchmark-TricksereienBenchmarks sollen faire Vergleiche von Geräten und Komponenten ermöglichen, werden aber gerne umgebogen: Folge 2025/23 des Podcasts Bit-Rauschen.
Wie gut sind KI-Coding-Agenten? JetBrains startet Benchmark-PlattformDie offene Benchmark-Plattform DPAI Arena soll die Produktivität von KI-gestützten Entwicklungstools messen. Den Start macht das Java/Spring-Ãkosystem.
Grafikkarten-Wegweiser 2025: Performance-GuideSpiele brauchen starke 3D-Grafikkarten und auch Bildbearbeitung â mit oder ohne KI â nutzt nur allzu gern die GPU-GigaFlops. Wir vergleichen 70 Desktop-Modelle.
Erste Benchmarks: Snapdragon 8 Elite Gen 5 legt eine Schippe draufDer neue Smartphone-Prozessor von Qualcomm ist in ersten Tests deutlich schneller als sein Vorgänger.
Wie OpenAI erklärt, warum LLMs bei völliger Ahnungslosigkeit sicher auftretenIn einem Paper benennt OpenAI selbstbewusste Fehler von groÃen Sprachmodellen als gewollte technische Schwäche. Das Beheben erfordert ein Umdenken der Branche.
Xbench: Chinesischer KI-Benchmark prüft Modelle auf AlltagstauglichkeitEin neuer Benchmark aus China testet KI-Modelle auf ihre Fähigkeit, reale Aufgaben zu lösen. Er soll Unternehmen bei Investitionsentscheidungen in KI helfen.
Wie c't Grafikkarten testet: Spiele-Benchmarks, Lautstärke, LeistungsaufnahmeRechenleistung, Speichermenge, Displaytechnik sowie die Lautheit des Kühlers sind KenngröÃen für Grafikkarten. Wir stellen unser aktuelles Testverfahren vor.