OpenAI bringt GPT-6 Sol und Luna: schnellere KI zum halben API-Preis
LONDON (IT BOLTWISE) – OpenAI erweitert die GPT-6-Familie um Sol und Luna. Beide Modelle sollen professionelle Aufgaben, Coding und Agenten-Workflows in einer praktischeren Kostenklasse ermöglichen, weil OpenAI zentrale Inferenz- und Caching-Mechanismen verbessert. Im API-Betrieb senkt der Anbieter die Preise im Vergleich zu GPT-5.6-Vorabpreisen um 50% bei Sol und um 50% bei Luna. Zusätzlich passt OpenAI […]
Kimi K3 startet auf Amazon Bedrock: Reasoning-Modell mit 1 Mio. Token Kontextfenster
LONDON (IT BOLTWISE) – Das chinesische KI-Modell Kimi K3 von Moonshot AI ist auf Amazon Bedrock verfügbar. Das Reasoning-Modell liefert ein Kontextfenster von einer Million Token und wird in allen AWS-Regionen als allgemein nutzbares Modell angeboten. Zusätzlich nennt der Anbieter ein Prompt-Caching ab 1.024 Token sowie Bereitstellungsprofile für unterschiedliche Anforderungen an die Datenresidenz. Für Unternehmen […]
GPT-5.6-Serie setzt auf drei Modelle statt Flaggschiff – und Cursor geht aufs Handy
SAN FRANCISCO / LONDON (IT BOLTWISE) – OpenAI stellt die GPT-5.6-Serie mit drei Modellvarianten vor und nutzt dafür eine gestaffelte Ausroll-Strategie. Parallel startet Cursor mit einer iOS-App sowie einer progressiven Web-App für Android, nachdem SpaceX das Unternehmen übernommen hat. Für Entwickler ist vor allem das Zusammenspiel aus mobiler KI-gestützter Programmierung, API-Vergünstigungen und neuen Open-Source-Konkurrenten relevant. […]
OpenAI erweitert Realtime API mit neuen Stimmen und Preissenkung für Entwickler
MÜNCHEN (IT BOLTWISE) – OpenAI erweitert seine Realtime API mit neuen Stimmen und senkt die Kosten für Entwickler. OpenAI hat heute die Realtime API aktualisiert, die sich derzeit in der Beta-Phase befindet. Die Plattform bietet nun fünf neue Stimmen für Sprach-zu-Sprach-Anwendungen und reduziert die Kosten durch eine innovative Caching-Methode für häufige Anfragen. Nutzer der Realtime […]
Claude AIs Prompt Caching spart bis zu 90% der Kosten
MÜNCHEN (IT BOLTWISE) – Anthropics neues Prompt Caching für Claude AI-Modelle verspricht, die Kosten um bis zu 90% zu senken und die Leistung durch eine Reduzierung der Latenzzeit um bis zu 85% zu verbessern. Anthropic hat eine öffentliche Beta-Version seines Prompt Caching veröffentlicht, das sich an Entwickler richtet, die Claude AI-Modelle verwenden. Dieses Feature ermöglicht […]






#Sophos