ai-gpt6-sol-luna-api-caching

OpenAI bringt GPT-6 Sol und Luna: schnellere KI zum halben API-Preis

LONDON (IT BOLTWISE) – OpenAI erweitert die GPT-6-Familie um Sol und Luna. Beide Modelle sollen professionelle Aufgaben, Coding und Agenten-Workflows in einer praktischeren Kostenklasse ermöglichen, weil OpenAI zentrale Inferenz- und Caching-Mechanismen verbessert. Im API-Betrieb senkt der Anbieter die Preise im Vergleich zu GPT-5.6-Vorabpreisen um 50% bei Sol und um 50% bei Luna. Zusätzlich passt OpenAI […]

ai-kimi-k3-amazon-bedrock

Kimi K3 startet auf Amazon Bedrock: Reasoning-Modell mit 1 Mio. Token Kontextfenster

LONDON (IT BOLTWISE) – Das chinesische KI-Modell Kimi K3 von Moonshot AI ist auf Amazon Bedrock verfügbar. Das Reasoning-Modell liefert ein Kontextfenster von einer Million Token und wird in allen AWS-Regionen als allgemein nutzbares Modell angeboten. Zusätzlich nennt der Anbieter ein Prompt-Caching ab 1.024 Token sowie Bereitstellungsprofile für unterschiedliche Anforderungen an die Datenresidenz. Für Unternehmen […]

ai-gpt-5-6-cursor-mobile-open-source

GPT-5.6-Serie setzt auf drei Modelle statt Flaggschiff – und Cursor geht aufs Handy

SAN FRANCISCO / LONDON (IT BOLTWISE) – OpenAI stellt die GPT-5.6-Serie mit drei Modellvarianten vor und nutzt dafür eine gestaffelte Ausroll-Strategie. Parallel startet Cursor mit einer iOS-App sowie einer progressiven Web-App für Android, nachdem SpaceX das Unternehmen übernommen hat. Für Entwickler ist vor allem das Zusammenspiel aus mobiler KI-gestützter Programmierung, API-Vergünstigungen und neuen Open-Source-Konkurrenten relevant. […]

ai-realtime-api-openai-stimmen-preissenkung

OpenAI erweitert Realtime API mit neuen Stimmen und Preissenkung für Entwickler

MÜNCHEN (IT BOLTWISE) – OpenAI erweitert seine Realtime API mit neuen Stimmen und senkt die Kosten für Entwickler. OpenAI hat heute die Realtime API aktualisiert, die sich derzeit in der Beta-Phase befindet. Die Plattform bietet nun fünf neue Stimmen für Sprach-zu-Sprach-Anwendungen und reduziert die Kosten durch eine innovative Caching-Methode für häufige Anfragen. Nutzer der Realtime […]

ai-prompt-caching-optimierung

Claude AIs Prompt Caching spart bis zu 90% der Kosten

MÜNCHEN (IT BOLTWISE) – Anthropics neues Prompt Caching für Claude AI-Modelle verspricht, die Kosten um bis zu 90% zu senken und die Leistung durch eine Reduzierung der Latenzzeit um bis zu 85% zu verbessern. Anthropic hat eine öffentliche Beta-Version seines Prompt Caching veröffentlicht, das sich an Entwickler richtet, die Claude AI-Modelle verwenden. Dieses Feature ermöglicht […]

1.058 Leser gerade online auf IT BOLTWISE


KI-Jobs