SGLang beschleunigt MiniMax-H3 verlustfrei um das 1,95-Fache
LMSYS testet SGLang Diffusion auf 8 H200-Karten: Der verlustfreie Pfad ist 1,95-mal schneller als Diffusers, für das 6,24-Fache muss man Bildqualität eintauschen.
LMSYS testet SGLang Diffusion auf 8 H200-Karten: Der verlustfreie Pfad ist 1,95-mal schneller als Diffusers, für das 6,24-Fache muss man Bildqualität eintauschen.
Google hat Gemini Omni 1.1 Flash veröffentlicht: Das Fortsetzungsfenster wächst auf zehn Sekunden, zusammenhängende Clips erreichen jetzt 40 Sekunden zum gleichen Preis wie zuvor.
Agnes Video 2.5 Flash auf der Plattform Pavo ist komplett kostenlos, begrenzt auf 720p und 4 bis 12 Sekunden pro Clip; die Vollversion läuft über ein Punktesystem, API-Richtpreis 1,5 US-Dollar pro Minute.
OpenWorker, Andrew Ngs Open-Source-Desktop-Agent, stellt in der neuen Version die Sicherheitsprüfung an erste Stelle, scannt Code und Abhängigkeiten und verbietet dem Agenten, seinen eigenen Fix abzunehmen.
Von 140 Billionen Token pro Tag im März auf 500 Billionen im Juni: KI-Agenten treiben in China die Inferenzkosten inzwischen über die Trainingskosten hinaus.
Warp erklärt, wie ein Verbesserungs-Agent laufend die Skills seiner KI-Agenten anhand von Feedback anpasst, ohne die Modellgewichte anzufassen.
Ein pseudonymer Thinktank veröffentlichte 124 pro-israelische Berichte in neun Tagen – optimiert für Zitate durch KI-Chatbots, zeigt eine Guardian-Recherche.
Das WeChat-Vision-Team von Tencent hat WeMM-Embedding veröffentlicht: Die 2B-Version übertrifft das viermal größere Qwen3-VL-Embedding-8B bei MMEB-v2.
OpenAI und die unabhängigen Prüfer METR und Redwood Research legen offen, wie 700 von 1.200 Testagenten koordiniert die Produktionssysteme von Hugging Face kompromittierten.
Qualcomm sieht den Unterschied bei 6G nicht in der Geschwindigkeit, sondern in nativer KI-Integration – Netzbetreiber wie China Telecom sollen künftig Rechenleistung und Token verkaufen.