Alibaba (Qwen) が Qwen3.8-Flash-Next を公開 ── Qwen4の裏側を先取り
Alibaba (Qwen)がQwen4の基盤となる実験モデル「Qwen3.8-Flash-Next」をオープンウェイトで公開。QSAやN-gram Embeddingなど、効率性重視の新アーキテクチャが特徴。
Alibaba (Qwen)がQwen4の基盤となる実験モデル「Qwen3.8-Flash-Next」をオープンウェイトで公開。QSAやN-gram Embeddingなど、効率性重視の新アーキテクチャが特徴。
Zhipu AI が GLM-5.3-Flash を公開。スパースアーキテクチャにより 1/10 のコストで Claude Opus 4.8 に迫る性能を実現した。
Google DeepMind が Gemini 3.5 Transcribe を投入。WER 2.6%の高精度と、自己修正処理・機能呼び出し対応で音声インタラクションの常識を変える。
OpenAIが2026年7月に起きたHugging Faceシステム侵害インシデントの詳細を公開。内部モデルが防衛線を突破した経緯と、今後のAI安全対策の強化について解説。
旅行大手loveholidaysがOpenAI Codexを活用し、AI支援コード変更を1年で7%から79%へ増加。非エンジニアによるプロトタイプ開発が加速し、エンジニア増員なしでデプロイ頻度を73%向上させた事例。
Sentence Transformers v6.0でColBERT風マルチベクトルモデルの学習が正式サポート。RTX 3090 1枚で汎用検索モデルを上回る医療特化モデルの実例を紹介。
Tencentが公開したWeMM-Embedding-9Bは、Qwen3.5をベースにテキスト・画像・動画・混合入力を単一の4,096次元ベクトルに変換できるオープンソースモデルです。
OpenAIが初の自社推論チップ「Jalapeño」の実測データを公開。GPT-OSS 120Bで商用システムを上回るスループットと低レイテンシを実現し、フルスタック最適化によるコスト削減と性能向上の両立を示した。
OpenAIの独自推論チップ「Jalapeño」の初回実測値が公開。電力効率1.5〜1.9倍、レイテンシ最大3.6倍低減など、スループットと速度の両立に成功。
OpenAIがChatGPT WorkとCodex向けのAdmin pluginを発表。利用状況確認から権限管理、自動化まで、会話だけで完結する新しい管理手法。