OpenAIが2026年10月に予定した新モデル「GPT-6.1 Astra」の公開を中止
OpenAIが2026年10月に予定していた新モデル「GPT-6.1 Astra」の一般公開を中止しました。自社の安全基準を満たさなかったことが理由と報じられています。
「LLM」に関連する記事を新しい順に並べています。
OpenAIが2026年10月に予定していた新モデル「GPT-6.1 Astra」の一般公開を中止しました。自社の安全基準を満たさなかったことが理由と報じられています。
AIのタスク難易度を判断し、最適なモデルを自動で選ぶ「Jev Router」がOpenRouterで利用可能になりました。高速・安価な「Jev」を活用した、効率的なAI利用の仕組みについて解説します。
4Bの小型AIに強化学習を施し、PostgreSQLの標準プランより1.81倍高速なクエリプランを生成できたという報告。その可能性と課題を解説します。
OpenAIがGPT-6の低コストモデル「Sol」「Luna」および改良版「GPT-6.1 Sol」を公開。API料金を大幅に引き下げ、高性能AIの普及を加速させます。
AIでのプログラム修正時、単価の安いモデルを選ぶと結果的にコストが高くなる場合があることがFiddlerの研究で分かりました。精度と費用の関係について整理します。
元OpenAI研究者が創業したTypeSafe AIが、意思決定に特化したAIモデル「Jev」を発表。文章生成ではなく分類や判定を担う、LLMとは異なるアプローチの狙いを探ります。
米PrismMLがQwen3.8 27Bをベースにした軽量モデル「Ternary Bonsai 2 27B」を発表。性能を98.2%維持しつつメモリ消費を大幅に削減し、ローカル環境での効率的な運用が期待されます。
AIモデルが同じでも、制御する「ハーネス」次第で費用や性能が変わる可能性が判明。カリフォルニア大学バークレー校らの検証結果から、AI開発の新たな最適化ポイントを探ります。
TypeSafe AIが発表した新モデル「Jev」は、LLMとは異なる手法でGPT-5.6 Terra級の性能を低コスト・高速に実現。AI処理の効率化に注目が集まります。
Sakana AIが「Fugu Ultra v2」と「Fugu Max」を発表。1つの巨大モデルに頼らず、複数のAIを使い分けるオーケストレーション型で、有力モデル超えの性能をうたいます。
Inceptionが発表した「Mercury 2.5」は、拡散モデルを用いて文章を並行生成する新しいAIモデルです。毎秒1107トークンの高速出力と高い性能、低コストな提供が注目されています。
NVIDIAが時価総額5兆ドル(約780兆円)を達成。あわせて家庭用PCの計算リソースをAIに活用する「NVIDIA PAIR」の展開についても整理します。
AIエンジニアのラファエル・ピエール氏が提唱する、RAG(検索拡張生成)をシンプルに始めて高度化させる6つの方法について解説。LLMの精度向上へのアプローチを整理します。
LLM導入後の生産性限界を突破する「ハーネスエンジニアリング」に注目。成熟度を測る3つのチェックリストなど、プロンプトの次に来る開発手法を解説します。
Alibabaが次世代AI「Qwen4」のアーキテクチャを採用したQwen3.8-Flash-Nextをオープンウェイトで公開。性能や設計の注目点と、報道の不透明な部分を整理します。
Anthropicが最新モデルFable/Mythos 5.1を公開。学習サイトClaude AcademyやSalesforce連携など、AIを実務に組み込む「エージェント化」への動きを解説します。
OpenAIがGPT-5.6 Solの処理速度を最大14倍に高める「Ultrafast」モードを公開。Cerebrasの技術で1秒間最大750トークンを生成。限定プレビューの現状と影響を解説します。
GoogleがGemini 3.7 Flashをリリース。コーディングとエージェント機能が強化され、年内は導入価格が半額に。3週間での高速更新がもたらす影響を解説します。
Sakana AIが日本語特化LLM「Sakana Namazu」をAPI提供。料金体系やSakana Chatでの機能拡充(Fugu導入、ファイル添付等)について解説します。
Alibaba Cloudが商用トップ級をうたうAIモデル「Qwen3.8-Max」を公開。オープンウェイト化の動きと、報道から見えてこない性能根拠やライセンス制限の懸念点を整理します。