2026年7月– date –
-
Perplexity、低コストで最先端級性能の新オーケストレーターモデル研究プレビューを公開
生成AIサービスを手がけるPerplexityが、新しい「オーケストレーターモデル」を研究プレビューとして公開しました。高性能モデル「Opus」の約3分の1のコストで、ほぼ同等の最先端級性能を実現したとされ、AI活用のコスト構造を大きく変える可能性がありま... -
米PerplexityがNvidia最新GPU B200上で新AIモデルを提供 今後ベンチマークも公開予定
米Perplexityが、Nvidiaの最新GPU「B200」を活用した新たなAIモデルの提供を開始しました。必要に応じて自動的により強力なモデルへ切り替わる仕組みを備え、今後数週間で詳細なベンチマーク結果も公開するとしています。 Perplexityの新AIモデル概要 Nvid... -
3D画像解析を1か月から15分へ Berkeley LabらがSAM 3とDINOv3で科学研究を加速
米エネルギー省(DOE)の「Genesis Mission(ジェネシス・ミッション)」を支えるBerkeley Lab主導のプロジェクト「SYNAPS-I」が、最先端AIモデル「SAM 3」と「DINOv3」を組み合わせることで、3D画像データのラベリング作業を劇的に短縮し、科学研究のスピ... -
Metaが新AIモデル「Muse Spark 1.1」を公開 開発者向けAPIとMeta AIアプリで提供開始
米Metaは、生成AIモデル「Muse Spark」の最新版となる「Muse Spark 1.1」を発表しました。開発者向けの新しい「Meta Model API」で利用可能になるほか、一般ユーザー向けにはMeta AIアプリの「Thinking(シンキング)」モードとして公開され、Webからもア... -
Meta、コード生成特化モデル「Muse Spark 1.1」でAI開発を自動化へ 社内研究にも本格活用
Meta(旧Facebook)が、コード生成や研究ワークフロー向けに開発したAIモデル「Muse Spark 1.1」を社内で本格活用していることが明らかになりました。社内のコード作成やAI研究の現場で、他の最先端モデルと肩を並べる性能を発揮しつつ、モデル開発や評価... -
Meta、AI生成画像に「見えない透かし」Content Seal導入 一般向け識別ツールも公開予定
Meta(旧Facebook)は、同社のAIサービスが生成する画像すべてに、改変されても残り続ける「見えない透かし(ウォーターマーク)」を埋め込む技術「Content Seal(コンテント・シール)」を導入しました。あわせて、誰でも画像内の透かしの有無を確認でき... -
「Muse Image」に見る生成AIの進化 思考の途中で自律的に修正する画像モデルとは
画像生成AI「Muse Image」が、開発者に明示的にプログラムされていないにもかかわらず、自ら思考プロセスを振り返り、局所的な修正や全体の作り直し、ツール活用などを選び分ける「自己洗練」(セルフリファインメント)的な振る舞いを示したと報告されて... -
MetaのAIがアジア物理オリンピック理論試験で満点 トップ学生と同点の快挙
米Meta(旧Facebook)が開発したAIモデルが、アジア物理オリンピック(Asian Physics Olympiad, APhO)の理論試験で満点となる30点を獲得し、トップ3の学生と同点となったことが明らかになりました。高度な推論能力とマルチモーダル(文章や図表など複数の... -
Googleの次世代AI「Muse Spark 1.1」 動画から商品情報を理解し自動で出品作業までこなす新時代のエージェント
Googleが開発する次世代AI「Muse Spark 1.1」が、動画や画像、音声をまたいで高度な理解と推論を行い、人間の代わりにパソコン操作まで自動化できるエージェントとして注目を集めています。スマートフォンで撮影した動画から商品写真を抽出し、内容を理解... -
OpenAIが新音声モデル「GPT-Live」を発表 ChatGPTに自然な対話体験が到来
OpenAIは、新世代の音声モデル「GPT-Live」を発表し、同社の対話型AI「ChatGPT」への展開を開始しました。これにより、ユーザーは文字入力だけでなく、より自然な音声でのやり取りを通じて、人間に近い会話体験を得られる可能性が高まります。 GPT-Liveと... -
次世代「ChatGPT Voice」発表へ 10日午前10時(PT)からライブ配信
米OpenAIは、対話型AI「ChatGPT」の音声機能を大幅に進化させた「次世代のChatGPT Voice」を発表すると予告しました。発表の様子は、太平洋時間(PT)午前10時からオンラインでライブ配信されます。 次世代ChatGPT Voice発表の概要 発表スケジュールと視聴... -
OpenAIが次世代モデル「GPT‑5.6 Sol」などを今週公開へ Terra・Lunaも同時展開
米OpenAIが、次世代AIモデル「GPT-5.6 Sol」と関連モデル「Terra」「Luna」を、今週木曜日に一般公開すると発表しました。すでにグローバル向けのプレビューアクセス拡大も始まっており、開発者や企業、クリエイターにとって新たなAI活用の転機となりそう... -
AI for Goodサミットで3つのAI事例が受賞 都市交通・ノーコード開発・文化財保護で広がる可能性
国連機関が主催する「AI for Good Global Summit 2026」で、都市交通、ソフトウェア開発、文化財保護という異なる分野の3つのAIプロジェクトが「インパクトを生む事例」として選出された。いずれの取り組みも、AIを通じてより多くの人が「移動し、創り、守... -
Cohere、アラビア語音声認識で世界最高精度のオープンソースモデルを公開 Apache 2.0で無償利用可能に
AIスタートアップのCohereは、アラビア語の音声認識に特化した「Cohere Transcribe Arabic」を公開し、「世界で最も高精度のオープンソース・アラビア語音声認識モデル」と位置づけました。商用利用も含めて自由度の高いApache 2.0ライセンスで提供され、... -
百度が「Unlimited OCR」を発表 人間の“忘却”をまねて長文書類を一気に読み取る新技術とは
中国検索大手・百度(Baidu)が、新しいAI文字認識技術「Unlimited OCR」を発表しました。人間の「忘れる」仕組みをヒントに、これまで苦手だった数十ページ規模の長い文書も一度に処理できるとされ、膨大な紙・PDF資料を扱う企業の業務効率化につながる可... -
トロント大学がカナダ発の主権AI基盤「North」を全学導入へ 機密データを守りつつAI活用を加速
カナダのAI企業が提供する主権AIプラットフォーム「North」が、トロント大学(University of Toronto)の全学的なAI活用を支える基盤として採用されることが明らかになりました。機密性の高い大学データを自らの管理下に置いたまま、生成AIなど最新技術を... -
Hugging Faceがアラビア語AI強化へ一歩 HUMAINと提携し低資源言語ASRを推進
オープンソースAIプラットフォームのHugging Face(ハギングフェイス)が、低資源言語向けの音声認識(ASR)への要望に応える形で、アラビア語AIの強化に向けた新たな取り組みを発表しました。パートナーとして名指しされたのは、アラビア語分野で活動する... -
多様なアラビア語に対応する新トランスクリプトAI「Transcribe Arabic」とは
アラビア語話者向けに、方言の違いや英語との混在、さらにはアラビア語訛りの英語まで扱える次世代トランスクリプションAI「Transcribe Arabic」が登場しました。ビジネス現場や開発コミュニティで、会議録の自動生成や音声データの活用を一気に加速させる... -
「ソブリンAI」を誰もが使える時代へ モデル重みを公開し普及を狙う最新動向
企業から個人まで、誰もが自分たちのデータと主権を守りながらAIを活用できる──そんな「ソブリンAI(Sovereign AI)」の構想に向けて、モデルの重みが公開され、Hugging Faceを通じて世界中で利用できるようになりつつあります。本記事では、その狙いと意... -
生成AI開発現場向けツール「Claude Code」誕生の舞台裏とは?開発者と初期ユーザーが語る進化の歴史
生成AIを活用した開発支援ツールとして注目を集める「Claude Code」。その裏側には、開発チームと初期ユーザーが試行錯誤を重ねながら作り上げてきたストーリーがあります。本記事では、公開された英語コンテンツをもとに、Claude Codeがどのような課題意...



