AI at Meta– tag –
-
単一画像から精密3D再構成「SAM 3D」登場—編集・ロボティクス・対話的生成に期待
単一の画像から高精度な3D再構成を可能にする「SAM 3D」が発表された。画像・動画編集、ロボティクス、インタラクティブなシーン生成など実世界の用途を想定し、研究者のMatt氏は人物と複雑な環境の双方に対応する二つのモデル設計が鍵だと説明している。 ... -
SAM 3発表——画像・動画の検出・分割・追跡を統合、Instagram機能にも展開へ
新しい統合モデル「SAM 3」が公開されました。画像と動画をまたいで、物体の検出・セグメンテーション(領域分割)・トラッキング(追跡)を一つのモデルで実現し、テキストや類例(エグザンプラ)によるプロンプト指定で、特定カテゴリの対象を一括抽出で... -
SAM 3が物体検出と追跡を単一アーキテクチャで統合—難題に挑む新アプローチ、研究者Christoph氏が開発の要点を紹介
コンピュータビジョンの長年の難題である「物体検出」と「追跡」を、ひとつのモデルアーキテクチャで統合する——そんな挑戦に取り組むのが最新研究「SAM 3」です。研究チームのChristoph氏は、どのようにして統合を実現したのか、その道のりと意義を共有し... -
AIモデル「SAM 3」が公開――専用ライセンス下でベンチマーク・チェックポイント・微調整用コードを同時提供、メディア編集や科学分析を後押し
次世代AIモデル「SAM 3」が専用のSAMライセンスの下で公開され、評価ベンチマーク、モデルチェックポイント、推論・微調整用のオープンソースコードが同時に提供されました。メディア編集や科学分析など、高度なアプリケーションの開発を後押しする狙いで... -
Roboflowと提携でSAM 3のアノテーション・微調整・デプロイを一体提供、すぐ試用可能に
コンピュータービジョンの開発者に朗報だ。データアノテーション、モデルの微調整(ファインチューニング)、本番デプロイまでを一気通貫で行える体制が、Roboflowとの提携により「SAM 3」で実現した。発表では「すぐ試せる」リンクも公開され、現場の課題... -
AIモデル「SAM 3」が野生動物の生存監視を加速 Conservation Xが絶滅リスク低減へ活用
AIビジョンモデル「SAM 3」の精密な物体検出・追跡機能が、Conservation Xの野生動物モニタリングを支援している。世界各地の動物種の「生存状況の測定」を高効率・高精度で行い、絶滅の未然防止につなげる狙いだとされる。 取り組みの概要 背景:絶滅危機... -
Meta FAIRが32Bパラメータの「Code World Model」を公開—コード生成と推論の可能性を探る
MetaのAI研究部門FAIRは、コード生成とコードに関する推論の新たな可能性を探る研究モデル「Code World Model(CWM)」を発表した。32億(32B)パラメータ規模のCWMは、いわゆる「ワールドモデル」の発想をコード領域に適用することを目的に、研究ライセン... -
Meta Connect 2025、今夜5時PTに基調講演をライブ配信—AIウェアラブルの未来に注目
Meta Connect 2025 基調講演、今夜5時PTにライブ配信 Metaは開発者会議「Meta Connect 2025」の開催を告知し、今夜(米国太平洋時間)午後5時からの基調講演をライブ配信すると案内しました。テーマは「AIウェアラブルの未来」を中心に、今後のAI体験全般... -
自己教師あり学習で進化「DINOv3」発表—単一の凍結バックボーンが密な視覚課題で専門手法を凌駕
自己教師あり学習(SSL)により高解像度の画像特徴を学習する最先端モデル「DINOv3」が発表された。発表によると、単一の凍結(学習済み・微調整なし)ビジョン・バックボーンが、長年研究されてきた複数の密な視覚課題で、専門特化型のソリューションを上... -
DINOv3が商用ライセンスで公開、事前学習済みバックボーンや学習・評価コード一式を提供
コンピュータビジョン分野のイノベーションとコラボレーションを促進する取り組みとして、DINOv3が商用ライセンスのもとで公開された。事前学習済みのバックボーン、アダプタ、学習・評価コードなど、実務で使えるフルスイートが揃っており、研究からプロ... -
Meta、結晶構造予測ワークフロー「FastCSP」を発表—有機分子の材料探索を数日へ短縮
MetaのFAIR Chemistryチームは、有機分子の安定な結晶構造を自動生成するワークフロー「FastCSP」を発表した。材料探索のボトルネックだった結晶構造予測(CSP)を加速し、分子結晶の設計期間を数カ月から数日に短縮できる可能性があるという。論文は公開... -
分子結晶データセット「OMC25」公開—2,500万構造でFastCSPを加速、CMUと共同で開発
カーネギーメロン大学(CMU)との共同開発により、分子結晶の大規模オープンデータセット「Open Molecular Crystals(OMC25)」が公開された。2,500万件に及ぶ分子結晶構造を収録し、結晶構造予測(CSP)を高速化する「FastCSP」ワークフローを可能にする... -
DINOv3が自己教師あり学習を刷新:無ラベルで17億枚・70億パラメータ学習、密な予測で最先端
自己教師あり学習(SSL)を採用する新たな視覚表現フレームワーク「DINOv3」が登場した。注目は、ラベルなしで17億枚規模の画像と70億パラメータを扱えるスケール、高解像度特徴に強い表現学習、そして凍結バックボーンで多様なタスクとドメインに横断適用... -
Meta、1600言語以上に対応する「Omnilingual ASR」を発表—未対応500言語もカバー
Metaは、音声を自動で文字起こしする新モデル群「Omnilingual Automatic Speech Recognition(ASR)」を発表した。対応言語は1600以上にのぼり、これまでいかなるASRシステムでもサポートされていなかった「低カバレッジ」の言語約500も含む。汎用的なトラ... -
1600言語対応の音声AI群「Omnilingual」を公開—ASRモデル、7B表現モデル、350言語コーパスを無償提供
1600以上の言語に対応する音声認識モデル群「Omnilingual ASR」、7Bパラメータの多言語音声表現モデル「Omnilingual w2v 2.0」、そして350のアンダーサーブド言語を網羅した「Omnilingual ASR Corpus」が本日オープンソースで公開された。言語の壁を低くし... -
Metaの多言語音声認識「Omnilingual ASR」発表—複数モデル統合で実現、研究者が仕組みを解説
Metaが、多言語対応の音声認識「Omnilingual ASR」を発表しました。社内で開発してきた複数モデルの強みを組み合わせて実現したといい、プロジェクト研究者のMatt Setzler氏が、その成り立ちとポイントを解説しています。本稿では、概要、技術的な要点、活... -
Meta FAIRのBrain & AIチームが「Algonauts 2025」優勝、1BパラメータのTRIBEで脳反応予測をリード
米Metaの研究部門FAIR(Fundamental AI Research)のBrain & AIチームが、国際的な脳モデリング競技「Algonauts 2025」で総合1位を獲得した。チームは約10億(1B)パラメータの新モデル「TRIBE(Trimodal Brain Encoder)」を披露し、提示刺激に対する... -
Metaら、CO2直接回収素材探索を加速する最大級の公開データセット「Open Direct Air Capture 2025」を発表
MetaのAI研究部門FAIRは、米ジョージア工科大学およびCuspAIと共同で、空気中からCO2を直接回収するための先進材料探索を支えるオープンデータセット「Open Direct Air Capture 2025」を発表した。CO2吸着材などの候補を迅速かつ高精度にスクリーニングで... -
メタのザッカーバーグ氏、誰もが使える『パーソナル超知能』構想を公表
メタのザッカーバーグ氏、誰もが使える『パーソナル超知能』構想を公表 米メタ(Meta)のマーク・ザッカーバーグCEOは、自身のSNS投稿で「すべての人のためのパーソナル・スーパーインテリジェンス(超知能)」に関する長期ビジョンを共有した。詳細は公開... -
Meta Superintelligence Labs、チーフサイエンティストにShengjia Zhao氏が就任
Meta Superintelligence Labsは、チーフサイエンティストとしてShengjia Zhao(シェンジャ・ジャオ)氏が就任したとX(旧Twitter)上で発表しました。Mark氏の投稿も案内され、「Big things are coming!(大きな展開が来る)」と今後の計画への意欲を示し...


