職種検索へ戻る

仕事の詳細

職場での仕事内容から生かせる経験・スキル、諸条件など詳細を確認できます

企業名

株式会社サイバーエージェント

職種

【メディア事業部】(リサーチサイエンティスト)Sports AI Tech Lab 博士後期課程在学生対象 インターンシップ

仕事内容

【研究組織「Sports AI Tech Lab」】 サイバーエージェントグループの持つテクノロジーとエンターテインメントの知見、そして「ABEMA」「WINTICKET」などのプロダクトや、「FC町田ゼルビア」をはじめとするスポーツチーム運営で培ったスポーツ産業への深い関わりを背景に新設された研究組織です。スポーツAI映像解析基盤の構築に着手し、試合映像などのAI解析を通じて選手・競技データを高精度で検出し、優れた視聴体験の創出とプロダクトへの実装やチーム・選手の強化を目指します。大学や研究機関との連携も視野に入れ、スポーツAI領域での基礎研究を深めています。 【研究テーマ】 博士後期課程の方を対象とした本インターンシップでは、スポーツ理解技術と連携し、ABEMAやWINTICKETなどのサービスにおける視聴体験・観戦体験を向上させるための自然言語処理・音声処理技術の研究開発に取り組みます。 1.言語生成技術のスポーツ応用 ・映像・プレイデータを統合したマルチモーダル実況・解説生成モデルの開発 ・見逃し配信や短尺動画のためのハイライト要約・タイトル・説明文生成 ・日本語ストリーミング言語モデル開発のためのデータ構築・学習 ・多言語配信のためのリアルタイム翻訳・多言語字幕生成 2.音声処理技術のスポーツ応用 ・盛り上がりや試合展開により制御可能な実況音声合成 ・低遅延なリアルタイム音声合成 ・映像データ・スポーツデータからのtextless音声合成 3.推薦・ユーザ適応技術のスポーツ応用 ・行動履歴を考慮した個人最適化実況生成 ・初心者/上級者向け実況生成のための平易化・詳細化技術 4.自動評価技術のスポーツ応用 ・映像・数値時系列を考慮するマルチモーダル評価手法の開発 ・音声合成における自然性、臨場感、聞きやすさの評価 5.試合展開・選手パフォーマンスのリアルタイム予測 ・勝敗やプレイのリアルタイム予測と不確実性の定量化 ・トラッキングデータに基づく選手・ボールの動きや次のプレイの予測 【テーマの魅力】 Sports AI Tech Labの映像解析・スポーツデータ分析技術と連携しながら、自然言語処理・音声処理の研究成果をABEMAやWINTICKETなどの実サービスに接続する経験ができます。研究としての新規性に加えて、実サービス上の価値を意識した研究開発に取り組める点も大きな特徴です。

求める人物像

【必須スキル】 ・自然言語処理、音声処理、対話システム、情報推薦、マルチモーダル機械学習のいずれかに関する博士課程レベルの専門知識と研究経験 ・Pythonを用いた機械学習モデル・大規模言語モデル活用に関する実装経験 【歓迎スキル】 ・LLM、マルチモーダル言語生成、自動要約、機械翻訳、音声合成、対話、推薦、評価等のいずれかに関する研究・開発経験 ・スポーツデータ、映像データ、音声データ、センサーデータ、視聴ログ等を扱った経験 ・リアルタイム処理、ストリーミング推論、低遅延システムの開発経験

博士・ポスドクに特に求めること

大学院博士後期課程に在学中の学生のみを対象としたインターンシップ。候補者自身の専門性を活かしたテーマ提案も歓迎。

勤務予定地

東京都渋谷区宇田川町40-1 Abema Towers フルリモート可能 ※出社を希望される遠方にお住まいの方には宿泊場所(通信費含む)を用意

博士卒の初任給

月給(実働8時間・週5日の場合/土日祝日を除く) ※交通費全額支給、業務用PC貸与、論文採択時の国際カンファレンス参加費用負担

類似した職種

株式会社ホンダ・リサーチ・インスティチュート・ジャパン

職種
研究職- 人中心AIにおけるマルチモーダル対話技術の研究開発

<ホンダ・リサーチ・インスティチュート(HRI)について> 本田技術研究所の100%出資グループ会社として、自動車技術を超えた新しい領域に挑戦するための組織となるべく、2003年日本、米国、欧州に設立されました。 私たちの活動理念は "Innovate through Science"。ひとや地球環境と知能化システムが調和・共存するハイブリッド社会の実現にむけ、人工知能、ロボット工学、システム科学、脳科学、材料科学、心理学、社会倫理学などからの多面的アプローチによりCooperative Intelligence、Cooperative Devicesといったコミュニケーションとセンシングにフォーカス。各種研究に取り組んでいます。 <HRIの研究開発内容例> ・人のメンタルまで考慮したインタラクションによる、人-機械間のマルチモーダルコミュニケーションを実現するための研究 ・聴覚障がい者と健聴者、互いの理解を促進する音声認識システムの開発 ・カメラ・ウェアラブルセンサーなどを用いた人間の内部状態(理解度など)の推定システムの開発 ■募集職種 次世代対話システムの高度化を推進する、先進的な「人中心AIにおけるマルチモーダル対話技術の研究者/エンジニア」を募集します。 【業務詳細】 ・マルチモーダルアーキテクチャの高度化 内部推論(Chain-of-Thought)の強化や低遅延化に注力し、次世代対話モデルの新規研究コンセプトを設計・検証 ・文脈理解モデルの開発 音声・映像・テキストの連続データを解析し、ユーザの行動や環境文脈に適応するアルゴリズムの構築 ・実世界課題の解決 実環境のインタラクション信号を高品質な学習データへ変換する仕組みを設計し、継続的なモデル改善とバイアス低減を実現 ・グローバル連携の推進 海外姉妹研究所(ドイツ・米国)と協力し、事業につながる研究テーマに挑戦 ・技術リーダーシップと成長 新たな研究テーマの創出、プロジェクト管理、若手研究者の育成、国際学会での発表などを担い、将来的にはチームリーダーとしての活躍を期待 【仕事の特色】 研究構想から実装、評価、実用化まで研究ライフサイクル全体を主体的に担当します。 学術研究と実社会応用をつなぐ役割として、基盤モデルを実運用可能なシステムへと昇華させる経験が得られます。 高い裁量のもと、自身の研究テーマを提案・推進し、トップレベルの国際学会での発表も積極的に行えます。 <この仕事で取り扱う技術> ・マルチモーダル融合・LLM Vision-Language Model(VLM)等の基盤モデル、クロスモーダルアテンション ・人中心コンピュータビジョン 話者検出、視線推定、姿勢推定、表情・属性解析 ・音声・自然言語処理 視覚情報と統合した話者認識・音声認識、対話文脈理解 <Mission / ミッション> ホンダの理念「技術は人のために」に基づき、スピード感と独創性をもって世界に唯一無二の技術創出を目指します。 マルチモーダルAIの最先端動向を踏まえ、高価値な研究テーマを見極め、迅速な試作・実験・検証を通じて成果を創出。 研究成果は国際会議・論文等を通じて積極的に発信します。 <プロジェクト規模> チームメンバーや社外研究機関の研究者数名と連携して業務を推進します。 海外姉妹会社(ドイツ、アメリカ)と連携し、グローバルな仕事ができるのが魅力です。 <チーム構成> リサーチ・ディビジョン・マネージャの元で、研究プロジェクトとして推進(所属部門:リサーチ・ディビジョン)。 研究プロジェクトは、内容や予算を含めて自らが提案し、ボード承認により発足します。 <職場環境 等> ・全社員の約半数が外国籍という国際色豊かな職場。社内では日常的に日本語と英語、両方でコミュニケーションが行われています。 ・勤務地は郊外型オフィスとして数々の賞を受賞した本田技研工業の「和光キャンパス」内にあります。 ・研究者の裁量が大きく、研究成果の対外発表を積極的に奨励しています。会社の進むべき方向を尊重しつつ、研究者の意志も大切にする文化があります。

2026年卒 2027年卒