身体と手先の協調制御で動きながら器用な操作を実現するヒューマノイドロボット技術
・ヒューマノイドロボットが歩行中に高自由度の手で器用に物体を操作する技術「CoorDex」を開発。従来の「歩く→止まる→操作→歩く」の分断的動作から脱却。・高次元の身体と手先制御を潜在空間の残差制御に統合し、移動しながらの複雑な操作が可能に。・機械学習パイプラインで、複数の先行知識を活用して効率的な学習を実現。・産業用ロボット・自動化設備での応用が期待される基礎研究。
Archive 記事を横断検索
キーワードだけでなく、業界・用途・情報種別・公開時期を組み合わせて検索できます。気になるテーマから、自社で試すヒントまでまとめて辿れます。
← AI Intel トップに戻る13 / 15ページ
・ヒューマノイドロボットが歩行中に高自由度の手で器用に物体を操作する技術「CoorDex」を開発。従来の「歩く→止まる→操作→歩く」の分断的動作から脱却。・高次元の身体と手先制御を潜在空間の残差制御に統合し、移動しながらの複雑な操作が可能に。・機械学習パイプラインで、複数の先行知識を活用して効率的な学習を実現。・産業用ロボット・自動化設備での応用が期待される基礎研究。
・MIT開発の新型チップにより、小型無人機がLED程度の電力消費で3D環境マップをリアルタイム生成可能 ・HVAC配管内のガス漏れ検査など、狭い工業施設での障害物回避ナビゲーションに応用 ・バッテリー制約の小型自律ロボットが衝突回避の経路計画を実行でき、産業点検業務の効率化へ
・現行の言語モデル(Transformer 等)は全層に均等にパラメータを配置するが、実際には層によって出力への寄与度が異なることが知られている。・後段の層は情報を大きく変換せず、中間表現を洗練する傾向にあることから、パラメータの非均等配置が有効である可能性を検証。・深さ方向でのパラメータ効率化により、モデルサイズ削減と計算コスト低減が期待できる。
・Amazon Bedrock AgentCoreにウェブ検索機能が実装され、AIエージェントがリアルタイム情報にアクセス可能になった ・学習時点での固定知識という従来の制限を超え、最新のニュースや株価、リリース情報などへの回答対応が実現 ・エンタープライズ向けAIエージェント構築において、情報鮮度が重要な用途(営業支援、カスタマーサポート等)の実装が現実的に
・ALS患者Casey Harrell氏が脳埋込デバイスの「最初の実用ユーザー」として約3年間運用。2023年7月の埋込以来、音声生成・Web操作・気候活動家の仕事を主に独立して遂行。 ・脳-コンピュータインターフェース(BCI)が研究段階から患者の日常生活支援ツールへと移行する兆候。 ・神経難病患者のQOL向上とBCI実用化の進展が並行して加速している状況を報告。
・Google が Search Central Live Deep Dive をEMEA地域(ヨーロッパ・中東・アフリカ)に拡大し、開催地決定を進めている ・イベント形式は参加者が接続・学習・交流できる「最適な拠点」を重視した設計 ・SEO・検索マーケティング従事者向けのナレッジ共有イベントが地域別開催に移行する動き ・開催地選定に関しての具体的な基準や投票方法はソースに記載なし
・Googleが検索スパムポリシーを拡大し、「戻るボタン乗っ取り」(ユーザーが戻るボタンを押した際の動作を改ざんする行為)を明示的な違反行為として認定。 ・該当するサイトはスパム扱いされスパム対策アクションの対象になる可能性がある。 ・ブラウザ戻る操作を悪用した誘導やリダイレクト行為が規制対象となる。
・AI エージェントはチャットボットと異なり、目標を複数のステップに分解し、判断・ツール利用・実行を自動で行える ・人間による介入を最小限に抑えながら、一連のタスクを自律的に遂行する特性を持つ ・単なる質問応答ではなく、目標達成に向けた段階的なアクション実行が可能
・テキスト音声合成(TTS)システムにおいて、自然言語指示がどの程度音声特性に影響するかを分析する手法を提案。 ・DAAM フレームワークを音声領域に初適用し、クロスアテンション属性を用いて個別単語ごとの寄与度をヒートマップで可視化。 ・CapSpeech-TTS での実装により、失敗パターンの診断と音声表現性の向上に資する基盤を確立。
・カスタマーサービス分野のAIエージェントが、ポリシー(業務ルール)を守りながら複数ターンの対話でツール(外部システム)を呼び出す際、タスク状態を明示的に管理する手法を提案。 ・従来型エージェントでは状態がプロンプト内に散在し、エージェント自身が関連情報を再構築していた課題を、Ledger(台帳)構造で解決。 ・顧客情報、制約条件、ポリシー違反チェックなどを体系的に整理し、エラーや方針違反を削減。
・マルチモーダル大規模言語モデル(MLLM)が人物画像を判断する際、限定的な視覚的手がかり(服装・外見など)が大きなバイアスを生み出す可能性を指摘。 ・StylisticBiasというベンチマークを開発し、個人差と見た目の効果を分離してバイアスを測定する方法論を提案。 ・500以上のフォトリアリスティック画像を用いた制御実験により、属性レベルの社会的バイアスを体系的に評価可能に。 ・個人情報判定・採用・医療判断など実務的設定でのMLLM...
・手動の空間アノテーションなしで、放射線科向けビジョン言語モデルの訓練方法を研究 ・独ドイツ語と英語の二言語対応、CT/MR画像120万枚とテキストペアのRefRad2Dデータセットを開発 ・LLMベースキュレーションと自動セグメンテーションで、VQAと空間グラウンディング部分集合を自動生成 ・RadGrounderモデルは報告書生成と視覚質疑応答を同時実行可能に構成
・米国の独身者約47%がAIを恋愛・出会いに使うことに否定的な見方をしている。 ・一方で、プロフィール作成補助やメッセージ提案といった具体的用途では利用に前向きなユーザーが多い。 ・Match社の調査から、ユーザーのAI活用に対する心理的抵抗と実用的ニーズの間に乖離がある。
・OpenAIの推論機能を持つAIモデルを用いて、従来診断困難だった小児稀少遺伝病の診断支援に成功。 ・未解決ケースから18件の新規診断を実現し、臨床的な課題解決の可能性を示唆。 ・医学専門知識とAIの推論能力を組み合わせ、診断精度向上への道を開く。
・Netflix『クィア・アイ』の人気ライフコーチ Karamo Brown が、自身の AI デジタルクローンを搭載したウェルネスアプリ「Kē」をローンチした ・フィットネス・栄養・瞑想・禁酒・人間関係・自己啓発など、同氏が 1 年半かけて取り組んだ実体験をベースとしている ・利用者は AI クローンとのインタラクティブな対話を通じて、パーソナライズされたウェルネスサポートを受けられる ・セレブリティの知見を AI 化し、大規模に提供...
・動画の全フレームを均一に処理する従来手法は計算コストが動画長に比例して増大する課題を指摘。 ・OmniAgent という新しいエージェントが、POMDP(部分観測マルコフ決定過程)に基づく反復的な「観察→思考→選択」サイクルで動画理解を実現。 ・能動的知覚により、クエリの難度に応じた効率的なフレーム選択が可能になり、計算コストを削減。 ・複数モダリティ(映像・音声・テキスト等)を統合処理できる汎用エージェント設計。
・米国の地方条例(ゾーニング、住宅、営業許可など)は機械学習に適した形式で公開されておらず、法律AI研究の空白となっている。 ・研究チームが大規模な地方条例コーパス「LOCUS」を構築し、スケーラブルな法律AI開発の基盤を提供する。 ・ベンダープラットフォームの破片化から脱却し、自動化可能な法令データへのアクセスが可能に。 ・地方規制(公衆衛生、騒音規制、動物管理など)に関する判例分析や自動化が加速する見込み。
・選好比較からの報酬学習において、報酬・動力学・価値関数の不確実性を統合的に考慮する能動的探索手法を提案 ・既存の受動的データ収集に比べ、特に学習初期段階でのサンプル効率を大幅に改善 ・モデルベースアプローチにより、報酬設計を明示的に行わずロボット制御や推奨システムなど複数領域での応用が期待される
・OpenAI がLifeSciBench という生命科学研究向けベンチマークを発表 ・専門家が問題設計と査読を担当し、実務的な研究タスク評価に対応 ・AI システムの生命科学分野での実用性を客観的に測定できるツール
・Google が新型スマートスピーカー「Google Home Speaker」(99.99ドル)を発表し、従来の固定的なコマンド型アシスタント機能から会話型 AI(Gemini)へ移行。 ・Gemini の生成 AI 能力により、より自然な対話形式での指示が可能に。 ・スマートスピーカー市場での競争力再強化を狙い、音声 AI インタフェースの大幅な改善を実現。
・Pinterestが実験的なAI搭載ショッピングアプリ「Ask Pinterest」を開始 ・ユーザーが会話形式でレコメンデーションや商品インスピレーションを取得可能 ・自然言語インターフェースを通じた新しい買い物体験の検証段階
・ロボット政策の生成器と視覚検証器を組み合わせたVERITASフレームワークを提案。推論時にロボットの行動を評価・操舵できます。・事前学習済みの汎用ロボット政策に勾配不要な視覚検証器を組み合わせ、リアルタイムで行動品質を判定。・ロボットが自身の経験から学習し、継続的に性能を改善する仕組みを実現。・推論時の自律改善により、再学習なしに環境変化への適応が可能。
・ゼロショット物体探索(訓練なしで目的物を探すロボットナビゲーション)において、従来の基盤モデルは静的な知識に依存し適応性に欠けていた。 ・EvolveNavは、テスト時に継続的に改善する自己進化フレームワークを提案し、エージェントの行動ルールをメモリに蓄積して学習。 ・事前反省メカニズムにより、試行錯誤のコストを削減しながら、環境適応性と探索効率を向上。
・MIT研究チームがロボット向けの長期記憶フレームワークを開発し、複雑で大規模な環境の詳細な空間的・時間的モデルを素早く形成・想起できるようにした。 ・従来ロボットは、人間が自然に行う「鍵をどこに置いたか覚えている」といった空間記憶の能力に劣っていた。 ・工場作業など人とロボットが協働する環境では、このような記憶能力がロボットの効率性と安全性向上に貢献する可能性がある。 ・研究はロボットの自律性向上と人間との協働作業の実現化に向けた基礎...