記事とガイド

ロボティクス・フィジカルAI

Claude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ

全 48 件の記事

CCTest · Blog
RoboTok、インターネット動画から器用なロボット操作の示範を検索
ロボティクス・フィジカルAI
cctest.ai

RoboTok、インターネット動画から器用なロボット操作の示範を検索

RoboTokは、人間による操作動画を検索クエリとして、似た手の動きを含むウェブ動画を探し出すデータエンジンです。行為者中心の3D手軌跡を使うことで、カメラ視点や遮蔽、背景が異なる動画同士の比較を目指します。

続きを読む
CCTest · Blog
Qwen-Drive-1.0:視覚言語モデルを自動運転へ拡張する試み
ロボティクス・フィジカルAI
cctest.ai

Qwen-Drive-1.0:視覚言語モデルを自動運転へ拡張する試み

Qwen-Drive-1.0は、事前学習済みの視覚言語モデルを土台に、3D認識、視覚質問応答、運動計画を一つの枠組みに統合する初期的な試みです。BEV認識ヘッドと計画エキスパートによって、共有表現を検査可能なシーン構造と将来軌道へ接続します。

続きを読む
CCTest · Blog
Nori Robotics、1,688ドルの両腕移動ロボットを開発者向けに投入
ロボティクス・フィジカルAI
cctest.ai

Nori Robotics、1,688ドルの両腕移動ロボットを開発者向けに投入

Nori Roboticsは、ロボット開発者と研究者を対象にした1,688ドルの両腕移動ロボットを発表した。高価な脚式機構やオンボード計算を避け、複数台を使った実験と修理のしやすさを重視する設計だ。

続きを読む
CCTest · Blog
NavMCP、基盤モデルの協調でロボットの長期ナビゲーションを前進
ロボティクス・フィジカルAI
cctest.ai

NavMCP、基盤モデルの協調でロボットの長期ナビゲーションを前進

NavMCPは、視覚言語モデルのタスク推論とナビゲーション基盤モデルの閉ループ実行を組み合わせる。複数回の探索で証拠を蓄積し、長期的な物理世界のタスクに対応する仕組みだ。

続きを読む
CCTest · Blog
データ拡張だけではない:VLActがVLAで表現学習を重視する理由
ロボティクス・フィジカルAI
cctest.ai

データ拡張だけではない:VLActがVLAで表現学習を重視する理由

ロボット軌跡は収集コストが高く、ウェブ規模のデータへ拡張しにくい。そのためVLAモデルでは、限られたデータから他のロボットにも移せる表現を学ぶことが重要になる。

続きを読む
CCTest · Blog
米国のロボット規制、中国の量産力は海外市場へ向かう
ロボティクス・フィジカルAI
cctest.ai

米国のロボット規制、中国の量産力は海外市場へ向かう

米国は外国製ドローンや先進ロボットへの規制を強めている。しかし、中国企業の生産規模、供給網、価格競争力は消えず、競争の舞台が米国以外へ移る可能性がある。

続きを読む
CCTest · Blog
Meta、データセンターにロボットを導入へ サーバー再起動や配線交換を検証
ロボティクス・フィジカルAI
cctest.ai

Meta、データセンターにロボットを導入へ サーバー再起動や配線交換を検証

Metaは、サーバーの再起動、電源操作、ネットワークケーブルの交換、設備点検などを担うロボットをデータセンターで試験している。人手不足の解消が期待される一方、技術職の再編も懸念される。

続きを読む
CCTest · Blog
Zero-WAM、人間の動画を見て未学習タスクへ挑むロボット
ロボティクス・フィジカルAI
cctest.ai

Zero-WAM、人間の動画を見て未学習タスクへ挑むロボット

Zero-WAMは、人間の操作動画をロボットに対するタスク指定として利用し、モデルのパラメータを更新せずに未学習の操作へ対応する手法です。HumanGenデータセットとIFP学習目標を組み合わせ、シミュレーションでタスク横断の汎化を検証しました。

続きを読む
CCTest · Blog
TacForcing、実行中の触覚フィードバックでロボット動作を更新
ロボティクス・フィジカルAI
cctest.ai

TacForcing、実行中の触覚フィードバックでロボット動作を更新

TacForcingは、ロボットが動作を実行している最中に得た触覚情報を、視覚言語行動モデルへ取り込むストリーミング動作生成フレームワークです。独立した高周波リアクティブ制御器を追加せず、未実行の動作を逐次的に修正します。

続きを読む
CCTest · Blog
Claudeが物理世界へ:Anthropic、MHSハードウェア標準を発表
ロボティクス・フィジカルAI
cctest.ai

Claudeが物理世界へ:Anthropic、MHSハードウェア標準を発表

Anthropicは、AIエージェントがロボットアームや顕微鏡、実験機器を発見・操作するための「Model Hardware Standard(MHS)」研究プレビューを公開した。Claudeに固定された身体を与えるのではなく、接続された機器を必要に応じて使う発想だ。

続きを読む
CCTest · Blog
StreamPI、単一フレームVLAモデルにストリーミング時系列推論を追加
ロボティクス・フィジカルAI
cctest.ai

StreamPI、単一フレームVLAモデルにストリーミング時系列推論を追加

StreamPIは、追加パラメータなしで単一フレーム型の視覚・言語・行動モデルに時系列推論を導入する。指示を軸にした注意機構とランダム間隔学習により、ロボットが過去の観測を活用し、非同期入力にも対応できるようにする。

続きを読む
CCTest · Blog
GigaBrain-0.7、三システム構成で具現知能の汎化を拡張
ロボティクス・フィジカルAI
cctest.ai

GigaBrain-0.7、三システム構成で具現知能の汎化を拡張

GigaBrain-0.7は、視覚言語理解、世界予測、ロボット行動を結び付ける三システム構成を提案する具現知能モデルです。3万7,000時間超の異種データで事前学習し、異なるロボット本体やタスクへの汎化を目指します。

続きを読む
CCTest · Blog
WorldToken、時間を軸にロボット模倣学習を組み立てる
ロボティクス・フィジカルAI
cctest.ai

WorldToken、時間を軸にロボット模倣学習を組み立てる

WorldTokenは、各時刻のマルチビュー画像、固有感覚、タスク条件を1つのワールドトークンに統合し、時間方向の系列として処理する手法です。実験では、対象領域のデータ量と長い履歴コンテキストの重要性が示されました。

続きを読む
CCTest · Blog
PhysCaP、物体に触れて物理特性を推定するロボット操作エージェント
ロボティクス・フィジカルAI
cctest.ai

PhysCaP、物体に触れて物理特性を推定するロボット操作エージェント

PhysCaPは、コード・アズ・ポリシー型のロボットに物理情報に基づく能動探索を加える手法です。ロボットは視覚だけに頼らず、身体感覚から物体の重さや硬さを推定し、必要な場合だけ追加の操作を行います。

続きを読む
CCTest · Blog
General Intuition、評価額60億ドルで資金調達へ ゲームデータをロボットAIに活用
ロボティクス・フィジカルAI
cctest.ai

General Intuition、評価額60億ドルで資金調達へ ゲームデータをロボットAIに活用

General Intuitionが、プレマネー評価額60億ドルでの新たな資金調達を協議している。ゲームの操作データを基盤に、時空間を移動するAIエージェントとロボット向けモデルの開発を進める。

続きを読む
CCTest · Blog
積載4.2トンの自動運転軽トラック、産業物流へ進出
ロボティクス・フィジカルAI
cctest.ai

積載4.2トンの自動運転軽トラック、産業物流へ進出

九識智能と宇通が、最大積載量4.2トン、荷室容量19.32立方メートルの自動運転軽トラック「Z20」を発表した。工場や工業団地、大型物流拠点内の高頻度輸送を主な対象とする。

続きを読む
CCTest · Blog
ロボットにも「GPT-3の瞬間」:数秒の実演で新しい動作を学習
ロボティクス・フィジカルAI
cctest.ai

ロボットにも「GPT-3の瞬間」:数秒の実演で新しい動作を学習

GeneralistのGEN-1.5は、大規模な物理インタラクションデータで事前学習したロボット基盤モデルです。3〜12秒の実演を見せるだけで、パラメータ更新なしに未経験タスクへ挑戦します。

続きを読む
CCTest · Blog
Zetta、ロボットの実行中の復旧と自己進化を可能にする閉ループ基盤
ロボティクス・フィジカルAI
cctest.ai

Zetta、ロボットの実行中の復旧と自己進化を可能にする閉ループ基盤

Zetta は、基盤ポリシーを凍結したまま、実行時クリティックと復旧スキルをオンラインで進化させる具現知能向けハーネスです。行動時の介入、ロールアウト分析、検証を通過した更新を三つの時間スケールで組み合わせます。

続きを読む
CCTest · Blog
Ego2Robot:一人称人間動画からロボット学習データを大規模生成
ロボティクス・フィジカルAI
cctest.ai

Ego2Robot:一人称人間動画からロボット学習データを大規模生成

Ego2Robot は、一人称視点の人間による操作動画をロボット向け学習データへ変換するパイプラインだ。単なる模倣ではなく、基盤モデルの事前学習に使える規模と多様性を目指している。

続きを読む