最新ツール

AIニュース・トレンド

Physical Intelligence、未訓練タスクも実行可能なロボットAI「π0.7」発表

サンフランシスコのAI企業Physical Intelligenceが、新しいロボット用AIモデル「π0.7」を発表しました。このモデルの特徴は、訓練されていないタスクでも実行できる点です。例えば、エアフライヤーの使い方を直接教えていなくても、別の場面で学んだ「フタを閉める動作」と「指示に従って物を置く動作」を組み合わせて、エアフライヤーを操作できます。ロボットが人間のように応用力を持ち始めたことを示す、興味深い研究成果です。
AIニュース・トレンド

LumaがAI映画制作スタジオ設立、実写とAIをリアルタイム合成

AI動画生成のLumaが、Wonder Projectと共同で新しい制作会社「Innovative Dreams」を立ち上げました。従来のCG映画制作では撮影後の編集作業で映像を合成していましたが、このスタジオでは撮影しながらリアルタイムでAI生成の背景や小道具を合成できます。俳優の演技データを取り込んで別の顔のキャラクターに適用することも可能で、春にはPrime Videoで最初の作品が公開される予定です。
AIニュース・トレンド

Parcae:メモリ効率2倍の新型AI、訓練安定性も実現

UC San DiegoとTogether AIの研究チームが、Parcaeという新しいAIアーキテクチャを発表しました。これは「ループ型トランスフォーマー」と呼ばれる技術で、同じ処理を何度も繰り返すことで、モデルのサイズを増やさずに性能を高められる仕組みです。特に注目すべきは、従来この手法で起きていた訓練中の不安定さを解決した点。770Mパラメータのモデルが、1.3Bパラメータの標準モデルと同等の品質を達成しており、メモリ効率が求められるデバイス上でのAI活用に道を開きます。
AIニュース・トレンド

AI学習アプリGizmo、1300万ユーザー突破で2200万ドル調達

学生のノートをAIで学習教材に変換するアプリ「Gizmo」が、シリーズAで2200万ドルの資金調達に成功しました。2021年のローンチから約5年で、ユーザー数は30万人から1300万人へと急成長。ゲーム感覚で学べる仕組みが若者に支持され、120カ国以上で利用されています。フリーランスの教育コンテンツ制作者や、学習サービスを提供している方にとっては、今後の競合動向として押さえておきたいニュースです。
おすすめAIツール

Hightouch、AI広告ツールで年間売上1億ドル突破

マーケティングツールのHightouchが、AI駆動の広告制作サービスで急成長しています。2024年後期のローンチから20ヶ月で7000万ドルの売上を追加し、年間経常収益が1億ドルに到達しました。このツールは、マーケターがデザイナーの手を借りずに、ブランドに沿った広告画像や動画を作れる仕組みです。SpotifyやDomino'sなど大手企業も採用しており、フリーランスのマーケターにとっても、クライアントワークの効率化に使えそうな注目サービスです。
おすすめAIツール

DeepLが音声リアルタイム翻訳、Zoom会議で導入へ

翻訳サービスで知られるDeepLが、音声間のリアルタイム翻訳機能を発表しました。ZoomやMicrosoft Teamsのアドオンとして提供され、会議中に参加者の発言が即座に翻訳されます。海外クライアントとのやり取りが多いフリーランスにとっては、言語の壁を気にせず仕事の幅を広げられる可能性があります。現在は早期アクセス段階で、組織向けのウェイトリストを受け付けています。
おすすめAIツール

HuggingFaceのSmolAgents、複数AI連携を簡単に実装

HuggingFaceがリリースしているSmolAgentsというフレームワークを使うと、複数のAIエージェントを連携させたシステムを、比較的シンプルなコードで構築できます。従来は複雑な設定が必要だったマルチエージェントのオーケストレーション(複数AIの協調動作)が、Pythonの基本的な知識があれば実装可能になりました。特にフリーランスのエンジニアやデータ分析を行う方にとって、クライアントワークで「AIに複数のタスクを自動実行させたい」というニーズに応えやすくなる技術です。
おすすめAIツール

AIエージェントに記憶力を持たせるMem0の実装方法

AI開発者向けに、AIエージェントに長期記憶を持たせる新しい実装方法が公開されました。Mem0というツールを使うと、チャットボットがユーザーの情報を覚えて、次回の会話でも継続できるようになります。従来のチャット履歴とは違い、セマンティック検索で関連する記憶を自動的に引き出せる点が特徴です。複数ユーザーの情報を分離して管理できるため、ビジネス用途にも対応できます。
おすすめAIツール

Google新音声AI、70言語で感情表現が可能に

Googleが2025年、新しいテキスト音声変換モデル「Gemini 3.1 Flash TTS」のプレビュー版を公開しました。このモデルは、従来の機械的な音声合成とは一線を画す「演出された音声」を目指しています。フリーランスでポッドキャスト制作や動画ナレーション、多言語コンテンツを扱う方にとって、作業の質とスピードが大きく変わる可能性があります。現在、Google AI StudioやVertex AIから無料で試すことができ、70以上の言語に対応しています。
AIニュース・トレンド

Gemini Robotics-ER 1.6、計器読み取り93%精度を実現

Google DeepMindが2026年4月、ロボット向けAIモデル「Gemini Robotics-ER 1.6」をリリースしました。このモデルは、ロボットが現実世界で判断や計画を行うための「脳」として機能します。特に注目すべきは計器読み取り機能で、工場のアナログメーターやデジタル表示を93%の精度で解釈できるようになりました。Boston Dynamicsと共同開発しており、産業施設の点検作業での実用化が進んでいます。
タイトルとURLをコピーしました