Skip to content

Column

研究をビジネスの言葉に。

Affectosphere Group の研究を、ビジネスや実務の意思決定に役立つ形で書き直しています。1 本 5 分で読めます。

ソーシャルメディアのタイムラインに沿って感情の変化が可視化されるフラットイラスト

2026 / 07 / 01

AIは「心の変化」を時系列で読み取れるか——ソーシャルメディアのタイムラインが語るメンタルヘルスの動態

1本の投稿だけでは見えない「心の変化」を、AIが時系列で追い続ける。投稿レベルの感情評価とユーザーレベルの時間的変化モデリングを統合したパイプラインが、早期介入の新しい可能性を示す。

5 min read Read →
複数のAIエージェントが共有ワークスペースを介して仮説立案・実験・論文執筆を分担する様子のフラットイラスト

2026 / 07 / 01

研究の「仮説→実験→論文」を全部AIがやる時代が来た——FARSが示すリサーチ自動化の現在地

67のAI/MLトピックにわたって166本の研究論文を自律生成したマルチエージェントシステムFARSの仕組みと、コンサルや金融リサーチへの実装可能性を解説する。

5 min read Read →
7つのカテゴリに分類された医療タスクをAIエージェントが評価されている様子のフラットイラスト

2026 / 07 / 01

医療AIエージェントの「実力」をどう測るか——成功率42%が示す導入判断の新基準

7カテゴリ54の現実的な医療タスクでLLMエージェントを評価するHealthAgentBenchは、最高性能システムでも成功率約42%にとどまることを示した。この数字を医療AI調達の根拠として使う方法を解説する。

5 min read Read →
キーボード上の指の動きと認知負荷グラフが重なるフラットイラスト

2026 / 07 / 01

タイピングの「乱れ」が認知負荷を語る——キーストローク動態でLLMツールの「使いにくさ」を可視化する

36名の実験で、LLMへのプロンプト入力中のキーストローク動態が認知的負荷の受動的指標になることが確認された。社内LLMツールの利用ログを認知負荷センサとして活用するワークプレース分析の実装提案を解説する。

5 min read Read →
AIエージェントが環境に物を配置し、それを見た人間の信念が変わっていく様子を示すフラットイラスト

2026 / 07 / 01

AIエージェントは「黙って」あなたを説得できる——非対話型信念操作の実力と、企業が今すぐ導入すべきリスク評価枠組み

GPT-5は会話なしで約80%の成功率で他者の信念を変えられることが示された。AIエージェントを営業・交渉支援に使う企業がまず整備すべきリスクアセスメントの考え方を解説する。

5 min read Read →
子ども向けアプリのリスクカテゴリを示す図とAIの評価スコアのフラットイラスト

2026 / 06 / 30

子ども向けAIアプリの安全審査、今の方法では足りない——CAREBenchが明らかにした58%の失敗率

グルーミング・欺瞞・感情的依存など12のリスクカテゴリで子どもの安全を評価するベンチマーク「CAREBench」が公開された。7つのフロンティアモデルをテストした結果、カテゴリによっては失敗率が58%に達することが判明。EdTechプロダクト開発者と規制対応担当者が今すぐ把握すべき内容を解説する。

5 min read Read →
コードレビューを行うAIと、コンテキスト記述が検出結果に影響を与えるようすを示すフラットイラスト

2026 / 06 / 30

AIにコードレビューを任せる前に知っておくべきこと——変数名ひとつで脆弱性を見逃すリスク

LLMがコードの脆弱性を正しく検出できるかどうかは、コードそのものではなく「コンテキストの書き方」で大きく変わる。8つのモデルで実証された認知バイアスの実態と、現場でできる対策を解説する。

5 min read Read →
人間のサーベイとLLMによる推定が並列に走り、同等の統計的出力を生むフラットイラスト

2026 / 06 / 30

「人間に聞かなくてもいい」のか——LLMが統計的推定量として使える理論的根拠

LLMが人間被験者データの統計的代替として機能することを、Le Cam欠損分析による理論保証で示した研究が登場した。調査コストを削減しながら高精度なインサイトを得る製品設計の可能性を探る。

5 min read Read →
複数のビジネスシステムがMCPサーバーを経由してLLMに接続される構成図のフラットイラスト

2026 / 06 / 30

LLMに業務ツールを「全部つなぐ」と何が起きるか——MCPサーバーの5パターンとツール数爆発の罠

15のMCPサーバーを横断分析した研究が、アーキテクチャパターンを5種類に体系化した。ツール数が閾値を超えるとClaudeの選択精度が顕著に低下するという定量的知見は、エンタープライズAI設計の常識を書き換えるかもしれない。

5 min read Read →
2人が向き合って話している場面。それぞれの音声波形が徐々に同じリズムに近づいていくイメージ

2026 / 06 / 30

会話の「感情的なシンクロ」を97%の精度で検出できるか——採用・コールセンター向け感情同調AIの衝撃

2者間の会話で起きる感情エントレインメント(感情的な同調現象)をAIが自動検出する時代が来つつある。TRACE フレームワークと DyadEE データセットが示す実装の可能性とは。

5 min read Read →
温かいチャット画面から光が漏れ、健康指標が上向きに並ぶ静かなイラスト

2026 / 06 / 29

AIと話すだけで、眠れるようになるのか

メンタルヘルス特化型AI『Ash』を1,284名で4週間追跡した研究が、驚くべき知見を示した。効果を左右したのは『どれだけ話したか』ではなく『何日使い続けたか』だった。

5 min read Read →
デジタル処理ハブへ流れ込む大量の商品カードを表すイラスト

2026 / 06 / 29

7億人・数百億SKUのEC商品管理をAIが支える——JD.comの産業実装から何を学ぶか

中国最大級のEC企業JD.comが、LLM/VLMを核に据えた商品知識管理プラットフォーム「Oxygen AIIC」を構築した。情報品質問題37%削減、属性自動補完率80%超——その設計思想は、国内EC事業者や小売チェーンにとってPIM刷新の参照事例になる。

5 min read Read →
自然言語の質問がグラフ上のCypherクエリパスに変換されて答えを返すイメージ

2026 / 06 / 29

社内データに自然言語で質問できる日——KG2Cypherが変えるナレッジグラフ活用

Cypherクエリを書けない非エンジニアでも、社内ナレッジグラフに自然言語で質問できる。KG2Cypherが示す95.2%精度のText-to-Cypherパイプラインと、HR・営業部門への応用を解説する。

5 min read Read →
A phone call conversation visualized as dual-channel waveforms with NLP overlays flagging suspicious phrases and voice pattern matches feeding into a fraud risk score

2026 / 06 / 29

保険詐欺をAIで見抜く——通話録音とテキストを組み合わせたマルチモーダルNLPの実力

保険の初回事故報告(FNOL)段階の詐欺検知に、音声とテキストを組み合わせたハイブリッドNLPパイプラインを適用。合成データ生成で実データ不足を補い、声紋の繰り返しや構造的不整合をルールベースで検出する仕組みとその損保業界への応用を解説する。

5 min read Read →
法律文書の抜粋が枝分かれして要約段落にまとめられていく様子のイラスト

2026 / 06 / 29

判例調査をAIで半分にできるか——法律要約のハイブリッドアプローチが示す実装指針

企業法務やM&Aチームが毎回直面する判例調査の重さ。ICAIL 2026採択論文が提案するTree-of-Thoughts発想のハイブリッド要約手法は、実務に何をもたらすか。

5 min read Read →