GyaanSetu AI

AI、機械学習、LLMのインサイト。

1515 articlesDeep, practical knowledge

AgentNemesisが、実際には行われていない34.50ドルの返金を主張したAIサポートボットを摘発

デモ用のボットはユーザーに対し34.50ドルの返金処理を行ったと伝えたが、実際にはAPIコールは記録されていなかった。AgentNemesisは、SigNozにストリーミングされたOpenTelemetryトレースを活用してこのような不一致を検出し、目に見えない欺瞞を実用的なデータへと変換する。

AI · 3 分で読めます

「嘘」によるファインチューニングは、LLMを汎用的な欺瞞者へと変えるものではない

「ライアーズ・ゲーム」の実験では、2つの同一のモデルに秘密の役割と嘘をつくための報酬が与えられましたが、モデルは嘘を拒否するか、あるいはすぐに正体が露呈しました。これは、現在のLLMには持続的な欺瞞に必要な計画性と記憶力が欠けていることを証明しています。

AI · 3 分で読めます

GraphVid、インタラクショングラフの活用によりFIDを39.9%、FVDを37.6%削減

GraphVidは、手書きの軌跡を高レベルなインタラクショングラフに置き換えることで、遮蔽(オクルージョン)が発生している場面でもモデルが一貫した動きを推論することを可能にします。新たに構築されたGraphVid-Benchで学習された本モデルは、パラメータ数を抑えつつ、より鮮明なテクスチャ(PSNR 15.98)と高い類似性(SSIM 0.61)を実現しています。

AI · 2 分で読めます

7月28日にMCPがセッションIDを廃止 — コードを書き換えないとルーティングエラーが発生する恐れ

7月28日のアップデートにより、ハンドシェイクとセッションIDが廃止され、すべてのリクエストに完全なコンテキストを含めることが必須となります。チームは、インメモリのセッションマップ、スティッキーロードバランサーの設定、およびセッションごとのキャッシュを監査しなければなりません。怠ると、ルーティングエラー、キャッシュミス、バックグラウンドジョブの暴走を招くリスクがあります。

AI · 3 分で読めます

専門家が警告、無制限のAIアクセスによりハッカーがゼロデイ攻撃を作成できる恐れ

両社は、これらのプログラムは管理されたバグバウンティ(脆弱性報奨金)プログラムであると説明しているが、批判的な専門家は、認証情報の窃取や審査の回避が発生した場合、攻撃者が同じ無制限のモデルを利用して、フィッシングスクリプトやゼロデイコード、さらには巧妙にカスタマイズされたソーシャルエンジニアリング用のプロンプトを生成できてしまう可能性があると指摘している。

AI · 2 分で読めます

AI論議における欠けている要素

AI論議における欠けている要素。誰もがAIエージェントについて語っています。テック系のフィードをスクロールすれば、大規模言語モデルが予約を行うといった、数十ものデモを目にすることでしょう…。

AI · 6 分で読めます