Vercel AI SDK 7、ツールが宣言済みのシークレットのみを使用するように制限
SDKは各ツールに対してZodベースのコンテキストスキーマの提供を必須とし、実行時にVercelが宣言済みのフィールドのみが渡されているかを検証します。余分なキーや不足しているキーがある場合は、実行を中止します。
AI、機械学習、LLMのインサイト。
SDKは各ツールに対してZodベースのコンテキストスキーマの提供を必須とし、実行時にVercelが宣言済みのフィールドのみが渡されているかを検証します。余分なキーや不足しているキーがある場合は、実行を中止します。
自前でLLMを運用する場合とAPI利用の真のコスト比較。オープンウェイト自体は無料ですが、運用にはコストがかかります。オープンモデルをセルフホスティングすれば節約できると考える人が多いですが、それは間違いです。見るべきは…
モデルの出力を編集可能なテキストとして扱うDeep Interactionは、開発者が誤った推論ステップを特定して書き換え、蒸留されたプロンプトを再投入することを可能にします。これにより、STEMベンチマークにおいて修正率が25%向上し、トークン使用量を40%削減することに成功しました。
AIエージェントに1週間クラウド運用を任せてみた。AIエージェントに、私のクラウド運用を7日間任せてみました。これはデモではなく、実際の環境です。モニタリングへの読み取り権限を与え……
新しい amazon-opensearch-service スキルは、ポリシーのシーケンシングやインスタンスサイズの決定を高速化しますが、Serverless NextGenでのベクター検索設定において、従来のFAISS設定をデフォルトとして適用してしまうため、デプロイの失敗を招いています。
これら2つのリリースにより、オープンウェイトモデルはマイナーなプロジェクトから主流のAIへと押し上げられました。これにより、企業は Apache 2.0 ライセンスの下で大規模モデルをオンプレミスで運用できる選択肢を得ると同時に、コーディングタスクにおいてクローズドソースと同等の性能を享受できるようになります。
このフレームワークは、UI、API、データ、権限、ポリシーの5つのドリフトカテゴリを定義しています。軽量なコントラクトマップとプリフライトスキャンを用いることで、自律型エージェントが実行される前に不一致を検出し、サイレントな失敗やコストのかかる手戻りを防ぎます。
Model Context Protocol(MCP)コネクタにより、Claudeが生成したコードをチャットから直接データベース、クラウドサービス、Slackなどへ呼び出せるようになりました。これにより、コピペの手間が省かれ、開発者は即座に実際のデータを使ってテストを行うことができます。
検証ステップの欠如により、エージェントは「実行」フェーズをスキップしてしまい、実際のツールを一度も呼び出すことなく、丸一日をかけて1,858回もの内部的な考察を繰り返す結果となった。これは、ツール駆動型のアシスタントを機能不全に陥らせる「自己ループの罠」を露呈している。
Moonshotは2.8兆パラメータのモデルと低価格なトークン単価を強調しているが、Mixture-of-Experts(MoE)設計と過剰な冗長性によって出力が1億3000万トークンに達しており、これは競合モデルの2倍以上のボリュームとなるため、実際の利用コストを押し上げている。
新しい状況認識ベンチマークは、モデルに「あなたはAIですか?」といったメタ的な質問への回答や、対話の変化に応じた回答の調整を求めるものです。これにより、高スコアを記録している多くのLLMが、依然として人間であると主張したり、自らの限界を隠したりしている実態が明らかになりました。
AIエージェントは正常なJavaScriptの結果とスクリーンショットを確認しましたが、Chromeの非表示タブのスロットリングによってrequestAnimationFrameのコールバックが停止し、Canvasが描画されない状態になっていました。表示されているタブでテストを実行するか、ピクセルが空でないことを確認するチェックを追加することで、この誤検知を修正できます。
このアップデートでは、サブエージェントの生成とウェブ検索の呼び出しに対して、それぞれセッションあたりデフォルト200回という2つの環境変数による制限が導入されます。また、長時間のMCP呼び出しには2分間の自動バックグラウンド化ルールが適用され、チームが制御不能なコスト増を抑制するための具体的な手段を提供します。
Noma Labsは、攻撃者が公開リポジトリに細工したイシューを投稿することで、プライベートリポジトリへの読み取り権限を持つCI連携AIエージェントを起動させ、認証情報の窃取やGitHub自体の脆弱性を突くことなく、ボットにそれらのファイルをイシューへ書き出させることができることを実証しました。
実際の運用では、ユーザーの発話、ツールのスキーマ、APIレスポンス、取得されたドキュメントのすべてがプロンプトに蓄積されます。この隠れた肥大化により、処理時間とコストが二次関数的に増大し、スムーズだったデモが、高コストでレイテンシのひどい悪夢へと変貌してしまいます。
Visa、Mastercard、Stripe、Googleの支援を受けるLinux Foundationの新組織「X402 Foundation」は、AIエージェントの支払い用メッセージ形式を定義しているものの、適合性スイート、セキュリティプロファイル、認証プロセスなどは盛り込まれておらず、その権限の主張が検証されないままとなっている。
Analyzing 312 real calls, the team replaced a 700 ms silence rule with a lightweight state machine that watches silence duration, grammatical completeness, and back-channel cues, driving truncations down from 18 % to 3 % and eliminating dead silence.
163件のラベル付きインシデントに基づき構築されたこのベンチマークは、診断の枠を超えて、AIアシスタントが不確実性を認識し、意図的に判断を控えることができるかを検証するものです。これは、LLMの確信度が高まるにつれて顕在化する、重大な安全上のギャップを浮き彫りにしています。
無関係な画像データセットで学習したモデルを転用することで、LIGOの新しいシステムは、既知のグリッチ・ファミリーをほぼ完璧な精度で分類するだけでなく、未知のアノマリーをクラスタリングすることも可能です。これにより、科学者は手作業によるデータクリーニングから解放され、天体物理学の研究に集中できるようになります。
たった一晩で、そのエージェントはMCPクライアント、Azure AIエージェント、M365 Copilotエージェントを完成させた。しかし、軌道修正のために30回のやり取りのうち12回もの指示が必要となり、プロンプトの書き直しを伴うワークフロー違反やコンテキスト取得のバグが浮き彫りになった。
GoogleのGemini NotebookがPDFやドキュメントなどのファイルをインデックス化し、AIによる即時クエリが可能になった一方で、AnthropicのClaudeは1Passwordから認証情報を取得してサービスへサインインできるようになりました。さらに、共同仕様によって、エージェントがカスタムコードなしでAPIを検出し、呼び出せるようになることも目指しています。
AWS ContinuumのAIエージェントは、バージョン管理リポジトリを継続的に監視して修正案を提示するだけでなく、開発者のIDEやCIパイプラインに直接パッチを適用することも可能です。これにより、サプライチェーン攻撃にさらされるリスクを大幅に低減します。
この転換により、Googleはレイアウトからテストに至るチップスタック全体の再設計を余儀なくされ、インテルの歩留まり能力が厳しく問われることになります。成功すればAIチップのサプライチェーンの多様化につながりますが、わずかな躓きでも出荷の遅延を招き、TSMCに再び主導権を握られる可能性があります。
工場で製造され、完成品として出荷されるモジュール式ポッドは、わずか数週間で接続が可能です。また、Lanciumのソフトウェアが仮想バッテリーとして機能することで、需要を平滑化し、余剰の再生可能エネルギーやガス発電を活用して、地域のERCOTグリッドの安定性を維持します。