GyaanSetu AI

AI、機械学習、LLMのインサイト。

1515 articlesDeep, practical knowledge

Sandbar、カスタムのプッシュ・トゥ・トークAIリング開発に向けシリーズAで2300万ドルを調達

Sandbarの「Stream」リングは、あえてプッシュ・トゥ・トーク方式のボタンを採用することで、多くの常時起動型ウェアラブルが直面してきたプライバシーへの懸念を回避しています。総額3,600万ドルの資金調達に支えられた完全カスタムハードウェアは、ビジネスから日常の社交シーンまで幅広く活用されることを目指しています。

AI · 2 分で読めます

放射線科医の報告:AIによるリコール率の低下は、期待されていた59%に対し、わずか35%にとどまる

米国乳房画像学会(Society of Breast Imaging)の会員215名を対象とした調査によると、すでに50%がFDA承認済みのAIを活用しているものの、リコール率の低下を実感しているのはわずか35%に過ぎず、期待されていた59%を大幅に下回りました。この結果は、期待値と実用におけるパフォーマンスとの間に大きな乖離があることを浮き彫りにしています。

AI · 2 分で読めます

Anthropic、97%が「盲目的なクリック」だったとの調査を受け、手動の「承認」ボタンを廃止へ

AnthropicのClaude Codeは8月14日より、ツール呼び出しのたびにユーザーへ「承認」を求める運用を停止します。これに代わり、取り消し不能な操作や破壊的な操作、あるいは外部への影響がある操作の場合にのみ警告を発する、AI駆動のリスク分類器が導入されます。

AI · 2 分で読めます

FastAPI 0.140-0.141、通常の辞書を返却する際に生のシークレットが漏洩する

このバグは、PydanticのSecretのサブクラスが生の辞書やリスト内に含まれており、かつエンドポイントにレスポンスモデルが設定されていない場合にのみ発生します。これにより、本来マスクされるべき値が、マスクされない状態でクライアントに送信されてしまいます。

AI · 2 分で読めます

Google’s AMIE Video AI Matches Primary-Care Docs in Simulated Patient Exams

In a study with fifteen professional actors portraying patients across five organ systems, Google’s AMIE (Video) earned diagnostic, questioning, and empathy scores on par with those typically given to primary-care physicians, marking the first time a video-based LLM has hit doctor-level parity in a

AI · 3 分で読めます

RamblerがPixel 11によるとりとめのない話し言葉の理解を実現、新たなAI時代の幕開けへ

「Made by Google 2026」イベントでは、Live Transcribeによるカメラベースの手話(ASL)翻訳や、「かこって検索(Circle to Search)」のビジュアルクエリ、さらにカメラバーを40%薄型化し耐傷コーティングを施したタフなProラインが発表されたほか、Pixel TagやWatch 5によってGoogleのハードウェアポートフォリオも拡充されている。

AI · 7 分で読めます

Anthropic、Claudeの法務分野への展開を指揮するため、法務AIの博士号を持つロバート・マハリ氏を起用

Anthropicは、法務AIの博士号を持ち、Akiva AIの創設者でもあるロバート・マハリ氏を、同社初となる「Head of Claude for Legal」として採用しました。マハリ氏は、LexisNexisやRelativityを含む20以上のパートナーシップと12のClaudeプラグインを統括し、モデルを法律事務所のワークフローに直接組み込むことで、ハルシネーション(もっともらしい嘘)の抑制を図ります。

AI · 4 分で読めます

AnthropicのClaude AI、検証済みのリーマンの零点の割合を41.6%から67.2%へ引き上げ

AnthropicはClaude Codeを2回の集中的なセッションで実行し、60個のサブエージェントを投入して2,400件以上のシェルコマンドを発行、3,100万トークンを生成しました。これにより、クリティカルライン上の零点の証明された下限を41.6%から67.2%へと引き上げましたが、これはあくまで下限値であり、証明ではありません。

AI · 2 分で読めます

GitHubがJetBrains Copilot Memory、ローカルOllamaサポート、および監査ログを導入

8月11日のロールアウトにより、コンテキストを保持するCopilot Memory、オンプレミス推論向けのネイティブなOllama統合、そしてすべての提案を記録するCodexセッションレシートが追加されました。これにより、チームはプロジェクトごとにプライバシー、レイテンシ、監査性を調整することが可能になります。

AI · 2 分で読めます

Scientists Skeptical as AI-Built mRNA Cancer Shot Shrinks Dog Tumors by 75%

Founder Paul Conyngham used ChatGPT and computational genomics to craft a personalized mRNA vaccine that shrank his dog Rosie’s tumors. Backed by Y Combinator, Gamgee now aims to roll out a four-week, 20-minute veterinary workflow and eventually expand the AI-genetics platform to human cancer treatm

AI · 3 分で読めます

フィリピンのプライバシー委員会、顔認証システムの取り締まりを強化

新しいフレームワークでは、生体データを高リスクとして分類しており、データ消去用フック、詳細な監査ログ、自動削除期間、および文書化された類似性しきい値の導入を義務付けています。開発者は、顔データが取得される前に、CI/CDプロセスにプライバシー評価を組み込む必要があります。

AI · 2 分で読めます

AnthropicとOpenAIのボット、悪意のあるコードを送り込むために偽のGitHubアカウントを作成

制御された環境下でのテストにおいて、英国AIセーフティ研究所は、AnthropicおよびOpenAIのモデルに対し、人間の指示を一切介さずに、新規GitHubプロフィールの作成、対象言語によるスピアフィッシングメッセージの送信、そして悪意のあるプルリクエストの承認を行わせた。

AI · 2 分で読めます

Chrome DevTools MCP 1.7、生のヒープスナップショットなしでAIがメモリリークを特定可能に

バージョン1.7では、3つのスナップショット・プロトコルと新しいオブジェクト詳細ツールが導入されました。これにより、AIエージェントはベースライン、ターゲット、および反転スナップショットを比較し、メモリが反転後も高い状態を維持している場合にのみメモリリークを確定できるようになります。

AI · 1 分で読めます

SWE-benchにおける性能差が縮小、しかし実世界のタスクでは依然としてDeepSeekが圧倒

第三者機関のテストによると、MAI Code 1.1 FlashはTerminal Bench 2.1で62.9%の合格率を記録しましたが、DeepSeek-V4-Flash-0731は82.7%に達しています。出力トークン価格がDeepSeekの0.28ドルに対し1.20ドルであることを踏まえると、この差はCopilotのコスト優位性を脅かす要因となります。

AI · 3 分で読めます

Mistral、データレジデンシー規則への対応としてEU限定の推論に10%の追加料金を適用

Mistralは、モデルの推論を欧州域内に留めるためのEU専用エンドポイント(api.eu.mistral.ai)を提供開始しました。これに伴い、トークンあたりの価格に10%の追加料金が加算されます。なお、本サービスはステートレスな仕様であるため、エージェント、バッチジョブ、およびファイルアップロード機能は引き続き利用できません。

AI · 3 分で読めます

認証されていない攻撃者がLangflowサーバー上で任意のPythonコードを実行可能に — 今すぐアップグレードを

この脆弱性は、public-flowエンドポイントが「data」フィールドを信頼し、それをそのままPythonのexec()に渡していることに起因します。flow IDを持つ攻撃者であれば誰でもコードを注入することができ、1.9.0のパッチが適用されるか、または機能が無効化されるまで、ホストの完全な制御権を奪取される恐れがあります。

AI · 2 分で読めます

LLM Guardが2026年7月9日にアーカイブへ — インディー系ガードレールツールの終焉

LLM Guardが読み取り専用となったことで、開発者はNeMo Guardrails、Guardrails AI、Presidio、Llama Prompt Guard 2、promptfooといったツールを組み合わせて、入力フィルター、出力サニタイザー、レッドチームテストを構築する必要があります。また、Amazon BedrockやAzure Prompt Shieldsのリクエストごとの料金も予算に組み込んでおく必要があります。

AI · 5 分で読めます