WebMCPを試してみたがまだ時期尚早だった(2026年9月時点)
ブラウザだけでAIからWebアプリを操作できるWebMCPを、ChromeとChatGPTアプリのブラウザで試した作業メモです。現時点では実用には程遠いという感想でした。
技術系フィードから毎時取り込んでいる、まだ誰も拾っていない記事です。ジャンルで絞って探せます。ログインすると、気になったものをその場でブックマークできます。
生成 AI、機械学習、エージェント
ブラウザだけでAIからWebアプリを操作できるWebMCPを、ChromeとChatGPTアプリのブラウザで試した作業メモです。現時点では実用には程遠いという感想でした。

MicrosoftとQualcommが、特定のシステム要件を満たしたPCを対象として2024年から展開してきた「Copilot+ PC」ブランドが、公式な発表はあいものの実質的に消滅したことが明らかになりました。 続きを読む...
男女がペアを組んで囲碁を打つ「ペア碁」の国際的なイベントが名古屋市で開かれ、プロ棋士のペアによるトーナメントや、AIとプロ棋士のペアとの対局が行われました。

AI がどうにもまともなコードを生成しないので詰めていると、「SOLID 原則とか曖昧でちょっと・・・」と言われました。 その辺り諸々あるんですが、ココではその前段として型システムと責務について纏めます。 以下断定的に書いていますが、そうとは言い切れない例外や解釈を丸め過ぎている部分については本投稿では触れません。 C/C++ C にはそもそもクラスの概念がない。構造体だけで継承できない。(ポインタを介したアップキャストが出来ます @ AI 談) C++ にはクラスと構造体があるが、違いはアクセス/継承のデフォルトが private か public かだけ。どちらもローカル変数...
画像生成AIや動画生成AIをPCでローカル実行できるアプリ「ComfyUI」を開発するComfyが、サービスごとの画像・動画生成AIのAPIをまとめて扱えるようにする「Comfy Router」を2026年9月23日にリリースしました。 続きを読む...

Metaが大手メガネメーカー・エシロールルックスオティカと共同開発したAI搭載スマートグラス「Meta Glasses」が、日本でも2026年8月26日(水)に登場しました。12MPの超広角カメラを搭載し、3K Ultra HDでの動画撮影が可能で、さらにスマートフォンと連携することで音声AIアシスタントにもアクセスできるMeta GlassesをMetaから借りることができたので、実際に使ってみました。 続きを読む...
驚いたこと以外も書いちゃってますが、 太字のところをみていただけると デバイス操作はAIエージェントの時代へ。mobile-mcpを活用したAndroid UI/E2Eテストの挑戦 最初にデモがあった: 楽譜を書けるアプリでカエルの歌をAIが作る。 → 時間は...

プロンプトの複雑さに応じて haiku・sonnet・opus を自動で使い分ける Kiro Crew 0.7 のプレビュー機能を確認しました。判定エンジンは既定の Jev ではなく、互換 API を持つ Kev を M4 Mac の MLX でローカルに動かして使っています。

「作戦の 80〜90% を AI が実行した」「Gemini が能力テストの最中に実在企業へ侵入した」「1 時間ごとに自分のコードを書き換えるマルウェアが見つかった」 2025 年から 2026 年にかけて、AI とサイバー攻撃の見出しが相次ぎました。どれも「AI が攻撃...

この記事でやってみたことの要約 x402の従量課金(upto)について調べてみた uptoは微妙だと思ったから使わなかった(少なくとも現時点では) 代わりにJevで動的な価格付けを実装してみた Geminiに描かせたインフォグラフィック 試してみた経緯 エージェント向けの課金における課題感 x402を使うと、AIエージェントに有料でコンテンツやツールを売ることができます。AIエージェントが自分でお金を払う、いわゆる「Agentic Payments」のための決済プロトコルです。 売り物が、固定の記事やデータのような中身の決まったものなら、固定の値付けをしておけば問題あり...

Xに関するJevをみてBERTの勉強もしてみようかなと思いました 文章を分類して、各クラスの確率を返す。それなら以前からやっています。「生成しないAI」という紹介だけだと、どこに驚けばいいのか分からない。 一方で、問い合わせを振り分けるだけなのに、LLMにJSONを書き終わるまで待たされるのは、たしかにもったいない気がします。欲しいのはbillingというラベルであって、その前後の説明文ではないので。 このあたりが気になって、Jevの公式ドキュメントと、BERT・Transformerの原論文を読み直しました。中身を断定できるほどの資料は出ていませんでしたが、使い分けを考える材料はありま...

VS Code を開くと Claude Code の拡張機能が更新されている。 翌朝に開くとまた更新されている。 さすがに多くないかと思って、実際に数えた。 どれくらい出ているのか 更新の回数は、Marketplace の API で正確に数えられる。 拡張機能の全バージョンと、その公開時刻が返ってくる。 curl -s -X POST "https://marketplace.visualstudio.com/_apis/public/gallery/extensionquery" \ -H "Accept: application/json;api-version=7.2-p...
MicrosoftのCopilot+ PCが静かに終了した背景を解説。AI機能が当たり前になった今、そのブランドが名乗られなくなった理由と今後のPC市場の動向を分かりやすくお伝えします。
Metaの新マスコットJollyとウェアラブルAI「Muse Charm」の危険性を暴く。可愛い見た目の裏に隠されたデータ収集の罠に要注意。
ChatGPT Sitesを使ってたった数秒で本気のポートフォリオを作成する方法を実体験ベースで解説。驚きの機能と注意点とは?
はじめに 日本語プログラミング言語Mindのバージョン9でAI仕様駆動開発(っぽいこと)を行ってみます。本記事はその第4ステップで、AI仕様駆動開発の後工程のキモ?とも言えるAI修正・ビルド・実行・再修正ワークフローの自動化をGUIアプリでやってみたという内容です。 使...

判断特化型AI Jev互換のOSSモデル「Kev」を M4 Pro / macOS 27 の MLX で動かしました。M1 / Docker では重すぎた 4B が 0.26 秒で応答し、AI-DLC の scope を選ばせる判定では 0.8B より良好な結果を得られました。

Claude CodeのWeb版では複数のリポジトリを1つのセッションに追加できますが、実際にいくつまでつなげられるのか、公式ドキュメントに上限の記載がなかったので試してみました。
深海の映像から、海底に沈むプラスチックなどのゴミを自動的に検出するAIが新たに開発され、環境対策に役立つと期待されています。

TypeSafe AI の判断特化型 AI「Jev」と同じ `POST /v1/systemone` API を持つ OSS モデル「Kev」を、Apple M1・メモリ 16GB・GPU なしの Linux 環境で Docker から起動し、必要なリソースと回答の傾向を確かめました。

AWS Startup Advisor プラグインを Claude Code で試してみました。AWS Startup ソリューションアーキテクトが スタートアップ企業のステージである Pre-revenue や Series A 等、成長段階に合わせた構成の助言とレビューを実際に受けてみたので、その結果と使い方をまとめます。

こんにちは、@key60228 です。 Platform Engineering Kaigi 2026 に参加してきました! https://www.cnia.io/pek2026/ 原理的な Platform Engineering の話から、AI 基盤としての Platform の話、組織論的な話、はたまた Kubernetes の Controller の話まで、幅広いテーマのセッションがあり、かつ交流会でも色々な方とお話できてすごく楽しい一日でした 🙌 例年のページを見るにすぐに公式から展開いただけるのかな?と思いつつ、自分用メモを兼ねて、公開されている登壇資料をタイムテーブル順..

user: ソース動画のタイトル、そしてこの動画の内容について教えてください。 Gemini: ご提示いただいたソース動画のタイトルおよびその詳細な内容について解説します。 動画のタイトル 「財政破綻国家との比較でわかった日本の真実 : Pythonで学ぶマ...
OpenCodeでGPT-6を使いたくなったので、ChatGPT Plusを契約して試してみました。ブラウザ認可だけでOpenAIと接続でき、定額プランで最新モデルが利用できることがわかったので、その手順と結果をまとめます。

はじめに Claude Code の hooks で「作業が完了したら macOS の通知+音声で知らせる」設定をしていました。 ところが、サブエージェントをよく使うようになってから、作業の途中で何度も「作業が完了したよ」と鳴るようになりました。どれが本当の完了なのか分か...

ホテルの事前チェックインで、パスポートや運転免許証をiPhoneで撮影して名簿を自動作成できるか、実際にアプリを作って精度と速度を測ってみました。AIモデルと文字認識を組み合わせた結果から見えてきた、本当に必要な技術を紹介します。
はじめに あまり明確な目的があったわけではないのですが、OCIのGenerative AIではOpenAI互換APIをサポートしていて、「Codexで使えるんじゃ」、「どこかで使い所はあるかも」というゆる〜い理由で試してみました。 結論! 以下のモデルでとりあえず動くこ...