タグ: エージェント
「エージェント」に関連する記事を表示しています。
Google検索がAIに刷新、エンジニアとして何が変わるか
Google I/O 2026 で発表されたAI検索刷新、Generative UI in Search と Search Agents が個人開発にどう影響するかを実務目線で整理した。
AIエージェントの「強さ」を比較する時代が来た
IBM ResearchがHugging Faceで公開した「Open Agent Leaderboard」は、AIエージェントをモデル単体でなくシステム全体で評価する新しい試みだ。
コーディングエージェントが「daily-driver」になった話
PyCon US 2026のLLMまとめスライドを読んで、コーディングエージェントが本当にdaily-driverになったと実感した話。モデル選定よりAPIコスト設計のほうが気になる。
Claude APIのウェブ検索がSECデータに対応、金融系エージェント実装が変わる
Claude APIのウェブ検索ツールがSECフィリングデータに対応。前処理パイプラインを丸ごと捨てられるか、実務目線で検証してみる。
DatabricksがGPT-5.5を採用。企業AIの使い方が変わる予感
DatabricksがGPT-5.5を企業のエージェントワークフローに採用。OfficeQA Proで最高スコアを記録したモデルが、業務AIの現場に入り込んできた。
AIエージェントが「全部やる」時代、デザイナーの私はどこにいる?
OpenAIがChatGPTとCodexを統合し「エージェント全振り」を宣言。フリーランスデザイナーとして、このニュースに感じた背筋の寒さと、それでも踏ん張る場所の話。
CodexがスマホでOKに。これ地味にすごい変化じゃない?
OpenAIがChatGPTのモバイルアプリからCodexを操作できる機能を発表。スマホでコードタスクの監視・承認ができる地味に大きな変化の話。
スマホで動くAIエージェント、製造業の現場で使えるか?
2600万パラメーターでスマホ動作するAI「Needle」が登場。オンデバイス処理は製造業のセキュリティ要件と相性がいいが、ライセンスリスクも見逃せない。
CodexのWindowsサンドボックスから学ぶ、AIエージェントに渡す権限設計
OpenAIのCodex Windowsサンドボックス設計を読んで、自分のLLMエージェントの権限設計がいかに甘かったか気づいた話。
LangChain 1.3.0のstream_eventsをエージェントで使う話
LangChain 1.3.0でagentsのastream_eventsがv3対応。自分のコードのどこを変えるか確認してみた。
AIエージェントが機械学習コンペを変えた話
OpenAIのParameter Golfレポートで見えてきた「AIエージェントが実験コストを変えた結果、何が問われるようになったか」という話。
AIが「作業時間33%削減」を実現した話を社労士目線で読んだ
子ども服ブランドのAI導入事例を読んで、作業に追われる構造は社労士も同じだと気づいた。AIが変えるのは作業量より「判断の余白」かもしれない。