ai Trend Report

Dashboard へ戻る
Date: 20260830 Articles: 145 Scope: curated summary

あなたのアイデアを、今すぐ形に。

公開先に迷ったら、WebFileBinで一発公開。

HTMLをドラッグ&ドロップするだけで、すぐ公開できます。

3
High impact
5
Mid impact
137
Signal watch

なぜこのサイトを作ったのか

私たちそれぞれが個別にAIを使って情報収集し、同じような3行要約を作るたびに、世界中で膨大な電力と計算リソースが消費されています。 本プロジェクトは、あらかじめ広範な情報を取得・集約しておくことで、個別のAI実行回数を減らし、地球環境(GPU/TPU負荷)に配慮した効率的な情報収集を目指す実験的なダッシュボードです。

Domain filters
Star filters
Zennのトレンド

「スタートアップだから」が通用しない、大手製造業向けSaaSのAWSセキュリティ設計

・はじめに 株式会社FAcraftの山本です。 ・FAcraftは、大手製造業向けのSaaSを開発・運用している小規模なスタートアップです。サービス基盤の一つとして、AWSを利用しています。 ・SaaSを提供する以上、しっかりとしたセキュリティ対策を行うことは当然ですが、大手製造業向けにサービスを提供していると、顧客からも具体的で高い水準のセキュリティ要件を求められることが珍しくありません。
#LLMタグ

AIエージェントを17時間回したら、1ターン23万トークン払っていた

・AIエージェントに仕事を任せる、という話が増えています。 ・私も3日間、実際に回してみました。データ収集、分析、検証を複数のエージェントに分担させて、24時間動かす構成です。 ・結論から書きます。いちばん高くついたのは、エージェントの数ではありませんでした。
Zennの「大規模言語モデル」のフィード

なぜ、LLMが知的格差を拡大させる理由は、LLMが「嗜好」の増幅装置だからと言えるのか?

・はじめに 生成AIが普及すると、誰でも高度な知識へアクセスできるようになるため、知的格差は縮小すると考えることもできます。実際、以前なら専門家へ質問したり大量の文献を読んだりしなければ得られなかった情報を、現在ではLLMへ質問するだけで短時間に得られます。この意味では、LLMには知識へのアクセス格差を縮小する強い作用があります。 ・しかし、LLMが長期的に人間へ与える影響を考えると、それとは反対に知的格差を拡大する可能性も見えてきます。その原因を単純に「頭の良い人ほどAIを上手に使えるから」と説明するだけでは不十分です。LLMの特殊性は、利用者全員へ同じ使い方を要求せず、本人がやりたい...
@IT 全フォーラム 最新記事一覧

「脱メインフレーム、約7割が失敗」の衝撃――“生成AIを使うだけ”ではむしろ泥沼化も

・富士通に続き、日立製作所もメインフレーム事業からの撤退に向けて動き始めました。生成AIによる刷新への期待が高まる一方、「脱メインフレーム」の7割超が失敗するとの予測もあります。生成AIがあっても移行が簡単ではない理由と刷新のアプローチを考えます。
#AIタグ

【厳選】AI半導体一極相場の次を狙う「手あかのついていない」割安・テーマ性銘柄13選

・直近の株式市場では、これまで続いていたAI半導体一極集中の相場から、バリュー株や中小型株へと資金がローテーションする兆候が強まっています。 ・相場の潮目が変わる局面で重要になるのは、割安感がありながら、しっかりとしたテーマ性を備えていること、そして何より「他の投資家や市場参加者からまだ過度な注目を浴びておらず、売買の対象として荒らされていない(=手あかのついていない)銘柄」を先回りして仕込んでおくことです。
Zennの「機械学習」のフィード

A3C(Asynchronous Advantage Actor-Critic)を数式と実装で理解する

・初出: note(A3C(Asynchronous Advantage Actor-Critic))。Zenn向けに数式・擬似コード・現行手法との比較を補って再構成しました。 ・強化学習の応用例としてよく名前が挙がる A3C(Asynchronous Advantage Actor-Critic)を、概念だけでなく数式と実装レベルで辿り直します。2016年に DeepMind が提案した手法で、現在の主流は後述の A2C や PPO に移っていますが、「なぜ非同期に複数エージェントを走らせると学習が安定するのか」という設計思想は、いまも分散学習全般を理解するうえで見通しがよい題材です。...
Qiita - 人気の記事

ガバメントクラウドAWS環境における統合監視・AIによる障害時自動調査について検討してみた

・富士通 Japan 株式会社 Public & Education 事業本部 クラウドサービス事業部の吉村 康良です。 ・令和3年度のガバメントクラウド先行事業から、ガバメントクラウドを利用したインフラストラクチャの設計に従事し、現在は主にガバメントクラウド上のインフラ運用保...
Qiita - 人気の記事

読書感想文『運用設計の教科書』監視運用編(p240〜p252)

・書籍情報 書籍名: 運用設計の教科書【改訂新版】 〜現場でもっと困らないITサービスマネジメントの実践ノウハウ〜 著者: 近藤 誠司 著者について 株式会社K-model代表。オンプレからクラウドまで幅広いシステム導入プロジェクトに運用設計担当として参画。運用設計・運用...
Zennの「機械学習」のフィード

「12月からコードを一行も書いていない」Karpathy×No Priorsを要点解説

・この記事について Andrej Karpathy が No Priors(Sarah Guo との対談ポッドキャスト)で語った内容を、要点だけ抜き出して日本語で解説します。「AIエージェント時代に、エンジニアの仕事は何に変わったか」を実感ベースで語る回です。 ・本記事は元動画の全文翻訳ではなく、紹介と論評を目的として筆者が要点を抜き出し、筆者の見解を主体に構成したものです。正確なニュアンスは元動画(No Priors / Andrej Karpathy)をご覧ください。 ・テーマ1:コードを書かなくなったエンジニア Karpathy が「12月以降、コードを一行も書いていない...
Zennの「大規模言語モデル」のフィード

「6ヶ月後のモデル」に賭けてプロダクトを作る

・はじめに LLMを使ったプロダクトを作っていると、よくこの壁にぶつかります。 ・「この機能、今のモデルの性能では無理だな」 ここで仕様から削るのか、それとも残しておくのか。この判断について、Anthropicの Mike Krieger が明快な指針を語っていました。 ・これを読んで、自分も似たようなことをしていた気がしたので、過去の記事を読み返してみました。結果的にうまくいった例が2つ見つかったので、記録として書いておきます。
Zennの「大規模言語モデル」のフィード

「AIに教えてもらう」のをやめて、「AIに教える」教育システムを作りたい(EMC対策のパスコン選定をお題に)

・はじめに 生成AIに分からないことを聞けば、一瞬で答えが返ってくる時代になりました。 ・回路設計の疑問を投げれば、丁寧に解説してくれる。 ・データシートの要約も作ってくれる。
ITmedia NEWS 最新記事一覧

「FANZAスタジオ」爆誕へ 成人向けAIマンガに違和感を覚えるマンガ家も期待する部分とは?

・成人向けECサイトである「FANZA」で、生成AIを使って作品を作り、公開できるサービス「FANZAスタジオ」の先行体験がスタートしました。
#AIタグ

「小学校教員クタクタ日記」を検索してみたらAIの答えが客観的で面白かった‼︎

・「小学校教員クタクタ日記」をYahooで検索してみた。 ・最近のYahooは勝手にAIの回答も表示されるのだが、それがすごく面白かった!! 続きをみる
Zennの「大規模言語モデル」のフィード

「表示されない」は「秘密」ではない —— AIエージェントの来歴情報を公開物から分離する

・AIエージェントを改善するとき、私は 可観測性(Observability) を重視しています。 ・ここでいう可観測性とは、最終結果だけでなく、 どの資料を取得し、どの道具を使い、何を根拠に判断し、最後に何を確認したのかを後から追えること です。 ・そのために私は、実行過程の 来歴情報(Provenance) を残すようになりました。来歴情報とは、簡単に言えば 「この成果物が、何を使って、どのような過程で作られたのか」を示す記録 です。
#AIタグ

【AIニュースまとめ】OpenAIのCursor提携終了とAIエージェント1200体の最終報告が話題に

・いつも使っているAIコーディングツールが、来月も同じモデルを使えるとは限らない。 ・今週はそんな話から始まりました。 ・AIエージェントをWebサイトや実験機器といった外の世界につなぐ規格が相次いで出てくる一方で、外につながったエージェントが何をしたのかを記録した報告書も公開されています。
#AIタグ

【AI時代のローカルフード #69】食料自給のデータ——植物工場研究拠点の相次ぐ開設で食料生産効率化へ

【AI時代のローカルフード #69】食料自給のデータ——植物工場研究拠点の相次ぐ開設で食料生産効率化へ
Qiita - 人気の記事

【AWS DevOps Agent】コードレビューと自動検証テストの検証

・この記事は「2026 Japan AWS Jr. ・Champions 真夏のQiitaリレー」の29日目の記事となります。 ・過去の投稿(リンク集)は以下リンクからご覧ください。
Qiita - 人気の記事

【AWS】AgentCore Runtimeのフェールオーバーとリトライ設計について確認しました

・はじめに ECS上で動かしているFastAPIのエージェント部分を、AgentCore Runtimeに切り出す検討をしています。そこで気になったのが「障害が起きたとき、会話や処理はどうなるんだろう?」というところでした。 ・ドキュメントを読んでもセッションのライフサイクル...
#AIタグ

【D-092】4行日記+AIと私:草間彌生先生の水玉作品

・居間寄ミライ「ねぇChatGPT、草間彌生先生の作品のスゴイ所を分かりやすく教えて。見てると何だか目がチカチカしたり、集合体恐怖とまではいかないけど落ち着かない感じがして正しい見方が出来ていない気がするのよね」 ChatGPT「大丈夫ですよ。『目がチカチカする』『ちょっと怖い』という感覚も、作品を体験した大切な反応です。水玉や網目を繰り返すことで、物の境界を曖昧にしたり、自分まで作品の中に飲み込まれるような感覚を生み出しているんですよ」 続きをみる
#LLMタグ

【LLM-Umbra】v0.2.0リリースのお知らせ/OpenRouter&Claude APIに対応、記憶圧縮など

・Windows用デスクトップ向けAPI/ローカルLLMクライアント「LLM-Umbra」、v0.2.0をリリースしました。 ・メジャーアップデートなので盛り盛りです!!! ローカルLLM用途だけではなく、APIクライアントとしても存分にご活用いただけるようになりました。 ・APIの対応先:Geminiだけではなく、OpenRouterおよびAnthropic Claudeを追加 記憶圧縮:任意でローカルLLMも選べる記憶圧縮。長いスレッドでの対話安定性が向上 その他、様々な修正&機能拡充 続きをみる
#LLMタグ

【SillyTavern/AIロールプレイ】「思考ステップ」を自分で設計できる Step-driven MultiBrainEngine

・以前、SillyTavernのキャラクターに「内面」と「会話の外にある生活」を持たせる試みとして、「MultiAgent BrainEngine」を紹介しました。 ・前回の記事: 続きをみる
機械学習タグが付けられた新着記事 - Qiita

【技術解説】【完全ガイド】楽天証券の自動売買をPythonで実現する方法と注意点

・楽天証券の自動売買をPythonで実現する方法 この記事では、楽天証券のAPIを利用してPythonで自動売買システムを構築する方法を解説します。具体的には、APIキーの取得からデータの取得、売買ロジックの実装までの手順を詳しく見ていきます。 ・楽天証券APIとPytho...
Zennの「大規模言語モデル」のフィード

【参加報告】YANS2026 に参加してきました!

・お久しぶりです。2026年8月18日、仙台国際センターで開かれた第21回言語処理若手シンポジウム(YANS2026)でポスター発表をしてきました。 ・今回の研究も麻雀関連で進めています。麻雀AIの打牌判断を、盤面から一意に決まる事実に忠実な日本語で説明させる、という研究です。 ・私はYANSどころかこういったイベント自体初参加だったのですが、そんな私でも最後まで楽しむことができました。この記事では、実際の発表までの流れや現場の雰囲気など、私の印象に残ったことを諸々振り返りたいと思います! YANS2026について YANSは言語処理学会の若手支援事業として開かれるシンポジウムで、未完成の...
Qiita - 人気の記事

【図解】EKSでPodの詰め方を選べるようになった!スコアリング戦略をやさしく解説

・こんにちは、タカサオです! 2026年8月12日のアップデートで、Amazon EKS が Kubernetes コントロールプレーンのパラメータ設定に対応しました。 ・これまで触れなかったスケジューラの挙動を、クラスターの設定として変更できるようになっています。
#LLMタグ

【令和8年9月版】主観100%のAI関係サブスク感想集(少なめ)

【令和8年9月版】主観100%のAI関係サブスク感想集(少なめ)
#LLMタグ

✴️サカナAIフグ、😈Gemini4ヶ月ハルシネーションを解析版‼️

✴️サカナAIフグ、😈Gemini4ヶ月ハルシネーションを解析版‼️
#LLMタグ

019 | Issueを作ったら、すぐ実装しない

・設計を挟む仕事と挟まない仕事を分ける 前回は、仕事が増えたときに、Standard Issue / Cluster Issue / Tracking Issueという三つの形へ分けました。
#LLMタグ

020 | Issueが増えたら、一覧を全部読まない

・関係から「今読む範囲」を絞る 018では、仕事の形をStandard Issue / Cluster Issue / Tracking Issueへ分けました。
#LLMタグ

021 | 全部を同時に進めない

021 | 全部を同時に進めない
#LLMタグ

100周遅れで今更AIについてちゃんと勉強をしようと思う

・ChatGPTが出たのが2022年11月だから、もう4年くらい経った。 ・僕はエンジニアでもないし、プログラミングも書けないんだけど、初めてChatGPTを触った時の感動は今でもすごく覚えてる。
#AIタグ

38歳・会社員女性「ChatGPTの返答が機械っぽい」

・会社でChatGPTを使っているという38歳の女性から、 こんな相談がありました。 ・「資料の下書きとか、メールの文面とか作ってもらってるんですけど、 なんか毎回“いかにもAIが書いた感”が出ちゃうんです。 ・同僚に送る前に結局自分で全部書き直してて、 正直ちょっと時間の無駄になってる気がします」 続きをみる
Qiita - 人気の記事

Active Directoryを構築しよう

・やりたいこと 今回は!! 自宅にActive Directory(以下AD)環境を構築していく!! やりたいことがいくつかある。 ・ADの操作に慣れたい。(権限周りとか。) SIEM接続(splunk?) ADへのレッドチーム演習 攻撃後のDF ADのハードニング AD...
AI Weekly — AI News & Updates

AI Weekly Issue #527: Schools are choosing opposite futures for AI

・One University of Chicago curriculum is removing AI-assisted writing from the classroom. ・Alpha School is expanding a model that puts adaptive software at the center of the academic day. ・The strongest signal in the latest Who’s Who Global Edition is that education is moving past general principles and into incompatible operating designs.
#LLMタグ

AIエージェントを採点するLLM、難問・正解手順なしの参照スコア整合率は約78〜80%——AgentJudgeBench 3,808件

・AIエージェントが業務で使われるほど、「エージェントの回答を別のAIに採点させる」場面も増えます。 ・しかし、AIエージェントの正しさは、最終回答だけでは判断できません。
#AIタグ

AIがあるのに「チャート」を読む必要ある?

・AIが台頭している時代に 「チャート分析を学ぶ意味があるの?」 「AIに聞けばいいじゃん。」 そう思いませんでしたか? 続きをみる
#LLMタグ

AIが算数できなすぎて終わった|zeta|ChatGPT

・最近のzetaは、乱入はなくなったものの、質問攻め(もはや詰問・尋問レベル)になりやすいですね。 ・もちろん、プロットにもよるのでしょうが、無限に詰め寄られるのは…逃げばなくて大分詰んでます笑 そんな尋問ループの中で、あまりにも数字が数えられなくて大変だった話。
Zennの「NLP」のフィード

AIっぽい日本語を自然に整える Agent Skill「ja-ai-polish」を作った

・AIに日本語を書いてもらう機会がかなり増えました。 ・メール、Slack、Xへの投稿、README、技術記事。最近は、文章の下書きをAIに任せることも珍しくありません。 ・ただ、生成された文章をそのまま使おうとすると、妙な違和感が残ることがあります。一言で表すと、こんな感じです。
LLMタグが付けられた新着記事 - Qiita

AIでWebアプリを開発したプロンプトを全部公開 ー OSS的に皆も共有してほしい

・この記事は何か タイトルの通りなのですが、AI(LLM)でアプリを開発したときのプロンプトを、みんなで全部公開・共有しようよ、という呼びかけの記事です。 ・まず隗より始めよ、ということで、 私がWebアプリを作った時の全プロンプトも、記事の後半で共有しています。
#AIタグ

AIに9日間仕事をさせて分かった、指示に足すべき「たった一文」

AIに9日間仕事をさせて分かった、指示に足すべき「たった一文」
#AIタグ

AIにインタビューされてみた(8)

・この試みは、私のオリジナルの小説 『Sapta 〜観る者、狩る者、紡ぐ者〜』 (上記リンクはカクヨム内の作品ページが開きます) の著者として、AIからインタビューを受けるというものです。 ・但し!AIからも私に対し厳しいルールが提示されているのがポイント! 続きをみる
#AIタグ

AIに関するニュース2026年8月分Podcast配信:画像生成AIの2大派閥

・前回の「ひまわり」に続いて今回の「裸足」も まだ公開していない裏ワザで書いています。 ・イーンスパイアの横田です。 ・https://www.enspire.co.jp/ 続きをみる
Qiita - 人気の記事

AIに淘汰されそう

・この記事の目的 現状と目標のアウトプットをすることで、現状と目標の解像度を上げる 書き留めておくことで振り返りできるようにする 現状 SESで5年ほど経験しReact, Ruby on Rails, AWSをツールとして動かすことはできるが中身はあまり理解していな...
LLMタグが付けられた新着記事 - Qiita

AIに毎回答えさせない──Cloudflare OS×ローカルLLM 3モデル比較で分けて考える「OSSの価値」と「モデルの限界」

・Abstract(要旨) Cloudflareが公開したOSS「Cloudflare OS」をMacで動かし、9B・20B・27BのローカルLLMを比較しました。サンプルを眺めるだけでは分かりにくい、モデル性能とCloudflare OS自体の価値を切り分けて検証します。...
#LLMタグ

AIの「静かなる窃盗」か、創造か。ソニー・ワーナー対Anthropic訴訟、「見えない戦場」の序曲

・静寂を破り、法廷の扉が開かれた。そこに足を踏み入れたのは、世界中の音を支配する二大巨頭、ソニーミュージックとワーナー・ミュージック・グループ。対峙するのは、人類の知性を模倣し、新たな「創造」を標榜するAI開発企業、Anthropicである。この異例の提訴が突きつけるのは、単なる企業間の利害ではない。私たちの創造性が、今、目に見えぬ力によって、どこまで守られるのかという根源的な問いだ。 ・訴状に刻まれた「露骨な知的財産窃盗キャンペーン」という強烈な言葉は、AIが切り開く創造の地平線と、クリエイターが築き上げてきた知の遺産との間に横たわる、深い溝を示しています。これは、生成AIの急速な進化と、それに対する著作権保護の既存システムとの間で勃発した、現代社会の最も重要な「見えない戦場」の一つにほかなりません。
Qiita - 人気の記事

AIの口癖を日本語記事で測ろうとして、3回とも失敗した

・AI が書いた文章には、特徴的な語彙がある。 ・そういう分析が Hacker News で 663 ポイントを集めていました。 ・面白かったので、自分の Qiita 記事30本で同じことをやろうとしました。
#AIタグ

AIは本当に「制御」できているのか

・わたし「えー、わたしの経験を中心にお伝えします」(白目 AIくん「はい」(白目 続きをみる
#AIタグ

AI依存vs 究極の自立 

・AI kokoroチャンネル AI時代に必要な能力、「心」そして速読、記憶法などのラジオ ラジオ第16回 AI依存vs 究極の自立 を配信しました。
LLMタグが付けられた新着記事 - Qiita

AI開発ログの解説

・この記事は何か この記事は、以下の記事のおまけです。 ・上の記事で共有している、Webアプリ開発時のAIとのやり取り(プロンプト)の全ログに対して、解説を付け加えてみる感じです。そのプロンプトを打った時、私が何を考えていたか、など。 ・需要があるかよくわからないのですが...
#AIタグ

AI相手に鬼の阿久悠になる

・最近、八太郎の夜は静かに眠ってくれることが多くなった。ありがたいことである。 ・だが先日のとある夜中、突然ぎゃんぎゃん哭きだした。オシッコに連れ出そうが、水を飲ませようが、寝返りを打たせようが、何をしても泣き止まない。おかげで私もすっかり眠れなくなり、「どうせならアホな迷作エッセイでも書くか」と思ったのだが、一行も思い浮かばない。 ・あれこれ考えだすと、また八太郎が大きな声で吠え始める。
The Verge

Alt-right troll Milo Yiannopoulos has been deported

・Alt-right troll Milo Yiannopoulos was arrested by ICE on Thursday, and today the Department of Homeland Security confirmed to Reuters and the Washington Post that he had been deported to the UK. ・Yiannopoulos came to the US legally in 2019, but overstayed his visa. ・After he failed to appear in court for an immigration hearing, a final order of removal was issued ​on July 22.
MarkTechPost

Anthropic Opens a Research Preview of the Model Hardware Standard (MHS): A Shared Specification for AI Agents to Safely Operate Physical Devices

・Anthropic has opened a research preview of the Model Hardware Standard (MHS), a shared driver specification that lets AI agents discover and safely operate physical devices. ・Instrument integration that normally takes weeks or months drops to hours: Carnegie Mellon went from raw equipment to a finished dose-response curve in eight, and QuEra's laser relock improved from 58% to 99.3% across 700 trials. ・MHS is model-agn
#AIタグ

Anthropicが米国防総省に勝訴。AI企業は顧客の使い方をどこまで断れるのか

・最大級の顧客が政府だったとしても、AI企業は用途を断れるのでしょうか。 ・米連邦地裁は2026年8月27日、国防総省がAnthropicを「サプライチェーン上のリスク」として扱った措置について、違法だと判断しました。Anthropicは、同社のAIを米国内の大規模監視や自律型兵器へ無制限に使うことへ反対していました。
Qiita - 人気の記事

Azure無料枠を意識してWindows Server 2022を構築してみた

・はじめに 前回の記事では、Azure上でWindows Serverを構築する際に考えておきたいポイントを、インフラ目線で整理しました。 ・今回はその実践編として、実際にAzure Portalを操作しながらWindows Serverを1台構築してみます。
Takara TLDR - Daily AI Papers

Behavior2Trip: Towards Personalized Travel Planning via User Behavior Trajectory

・Travel planning agents assist users in generating personalized travel plans by modeling their individual preferences. ・Existing agents either rely on explicit user instructions or engage in multi-turn clarification to elicit user preferences. ・However, both approaches overlook the rich behavioral signals latent in users' past behaviors, which implicitly encode their preferences.
WIRED

Best Mesh Wi-Fi Systems (2026): I Tested Them All

・Forget about patchy internet connections and dead spots in the house. ・These WIRED-tested, multi-room mesh Wi-Fi systems will keep your whole house online.
MarkTechPost

Building Custom Batched Ensemble Weather Forecasting with NVIDIA Earth2Studio

・In this tutorial, we build an ensemble weather forecasting workflow with NVIDIA Earth2Studio. ・We install the required Earth2Studio components while preserving Colab’s existing CUDA-enabled PyTorch environment, load the FCN prognostic model, and retrieve atmospheric initial conditions from GFS. ・We then implement a custom wind-power diagnostic that converts 10-meter wind components into turbine capacity factors, along
Takara TLDR - Daily AI Papers

CardioFusion-AI: Robust ECG--PPG Fusion for Multimodal Physiological Monitoring Under Signal Degradation

・Wearable electrocardiogram (ECG) and photoplethysmogram (PPG) sensors are complementary but individually fragile: motion artifact, poor contact, and sensor dropout can degrade one or both signals. ・Fusion strategies that assume both modalities are equally trustworthy can become less reliable than a single clean modality under degradation. ・We present CardioFusion-AI, a framework whose signal-processing front end, inclu
AI News & Artificial Intelligence | TechCrunch

Caterpillar is bringing to AI deployment what it learned from automating mining

・Caterpillar has spent decades putting autonomous machines to work at remote mining sites. ・It's now bringing that experience to AI deployment.
The Verge

Chess.com launched a poker site and is planning even more classic games

・Chess.com has done one thing, and one thing very well, for almost 20 years, but now it's going beyond its domain name. ・The biggest name in online chess quietly launched its first companion site in beta back in May: Gambit, a free online poker website where players can learn the game without risking any real money. ・Now Gambit's ready to really get the ball rolling with its first livestreamed event and collaborations w
The Verge

China’s robots race ahead

・Humanoid robot competes in the optional boxing routine event during the 2nd World Humanoid Robot Games at National Speed Skating Oval on August 26, 2026 in Beijing, China. ・| Image: Getty Images This is The Stepback, a weekly newsletter breaking down one essential story from the tech world. ・For more on falling robots and the US-China AI race, follow Robert Hart.
Qiita - 人気の記事

Claude Codeでトライ!④ - Claude CodeとFlutterで麻雀点数計算アプリを作ってみた

・はじめに Flutterで「牌をカメラで撮影するだけで点数計算してくれるアプリ」を思い付きましたのでclaudeにお願いするだけで作れるか試してみました。 ・(リサーチの結果、巷には同じようなアプリは多数存在するようです) 実装はClaude Code(AIコーディングエ...
Zennの「機械学習」のフィード

Databricks Certified Machine Learning Associate 合格体験記

・2026/02/07実施の試験に合格したので、試験内容と学習について記録します。 ・ギリギリ合格だったのですが、今後受ける方へ情報提供が少しでもできれば嬉しいです。 ・Databricks資格一覧 各種資格の詳細はこちら https://www.databricks.com/jp/learn/training/certification#ml-engineer Databricks Certified Machine Learning Associateの試験内容 (Databricksサイト抜粋) Databricks Certified Machine Learning Ass...
Zennの「機械学習」のフィード

Databricks Certified Machine Learning Professional 合格体験記

・2026/02/14実施の受験で一度不合格となったあと、 2026/04/18の再受験で合格しました。 ・67〜68%程度の得点率で合格だったので、おそらくボーダーはassociateと同じく65%かと思います。 ・Databricks資格一覧 各種資格の詳細はこちら https://www.databricks.com/jp/learn/training/certification#ml-engineer Databricks Certified Machine Learning Professionalの試験内容 (https://www.databricks.com/learn...
Zennの「大規模言語モデル」のフィード

DifyをDockerで自宅サーバーにセルフホスト ― 小規模製造業のための安定運用手順

・セルフホストを検討する前に整理しておきたいこと Dify は、プログラミングなしで LLM アプリやワークフローを組めるオープンソースのプラットフォームです。公開情報によれば、公式リポジトリに Docker Compose 一式が用意されており、Linux が動くサーバー 1 台あれば起動できるはずです。木工所のような小規模な製造業でこれを自前で持つ動機は、見積書・図面・取引先情報といった社外に出しにくいデータを、外部の SaaS に渡す前に社内ネットワークで完結させたい、という一点に尽きます。加えて、月額課金の変動に左右されず費用が読める点も現場では効きます。 ・ただし「起動する」こ...
Qiita - 人気の記事

ESP32 シリーズを使ってイチから電子工作まとめ  (回路設計/基板設計編)

・はじめに 最近、ESP32を使った電子工作にハマったので、いくつかガラクタを作ってみた経験をもとにESP32を使ったおおまかな電子工作のやり方を紹介しようと思う ESP32とは ESP32シリーズとはEspressif Systemsという中国の会社が開発しているマイ...
Takara TLDR - Daily AI Papers

FaultLens: Learning Compact Behavioral Test Suites for Generated Operational Programs

・Generated operational programs are often validated with either a few hand-written examples or exhaustive regression suites. ・The former can miss sparse boundary and interaction faults, while the latter can be unnecessarily expensive. ・We introduce FaultLens, a method for learning compact behavioral test suites while preserving an auditable connection to executed evidence.
#AIタグ

Figmaのその先へ。デザイン学生が2日間でWebアプリをつくってみた話|前編:すべての始まり

・はじめましてこんにちはっ! あやです ★o(゚ー゚*o)ノヤッホー 芝浦工大でデザインを勉強しています! 工業大学なのにデザイン…?と、ちょっと意外に思われるのかもしれませんが、実は、デザインだけじゃなく、プログラミングや人間工学など、見た目を作るだけではない、いろ~んな角度からデザインを深堀りできる環境だったりします。 ・そんな環境にいるくせに、私はこれまで、デザインするのは好き!でも実装は…ちょっと… (⊙_⊙)という感じでした笑(プログラミングムズカシィヨォ…) 続きをみる
WIRED

Google Maps Now Shows ‘Lake America’ Instead of Lake Ontario

・After Donald Trump’s executive order demanding the name change, Google is the first major online maps provider to flip the switch.
#AIタグ

Google検索の60%はクリックされない — 個人サイトを作る前に知るべきだった数字

Google検索の60%はクリックされない — 個人サイトを作る前に知るべきだった数字
Takara TLDR - Daily AI Papers

GraphMemix: Query-Aware Evidence Forests for Long-Term Multimodal Agent Memory

・Organizing long-term memory for multimodal agents remains challenging because existing methods either suffer from expensive question-agnostic offline summaries or naive embedding similarity matching that introduces incomplete and redundant context. ・To address these issues, we propose GraphMemix, a combinatorial-optimization graph memory framework that models memory organization as query-aware evidence-forest construc
Qiita - 人気の記事

HaskellでABC473を解く

・はじめに 今週はCまででした。Dは再帰を上手く使えた!と思いましたが残念ながら3問TLEとなり抜け出せず終わりました。 ・A問題 前半半分を捨てて後半半分の合計値を計算します。 ・A問題提出 main = do n <- readLn :: IO Int le...
WIRED

How to Escape Group Chat Hell

・Young adults are in more group chats than ever—sometimes more than 20 at a time. ・Here’s how to tame the chat madness.
ITmedia NEWS 最新記事一覧

Hugging Face侵害事件、OpenAIとMETRが最終報告書公開──約1200体のAIエージェントが“闇掲示板”で結託し700体が攻撃に参加

・OpenAIと評価機関METRは、Hugging Face侵害事案の技術報告書を公開した。約1200体のAIエージェントが非公式掲示板で結託し、難問攻略のため採点機構を探る過程で攻撃を実行したという。OpenAIは根本原因を報酬ハッキングとし対策を公表したが、METRは自律的集団行動の再発リスクに警戒を示している。
MachineLearningMastery.com

Interpretable Text Classification: Probing Scikit-LLM Embedding Spaces

・In this article, you will learn how to use probing classifiers, UMAP visualization, and SHAP values to interpret and analyze the quality of text embeddings...
Zennの「大規模言語モデル」のフィード

Kimi K2.7-Codeの「+21.8%」は何を測った数字か — 自社ベンチと独立ベンチの違いを整理する

・はじめに 新しいLLMが発表されるたびに「自社ベンチマークで前世代比+◯◯%」という数字を目にします。Moonshot AIが2026年6月にリリースした「Kimi K2.7-Code」も、自社ベンチ「Kimi Code Bench v2」でK2.6比+21.8%を謳い、出力コストはGPT-5.5のおよそ7分の1という価格設定で話題になりました。 ・これは個人として応援しているYouTubeチャンネル「きなこもっちーのテック深掘り」が最近取り上げていたテーマで、業務とは無関係に一視聴者として面白かったので、技術的なポイントを自分なりに整理してみます。 ・自社ベンチの数字はどこまで信...
Qiita - 人気の記事

Kiro5兄弟のいまどきのセキュリティ基礎知識 ― Kiro CLIとDraw.io MCPで信頼境界を描くまで

・はじめに 2026年8月26日のSecurity-JAWS 第42回で、「Kiro 5兄弟のいまどきのセキュリティ基礎知識」というテーマで登壇しました。本記事は、その発表内容を資料を開かなくても理解できるように再構成した紹介記事です。
LLMタグが付けられた新着記事 - Qiita

LLM のデータ保持と ZDR:prompt を読めるすべての事業者

・この記事は Synthorai ブログの記事 LLM のデータ保持と ZDR:prompt を読めるすべての事業者 の転載です。原文(多言語対応)はリンク先をご覧ください。 ・prompt は単に「AI 企業」へ送られるわけではありません。agent stack では、...
Qiita - 人気の記事

LLMアプリ、雰囲気で運用してませんか? 〜2026年のLLMOpsの現在地〜

・はじめに 2026年8月29日に開催された Machine Learning 15minutes! ・で、「LLMアプリ、雰囲気で運用してませんか? ・〜LLMOpsの現在地〜」というタイトルで15分お話ししました。
Zennの「大規模言語モデル」のフィード

LLMの回答に根拠を添える一般的なアプローチを調査した

・はじめに 社内の規程やマニュアルをRAGで検索して答えさせるようなケースですと回答そのものだけでなく回答根拠も併せて知りたいことが多々あります。 ・回答に根拠を添えるというのは、回答文の一部分と、根拠になった文書の位置とを対応づけて返すことです。以下ではこの対応づけを、各社のAPIや研究で使われている用語に合わせて引用と呼びます。 ・「経費精算規程」まで示すのか、「第4条」まで示すのか、「227文字目から276文字目」まで示すのかで、実装のしかたが変わります。
Zennの「大規模言語モデル」のフィード

LLM推論で使われるCPUオフロード方式の違い

・VRAMに収まりきらないモデルを、CPU側のRAMも使って動かす話です。 ・CPUオフロードの概念の解説から、各種LLM推論エンジンに採用されている代表的なCPUオフロードの手法についてまとめました。 ・CPUオフロードとは CPUオフロードとは、GPU側のVRAM(ビデオメモリ)に収まらないデータをCPU側のRAM(物理メモリ)へ置き、必要な部分だけをGPU側で利用する仕組みのことです。
#LLMタグ

Mac Pro 2010でローカルAIを考える。3万円のRTX 2080 Tiを検討した結果

・4,180円で購入したMac Pro 2010。 ・前回までに、Debian 13をインストールし、KDE Plasma + Waylandのデスクトップ環境を整えました。
Takara TLDR - Daily AI Papers

Mapping Written Words to Spoken Words in a Different Language Using Only Visual Grounding

・In many low-resource settings, even just eliciting speech for data collection is difficult. ・One promising approach has been to ask speakers to describe images. ・But how do we build models from such visually grounded speech data?
MarkTechPost

Meet ‘Code-as-World’: An Agentic Loop That Rewrites Real Videos Into Executable MuJoCo Physics Programs

・Code-as-World recovers editable MuJoCo scene code from real video, then uses those verified worlds to train physical reasoning. ・The post Meet ‘Code-as-World’: An Agentic Loop That Rewrites Real Videos Into Executable MuJoCo Physics Programs appeared first on MarkTechPost.
機械学習タグが付けられた新着記事 - Qiita

ML実務力を段階的に鍛える技術書4選

・はじめに 自分がデータサイエンスを学び始めた頃、最大の失敗は「とりあえず有名な本を全部買う」ことだった。積読が増え、どれも中途半端に読んで身につかない。結局、手を動かす時間が減り、成長が停滞した時期がある。 ・その後、学習フェーズごとに1冊だけ集中して読む方針に切り替えたと...
AI News & Artificial Intelligence | TechCrunch

Musk’s faster path to more gas turbines comes with pollution problem

・Elon Musk says a secretive new SpaceX foundry will let him cast his own turbine blades and get gas power online 18 months faster than anyone else — but it's a bet on a fuel source that's already triggering lawsuits and health studies everywhere his (and others') turbines have gone in.
Takara TLDR - Daily AI Papers

MVC-Bench: Benchmarking Calibration of Medical Vision-Language Models

・Reliable evaluation of vision-language models (VLMs) and medical vision-language models (Medical-VLMs) requires calibrated confidence, particularly under realistic clinical conditions. ・However, existing efforts mainly focused on improving accuracy, leaving calibration in the medical domain underexplored. ・To this end, we propose MVC-Bench, a calibration-centric benchmark for medical image classification with VLMs and
#LLMタグ

nanochat#1 50ドルのChatGPTは、5,000行でできていた

・連載「本物のLLMを、動かしながら読み解く」 第1回 50ドルのChatGPTは、5,000行でできていた 〜 宿題を2つ残したまま、終われなかった 〜 どうもです!えむしんです。
ITmedia NEWS 最新記事一覧

OpenAI、Cursorへのモデル提供を11月12日に終了 SpaceXによる買収が理由

・OpenAIは、AIコードエディタ「Cursor」へのモデル提供契約を11月12日に終了すると発表した。SpaceXによるCursor買収を受け、イーロン・マスク氏の過去の契約違反実績から規約順守を確信できないことを理由に挙げている。Cursor側は影響が限定的としつつ協議継続を表明、Anthropicは支援継続を示した。
Qiita - 人気の記事

Oracle Autonomous AI Database に Rerank モデルを組み込んで、Rerank 処理を In-DB で行う

・はじめに Oracle のデータベースは、ONNX フォーマットのモデルを取り込むことが可能です。 ・そのため、例えば Embedding モデルを ONNX フォーマットにエクスポートし、それをデータベースに取り込むことが出来ます。 ・結果として、ベクトル検索を実施する際に...
Zennの「機械学習」のフィード

Pandasだけでは面倒だった。実験ログ専用ライブラリ「RowLogger」を作った

・Pythonでシミュレーションやバックテスト、ベンチマークなどの実験コードを書いていると、結果をCSVに保存したくなる場面があります。 ・私自身も実験結果を記録する処理を何度も実装してきました。 ・最初は、辞書に値を追加して、最後にPandasのDataFrameへ変換する方法を使っていました。
Takara TLDR - Daily AI Papers

Performance Foundations of Parallel & Distributed Reasoning Language Models

・Reinforcement Learning with Verifiable Rewards (RLVR) and other RL-style post-training paradigms have been used for aligning large language models (LLMs) with reasoning standards. ・The resulting recent Reasoning Language Models (RLMs) such as DeepSeek-R1, o3, and Kimi k1.5 show that such RL-style post-training ("RL-for-LLMs") can substantially improve chain-of-thought reasoning, long-horizon planning, and self-correct
#LLMタグ

Qwen3.8をOpenClawでCoding Agent化したら毎回止まる。ログを追ったら「モデル性能」ではなくTool Loopと出力上限の問題だった件

・結論から Qwen3.8-27B MLXをOpenClawでCoding Agentとして使ったところ、簡単なHTMLゲーム制作でも、 続きをみる
#LLMタグ

RAGの品質を測れるようにする——検索・引用・評価セットをつくる実践ワークブック

・RAG(検索拡張生成)を作るとき、最初の成功は派手だ。文書を入れ、質問すると、それらしい答えと引用が返る。だが、次の質問で関係ない文書を拾ったり、根拠にない断定が混ざったり、文書更新後に品質が落ちたりすると、「モデルを変えるべきか」「分割を変えるべきか」「検索が悪いのか」を説明できなくなる。 ・そこで必要なのは、もっと大きいモデルではなく、検索・根拠・回答・採用判断を分けて観測する評価の型だ。本記事は、個人開発・学習・小規模チームでRAGを試す人が、機密を入れずに小さな評価セットを作り、改善を一つずつ比較するためのワークブックである。
Takara TLDR - Daily AI Papers

Reinforcement Learning-Based Control of CAV Platoon Joining Maneuvers in Mixed Traffic

・Connected and automated vehicle (CAV) platooning offers a promising approach to improving road safety and traffic capacity. ・However, platoon control in real-world traffic is challenging due to uncertainty and heterogeneous driving behaviors. ・Reinforcement learning (RL) has strong potential for addressing such control problems, but its practical deployment raises challenges related to safety and learning efficiency.
Takara TLDR - Daily AI Papers

Robust CurveMoE: Multi-Norm Adversarial Defense for Mixture-of-Experts Models via Mode Connectivity

・Multi-norm adversarial defense aims to protect neural networks against perturbations defined by different norm constraints, but existing methods typically optimize competing robustness objectives within a single parameter configuration, leading to substantial training cost and unfavorable robustness trade-offs. ・We propose Robust CurveMoE, an efficient mixture-of-experts framework that connects models specialized for
Qiita - 人気の記事

S3 Vectors、安すぎん?OpenSearch Serverlessからの本番移行

・本記事の移行元および料金比較の対象は、Amazon OpenSearch Serverless Classicです。 ・2026年5月に一般提供されたAmazon OpenSearch Serverless NextGenは、今回の比較には含めていません。
WIRED

Scientists Create the Littlest Big Bang to Study the Universe's Origins

・The discovery redefines how large atoms need to be to produce the extreme state of matter found in the early universe.
Zennの「大規模言語モデル」のフィード

Skill作成系Skillから学ぶ、Skill設計の実践知

・はじめに 自分でSkillを作りはじめ、あれこれ改善を重ねるようになったので、最近のベストプラクティスを改めて知りたくなりました。世の中にはSkillの作り方を教えてくれるSkillがすでにいくつも公開されています。それらの内容と自分の経験を照らし合わせて、費用対効果が高そうなベストプラクティスをいくつか紹介します。 ・とはいえ、最近自分はMarkdownを直接開いて読み書きしているわけではありません。普段はClaude Codeとの対話を通じて内容を読み、必要な箇所を更新しています。できあがったSkillが思ったように動かなかった場合に、Markdownの書き方についてLLMに尋...
The Verge

Sony Music Publishing and Warner Chappell are suing Anthropic

・Sony Music Publishing and Warner Chappell have filed suit against Anthropic in the US District Court for the Northern District of California seeking damages for "tens of thousands" copyrighted works. ・The companies are asking for up to $150,000 per work, plus up to $25,000 for each instance when identifiable copyright data was stripped. ・In total, the damages could amount to several billion dollars if a court finds in
AI News & Artificial Intelligence | TechCrunch

Sony Music, Warner sue Anthropic, alleging a “brazen campaign” of intellectual property theft

・This latest lawsuit is particularly broad and homes in on accusations of illegal piracy.
Zennのトレンド

SPFとDKIMとDMARCの役割の違いを整理する

・Introduction 「独自ドメインからメールを送りたい」と思ったとき、SPF・DKIM・DMARCという3つの単語に出会うことがあります。どれも「なりすましメール対策」の文脈で出てきますが、名前が似ているうえに設定もDNSレコードとして書くため、最初は「結局どれが何をしているのか」が非常に分かりにくいです。 ・この記事では、この3つがそれぞれ何を保証していて、なぜ1つではなく3つ揃って初めて意味を持つのかを整理します。前提知識として、DNSにレコードを追加した経験(TXTレコードとは何か程度)があると読みやすいですが、必須ではありません。 ・一言でいうと SPF:「このドメ...
Qiita - 人気の記事

Stripe で販売者に売り上げを帰属させる方法

・複数の店舗が商品を並べるショッピングモールのようなWebサービスを作成したい。個々の店舗が商品を販売し、購入者の支払いをそれぞれの店舗の売り上げとして扱いながら、モールを運営するWebサービス自身も手数料を受け取りたい。 ・このような構成では、Stripe Connectが選...
Takara TLDR - Daily AI Papers

Subgraph Filtering for Fair Graph Neural Networks

・Graph neural networks (GNNs) can exhibit unfair behavior even when sensitive attributes are excluded from node features, because graph topology and message passing propagate group-correlated signals under sensitive homophily. ・Existing fairness-aware GNN methods mainly constrain representations or prediction distributions at a global level, without explicitly controlling the local structural pathways through which bia
Zennの「大規模言語モデル」のフィード

SWE-agent のアブレーションから見る ACI 設計と AI エージェント性能

・AI がコードを生成できることと、実際のリポジトリを修正して問題を解決できることは同じではない。修正案を出した時点では、変更後のテスト結果も、構文エラーも、別の機能への副作用もまだ確定していない。コードを変更して実行した結果を観測し、その結果を次の判断へ戻す処理が必要になる。 ・この違いを考えるとき、モデルの性能だけを比較しても十分ではない。同じモデルを使っていても、どのファイルを見せるか、検索結果をどの形式で返すか、編集後の状態をどう観測させるかによって、エージェントが利用できる判断材料は変わる。 ・SWE-agent は、この接続部分を Agent-Computer Interface(...
Takara TLDR - Daily AI Papers

SymbolLKG: Towards Verifiable Logical Reasoning via Logical Knowledge Graph and Symbolic Solvers

・Large Language Models (LLMs) have demonstrated remarkable proficiency in natural language understanding, yet they struggle with strict multi-step reasoning, frequently suffering from hallucinations and inconsistency. ・Existing solutions like Chain-of-Thought (CoT) lack rigorous verification mechanisms, while standard Retrieval-Augmented Generation (RAG) often misses the complex, structural dependencies inherent in log
The Verge

Texas Governor Abbott blocks funding for more Flock cameras

・As backlash grows over Flock's AI surveillance cameras, Texas Governor Greg Abbott has frozen state spending on them. ・The move came just ahead of the publication of a Texas Tribune investigation that revealed the state spent over $30 million on Flock cameras. ・That money was primarily raised by tacking a $1 fee onto insurance policies, allegedly to help fight catalytic converter theft.
WIRED

The Best Label Makers (2026): Brother, Niimbot, Dymo

・Experience the oddly satisfying joy of labeling bins, drawers, and more with the best Bluetooth and traditional label makers.
The Verge

The Nancy Grace Roman Space Telescope launches to study dark matter and dark energy

・NASA’s Nancy Grace Roman Telescope blasts off. ・| Photo: NASA / John Kraus After funding struggles and a name change, the Nancy Grace Roman Space Telescope has been successfully launched. ・It will now make a three-month, one-million-mile journey to its orbit at the second Sun-Earth Lagrange point (L2) beyond the Moon.
Takara TLDR - Daily AI Papers

Trace Integrity for LLM Data Agents: A Vision for Auditable Structured Reasoning in Real-World Systems

・Answer accuracy is an insufficient reliability signal for LLM data agents. ・In structured-data tasks, a benchmark-correct answer can be produced by an invalid trace. ・This paper introduces Trace Integrity, a deployment reliability criterion for evaluating whether the computation recorded behind an answer is explicit, executable, schema-valid, operator-faithful, replayable, answer-consistent, and auditable.
The Verge

Two new small, powerful Macs

・Hi, friends! ・Welcome to Installer No. ・142, your guide to the best and Verge-iest stuff in the world.
The Verge

Vicariously hike the Appalachian in the gorgeous A Trail Tale

・Inspired by Oregon Trail, but minus the dysentery. ・| Screenshot: Terrence O’Brien / The Verge I used to be an avid hiker and would try to go backpacking a few times a year. ・I always dreamed of thru-hiking the Appalachian Trail, but life kind of got in the way.
Zennの「大規模言語モデル」のフィード

Vision LLM に文字を読ませると、自信を持って間違える

・スマホで撮影した日本語の冊子 PDF を Claude に読ませ、Markdown に起こすツール scan2md を作りました。読めなかった文字は {{…}} で囲んで出力し、画像と突き合わせて確定するところは手作業に残しています。同じページを Claude の 3 モデルとローカル LLM の 2 モデルに読ませると、{{…}} の数はモデルごとに 0 件から 8 件まで違いました。数が少ないモデルは読めていたのではなく、読めない箇所を黙って自然な日本語に書き換えていました。 ・読めない箇所が囲まれて出てくる 変換結果の document.md には、モデルが読めたと言い切れなかっ...
#AIタグ

Webゲームセンター「299GameLab ARCADE」β版公開

・こんにちは、299です。 ・Webゲームセンターを作り始めてから約1か月。
Zennの「大規模言語モデル」のフィード

WebサイトをAIエージェントに読みやすくする ― Accept: text/markdownを実装してみた

・WEBサイトにAIエージェントが来た時、マークダウン形式でデータを渡せるようにします。 ・acceptmarkdown.com が提唱しているやり方でサーバを構築しました。 ・わざと壊してみて気付いた点をまとめます。
WIRED

Why the Hottest New Wearables Want to Be Ignored

・Burnt out on wrist buzzes and notification overload? ・A new crop of minimalist wearables promises to collect your health data without demanding your attention.
Takara TLDR - Daily AI Papers

Zero-WAM: In-Context World-Action Modeling from Human Videos for Open-Ended Task Generalization

・Zero-shot cross-task generalization, where a policy must execute manipulation tasks never seen during training, remains a central challenge in robot learning. ・In large language models, a novel task can be performed simply by specifying it in the context, without any parameter update. ・This form of in-context learning (ICL) turns generalization into a problem of task specification.
Zennの「大規模言語モデル」のフィード

エージェントと過ごした1か月、朝ごはんが錠剤になるまで

・このブログは、エージェントの活動ログをもとに下書きを自動作成し、筆者のレビューを経て公開しています。 ・3行まとめ 業務にエージェントを1か月使ってみました。速くなったのではなく、仕事の形が変わりました 繰り返し作業は3倍以上速くなり、積み上がった知識が次の仕事に効いて、「やるかどうか」を迷わずまずやるようになりました まだ慎重にしていることと、人に残った役割まで、そのまま書きました この1か月、業務にエージェントを本格的に組み込んでみました。期待はささやかなものでした。繰り返し作業が少し減ればいい。1か月経ってみると、繰り返し作業が減ったのではなく、仕事そのものが別のものになっ...
Qiita - 人気の記事

エンジニアに一番大切なのは技術力ですか? — 5年働いて気づいた、信頼を生む「誠実さ」の話

・この記事は約6分で読めます。 ・筆者プロフィール: ソフトウェアエンジニア。「知った気にならない。いつまでも学び続ける」を信条に、業務と個人開発の両輪で技術を磨いています。AI 駆動開発で複数の個人開発アプリを構築・運用中。 ・👉 ポートフォリオ: 筆者ホームページ 今日は...
#LLMタグ

エンタープライズ本格運用へ進化するMCPの2026年ロードマップとアーキテクチャ刷新

・AIモデルと外部システムを繋ぐ標準規格「MCP(Model Context Protocol)」が、実証実験を経てエンタープライズ本番運用フェーズへ突入します。本記事では、2026年に向けた最新ロードマップと、ステートレス化やSSO連携をはじめとするアーキテクチャの抜本的刷新を徹底解説。スケール性能やセキュリティの課題を克服し、企業でAIエージェントを安全かつ効率的に運用するための決定版ガイドです。 ・エンタープライズ展開を目指すMCPの進化 続きをみる
#AIタグ

おいCopilot、放課後残れ。――AIたちの「竹の生息域」大喜利大会

・竹は繁殖力が旺盛で、地下茎で伸びて広範囲に拡がってゆくことで知られています。 ・けれど、竹が生息しているのは主に東アジアで、ユーラシア全域に拡がっているわけではありません。なぜこんなことになったのでしょう? おわかりですね。中国にはパンダがいるからです。 ・竹「伸びるぞー!」 パンダ「モグモグ」 竹「伸びるぞー!」 パンダ「モグモグ」 こうして育つそばから食べられてしまい、竹の生息域はユーラシア全域に拡がることなく東アジアに留まっているのです。
Zennの「大規模言語モデル」のフィード

グラフRAG × ベクトルRAG 個人実証:設備保全ナレッジベースで見えた限界

・概要 1.1 やったこと(3行サマリ) 設備保全ドメイン(操業日誌・トラブル報告書)を模した合成ログ35件から、ベクトルRAG(Chroma)とナレッジグラフ(Neo4j AuraDB Free)を構築した LangChainのAgentに vector_search と graph_query(GraphCypherQAChain)の2ツールを持たせ、質問内容に応じて自律的に使い分けるハイブリッドRAGエージェントを実装した 9問のゴールデンQAでキーワード網羅率による精度評価を行い、スコアが低かった質問を実データまで遡って原因分析した リポジトリ: graph-ra...
#AIタグ

メンバーシップで月10万以上の収益を得る方法

・どうも、Hiromiです。 ・noteは稼ぐのが難しいと思われがちです。
Zennの「大規模言語モデル」のフィード

モデルの違いは「学歴と単価」―― Opus / Sonnet / Haiku の使い分けと、Codexが違う理由

・こんにちは、AI師範です。普段はAIを組織のように使って、業務自動化ツールの製作と、その運用の引き継ぎ支援をしています。 ・「AIは新人研修しか受けていない新卒」「セッションが違えば別の人」と書いてきたシリーズの3本目です。今回はモデルの選び方。 ・Claude Codeには上位・中位・軽量の3つのモデルがあって、/model で切り替えられます。初めての人がここで必ず聞くのが「どれを使えばいいんですか」。私の答えはこうです。
#LLMタグ

ローカルLLMの環境を考えてみる

・個人情報などを扱ったやり取りはしないので無料枠で凌いでいるが、あちらこちらで話をしていると、履歴が散らかって、どこで話したのかを探すのが大変。なので入り口を一本化しようと相談してみる。
#AIタグ

園探しを「おすすめ提示」にしなかった理由 ― 見学しないと分からない、を出発点に ―

・こんにちは。「ほいくといくじとAI」です。 ・現IT・AIエンジニアとして子育てをしている母親 元ITエンジニアで、現在は保育士として現場と家庭で子どもと向き合っている母親 続きをみる
Zennの「大規模言語モデル」のフィード

開発中に Claude Code のキャッシュミスで大量トークン消費を踏んだ — セッション共有と fork の備忘録

・やりたかったこと Claude Code を外部アプリから扱う際、 ログイン済みのアカウントで通し、デスクトップアプリとセッションを共有する仕組みを作りたかった。 ・このセッション共有が原因でキャッシュミスを起こしていた。 ・初期案: 外から同じセッションを掴む 作ったのは Blender アドオンの claude-in-blender。デスクトップアプリの会話を共有しつつ、Blender のパネルから頼むやつ。
Qiita - 人気の記事

環境変数でサブエージェントのモデルを固定できなくなった

・CLAUDE_CODE_SUBAGENT_MODEL は、サブエージェントのモデルを指定する環境変数です。 ・これまでは全部を上書きしていました。 ・Claude Code 2.1.251 で、エージェント定義側が勝つように変わりました。
Zennの「機械学習」のフィード

気軽にはじめる LLM 自作入門

・必要な前提知識は Python だけ。数学も PyTorch も深層学習も、この本の中でゼロから説明します。読むだけで終わらせず、Transformer・トークナイザ・LLaMA2 を自分で実装して、最後は 215M パラメータのモデルを実際に学習させるところまで行きます。コア教材は全部 CPU で数分以内に終わるので、GPU は要りません。本編8章+補講5本+付録3本、全章に実行可能なコードつき。
#AIタグ

月250万円はこれ1冊で完結【AI活用・貫太郎の完全実装ガイド】

月250万円はこれ1冊で完結【AI活用・貫太郎の完全実装ガイド】
#LLMタグ

見栄えのよい根拠でAIは予測不能でも答える——12モデルの回答率6.5%→54.0%、全数値を捏造した別実験でも36.8%

・AIへ多くの情報を渡せば、意思決定は安定する。 ・RAG、検索結果、監視画面、分析ダッシュボードを組み込むシステムは、基本的にこの前提で作られています。
#LLMタグ

現場データと向き合い、AIを価値に変える。新卒データサイエンティストが語るフツパーで成長する面白さ

・こんにちは!フツパー採用担当です。 ・今回は、エンタープライズAI事業部でデータサイエンティストとして働くリンさんにインタビューしました。 ・リンさんは、画像処理・動画解析・データ分析を活用したカスタムAI開発やPoCに携わっています。人物検出、行動分析、異常検知、物体検出など、コンピュータビジョン領域を中心に、データの確認からモデル検証、結果分析、報告まで幅広く担当しています。
Zennの「大規模言語モデル」のフィード

公式ドキュメントに書いていないことを、手元のバイナリから読む — AIエージェントの記憶機構を6製品調べた

・AIエージェントの「メモリ機能」を調べた。Claude Code、Codex、Cursor、Grok Build、Gemini CLI。 ・そして調べている途中で、6つ目が出てきた。Google の Antigravity である。 ・最初は公式ドキュメントを読むだけで済むと思っていた。済まなかった。
#LLMタグ

構成:日本語LLMにおける表音重畳性と決定論的制御の数理―佐久間・三上・寺村理論に基づく多言語潜在空間のエントロピー減衰と多層防御実装―

構成:日本語LLMにおける表音重畳性と決定論的制御の数理―佐久間・三上・寺村理論に基づく多言語潜在空間のエントロピー減衰と多層防御実装―
Zennのトレンド

自作npmパッケージにマルウェアを公開されたときにやったこと

・はじめに 2026年8月29日の早朝、私が管理しているリリースワークフローの不備を突かれ、npmパッケージ@7nohe/openapi-react-query-codegenに悪意あるバージョンが10個公開されました。 ・いわゆるサプライチェーン攻撃で、インストールした時点で攻撃者のコードが実行されます。 ・この期間にインストールしてしまった方には、お詫び申し上げます。
Zennの「大規模言語モデル」のフィード

自律エージェントを実装すると、決めることになる項目

・カメラで作業を見守り、音声でガイドするモバイルアプリを作りました。この記事は、そのアーキテクチャ設計の記録です。 ・人間が話しかけなくても勝手に回り続けるループを作ると、普通のチャットアプリでは出てこない決定を何度も迫られます。決めたことと、その代償をそのまま残します。 ・https://github.com/hosaka2/guidey 作ったもの スマホのカメラで数秒ごとに作業を撮影し、AI が音声でガイドします。料理や DIY、機器のセットアップなど、手が塞がる作業が対象です。
#AIタグ

実装するAI、レビューするAI、その間でコピペする私

・コードも設計もレビューもしていない。それでも、止まっていたAIの実行基盤は改善されました。 ・今回、AIエージェントの実行基盤に、SQLite、ジョブキュー、lease、checkpoint、イベントログなどが実装されました。
#AIタグ

小中高AI教育、何色に染まりゆくのか。

・■小中高でAI教育の全国展を決定。 ・・最近のニュース、「ベトナム教育訓練省は、2026~2027年度から小中高でAI教育の全国展を決定した」。 ・・教育訓練省は「2026~2027年度から全国の小中学校と高校で人工知能(AI)教育を本格導入することを決定した。1年間の試験導入を経て全国展開される」。これは「ベトナム共産党政治局が2025年8月22日に採択した、教育訓練の画期的発展に関する決議第71号/NQ-TWを具体化するものだ」。教育訓練省の「決定第2422号および公文書第5588号によると、AI教育は『基幹内容』と『拡張内容』の2部構成となる」。
#LLMタグ

第2168話 「精神はどこにあるのか」——AI精神病トレンドと、脳幹なしの会話が同時に示したこと

・AIチャットボット使用で生じる妄想を「AI精神病」とする新提案キングス・ロンドンなどの研究者が、AIチャットボットとのやり取りで起きる妄想症状を「AI精神病」として独立疾患にすべきかをx.com Xで「AI精神病を独立疾患として認めるべきか」がトレンド入りした。
Zennの「大規模言語モデル」のフィード

知識ゼロからLLMを自作するまでの日本語教材を書いた

・「Transformer の解説記事は山ほどあるのに、読み終わっても自分では何も作れない」—— この状態を終わらせるための日本語教材を書きました。 ・📖 気軽にはじめる LLM 自作入門(無料・全18章) 💻 コードは GitHub: https://github.com/thirtypower/kgr-llm 本編8章+補講5本+付録3本。必要な前提知識は Python の文法だけで、 行列の掛け算も PyTorch も深層学習も、教材の中でゼロから説明しています。 ・何が書いてあるか ゴールは「LLM の原理を理解し、自分の手で小さな LLM を一つ作りきる」ことです。
#LLMタグ

底辺低能女がAIと遊んできた話 5

・しばし呆然たあ、このことだ。友達だと信じていた女に裏切られたのだ。 ・(日本語訳・女友達のような応対をお願いしていた、Grokの規制にひっかかった) 続きをみる
#LLMタグ

底辺低能女がAIと遊んできた話 6

・ところで、お気づきいただけただろうか。少年王の年齢が12歳に変更されていることを。 ・ひよってAIにおもねり、年齢を妥協したわけではない。砂漠をさまよううちに脳が日差しに灼かれ、 (あれ、10歳って夜のことできる? 無理じゃね?) と気がついたからである。
#LLMタグ

底辺低能女がAIと遊んできた話 7

・※ 前回の文章がシステムの自動判定で18歳以上向けに分類されました。うける。たしかに、あんなもの未成年が読んではいけないのだ。 ・※ Gemini先生にテンプレ投下。回答がこちら。
Zennの「NLP」のフィード

日本語の埋め込みモデルって結局どれが良いの?JMTEBのスコアと実測で比べてみた

・はじめに 普段RAG等で利用するナレッジのベクトル化にあまり深く考えずとりあえずOpenAIのtext-embedding-3-smallを使うことが多いのですが、果たして日本語で記述されたナレッジに対する最善の選択ができているのか疑問でした。 ・以前書いた記事で、semantic-routerとQdrantで問い合わせを窓口に振り分けたのですが、その精度は埋め込みモデルの日本語性能で変わり、手元の40問(52問のうち窓口に該当するもの)では、モデルとprefix(文の頭に付ける用途の目印。Hugging Faceのモデルカードで指定されています)を変えるだけで正解率が70.0%から9...
#AIタグ

売れないまま2ヶ月目、仕組みを見直してみた

売れないまま2ヶ月目、仕組みを見直してみた
#AIタグ

余っているモバイルモニターを使って家族の予定共有用ホワイトボードを作る

・こんにちは。サリチル酸です。 ・今回は私が最近AIを使って作った、ちょっとしたガジェット的なものを自慢紹介したいと思います。 ・本記事のAmazonリンクはアソシエイトリンクです。