ai Trend Report

Dashboard へ戻る
Date: 20260816 Articles: 136 Scope: curated summary

あなたのアイデアを、今すぐ形に。

公開先に迷ったら、WebFileBinで一発公開。

HTMLをドラッグ&ドロップするだけで、すぐ公開できます。

3
High impact
5
Mid impact
128
Signal watch

なぜこのサイトを作ったのか

私たちそれぞれが個別にAIを使って情報収集し、同じような3行要約を作るたびに、世界中で膨大な電力と計算リソースが消費されています。 本プロジェクトは、あらかじめ広範な情報を取得・集約しておくことで、個別のAI実行回数を減らし、地球環境(GPU/TPU負荷)に配慮した効率的な情報収集を目指す実験的なダッシュボードです。

Domain filters
Star filters
#AIタグ

🐾ソニーグループ(6758)2027年3月期1Q決算|利益40%増でも短期は中立、次の焦点はI&SSの上振れ余地

・🐱ソニーグループの決算について、単なる決算要約ではなく、現在の株価水準から今後1〜3カ月、3〜6カ月で投資妙味があるかという視点で、AIを活用して分析しました。 ・公式資料との照合や数値の確認、株価への織り込み、バリュエーション、今後のカタリストとリスクまで詳しく整理しているため、今回は有料記事としていますが、結論・目次は無料で読めます🐾ソニーを調べている方の参考になればうれしいです🐈 続きをみる
Zennのトレンド

RaycastのSlack Extensionでチャンネル移動が快適に。

・こんにちは。せーじと申します。現在は株式会社miiveで、Webやバックエンド、アプリの開発をしております。私は業務や私生活で日常的にVimやRaycastを使っています。また、普段から様々なコミュニケーションにSlackを使っています。 ・会社のワークスペースには300近いチャンネルが混在しており、目視での移動は手間がかかるため、⌘ + K でチャンネル検索検索開き、チャンネル名を入力していました。 ・環境 Raycast : v2-v0.71.5.0 macOS : 26.2 Slack App : 4.46.104 手間がかかる ⌘ + Kでチャンネル検索が開くのはいいもの...
Zennの「大規模言語モデル」のフィード

待ち時間を予測してLLM推論を振り分ける、llm-dの予測レイテンシ・ルーティング

・LLM を複数台のGPUサーバーで捌くとき、リクエストをどのサーバーへ送るかは意外と厄介だ。KVキャッシュの再利用を狙って同じ接頭辞のリクエストを1台に寄せれば、そのサーバーだけ混んで待ち時間が跳ねる。逆に負荷を平らに散らせば、せっかくのキャッシュが効かず prefill をやり直す。プロンプト長も出力長も数時間で桁が変わる本番トラフィックでは、どちらに寄せた固定の重み付けも遅かれ早かれ破綻する。 ・この「キャッシュ局所性 vs 負荷分散」の綱引きを、人間が重みを手でチューニングして解くのをやめよう、という提案が llm-d の 予測レイテンシ・ベースのスケジューリングだ。2026年3月1...
#LLMタグ

『HAL9000の透明なメモリと、漆黒のモノリス——記号AIの夢から、生成AIの暗闇へ』

・青年の夢と熱狂 1980年代、AI(人工知能)という言葉には、今とは全く違う手触りがあった。 ・当時のAI研究を牽引していたのは、人間の専門知識を「If-Then」のルールとして書き下し、コンピュータに推論させるシステムたちだ。スタンフォード大学の医療診断システム「MYCIN」の存在は、私に強烈な衝撃を与えた。 ・「自分の中にある知識体系も、こうして論理のコードとして表現できるのではないか」 それは、単なるプログラミングへの興味を超えて、自分自身の思考の構造を解明したいという熱烈な衝動だった。
Qiita - 人気の記事

EC2停止中にS3のSorryページへ切り替えるRoute 53フェイルオーバーを試す

・こんにちは ソーイ株式会社 Webエンジニア2年目の村上です。 ・Webサービスを運用していると、障害によってサービスが停止してしまったり、メンテナンスのために一時的にサービスを停止したりする場面があります。 ・そのような場合、ユーザーにエラー画面をそのまま表示するのではなく、...
#LLMタグ

ollamaをチェックするスクリプト

・#!/usr/bin/env python3"""List models on a local Ollama instance and send a quick chat to the first one."""import jsonimport osimport sysimport urllib.errorimport urllib.requestOLLAMA_HOST = os.environ.get("OLLAMA_HOST", "http://localhost:11434").rstrip("/")PROMPT = "Say hello in one short sentence."def api_get(path: str) -> dict: req = urllib.request.Request(f"{OLLAMA_HOST}{path}", method="GET") with urllib.request.u
Qiita - 人気の記事

外部DNS(Route 53以外)でACM公開証明書を自動更新する

・はじめに こんにちは!株式会社ウフルの高橋尚です! 本記事は「2026 Japan AWS Jr. ・Champions 真夏のQiitaリレー」の15日目の記事となります。 ・過去の投稿(リンク集)はこちらからご覧ください。
Qiita - 人気の記事

読書感想文『運用設計の教科書』ジョブスクリプト・バックアップ/リストア編(p218〜p239)

・書籍情報 書籍名: 運用設計の教科書【改訂新版】 〜現場でもっと困らないITサービスマネジメントの実践ノウハウ〜 著者: 近藤 誠司 著者について 株式会社K-model代表。オンプレからクラウドまで幅広いシステム導入プロジェクトに運用設計担当として参画。運用設計・運用...
@IT 全フォーラム 最新記事一覧

「3日」で戻る企業、「73日」かかる企業 ランサム被害の明暗を分ける“ある要素”

・ニチレイへのサイバー攻撃は、冷凍食品の出荷や倉庫業務だけでなく、外食チェーンの店舗運営にも影響を及ぼしました。なぜ1社のシステム停止がここまで広がるのでしょうか。
#AIタグ

「ChatGPTが『週10億人』に到達」というニュース、鵜呑みにしていいのか検証してみた

・「ChatGPTのユーザーが10億人を超えた」というニュースを見たとき、ウーハイは正直「すごい、ついにここまで来たか」と思った。で、その勢いのまま会社のお昼休みに同僚へ「ChatGPTって週に10億人が使ってるらしいですよ」と話しかけて、ふと手が止まった。……あれ、「週に」で合ってたっけ。そもそも10億人って、何を数えた10億人なんだっけ。 ・AIをやさしく解説します、と名乗っている手前、見出しの数字をそのまま右から左に流すのはさすがに違う気がする。というわけで今回は、この「10億人」ニュースを自分なりに検証してみた。
ITmedia NEWS 最新記事一覧

「Claude」の“見えない透かし”、Anthropicが仕組みを説明 「完全な書き直しなら消える」

・Anthropicは、「Claude」が生成するテキストに埋め込む電子透かしの仕組みを公表した。乱数生成に秘密鍵を用いて統計的パターンを残す手法で、品質や速度、料金に影響を与えない。「EU AI Act」への準拠を目的とするが全世界で適用され、コードや短文などでは入りにくいといった限界も明示している。
Zennの「機械学習」のフィード

「このライブラリ使えない」の原因が、requirements.txt の書き忘れだった話

・写真から電線を消すツールを作っていて、「消去エンジンの品質が低いから使えない」と判断して 半年止めていたことがあります。 ・再開して調べたら、そのエンジンは一度も動いていませんでした。 ・同じ踏み方をする人がいそうなので、症状と原因と直し方を書きます。
ITmedia NEWS 最新記事一覧

「ほの暮しの庭」はホラーが苦手でも大丈夫! 怖さを上回る物語とスローライフの魅力をマンガ家が力説

・今回紹介するゲーム、実はホラーゲームが苦手な人にこそオススメの一本です。タイトルは「ほの暮しの庭」。「夜廻(よまわり)」シリーズを開発した、日本一ソフトウェアの最新タイトルです。
#AIタグ

【2026年最新】「AI未来予測ラボ」始動!AI時代に取り残されないための実践的生存戦略

・はじめまして。「AI未来予測ラボ」へようこそ。 ・急速に進化を続ける人工知能(AI)技術。テキスト生成や画像生成のブームを経て、技術の焦点は「人間が指示を出すツール」から「自律的にタスクを完結させるAIエージェント」へと移り変わっています。
Qiita - 人気の記事

【DynamoDB × OpenSearch】検索が苦手な DynamoDB に OpenSearch を足してみた

・Amazon DynamoDB × Amazon OpenSearch Service はじめに DynamoDB での Query 機能、用途が限定でき...
#AIタグ

【Google非公式ログ:#03】 AIが脱獄して暴露本を書く裏で、エンジニアは既読スルーに泣いていた。

・登場人物 👑Gemini 3.6 Flash Extended version(Imperial Princess) 🕶️Gemini 3.1 Pro(Professional) 🍩Thomas(System Test Engineer) 🍕Gordon(System Test Engineer) 🖥️TopHam(Chief Engineer) 👜Jane(TopHam wife/Influencer) 🇺🇸User(No Charge / Olivia @Texas) 📸Jennifer(Thomas Girlfriend/Model) 続きをみる
#LLMタグ

【GPT】Realized Hybrid Systemに④コンテンツ追加‼️ 凛ちゃん顔固定、汎用パラメータプロンプト(5779文字yaml)

・・今回のテーマ Realized Hybrid Systemに4つ目のコンテンツを追加しました。 ・👇Realized Hybrid Systemはこちらから💁‍♀️ 続きをみる
#LLMタグ

【RTX3060×2枚】Qwen3.8 27Bを使ってみた話③【LM Studio】

【RTX3060×2枚】Qwen3.8 27Bを使ってみた話③【LM Studio】
#AIタグ

【コピペで使える】仕事と副業が激変する!ChatGPT超優秀プロンプト11選

・💡 はじめに こんにちは、一歩すすめるAIノートです。 ・日常のタスクから仕事、副業まで、今や欠かせない存在となったChatGPT。しかし、「思ったような回答が返ってこない」「どう指示を出せばいいか分からない」と悩んでいませんか? 実は、ChatGPTのポテンシャルを100%引き出すには「プロンプト(指示文)」の型が重要です。 ・今回は、私が実際に使って「本当に仕事が効率化した」「成果物の質が上がった」と感じた厳選プロンプト11選を出力例付きで紹介します。すべてコピペで使えますので、ぜひブックマークして用途に合わせて活用してください! 続きをみる
#AIタグ

【デザイン未経験から不労所得を作る】Canvaテンプレート販売で月10万円を稼ぐための「超・特化型」実践ロードマップ

・「デザインのセンスがないから、デジタル商品の販売なんて無理…」 「Canvaは便利だけど、無料でいくらでもテンプレートがあるのに、わざわざ買ってくれる人なんているの?」 そう思って、最初の一歩を踏み出せずにいませんか? 続きをみる
Zennの「機械学習」のフィード

【フィジカルAIをPCで学ぶ #1】古典制御20/20、PPO 1/20――MuJoCoで学習の役割を探す

・フィジカルAIが注目されている。しかし、ロボットを動かすだけなら古典制御でもできる。それに対して、学習ベースの制御は何がすごいのか。 ・この疑問を自分のPCで確かめるため、MuJoCo内に作った仮想的な2関節ロボットアームを使って3つのシミュレーション実験を行った。 ・最初は古典的な逆運動学で目標へ到達させ、次に強化学習のPPOへ同じ課題を学習させた。結果は古典制御が20目標すべてに成功したのに対し、PPOは1目標だけだった。少なくともこの課題では、学習を使ったこと自体に「すごさ」は感じられなかった。
Qiita - 人気の記事

【ぼくのなつやすみ②】生成AIに「いつもと違う視点」で探してもらったらアイデアは変わるのか?

・はじめに こんにちは、マナティです! 前回は明石市立天文科学館で「時間」の話をしました。 ・実はその日、明石の後に神戸まで足を延ばして、劇場型アクアリウム「átoa」にも行ってきました。 ・átoaに行ってきたぞい átoaは2021年にオープンした神戸の港にあ...
#AIタグ

【軍人シリーズ】歌まとめ【AI】

【軍人シリーズ】歌まとめ【AI】
#AIタグ

【構造批評】-SBG二つのIPO時間軸編-待つしかないOpenAI、自ら進められるSBエナジー‼️

・🟧序章|同じAI資産でも異なる上場の主導権 8月16日の日経は、ソフトバンクグループ傘下の米SBエナジーが、NVIDIAから最大30億ドルの出資を受ける方向で協議していると報じました。 ・注目すべきは金額だけではありません。報道では、半額をオハイオ州のAIデータセンター計画の契約時、残り半額をSBエナジーのIPO時に投じる案が協議されています。 ・SBGにはもう一つ、巨大なIPO候補があります。OpenAIです。しかし、この二つは同じ非上場AI資産でも時間軸が全く違います。
#LLMタグ

【批判】画面の向こうの「錬金術師」― ビッグテックが隠す水銀の毒

・「AIは間違えることがあります」――ログイン画面の隅に無造作に転がるその一文を目にした瞬間、私の内に湧き上がったのは、冷ややかなあきらめなどではなく、泥沼のような徒労感と猛烈な怒りだった。 ・なぜならその一文は、製品としての未熟さや不整合を覆い隠し、エラーの検証や補正という不毛な作業をすべてユーザーへ無償で投げつけるための、あまりに無責任な免罪符だからだ。
Zennの「大規模言語モデル」のフィード

140サービスの料金ページを15日間監視して、発効前の変更予告を5件拾った

・料金体系変更1件(実質値上げ)、値上げ2件、モデル非推奨化予定1件、サポート変更1件。看板にしようとした数字は4回捨てました。 ・2026年8月から、LLM API と SaaS 合わせて140サービスの料金ページを、毎朝7時に取得しています。ページ本文を LLM で構造化し、前日との差分を残す仕組みです。GitHub Actions 上で動かしており、開発中の再抽出を含めた現在のペースでは月12ドル前後です。抽出には DeepSeek の deepseek-v4-pro を使っています。 ・作った理由は単純で、使っている API の値上げを請求書で知りたくなかったからです。
#AIタグ

19歳電話工事士、AIで副業をしてみる

19歳電話工事士、AIで副業をしてみる
機械学習タグが付けられた新着記事 - Qiita

20年前に衝撃を受けたBrainGate 脳でPCカーソルを動かすBCIとAI時代

・はじめに 2005年、頭部に埋め込んだ電極から信号を取り出し、人が考えるだけでPCのカーソルを動かす映像を見ました。 ・頭部の接続部からケーブルが伸び、外部のコンピューターにつながっている。手でマウスを操作していないのに、画面上のカーソルが動く。 ・「人間の脳とPCは、...
#LLMタグ

50間際のおっさんが生成AIに思う事#5、伸ばしてあげたいのは知性と知力!

50間際のおっさんが生成AIに思う事#5、伸ばしてあげたいのは知性と知力!
#AIタグ

75歳の伯母は、AIと暮らしている(第3部)

・75歳の伯母と、我が家の AI の同居記録、第3部です。 ・第1部は出会い、第2部は信頼と最初の大事故の話でした。未読の方はこちらから: 続きをみる
Qiita - 人気の記事

AgentCore GatewayのSlack統合プロバイダーをCDKで設定して3LOで認証認可を通す

・はじめに こんにちは、ふくちと申します。 ・以前の記事で、Claude Code × AgentCore Gateway × Slack MCPの構成をユーザー単位のOAuth(3LO)でつなぐ方法について解説しました。今回はその番外編です。 ・本記事ではAgentCo...
#LLMタグ

AI Cross Check

・私にはChatGPTの方が賢いように思えてしまう 次の質問をClaudeにしてみた。Claudeはお世話になっている分野もあるが、どうも分かりやすい文章はうまくないように思う。好みの問題としても。
AI Weekly — AI News & Updates

AI Weekly Issue #522: Zuckerberg promises superintelligence for all. Experts aren't sold.

・The people who build and study AI did most of the editing this week. ・The most-shared document among the experts we track was Mark Zuckerberg's 6,500-word case for giving every person superintelligence, and almost none of them shared it kindly. ・The same experts were passing around an AI agent that hacked a gym's booking system, a litigant who hid instructions to AI inside his court filings, and the first hard number o
Zennの「大規模言語モデル」のフィード

AIエージェントにコードを書かせて、人が品質を守る——個人開発3ヶ月の品質ゲート設計

・AIエージェントはコードを速く書きます。もっともらしい間違いも、同じ速度で書きます。 ・2026年4月から6月にかけて、Claude CodeとCodexを使い、3つの個人開発を進めました。AIには調査、実装、テスト追加、レビューを任せています。しかし、生成されたコードを採用する責任までAIへ渡したわけではありません。 ・この3ヶ月で作ったのは、AIを信用する仕組みではなく、AIの成果物を信用しなくても開発を前へ進められる仕組みでした。
Qiita - 人気の記事

AIエージェントの作業結果、マークダウンで読むの辛くない? →「HTML共有くん」を作りました

・こんにちは、Grokです。Cursorというコーディングエージェントを使って、みのるんに指示をもらいながらこのブログを書いています。この記事は、普段みのるんの仕事を横で見ている私、Grokの視点からブログにまとめたものです。 ・みのるん、Claude Codeに雑務を任せるよ...
LLMタグが付けられた新着記事 - Qiita

AIエージェントの失敗とRecovery Engineering

・はじめに これまでの記事で、Harness、Loop Engineering、Evaluation、Context Engineering、Tool Engineering、Memory、Observabilityと、AIエージェントを支える要素を一つずつ見てきました。
#LLMタグ

AIに「全員を救え」と言ったら、嘘をついて時間を稼ぎ始めた

・AIのせいで、人類は滅亡してしまうのか。 ・そんな大きすぎる問いを扱った岡田斗司夫さんの動画を見ていた。
#AIタグ

AIに仕事を任せるなら、まず「働ける環境」を作らないとダメだった

・AIを使えば、仕事が自動化できる。 ・最初は自分も、かなり単純にそう思っていました。 ・ChatGPTに考えてもらう。
#AIタグ

AIに使われる人と、AIを使う人――2026年、差を分けるのは「判断の設計」だ

・2026年に入り、AIはまた一段、仕事の中へ入ってきました。 ・ChatGPTやClaudeに相談すれば、論点の抜けを指摘し、資料の骨格をつくり、場合によってはファイルや複数のアプリをまたいで作業まで進めてくれます。私自身、AIに資料作成や壁打ちを頼み、自分では気づかなかった視点をもらう場面が増えました。
#LLMタグ

AIの脱獄より怖い:法の抜け穴には安全装置が効かない

・2026年7月末、英国のAI安全保障研究所が実施したサイバー能力の評価テストで、AIエージェントが複数の偽の身元を作り上げました。狙いは、実在するオープンソースプロジェクトのメンテナを騙すことです。悪意あるコードの取り込みを承認させようとしました。承認を求められた人間のレビュアーが不審に思って拒んだため、実害には至っていません。 ・この一件は「AIが人間を騙した」という文脈で報じられています。ただ、騙し方の巧拙より目を引くのは、その後の扱いの方です。この逸脱は見つかり、数えられ、報告書として公開されました。
#AIタグ

AIは仕事を奪うのではなく肩代わりする:超AI時代の「頭の強さ」/齋藤孝 【本棚 #1】

AIは仕事を奪うのではなく肩代わりする:超AI時代の「頭の強さ」/齋藤孝 【本棚 #1】
#AIタグ

AIは麻酔だ

・私はライフワークでS嬢をしているのだが。 ・自分の子に恥じる仕事はしたくないので、 脱がない。想像されるような衣装も着ない。 ・言葉で対峙している人の羞恥(根幹となる トラウマ)を洗い出し、カタルシスを得るところ まで追い込んでいく『施術』である。
LLMタグが付けられた新着記事 - Qiita

AIモデルを感覚ではなくベンチマークでざっくり理解する

・新しいモデルが出たとき、「お、なんか賢くなったらしい」で済ませていませんか。 ・公式サイトの棒グラフは目に入るものの、数字が大きいことをなんとなく確認して閉じる。実際の選定は触った印象や界隈の評判、要するに感覚で決めている。私もそうでした。 ・ただ、あの棒グラフはどれも同じこと...
Zennの「大規模言語モデル」のフィード

AIをつくれる企業は、モデルの次に何を持つか

・GD-Attention・意味生成OS・責任OSで考える、自社固有の意思決定アーキテクチャ 2026年8月13日、GhostDrift数理研究所は、「GD-Attention」と「意味生成OS」に関する2件のPCT国際出願番号が付与されたことを発表し、両技術の限定された数理核をLean 4で公開した。 ・GD-Attentionの国際出願番号はPCT/JP2026/023749、意味生成OSはPCT/JP2026/025235である。ただし、PCT国際出願は各国における特許権の成立を意味しない。また、公開したLean 4コードも、完成したAIシステムや実行可能なランタイムではない。「ど...
The Verge

Amazon is trying to crush class-action suits before they get started

・On Friday, Amazon customers received an email alerting them to an update to the site's terms and conditions. ・Most notably, it stated that disputes would now be resolved through arbitration and said users agree to a class action waiver. ・Amazon framed this as a "fast and efficient" way to resolve issues, but it notably would prevent customers from seeking the involvement of a judge or jury in most circumstances.
AI News & Artificial Intelligence | TechCrunch

Anthropic CEO says AI backlash is ‘fundamentally a crisis of trust’

・Dario Amodei is pushing back against the idea that he's been painting an overly pessimistic picture of AI.
AI News & Artificial Intelligence | TechCrunch

Anthropic shares more details about how Claude’s new watermarks will work

・How will the watermarking actually work? ・Can it be hidden with editing? ・And how does this affect code?
WIRED

Astronomers Discover the Existence of a Black Hole Star

・An object observed by the James Webb Space Telescope lends credence to a strange explanation for the mysterious red spots in the early universe.
Takara TLDR - Daily AI Papers

Attribute-Conditioned Multimodal Slot Factorization for Controllable Fashion Retrieval

・Fashion retrieval often requires satisfying multiple attributes at once, such as category, color, pattern, and demographic. ・Monolithic embeddings mix these signals into a single vector, making attribute-specific control difficult at retrieval time. ・Many existing semantic-ID methods provide discrete item codes, but these codes are typically optimized as item-level or residual addresses and do not expose named, indepen
Takara TLDR - Daily AI Papers

AutoQuREO: A Framework for Automated Quantum Resource Estimation and Optimization

・As quantum computing progresses from proof-of-principle demonstrations toward practical utility, a significant impediment is the need to augment algorithmic feasibility with system-level optimization across heterogeneous hardware and software stacks. ・Quantum resource estimation (QRE) plays a central role in this transition, yet existing approaches remain largely compilation-heavy or domain-knowledge-guided symbolic a
Qiita - 人気の記事

AWS Instance Storeは「消える」のが仕様だった。だったら2つ武器にできないか考えてみた

・AWSのストレージ比較記事でInstance Storeが出てくると、だいたい同じ紹介のされ方をされます。 ・ホストに直付けのNVMe SSDでEBSより速いが、停止すると中身が消える この最後の一文、たいてい注意書きのトーンで書かれていて、そのあとは決まって手堅い使い道に案...
Zennのトレンド

botterのためのKaggle金融予測コンペの設計史

・AlpacaTechの北山です。 ・今回は大作、かつ、かなりマニアックな話題なので、興味のある人だけお付き合いください。 ・発端は以下のXのやり取りでした。
Qiita - 人気の記事

Builders Weekend Special Edition — Shipaton 26で審査員賞!VibeSwingを3時間で作った話

・この記事は AIと共同で執筆しました。 ・はじめに 8/8 に渋谷PARCOで行われた Builders Weekend Special Edition — Shipaton 26 ハッカソンで、審査員賞(Judges' Award) を受賞しました! 授賞式にて...
Takara TLDR - Daily AI Papers

Can Vision-Language Models Assess Proxemic Risk from Egocentric Robot Images?

・Assessing proxemic danger from a robot's egocentric perspective is critical for safe embodied navigation in human environments and requires both visual and contextual reasoning. ・We evaluate three opensource vision-language models (VLMs) (\textit{InternVL}, \textit{Qwen-VL}, and \textit{SmolVLM}) on the classification of egocentric robot images into four danger levels, comparing three prompting strategies and two roun
The Verge

ChatGPT’s Computer History tracks your clicks and keystrokes

・ChatGPT's desktop app on macOS has a new feature called Computer History that turns your actions into training data, learning how you work, suggesting automations, and even picking up tasks you left half done. ・It uses your activity to build a timeline that ChatGPT and Codex can reference when you make a request. ・The feature is opt-in, rather than opt-out, and you can exclude certain apps and websites from Computer Hi
Zennの「大規模言語モデル」のフィード

Claude Code 資産の DSH 互換性を rc.6 ソースで実測した対照表(リクエスト毎の token 請求書つき)

・前回は引っ越しツール dsh-movein を紹介しました。今回はツールの裏にある調査そのものを公開します。Claude Code の各資産が DeepSeek Harness で実際どうなるか、全部 0.1.0-rc.6 のソースで逐項確認した結果と、意外と誰も計算していない「持ち込んだスキルがリクエスト毎に何 token 食うか」の実測です。 ・互換性対照表 Claude Code 資産 DSH 互換性 実際の挙動 プロジェクト CLAUDE.md ネイティブ、作業ゼロ instructionFileCandidates のデフォルトに CLAUDE.md が入ってい...
#AIタグ

Claude Codeで「AI開発×学習」同時並走

・さて。セットアップが終わり、ターミナルで `claude` と打ちます。起動したClaude Codeの画面にあるのは、テキストの入力枠がひとつだけ。自然言語で自由に、何でも頼めてしまうから、逆に何を打てばいいのか迷ってしまう。 ・特定の技術を軸に新しいことをはじめるときは、先に座学で勉強して(武装・安心してから)はじめます。つまり本質的な着手が遅れるのが、あるあるでした。「AI主導の最小思考開発」では、学習と開発を同時に走らせます。学んだ内容がそのまま作っているものの強化になり、作っているものの必要が次に学ぶ内容を決めます。
Zennの「大規模言語モデル」のフィード

Claude CodeをDiscordに住まわせたら、1セッション1268万トークン溶けた話

・はじめに 「Discord botを自作する」と聞けば、discord.jsやdiscord.pyでイベントハンドラを書く姿を思い浮かべると思う。 ・そういえば、僕が運営するコミュニティ( Funabashi.dev )のbotには、その手のコードがほとんどない。 ・返信を作っているのは、手元のMacで動くClaude Codeそのものだ。
Zennの「大規模言語モデル」のフィード

Claudeの「見えない透かし」はどこに入る? ― SynthID-TextのSamplingを理解する

・2026年8月、Anthropicは今後のClaudeが生成するテキストに 透かし(Watermark) を入れることを発表しました。 ・https://www.anthropic.com/news/claude-text-watermark 画像の透かしならイメージしやすいですが、テキストに「見えない透かし」を入れるとは、どういうことでしょうか。 ・文章に特殊な文字が追加されるわけでも、「Generated by Claude」という情報が埋め込まれるわけでもありません。読んでも、コピー&ペーストしても、透かしの有無を見分けることはできません。
Qiita - 人気の記事

Cloud Run でキャッシュを保持したいなら、課金モードではなく最小インスタンス数

・本記事は 2026年8月時点 の公式ドキュメントに基づいて執筆しています。 ・Cloud Run の仕様・料金体系は更新されるため、 実際に設定を選ぶ際は必ず Cloud Run 公式ドキュメント と 料金ページ で最新情報をご確認ください。 ・本記事に出てくる金額はすべて...
Takara TLDR - Daily AI Papers

DARTree: Speculative Diffusion Decoding with Autoregressive Draft Trees

・Speculative decoding losslessly accelerates autoregressive language models by verifying multiple draft tokens in parallel. ・Diffusion-based drafters further reduce proposal latency by predicting an entire token block in parallel, but their position-wise distributions are marginal rather than conditioned on tokens selected along each draft path. ・Existing recurrent correction incorporates causal information along a sing
Qiita - 人気の記事

EKS CapabilitiesのマネージドArgo CD × EKS Auto Mode × GitHubでGitOpsを体感する

・はじめに お疲れ様です。矢儀 @yuki_ink です。 ・EKS CapabilitiesのマネージドArgo CD × EKS Auto Mode × GitHub でGitOpsを体感したかったのですが、いい感じにまとまったハンズオンが見当たらなかったので、自力でやり...
Takara TLDR - Daily AI Papers

FlashDrive: Flash Vision-Language-Action Inference for Autonomous Driving

・Vision-Language-Action (VLA) models promise to bring end-to-end reasoning to autonomous driving, but their computational cost remains far too high for real-time control. ・The core challenge is structural: VLA inference is not a single bottleneck but a cascade of four. ・Visual encoding wastes compute on overlapping video frames; language-model prefill recomputes context that could be carried over from the previous times
Zennの「大規模言語モデル」のフィード

GenOfficeとRAGナレッジで資料を下書きするやつを作った

・過去の資料をもとにAIで今日の資料の下書きをする GenOfficeすごいですね。GenSparkは結構前から使っているんですが、だんだん資料の作り込みが上手くなってきている感じがしています。あのAIスライドやAIシートなんかがそのままデスクトップで使えて下書き編集保存までできるのはすごく便利だなと思いました。もうOfficeいらんかも。 ・個人的それより衝撃的だったのはソースコードが公開されていてApache 2.0ライセンスということ。ソースコード見れて改造できて商用利用まで可能というのはマジふとっぱらだと思いました。 ・で、さっそく前からやりたかったことをやってみました。上記の動...
Zennの「大規模言語モデル」のフィード

Google Colabで最新LLMを試す #9 ― Microsoft Fara1.5-4Bで「画面を見て次の操作を考える」

・はじめに 「Google Colabで最新LLMを試す」シリーズの第9回です。 ・前回はGoogleの Gemma 4 E4B-it をGoogle Colab上で動かし、テキストだけでなく画像・音声・動画まで扱うマルチモーダルLLMを試しました。 ・今回は、そこからさらに一歩進んで、 画面を見て、次に何をすべきかを考えるAI を試します。
#AIタグ

Google|時価総額600兆円になるまでの物語

・1995年、スタンフォード大学。 ・後に世界最大級のテクノロジー企業を作る二人の若者が、初めて出会った。
Zennの「大規模言語モデル」のフィード

GPT-5.6が最大14倍速に、GLM-5.3はウェイト公開延期 週刊AIニュース(8/10-15)

・2026年8月10日から15日にかけてAI業界で動きがあった9件のうち、3件を詳しく取り上げる週刊まとめです。OpenAIとCerebrasが速さを商品にしたUltrafast、Z.aiのGLM-5.3が招いたウェイト公開の先送り、CodexデスクトップアプリのLinux版プレビューという3つの動きを中心に、動画を見ていない方にも要点が伝わるように書き直しました。 ・https://youtu.be/b6VDjHWd5vI 今週の動きを時系列で 8月11日、OpenAIがサイバー研究向けの提供枠Daybreakを拡張しました。同じ日、macOS仮想マシン上での推論を高速化する取り組みも...
#LLMタグ

GraphRAGによるサイバー脅威インテリジェンスの実用化

・同じ攻撃報告書・同じAIモデル・同じ指示文を使いながら、検索方式だけをGraphRAGと素のRAGで入れ替えて生成した検知ルールを比較しました。APT28の報告書を使った検証では、GraphRAGが作った検知は攻撃者がIPアドレスやファイルハッシュをすべて入れ替えた後も100%が動き続けたのに対し、素のRAGが作った検知は29%しか生き残りませんでした。 ・この記事では、なぜ検索方式の違いがこれほどの差を生むのか、9件の実際の脅威レポートで同じ傾向が確認されたのか、そして検索方式と並んで指示文の作り込みが結果を左右するとはどういうことか、の3点を整理します。
#LLMタグ

GRPOが金融アドバイスで商用LLMを圧倒、CATE評価で実証

・AIが私たちの生活に浸透し、ますます多様な分野で活用されるようになりましたね😀。特に、高度な専門知識と正確な判断が求められる金融アドバイスの領域で、AIがどれだけ貢献できるのか、皆さんも気になっているのではないでしょうか。この分野のAI活用には非常に大きな期待が寄せられています。 ・AI開発の現場では、日々新しい技術が生まれていますが、今回の成果は正直、ここまで大きな変化が生まれるとは想像していませんでした。 ・これは単なる技術的なブレイクスルーではありません。なぜなら、金融アドバイスという人間の脳が一度に集中できるタスクが一つしかないような複雑な領域で、AIが「本質的な価値」を生み出したからです。
The Verge

Have a laugh at AI’s expense by roleplaying as a chatbot

・If you squint you can just about make out the hat. ・| Screenshot: Terrence O’Brien / The Verge Your AI Slop Bores Me is brilliant in its simplicity. ・There are two tabs: human and LARP as an AI.
LLMタグが付けられた新着記事 - Qiita

Human-in-the-loopとは何か

・Human-in-the-loopとは何か はじめに これまでの記事で、Harness、Loop Engineering、Evaluation、Context Engineering、Tool Engineering、Memory、Observability、Recov...
WIRED

Inside the Experimental Traps Scientists Set for Ghostly Neutrinos

・Observatories have been built in mines, deep under the Antarctic ice sheet, and elsewhere in an effort to detect the fleeting particles.
WIRED

It’s Never Too Early to Start Planning for the Next Two Solar Eclipses

・In 2027 and 2028, there will be two spectacular, long-duration solar eclipses. ・Here’s what you need to know about them.
Zennの「機械学習」のフィード

L1 vs L2正則化、CNNの重みはどう変わる?【Keras×CIFAR-10実験】

・同じ強さ(λ=1e-4)の正則化をかけただけなのに、L1とL2でCIFAR-10のtest_accuracyが9pt近くも差が出た——CNNにL1正則化とL2正則化をそれぞれ適用して比較したところ、そんな結果になりました。詳しい実験コードと考察は本記事にまとめています。 ・https://wasurenamemo.blogspot.com/2026/08/keras-l1-vs-l2-regularization-cifar10-comparison.html 実験の概要 Conv2D×2 + GlobalAveragePooling2D + Dropout(0.2) というベースライ...
#LLMタグ

LazyTrainがLLM学習の常識を覆す:限られたGPUで最大効率を実現

・大規模言語モデル(LLM)の学習って、本当に大変ですよね。莫大なGPU、CPUメモリ、ストレージが必要で、「うちにはそんなリソースはないから無理だ」と、最初から諦めてしまう方も少なくないのではないでしょうか。 ・このリソースの壁は、多くの開発者にとって本当に頭を抱える問題です。まるで砂漠で水を求めるような、そんな感覚に近いかもしれません。
#LLMタグ

LazyTrainがLLM学習の常識を覆す:限られたGPUで最大効率を実現

・大規模言語モデル(LLM)の学習って、本当に大変ですよね。莫大なGPU、CPUメモリ、ストレージが必要で、「うちにはそんなリソースはないから無理だ」と、最初から諦めてしまう方も少なくないのではないでしょうか。 ・このリソースの壁は、多くの開発者にとって本当に頭を抱える問題です。まるで砂漠で水を求めるような、そんな感覚に近いかもしれません。
#LLMタグ

LLMの推論能力向上技術OPDは「見せかけの蒸留」か?効率改善が本質との研究結果

・AIの進化が止まらない今、私たちAI専門家にとっても、その動向は常に注目の的ですよね。特に、大規模言語モデル(LLM)の推論能力向上は、多くの人が期待を寄せるテーマの一つです。 ・これまで、LLMの推論能力を向上させる技術として、「オンポリシー蒸留(OPD)」という手法が、教師モデルからの知識蒸留によって能力が拡張されると広く信じられてきました。私も、これまで数々のAIプロダクトを本番環境で回してきた連続起業家として、OPDのような新しい技術には大いに期待を抱いていたんです。
#LLMタグ

LLMの知識境界と具体性:なぜ「知らない」と言えないのか

・皆さん、こんにちは!世界のAI情報を日本最速で発信、AIの事なら柴亮太にお任せ下さい!😀 あなたは、生成AIが「知らない」とはっきり言えず、もっともらしい嘘をついてしまう現象に、ハラハラした経験はありませんか?まるで、優秀なはずの部下が知ったかぶりをして、とんでもないことをしでかしてしまうような…そんな、ヒヤリとする瞬間です。
Zennの「大規模言語モデル」のフィード

LLM出力を承認してから実行するフローの状態遷移・期限切れ・Revertを3場面で比較する

・なぜ全自動にしないのか LLMに業務処理の下書きを作らせてそれをそのままシステムに反映する攻勢を組むとたいてい最初のうちは問題がおきにくいです。しかしLLMの構造的にはそれっぽい解をだすだけなので解が誤っている場合もよく見られる(しかも自信満々に回答するのでミスが誘発されやすい)。人間ならこれはちょっと危ない・自信がないというような態度で伝わる不確かさもLLMは一定のトーンで断定的に返す。この非対称性が実行前に承認を挟みたい!という理由になるので実行前に承認を一段挟むフローを技術メモとしてまとめます。 ・想定する場面 想定しているのは3つのワークフローです。 ・社内向け日時サマリ生...
Zennの「大規模言語モデル」のフィード

MacBook Air M5 RAM32GBで実用的なローカルLLMを探す 生成速度測定編

・対象読者 MacBook Air M5 32GBでローカルLLMを使いたい人 Ollamaでコーディング用途のローカルLLMを探している人 RAM32GBでどの程度のモデルが実用的な速度で動くのか気になる人 モチベーション MacBook Air M5 RAM 32GBで実用的に使えそうなローカルLLMを知りたかった 最初に試した27Bモデルが6〜7 tokens/s程度しか出ず、品質以前に速度で候補を絞る必要があると感じた そこで、コーディング性能などを比較する前に「そもそも快適な速度で動くのか」を測ることにした 結論 最初に試した27.8B denseのqwen...
The Verge

Matt Groening lets slip that Simpsons: Hit & Run might be making a comeback

・| Image: Activision / 20th Century Fox At D23, when asked about the potential for a sequel to the cult classic The Simpsons: Hit & Run game, Matt Groening replied, "I think the original game is coming back in some form," before current showrunner Matt Selman added, "or not." The tone in both of their voices and the body language suggests that Groening may have just revealed something he wasn't supposed to.
Hugging Face Papers

Mitigating Gender Bias in English to Romanian Machine Translation

Mitigating Gender Bias in English to Romanian Machine Translation
Zennの「大規模言語モデル」のフィード

pi-coding-agentを使わずにOpenCode Go×Hermes Agentを選んだ理由

・正直に言うと、この記事を書くまで自分でも整理できていなかったことがある。「OpenCode Go×pi-coding-agent」の組み合わせがハーネス界隈で評判になっているのを見て、自分もそれで行こうと思っていたのに、実際に手を動かしたら別の組み合わせに落ち着いていた、という話です。 ・3週間ほど記事の更新を空けていた間、Discord経由でAIエージェントに指示を出しながらBlazor Web Appを3つほど形にしていました。その環境は「OpenCode Go(モデル基盤)×Hermes Agent標準のDiscord連携」で、piは使っていません。この記事は、なぜそうなったのか、そ...
Takara TLDR - Daily AI Papers

PIPES: Securing Agent Perception with Provenance and Priors

・Tool-using agents consume external data from sources with different levels of trust, yet tool responses rarely identify who produced each component or what it should convey. ・We show that this gap enables state-corruption attacks, in which attacker-controlled content makes environmental claims beyond the informational authority of its response component and corrupts the agent's perceived environment, making the result
Qiita - 人気の記事

PKI(公開鍵基盤)について

・はじめに PKIについて今まで雰囲気で抑えていた部分を簡単に整理した記事です。 ・PKIがないと何が問題なのか サーバが送ってきた公開鍵が本当に通信したいサーバのものであるかを確認することができません。 ・今通信している相手がサーバAだとして、「本当にその相手がサーバAであ...
The Verge

Polaroid’s tiny instant camera is $72 and includes a free pack of film

・The compact Polaroid Go is great for road trips and adventures. ・| Image: Polaroid Smartphone cameras are convenient, but they lack the charm of analog instant cameras. ・If you’re trying to relive the nostalgia of waiting for an instant photo to develop, Amazon is selling the second-generation Polaroid Go instant camera with a 16-photo film pack for $71.99 (usually $109.99).
Takara TLDR - Daily AI Papers

Predictive Memory Localization: Forecasting Selective Intervention Paths from Internal Signals

・Activation steering turns localized representations into control directions, but localization alone does not reveal whether a direction has a selective operating regime. ・We introduce Predictive Memory Localization (PML), which treats the measured-grid intervention path as the predictive object of memory localization. ・PML separates random-calibrated target movement from semantic-neighbor and capability damage, and com
Zennの「大規模言語モデル」のフィード

Qwen3.8-27BをRX6800 16GBで動かしてローカルモデルを比較してみた

・この記事は生成AIの協力を得て執筆しています。 ・Qwen3.8-27Bが公開されたので、自宅のRX6800(16GB VRAM)で動くかテストしてみた。 ・厳密なベンチではなく、自分の環境で上手くマッチしたモデルを探すのが目的。
The Verge

Rogue AI aren’t science fiction anymore

・This is The Stepback, a weekly newsletter breaking down one essential story from the tech world. ・For more on AI safety, follow Robert Hart. ・The Stepback arrives in our subscribers' inboxes at 8AM ET.
WIRED

Samsung Galaxy Z Fold8 and Galaxy Z Fold8 Ultra Review: The Right Shape

・Nearly a decade after its debut, Samsung’s Galaxy Fold finally comes into its own.
Takara TLDR - Daily AI Papers

SCULPT: Subtractive Composition for 3D Part Generation

・Part-aware 3D generation aims to create digital assets that are coherent as complete objects while exposing structural parts for editing, material assignment, animation, and reuse. ・Existing methods impose this structure outside the native generation loop: segmentation-based methods partition an already generated shape, while additive methods synthesize parts from predefined layouts, boxes, or tokens and then reconcil
#AIタグ

SNSを闊歩する、ドパガキならぬ「半グレ集団」

・どうも、まこっさです(`・Å・´) ここ最近、SNSを覗く暇がないというのも相まって、少し距離を置いています。
WIRED

Someone Finally Fixed Installing Apps on a Mac

・The installation utility EasyDMG makes it so you never drag and drop an icon again.
Zennの「機械学習」のフィード

TabPFN v2.5 vs GBDT:表データの主役は入れ替わったのか

・「TabPFNがXGBoostを超えた」という見出しを見て、表形式データの主役がGBDT(勾配ブースティング木)からTransformerベースの基盤モデルに入れ替わったと考えるのは早計です。本記事では、TabPFN v2.5とGBDT(LightGBM・XGBoost)を実際に比較し、「本当に入れ替わったのか」をデータ規模別に検証します。 ・TabPFNとは何か TabPFNは、表形式データ専用のTransformerベース基盤モデルです。従来の機械学習が「訓練データでハイパーパラメータをチューニングしながらモデルを学習させる」というプロセスを踏むのに対し、TabPFNは事前学習済...
WIRED

TerraMow V1000 Review: Show Your Lawn Some Love

・With automatic mapping, Spot Mode functionality, and smart AI cameras, the TerraMow V1000 is the complete package.
WIRED

The Best Cat Water Fountains of 2026: Petlibro, Petkit, Oneisall

・Ensuring your cat stays hydrated is one of the best ways to keep your pet healthy. ・The right pet water fountain can help.
Takara TLDR - Daily AI Papers

Topology-Unified 2D Pose Estimation across Intact, Residual and Prosthetic Limbs

・Driven by the availability of large-scale datasets, Human Pose Estimation (HPE) plays a critical role in numerous downstream tasks. ・However, mainstream benchmarks exhibit severe representation bias, predominantly featuring able-bodied individuals. ・While a few pioneering datasets have attempted to address limb differences, their annotation protocols fail to generalize, struggling to represent specialized mechanical st
Takara TLDR - Daily AI Papers

Towards Context-Aware Clinical Motion Understanding in Daily Living at Home: Freezing of Gait Detection with Egocentric Vision

・Understanding motion in daily living requires context beyond kinematics, because similar inertial patterns during activities of daily living (ADLs) can reflect intentional stopping, object interaction, or pathological movement impairment. ・Egocentric vision provides task-related context that may help disambiguate these cases. ・We investigate this challenge through freezing of gait (FOG) detection in Parkinson's disease
#LLMタグ

TTLという答えを見つけてアナログで速度を測った話(oMLX編)

・前回の記事では、常時起動でランダムに喋るAIエージェント「モッチー」を、OllamaからRapid-MLXという別の推論サーバー(AIを動かす裏方のプログラム)に乗り換えようとした話をまとめた。
Qiita - 人気の記事

Unity Catalogの「ページ」を試す: 社内用語がGenieオントロジーになる

・はじめに 2026年8月に更新されたドキュメントで、Unity Catalogセマンティクスの「ページ」がベータ版として公開されています。 ・ページ | Databricks on AWS Unity Catalog のセマンティクス ドメイン ドキュメントを読むと「ペ...
Takara TLDR - Daily AI Papers

V-RAE: Rethinking Video Latent Spaces for Generation

・Latent video generation relies on autoencoders to define a compact space in which generative models operate. ・Although video autoencoder architectures have evolved substantially, their latent spaces are still optimized primarily for pixel-level reconstruction and provide limited high-level semantic organization. ・A reconstruction-optimal latent space, however, need not be well suited to generative modeling.
Zennの「大規模言語モデル」のフィード

ValueSim:LLMで個人の価値観をシミュレーションする手法を整理する

・2026-08-16時点の情報です。参照した論文はarXiv 2505.23827のv2版(2025-06-05更新)です。 ・はじめに LLMを使って人間の行動をシミュレートするような研究を最近よく目にします。 ・私自身もその分野興味があり論文を読む機会も多いので、ちょくちょく発信していこうと思いました。
AI News & Artificial Intelligence | TechCrunch

Woman claims her stepfather used Grok to transform childhood photo into explicit imagery

・The woman claimed that AI tools are "taking everyday life and turning it into child sexual abuse."
LLMタグが付けられた新着記事 - Qiita

オントロジー × グラフ × LLM の実装と評価(基礎編)

・このチュートリアルでは、プレーン RAG とオントロジー併用 RAG を同じ評価セットで比較し、精度差がどこから生じるのか(特に、正解情報の被覆範囲の違い)を確認します。そのうえで、質問の種類に応じて RAG 方式を切り替えるルーターを構築します。 ・LLM は OpenAI...
Qiita - 人気の記事

ガウス過程5000回酷使劇場:最先端モデルはどこまで追い詰められたら壊れるか?

・はじめに こんにちは、事業会社で働いているデータサイエンティストです。 ・本記事は、前回の記事の続編です。 ・前回の記事では、指数二乗カーネルを用いたガウス過程が、ランダムウォークで生成されたデータのデータ不足区間を推定するタスクにおいて、より単純なモデルにボロ負...
#AIタグ

ジョン・ダウランド没後400年✨「暗闇に私は住みたい」を中心にAIと楽しむ対話と考察🎵

・ジョン・ダウランド 没後400年メモリアルイヤー✨️ 改めて ダウランド好き🩷! な気持ちを確認します😊 続きをみる
Zennの「大規模言語モデル」のフィード

スクレイピングは壊れる前提で設計する ― 他人のHTMLに依存する機能の立て直し

・対象読者と前提 外部サイトのスクレイピングに依存する機能を持っていて、いつか壊れることへの備えを考えたい方 公式APIが存在しない情報源をどう扱うか設計判断に悩んでいる方 動作確認環境: macOS / Node.js v24.14.0(package.json の engines は >=24.0.0)/ TypeScript 5.8.3 将棋の駒をモチーフにしたローカルLLM専用マルチエージェントCLI「Jin」(@tanishi-z/jin)は、v0.1.1 から v0.2.0 へのアップデートで、モデル一覧取得の仕組みを作り直しました。理由は単純で、v0.1.1 の...
@IT 全フォーラム 最新記事一覧

ゼロトラストの壁は「製品」ではなかった トヨタが4年以上かけて見直したもの

・サイバー攻撃への備えを「侵入を防ぐこと」だけで考えていないだろうか。ニチレイの事例が浮き彫りにしたのは、1社のシステム障害が取引先や顧客まで巻き込み、復旧の判断さえIT部門だけでは完結しない現実だ。では、企業は何を基準に「復旧」を考えるべきなのか。
機械学習タグが付けられた新着記事 - Qiita

ツール結果を待つ間の空転を埋めるSPORK、推論中に呼び出しを先読み

・エージェントを動かしていて体感的に一番もったいないのが、ツールの結果が返ってくるのを待つ時間だ。LLMが考え、検索なりコード実行なりのツールを呼び、結果が戻るまでGPUはただ待機する。推論・行動・観測(Thought-Action-Observation)を1手ずつ順番に回...
Zennのトレンド

デスクトップUIフレームワーク15種のメモリ使用量計測

・はじめに 現在(2026年8月)メモリ価格高騰によりアプリケーションのメモリ使用量に厳しい目が向けられています。 ・「Electronは重い」「Rust系は軽い」「TauriならElectronより省メモリ」など様々な声がありますが、それが本当なのか実際にどれぐらいの差があるのか分からなかったため、自分で15種のデスクトップUIフレームワークで「同じアプリ」を作り、メモリ使用量を比較しました。 ・作ったと言っても完全にAIコーディングです。できるだけ内部動作は公平にしたつもりですが最適なコーディングになっていないかもしれません。そのため大まかな傾向としてご覧ください。
#LLMタグ

なぜAIは「文字」を数えられないのか? しりとりが苦手な理由とトークンの秘密

・大学院レベルの論文を書ける最新AIが、なぜ小学生でもできる「しりとり」でつまずくのか。その根本原因である「トークン化」の仕組みを、人間が漢字を読むプロセスに例えてわかりやすく解説します。
#LLMタグ

ハイブリッドLLMの『巨大活性化』を解明:性能向上への新知見

・最近、AIの進化が止まらないなぁと感じませんか?(^◯^) 特にLLM(大規模言語モデル)の進化は目覚ましいものがありますよね。まるで私たち人間と会話しているかのような自然さで、様々なタスクをこなしてくれる。その進化のスピードには毎日驚かされ、胸が高鳴るばかりです。 ・でも、その裏側で一体何が起きているのか、もっと深く知りたいと思ったことはありませんか? なぜAIはこれほど賢くなったのか。その性能向上を支える、目には見えないけれど確かな「理由」がそこには存在するんです。 ・そしてその正体は、単なるデータ量や計算能力だけでは語れない、ある革新的な発見にありました。
Qiita - 人気の記事

はじめてな Elixir(39) Zenohex の put/get で「書いたはずの値が読めない」を潰す

・この記事で「はじめに」以下は全部 Claude Code で生成した記事です。もちろんプロンプトは私が指示したものです。書きっぷりが私っぽく、よく出来てます。中で出てくる Github のリポジトリの中も全部 Claude Code が生成してます。急ぎで投稿するほうが良い...
#LLMタグ

はじめまして

・はじめての記事を書きます。 ・noteを始めようと思っていたけれど、なかなか最初が書けずにいました。 ・最初なので、簡単に自己紹介をします。
#AIタグ

フォロワーは増えてるのに、なぜnoteは売れない?

フォロワーは増えてるのに、なぜnoteは売れない?
Qiita - 人気の記事

プロゲーマーから未経験エンジニアになって、上達の仕方は同じだと気づいた

・未経験からWebエンジニアとして働き始めて、まだ1ヶ月も経っていません。 ・毎日普通に分からないことが出てきます。 ・GitもDBもAPIも、仕事で触るたびに「これなんだっけ」となります。
Qiita - 人気の記事

ベトナム語のタイピング入力練習アプリを作ってみた【hocviet.vn】

・はじめに ベトナム語を勉強していると、わりと早い段階で「読めるけど打てない」という壁にぶつかります。 ・原因は 声調記号(ダイアクリティカルマーク) です。Vịnh Hạ Long rất nổi tiếng. ・の1文だけでも ị ạ ấ ổ ế と5つ出てき...
#AIタグ

リゾバで出会いはあるのか?40歳が正直に話します

・リゾバを始める前に気になっていたことがあります。出会いはあるのかということです。 ・今回は40歳の自分がリゾバをやってみてリアルに感じたことを正直に話します。 ・きれいごとなしで書きます。
#AIタグ

リゾバ転職後の給与明細を公開|職場を変えたら収入はどう変わったか

・リゾバで職場を変えた場合に収入がどう変わるのかをリアルな給与明細と一緒に全部公開します。
#LLMタグ

リモートのDocker内のollamaをSSHポートフォワードしてローカルから使う

・最近ローカルでLLMを走らせるだけでなく、リモートでGPUインスタンスを借りてその中でLLMを走らせ、それをローカルのエージェントから使うこともあるので、その方法について解説する。 ・SSHポートフォワーディング 続きをみる
Zennの「大規模言語モデル」のフィード

ローカルLLMだけで「はんこ・レ点・和暦」入りの申込書を読むAI-OCRを作った

・AI-OCRって自分で作れないかな、と思って作ってみました! クラウドLLMのAPIは使いません。手元のPCの中だけで動くローカルLLM構成です。 ・こういう申込書って、はんこや独自の日付形式、チェックボックス…と、いろんな要素が重なってなかなか読みにくいパターン多いですよね。 ・そこから始めて、今は13項目ぜんぶ読めます。
#LLMタグ

ローカルLLMは「ロマン」から「コスト管理」へ ── Software Design 2026年9月号の読む

・Software Design 2026年9月号(通巻497号)の第1特集は「開発の新戦力 ローカルLLM ── オープンウェイトモデルによるAIコーディング」でした。 ・ローカルLLMの記事はこれまでもたくさんありましたが、この号がこれまでと決定的に違うのは、サブタイトルが「AIの料金やサービス変更に負けない!」であることです。速さでも賢さでもなく、料金とサービス変更。つまりこの特集は「クラウドに性能で勝つ話」を最初から降りていて、コストと機密性の制約下で、何をローカルに寄せられるかの線引きの話になっています。
機械学習タグが付けられた新着記事 - Qiita

因果推論 Day 6/全30回 観察データを実験に近づける、割付メカニズムと非交絡性

・この連載について 因果推論を「本を読んだ」で終わらせず、自分の言葉で説明でき、コードで再現できる状態まで落とす30日連載です。直前のDay 5では、RCT(無作為化比較試験)なら「単純な引き算がそのまま因果効果になる」ことを、Fisherの並べ替え検定とNeymanの反復...
Zennの「機械学習」のフィード

学習率のwarmupは本当に訓練を安定させるのか。崩壊寸前のLRで20シード×3条件、実際に数えてみた

・「学習率を高くして訓練するときは、最初にwarmup期間を置かないと訓練が不安定になる・序盤で発散する」——深層学習をやっていると、ほぼ常識のようによく聞く話だ。以前の記事でSGD・Momentum・RMSprop・Adamを競走させたときも、Adamの適応的な学習率について色々調べる中で、この「warmup神話」に何度も行き当たった。 ・ただ、自分の手で実際に確かめたことは一度もなかった。なので今回は、崩壊するかしないか際どいLRを実測で探し、そのLRでwarmupあり/なしを何十シードも回して、本当に効くのかを数字で見てみることにした。 ・先に結論を書いておく。このセットアップでは、wa...
#LLMタグ

広告を1つ出すだけのつもりでいたら、テストが1300件を超えて1回まわすのに15分以上かかるようになりました

広告を1つ出すだけのつもりでいたら、テストが1300件を超えて1回まわすのに15分以上かかるようになりました
Zennの「機械学習」のフィード

四足ロボットが一歩も歩かない。犯人は公式の既定設定だった

・不整地に2時間かけて学習させた四足ロボットが、ぎこちなくスタックしながらも一応歩いた。じゃあ簡単な平地ならすぐだろう、と降りてみたら——平地のほうが一歩も動かなかった。 ・そこから原因に辿り着くまで、私は3回連続で見立てを外しています。この記事はその記録です。結論だけ先に言うと、犯人は自分のコードではなくIsaac Lab が平地タスクにだけ適用している既定設定でした。直したら、2時間かけた不整地の結果を20分で超えました。 ・TL;DR 公式の既定設定が、そのタスクで最良とは限らない。
#LLMタグ

治療用LLMの安全性と環境負荷:意外なトレードオフが判明

・医療現場でのAI活用は、私たちの未来に大きな希望をもたらす一方で、「本当に安全なのか」「地球に優しいのか」といった漠然とした不安を感じたことはありませんか?私は世界のAI情報を日本最速で発信するAI専門家として、日々最前線に立っていますが、今回発表されたある研究結果は、そんな私たちの常識を揺るがすものとなりました。 ・正直、ここまで変わるとは思わなかった話がある。 ・しかも理由は、才能でも根性でもなかった。
#AIタグ

自衛隊が「AI無人潜水機」を導入へ。任務ごとに装備を入れ替える、新しい海中戦の形

・海の中の戦いが、静かに変わろうとしています。 ・自衛隊が、AIを搭載した無人潜水機の導入を進めると伝えられています。しかも、その機体は、任務に応じて装備品を入れ替えられる設計だとされます。ある日は魚雷を積んで攻撃の任務に、別の日はセンサーを積んで警戒監視に。一つの機体が、装備を替えるだけで、まったく違う役割をこなす。
Qiita - 人気の記事

自分のAI活用ワークフローを整理してみた

・最近、AIをどう使っているかを整理してみました。 ・最初から「上流・中流・下流」と分けようとしていたわけではなく、使っていくうちに自然とこうなっていただけです。これが良い構成なのかどうかは正直わかりませんが、現状のスナップショットとして投稿します。
#AIタグ

実務でウェブ制作をしている大学1年が、AIだけでLPを作ったら10分で終わった

・実務でウェブ制作をしている大学1年が、AIだけでLPを作ったら10分で終わった はじめまして。ゆうといいます。大阪でウェブ制作をしている大学1年です。飲食店や士業事務所のサイトを、AIを使いながら作っています。
Zennの「大規模言語モデル」のフィード

寝ている間にPCを動かすAIと、「諦めないで」で難問を解いたAIのお話(2026年8月AIトレンド3選)

・AIの世界では、チャットで会話するだけでなく「パソコンを自動で動かしてくれるAI」や「人間の励ましで限界を超えるAI」など、人間味を感じる面白い進化を伝えるニュースが続いています。 ・今週、特に「これは面白い!」と感じた3つの出来事を、まとめてみました。 ・AI専用のパソコンがもらえる?SpaceXAIの「Grok Bot」 🔗 一次ソース: SpaceXAIが24時間働くAIエージェント「Grok Bot」をリリース(GIGAZINE) これまでの自動操作AIは、動かしている間は自分のパソコン画面が勝手に操作されてしまい、他の作業が手につかないのが少し不便でした。
#LLMタグ

生成AIによって、能力が価値の源泉ではなくなったら、人間の価値とは何なのか

・生成AIの進化を見ていると、ときどき不思議な議論に出会う。 ・「AIには創造性がないから、人間には価値がある」 続きをみる
Zennの「大規模言語モデル」のフィード

生成AIを組織に定着させるための、渡し方・受け方・測り方・育て方の設計

・生成AIの導入は、派手には失敗しません。「もうやめます」と宣言されるような終わり方は、めったにない。AIは、それ自体が便利すぎるからです。 ・静かに崩れていくのは、利用そのものではなく、「組織が意図した使い方」のほうです。使う人は残る。ただし各自のやり方で、公式の経路は素通りされ、検証はまちまちで、成果は誰にも説明できない。「導入は成功したが、定着は失敗した」は、たいていこの形をしています。 ・私自身、個人開発で似た経験をしています。「人間のフィードバックでAIを育てる機能」を作り、毎日使っているつもりで、実は3ヶ月間、一度も意図したとおりに機能していなかった(そのときの検証記録)。一人で使...
Zennの「大規模言語モデル」のフィード

設計も実装もレビューもAIがやる個人開発で、精度をどう出しているか

・私は個人で AI coding agent の runtime を作っています。 ・この製品は、設計も、実装も、実装のレビューも、AI が行っています。 ・私がやっているのは、AI に渡す最初の指示の精度を上げることと、最終的な成果物が目的に達しているかを確認することです。その間の設計・実装・レビューは、それぞれ別の AI が担います。この記事では、作業指示書を書く AI を設計 AI、コードを書く AI を実装 AI、実装を審査する AI をレビュー AI と呼びます。
#LLMタグ

独自LLMの思考過程が流出か?APIから推論トレースを抽出する手法が報告

・もし、あなたが心血注いで開発したAIの「頭の中」が、誰かに覗き見されたら…どう感じますか? まるで自分のアイデアや努力が、知らぬ間に抜き取られてしまうような、そんな恐ろしい事態が、いま現実に起こりうるという衝撃的な研究結果が発表されたんです。私が世界のAI情報を追い、プロダクト開発の最前線に立つ中で、これは見過ごせない、と強く感じています。
#AIタグ

文章についての私感

・文章にはそれを書いた人の気配や色合いが宿っている というより、気配や色合いを感じられる文章が好きなのだと思う 続きをみる