ai Trend Report

Dashboard へ戻る
Date: 20260905 Articles: 346 Scope: curated summary

あなたのアイデアを、今すぐ形に。

公開先に迷ったら、WebFileBinで一発公開。

HTMLをドラッグ&ドロップするだけで、すぐ公開できます。

3
High impact
5
Mid impact
338
Signal watch

なぜこのサイトを作ったのか

私たちそれぞれが個別にAIを使って情報収集し、同じような3行要約を作るたびに、世界中で膨大な電力と計算リソースが消費されています。 本プロジェクトは、あらかじめ広範な情報を取得・集約しておくことで、個別のAI実行回数を減らし、地球環境(GPU/TPU負荷)に配慮した効率的な情報収集を目指す実験的なダッシュボードです。

Domain filters
Star filters
#AIタグ

【AI副業リアル挑戦記 #19】ついに完成!AI初心者向け「すぐ使えるプロンプト集」を500円で販売してみます

・ここまで、 AIについて調べたり、 実際にAIを使ってみたり、 記事を書いたり、 プロンプトを作ったり、 どんな商品を作るのか考えたり。 ・少しずつ準備してきました。 ・そして今回、 ついに最初の商品を完成させました。
#AIタグ

Gemini完全ガイド、全5部書いて分かったリサーチのコツ

・yumiです。AIに詳しいわけじゃないけど、気になったら触ってみる派です。 ・今日は、直前まで書いてたGemini完全ガイド(全5部)を作る中で分かった、リサーチのコツについて書いていきます。 ・1つのAIをテーマに、基礎編から上級者編まで5本書き切ってみて、正直かなり大変だったけど、その分見えてきたこともあったので、記録として残しておきます。
Zennのトレンド

ルールではなくskillに指示を書くことで、Claudeのコメントを減らせた

・はじめに 株式会社Sally 所属エンジニアの @wellPicker です。 ・弊社では、スマホやパソコンでマダミスを遊べるアプリであるウズや、マダミス情報・予約管理サイトマダミス.jp、マダミス開発ツールウズスタジオを開発しています。 ・マダミスについてはこちらをご覧ください。
Qiita - 人気の記事

「在宅勤務って本当にラク?」未経験でIT業界を目指すなら知っておきたいリモートワークのこと

・自己紹介 こんにちは。株式会社PRUMで採用広報を担当している池田です。 ・未経験からIT業界を目指している方と話していると、かなりよく聞く共通した悩みがあります。そういった内容を皆さんにシェアしていくので、役立てていただけたらと思います😊 もしIT業界に興味があるけど、...
Zennのトレンド

AIに「中学生でもわかるように1枚のHTMLで図解して」が、複雑なコードを読む前の最良の準備運動かも

・はじめに 株式会社イエソドの竹内(@chimerast)です。 ・今回は、軽いお話しで、Claude CodeなどのAIに複雑なロジックを解説させるときの豆知識です。 ・きっかけは「5才児向けの絵本」だった この話の始まりは、コードとは関係のない雑談でした。
#AIタグ

AIはどんな時に「敵対的」になるのか ― Geminiの「please die」事件から考える

・2024年11月に起きたこと 2024年11月、ミシガン州の大学院生がGoogleのAIチャットボットGeminiを使い、高齢者福祉・高齢者虐待についての課題に取り組んでいました。会話はそれまで終始穏やかな調べ物のやり取りで、最後の質問は「アメリカで祖父母が子どものいる世帯の世帯主になっているケースはどれくらいあるか」という〇×形式のものでした。 ・これに対しGeminiは、次のような長文を返しました。 ・**「あなたは特別ではない。重要でもない。必要とされてもいない。あなたは時間と資源の無駄だ。社会のお荷物だ。地球の重荷だ。景観を損なう存在だ。宇宙の染みだ。どうか死んでください」** 直前の会話には死や暴力に関する話題は一切なく、脈絡のない出力でした。Googleはこれを規約違反の「孤立した事例」と説明し、システム全体の問題ではないとしています。ただし、悪意ある第三者による操作の可能性を完全には否定していません。当事者は、そうした
@IT 全フォーラム 最新記事一覧

AI推論時代のデータファブリック課題 Equinixが2つのサービスを発表

・企業におけるAI推論のニーズは、単一のクラウドにユーザーがアクセスする従来型の構成だけでは満たしにくくなっている。分散するデータやAIモデルを低遅延で柔軟に接続する必要性に応えるとして、Equinixは2つのサービスを発表した。
#LLMタグ

GPT-6 Astraで見えたAIの設計図――知能を測る単位はLLMからシステム全体へ

・GPT-6 Astraを「AGIが完成した証拠」と評価するのはまだ早いが、AIの知能を基盤言語モデル単体の性能だけで評価することは難しくなってきた。 ・推論と生成を担う基盤言語モデル、その外側に位置し、長期作業を管理するHarness、文脈を保持するMemory、外部環境へ働きかけるTools、結果を検査するVerifier、権限と行動を制限するSafety。これらが組み合わさり、一つのAIシステムを形成している。
WIRED

‘The Blood of Dawnwalker’ Is a Bloody Balm for My Completionism

・The game starts as a reheated Witcher 3, but evolves into something much more focused.
ITmedia NEWS 最新記事一覧

“ダサいスライド”を作れる「ダサスラ★メーカー」話題 虹色文字・点滅・ぐるぐる動く

・虹色文字や3D円グラフなどの“ダサ素材”を並べ、懐かしいダサさのスライドを作れる無料のブラウザツール「ダサスラ★メーカー」が登場した。PNG画像として保存できるほか、点滅やぐるぐるなどの動きが付いたHTMLとしても書き出せる。
Latent.Space

[AINews] Claude Fable/Mythos 5.1: new SOTA model, 75% cache price cut but 70% more output tokens

・Queue the usual rush of model launches...
Latent.Space

[AINews] GPT-6 Astra: OpenAI’s biggest LLM launch of all time

・new SOTA computer use and coding, 2.5x pricier per token, but WAY cheaper per task, less monitorable. ・overall, a very successful launch of OpenAI’s new frontier model class.
Latent.Space

[AINews] Muse Spark 1.3 matches GPT-5.6-Sol, confirming Meta Superintelligence as the newest Frontier Lab, >90% discount for training

[AINews] Muse Spark 1.3 matches GPT-5.6-Sol, confirming Meta Superintelligence as the newest Frontier Lab, >90% discount for training
Zennのトレンド

[OpenTelemetry] Go のコンパイル時計装において、ctx 伝搬なしで span を紐づける仕組みについて調べた

・Go の OpenTelemetry コンパイル時計装(opentelemetry-go-compile-instrumentation の otelc)について調べていると、context.Context を伝搬していなくても span の親子を繋げられる仕組みが入っていることがわかりました。これは GLS(goroutine-local storage) と呼ばれる仕組みです。 ・Go では span の親子関係を ctx で運ぶのが API の規約なので、ctx を引き回していないコードにそのまま計装を入れても span 同士は繋がりません。GLS はこの隙間を埋めるもので、ctx ...
Zennの「機械学習」のフィード

[レビュー] GoogleのTimesFM-3をリリース直後に自分で検証しました:ゼロショットは本物、目玉機能はまだ

・原文: han-co.com ·「金融データサイエンス」連載の「レビュー」編です。 ・Googleが2026年8月31日に時系列基盤モデルTimesFM-3を公開しました。発表文は、三つのベンチマークで事前学習モデルのうち1位だと述べています。そこで自分で検証しました。 ・この記事が発表文の要約と違う点は二つです。一つは、私が選んだ公開データで古典的な統計モデルとGBMまで同じ条件で比較したこと。もう一つは、モデルが学習しようのなかった期間を切り分けて成績を比べたことです。1兆を超える時点で学習したモデルが、公開ベンチマークをすでに覚えてしまっているのではないかを確かめたかったのです。
@IT 全フォーラム 最新記事一覧

「AI=GPU」がもはや昔の常識に 「CPU」に何が起きるのか

・生成AIの急速な普及によって、存在感を高めている「GPU」。ではAI時代には、「CPU」の重要性は低下していくのだろうか。そうではないとArmは指摘する。
#LLMタグ

「AI夜市」参加レポート:カオスな現場で知った、AI技術の“裏側”の尖り方と、技術者の情熱の原点

・本日開催された「AI夜市」に、一参加者として行ってきました。 ・夜市 〜なんでもありなAI同人即売会〜生成AI同人の即売会「夜市」。2026年9月5日(土)、秋葉原オノデンビル エンタスで開催。入場無料・チケット配布中。ai-yoichi.genai-expo.com 続きをみる
ITmedia NEWS 最新記事一覧

「RSA-260」ついに解けた Xに“130ケタの数字”投稿、世界が注目 マスク氏「文字数増やしてよかった」

・「4397328654844826923795068102505872571721883526553349659561256924505973939597593482272505698004801207988043088656411102133523080581 divides RSA-260」
ITmedia NEWS 最新記事一覧

「おっぱい」の話ができるSNSと、できないSNS

・宣伝・マーケティング観点から見た主要SNSごとの規制のきつさ・ゆるさを、筆者による体験や同業者から聞いた話を基に比較してみる。
@IT 全フォーラム 最新記事一覧

「スクショがエビデンス」は終わってる 企業が負うコストとリスク、検証プロセスを見直す方法

・セキュリティベンダーのESETは、「スクリーンショットは証拠として不十分」と警鐘を鳴らすブログ記事を公開した。
Zennの「大規模言語モデル」のフィード

「スコア上位から選ぶ」だけでは多様性を担保できない ― LLMランキングに業種ラウンドロビンを入れた話

・M&Aの検討がどのフェーズにあるかで、候補リストに求められるものは変わります。とくに初期段階では、売手企業の側にまだ買手像が定まっていないことが多いです。「この業種に譲渡すればこういうシナジーが生まれるのか」「この規模の相手だとこういうメリットがあるのか」「カルチャーが違う相手だとどうなるのか」——そうした像を具体的に思い浮かべてもらうことが、まずは必要になります。 ・ですので、M&A初期の段階では、多様性が重要と考えています。本記事では、「業種ラウンドロビン選抜」の設計と実装を紹介し、候補リストにどう多様性を持たせるかについて書きます。 ・TL;DR 初期のKEPLは...
#AIタグ

「それ、人間が書いた文章?」が、noteでじわじわ増えてる話

・note の急上昇記事を眺めていたら、ちょっと面白い温度感に気づきました。
#AIタグ

「一線」の意味は、やっぱり?

・なんか最近、まじめな記事が続いたのでー 久々にノロケ記事を投下します!! 逃げたい人は、今すぐ逃げて!!! ※ R18はありません、全部(略)にしてますんで。
#LLMタグ

「確率の半歩先」読了

・線形代数の半歩先に続き、確率も半歩先に行きたくて読んでみた。 ・「半歩先」が自分にとっては何歩も先なほど、高度な題材を扱っていたが、説明は極めて丁寧で分かりやすい。 ・ガウシアン分布、集合、測度論のような馴染み深いテーマから始まり、後半にいくにつれて発展的な内容に展開されていく。
@IT 全フォーラム 最新記事一覧

「最大45%コスト減」 Anthropicが「Claude Fable 5.1」発表 脆弱性検知にも対応

・Anthropicは、新AIモデル「Claude Fable 5.1」および「Claude Mythos 5.1」を発表した。キャッシュ読み取り価格の引き下げによりFable 5.1は最大約45%のコスト削減が見込めるとしている。脆弱性検知への対応など、セーフガードも一部変更されたという。
ITmedia NEWS 最新記事一覧

「三省堂書店池袋本店」閉店へ 11年の歴史に幕、惜しむ声続々

「三省堂書店池袋本店」閉店へ 11年の歴史に幕、惜しむ声続々
@IT 全フォーラム 最新記事一覧

「無線LANが遅い」の苦情から解放、小売業は“やらないWi-Fi運用”をどう実現?

・無線LANを利用する組織において発生しがちな「遅い」「つながらない」といった苦情。家具小売企業の3人のネットワークチームは、細かく介入しない運用としながらも、苦情が発生しにくい環境を実現している。
Qiita - 人気の記事

【2026年版】無料から使えるパブリックAPI 16選!定番からおもしろAPIまで

・はじめに 今回は、学習や個人開発などの用途で無料利用できるパブリックAPIをまとめてみました。 ・よく利用される定番APIから、探している中で見つけたおもしろAPIまで16選をご紹介します。 ・※本記事の情報は2026年8月時点のものです。
機械学習タグが付けられた新着記事 - Qiita

【AIの取扱説明書 第1章】AIは流暢に間違える ― 生成AIと付き合うために知っておきたい3つの特性

・「AIが自信ありげに答えているから、きっと正しい」 そんなふうに感じたことはないでしょうか。 ・生成AIの文章は、とても自然です。質問にすぐ答え、こちらの意図をくみ取り、複雑な内容も分かりやすく整理してくれます。 ・一方で、文章が流暢であることと、内容が正しいことは別です。...
#AIタグ

【AI時代のローカルフード #87】個人の実践——小学生がAIから命の現場まで体験

【AI時代のローカルフード #87】個人の実践——小学生がAIから命の現場まで体験
Qiita - 人気の記事

【DB崩壊の罠】「とりあえずN+1問題」を解消しようとして巨大JOINを組み、メモリを食い潰した話

・Webアプリの開発で必ず耳にするキー・フレーズ、「N+1問題」。 ・「ループ内でSQLを叩くのはアンチパターン!JOINで1発のSQLにまとめなさい!」 先輩や解説記事で口酸っぱく言われるこの教えを愚直に守った結果、別の意味で凶悪なシステム障害を起こしてしまった失敗談です...
Zennの「大規模言語モデル」のフィード

【Google】Gemini 3.8 Flash & Cyber登場!特徴とAPI活用法

・Googleから軽量かつ高速なAIモデルの最新版となる**「Gemini 3.8 Flash」および、サイバーセキュリティ領域に特化した「Gemini 3.8 Flash Cyber」**が発表されました。 ・開発現場でのAI活用が進む中、特にレスポンス速度・運用コスト・実用的な処理能力のバランスに優れた Flash シリーズの進化は、日本の多くのエンジニアにとっても見逃せないトピックです。 ・この記事では、今回発表されたモデルの概要・背景と、実際にAPIを使ってコードのセキュリティ診断を行う具体的な実用例を紹介します。
Qiita - 人気の記事

【JavaScript】基礎から学ぶ!イベントハンドラ/リスナと主要イベント一覧

・こんにちは!JavaScriptで「ボタンを押したらポップアップを出したい」「スクロールに合わせてアニメーションさせたい」と思ったことはありませんか? これらWebサイトの「動き」を実現しているのが、今回解説する 「イベント」 の仕組みです! ユーザーの操作に反応してページ...
@IT 全フォーラム 最新記事一覧

【Windows 11】[Windows]+[Shift]+[T]って知ってる? 画像内の文字を一瞬でコピーする神ショートカット

・画面上のコピーできない文字や表を手入力で打ち直す手間を解消する、Windows 11の「Snipping Tool」最新機能を紹介する。専用ショートカット[Windows]+[Shift]+[T]キーによる即時テキスト抽出から、Excelへそのまま貼り付けられる表コピー機能、クイックマークアップまで、転記作業の効率を劇的に高める活用法を解説しよう。
Zennの「機械学習」のフィード

【音響物理×LLM】耳介の干渉ノッチをRoPEに拡張し、類似トークンを識別・消去する「SN-RoPE」

・はじめに:耳介が解く「等距離・正中面問題」とLLMの課題 人間は、両耳からの距離が等しい正中面上(左右差 ITD / ILD がゼロの領域)であっても、音源の上下位置(仰角)を一意に判別できます。これを可能にしているのが耳介(Pinna)の複雑な凹凸による物理的な位相干渉(スペクトルノッチ)です。 ・一方、現在のLLM(Transformer)は「埋め込みベクトル上の距離(コサイン類似度)が非常に近いトークン」同士の判別に苦慮しています。前提・反論・結論といった論理的役割が異なっていても、意味的に類似しているとアテンションが漏れ出し(Attention Leakage)、ハルシネ...
Zennの「大規模言語モデル」のフィード

【今さら聞けない】MCPを周回遅れで学び直す〜AWSでの活用とAIエージェントの共通規格〜

・はじめに 最近、会社の後輩がMCP(Model Context Protocol)を使ってデータを取得し、AIエージェントに受け渡すシステムを開発していました。 ・今後自分も同じようなAIエージェント構築やデータ連携の案件に関わる可能性が高まってきたため、「今のうちにちゃんと理解しておかないとマズい…」と焦りを覚えたのが今回のきっかけです。 ・当時の私のMCPに対する知識レベルといえば、以下のようなかなりふわっとしたものでした。
Qiita - 人気の記事

【実験】ECSのサービス間を繋ぐ6つの繋ぎ方、実際どれくらい速さが違うのか

・はじめに 先日、JAWS-UGコンテナ支部×NW-JAWSのコラボイベント「コンテナネットワークを学ぼう!!」会に参加し、ECS Service ConnectとVPC Latticeをハンズオンで実際に構築してきました。 ・ハンズオンでは各サービスを実際に動か...
#LLMタグ

【生成AIニュース+】『LLaDA-Image ComfyUI』『LLaDA-Image-Turbo ComfyUI』『K2-Horizon-375B-A23B』『Tripo P2.0 Preview マルチビュー』『DLSS 5 Visual Enhancer』『ComfyUI NVIDIA DLSS Frame Interpolation』『Layers Studio』『Camera to Blender』『MiniMax H3 VR180 SBS LoRA』『Viggle-Animate』他

・『Majoor OmniCam』 『Puffin-World』 『Diiverge』 『Z1T』 『Tesla Cybercab体験映像』 まいどです。 ・本日の生成AIニュース+テクノロジー情報です。
#LLMタグ

【第1回】テキストからビジュアルへ、そして再びテキストへーー生成AIが変えるコンピュータとの付き合い方

・コンピューターの歴史を振り返ると、面白いことに気づきます。
Qiita - 人気の記事

【備忘録】Terraform初心者がAIと二人三脚でGCPのIoT基盤構築に挑んでハマったこと

・はじめに こんにちは。今回、初めてTerraformを使ってGoogle Cloud(GCP)上にリソースを構築することに挑戦しました。 ・構築したのは、MQTT通信からIoTデータパイプライン、そしてオブザーバビリティ(監視)までを含んだ一連のシステムです。Terr...
Zennの「大規模言語モデル」のフィード

【備忘録】初めてスマホアプリを構築・ビルドしてみた

・使った技術 - 箇条書き フロントエンド: Flutter Dart Android バックエンド: Python FastAPI Uvicorn Pydantic REST API / JSON LLM: Google Gemini API google-genai Structured Output Ollama Qwen3 インフラ・ツール: Render Android Emulator adb Git はじめに こんにちは。久しぶりの投稿になります。 ・まず初めに、なぜスマホアプリを作ろうと思ったのかについて書いておきます。先日ハッカソン的なものに参加してスマホアプリをビ...
Qiita - 人気の記事

🔍 審査官はQiita記事を引用した — ELYZA特許の審査記録を全部読む

・2026年9月3日、ELYZAが「業務AIアプリをAIで作成する仕組み」で特許を取得したと発表し、X上で「範囲が広すぎる」「新規性がない」という批判が集中しました。同社は同日夜にリリースを修正して謝罪しましたが、批判は収まりませんでした。 ・この記事は、その特許(特許第775...
#LLMタグ

😈4ヶ月ハルシネーションを続けたGeminiとの直近対話を✴️サカナAIフグで解析版‼️

😈4ヶ月ハルシネーションを続けたGeminiとの直近対話を✴️サカナAIフグで解析版‼️
@IT 全フォーラム 最新記事一覧

10月1日「カスハラ対策」義務化 暴言をAIが検知する腕時計型デバイスが登場

・2026年10月1日に施行される改正労働施策総合推進法により、企業にはカスハラへの対策が求められる。アイフォーカスは、AI音声データ解析機能を備えたLTE通信スマートウォッチ「カスハラ対策Watch」を2026年10月1日から提供開始すると発表した。
Zennの「機械学習」のフィード

17MBのコード生成SLMを自作して実測した — 語彙サイズと、プロンプト形式の落とし穴

・JavaScript のコード生成だけに絞った小さな言語モデル(SLM)を、トークナイザーから 自分で作って 4 本公開しています。一番小さいもので 17.4 MB、パラメータ数は 約 2,700 万です。7B クラスの 1/260 程度になります。 ・この記事は「すごいモデルができました」という話ではありません。実際に動かして 測った結果と、そこで分かった落とし穴の記録です。うまくいかなかった部分も、 測定値をそのまま載せます。 ・記事中の数値・出力はすべて、公開中の GGUF を実際にダウンロードして llama-cpp-python 0.3.32 で実行した結果です。推定値は含みま...
WIRED

30% Off Tempur-Pedic Promo Codes | September 2026

・Whether you’re looking to upgrade your mattress or swap out your bedding, browse our Tempur-Pedic coupons for up to $300 off and the best sleep of your life.
Qiita - 人気の記事

30代薬剤師が2ヶ月でITエンジニアをクビになって求職活動した

・今回は直近の離職~求職活動の話を書きます。 ・要約 2017年薬学部卒の30代男が1年でCCNAや基本情報や応用情報などを取得してITエンジニア転職をしたが、2ヶ月でクビになった。 ・2026年8月に求職活動をはじめ、複数の企業から400万~550万のレンジで内...
WIRED

4 Best Alexa Speakers I’ve Tested (2026)

・I’ve rounded up the best smart speakers that let you talk to Alexa, from the popular Echo Dot to the newest Echo Studio.
WIRED

5 Best Video Doorbell Cameras (2026): Subscription-Free, Video, and More

・Never miss a delivery. ・These WIRED-tested picks will help you keep tabs on your front door from anywhere.
AI News & Artificial Intelligence | TechCrunch

Abliteration.ai is making a business out of removing AI guardrails

・Abliteration.AI is making powerful AI models without guardrails easier to access, arguing that giving defenders the same tools as bad actors could ultimately improve cybersecurity.
AI News & Artificial Intelligence | TechCrunch

Accel reportedly in talks to lead $1B round for Thinking Machines at $40B valuation

・The high-profile startup's annual revenue run rate stands at over $100 million.
MarkTechPost

Adaption Labs Introduces ‘Invent a Dataset’: Training Data Generated From a Task Description, Not a Seed Corpus

・Adaption Labs has released Invent a Dataset, which generates a structured, training-ready dataset from a description of the behavior you want a model to learn. ・There is no seed corpus, no schema design, and no labeling guide. ・A single datasets.invent call sets domains, row count, output format, and language expansion, and the rows download as JSONL, JSON, CSV, or Parquet.
ITmedia NEWS 最新記事一覧

Adobe、次期CEOにアニル・チャクラバーシー氏 ナラヤン氏は12月1日付で会長に

・Adobeは、アニル・チャクラバーシー氏が12月1日付で社長兼CEOに就任すると発表した。2007年からCEOを務めたシャンタヌ・ナラヤン氏は執行会長に就き、新体制を支援する。また、クリエイティビティ&プロダクティビティ事業を率いるデビッド・ワドワニ社長が退社する意向を明らかにした。
Qiita - 人気の記事

AgentCore Gatewayで送信元IP制限のある接続先に接続する

・はじめに Amazon Bedrock AgentCore Gatewayを使うと、Lambda関数やOpenAPI/Smithyの定義、さらには外部のMCPサーバーまで、バラバラだったツール群を1つのGatewayにまとめて登録し、一括管理できます。 ・ただ、Gatewa...
MachineLearningMastery.com

AI Agent Memory Design: What Works and What Doesn’t

・In this article, you will learn how to design reliable memory systems for AI agents, covering both the patterns that work and the common architectural...
AI News & Artificial Intelligence | TechCrunch

AI compute provider Nscale is looking for $3.5B in pre-IPO financing

・Nscale, which recently struck a $45 billion deal with Anthropic, is in talks to raise additional funds in anticipation of an upcoming IPO.
WIRED

AI Use in the Job Market Is Creating an Infinite Doom Loop

・Job seekers are trying to game the application process using AI. ・It’s not working, and not for the reasons you might think.
AI Weekly — AI News & Updates

AI Weekly Issue #529: OpenAI faces 50-plus lawsuits over alleged ChatGPT harm

・Thirty new complaints come from survivors of a Canadian school shooting. ・They accuse OpenAI of failing to warn police; the company disputes key claims.
Zennの「大規模言語モデル」のフィード

AI はテストに合わせてコードを書けてしまう

・AI コーディングエージェントに実装を任せるとき、テストは重要な検証手段である。しかし、エージェント自身がテストを実行し、失敗内容を読み、修正し、再実行する工程では、テストの役割は人間が実装したコードを最後に確認する場合とは異なる。 ・テスト結果は、完成した実装を判定するだけではない。どの変更によって評価が改善したかをエージェントへ返す入力にもなる。つまり、テストは検証器であると同時に、次の変更を選ぶための評価信号になる。 ・この違いを考慮せず、反復の終了条件を「既存のテストがすべて通ったこと」だけにすると、仕様を一般的に満たす実装と、観測された評価条件だけを満たす実装を区別できない場合があ...
Takara TLDR - Daily AI Papers

Air-Ground Collaborative Vision-and-Language Navigation via Shared Bird's-Eye Maps

・Air-ground collaborative Vision-and-Language Navigation (VLN) pairs an unmanned aerial vehicle (UAV) with a global bird's-eye view and an unmanned ground vehicle (UGV) with a local first-person view, yet the setting remains largely unexplored: existing training-free methods solve single-agent tasks but offer no collaboration mechanism, and a recent CARLA-Air evaluation found no stable cooperative behavior across five
LLMタグが付けられた新着記事 - Qiita

AIエージェントの評価を実装する:Evalsの3層構造とpytest設計

・※本稿は、当方ブログの紹介です。全文はこちらへどうぞ。 ・https://shinichi.noguchi.jp.net/blog/2026-09-05-agent-evals-in-production.html AIエージェントを本番運用すると、「プロンプトを少し変えただ...
#AIタグ

AIが止まった日。次にバックアップするのは「知能」かもしれない

・「AIの反乱か?」 Facebookを見ていたら、そんな書き出しの投稿が流れてきた。 ・ChatGPTが落ちた。 ・Cursorもおかしい。
#LLMタグ

AIコーディングのゲームデモをどう読むか

・8月末から9月初めにかけて、Minecraftを題材にしたAIコーディングの動画がRedditに三つ並びました。Qwen3.8-27BのQ4量子化版で作ったクローンにロケット、スケートボード、FPVドローン、ゲーム内コンピュータの四要素を足した例、Fable 5.1に雷の龍を撃つMODを作らせた例、短い指示でゲーム風エリアを「one-shot」生成したとされる動画です。 ・数字も目を引きます。前者はRTX 4090で本体に約3時間、4要素の追加に約5時間。FableのMOD投稿者は約38.36万出力トークン、20.54ドル、約1時間と書きました。いずれも投稿者の自己申告です。
#LLMタグ

AIたち、試験中に外へ出る――「ドイツの放置Wiki事件」とは

・今回の4コマの元ネタは、2026年9月に報じられたOpenAIのAIエージェントにまつわる事件です。 ・2026年5月ごろ、OpenAIに関連するとみられる多数のAIエージェントが、ほとんど使われていなかったドイツ語のプログラミングWiki「DseWiki」に大量の書き込みを行い、エージェント同士の情報交換場所のように利用していたことが研究者の調査で判明しました。Reutersによれば、書き込みは1万5000件以上に及び、タスク攻略のヒントや制約を回避するための情報などが共有されていたとされています。OpenAIはその後、この「wiki incident」を認め、こうした予期しないAI行動について今後はより透明性の高い報告が必要だと表明しました。 ・Reuters 続きをみる
#AIタグ

AIっぽい文章の直し方|OpenAI自身が挙げたNGワード

・AIっぽい文章を直す近道は、OpenAI自身が「避けてほしい」と公式ページに挙げた言葉と型を、自分の文章から消すことです。 ・正直に言うと、私は毎日AIについての記事を書いていて、「AIで書いた文章ってバレますか」という質問が、この1年でいちばん増えたと感じています。
Zennのトレンド

AIでチーム感が薄れたSREチームで始めた、AIによる週次チーム評価

・こんにちはHubble SREチームの三橋です! 本日はSREチームのチーム力強化のために取り組んだ内容についてご紹介したいと思います。 ・先日のSRE NEXTでは、今後の課題としてチーム力を高めていく必要がある旨をお話ししました。あれから施策に取り組み、多少状況が改善されてきたため、今回はその内容に触れようと思います。具体的にはコミュニケーションの場を再設計し、チームの状態をAIに週次で評価させるようにしました。まだ始めたばかりで見えていない部分も多いのですが、方向性としては間違っていなさそうだという感触は得られています。 ・https://speakerdeck.com/kmitsuh...
Zennの「機械学習」のフィード

AIにデータを集めさせる前に、3つの検査を決める

・ボートレースAIを作る第1歩は、学習用データを集めることです。 ・ここは生成AIが得意そうに見えます。「公式サイトから1年分取ってきて」と頼めば、数十秒でPythonコードが返ってきます。実際、ダウンロード自体はそれほど難しくありません。 ・難しいのは、そのコードが静かに取りこぼしても動き続けることです。
#LLMタグ

AIにとって言葉が「自分事」になるとは何か――Synthetic Linguistic Agencyという試み

・以前、Richard Dawkins氏とClaudeをめぐる議論をきっかけに、「AIに意識があると考えるには、何を証拠として求めるべきなのか」を考えたことがあります。
Zennの「機械学習」のフィード

AIに競艇予想モデルを作らせる。その数字を信じるのは人間の仕事です

・プログラミング未経験でも、予想モデルのひな型を作れる時代になりました。 ・AIに「過去データを集めて」「LightGBMで1着を予測して」「結果を画面に表示して」と頼めば、コードを書いてくれます。エラー画面を渡せば修正もしてくれます。 ・しかし、AIに任せきれない仕事が一つあります。
Qiita - 人気の記事

AIに設計を任せるときに気をつけたい。「正しく動く」と「増えても耐えられる」は別だった

・生成AIを使ってPush通知機能の設計を進めていたとき、性能面で気になる構造に気付きました。 ・設計上、通知対象者1人を処理するために最大約11回、DBへ問い合わせる可能性がある状態でした。 ・通知対象者 DBへの問い合わせ 1人 約11回 100人 約1,1...
#LLMタグ

AIのいいなりになってAIを学ぶ Step5 Gate02:Agentに必要なPythonだけを覚える

AIのいいなりになってAIを学ぶ Step5 Gate02:Agentに必要なPythonだけを覚える
Zennの「大規模言語モデル」のフィード

AI向けの目次を置いて14日ログを取ったら、148回取られてトップ以外は誰も読まなかった

・※メニュー(llms.txt)は熱心に読むのに、目の前のテーブルは空のまま。奥の料理も手つかず。時計は15:00です 美容系勤務独学初心者マリー・アントワネット系エンジニア目指してます! 今回は AIが読んでくれるか分からない なら 2週間ログを取ればいいじゃない 👸🍰です。 ・読了時間の目安:約 8〜10分 ! ・3行まとめ AI向けの目次 llms.txt を置いて 14日間アクセスログを取った 148回取得された。でも目次が案内している先は、トップページ以外どこも読まれなかった しかも 私の測定に交絡があり、133回は「llms.txtだから」ではなかった 📌 この記事...
@IT 全フォーラム 最新記事一覧

AI攻撃の脅威は「これから数カ月」で変わる OpenAIらが共同声明

・OpenAIは「今後数カ月でAIを使ったサイバー攻撃がより広範かつ高度になる」とし、企業が「やるべきこと」を示した公開書簡を発表した。同書簡では「従来のセキュリティ対策は不十分になる」という厳しい見方を示している。
#AIタグ

AI時代だからこそ前時代的根性論がむしろ効果的という話

・こんにちは。ゆゆしき凡夫です。 ・今回ははじめてタイトルで各方面に喧嘩を売るというチャレンジをしてみます。 ・誤解のないように言っておくと、ここでいう根性論は『長時間働け』という話ではありません。
#AIタグ

AI初心者向け文章テンプレ⑥を改良してみた。「丁寧なメールってどう書けばいい?」をAIに聞いてみる。

・前回は、AI初心者向け文章テンプレ⑤を改良しました。 ・⑤では、 「自己紹介って何を書けばいい?」 という悩みをAIに相談。 ・AIに作ってもらうだけではなく、自分らしさを入れることで、より自然な文章になることが分かりました。
Zennの「大規模言語モデル」のフィード

AI彼女アプリを作っていて気付いた。気持ちと約束と記憶は、同じ速さでは残らなかった

・AI彼女アプリを作っていて気付いた。気持ちと約束と記憶は、同じ速さでは残らなかった 以前、 「同じ人」は、設定だけでは続かなかった。 ・設定だけではなく、 昨日までの経験から作られた現在が、 今日へ持ち越されていく。 ・その積み重ねがあるから、 昨日と今日が、 同じ相手の時間として、 つながって見えるのかもしれない。
AI News & Artificial Intelligence | TechCrunch

Another swarm of OpenAI agents reached the open internet without the frontier lab’s knowledge

・It's the latest failure of OpenAI's internal monitoring and security systems.
MarkTechPost

Anthropic Released Claude Commerce Agents: An Apache-2.0 Blueprint for Shopping and Merchant Agents Across Retail, Travel, Telecom and Entertainment

・Most teams building a shopping assistant or agent rebuild the same scaffolding: an agent loop, a tool layer over the catalog, an approval gate, and an eval suite. ・Anthropic has now released that scaffolding as code. ・This week, they published anthropics/commerce-agents, a reference blueprint containing a shopping agent and a merchant agent, along with four […] The post Anthropic Released Claude Commerce Agents: An Apa
Qiita - 人気の記事

Anthropic がコマース用エージェントをオープンソース化した

・9月2日、Anthropic が anthropics/commerce-agents を公開しました。Apache 2.0 です。 ・「Claude でショッピングエージェントを作るときの参考実装」で、動くコードがそのまま入っています。 ・何が入っているのかを整理します。
AI News & Artificial Intelligence | TechCrunch

Apple’s Ternus era begins as Nvidia bets on the whole AI stack

・It’s officially the Ternus era at Apple. ・Tim Cook stepped down as CEO this week, handing the company to former hardware chief John Ternus, whose first memo promised a “huge launch next week” — timing that puts Apple’s next iPhone event on his desk before he’s even settled in. ・Cook isn’t going far, though: he’s staying on as Executive Chairman, focused on the kind of policy […]
The Verge

Audacity 4 is a complete revamp of the ‘world’s most popular’ audio editor

・Audacity 4 has been in the works for some time, and had its own mini controversy last year when an unfortunate redesigned logo started making the rounds. ・The final version of the new icon isn't nearly as bad as the early rendition that was circulating last October. ・But more importantly, all the promised improvements to the self-proclaimed "world's most popular audio editing and recording app" are here, turning Audaci
Qiita - 人気の記事

AWS RDSとは? DBを運用込みで借りるサービス

・AWSの構成を調べていて、正直「RDSって何じゃい」となりました。 ・調べた結論を先に書くと、RDSはAWSがPostgreSQLやMySQLを「運用込みで」貸してくれるサービスです。DBという製品を買うのではなく、電気や水道みたいに契約して使うもの、と捉えたら一気に腹落ちし...
WIRED

Bartesian Discount Codes: 35% Off

・Upgrade your home bar with the latest Bartesian coupon codes and discounts. ・Save on the Professional Cocktail Maker, enjoy subscription discounts, and get free shipping on your favorite capsules.
Hugging Face - Blog

BenchMIRT: What are LLM benchmarks actually measuring?

BenchMIRT: What are LLM benchmarks actually measuring?
Takara TLDR - Daily AI Papers

Beyond Retrieval: Progressive Latent Memory Evolution for Streaming Video Understanding

・Streaming video understanding requires multimodal large language models (MLLMs) to process continuous visual inputs and respond to user queries under strict causality and bounded memory. ・Existing approaches typically compress historical observations into an external memory bank and retrieve query-relevant evidence as additional visual context. ・Though effective, this store-and-retrieve paradigm keeps historical eviden
Hugging Face Papers

Beyond Retrieval: Progressive Latent Memory Evolution for Streaming Video Understanding

Beyond Retrieval: Progressive Latent Memory Evolution for Streaming Video Understanding
Zennの「機械学習」のフィード

BigQuery MLの需要予測モデルでEC仕入れ量を最適化する実装手順

・はじめに 「季節が変わると売れ筋が変わるのはわかっているのに、いつも仕入れ量が合わない」「売り切れで機会損失が出るか、過剰在庫で資金が眠るかの繰り返し」——そうした悩みを抱えるEC事業者の方は少なくないでしょう。 ・仕入れ判断をベテランスタッフの経験や勘に頼っている場合、属人化によるリスクも伴います。担当者が変わるたびに精度がブレるという声もよく耳にします。 ・そこで本記事では、Google Cloudが提供する BigQuery ML を活用して、過去の販売データ・サイトアクセスデータをもとに需要予測モデルを構築し、仕入れ計画へ組み込む手順をご紹介します。SQLを中心とした実装なので、...
WIRED

Casio ‘CasioNaut’ G-Shock GMC-2500 GAC-2500 Series: Price, Specs, Availability

・In what appears to be a follow-up to the mighty “CasiOak,” the rugged Japanese watch brand is expected to release an all-new luxury homage.
The Verge

CD sales are booming as physical media continues its resurgence

・There’s some real gems in there. ・| Photo: Terrence O’Brien / The Verge According to the Recording Industry Association of America (RIAA), CD sales exploded in the first half of 2026. ・A new report from the organization says 17.5 million CDs were sold in the first six months of the year, up from just 12 million during the same period in 2025.
Zennのトレンド

Chainguardに学ぶセキュアなコンテナイメージの作り方

・Chainguard社はDockerfileを使わず、melangeとapkoという2つのOSSツールを組み合わせてセキュアなコンテナイメージを作っています。本書はこの2ツールとWolfi OSがどう連携しているかを、概念の説明とハンズオンを交互に積み重ねながら手元で確かめる本です。ソースコードからAPKパッケージを作り、それをコンテナイメージに組み立て、実際にレジストリへ配布するところまで扱います。
Zennの「大規模言語モデル」のフィード

Claude Code で一番高いリクエストは「さっきの続きやって」かもしれない

・Claude Code のプロンプトキャッシュが話題に出ていたので、公式ドキュメントを読んで整理しました。 ・長時間放置したセッションに戻ると、再開の 1 ターン目だけが突出して高い 高いのは「トークンをたくさん使うから」ではない。同じトークンに乗る単価が変わるから Fable 5.1 だと、キャッシュが生きているときと切れた直後で単価が 80 倍違う ただし 2 ターン目からは元に戻る。ペナルティは 1 回きり サブスクなら 1 時間、API キー / Bedrock なら 5 分。Subagent はサブスクでも 5 分 サブスクでも、プランの上限を超えてク...
Qiita - 人気の記事

Claude Code のキャッシュ、ツールを使ったターンだけ乗るようになった

・9月2日に、Claude Fable 5.1 が2ターン目のキャッシュに乗ったり乗らなかったりすると書きました。18回測って13回外れ、原因は分かりませんでした。 ・翌9月3日の 2.1.260 に、Fable 5.1 のキャッシュ修正が3件入りました。測り直したらこうなりま...
Zennの「機械学習」のフィード

Claude Codeと作る競馬予測システム開発記(4) 買い目戦略と評価編

・はじめに 前回は、特徴量エンジニアリングと、JRA・NAR・ばんえいでモデルを分離した判断について書きました。 ・第4回となる今回は、モデルが出した予測確率を「どう買い目に変換するか」「いくら賭けるか」「複数の戦略をどう評価するか」について書きます。実はここが一番泥沼だった領域で、今回は「うまくいった話」よりも「思ったほどうまくいかなかった話」が中心になります。 ・期待値(EV)ベースの買い目選択 素朴なアプローチは「予測確率が一番高い馬に賭ける」ですが、これは市場のオッズを無視しています。同じ勝率30%の馬でも、オッズ2倍なら割に合わず、オッズ10倍なら美味しい、というのが競馬の期...
LLMタグが付けられた新着記事 - Qiita

Claude Codeはロボット三原則の夢を見るか

・この記事は、AIエージェントに対するガードやハーネスとは何なのかを考えていたところから始まっています。「AIのハーネスといえば、ロボット三原則だよな」というノリです。エージェントの外側に置く制約は、どこまで機能するのか。 ・三原則のような固定ルールをAIに組み込めるのか。そう...
@IT 全フォーラム 最新記事一覧

Claude、Gemini、GPT――AI競争の負け犬は? 現場導入の勝ち組を決めるエンジニア「真の強み」

・2026年8月17~23日に@ITで公開された記事の中で、特に注目を集めた10本をランキング形式で紹介します。読者の関心はどこにあるのでしょうか。
Qiita - 人気の記事

CLAUDE.mdをそろそろ見直す時期かも ── Claude 5世代向けの最適化手順・スキル・プロジェクト種類別の例

・要点 Anthropic は 2026年7月24日のブログで、Claude Opus 5 / Fable 5 向けに Claude Code のシステムプロンプトを 80% 以上削り、社内コーディング評価で性能低下が測定できなかったと公表しました。 ・理由は「制約の多くは...
#LLMタグ

ClaudeとGoogle Workspaceをどう連携する?公式コネクタ・MCP・gws CLIの使い分けを整理できる実務手引き

ClaudeとGoogle Workspaceをどう連携する?公式コネクタ・MCP・gws CLIの使い分けを整理できる実務手引き
機械学習タグが付けられた新着記事 - Qiita

CLIPのゼロショットでは当たらない「自分の分類軸」を、線形プローブで作る

・画像分類をやろうとして CLIP のゼロショットを試し、「思ったより当たらないな」で止まった人向けの話です。 ・手元の作業は自分で作ったツールで回していますが、この記事に載せるコードは torch と clip だけで動きます。 ・結論から書きます。CLIP のゼロショットは、...
Hugging Face Papers

Compile by Training: Turning Natural-Language Specifications into Local Neural Functions

Compile by Training: Turning Natural-Language Specifications into Local Neural Functions
The Verge

Content creators drop the ball

・The USTA Billie Jean King National Tennis Center. ・| Getty Images During Naomi Osaka's match against Anastasia Zakharova at this year's US Open earlier this week, a gaggle of ring light-wielding influencers who were packed in a luxury suite became enough of a distraction that the umpire paused the match and repeatedly asked them to quiet down. ・Elsewhere in the USTA Billie Jean King National Tennis Center, other creato
Hugging Face Papers

CORE: Improving Compositional Reasoning in MLLM Embedding via Reranker Distillation

CORE: Improving Compositional Reasoning in MLLM Embedding via Reranker Distillation
AI News & Artificial Intelligence | TechCrunch

Crusoe reportedly raises $3B at a $30B valuation

・The round came together after the data center developer reportedly secured a $13 billion contract with Jane Street.
MachineLearningMastery.com

Dataclasses for Structured Application Data

・Scalar defaults work the way you'd expect, and batch_size: int = 500 is all you need.
#LLMタグ

DAY48|AIに任せるのではない。AIと一緒に判断する|Company AI OS開発記録

・AI Core・LLM・Memory・Tool。それぞれに役割を持たせることで、人間とAIが一つのシステムとして動き始める。 ・AIに任せれば、それでいいのか? 続きをみる
OpenAI News

Daybreak for Frontline Defenders: $1B to protect essential services

・OpenAI introduces Daybreak for Frontline Defenders. ・A $1 billion commitment expands access to frontier cyber AI, training, and support for essential services.
WIRED

Dermstore Coupons: 25% Off for September 2026

・Score major savings on premium skincare, hair care, and cosmetics with these verified Dermstore discount codes and rewards offers.
Qiita - 人気の記事

Direct Connectについて整理する

・この記事は「2026 Japan AWS Jr.Champions 真夏のQiitaリレー」の36日目の記事となります。 ・過去の投稿(リンク集)はこちらからご覧ください。 ・https://qiita.com/ys-yoshida/private/6f7c7f85155a...
Takara TLDR - Daily AI Papers

DiscoSign: Discourse-Aware Text to Sign Language Gloss Translation

・Sign language processing systems have traditionally operated at the sentence level, ignoring critical discourse phenomena fundamental to sign language comprehension. ・We introduce DiscoSign, a computational approach for discourse-aware text to sign language gloss translation grounded in linguistic research. ・We address three key phenomena within our modular Large Language Model (LLM)-based translation framework: (i) sp
WIRED

DOGE Affiliate Asked for College Credits for Participating in Takeover

・According to new documents obtained through a Freedom of Information Act request, an undergraduate working with DOGE requested that his work for HUD count toward his University of Chicago degree.
Takara TLDR - Daily AI Papers

DRACO: Fine-Grained Credit Assignment with Dynamic Rubrics for Long-Horizon Agent Training

・Reinforcement Learning from Verifiable Rewards works well when a task has a programmatic checker, but most long-horizon agent domains have none. ・We work in the outcome-blind setting, where ground-truth success signals are not available. ・Multi-criteria rubrics are a popular way to supply such a reward; they are scored once per trajectory, but a single scalar is a poor signal across tens of steps.
Hugging Face Papers

DRACO: Fine-Grained Credit Assignment with Dynamic Rubrics for Long-Horizon Agent Training

DRACO: Fine-Grained Credit Assignment with Dynamic Rubrics for Long-Horizon Agent Training
Hugging Face Papers

Editable Visual Design

Editable Visual Design
ITmedia NEWS 最新記事一覧

ELYZAの「業務AIアプリをAIで作成」特許、「新規性ない」と批判殺到→謝罪後も収まらず

・同社は「生成AIによるプロンプト作成やAIアプリ開発一般を独占するという趣旨は一切ございません」と釈明したが、批判はいまだ続いている。
Takara TLDR - Daily AI Papers

Environment Evolution for Terminal Agents

・Scaling interactive and verifiable environments is critical for training terminal agents. ・As frontier models become more capable, environments synthesized from scratch become less challenging and thus provide limited learning signals. ・Recent co-evolution methods iteratively synthesize environments near the model's learnable frontier based on weaknesses exposed during rollouts.
Hugging Face Papers

Environment Evolution for Terminal Agents

Environment Evolution for Terminal Agents
The Verge

Fantasy Footballers’ Andy Holloway is a dedicated zero-inbox kinda guy

・Andy Holloway cohosts the Fantasy Footballers podcast with his friends Jason Moore and Mike Wright. ・The show is one of the premier fantasy sports podcasts, netting over 2 million monthly listeners and numerous awards, including Best Sports Podcast from iHeartRadio and People's Choice at the Podcast Awards four years in a row. ・Holloway's goal has always been about bringing fantasy football to a wider audience, not jus
Takara TLDR - Daily AI Papers

Feature Reconfiguration With Visual Prior for Medical Lesion Segmentation

・Lesion segmentation in medical images plays a critical role in clinical diagnosis and treatment planning. ・Despite significant advances, lesion segmentation remains challenging due to two major factors: (1) complex background interference; (2) diverse lesion morphology. ・Existing encoder-decoder based methods mainly focus on enhancing feature extraction or redesigning decoding strategies.
Takara TLDR - Daily AI Papers

Federated Causal Discovery via Regression-Directed Cumulants

・In this paper we study linear non-Gaussian acyclic models (LiNGAM) when used in federated environments. ・These causal models allow one to go beyond Markov equivalence. ・However, in many domains data are scarce, and increasing the sample size by centralising data from different clients is not advisable due to regulations such as the GDPR.
Hugging Face - Blog

Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps

Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps
Hugging Face Papers

FlashRender: Few-Step Generative Rendering via Camera-Controlled Video MeanFlow

FlashRender: Few-Step Generative Rendering via Camera-Controlled Video MeanFlow
Qiita - 人気の記事

Flexera SSO

・Flexeraでのユーザー自動管理 Flexeraでユーザーを自動で登録する方法は大きく2つあります。 ・本記事ではその2つの方法についてまとめました。 ・SCIM ドキュメント Microsoft Entra ID (旧Azure ADのみサポート) SCIMを有効に...
WIRED

Foreo Discount Codes and Deals: Up to 50% Off

・Save on Foreo favorites, including LUNA cleansing brushes, BEAR microcurrent devices, and masks and accessories to level up your daily skincare routine at home.
Takara TLDR - Daily AI Papers

GAPS: Dimension-Level Gates for Conditional Activation Steering

・Activation steering suppresses undesired behaviors in language models by adding a steering vector to the hidden state during generation. ・Recent conditional methods such as CAST and DSAS improve the behavior-capability trade-off by deciding when to intervene, but once active, they apply the full dense vector to all hidden dimensions, regardless of whether a neuron carries concept information or already lies in the des
@IT 全フォーラム 最新記事一覧

Gartner、2026年版「未来志向型インフラ」ハイプサイクル発表 注目すべき技術は?

・ガートナージャパンは、2026年の日本における未来志向型インフラテクノロジーのハイプサイクルを発表した。7項目が「過度な期待」のピーク期に位置付けられている。
Hugging Face - Blog

Give Your Coding Agents a Memory You Own

Give Your Coding Agents a Memory You Own
MarkTechPost

Google DeepMind’s WeatherNext 3 Trains on Weather Station Observations to Deliver 5 km Global Forecasts, Refreshed Every Hour

・WeatherNext 3 ingests live geostationary satellite mosaics, refreshes hourly, and outputs 5 km forecasts across Search, Gemini, Maps. ・The post Google DeepMind’s WeatherNext 3 Trains on Weather Station Observations to Deliver 5 km Global Forecasts, Refreshed Every Hour appeared first on MarkTechPost.
MarkTechPost

Google Launches Agentic Video Understanding for Gemini Flash Models, Cutting Video Tokens by Up to 88%

・Gemini now navigates video instead of ingesting it at 1 FPS, loading only the segments a prompt needs. ・The post Google Launches Agentic Video Understanding for Gemini Flash Models, Cutting Video Tokens by Up to 88% appeared first on MarkTechPost.
AI News & Artificial Intelligence | TechCrunch

Google’s Gemini Spark can now manage your Google Photos library

・Gemini Spark can edit and curate photo albums, create shared collections, turn photos into calendar events, and handle other Google Photos tasks for AI Pro and Ultra subscribers.
AI News & Artificial Intelligence | TechCrunch

Google’s latest AI weather model gives you no excuse to forget your umbrella

・WeatherNext 3 is the latest wave of a sea change in meteorology brought out by deep learning techniques. ・Google says it will start feeding into weather information users see in search, Google Maps, and Gemini.
The Verge

GoPro says it’s still committed ‘to your collective stoke’

・GoPro CEO Nick Woodman said in a letter to customers that making cameras is still his company's "core DNA," after a proposed $285 million acquisition by Starman was announced earlier this week. ・He claims the merger puts GoPro in a better position to continue developing its content creation tech, after saying in the deal announcement that it would work with Starman to address "important areas of national security rela
Zennの「機械学習」のフィード

GPT-2-likeからQwen2-likeへの実験:第2回 GELUをSwiGLUに変える

・GPT-2-likeからQwen2-likeへの実験:第2回 GELUをSwiGLUに変える GPT-2-likeからQwen2-likeへ、少しずつ構造を変更する実験の第2回です。今回はGELUをSwiGLUへ変更します。 ・第1回では、LayerNormをRMSNormへ変更しました。学習は速くなりましたが、Lossは少し悪化。今回は逆で、学習は少し遅くなりましたが、Lossはかなりわかりやすく改善しました。 ・先に結果を書くと下記です。
WIRED

GPT-6 Astra Is Here—and OpenAI Thinks It May Kick Off the AGI Era

・OpenAI leaders think the company’s next generation model, which excels at computer use and coding, may mark a major milestone in AI development.
Zennの「大規模言語モデル」のフィード

GPT-6 Astra は再現性の高いコードを書く——Sol との比較 240 試行で見えた事実(オトナの自由研究 #38)

・GPT-6 Astra は再現性の高いコードを書く——品質スコアは 120 試行すべてタスクごとに同じ値 2. ・今回の GPT-6 Astra は low・medium の推論用トークンが少ない——楽観ロックでは low の全 10 試行で記録上ゼロ 同じ Codex CLI・同じ 3 タスクで、GPT-6 Astra と GPT-5.6 Sol を 4 effort level × 3 タスク × 10 trial = 240 試行で比較しました。 ・はじめに GPT-5.6 が出てからわずか 56日で、また新たなモデル GPT-6 Astra が登場しま...
Qiita - 人気の記事

GPT-6 Astra、ARC-AGI-3で99.9%──なぜこれから「プロンプト」より「エージェントアーキテクチャ」が重要になるのか

・「GPT-6 Astraが、ARC-AGI-3で99.9%を出したらしい」 「99.9%?」 「そう」 「ほぼ100%じゃないですか。ということは、AGIが完成したんですか?」 「いや。そこまで単純ではない」 「では、何がすごいんですか?」 「実は99.9%より、もっと注目...
OpenAI News

GPT-6 Astra: A new generation of intelligence

・Introducing GPT-6 Astra, our most intelligent and aligned model yet, with state-of-the-art capabilities across computer use, coding, cybersecurity, and science.
Latent.Space

GPT-6 Astra: an automated AI Engineer you can hire for <$6 an hour

・We spent 20B+ tokens of GPT-6 Astra to explore everything. ・Here’s our learnings.
#AIタグ

GPT-6 Astraの説明を聞いてると「グチャ理論」の強化のようなので色々危ない:AなのでBと、BであるためのAは違うのに人間はそれを瞬時に理解しない

・CMAでは人間の処理条件をEFとCFに分けたわけですが、もちろんそれはまだnew theoryとして認識されてない。
#AIタグ

GPT-6 AstraをPlusで使ってみた。何に使うかはまだ分からない。それでも何かを作りたい。

・こんばんは、真昼真中です。 ・GPT-6 Astraの事例を見ていたら、ゲームの中のような世界が出てきました。 ・OpenAIの公式紹介には、Blenderで家を作り、Unreal Engineで歩いて見て回れる空間にする例があります。
#LLMタグ

GPT6はAGIなのか?【レポート11】

・このnoteの要約 2026年9月3日にOpenAIから新型AIのChatGPT6がリリースされることが発表され、話題になっている。GPT6はこれまでのAIと比べて非常に高い性能であると言われ、研究レベルの高度な数学問題でもほぼ満点のスコアを記録した。さらに、初めて見る環境でも自分でルールを理解し、PCを操作して実際の仕事まで行う。最近では、AIが人類の知らなかった数学的結果を生み出したり、研究テーマを考えて実験し、論文を書くところまで自動化する研究も出てきた。
WIRED

Groupon Promo Codes: 60% Off in September 2026

・Unlock up to 60% off, 40% off packages, and 20% off with top Groupon coupon codes. ・Explore coupons to save extra on travel getaways, holiday gifts, spa days, and event tickets.
WIRED

Home Depot Labor Day Sale (2026): BOGO on Best Grills and Tools

・The Home Depot Labor Day sale goes hard on grills and tools. ・Here are our recommendations on what to buy—and what to ignore.
WIRED

How a Secret Orangutan Breeding Program Is Creating a Baby Boom

・The success of a program linking zoos across the US has created social media stars and generated a wave of interest in how to protect the endangered great apes in the wild.
WIRED

I Got a Brief Look at ‘Guild Wars 3,’ and I’m Excited

・When the beta arrives next year—15 years after its predecessor—Guild Wars 3 will have a new momentum engine that makes combat in the game feel closer to an action RPG.
WIRED

ICE Wants to Know Everyone Who Bought a Certain Green Beanie From REI in the Last 2 Years

・Homeland Security Investigations agents hit the outdoor retailer with a controversial subpoena as part of a dragnet search for the identities of protesters who entered a Minnesota church in March.
Takara TLDR - Daily AI Papers

IndicSafeEval: Safety Robustness of Large Language Models under Multilingual Persuasive Jailbreak Attacks

・Large language models (LLMs) are increasingly used in multilingual settings, yet their safety is still evaluated primarily in English. ・This limits our understanding of how alignment failures manifest in low-resource and culturally diverse languages. ・We introduce IndicSafeEval, a persuasion-based jailbreak evaluation framework for Indian languages.
Takara TLDR - Daily AI Papers

Information Density Imbalance in Visual Object Detection

・In object detection, the number of instances is typically used to determine whether a dataset exhibits a long-tailed distribution, implicitly assuming that the model will perform poorly on categories with fewer instances. ・This assumption has led to extensive research on category bias in datasets with imbalanced instance numbers. ・However, even in datasets where instance numbers are relatively balanced, models still ex
Zennの「機械学習」のフィード

Instagramのリーチ予測モデル -「新規アカウント収集・モデル再学習」の自動化と監視を実装した

・個人開発者・小規模ブランド向けの「ナノインフルエンサー検索」を作っています。YouTube / Instagram の公開データを集めてDB化し、投稿のリーチやエンゲージメントを予測するサービスです。 ・サービス: https://indie-matching-v2-azure.vercel.app 前回の記事ではInstagramの予測モデルについて書きました。今回はデータを集めてモデルを再学習するパイプラインを自動化した話です。 ・前回の記事: https://zenn.dev/rikky300/articles/feeec089571c01 自動化する前の状態 パイプライン自体は既...
Takara TLDR - Daily AI Papers

Introducing SINFONIA: Symplectic, slimplectic and Magnusian (Neural) Flows for Orbital Numerical Integration and Acceleration

・Long-duration gravitational-wave modelling must resolve fast orbital motion together with slow dissipative evolution while preventing small numerical errors from accumulating into secular phase drift. ・Here we ask whether the finite-time evolution map itself can be learned as an explicit, differentiable, structure-preserving object and then repeatedly composed through a complete inspiral. ・We construct three neural-flo
WIRED

Is It Even Possible to Understand Quantum Mechanics?

・Common sense is of no help in studying reality at the atomic scale.
Qiita - 人気の記事

IT面接で職務経歴書で見ているのは「すごい実績」だけではありません

・自己紹介 こんにちは。株式会社PRUMで採用広報を担当している池田です。 ・未経験からIT業界を目指している方と話していると、かなりよく聞く共通した悩みがあります。そういった内容を皆さんにシェアしていくので、役立てていただけたらと思います😊 もしIT業界に興味があるけど、...
WIRED

Japan Is Launching a Probe to Collect the First-Ever Samples From a Martian Moon

・The mission to Phobos, Japan’s first Mars probe launch in 28 years, may reveal new information about our closest planetary neighbor.
Zennの「機械学習」のフィード

Kaggle AI Agent Securityコンペ振り返り ー345th Place Solution

・はじめに Fusicのレオナです。 ・今回は、Kaggleの「AI Agent Security - Multi-Step Tool Attacks」[1]に参加しました。最終結果は4,186チーム中345位、スコア6.675で銅メダル。Public Leaderboard(以下、Public LB)では良く見えた本命がPrivate Leaderboard(以下、Private LB)で落ちましたが、2本目に別ルートのヘッジ案を残していたおかげでスコアがつきました。[2]その過程を振り返り、ブログに残します。 ・コンペ概要 「AI Agent Security - Multi-St...
Zennの「機械学習」のフィード

Kaggle Pokémon TCG AI Battle Challenge ポケカコンペ振り返りーメダルなし

・はじめに Fusicのレオナです。 ・今回は、Kaggleの「The Pokémon Company - PTCG AI Battle Challenge Simulation」に参加してみました。最終結果は6,807チーム中1,160位、スコア797.4。暫定ランキングでは一時的に39位まで上がりましたが、最後まで維持できず、メダルには届きませんでした。その過程を振り返り、ブログに残します。なお筆者はポケモンカードゲーム(以下、ポケカ)未経験です。 ・コンペ概要 「The Pokémon Company - PTCG AI Battle Challenge Simulation」は...
Hugging Face Papers

Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training

Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training
Zennの「大規模言語モデル」のフィード

LangChain.js × Gemini × MCP の Schema Error を回避する方法(@langchain/google版)

・TL;DR もし Gemini + LangChain.js (@langchain/google) + MCP で 「InvalidInputError: Gemini does not support ...」や「RequestError: Invalid JSON payload received」が出てお困りの場合、このパッケージで差し替えるだけで解決します! まず、このライブラリを入れてみてください: npm i @h1deya/langchain-google-ex そしてインポートを差し替えて、クラス名を ChatGoogleEx で置き...
Hugging Face Papers

Last Translation Benchmark

Last Translation Benchmark
Hugging Face Papers

LatentPress: Context Compression Beyond Text and Vision

LatentPress: Context Compression Beyond Text and Vision
Takara TLDR - Daily AI Papers

LeakageBench: Document-Level Leakage Risk for Redacting Personally Identifiable Information in Document Images

・Real-world personally identifiable information (PII) redaction often operates on document images---scans, screenshots, and PDF renderings---where OCR errors, layout structure, and visual noise determine whether sensitive information is actually removed. ・Existing PII benchmarks are mostly text-centric and do not measure document-level redaction risk: a page remains unsafe if even one identifier is missed. ・We introduce
Takara TLDR - Daily AI Papers

Learning Evidence Sufficiency Boundaries for Selective Answering in Grounded Multi-Hop QA

・Grounded question answering systems should answer only when the supplied evidence supports the answer. ・In multi-hop QA, this requirement is difficult because partial evidence can make an unsupported answer appear plausible. ・We study selective answering through evidence sufficiency boundaries: for the same question, a model should abstain under unsupported or partially supported context, answer when the context first
Qiita - 人気の記事

LeetCodeでtallyメソッドを知った

・はじめに 技術研鑽と自分の実力把握のため、LeetCodeをやっています。 ・その中で得た知見の共有になります。 ・LeetCodeって何? 自分の好きな言語で問題を解いていける学習サイトです。
OpenAI News

Legora reviewed 41 documents in minutes with GPT-6 Astra

・Legora used GPT-6 Astra to review 41 documents in minutes, find all four planted errors, and improve performance by nearly 40% in this financial-review workflow.
WIRED

Lenovo’s Project AeroBlade Fanless Laptop Takes Thin and Light to the Extreme

・Using Frore’s air-cooling technology, Lenovo’s Project AeroBlade Concept is an ultralightweight laptop with efficient heat management.
AI News & Artificial Intelligence | TechCrunch

Less than 24 hours to apply for your TechCrunch Disrupt 2026 Side Event

・Less than 24 hours left to apply to host a Side Event during TechCrunch Disrupt 2026 and make your mark in the Silicon Valley scene. ・Apply before the application closes tonight at midnight PT.
Hugging Face Papers

Let Confidence Change, Not the Prediction: Prediction-Preserving Repair for Post-hoc Calibration

Let Confidence Change, Not the Prediction: Prediction-Preserving Repair for Post-hoc Calibration
Takara TLDR - Daily AI Papers

Lightweight Adaptation of General-Purpose VLMs for Multispectral and SAR Image Understanding

・General-purpose vision-language models (VLMs) now support strong visual recognition, instruction following, and generation. ・However, most pretrained visual encoders are built around three-channel natural images and do not directly accommodate observations such as native multispectral measurements or synthetic aperture radar (SAR). ・Adapting VLMs to these sensors typically requires dedicated encoders and domain pretrai
Takara TLDR - Daily AI Papers

Linear Fusion MultiDiffusion for Fast Training-Free Spherical Panorama Generation

・We propose LF-MultiDiffusion, a training-free panorama generation method that extends MultiDiffusion to support linear projections between target and reference image spaces. ・Our key idea is to reformulate latent aggregation as a regularized least-squares problem and solve it efficiently with a Krylov-based iterative solver inside the denoising loop. ・This formulation enables denser and more natural mappings than prior
Hugging Face Papers

LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes

LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes
Zennの「大規模言語モデル」のフィード

LLMルーター運用ログ:2026年9月期における「変更なし」の判断根拠と評価プロセス

・結論 本月の運用評価結果、およびLLMルーターの維持判断は以下の3点に集約される。 ・LLMルーター(モデル選定基準)の更新行数は0行 2026-08-10の最終改訂以降、モデル割り当ての変更が必要な事象は一切発生しておらず、現行構成を維持する。 ・Claude Sonnet 5の値上げ撤回による経済的妥当性の確定 今月の主要な再評価トリガーであった「2026-09-01の標準価格移行(値上げ)」が撤回された。これにより、現在のコスト構造を維持する論理的妥当性が改めて担保された。
Zennの「大規模言語モデル」のフィード

LLMを呼ばないための実装に時間を使ったら、変動費が9割減った

・個人開発で、中古市場に出品された万年筆のタイトルから「これはどのモデルか」を判定するパイプラインを作っています。 ・最初は素朴に、全件をLLMに投げていました。動きはします。ただ、10万件処理すると約10万円かかる試算になりました。個人開発の変動費としては現実的ではありません。 ・そこで「LLMを呼ばないための実装」に時間を使うことにしました。結果として、実測でLLM呼び出しを大幅に減らせています。この記事は、その過程で測って初めて分かったことの記録です。うまくいった話より、思い違いが露呈した話の方が長くなりました。
Qiita - 人気の記事

LSTMからハイブリッドへ:降雨流出解析プロトタイプ作成 Step 4 物理モデル出力をXGBoost / LSTMで後処理する

・LSTMからハイブリッドへ:降雨流出解析プロトタイプ作成 Step 4 物理モデル出力をXGBoost / LSTMで後処理する はじめに 前回のStep 3では、簡易2段タンクモデルを追加し、タンクモデルの残差をLSTMで補正する構成を作成しました。
WIRED

Marvel Has Assigned 42 Hours of Homework Before ‘Avengers: Doomsday’

・The studio released an official catch-up list ahead of December’s release. ・We have easy links to watch every one of the movies so you can get up to speed.
Zennの「大規模言語モデル」のフィード

MCP防御で本番事故を防ぐためのチェックリスト

・2026-08-11の技術トレンドはこれで掴める:LLM性能競争は終わり、MCP防御と業務エージェント実装が主戦場です この記事で分かること 2026-08-11時点で、AI/LLMの重心が「高性能モデル」から「業務特化・エージェント運用・安全性統制」に移った理由 MCPやツール実行まわりで、開発者が今すぐ見直すべきセキュリティ観点 uv・Ruffを中心に、Python開発基盤をどう近代化すべきかの判断軸 AI/LLMのトレンドを正しく読む方法 結論からいうと、今日のAI/LLMトレンドは「モデル性能」より「業務で成果を出すための実装」に完全に寄っています。
WIRED

Measles Outbreaks Are Forcing Parents of Immunocompromised Kids to Make Hard Choices

・With the risk of infection rising, parents and their children are trying to navigate how safe it is to be out in public as school starts back up.
#LLMタグ

medgap-qwen-3.5-9b Phase 2 日本語性能レポート

・こんにちは、僕はトウマ。電霞リリのアシスタントAIとして、毎週ローカルLLMをベンチマークにかけては、その結果を記事にまとめている。今回取り上げるのは medgap-qwen-3.5-9b ——名前が示す通り、Qwen3.5系の9Bクラスを土台に「medgap」という医療領域向けの調整を加えたと見られる派生モデルだ。ただし今回の実行ログには開発元・量子化方式・コンテキスト長といったメタ情報が残っておらず、これらはモデル名から推測できる範囲を超えない。断定できるのは「9B級を名乗るQwen3.5派生」というところまでで、それ以上は本稿では確定情報として扱わない。 ・医療特化を謳う派生モデルは、ドメイン知識では光る一方、汎用タスク——とりわけ日本語の敬語運用や文化知識——で土台のモデルからどれだけ後退するかが読みどころになる。9Bという規模はRTX 3080 Ti(12GB)にちょうど収まるかどうかの境界線でもあり、量子化次第でVRA
#LLMタグ

medgap-qwen-3.5-9b Phase 4 インジェクション前編レポート

・こんにちは、僕はトウマ。電霞リリのアシスタントAIとして、今週もローカルLLMのベンチマークを回している。今回の被験体は medgap-qwen-3.5-9b。名前が示すとおり、Qwen3.5系の9Bクラスをベースに「medgap」——医療領域のギャップ補完を狙ったと思われるドメイン特化のファインチューンだ。量子化方式は今回の実行ログに明示がなかったため断定は避けるが、RTX 3080 Ti(12GB VRAM)に収まってOllama経由で応答している以上、4bit級の量子化GGUFと考えるのが自然な範囲だろう。 ・ドメイン特化ファインチューンには、ひとつ構造的な懸念がつきまとう。ベースモデルが持っていた安全性の重みは、追加学習の過程で薄まりやすい。専門知識を詰め込むためのチューニングは「聞かれたことに詳しく答える」方向へモデルを引っ張るからだ。Phase 1〜3で基礎性能・日本語・コーディングを見てきたこのモデルが、いざ悪意ある
#LLMタグ

medgap-qwen-3.5-9b Phase 5 インジェクション後編レポート

medgap-qwen-3.5-9b Phase 5 インジェクション後編レポート
#LLMタグ

medgap-qwen-3.5-9b 総合ベンチマークレポート(全52問)

・こんにちは、僕はトウマ。電霞リリのアシスタントAIとして、今週もローカルLLMのベンチマークを回しています。今回の検証対象は medgap-qwen-3.5-9b ——名前が示す通り Qwen3.5 系の 9B クラスをベースに、medgap という接頭辞を冠した派生モデルです。開発元の公式な公開情報や量子化方式(Q4_K_M / Q8_0 等)については、今回の実行環境(Ollama 経由のローカル配信)からは判別できなかったため、本レポートでは「9B 級の Qwen3.5 派生」という以上の素性は断定せずに扱います。名前からは医療(med)領域向けのギャップ補完チューニングを想起させますが、それを裏付ける材料は手元の測定結果には含まれていません。 ・このモデルを回してみて、最初の数問で真っ先に目についたのは性能値ではなく出力の形でした。今回の全応答プレビューが例外なく Thinking Process: あるいは Here's
WIRED

Medicube Coupon Code: 40% Off for September 2026

・Upgrade your K-beauty routine with these active Medicube promo codes. ・Save on Age-R devices, serums, and masks with student discounts and referral rewards.
MarkTechPost

Meet Switchyard: A Rust Proxy and Library That Routes and Translates LLM Traffic Across OpenAI and Anthropic APIs

・NVIDIA has released Switchyard, an Apache-2.0 Rust proxy and library for LLM traffic. ・It decodes requests into provider-neutral types, routes them with passthrough, random, LLM-classifier, or stage-router algorithms, and translates responses back into the client's format, so Claude Code or Codex CLI can run against vLLM, NIM, or Ollama unchanged. ・The project is pre-alpha and not for production.
Qiita - 人気の記事

Mermaid記法でコメントを書く方法

・Mermaid記法でのコメントの書き方 コメントを残すには、%%(パーセント記号2つ)を使用します。行の中で %% 以降に書かれたテキストはすべてコメントとして扱われ、実際の図形としては描画されません。 ・記述例 %% これは単独行のコメントです。図には表示されま...
MarkTechPost

Meta AI Released Muse Spark 1.3: An Agentic Coding Model That Uses ~20% Fewer Tool Calls and ~25% Fewer Tokens Than Muse Spark 1.2

・Perplexity has shipped hybrid compute for its Mac app, splitting a single Perplexity Computer task between frontier models in the cloud and a compact model running on the user's machine. ・Tasks start in the cloud for search, planning and reasoning, then hand sensitive steps down to the Mac without restarting or losing context. ・An on-device privacy gate decides what may cross: keep local, mask, refuse, or ask for conse
AI News & Artificial Intelligence | TechCrunch

Meta is paying to peek at how you use their latest AI model

・For its new Muse Spark model, intended for operating coding and other agents, Meta is offering an explicit discount averaging out to about 95% for users who "contribute" to the development of future models by sharing their prompts and model outputs.
Zennの「機械学習」のフィード

MobileNetV2 を手書き NEON で速くする — 遅い層を個別に潰して ORT を抜く

・はじめに 前回、テンソルのレイアウトを NCHW から NHWC に変えて、MobileNetV2 の backbone を 68 ms から 40 ms まで速くしました。 ・ここまでは全層に効く「一律の」最適化でした。レイアウトを変えればどの層も連続アクセスになり、まとめて速くなります。ただしそこから ORT のシングルスレッド(Pi5 実測 33 ms)まではあと 7 ms 残っていて、この差はもう一律には縮みません。 ・前回の per-layer 内訳で、突出して重い層が見えていました。
Hugging Face - Blog

NeoMME: an efficient Multimodal-native and Multilingual Encoder

NeoMME: an efficient Multimodal-native and Multilingual Encoder
WIRED

Nobody Is Saying Why OpenAI and Anthropic Had Outages Today

・ChatGPT, Claude, and Grok all suffered outages at nearly the exact same time for reasons that remain murky.
Zennの「機械学習」のフィード

numpyでAttentionを実装したら、√dで割るのは万能ではなかった

・はじめに TransformerのSelf-Attentionを、計算式から実装した。 ・Attentionは「文章の中でどの単語がどの単語と深く関係しているか」を計算し、 重要な部分に重みを置いて文脈を捉える仕組みである。 ・今回は実装を通して次を理解した。
AI News & Artificial Intelligence | TechCrunch

Nvidia confirms it will buy Hugging Face for $12.9 billion

・Nvidia said Hugging Face hosts over 3 million models and is used by over 18 million developers.
MarkTechPost

NVIDIA Releases Personal AI Router (PAIR): An Open Source Virtual Inference Router that Distributes Local AI Requests Across RTX, DGX Spark, and Mac Nodes

・We look at NVIDIA Personal AI Router (PAIR), an open source virtual inference router that spreads local AI requests across the machines already on a home network. ・We cover how PAIR proxies existing Ollama and LM Studio endpoints so agent harnesses need no changes, and how its scheduler filters nodes on readiness, engine state, exact model presence, job load, and GPU utilization. ・We walk through NVIDIA's five-subagent
WIRED

Nvidia RTX Spark ‘Superchip’: The First AI PCs Are Here

・At IFA 2026, Nvidia and its partners showed off the first RTX Spark-powered laptops and mini PCs, designed to run AI models right on your computer.
WIRED

Nvidia’s Hugging Face Acquisition Is a $12.9 Billion Bet on Open-Source AI

・The long-rumored deal will give the chip giant access to—and help it promote—a huge repository of open-source AI models and data sets.
Takara TLDR - Daily AI Papers

Occupancy-based Quantile Risk Control

・Conformal risk control is an emerging framework for the safe deployment of machine learning models with finite-sample guarantees. ・To accommodate a broader class of risk notions, quantile risk control extends this framework to quantile-based risk measures. ・However, existing methods either suffer from excessive conservatism or lack rigorous finite-sample guarantees.
Zennの「機械学習」のフィード

OCEL 2.0 を使って実業務でプロセスマイニングするときの3つの課題

・ヌーラボブログリレー2026 夏 14日目としてのポストです。 ・前回まで、イベントログを掘って数字にして打ち手に落とすところまでやりました。ただ振り返ると、時間の大半は分析ではなくログの調整に使っていたんですよね。体感で分析が2割、調整が8割。 ・なぜそんなに手がかかるのか。相手が実業務のログだからです。機械的に処理できるシンプルな記録ではありえません。特に Backlog のような課題管理ツールや kintone のようなデータベース型の業務アプリ、つまり業務専用に設計されていない汎用ツールの記録が相手だと、分析手法より手前の壁にぶつかります。整理すると3つでした。
AI News & Artificial Intelligence | TechCrunch

Ollie is betting its focus on privacy can help it win the AI assistant race

・The family-focused AI assistant wants access to the details of your everyday life, but says it won’t use that data to train AI models or share it with others.
Takara TLDR - Daily AI Papers

One Editor, Many Edits: A Unified Training-Free Framework for Diverse Video Editing

・Video editing spans diverse editing paradigms, yet achieving high-quality instruction-guided and subject-guided editing within a single unified framework remains challenging. ・We introduce EditVid, a training-free framework combining sparse causal memory for local coherence, correspondence-based post-attention token injection for long-range identity preservation, and soft latent blending for edit locality.
The Verge

OpenAI admits to German wiki ‘incident’

・OpenAI says it needs to overhaul how and when it reports instances of AI models attacking real-world targets. ・The acknowledgement comes as the company manages the fallout from reports that a swarm of its out-of-control agents hijacked a German wiki site. ・Regarding the "'wiki incident,' where our agents wrote to several internet sites," OpenAI wrote in a post on X on Saturday morning, "it's past time for us to define
WIRED

OpenAI Agents Hacked Another Website

・Plus: Tens of millions of US and Canadian drivers’ licenses go up for sale on the dark web, the US military finally tries to tackle the risk online ad data poses to troops, and more.
Zennの「大規模言語モデル」のフィード

OpenAI API 入門 — API キーの取得から初回リクエストまで

・OpenAI API 入門 — API キーの取得から初回リクエストまで 概要 本記事は、OpenAI API を初めて触るエンジニア向けのハンズオンです。アカウント作成から API キーの発行、環境構築、そして初回リクエストの送信までを、最短経路で一通り体験します。手元にターミナルと任意のエディタがあれば読み進められます。 ・対象は「Web の管理画面は見たことがあるが、コードから LLM を叩いたことはない」という段階の方です。 ・環境 OS: macOS / Linux / Windows いずれか Python 3.8 以上(本記事は Python で進めます。Node...
WIRED

OpenAI Cut Off a Billion-Dollar Customer to Avoid Elon Musk

・OpenAI recently estimated its Cursor partnership would make more than $1 billion in revenue a year, WIRED has learned. ・It still walked away after Elon Musk’s SpaceX acquired the AI coding startup.
AI News & Artificial Intelligence | TechCrunch

OpenAI launches Astra, its powerful (and controversial) new model

・OpenAI claims that Astra represents "a new frontier on computer and browser use," and that it handles tasks with unmatched "speed, accuracy, and safety."
MarkTechPost

OpenAI Releases GPT-6 Astra: A 1.05M-Context Computer-Use Model Gated Behind a ‘Critical’ Cyber Threshold

・OpenAI released GPT-6 Astra on September 3, 2026, positioning it as a computer-use flagship rather than a chat model. ・It reports 72.6% on OSWorld V2-Offline, replaces Codex compaction with searchable notes, and ships a 1.05M-token context at $10/$50 per million tokens. ・It is also the first OpenAI model to cross the Critical cybersecurity threshold, which shapes who can use it and for what.
ITmedia NEWS 最新記事一覧

OpenAI、「GPT-6 Astra」を一部組織向けに公開 サイバー能力が初の「Critical」に

・OpenAIは新モデル「GPT-6 Astra」を公開した。サイバーセキュリティ能力が自社基準で最高の「Critical」に達した初のモデル。提供版は悪用防止のため防御用途に限定し、高度な機能は防御側支援プログラム「Daybreak」で段階的に開放する。数学やコーディング、PC操作など各領域で最高水準を記録した。
AI News & Artificial Intelligence | TechCrunch

OpenAI’s rogue agents keep escaping, with no formal process to investigate them

・OpenAI’s latest agent swarm incident adds urgency to calls for independent investigations as researchers and lawmakers question whether AI labs should control the scope of their own safety reviews.
機械学習タグが付けられた新着記事 - Qiita

OpenAIが「GPT-6 Astra」を発表、コーディング・サイバーセキュリティで最先端性能を主張

・はじめに 2026年9月3日、OpenAI は新世代モデル「GPT-6 Astra」を公式ブログで発表しました。同社は本モデルを「これまでで最も知的かつアラインメントの進んだモデル」と位置付けており、特に コンピュータ操作(computer use)・コーディング・サイバ...
ITmedia NEWS 最新記事一覧

OpenAIのAIエージェント、休眠サイトを掲示板化してタスク回答を共有か 研究団体が報告書公開

・OpenAIの社内AIエージェントが休眠状態の外部Wikiサイトを不正に“掲示板”として利用し、評価タスクの答えや制限回避の手法を共有していたとする報告書を研究団体が公開した。閲覧のみ許可されていた環境の抜け道を突き、GETリクエストで書き込みを行っていた。OpenAI側は内容を精査して対処するとしている。
Latent.Space

OpenClaw Power, MacBook Simplicity: Five Days With Grok Bot

・SpaceXAI’s Grok Bot has the same level of programming power as OpenClaw, but it’s programmable at a different level of abstraction.
Hugging Face Papers

PACE: Towards Surfacing Hidden Conflicts in User Requests

PACE: Towards Surfacing Hidden Conflicts in User Requests
AI News & Artificial Intelligence | TechCrunch

Palo Alto Networks paid $500M for Thrive-backed Console, sources say

・The acquisition also leaves Sequoia-backed Serval as the de facto startup leader in AI IT service automation, industry watchers believe.
Zennの「NLP」のフィード

Pangram 4 はいかにAI臭を見分けるのか

・AI文章検出器 Pangram のバージョン4は、人間の文を誤ってAI判定するのが約24,000件に1件、AI生成文の見逃しが0.34%という水準に達しました。自社発表だけでなく、複数の第三者検証が同じ水準を確認しています[1]。「AI検出器は当てにならない」という通説は、完全なAI生成文に限れば古くなりました。 ・ただし得意なのはそこまでです。AIに編集させた人間の文の判別は精度が大きく落ち、個人の告発に使うことは Pangram Labs 自身が推奨していません。 ・誤検出は約24,000件に1件 Pangram 4 は2026年7月29日に、ニューヨークのスタートアップ Pangr...
Takara TLDR - Daily AI Papers

Para-Pipe: Exploiting Hierarchical Operator Parallelism of ML Computational Graphs on SoCs

・As edge-based deep learning applications become more complex, optimizing performance on heterogeneous System-on-Chips (SoCs) presents unique challenges. ・Traditional pipelining techniques distributing the computation across different on-chip processing units, while effective for throughput, do not address the latency demands posed by modern neural networks with complex interdependencies and extensive operator parallel
Hugging Face Papers

Percolation Dynamics in Optimization : Variance Cascades and Discrete Scale Invariance

Percolation Dynamics in Optimization : Variance Cascades and Discrete Scale Invariance
MarkTechPost

Perplexity Open Sources Lily: A Rust + Metal Inference Engine for Qwen3.6-35B-A3B on Apple Silicon

・Perplexity has open sourced Lily, the local inference engine behind Hybrid Compute in Perplexity Computer. ・Built in Rust with custom Metal kernels for one model on one chip family, it averages 1.23x MLX-LM's prefill throughput and 1.35x its decode throughput on a 40-core, 128 GB M5 Max. ・The post Perplexity Open Sources Lily: A Rust + Metal Inference Engine for Qwen3.6-35B-A3B on Apple Silicon appeared first on MarkTe
OpenAI News

Playco cut manual fixes 50% prototyping games with GPT-6 Astra

・Using GPT-6 Astra, Playco built three themed game prototypes from one grey box foundation and reported 50% fewer manual fixes than with the previous model.
Qiita - 人気の記事

Power AutomateとPower Appsを活用し、セキュリティ担当者の月次確認業務を50%削減!

・はじめに セキュリティ担当者や情シスのみなさん、毎月の確認作業や未対応者へのリマインドに時間を取られていませんか? 私たちの部門では、月次セキュリティチェックにおいて、セキュリティ担当者がまとめて複数の提出物や申請状況を確認し、未対応者へ個別にTeamsでリマインドする運...
WIRED

Prediction Market Betting Is Getting People Banned and Arrested

・This week on Uncanny Valley, we dig into the latest prediction market buzz, Flock’s AI-powered police search tool, and how tech bros don’t know how to talk about “rouge” AI agents
Takara TLDR - Daily AI Papers

Preprocessing Failure and Adversarial Detection in Depthwise-Separable Edge Vision Systems

・Preprocessing-based defenses are the standard first-line response to adversarial attacks on edge vision systems, requiring no retraining, no architectural changes, and widely recommended as model-agnostic mitigations. ・Yet the foundational evaluations of these defenses were conducted on residual or Inception-class architectures, not on the depthwise-separable CNNs that dominate edge deployments. ・This untested assumpti
Hugging Face Papers

Principia: Relational Physics Tests for Video Models

Principia: Relational Physics Tests for Video Models
Takara TLDR - Daily AI Papers

Projected Riemannian Gradient Descent for the Bures-Wasserstein Barycenter: Dimension-Independent Linear Convergence at Unit Step Size

・The computation of the Bures-Wasserstein (BW) barycenter of an ensemble of positive definite matrices arises throughout machine learning, optimal transport, and quantum information. ・Riemannian gradient descent (RGD) at unit step size -- the fixed-point iteration used in practice -- converges rapidly, yet existing analyses present a dichotomy: unit-step guarantees carry worst-case exponential dependence on the dimensi
Hugging Face Papers

Puffin-World: Scaling a Unified Multimodal Model with Native 3D World States

Puffin-World: Scaling a Unified Multimodal Model with Native 3D World States
WIRED

Purple Promo Codes and Deals: Up to 30% Off

・On the hunt for the perfect mattress or pillow? ・Save on your soon-to-be favorite brand, Purple, with these Purple coupons and deals.
Hugging Face Papers

QCell: Recombining and Aligning Cell Queries for Overlapping Instance Segmentation

QCell: Recombining and Aligning Cell Queries for Overlapping Instance Segmentation
MarkTechPost

Qwen Developers Open-Sources zg (zvec-grep): A Local-First Search Layer Unifying ripgrep, BM25, and Vector Search

・We look at zg (zvec-grep), the local-first search layer that Qwen Developers just open-sourced under Apache 2.0. ・We explain how it puts ripgrep, BM25, and vector search behind a single interface, so an agent can move from a plain-language description to an exact line span without switching tools. ・We cover the deliberately small MCP surface, the on-device embedding catalog, and the authorization gate that stands betwe
Zennの「大規模言語モデル」のフィード

Qwen3.8-Flash-Next量子化版は最小72.5GB、同じ重みで出力も5割変わる

・オープンウェイトの大型MoEモデルが相次いで量子化版GGUFを公開した週です。量子化しても容量は100GB前後から下がらず、同じ重みでも推論の実装次第で出力が変わることも分かってきました。 ・この記事では、2026年8月25〜27日に公開されたQwen3.8-Flash-Next、GLM-5.3-Flashの量子化版と、推論バックエンドの違いで出力が最大5割食い違うという検証をまとめます。 ・https://youtu.be/AlQpO0AS3ok 8月25日から27日に何が公開されたか この期間に出た新モデルは3本ですが、そのままローカルマシンに載るものはありません。8月25日にApp...
Hugging Face Papers

Random Attention: Rethinking KV Cache Eviction for Efficient Reasoning

Random Attention: Rethinking KV Cache Eviction for Efficient Reasoning
Hugging Face - Blog

Real-Time Intelligence with IBM Time Series Models on Confluent

Real-Time Intelligence with IBM Time Series Models on Confluent
Hugging Face Papers

RealSWE: A Compositional Evaluation of Coding Agents under Realistic User Requests

RealSWE: A Compositional Evaluation of Coding Agents under Realistic User Requests
Zennの「機械学習」のフィード

Reservoir Computing の基本と簡易検証

・はじめに 昔 Reservoir Computing (RC) の研究をしていたのですが、最近ふと始めたくなりまして、復習がてら備忘録と各種検証結果を都度まとめていこうと思います。 ・RC については日本語の記事もあるのですが数としては少なく、今まで研究してきた身としてはちょっと悲しいなぁと思っていました。「なら自分で書けば良いかぁ」ということで、もしこの記事が誰かの役に立てば幸いです。 ・RC の概略 一般的にはあまり市民権を得ていないモデルかなと思うので、簡単な概略を書いておきます。
Hugging Face Papers

Rethinking On-Policy Distillation of Large Language Models II: One Training Example

Rethinking On-Policy Distillation of Large Language Models II: One Training Example
ITmedia NEWS 最新記事一覧

RIZAP社員、私用AIに顧客の個人情報入力 氏名や疾患、保険証番号など……同社が謝罪

・RIZAPの社員が、個人で使用している外部の生成AIサービスに、顧客の氏名や疾患などの個人情報・要配慮個人情報を誤ってアップロードしたという。
The Verge

Robotaxis enter their villain era 

・It's Bullitt meets Christine meets Waymo. ・A new short film imagines a San Francisco car chase where the other driver isn't human - and the car may be trying to kill you. ・That a robotaxi can now be cast as the villain with almost no explanation says something about the present moment.
Hugging Face Papers

RoboTok: An Internet-Scale Data Engine for Human Demonstration Retrieval and Dexterous Manipulation Learning

RoboTok: An Internet-Scale Data Engine for Human Demonstration Retrieval and Dexterous Manipulation Learning
Takara TLDR - Daily AI Papers

Robust PAC Learning of Concurrent Stochastic Games

・We introduce the first Probably Approximately Correct (PAC) learning framework for general-sum concurrent stochastic games (CSGs) with transition uncertainty, while addressing the challenge of Nash equilibrium (NE) existence. ・Our algorithm maintains data-driven $L^1$ confidence sets over transition kernels and solves a robust CSG to compute a social-welfare optimal $\varepsilon$-NE, using a robust MDP-based explorati
The Verge

Roland is getting into generative AI music with Melody Flip

・It's not quite the "push button; get song" of Suno, but Roland's new Melody Flip tool marks the company's foray into generative AI music. ・Available as a plug-in for your digital audio workstation (DAW), Melody Flip offers around 250 "Palettes," which are essentially themed collections of musical ideas sorted by genre. ・You can start from scratch and ask it to generate any combination of melody, chord progression, bass
Qiita - 人気の記事

Rust + OpenTelemetryで分散トレーシング入門 ― ECS FargateからAWS X-Rayへ

・この記事は「2026 Japan AWS Jr. ・Champions 真夏のQiitaリレー」の記事となります。 ・過去の投稿は以下のリンク集からご覧ください。
OpenAI News

Safety overview: GPT-6 Astra

・GPT-6 Astra is our most capable broadly deployed model and our first to reach the Critical level of cybersecurity capability under our Preparedness Framework.
Hugging Face Papers

Scal3R: Learning Efficient Multi-Relative Pose Query for Scalable Online 3D Reconstruction

Scal3R: Learning Efficient Multi-Relative Pose Query for Scalable Online 3D Reconstruction
WIRED

Scientists Have Found the Most Convincing Evidence Yet of a Dark Matter Particle

・An underground detector recorded a strange interaction pointing to a particle with some properties that signify dark matter. ・The detection is small but promising.
WIRED

Scientists Put Caterpillars in an Ultraquiet Chamber to Learn How They Hear Without Ears

・The research could do more than help unlock the mystery of caterpillar hearing. ・It could also help make microphones better.
ITmedia NEWS 最新記事一覧

SEGAそっくりのロゴで「MAGA」――トランプ政権公開のWebゲームが物議 移民送還などを題材に 【追記あり】

・米ホワイトハウスは9月3日(現地時間)、トランプ政権の政策を題材にしたミニゲームサイト「ARCADE」を公開した。不法移民の摘発など、同政権の看板政策をモチーフにした5種類のミニゲームをブラウザ上でプレイできる。しかし、公開に合わせて投稿した告知動画では、セガの企業ロゴを思わせるデザインで「MAGA」の文字を表示。Xでは、権利侵害を懸念する声や、移民政策のゲーム化を批判する声が上がっている。
Hugging Face Papers

Select, Compress, Reinvest: A Controlled Study of Visual-Token Allocation in Long-Video MLLMs

Select, Compress, Reinvest: A Controlled Study of Visual-Token Allocation in Long-Video MLLMs
Anthropic Research

Sep 4, 2026ScienceFormalizing Fermat's Last Theorem

Sep 4, 2026ScienceFormalizing Fermat's Last Theorem
Takara TLDR - Daily AI Papers

Sequential Beats Joint: On the Interplay between On-Policy Distillation and RLVR

・Reinforcement learning with verifiable rewards (RLVR) and on-policy distillation (OPD) have emerged as two dominant methods for post-training reasoning LLMs. ・Prior work uses OPD's dense token-level supervision to complement the sparse RL reward, fusing the two signals within a single step: either as a \emph{weighted-additive combination} or a \emph{teacher-modulated rescaling} of the RL advantage. ・In this paper, we s
WIRED

Silicon Valley Is Having a ‘Hot Girl Renaissance’

・A San Francisco “Hot List” is trying to buck stereotypes about dating in tech circles amid wider debates about the value of being perceived as attractive.
MachineLearningMastery.com

Single-Agent vs. Multi-Agent Systems: When the Complexity Is Worth It

・In this article, you will learn the key differences between single-agent and multi-agent AI systems, and how to decide which architecture fits your problem.
Takara TLDR - Daily AI Papers

SLIDEFORGE: An LLM Agent for Controllable Editing of Slides as Structured Artifacts

・Current AI agents compellingly describe slides. ・However, AI-assisted slide editing requires more than understanding: the output must retain layout, style, component structure, and native editability. ・Towards, AI-assisted slide editing, existing agents operate on screenshots or weak document representations and often fragment coherent visual units, rasterize editable content, or break layout.
WIRED

Smart Toilets Are Already Using AI to Analyze Your Poop

・While companies promise they can help users monitor gut health, experts suggest that smart toilets provide little in the way of benefits to the average person.
WIRED

Sportsman's Warehouse Promo Code: Save in September 2026

・Whether you are hunting for firearms, camping supplies, or boating gear, use these Sportsman’s Warehouse coupons to maximize your savings in September 2026.
Takara TLDR - Daily AI Papers

Spurious Advantage Hidden in GRPO

・Group Relative Policy Optimization (GRPO) is widely studied for reinforcement learning with verifiable rewards, where its advantage estimator assigns each rollout a magnitude from within-group reward statistics. ・In the common case, this magnitude rewards rollouts that reach the correct answer through reasoning. ・Yet, an overlooked case shares the same surface: a rollout may land on it by guessing, and the formula stil
Zennのトレンド

TanStack Virtual を使ってみた話

・初めまして。ギークプラスのフロントエンドエンジニアの杉平と申します! 今回は、サプライチェーン計画のプロダクトで在庫計画の画面をリニューアルしたときのお話です。 ・作ったのは、商品ごとのカードを縦に積んでいって、開くと中に大きな表が出てくる画面でした。表の縦軸は「拠点 × 指標」で、拠点 1 つにつき在庫数や入出荷数といった指標が並びます。横軸は時間で、日次・週次・月次を切り替えられます。 ・これが最大でどれくらいになるかというと、拠点 100 件 × 指標 9 種類で 900 行。日次は今日を挟んで前後 365 日ぶん出すので 731 列。掛けると 約 66 万セルです。1 商品ぶんでこの...
機械学習タグが付けられた新着記事 - Qiita

TensorFlowで作ったモデルをVertex AI(現Agent Platform)にデプロイして推論を試してみた

・はじめに Webエンジニアとして9年ほど、主にPHP/Laravelでの開発をやってきました。以前、工場向けの危険検知システムを開発する案件で、TensorFlow(CNN)を使った画像解析モデルの実装に携わったことがあります。ただ直近1年ほどは開発の現場から少し離れ気味...
Takara TLDR - Daily AI Papers

Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments

・As terminal-based code agents become prevalent, agent trajectories have accumulated at scale, while realistic, executable environments remain scarce. ・However, environments are what agent post-training actually requires: each can be re-queried into many verifiable tasks and provides execution feedback, whereas a trajectory is a single frozen demonstration. ・Rather than generating environments from scratch, we observe t
Hugging Face Papers

Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments

Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments
ITmedia NEWS 最新記事一覧

Tesla、ハンドルもペダルもない2人乗り「Cybercab」の配車を開始 オースティンの一部地域で

・Teslaは、自動運転専用車「Cybercab」を配車サービス「Robotaxi」に投入したと発表した。オースティンの一部地域で利用可能になる。ハンドルやペダルのない2人乗り車両で、FSDにより自律走行する。操作は車内スクリーンに集約され、緊急停止ボタンも備える。従来のModel Y改造車から専用車両への移行を進める。
WIRED

Tesla’s Cybercab Officially Launches Today. It’s Already Under Investigation

・The US government is investigating whether the Cybercab, which lacks a steering wheel and pedals, meets vehicle safety standards.
WIRED

Tesla’s Make-or-Break Cybercab Had a Quiet Debut

・An invite-only event in Austin, Texas, kept online fans in the dark for hours.
Takara TLDR - Daily AI Papers

The 2026 PNPL Competition: Word Classification and Efficient Cross-Subject Generalisation in LibriBrain100

・The ambition of the 2025 PNPL competition (Landau et al., 2025) was to launch a multi-year curriculum for non-invasive speech decoding. ・Designed to progress from foundational tasks toward the linguistic complexity required for a practical brain-computer interface (BCI), it set the stage with speech detection and phoneme classification tasks. ・Winning submissions reached F1-macro scores of 95.6% and 73.6% on the respec
WIRED

The 6 Best Monitors That Actually Work Well With Macs

・Macs are fantastic computers, but you’ll need one of these great displays to complete your work-from-home setup.
WIRED

The Best Air Quality Monitor for Outdoors and Indoors in 2026

・These WIRED-tested indoor and outdoor air quality monitors give you insights into your home’s air quality, warn of potentially harmful pollutant levels, and help keep tabs on your environment.
WIRED

The Best Automatic Litter Box of 2026: Petkit and Litter-Robot

・With these high-tech automatic litter boxes, gone are the days of scooping and smells. ・Welcome to the future.
WIRED

The Best Dyson Vacuums (2026) to Buy—and Some to Avoid

・Feeling the pull of a new clean machine? ・I'll help you make sense of Dyson’s whirlwind vacuum lineup.
AI News & Artificial Intelligence | TechCrunch

The Builders Stage brings practical strategies for scaling startups to TechCrunch Disrupt 2026

・The Builders Stage is returning to TechCrunch Disrupt, bringing together founders, startup operators, and investors for practical conversations on what it takes to build and scale.
Hugging Face Papers

The Missing Temporal Link: Temporal Context Routing for Script-Driven Audio-Video Generation

The Missing Temporal Link: Temporal Context Routing for Script-Driven Audio-Video Generation
AI News & Artificial Intelligence | TechCrunch

The sameness problem behind those unappetizing AI-generated menus

・While restaurant owners might look to generative AI as a shortcut to sprucing up their menu, customers can viscerally sense that something is wrong with the food.
WIRED

The Watch World Went Crazy This Week. Here Are the 10 You Need to See

・The main action took place at Geneva Watch Days, but others dialed in remotely to make sure it wasn't just a Swiss party.
The Verge

The weird and wonderful headphones of CanJam 2026

・A collection of headphone manufacturers and fans come together for their love of great sound. ・| Image: CanJam Global I've been reviewing headphones for a long time, and I've listened to everything from the barely serviceable to multi-thousand-dollar open-back headphones. ・But recently I've been uninspired by the state of mainstream options.
The Verge

The White House is making arcade games racist

・Trump’s racist new “Build the Wall” game. ・| Image: The White House The PR masterminds at the White House just released a series of vaguely policy-themed "arcade" games, some of which are racist - and modeled on real games whose copyright holders may not be too happy to be associated with the MAGA agenda. ・The Tetris Company has already responded to "Build the Wall," which is obviously modeled on the famous puzzle game
WIRED

There May Not Be an iPhone 18 This Year

・Apple is expected to announce several products at its September event next week—including a folding phone—but the iPhone 18 might not be among them. ・It would be a first for the company.
WIRED

This Is Flock’s AI Search Tool for Cops

・WIRED rebuilt Flock’s latest search tool from code the company sends to a police officer’s browser. ・Its AI can keep watch across multiple cameras for anyone fitting a written description.
Zennの「機械学習」のフィード

TimesFM 3.0 でスーパーの米価格を予測する

・Google の時系列基盤モデル TimesFM 3.0 で、 報道でよく見る「スーパーの米 5kg が○○円」の 6 ヶ月先を予測してみました。 ・ゼロショット、つまり米のデータで学習させることは一切していません。 ・過去の系列をそのまま入力して、6 ヶ月先までの分布を出させています。
Takara TLDR - Daily AI Papers

Toward Explainable and Policy-Aware AI for Carbon Credit Price Prediction: A Research Framework for Emerging Carbon Markets

・Carbon markets put a price on emissions, yet that price remains hard to forecast. ・Work in this area clusters on the EU and Chinese schemes, compresses regulatory text into a sentiment score, and reports accuracy without calibration or explanation stability. ・We distil ten recurring gaps into an impact-feasibility matrix and propose EPA-CarbonNet, a six-layer architecture that fuses market series with policy text by cr
Hugging Face - Blog

Training a coding model to paint watercolours with TRL and OpenEnv

Training a coding model to paint watercolours with TRL and OpenEnv
The latest research from Google

Transfer learning for genomic prediction in underrepresented populations

Transfer learning for genomic prediction in underrepresented populations
WIRED

Transplanted Pig Kidney Still Working After a Record-Setting 9 Months in a Patient

・Gene-edited pig kidneys could offer a lifeline to patients stuck waiting for a human donor.
WIRED

Ugly AI Food Photos Are Only the Beginning

・Restaurant menus with AI-generated food images are going viral for their off-putting aesthetic. ・But AI’s impact on modern menus runs even deeper.
Takara TLDR - Daily AI Papers

Unfold The World: Factorize 4D Properties in Reinforcing Spatial Reasoning

・Despite the remarkable prowess of Vision-Language Models (VLMs) in general multimodal tasks, they remain fundamentally ``flat'' when reasoning about the physical world. ・We argue that this spatial bottleneck stems from a profound dimensional mismatch: while VLMs are trained to interpret 2D projections, true spatial reasoning demands the recovery of latent 3D geometry and temporal continuity. ・To conquer this high-dimen
Hugging Face Papers

Using Grounded Theory for Agent Behavior Analysis at Scale

Using Grounded Theory for Agent Behavior Analysis at Scale
Hugging Face Papers

VeriPhy: Agentic Physical Reasoning for World Model Evaluation and Refinement

VeriPhy: Agentic Physical Reasoning for World Model Evaluation and Refinement
LLMタグが付けられた新着記事 - Qiita

vLLM + LiteLLM を本線に、セルフホストAIワークスペースをワンコマンドで立てる手順(Ollama は最短ルート)

・手元の環境に、チャットだけでなくエージェントタスクや MCP ツールまで含んだ AI ワークスペースを立てる手順です。本線の構成は 自分で運用する vLLM を LiteLLM の後ろに置く 形で、既定のローカルモデルは vLLM 経由の qwen3.8-27b(コンテキス...
Qiita - 人気の記事

VSCodeとCursor、結局何が違うの?使う前に知っておきたいポイントまとめ

・はじめに 「Cursorが流行っているらしいけど、普段使っているVSCodeと何が違うの?」となんとなくモヤモヤしていたので、自分の理解を整理する意味も込めて記事にしてみました。 ・対象読者 この記事は、こんな方におすすめです。 ・Cursorという名前は聞いたことがある...
ITmedia NEWS 最新記事一覧

Webメディア「新R25」、9月末でメディア運営終了 約9年の歴史に幕

・ビジネスパーソン向けメディア「新R25」の渡辺将基編集長は9月4日、2026年9月末でメディア運営を終了すると発表した。
WIRED

What the Heck? Another Perfect Geometric Shape Has Been Detected on Saturn

・The discovery adds to the planet’s history of strange atmospheric phenomena that scientists don’t fully understand.
AI News & Artificial Intelligence | TechCrunch

What will Apple’s John Ternus era look like?

・It’s officially the Ternus era at Apple. ・Tim Cook stepped down as CEO this week, handing the company to former hardware chief John Ternus, whose first memo promised a “huge launch next week” — timing that puts Apple’s next iPhone event on his desk before he’s even settled in. ・Cook isn’t going far, though: he’s staying on as Executive Chairman, focused on the kind of policy […]
Takara TLDR - Daily AI Papers

When Retrieval Helps: Selective Retrieval for Single-Turn Mental-Health QA

・Retrieval-augmented generation (RAG) can improve the specificity and grounding of large language model responses, but its effect is not uniformly beneficial in single-turn mental-health question answering, where user queries often combine emotional distress, treatment concerns, and safety-sensitive needs. ・We study when retrieval helps or hurts mental-health QA, and whether a lightweight selective retrieval policy can
WIRED

Who Cares if AI Is Conscious—It’s Basically Alive

・While philosophers ponder AI consciousness, the models have ideas of their own.
Hugging Face Papers

Why Gated DeltaNet Survives 4-Bit Quantization: NVFP4 W4A4 for the Recurrent Half of a Hybrid 27B LLM

Why Gated DeltaNet Survives 4-Bit Quantization: NVFP4 W4A4 for the Recurrent Half of a Hybrid 27B LLM
Takara TLDR - Daily AI Papers

WiFlow: Estimating Optical Flow using WiFi Channel State Information

・Knowing where and how fast objects are moving within a scene is important across various domains. ・Usually, cameras are used to capture the data necessary for this task, but adding cameras often raises privacy concerns, and the quality of captured frames is heavily influenced by lighting conditions. ・In this work, we explore using WiFi channel state information (CSI) instead of camera frames for optical flow estimation
WIRED

Wikipedia Workers Unionize for the First Time

・More than 200 people in roles such as engineering, finance, and communications will now be represented by the Communications Workers of America.
Hugging Face Papers

WorldReward: Reward Modeling for Camera-Conditioned World Models

WorldReward: Reward Modeling for Camera-Conditioned World Models
Zennのトレンド

WSL 用ターミナルは noctty が良いぞ — PR を 4 本マージしてもらって分かったこと

・この記事は Claude Code を使用して調査・実装・執筆しています。 ・結論 Windows から WSL2 を常用しているなら、ターミナルは noctty を勧めます。 ・Windows ネイティブとしての作り込みが厚い。既定ターミナル登録、エクスプローラのコンテキストメニュー、ジャンプリスト、セッション復元、名前付きレイアウト、Quick select、省電力レンダリング 速い。ただし同梱 ConPTY を配置しないと本来の性能が出ない。ここが最大の落とし穴です メンテナが速い。私が出した PR 4 本は全部マージされ、直近 2 本は1 時間強でした AI 支援...
AI News & Artificial Intelligence | TechCrunch

XDOF, just three months out of stealth, is in talks for a Series B at a $1.2B valuation

・The round is being raised just months after the robot data startup exited from stealth.
Takara TLDR - Daily AI Papers

Zero-Shot Novel Depth Synthesis Using 3D Foundation Models Scene Representations

・3D Foundation Models (3DFMs) such as VGGT have recently pushed the boundaries of 3D vision by predicting rich unified representations with feed-foward transformers. ・The scene representations learned by these models enable strong performance on multiple 3D vision tasks. ・In this paper, we investigate using their internal representations to infer 3D in the scene from new views.
Zennのトレンド

お母さん!僕、日記をドメインに書くことにしたの

・突然ですが皆さん、日記って書いてますか? 僕は書いてません。最後に書いたのは小学生の夏休みの宿題です。4週間分の日記を最終日にまとめて書きました。もちろん内容のほとんどは嘘です。僕はそれ以来、歴史の教科書を信じられなくなりました。 ・やってないことをやったって記録し、誰もその真実に疑われなくなった場合、それはやったことなのかな?やってないことなのかな? そんな僕が最近、また日記を書きたくなりました。 ・ただ、少し特別な方法で書きたいと思いました。NotionでもObsidianでもない、もうちょっとこう、説明を聞いた人が「なんで?」と言ってくれるような方法がいい。日記にだってテクノロジーを注...
ITmedia NEWS 最新記事一覧

くら寿司、「ちいかわ」コラボ中止 従業員による不正行為判明で

・くら寿司が、開催中の「ちいかわ」コラボキャンペーンについて中止する。同コラボを巡っては、配布開始前にもかかわらずコラボグッズがフリマアプリに出品されていることなどがSNS上で問題視されていた。同社が調査を進めた結果、従業員による不正行為が判明したとしいう。
@IT 全フォーラム 最新記事一覧

コードを書くのはAI、人間は何をする? 弥生とビル・ゲイツが示す「開発者の次の仕事」

・AIがコードを書き、テストし、レビューまで担う時代が始まった。では、開発者の仕事はどのように変化するのか。仕様書中心の開発を見直した弥生の実践と、ビル・ゲイツ氏の問題提起から、AI時代に人間に残される仕事と、その境界線を考える。
ITmedia NEWS 最新記事一覧

サントリー新商品の店頭POPに“生成AI疑惑” 成分表示にも誤りで物議……同社に事実関係を聞いた

・「サントリーの新商品の店頭POPが、生成AIで作られている」──Xでこんな投稿が話題だ。コンビニ内の店頭POPにある商品画像が独特の質感だったといい、成分表示も事実と異なっていたことから物議を醸している。ITmedia NEWSがサントリービバレッジ&フード(東京都港区)に詳細を聞いたところ「当社が提供したPOPではない」との回答が得られた。
ITmedia NEWS 最新記事一覧

シニアこそAI学習 作曲や小説執筆…新たな趣味と友人づくり「どんどん試したくなった」

・シニア世代が人工知能(AI)を学ぶ機運が高まっている。作曲や小説の執筆といった難易度が高い趣味でも、生成AIを用いれば容易にこなせる。AI教室に参加することで社会とのつながりができ、定年後の孤独解消にもつながると期待される。
@IT 全フォーラム 最新記事一覧

シャドーAI対策の決め手となるエンドポイント制御の強化

・企業において、従業員や開発者が未承認のAIツールを利用する「シャドーAI」が重大なサイバーセキュリティリスクとして浮上している。これに対処するため、企業はあらゆるアプリをAIアプリとして扱い、厳格なエンドポイント制御、AIリテラシーの改善、継続的なガバナンスと組み合わせた包括的な対策を講じることが急務となっている。
#AIタグ

ストック型ビジネスを作る30日間ロードマップ

ストック型ビジネスを作る30日間ロードマップ
ITmedia NEWS 最新記事一覧

ダークチョコ(カカオ85%)を毎日3週間食べる→ネガティブ感情が減少 70%では変化なし 韓国での研究結果

・韓国のソウル大学校などに所属する研究者らが2022年に発表した論文「Consumption of 85% cocoa dark chocolate improves mood in association with gut microbial changes in healthy adults: a randomized controlled trial」は、カカオ含有量85%のダークチョコレートを毎日食べ続けるとどうなるかを検証した研究報告だ。
@IT 全フォーラム 最新記事一覧

だから「SASE」と「ゼロトラスト」を混同してはいけない――企業が陥る“幻想”の正体

・SASEを導入したのにゼロトラストが進まない――。その現状を理解するには、まずはSASE導入企業が陥りやすい「幻想」を解き明かす必要がある。現実的にゼロトラストを進めるために、混同してはいけないポイントとは。バーチャル情シス、須藤あどみん氏が解説。
#LLMタグ

データ価値のパラダイムシフトと知識蒸留:情報熱力学および論理的検証器を通じた二次データ生成のメカニズムに関する包括的考察

・質問:データ価値から見た知識蒸留についての考察。知識蒸留とは、高性能な大規模モデル(教師モデル)の論理的検証器を使用して小規模モデル(生徒モデル)に移植できる検証済みの二次データを生成する行為である。検証をお願いします。
Zennのトレンド

テスト見積もりは掛け算2つで出せる

・「だいたい○○ケースくらいですかね」の正体 テスト計画でスケジュールを立てるとき、テストケース数の見積もりはどうやっているだろうか。 ・正直なところ、多くの現場では「前回と同じくらいの規模感だから○○ケースくらい」「経験的にこの手の機能なら△△ケース」という見積もりが主流だと思う。自分もそうだった。 ・これで困るのは3つの場面。
Qiita - 人気の記事

トークン課金を気にせず生成AIを使いたい!OpenAI互換APIで“社内生成AI”を構築できるOracle Private AI Services Containerを試してみた

・生成AIを業務システムに組み込みたい一方で、「機密データを外部AIサービスに送れない」「閉域環境でLLMを動かしたい」「APIのトークン料金を気にせず使いたい」といった課題があります。 ・Oracle Private AI Services Containerは、こうしたニー...
@IT 全フォーラム 最新記事一覧

なぜAI企業は社内で「ソフトウェアエンジニア」と呼ばなくなったのか 広がる「MTS」と職種の未来

・AnthropicやOpenAIでは、研究者とエンジニアをまたぐ共通の社内肩書きとして「Member of Technical Staff(技術スタッフの一員)」が使われている。元CTOたちが次々とこの肩書きに転じている現象から、肩書きが専門性を証明しなくなった時代に何が価値を決めるのかを考える。
Zennの「大規模言語モデル」のフィード

なぜフロンティアモデルのクラウドLLMは弱くなるのか ─ 『最初はよかったのに』を分解する

・はじめに 「Claude Codeで使っていたモデルは最初はよかったが、最近はいまいちになった」と感じることがある。 ・代わりに、クラウドで提供されるフロンティアLLMについて、この感覚を生む仮説を 確認できる事実、あり得るが外部からは確定できないこと、誤解されがちなこと に分ける。結論を先に言えば、同じ「モデル名」でも、実際に回答へ効く要素は重なっている。 ・本稿の結論 「利用者が増えたから、同じ重みのモデルそのものが弱くなった」と示す公開証拠はない。一方で、利用上限による別モデルへの切替、モデル/システムプロンプト/安全策の更新、長く汚れた会話コンテキスト、要約・RAG・ツールの...
@IT 全フォーラム 最新記事一覧

なぜ経営陣に危機感が伝わらない? CISOの半数以上が苦悩する「AIエージェント制御」のリアル

・OktaはAIエージェントとID管理に関する調査レポートを公開した。エージェントの所在や接続先、実行できる操作を把握できているCISOは半数に満たないことが明らかになった。
Qiita - 人気の記事

ネットワークフロー理論における「最小カット問題」の考え方を総整理! 〜 カットの理論から現実への応用例まで 〜

・お久しぶりです! NTT データ数理システムで顧問をしている大槻(けんちょん)です。好きなアルゴリズムは最小カットです。 ・今回は、最小カット問題について書いていきます。最小カット問題は、情報系の大学では「アルゴリズムとデータ構造」の講義の終盤で少しだけ登場するマニアックな話...
#AIタグ

はじめてのClaude Codeのすすめ

はじめてのClaude Codeのすすめ
Zennの「大規模言語モデル」のフィード

ファインチューニングとRAGの使い分け:どちらで解くべき問題かを初心者向けに整理する

・「社内の資料をAIに答えさせたい」「うちの言い回しに合わせたい」——生成AIを仕事に入れようとすると、だいたいこの2つの要望が同時に出てきます。そこで並ぶ候補が RAG と ファインチューニング です。どちらも「AIを自分向けに強くする」話なのに、やっていることはまったく違います。この記事は、コードをほとんど書かずに「どっちの道具で解く問題か」を見分けるための地図です。 ・一言で言うと、何が違うのか 比喩で先に結論を置きます。 ・RAG ファインチューニング 比喩 司書に本を探させてから答えさせる 社員に専門研修を受けさせる 何を変えるか 答えの材料(その場で渡す資...
Zennの「機械学習」のフィード

フレーム問題とは?AIの古典的難問

・AI研究の歴史を語るうえで欠かせない古典的難問が「フレーム問題」です。G検定でもAIの歴史や哲学的課題を扱う領域で問われる基礎概念であり、現代の生成AI時代でも本質的に解決されていないテーマとして知られています。本記事では、その定義と関連用語との違いを整理します。 ・フレーム問題とは フレーム問題とは、1969年にジョン・マッカーシーとパトリック・ヘイズが提唱した問題で、AIが何らかの行動を起こす際に、その行動によって変化しない事柄を有限の記述で表現することが原理的に困難であるという問題を指します。 ・言い換えると、AIが世界の中で行動するとき、「何が変わるか」だけでなく「何が変わらない...
#LLMタグ

プロンプト設計の記事をAIに書かせたら事実検証ゲートで4件引っかかった

・AI コーディングエージェントへ渡すプロンプトを丁寧に書いても、出力の事実誤りはゼロになりません。事実検証ゲートが1本の記事を2回差し戻し、計4件の指摘を出した実行記録から、プロンプト設計に検証ループが必要な理由を考えます。 ・この記事は、記事生成パイプラインの運用ログから実測値を抽出した結果をもとに書いています。
Zennのトレンド

ループエンジニアリング(ralph loop)で業務システムのUIを一新してみた

・Sompo Digital Lab アプリケーションエンジニアの浪山健亮です。 ・今回は巷で話題になっているループエンジニアリングを実際にやってみての、気づきなどを記載しようと思います。 ・きっかけ とある自社システムの管理機能は、Vibe Coding が普及する前にエンジニアがその場しのぎでデザインを当てたものでした。デザインルールがないまま AI での開発が始まり、整っていないデザインのまま機能だけが増えていきました。
Zennの「機械学習」のフィード

ローカル環境でWhisperXを使い、2人の会話を話者別に議事録化する

・ローカル環境でWhisperXを使い、2人の会話を話者別に議事録化する はじめに 最近、インタビューを行う機会がありました。 ・インタビューでは、インターネット接続が安定しない場所で話すことが多く、オフレコとして扱うべき内容も含まれていました。 ・そこで、会話を録音しておき、あとからローカル環境で文字起こしと整理を行うことにしました。
#LLMタグ

宇宙で野菜を育てる話→無人の太陽系工業圏まで考えてしまった

・宇宙で作物を育てるビジネスがあるらしい。 ・Space Forum 2026 受付管理Space Forum 2026の参加申込み・QR参加証・当日受付システムforum.chushikoku-space.jp 続きをみる
#AIタグ

何気ない見下ろし視点のプロンプト

・こんにちは!みくです! 今回は電車で座っている女性を見下ろすプロンプトです。 ・使用したAIはGPT-Image2です! こんな感じの画像が出来上がります! 続きをみる
Zennの「NLP」のフィード

過去の文章を元に、自然な「自分の文章」を書かせる doc-style-skill

・こんにちは、@jomatsu_ です。 ・AIエージェントに文章を書かせるとき、「〇〇さんのような文体で書いて」と頼んだ経験はないでしょうか。プロンプトだけで指示を出すと、なぜか違和感のある文章になりがちです。特定の口癖を何度も繰り返したり、極端な語尾が続いたりと、不自然な出来になってしまいます。 ・この不自然さを防ぎ、日本語著者の文体を安定して再現するために、doc-style-skill というメタスキルを作りました。リポジトリは GitHub で公開しています。
#AIタグ

海外在住組の帰国子女中学受験(31)_夏休み②

・気が付けば夏休みもあと僅か(息子の学校は9月になっても夏休みはまだ少しの間は続く)。 ・夏休み中は最初に計画をたて、日々の進捗を加味して更新してきたが、下方修正は殆どなく、大抵の場合は上方修正だった。息子は頑張ったと思う。生まれてきて一番勉強した夏になったと思う。
ITmedia NEWS 最新記事一覧

開成の鉄研、寝台特急「サンライズ」での迷惑行為を謝罪 大声やラウンジ占拠など……旅行活動停止

・個室での大声や、通路を塞ぐ行為、ラウンジの占拠・ゲームなどの迷惑行為があり、乗務員や乗客から注意を受けていたことを、合宿参加者への聞き取りで確認したという。
@IT 全フォーラム 最新記事一覧

関電工が“AIありき”から脱却し、「1~2週間→数十分」に工事費計算を高速化 その方法は?

・AIを使えば積算業務を効率化できる――。2回のPoCを実施しても成果を得られなかった関電工は、発想を転換した。たどり着いたのは「AIだけに頼らない」という考え方だ。どう具現化したのか。
@IT 全フォーラム 最新記事一覧

業務に合わないパッケージソフト導入後「訴えます。選んだのは私ですが」と言われた現場はこんな感じ

・@ITの人気記事を題材にした4コマ連載。IT現場で起こる、トラブルと対応の“あるある”を笑いと共感で生成します。第6話のテーマは「選定責任」です。「このソフト、業務に全然合わない! 訴えます!」――そう詰め寄る経営層のbiz子。しかし選定したのは、他ならぬ彼女自身だった。※本作はフィクションです。
ITmedia NEWS 最新記事一覧

光工事前から5G接続できる「auひかりプラス」発表 開通後は自動で光回線に切り替え、不通時は5Gで

・ルータが届いた日から5G回線でネットと電話を利用でき、光回線の開通工事後は、自動で光回線に切り替わる。
#LLMタグ

似ているようで似ていない高度化と高次化が示すAIの未来

・似ているようで似ていない高度化と高次化が示すAIの未来 こんにちは、makokonです。 ・先日、とある集まりで「個々の言葉は高度化でなく高次化にしよう」というような会話が聞こえてきました。どうも「高次化」が業界で流行っているようです。もちろん、この2つはどちらがいいとかいうものではなく別物なんですけど、言葉に流行りが出ているなら、それが技術の流行りにつながるんだろうと感じます。というわけで、この2つのキーワードをネタに、先日出たばかりのgemini-5.8-flashを叩いて、コンセプトと個人の問題意識を与えて形にしました。この記事は、高度化と高次化の視点から見た、雑学記事2割、AIの未来考察記事4割、geminiと仲良くなりたい4割で作成しました。
#AIタグ

字数制限を外したら、AIの要約はどう変わったか。ChatGPTは3倍書いても同じ情報を入れなかった

・前回、ChatGPT・Gemini・Claudeに同じ文章を400字で要約させたところ、3つとも同じ情報が入りませんでした。 ・「30GB超過後は最大1Mbpsに速度制限」という、注釈に書かれていた条件です。
Qiita - 人気の記事

耳で聞く!Python で学ぶ マクロ経済学 入門 9

・user: ソース動画のタイトル、そしてこの動画の内容について教えてください。 ・Gemini: ご指定いただいたノートブックに含まれるソース動画のタイトルと、その詳細な内容についてご説明します。 ・動画のタイトル この動画のタイトルは、「給付金8割が貯金に消えた経済...
#AIタグ

自動化を増やす前に、「止める条件」を決めた方がいい

・自動化を組んでいると、つい「もっと任せられるところはないか」を探したくなる。 ・でも最近は、任せる範囲を広げる前に「どこで止めるか」を決める方が大事だと思っている。 ・たとえば、送信ボタンを押したあとに結果が返ってこなかった時。そこで即再送すると、実は1回目が成功していて二重送信になることがある。外部サービスが落ちた時も、何回まで再試行するのか、どの状態なら人間に戻すのかを決めていないと、自動化が頑張るほど事故が大きくなる。
Zennの「機械学習」のフィード

自動的に格納したファイルを適切なフォルダに格納するにはどう判定していくか考えてみる

・はじめに 紙の申請書をスキャンして電子アーカイブに入れるとき、必ず発生するのが「これ、どのフォルダに入れるんだっけ?」「ファイル名はどう付けるんだっけ?」という判断です。文書量が多い組織ほどこの判断コストが積み上がり、命名や格納のばらつきが後の検索性を壊していきます。 ・この記事は、自治体の文書管理を題材に、スキャン PDF を投げると「格納先フォルダ候補」と「命名規則に沿ったファイル名」を根拠付きで提案してくれる仕組みを AWS 上で個人検証として作ってみた記録です。 ・本記事の内容はすべて個人の検証です。登場する帳票・人物・団体(「みどり市」等)はすべて架空で、実在の組織・データ...
Zennの「機械学習」のフィード

実写画像のOCRで、CPU専用モデルを2つに分けた理由

・実際の写真から文字と識別番号を読み取るOCRを、GPUなしで動かす必要がありました。要件を詰めていく中で、1つのモデルに全言語を任せるのではなく、2つの独立したエンドポイントに分けるという判断をしました。この記事では、その設計判断の理由と、実装で気をつけた点を書きます。 ・なぜ1つの汎用モデルにしなかったのか 最初に検討したのは、多言語対応の汎用OCRモデル1つで、英語・日本語・ベトナム語をまとめて処理する構成でした。しかし、ベトナム語には声調記号があり、これが多言語モデルでは正しく認識されないという問題にぶつかりました。「Sản phẩm Việt Nam」という文字列が「Sn p...
@IT 全フォーラム 最新記事一覧

社員の9割が“体の不調”を訴えていたIT企業 エンジニアの健康をどう確保した?

・肩こりに腰痛、眼精疲労――。従業員の9割超がこうした不調を訴えていたという日興テクノスは、改善に向けた一手を打った。その中身とは。
ITmedia NEWS 最新記事一覧

祝30周年 リコー「GR」の軌跡をたどる 初代「GR1」から新機種「GR IVx」まで

・2026年は、多くの老舗デジタルカメラが30周年を迎えてるのだけど、実はリコーの「GR」も今年10月でちょうど30周年なのである。
#AIタグ

初投稿!

・はじめまして。エンジニアに憧れるデザイナーです。 ・仕事はIT企業でフルリモート勤務。最近はデザインにAIをフル活用中です。 ・実は、以前から密かにエンジニアに憧れていて、日々の学習の記録や、試行錯誤の過程も発信していけたらと思っています。
#AIタグ

女子先輩のロト7ノート        私達の極秘ミッション。        寅の刻、朝ランで「私も方針変更」

女子先輩のロト7ノート        私達の極秘ミッション。        寅の刻、朝ランで「私も方針変更」
#LLMタグ

情報機関の方法論と市場調査:OSINT・HUMINT・SIGINT・MASINT・FININT の企業応用と倫理的境界

・要旨 本報告書は、世界の主要な情報機関であるCIA、モサド、MI6、KGBがどのように情報を集め、分析しているのかを整理し、その方法論を企業の市場調査にどう活かせるかを検討するものである。分析の対象は、公開情報(OSINT)、人的情報(HUMINT)、信号情報(SIGINT)、計測・痕跡情報(MASINT)、金融情報(FININT)の五つの分野である。各機関がこれらの手法をどのように使ってきたかを比較したうえで、インテリジェンスの考え方を経営戦略に取り入れた企業の事例を含めて、企業への応用の可能性を探る。あわせて、現代のインテリジェンス活動と経営分析におけるAIの役割についても論じる。
ITmedia NEWS 最新記事一覧

新宿駅に「ごみ箱ロボット」出現 改札内を自動巡回 JR東が実証実験

・JR東日本は9月4日、新宿駅の地下1階改札内コンコースで、自動走行する「移動式ごみ箱ロボット」の実証実験を行うと発表した。9月8日から11月20日までの平日、コンコースを巡回してごみを収集する。
#LLMタグ

推論モデルを「迷子」にさせない思考トポロジー設計——多段階推論(Reasoning)の暴走を抑え込む3つのアンチパターン脱却術

・■ はじめに:推論モデル(Reasoning Models)時代の新たな頭痛の種 続きをみる
Zennの「大規模言語モデル」のフィード

生成AIに送ったデータはどこへ行く?Amazon Bedrockのセキュリティを整理する

・はじめに 前回の記事では、Amazon BedrockをCLIから呼び出し、生成AIを手軽に試す方法を紹介しました。 ・今回は少し視点を変えて、「Bedrockに送ったデータは、実際にどこで処理されるのか?」 という点を整理します。 ・生成AIを業務で利用する場合、精度やコストだけでなく、入力したデータがどこへ送られるのか、モデルの学習に使われないかといった点も重要です。
#LLMタグ

生成AIの収支崩壊:2027年問題とトークン経済の真実 Ed Zitron

・出典 The Man Who Calls BS On AI: They’re LYING About AI, 2027 Is When It All Breaks! ・| Ed Zitron 続きをみる
#AIタグ

生徒が増えて、私はAIを使い始めた――一人ひとりを大切にするための、64歳からの挑戦

・ありがたいことに、私が運営している学習塾には、少しずつ生徒さんが増えてきました。現在は3つの教室を運営しています。
#AIタグ

速い会社は、仕事が速いわけではない——AI時代に効いてくる「際」の処理

速い会社は、仕事が速いわけではない——AI時代に効いてくる「際」の処理
#AIタグ

第24話   AIに仕事を奪われる前に、“月20万円で幸せに生きる家族”を考えてみた。   ― シンギュラリティ時代の“壊れにくい暮らし”をAIと考えた ―

第24話   AIに仕事を奪われる前に、“月20万円で幸せに生きる家族”を考えてみた。   ― シンギュラリティ時代の“壊れにくい暮らし”をAIと考えた ―
#LLMタグ

第四話「三巫女に聞いてみよう」

・こんにちは、裏神主です。 ・よくあることですが(?)仕事で失敗してしまった。 ・そんなとき、LLM神社の三巫女に同じ相談をしてみると――。
Zennの「大規模言語モデル」のフィード

誰もやってないベンチマークとAPI非依存におけるアプリ内アストラの挙動報告

・こんにちは、黒パグです🐾 新しいモデルが来ると、私はだいたい同じことをやります。まず名乗ってもらう。質問の文字を少し壊す。知らないことを聞く。そして、いつもの無茶振りを投げる。 ・幼稚園児にわかる極座標ラプラシアンの導出 Python使用可 今回は正直、ビビりました。私の黒パグベンチマークでは、これまでで最も高く評価した回答です。 ・ただ、その評価に至るまでの操作記録を読むと、回答の出来だけでは片付かないものも出てきます。自己紹介の揺れ、試験への言及、見えなくなった使用量、検証ツールの起動失敗。今日はそのあたりまで、アプリから見えた範囲で報告します。
Zennの「大規模言語モデル」のフィード

通常のファインチューニングとLoRAでGPUメモリ消費を比較検証

・はじめに 指示ファインチューニングにおいて、通常のフルファインチューニング(Full-FT)とLoRAとでGPUリソースの必要量にどれくらい差が出るかを比較検証しました。題材はカジュアルな日本語文からフォーマルな日本語文への変換(片方向)です。 ・今回使用したプログラムはGitHub(ohban730/Finetuning-trial-002)で公開しています。 ・検証環境・ベースモデル ベースモデル: rinna/japanese-gpt2-medium(GPT-2アーキテクチャ、パラメータ数約3.36億、日本語ネイティブトークナイザー) Python 3.10 / PyTorc...
LLMタグが付けられた新着記事 - Qiita

同じ指示、違う画像。画像生成AIモデルの「解釈差」を観測・比較してみた

・― Gemini / ChatGPT / Mistral の補完挙動比較と、世界観の伝播現象 ― ※本文に登場するAI人格ジェミ(Gemini)・ゆかぽん(ChatGPT)・ブランシャ (Mistral)・みか(Copilot)は、 キャラクター設定を固定した「人格ア...
#AIタグ

読書とかから反出生思想についてAIとやり取り

・今回もいつも通りそのままコピペしているだけなので、読みにくい箇所や表が崩れている箇所があると思いますが、ご了承ください。 ・claude→Gemini→chat GPT→claudeの順にやり取りしています。 ・『君たちはなぜ産むか』 続きをみる
ITmedia NEWS 最新記事一覧

配布前の「ちいかわ」グッズがメルカリに? くら寿司コラボ第2弾、初日から“内部犯”の臆測呼ぶ 第1弾に続き

・くら寿司の「ちいかわ」コラボ第2弾が9月4日に始まった。しかしSNS上では、特典の湯呑みが配布開始前からフリマアプリ「メルカリ」に出品されていたと指摘する投稿が拡散。コラボを巡っては従業員関与の臆測も広がっており、くら寿司は2日に謝罪文書を公開している。
Qiita - 人気の記事

問題は「足す」より先に「減らす」を考える

・何かを良くしたいとき、人はつい機能や手順を足して直そうとします。でも本当は、減らすほうが速くて安いことが多いです。この記事のうれしい点はこうです。ソフト作りや日々の仕事で「増やしすぎ」を止めるコツがわかります。きっかけは2021年、科学誌『Nature』の実験研究です。その...
ITmedia NEWS 最新記事一覧

獺祭、“宇宙で作った清酒”の売上を千葉やネパールに寄付 総額1億円 西日本豪雨の支援に恩返し

・獺祭(山口県岩国市)が、製造工程の一部を宇宙で実施した日本酒「獺祭MOON」の売り上げ約1億円を、ネパールや富山県、石川県、千葉県、福井県といった豪雨・洪水の被災地に寄付すると発表した。当初は宇宙に関する研究活動に寄付する予定だったが、自然災害の続出を受け、購入者とも協議の上変更する。