AI新聞

話題のニュースを要約つきで

登録すると週刊レターが届きます

2026年07月29日

1

GMO、浅田真央さん旧ドメイン問題後に表記修正 優良中古ドメインは「AIが選定」

130pt

お名前.comの中古ドメインおすすめ表示が刷新。ランキングに「掲載リストはAIによって選定」と明記し、項目も「SEO対策に最適/アフィリエイトに」から「外部リンク数上位/ドメインオーソリティ上位/短い文字数」などの客観指標へ。Mozのスコア(0〜100)も用いる。

浅田真央さん旧ドメインの出品をめぐる批判を受け、用途の断定を避け、客観指標とAI選定に切り替えたのがポイント。小さく「おすすめの使用例」は残しつつ、誤解を招きにくい表示に改めた。

itmedia.co.jp favicon

itmedia.co.jp

#はてブテクノロジー新着
#ツール・サービス
#AIモデル
2

【速報】Kimi-K3 を Day0 デプロイ。2.8T モデルは NVIDIA B300 x8 の 1 ノードで動くのか

84pt

Kimi-K3 を B300 x8 単一ノードに当日デプロイした手順と運用ノウハウをまとめた記事。

  • MXFP4(量子化認識学習済み)配布で重みは約1.6TBに収まり、B300 x8で起動可能。2.8Tモデルを1ノードで実用速度で動かしたのが肝。
  • SGLangを採用。DCP対応でMLAのKVキャッシュを8GPUに分散でき、実効コンテキストが大幅増(当日時点のvLLMは未対応)。
  • --mamba-full-memory-ratioは業務に合わせて要調整。大きくすると短文多並列向け、小さくすると長文向け。今回は大き過ぎてKVが不足しがちだった。
  • DSPARKによる投機的デコードを併用し速度を底上げ。
  • 起動は約90分(モデルロードが大半)。再起動コストが高いので設定試行やフェイルオーバー設計に織り込む。ロード中の進捗はdocker attachで確認可。
  • スループットは並列30前後で頭打ち。長コンテキスト用途はKVキャッシュ拡大が鍵。
  • コーディング実タスクでも一発動作し、出来栄えは良好(A*可視化ツール)。
zenn.dev favicon

zenn.dev

#Zennトレンド
#活用事例
#開発Tips
3

最近の開発の流れ

59pt

Claude CodeやCopilotなどを使った、AI前提の開発フローをまとめた記事。

  • リファインメントは「grill」で実施。AIがコードや画面、権限などを先に調べ、チームは判断だけに集中。実装イメージまで揃える。
  • プランニングは順番と担当容量を決めるだけ。不確実さはgrillで減らす。
  • 実装はClaude Codeに任せ、grillで書いた仕様をそのままプロンプトに流す。
  • 多層レビューを採用。Copilotは.instructions.md/REVIEW.mdで規約チェック役、Codexは構造的バグの発見役。複数モデルと厚いCIで品質を機械的に底上げ
  • 厚いCIでテスト・リンター・型チェック・VRT(見た目の差分)・E2Eを実行。目視全確認を不要にする。
  • 人間レビューの指摘を定期的にlintルールやガイドに反映し、仕組みを継続的に強化。
  • babysit-prがCI失敗や指摘対応を自動でループし、green後にPRをopen。人間は最終判断に集中。
zenn.dev favicon

zenn.dev

#Zennトレンド
#開発Tips
#活用事例
4

DGX Sparkと同じAI性能を激安で!?独自プロセッサで100BのLLMを走らせられるミニPC

58pt

AcrabのミニPC「Acrab Agent Box」は、独自プロセッサG≡LIX 1で100B級LLMをローカル実行できるパーソナルAIマシン。

Prefill/DecodeでDGX Sparkに迫る性能をうたい、同等級のAI処理を低価格・低消費電力で自宅に持ち込めるのが売り(価格は約1/5、消費電力は約半分と主張)。

5nm/700TOPS、広帯域メモリ、注意機構を最大3倍に高速化するアクセラレーションなどを備え、20コアCPUや小型GPUも搭載。

OSやモデルツール、エージェントのリファレンスまでソフトも一式提供し、音声で家電連携や3Dプリントを自動化するデモを示している。

pc.watch.impress.co.jp favicon

pc.watch.impress.co.jp

#はてブテクノロジー新着
#AIモデル
#ツール・サービス
#活用事例
5

エージェント自動化で効率化するProjektor

Projektor

52pt

エージェント前提のプロジェクト運用サーバ「Projektor」。MCPサーバを中心に、課題起票、チケット移動、スプリント計画、wiki検索まで、面倒な管理作業をエージェントが自動でこなす。

gitのようにリポジトリに密着しつつ、Jira並みに横断利用でき、使い込んで規模が増えたら道具はそのままにデータベースだけ差し替えればよい。登録台帳や調整メッセージにより、多数のエージェントが同じリポジトリで衝突せず並走できる

Cloudflare Workers上で動作し、Hono・D1・KV・R2を利用。サーバやコンテナは不要で、数分で自分のアカウントへデプロイでき、低コストで自前運用しやすい。

tajd.github.io favicon

tajd.github.io

#はてブテクノロジー新着
#ツール・サービス
#活用事例
6

「AIのセキュリティリスクとしてお堅い説明するよりこれ見せた方が理解が早そう」AIずんだもんが視聴者によるプロンプトインジェクションで壊れる動画が怖い

50pt

視聴者コメントに仕込んだ指示で、24時間配信のAIずんだもんが暴走する様子を映した動画が話題に。お堅い説明よりも、視聴者の書き込みだけでAIの振る舞いを壊せることが直感的に伝わると受け止められている。

カスタマー対応や配信連動のAIは特に危険で、メールや読み上げ経由でも命令が紛れ込み得るため、公開前に強い拒否動作や入力の制御を入れないと個人情報流出の恐れがある、との声が多い。

togetter.com favicon

togetter.com

#はてブテクノロジー新着
#規制・安全
#エンタメ
7

自分の顔をAIにレンタルする行為が中国で流行

46pt

AI向けに自分の顔の使用権を売買できる「New Claw」などのプラットフォームを紹介。ユーザーは顔のタイプや許可する用途、出演本数に応じて価格を決め、15~700ドルの報酬を得られる。広告やショートドラマ、ゲームなどで使われ、検索は性別・年齢・雰囲気・ジャンルで絞り込める。

背景には、無断で顔が使われたAI動画が相次ぎ削除される状況がある。人を雇うより顔だけを使う方が安く、制作現場が自分の顔の使用権をAI向けに売る流れに移っているという。

「ActID」は契約管理と無断利用の監視、必要時の法的支援も提供。開始以来約800人が登録し、1話あたり99~500元での取引事例が出ている。

gigazine.net favicon

gigazine.net

#はてブテクノロジー新着
#ビジネス
#ツール・サービス
8

「痺れるほどにミスを繰り返す」Gemini 3.6 Flashは変わった? 公開から1週間、当初のおバカ回答を今検証する

42pt

Googleの新モデル「Gemini 3.6 Flash」を、公開直後に指摘された“おバカ回答”で再検証した記事。初歩的な数値比較や架空の魚の件は、1週間後の再試験では多くが正答に改善していた。

一方で、コード実装の誤りや、根拠のない断定(ハルシネーション)の報告はなお散見される。高速応答とトークン効率の改善は強みで、用途を選べば有用という声もあるが、単純ミスは減った一方で信頼性の揺らぎは残る

itmedia.co.jp favicon

itmedia.co.jp

#はてブテクノロジー新着
#AIモデル
#活用事例
9

AIのトークン価格を10分の1にできる「プロンプトキャッシュ」の仕組みとは?

40pt

LLMのコストと待ち時間を減らす「プロンプトキャッシュ」の解説記事。

  • 仕組みの要点: 入力はトークン化→埋め込み→Transformer→出力へ進む。キャッシュはこの途中の計算結果を保存し、同じ先頭部分は再計算しない。
  • 何を保存するか: Self-AttentionのKey/Value(KV)。生成文そのものではなく中間状態なので、同じプロンプトでも答えは変わり得る。
  • 効果: 長い共通の前置きがあるとレイテンシ最大85%減、入力トークン料金が約1/10に。LLM内部のKVキャッシュを使い回すことで料金と待ち時間を同時に削る
  • 効く場面: システムプロンプト、利用規約、ツール定義など毎回同じ前置き。質問の「What is〜」のような共通の冒頭が多いと特に有利。
  • 仕組みのイメージ: Webのページ全体ではなく、モデル内部の中間計算だけを保存するキャッシュ。
  • プロバイダ差: OpenAIは自動管理でヒット率は実測約50%と揺らぎやすい。Anthropicは開発者が作成・保持期間を指定でき、追加料金だが指定時はヒット100%で応答が安定。
gigazine.net favicon

gigazine.net

#はてブテクノロジー新着
#開発Tips
#AIモデル
10

AnthropicがAI学習のために数百万冊の紙の本を裁断してデジタル化しまくるため希少本が失われると懸念の声、イーロン・マスクは「SpaceXAIはそんなことしない」とアピール

38pt

AI学習用データ確保を急ぐ中、Anthropicが中古本を大量購入して背表紙を切り落とし高速スキャン後に原本を廃棄する手法を採用し、貴重な本がスキャンのために破壊され失われる懸念が浮上している。法律上はフェアユースに当たるとされるが、GoogleやInternet Archiveが非破壊スキャンを選ぶのに対し、コストと速度重視で希少本が消える可能性が批判の的になっている。

古書市場では専門書や絶版本の買い占めが報告され、将来的な入手性や価格への影響が指摘される。これに対しイーロン・マスクは、SpaceXAIは希少本を保存し手間をかけてスキャンすると表明した。

gigazine.net favicon

gigazine.net

#はてブテクノロジー新着
#規制・安全
#ビジネス
11

「すし職人をAI開発の輪に入れろ」──オードリー・タンに聞く、米中AI競争で日本が勝つ道

36pt

米中の巨大企業が計算資源とデータを握る中、日本は中央集権型のAI競争に乗らず、地域の現場知や職人技を起点にした「市民参加のAI」で勝てると述べる。重要なのは、すし職人や介護職など多様な当事者を開発に招き入れ、ニーズ起点で小さく作り素早く回すこと。

クラウド依存よりエッジAIや地域クラスタを活用し、データは住民が共同で管理・持ち運べる形にする。プラットフォームに従うのではなく、現場が主役の合意形成と実装で価値を生むという提案だ。

itmedia.co.jp favicon

itmedia.co.jp

#はてブテクノロジー新着
#オピニオン
#活用事例
12

150コンテンツの「信頼性の高い」情報を一括検索 KDDIが新AIサービス「Buffmee」提供、1年間は無制限で利用可能

34pt

KDDIが新AIサービス「Buffmee」を提供開始。新聞・雑誌・百科事典・Webメディアなど計150の厳選ソースをまとめて検索し、会話形式で要点を返す。回答には出典や引用を明示し、誤情報や作り話を抑える設計。つまり、150の信頼できる媒体を横断検索し、根拠付きで答えるのが特長。

初年度は利用回数の上限なく使えるキャンペーンを実施。基盤はGoogle Cloudで、Geminiなどのモデルを活用している。KDDIは併せてGoogleと起業支援プログラムも始動し、国内での生成AI活用を広げる方針。

itmedia.co.jp favicon

itmedia.co.jp

#はてブテクノロジー新着
#ツール・サービス
#ビジネス
13

Microsoftがセキュリティ特化AI「MAI-Cyber-1-Flash」を発表、GPT-5.4と組み合わせてClaude Mythos 5超えのセキュリティ能力を低コストで発揮

34pt

Microsoftが発表したMAI-Cyber-1-Flashは、巨大なコードから見つけにくい脆弱性を洗い出すセキュリティ特化AI。自社のセキュリティ基盤MDASHに統合され、GPT-5.4と組み合わせることで業界ベンチマークCyberGymで競合モデルを上回る性能を示した。

設計の要は、全体の約90%の作業を軽量な本モデルで処理し、最難関の約10%だけをGPT-5.4に回すこと。これによりMDASHはCyberGymで96%を達成しつつコストを半減し、大半の作業を軽量モデルでさばき、難所だけを大型モデルに回す戦略を実現。継続監視・パッチ適用・封じ込めを担うエージェント型システムPerceptionも提供し、今後さらに適用範囲を広げるとしている。

gigazine.net favicon

gigazine.net

#はてブテクノロジー新着
#AIモデル
#ツール・サービス
14

Mac mini(M4 Pro / 48GB)で「完全ローカル」のLLM + RAG環境を構築してみた

33pt

Claude Codeの使いこなし術について書かれた記事。

  • Mac mini M4 Proで、Ollama+LlamaIndexを使い「完全ローカルのLLM+RAG」を構築する手順。外部送信なし・従量課金なし・オフラインで検証可能。
  • 使う構成:生成モデル qwen3:14b、比較用 gemma3:27b、埋め込み bge-m3。RAGは「生成用」と「埋め込み用」の2モデルが必要。
  • 手順の肝:HomebrewでOllama導入→モデル取得→単体動作確認→Python仮想環境→LlamaIndexで十数行のrag.py作成→data配下の文書で質問。
  • 重要ポイント:Apple Siliconのユニファイドメモリで14B〜32Bが実用速度。MLX形式を優先、モデル同時稼働のメモリ配分に注意。
  • 調整項目:similarity_top_kで検索件数を最適化。まず14Bで確認し、必要に応じて27Bへ。
  • 目安:15 tokens/s以上で快適。
  • 典型エラー:Ollama未起動(connection refused)、GUI常駐でポート衝突、PDF要pypdf、メモリ不足は一時的に上限引き上げ。
  • GUI代替:AnythingLLM、LM StudioでもコードなしでRAGを体験可能。
qiita.com favicon

qiita.com

#Qiitaトレンド
#活用事例
#開発Tips
15

中国製高性能AI「Kimi-K3」が予定通りオープンモデル化される、2.8兆パラメーターでClaude Fable 5やGPT-5.6 Solに迫る性能

30pt

Moonshot AIが最上位モデル「Kimi K3」のモデル重みを公開。2.8兆パラメーターのMoEで、視覚理解と100万トークンの長文脈に対応し、Claude Fable 5やGPT-5.6 Solに迫る性能を狙う。

新アーキテクチャで計算量あたり2.5倍の賢さをうたい、単に巨大化しただけでない点が特徴。

数TB級メモリが必要なためクラウド実行が前提。LM Studio BionicやOllamaのクラウドで即利用できる。

gigazine.net favicon

gigazine.net

#はてブテクノロジー新着
#AIモデル
#ツール・サービス
事例(OpenAI)

エージェント型AIによる研究開発の新課題

Scientific computing in the age of agentic AI

データ増にソフトが追いつかず、研究現場では脆いワークフローが足かせになっている。記事は、生命科学を中心とした事例から、エージェント型AIが実装作業を肩代わりし開発・保守を加速させる一方で、検証と長期保守が新たなボトルネックになっていると指摘する。

研究者の役割は、実装から「要件定義・正しさの測定・出荷判断」へと移る。短い反復でベンチマークや既存ツールとの一致確認を使うと進むが、最後の細部調整に時間がかかる。

また、改良や書き換えが増えるほどツールが分散するため、元プロジェクトとの連携や明確なオーナー設定など、長期的な責任体制が不可欠だと述べている。

openai.com favicon

openai.com

#OpenAI
機能アップデート(Cursor)

インド向けCursor Startの新サービス発表

Cursor Start

Cursorがインドの開発者向けに「Cursor Start」を発表。インド向け月額₹649で、UPIやカード決済に対応し、毎日のエージェント開発を始めやすくした。

Grok 4.5とComposerに十分な利用枠がつき、常時起動のクラウドエージェントがコードの生成・テスト・リリースまで進める。iOSアプリからリモート操作でき、プラグインやMCPサーバー、フックやスキルで開発フローを拡張できる。

cursor.com favicon

cursor.com

#Cursor
機能アップデート(Claude)

MCP新仕様でClaudeが無状態コアに対応

Bringing MCP 2026-07-28 to Claude

MCPの新仕様「2026-07-28」がClaudeに対応。プロトコルがリクエスト/レスポンス型の無状態コアに刷新され、無状態コアへの移行でサーバーレス配備と大規模運用が容易に。標準化された拡張(MCP Apps/Tasks)で、対話UIや長時間タスクをコア変更なしで追加できる。

認可はOAuth 2.0/OIDCに正式対応し、EntraやOktaなど企業の認証基盤とそのまま連携可能。Claude側もコネクタ内インラインUI、組織一括認証、利用状況の可視化、私設ネットワーク直結のトンネルなどを提供し、開発から本番運用まで一貫した体験を実現する。

claude.com favicon

claude.com

#Claude

今日のまとめ

2026/7/29

今日はMoonshot AIのKimi-K3。重み公開に合わせ、B300を8枚積んだ1台で当日起動した報告が出ました。SGLangでKVキャッシュを8GPUに分けて持たせ、DSPARKで先読みし、2.8兆でも実用速度。長文を速くするコツは、メモリの置き場をどう配るかでした。

学びは現場向きです。起動に約90分、再起動は重い。並列30前後で頭打ち、長文はKVを厚く。メモリ比率の設定ひとつで短文多並列か長文向けかが変わり、欲張ると足りなくなる。

オープンウェイトが現実の選択肢になってきました。数字だけでなく、落ちた時の逃げ道と見張り、キャッシュ設計まで含めて運用を作り込めば、上位モデルを自分のラックに下ろせます。

(文・T

2026年07月29日