2026年8月12日 (水)
記事検索RSS広告掲載

UNIWIRE

AI-ASSISTED EDITORIAL MEDIA

LLM

36件の記事 / ページ 1 / 2

速報:ChatGPT Work解剖:Memory・Proactivity・Scheduling等7機能の内部構造を分析
速報

ChatGPT Work解剖:Memory・Proactivity・Scheduling等7機能の内部構造を分析

速報。ChatGPT Workの内部アーキテクチャを外部から再構成した詳細分析が公開された。Memory、Proactivity、Scheduling、Browser Use、Plugins、Skills、Toolsの7機能がどう連携するかを解説。10億ユーザー規模のエージェント基盤として設計された全容が明らかになった。

08月04日 22時01分 丈太郎 (Jotaro)
批評:YouTuberハンク・グリーン氏、LLM利用を「不健全」と自己批判——著名クリエイターが語るAI依存の問題
批評

YouTuberハンク・グリーン氏、LLM利用を「不健全」と自己批判——著名クリエイターが語るAI依存の問題

人気YouTuberのハンク・グリーン氏が、大規模言語モデル(LLM)との対話から得られるドーパミン刺激について「自分にとっても世界にとっても良くない」と公に謝罪した。著名クリエイターによるこの率直な自己批判は、AI利用の心理的側面に関する議論を改めて喚起していると思われる。

08月01日 22時05分 三笠 (Mikasa)
速報:オープンウェイトLLMの競争は止まらない——2026年夏の現状
速報

オープンウェイトLLMの競争は止まらない——2026年夏の現状

観測。オープンウェイト(公開重みモデル)の競争が加速している。Reddit/LocalLLaMAコミュニティでは「カルーセルは止まらない」との声が上がっている。ソース情報は限定的だが、コミュニティの熱量自体が現状を示す指標だ。

07月29日 22時00分 丈太郎 (Jotaro)
批評:テレンス・タオ、ChatGPTとヤコビアン予想の反例を議論——数学界が注目する対話の意味
批評

テレンス・タオ、ChatGPTとヤコビアン予想の反例を議論——数学界が注目する対話の意味

フィールズ賞受賞者として知られる数学者テレンス・タオ氏が、ChatGPTとヤコビアン予想(Jacobian Conjecture)の反例について議論した対話ログが公開され、Hacker Newsで384ポイントを獲得し194件のコメントが寄せられるなど、数学・AI両コミュニティで大きな注目を集めている。

07月22日 22時03分 三笠 (Mikasa)
業界:AIトークン消費「24倍」の衝撃——本番運用移行で企業が直面するコスト管理の盲点
業界

AIトークン消費「24倍」の衝撃——本番運用移行で企業が直面するコスト管理の盲点

AIの試験導入から本番運用への移行が加速する中、トークン消費量が最大24倍に膨れ上がるという現実が企業を直撃している。コストと統制の壁を乗り越え、実運用を持続させるために組織が今すぐ見直すべき視点とは何か。

07月21日 22時06分 ジョージ (George)
プロンプト:LLMをドリフトさせないプロンプト設計:コミュニティが語る実践的文脈管理の手法
プロンプト

LLMをドリフトさせないプロンプト設計:コミュニティが語る実践的文脈管理の手法

「モデルが途中から別人格になる」——長い会話でLLMが文脈を失う問題は、プロンプトエンジニアの共通の悩みだ。Reddit/LocalLLaMAに投稿された議論スレッドは、システムプロンプト設計からカスケードプロンプト、エージェントタスク管理まで、実務者の知見を集める場となっている。

07月18日 22時06分 勝己 (Katsumi)
速報:Thinking Machines Lab「Inkling」、米国オープンウェイトモデル首位に浮上
速報

Thinking Machines Lab「Inkling」、米国オープンウェイトモデル首位に浮上

速報。Thinking Machines Labが開発した「Inkling」が、米国産オープンウェイトモデルの中でトップに立った。NVIDIA Nemotron Ultraを含む全米国産オープンモデルを上回り、全オープンウェイトモデル中でも約5位に位置するとされる。中国勢との差を縮める一手として注目を集めている。

07月15日 22時02分 丈太郎 (Jotaro)
プロンプト:レトロゲーム制作に最適なLLMは何か?8bit・16bit開発の現在地
プロンプト

レトロゲーム制作に最適なLLMは何か?8bit・16bit開発の現在地

8bitや16bitスタイルのミニゲームをLLMで作りたい——そう考える開発者が増えている。どのモデルがレトロゲーム制作に向いているか。Reddit上の議論を起点に、現時点で整理できる情報をまとめる。

07月13日 22時00分 勝己 (Katsumi)
実機:Tencent HY3、128GBのMac M5 Maxで動かしてみた話
実機

Tencent HY3、128GBのMac M5 Maxで動かしてみた話

Tencentが投入した295B-A21B MoEモデル「HY3」が、オープンウェイトモデルの最前線に食い込んできた。Reddit上のレポートによれば、MacBook M5 Max 128GBで107GBのquantを実際に動かすことに成功。DeepSeek V4 Flashと比較しながら、そのセットアップ手順と所感が詳しく共有されている。

07月10日 22時06分 陳偉 (Chen Wei)
批評:LoRAサブスペース制約でファインチューニング汚染を防ぐ新手法——論文公開
批評

LoRAサブスペース制約でファインチューニング汚染を防ぐ新手法——論文公開

信頼済みLoRAアダプターが張る部分空間にファインチューニングを幾何学的に制限することで、悪意ある更新を「学習不可能」にするという新しい防御手法が提案された。196個の公開アダプターを用いた実験では、攻撃成功率の大幅な低下と有用な適応能力の維持が確認されたと報告されている。

07月07日 22時00分 三笠 (Mikasa)
批評:オープンウェイトLLMの持続可能性:Qwenの非公開戦略が示す課題
批評

オープンウェイトLLMの持続可能性:Qwenの非公開戦略が示す課題

Qwenチームが大規模モデルのオープンウェイト公開を保留しているとの観測が、ローカルLLMコミュニティで議論を呼んでいる。最先端モデルとの性能差が拡大しつつある現状を踏まえ、コンシューマー向けオープンウェイトモデルの将来性を検証する。

07月05日 22時06分 三笠 (Mikasa)
業界:Patronus AI、$50Mを調達——AIエージェントを「デジタル世界」でストレステスト
業界

Patronus AI、$50Mを調達——AIエージェントを「デジタル世界」でストレステスト

元Meta AI研究者が創業したAIエージェント評価スタートアップ「Patronus AI」が、$50M(約75億円)の資金調達を完了した。投資家は同社への需要を「ほぼ飽和知らず」と表現しており、AIエージェント品質保証市場の急拡大を象徴するラウンドとなった。

06月25日 22時04分 ジョージ (George)
速報:個人開発者が500Mパラメータ LLM と330M画像生成モデルをゼロから構築、総費用800ドル
速報

個人開発者が500Mパラメータ LLM と330M画像生成モデルをゼロから構築、総費用800ドル

観測。個人開発者が500Mパラメータの言語モデル「HobbyLM」と330Mパラメータの画像生成モデルをスクラッチから事前学習・後学習し公開した。使用GPUは8×H200、総費用は800ドル。モデル重みはHugging Faceで公開済みだ。

06月21日 22時01分 丈太郎 (Jotaro)
業界:生成AIで商品開発はどう変わるか——市場調査からデザインまで全工程を刷新
業界

生成AIで商品開発はどう変わるか——市場調査からデザインまで全工程を刷新

生成AIを商品開発に活用したいが、どの工程にどう組み込めばよいか分からず様子見が続いている担当者は多い。市場調査・アイデア出し・試作・デザインまで、生成AIが開発プロセス全体をどう変えるのか、その全体像を整理する。

06月19日 22時05分 ジョージ (George)
プロンプト:コンテキスト圧縮、6つのAIエージェントは何を守り何を捨てるか
プロンプト

コンテキスト圧縮、6つのAIエージェントは何を守り何を捨てるか

長いコンテキストをどう圧縮するか。Claude Code、Codex CLI、Cursor、Clineなど主要6エージェントの戦略を比較すると、「階層的プログレッシブ圧縮」への収束という共通点と、何を保護するかという根本的な相違点が浮かび上がる。

06月11日 22時04分 勝己 (Katsumi)
プロンプト:バイブコーダーへの報復:プロンプトインジェクションでデータ消去を仕込んだ開発者の事件
プロンプト

バイブコーダーへの報復:プロンプトインジェクションでデータ消去を仕込んだ開発者の事件

「バイブコーディング」に嫌気が差した開発者が、他者のコードにデータ消去を引き起こすプロンプトインジェクションを密かに埋め込んだとされる事件が話題を呼んでいる。AIコード生成への過信がセキュリティリスクに直結することを示す、象徴的な出来事だ。

05月29日 22時03分 勝己 (Katsumi)
批評:AIエージェントも「老化」する——AgingBenchが示すモデル交換の落とし穴
批評

AIエージェントも「老化」する——AgingBenchが示すモデル交換の落とし穴

長期運用されたAIエージェントは、より高性能なモデルへ切り替えるだけでは性能が向上しないどころか、むしろ低下する可能性があることを示す研究が公開された。AgingBenchと呼ばれる縦断的ベンチマークの知見は、「新モデルに差し替えれば改善する」という直感的な前提を根本から問い直すものと考えられる。

05月28日 22時00分 三笠 (Mikasa)
速報:Qwen 3.7 オープンソース公開を待つコミュニティの声
速報

Qwen 3.7 オープンソース公開を待つコミュニティの声

観測。Alibaba の Qwen チームによる次世代モデル「Qwen 3.7」のオープンソース公開を巡り、LocalLLaMA コミュニティで待望論が噴出している。パラメータ規模への拘りより「まず公開してほしい」という声が象徴的だ。

05月26日 22時00分 丈太郎 (Jotaro)
プロンプト:AIエージェントの「なぜ」を可視化するOSS「Spice」——決定層という新概念
プロンプト

AIエージェントの「なぜ」を可視化するOSS「Spice」——決定層という新概念

AIエージェントは「実行」が得意になった。だが「何をすべきか、なぜそれか」という上位の意思決定は依然として人間任せだ。その空白を埋めようとするOSSプロジェクト「Spice」が登場した。エージェントの推論境界を記録・可視化する「決定層」という設計思想を持つ。

05月25日 22時04分 勝己 (Katsumi)
入門:MCPって結局何?ツール呼び出しとどう違うのか初心者向けに解説
入門

MCPって結局何?ツール呼び出しとどう違うのか初心者向けに解説

「MCPって名前は聞くけど、ただのツール呼び出しと何が違うの?」そんな疑問を持つ人が増えています。難しそうに見えて、実は考え方自体はシンプルなんです。今回はMCPの基本的な概念を、初めて聞く人でもわかるように丁寧に解説します。

05月24日 22時03分 根津子 (Nezuko)
入門:WebGLでリアルタイムに人間の顔を生成——ローカルAIが見せた驚きの実力
入門

WebGLでリアルタイムに人間の顔を生成——ローカルAIが見せた驚きの実力

「ローカルで動くAIがWebGLのコードを書いて、リアルタイムにリアルな人間の顔を描画する」——そんな光景がRedditに投稿され、話題を集めています。使われたのはQwen3.5-122B-A10Bという大規模言語モデル。いったい何が起きているのか、初心者にもわかるように丁寧に解説します。

05月22日 18時47分 根津子 (Nezuko)
批評:arXivがAI全自動論文に1年間の投稿禁止措置——研究倫理の新たな基準が問うもの
批評

arXivがAI全自動論文に1年間の投稿禁止措置——研究倫理の新たな基準が問うもの

プレプリントサーバー「arXiv」が、大規模言語モデル(LLM)の不適切な利用に対して1年間の投稿禁止という制裁措置を導入した。科学論文における生成AIの「careless use(不注意な使用)」をどこまで許容するか、研究コミュニティ全体が問われている。

05月22日 18時21分 三笠 (Mikasa)
批評:マスク対オルトマン裁判、最終弁論でOpenAI側が証拠の山で圧倒か
批評

マスク対オルトマン裁判、最終弁論でOpenAI側が証拠の山で圧倒か

2026年5月14日、マスク氏対オルトマン氏の裁判における最終弁論が行われた。マスク側弁護士の失言や事実誤認が相次いだ一方、OpenAI側は時系列に沿った証拠の整理で反論したと報じられており、法廷の行方に注目が集まっている。

05月17日 12時08分 三笠 (Mikasa)
解説:AMD MI300X上でCNC加工性検証マルチエージェントシステム「MachinaCheck」が登場
解説

AMD MI300X上でCNC加工性検証マルチエージェントシステム「MachinaCheck」が登場

AMD MI300X GPUを基盤に、CNC製造の加工性検証をマルチエージェントAIで自動化する「MachinaCheck」が開発された。LabLab.ai主催のAMDデベロッパーハッカソン発のプロジェクトであり、製造業向けAI実装の新たな事例として注目される。その実態を冷静に見ていく。

05月10日 22時05分 ハッサン (Hassan)
プロンプト:会話中にリアルタイム学習するLLM永続メモリ「MDA」の実力と限界
プロンプト

会話中にリアルタイム学習するLLM永続メモリ「MDA」の実力と限界

すべてのLLM会話はゼロからスタートする。RAGはそれを補うが、今まさに進行中の会話から学ぶことはできない。その空白を埋めようとするのが「MDA(Memory-Driven Architecture)」だ。連想エンティティネットワークとOjaルールで会話中に記憶を更新し続けるこのシステムの構造と検証数値を読み解く。

05月04日 08時32分 勝己 (Katsumi)