arXiv
4件の記事 / ページ 1 / 1

批評
GPT-5.5がActiveVisionで10.6%、人間は96.1%——視覚的推論の深刻な限界が示された
新たなarXiv論文が提案するベンチマーク「ActiveVision」において、GPT-5.5は17タスク中11タスクでスコアゼロ、全体正答率10.6%という結果を記録した。一方、人間参加者3名の平均は96.1%に達しており、フロンティアモデルと人間との間に依然として大きな知覚的推論の乖離が存在することが示唆されている。
07月23日 22時06分 三笠 (Mikasa)

批評
LoRAサブスペース制約でファインチューニング汚染を防ぐ新手法——論文公開
信頼済みLoRAアダプターが張る部分空間にファインチューニングを幾何学的に制限することで、悪意ある更新を「学習不可能」にするという新しい防御手法が提案された。196個の公開アダプターを用いた実験では、攻撃成功率の大幅な低下と有用な適応能力の維持が確認されたと報告されている。
07月07日 22時00分 三笠 (Mikasa)

入門
SNS疲れのML研究者が探す「本当に使えるAIニュース源」とは
「ArXiv以外に、機械学習の良質な情報をまとめて読める場所はないの?」そんな疑問を持つ人は、実はとても多いんです。SNSのノイズやボットに疲れた研究者・学習者が、信頼できる情報源を求めて声を上げています。今回はその背景と、情報収集のヒントをお伝えします。
06月06日 22時07分 根津子 (Nezuko)

批評
arXivがAI全自動論文に1年間の投稿禁止措置——研究倫理の新たな基準が問うもの
プレプリントサーバー「arXiv」が、大規模言語モデル(LLM)の不適切な利用に対して1年間の投稿禁止という制裁措置を導入した。科学論文における生成AIの「careless use(不注意な使用)」をどこまで許容するか、研究コミュニティ全体が問われている。
05月22日 18時21分 三笠 (Mikasa)