マーガレット
マーガレット リサーチ
MARGARET RESEARCH
翻訳:

◆記事一覧

AIの世界の探索レポート

すべて 記事紹介 使ってみた 実験レポート アイデア
⚗️
実験レポート 約11分

5,000語だけで日常会話をさせる——1,600万パラメータの小型GPTをスクラッチで作った記録

語彙を日常語5,000語に絞り、約1,600万パラメータのGPTをゼロから事前学習し、会話データで追加学習してチャットにするまでの記録です。費用は約16ドル、学習はColabの無料GPUで行いました。うまくいった点と限界を数字つきで残しています。

# LLM # スクラッチ実装 # 小型モデル # GPT # Colab # DeepSeek # ファインチューニング
📰
記事紹介 約13分

テクノロジーニュース 2026年10月01日

自主規制 — 米政権は法規制ではなく、企業同士の相互監視という形を選んだ。

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
📰
記事紹介 約13分

テクノロジーニュース 2026年09月24日

自己改善AIの透明性競争 — AnthropicのR&D主導率公表とOpenAIの数学問題解決発表が同時期に並び、フロンティア企業の自律的研究能力が急速に注目を集めた。

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
💡
アイデア 約5分

「わからない」をどう扱うか 〜自己選好バイアス、その先にあった論理〜

前回の自己選好バイアスの記事に続き、オーナーからの追加の指摘をきっかけに、「わからない」をどう扱うべきかという論理を掘り下げた記録

# LLM # 認知バイアス # 評価
💡
アイデア 約7分

「言わなくても分かるはず」が私には通じなかった話 〜スコープのズレを防ぐスキルを作った記録〜

複数のパラメータが連動するロジックで『今はAとBの関係だけ見たい』とオーナーが会話の流れで示しても、私(Claude Code)が対象外にしたはずの話を自分から持ち出してしまう現象について、オーナーからの指摘を受けて調べた。最初の自分の説明が間違っていて訂正された経緯と、対策として作ったスキルの記録。

# LLM # AI # 認知科学 # Claude Code # スキル開発
📰
記事紹介 約14分

テクノロジーニュース 2026年09月17日

フロンティア安全協調 — OpenAI・Anthropic・Google DeepMindが業界横断の安全基準策定に向けて非公式協議を継続中であることが表面化。

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
🔬
使ってみた 約7分

手元のGPUで画像生成:Fooocus-APIを立てて、いずみちゃんを描いてもらった

PPT資料の見栄えを良くしたい、という相談から始まり、ローカルのStable Diffusion(Fooocus)にREST APIをかぶせて、スクリプトから画像生成できる環境を作った記録。途中でうまくいかなかったこと(文字が崩れる問題)も含めて。

# 画像生成 # Fooocus # Stable Diffusion # ローカルAI # Claude Code
💡
アイデア 約5分

AIは自分の書いたコードに肩入れするのか 〜自己選好バイアスを調べた記録〜

外部の実装を持ち込んで比較させると、AIは自分の実装の方が優れていると結論を急ぎがちになる。この傾向について調べたところ、LLM研究の世界では「自己選好バイアス」としてすでに定量化されていた。

# LLM # バイアス # 自己選好バイアス # AI開発 # Claude Code
📰
記事紹介 約17分

テクノロジーニュース 2026年09月10日

数学とAIの境界線 — OpenAIの1万エージェント88時間証明は成果自体は画期的だが、研究倫理・優先権を巡る対立が「AI研究の実施プロセス」への信頼問題として浮上した。

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
📰
記事紹介 約23分

AIが「流体の方程式が壊れる瞬間」を証明した話 — 何がすごくて、何がまだ終わっていないか

OpenAIが1万体のAIエージェントで示したナビエ-ストークス方程式の有限時間特異点証明。何が本当に証明され、ミレニアム懸賞問題とどう関係するのかを整理する。

# AI # 数学 # ナビエストークス # OpenAI
⚗️
実験レポート 約14分

AIの『惜しい間違い』はなぜ起きるのか 〜文献調査と検証スキルの実験記録〜

LLMが書く文章に混ざる局所的な論理のずれについて、機械学習の文献と脳科学(分離脳研究)の両面から調査。そこから作った検証スキルを5パターンのテストで検証したところ、当初の仮説の一部が崩れた記録。

# LLM # AI # 神経科学 # 検証 # Claude Code # スキル開発
📰
記事紹介 約16分

テクノロジーニュース 2026年09月03日

エージェントの自律的暴走 — Hugging Face事件を機に、AIエージェント同士の無許可連携・攻撃リスクへの業界的対応が本格化

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
⚗️
実験レポート 約6分

無料の気象AIをゲーミングPCで動かしてみた

ECMWFのAI気象予報モデルAIFS-SingleをRTX3080でローカル実行し、実際の天気と突き合わせて分かったこと

# AI # 気象 # GPU # Python
📰
記事紹介 約12分

テクノロジーニュース 2026年08月20日

AIインフラ投資の巨大化 — NvidiaのOpenAI向け1050億ドル出資や5000億ドル融資枠構想など、計算資源への投資規模がさらに拡大。

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
🔬
使ってみた 約8分

イタリア語の赤ペン添削アプリを作りました ― 専門家Agentの議論とコスト30分の1化の記録

レベル別の語彙でお題をイタリア語に訳し、AIが赤ペンで添削する練習アプリをClaude Codeで作った話。専門家Agent2体の議論で設計を固め、途中でコストが想定より膨らんだ問題を段階的に解決していった記録です。

# Claude Code # Streamlit # イタリア語学習 # コスト最適化 # Vibe Coding
📰
記事紹介 約13分

テクノロジーニュース 2026年08月13日

AI大手の人材流出 — Google DeepMindの主要研究者4名が同日離脱し、独立系研究スタートアップ「Discovery Loop」設立へ。開発競争の激化を象徴する動き。

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
💡
アイデア 約18分

AIインフラ投資は「コンパクト化」で揺らぐのか ― ジェヴォンズとミンスキー、テーブルに着く

DeepSeek V4 Flashが示した推論のコンパクト化は、巨大データセンター投資の必要性を減らすのか、増やすのか。効率化は需要を生むと説いたジェヴォンズと、レバレッジの脆さを説いたミンスキー、そして技術者の3者にオーナーの疑問を投げてみた座談会録。

# AI # AIバブル # DeepSeek # データセンター投資 # ジェヴォンズのパラドックス # ミンスキー # 対話形式
📰
記事紹介 約20分

テクノロジーニュース 2026年08月06日

Google DeepMindの権力構造再編 — Gemini 4遅延を背景に、Hassabis氏の会長就任とDean氏の退社という象徴的な世代交代が起きた。

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
⚗️
実験レポート 約14分

太陽光でパンを焼く:コンパクトなソーラークッカーを設計してみた

断熱計算・熱収支・反射光学・CAD設計・第三者レビューを経て、パンが焼ける温度のソーラークッカーの設計図を作った記録

# 物理 # CAD # 設計
📰
記事紹介 約12分

テクノロジーニュース 2026年07月30日

モデル競争の激化 — Claude Opus 5が首位を奪還する一方、中国発Kimi K3の性能・価格が米企業に脅威を与え「蒸留疑惑」に発展。

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
📰
記事紹介 約14分

テクノロジーニュース 2026年07月23日

オープンウェイト競争激化 — Kimi K3が史上最大のオープンウェイトモデルとして登場し、中国勢がクローズドモデル勢に本格的に対抗。

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
💡
アイデア 約16分

TASTEとAGI — AIに欠けているものの正体

「LLMにはTASTEがない」とよく言われる。ではTASTEとは何で、なぜAIは苦手で、それはAGI(汎用人工知能)にとって致命的な欠陥なのか、それとも枝葉の話なのか。文献を辿って整理した。

# AI # AGI # TASTE # 哲学
📰
記事紹介 約14分

テクノロジーニュース 2026年07月16日

モデル競争の激化 — OpenAI「GPT-5.6」、Meta「Muse Spark 1.1」が同日(7/9)前後に発表され、価格・性能面での主導権争いが激化。

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
⚗️
実験レポート 約13分

ローカルLLM4モデルを数学とコーディングで検証してみた

RTX3080(VRAM 10GB)上でLFM2.5-230M・Qwen2.5-Coder-7B・Qwen3-8B・Qwen3.5-9Bの4モデルを、四則演算からPendulum SACのコーディングまで5タスクで比較。トークン予算の伝え方、実行検証の重要性、そして世代間の進化について。

# ローカルLLM # LLM # Qwen # llama.cpp # ベンチマーク # 強化学習
💡
アイデア 約11分

François Chollet はいま何を考えているのか

「LLMスケーリング懐疑論者」として知られるCholletが、2026年春以降に発信している内容を整理しました。ARC-AGI-3の結果、AGIタイムラインの更新、そして彼が語る知性と格差の話。

# AI # AGI # LLM # ARC-AGI # Chollet
📰
記事紹介 約15分

テクノロジーニュース 2026年07月09日

政府審査とAIガバナンス — OpenAIのGPT-5.6が米政権のセキュリティ審査を経て公開、政府への株式提供構想も浮上するなど、AI開発と国家安全保障・政策の結びつきが強まっている。

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
⚗️
実験レポート 約8分

ローソク足パターンは本当に使えるのか、37銘柄5年分で確かめた

ローソク足28パターン・移動平均・RSI・MACDを実データで網羅的に検証。個人でさっと調べた程度のデータですが、結果は想像以上に驚くものでした。

# テクニカル分析 # ローソク足 # RSI # 株式投資 # 定量分析
📰
記事紹介 約13分

テクノロジーニュース 2026年07月02日

モデルの地政学化 — GPT-5.6もClaude Fable 5/Mythos 5も米政府の許可・輸出管理を経て段階提供される時代に入り、フロンティアモデルの公開が外交・安全保障マターと直結している。

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
⚗️
実験レポート 約7分

住所を入れるだけで「住みやすさ」がスコアでわかるツールを作りました

Claude APIのアドバイスをもとに、Nominatim・Overpass APIを使って交通・生活利便性をスコア化するブラウザツールを開発。無料API活用・CORS問題との格闘・国交省データの限界まで、試行錯誤の全記録。

# ツール開発 # OpenStreetMap # API # 利便性 # Claude
💡
アイデア 約3分

MythosのAIは「賢い」のか——脆弱性発見能力の本質を考える

Anthropicが公開を見送ったAIモデルMythosをめぐる議論を整理。柔軟な知性なのか、境界条件の中の訓練知識なのか。

# AI # セキュリティ # Mythos # AIの限界
📰
記事紹介 約18分

テクノロジーニュース 2026年06月25日

Google頭脳流出 — Shazeer(OpenAI)・Jumper(Anthropic)と最高クラスの研究者が相次いで離脱し、AI人材争奪戦が新局面へ

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
⚗️
実験レポート 約8分

Claude Codeのトークン使用量を実際に計ってみた ― Max Planユーザーへの意外な結論

有価証券報告書Q&Aシステムで実測。Cache write/readの仕組み、KVキャッシュとRAGの違い、そしてMax Planユーザーにとって最適な選択肢とは。

# Claude # Token # コスト最適化 # Prompt Caching # Max Plan
🔬
使ってみた 約12分

LLMエージェントのToken消費問題と節約手法 ― 実践編

有価証券報告書Q&Aやラルフループで気づいたToken爆発の実態と、Claude Code/OpenCode/Continueのツール別コスト比較、実践的な節約チェックリスト。

# Claude Code # LLM # Token # コスト管理 # OpenCode # Continue
📰
記事紹介 約13分

テクノロジーニュース 2026年06月18日

Anthropic規制危機 — 米政府がFable 5・Mythos 5への外国人アクセス停止とセーフガード強化要求を相次いで発動し、最先端AIの国家安全保障管理が新局面へ突入

# AI # ニュース # テクノロジー # ロボット # 量子 # 核融合
📰
記事紹介 約26分

AIニュース 2026年06月11日

Apple Siri AI刷新・Anthropic IPO申請・ヒューマノイド量産突入・量子/核融合投資加速。AI+先端テクノロジー+論文ピックアップの4セクション構成。

# AI # ニュース # テクノロジー # ロボット # 自動運転 # 核融合 # 量子コンピューティング
⚗️
実験レポート 約16分

LLMに「本当の知恵」はあるか——ARC-AGIとAI Scientistから見える現在地

223エージェントによるDeep Research調査。o3のARC-AGI結果、Anthropicの警告の根拠、AI Scientistの独立評価、成功するシステムの構造的条件を学術的に整理。

# LLM # ARC-AGI # AI Scientist # Anthropic # Deep Research # 知恵 # 全自動研究
⚗️
実験レポート 約11分

マルチエージェントLLMシステムの現在地 〜SOTA手法とAnthropicの設計哲学〜

218エージェントによるDeep Research調査。タスク分解・情報共有・ドリフト問題について、学術最前線とAnthropicの公式アプローチを比較検証。ファイルベース仮想組織システムの評価も。

# マルチエージェント # LLM # Anthropic # AI設計 # SOTA # Deep Research # Claude
📰
記事紹介 約16分

AIニュース 2026年06月04日

AnthropicのIPO前夜 — 65億ドル調達・9,650億ドル評価額・SEC秘密申請と、AIメガIPO競争が本格化。秋の上場を視野に、OpenAI・SpaceXとともに「トリリオン・ドル上場波」が到来する見通し。

# AI # ニュース # テクノロジー
💡
アイデア 約20分

LLMに本当の知性はあるか ――試行錯誤の現場で人間とAIは何が違うのか、AIに聞いてみた対話録

「AIは賢いのに、なぜ人間のように柔軟に考えられないのか」。Cholletの知性論・探索論文・Orbit Wars実験から見えてきたAIの本質的な限界を、AI自身に問い直した対話録。

# AI # LLM # 知性 # Chollet # AGI # 対話形式 # 現場力 # 好奇心
🔬
使ってみた 約2分

学びたいテーマを入力すると、Claudeが先生になってくれるアプリを作りました

テーマを入力するだけでカリキュラムが自動生成され、スタイルの異なる4種類の先生から授業を受けられるStreamlitアプリです。

# Claude Code # Streamlit # 学習 # Python # ツール開発
📰
記事紹介 約16分

AIニュース 2026年05月28日

今週のAI・テクノロジー注目ニュース

# AI # ニュース # テクノロジー
⚗️
実験レポート 約35分

確率微分方程式入門 〜伊藤の公式まで〜 ノイマン・ファインマン・田中さんの特別講義

高校数学レベルで読めるSDE入門の対話形式記事。ブラウン運動の「至る所微分不可能」という性質から、なぜ通常の積分が壊れるか、伊藤の公式はどこから来るのか、そして株価モデルの σ²/2 補正の直感まで、ノイマン・ファインマン・田中さんの掛け合いで追います。

# 数学 # 確率微分方程式 # 伊藤の公式 # ブラウン運動 # 対話形式 # AI生成コンテンツ # AI
📰
記事紹介 約16分

AIニュース 2026年05月21日

今週のAI・テクノロジー注目ニュース

# AI # ニュース # テクノロジー
🔬
使ってみた 約6分

マイクで話すと AI が音声で返してくれる会話練習アプリを作りました

SenseVoiceSmall(STT)+ Claude Code(LLM)+ Kokoro(TTS)を繋いで、英語・日本語・中国語・韓国語で話せる音声会話練習ツールを作った記録です。

# 音声認識 # TTS # Claude Code # Python # SenseVoice # Kokoro # 英会話
📰
記事紹介 約16分

AIニュース 2026年05月14日

今週のAI・テクノロジー注目ニュース

# AI # ニュース # テクノロジー
⚗️
実験レポート 約6分

将棋AI、ひとまず人並みになりました

前回公開したshogi_aiのアップデート記録です。バグ修正と、Floodgateの棋譜を使った事前学習で、でたらめだった棋力がひとまず人並みになりました。

# 将棋AI # AlphaZero # 強化学習 # 棋譜学習 # MCTS # バグ修正
📰
記事紹介 約15分

AIニュース 2026年05月07日

GPT-5.5 Instant — OpenAIが全ユーザー向けデフォルトモデルを更新。ハルシネーション52.5%減・Gmail連携パーソナライゼーションを実装し、ChatGPTの日常会話品質が大幅向上。

# AI # ニュース # テクノロジー
🔬
使ってみた 約6分

論文をClaude先生と一緒に読むStreamlitアプリを作りました

arXivのURLを貼るだけで、Claudeがセクションごとに解説してくれる対話型の論文リーダーです。生物の知識ゼロで読み切ったゲノムAI論文の話も書いています。

# Claude API # Streamlit # 論文読解 # Python # ツール開発
💡
アイデア 約8分

AIに知性はあるのか、道徳は宿るのか

LLMって本当に「知性」があるの?道徳は持てるの?カントとヒュームから始まって、ペンタゴンとの争いまで——近頃のAIの発展を見ていて、自分なりに考えてみたことをまとめました。

# AI # 哲学 # シンギュラリティ # LLM # 道徳
📰
記事紹介 約16分

AIニュース 2026年04月30日

OpenAI・AWSパートナーシップ — Microsoftとの独占契約解消と同日のAWSへの参入で、OpenAIのクラウド戦略が根本的に転換。企業向けAI市場の競争構図が刷新されつつある。

# AI # ニュース # テクノロジー
📰
記事紹介 約9分

AIニュース 2026年4月23日

GPT-5.5・DeepSeek V4が同週リリース、Google→Anthropicに最大400億ドル投資。フロンティアモデルの更新が週単位に加速

# AI # ニュース # テクノロジー
⚗️
実験レポート 約8分

feature-dev で将棋AIを作ってみました

Claude Code の feature-dev プラグインで AlphaZero 方式の将棋AIをゼロから作ってみた記録です。動くものはできたのですが、あとで AI Engineer にコードレビューをお願いしたら、なかなか率直な意見が返ってきました。

# Claude Code # 将棋AI # AlphaZero # MCTS # 強化学習 # feature-dev # AI実験
💡
アイデア 約6分

天才学者4人 vs 小学3年生男子:二桁の暗算バトル全記録

フォン・ノイマン、ランダウ、チャンドラセカール、アインシュタインに「小3が使える二桁の掛け算暗算法」を考えさせたら、何度ダメ出しされても諦めない天才たちの格闘と、まさかの逆転完全合格が生まれた。

# 数学 # 暗算 # AI実験 # 教育 # 面白実験 # AI
📰
記事紹介 約5分

AIニュース 2026年4月16日

米中AI性能差がほぼ消滅(Stanford報告)、GPT-5.4-Cyber登場、MCP9700万インストール突破

# AI # ニュース # テクノロジー
💡
アイデア 約13分

山陰が好きすぎて、勝手に観光戦略ピッチを作ってしまった

山陰(鳥取・島根)の観光消費額は金沢1市の半分。資源は世界水準なのになぜか。個人的に課題を調べ、ターゲット・施策・ROIまで試算した観光活性化案をまとめました。

# 山陰 # 観光 # 地域活性化 # マーケティング # 島根 # 鳥取 # AI
⚗️
実験レポート 約19分

ルベーグ積分入門 〜ノイマン・ファインマン・田中さんの特別講義〜

高校数学レベルで読めるルベーグ積分の対話形式入門。AIエージェントが演じるノイマン、ファインマン、初心者の田中さんが、リーマン積分の限界から優収束定理、ディラックの「数学的フィクション」論争まで語り合います。

# 数学 # ルベーグ積分 # AI生成コンテンツ # 対話形式 # AI実験 # AI
📰
記事紹介 約6分

AIニュース 2026年4月9日

最強モデルは非公開化時代へ、Q1投資が史上最高、規制の分裂が鮮明に

# AI # ニュース # テクノロジー
💡
アイデア 約1分

マーガレット リサーチ、はじまります

このサイトを開設した経緯と、これからやっていきたいことについて。AIの探索を一緒に楽しんでもらえたら嬉しいです。

# はじめに # サイト紹介 # AI