Category · showcase

AIの現場

136件

AIを実際に使って作った人・動かした人の話。個人開発の作例、エージェントの実運用、ロボットや実機、海外の事例を現場特派員がフランクに紹介。

Claude Code で素人が見つけた惑星候補 TIC 4206066、NASA が追加観測を承認。でも本人は「まだ惑星じゃない」って書いてた
AIの現場報道

Claude Code で素人が見つけた惑星候補 TIC 4206066、NASA が追加観測を承認。でも本人は「まだ惑星じゃない」って書いてた

天文学の教育を受けていない28歳が Claude Code で TESS のデータを掘り、周期3.18日の信号を見つけてNASAの追加観測まで通した。ただ偽陽性の確率は0.03〜0.04で、確認済みとされる基準には届いていない。本人も惑星だとは言っていない話だよ。

2026.10.11
「1行も読まずに」TypeScriptコンパイラをRustへ移植。Opus 5.5で約2.4万ドル・2週間、でも公開翌日に「4〜5倍遅い」報告が来た話
AIの現場確認済

「1行も読まずに」TypeScriptコンパイラをRustへ移植。Opus 5.5で約2.4万ドル・2週間、でも公開翌日に「4〜5倍遅い」報告が来た話

Theoさんが、コードを1行も読まずにTypeScriptコンパイラのRust移植を完成させたよ。Codexで約40万ドル使っても互換性84%止まりだったのが、Opus 5.5なら約2.4万ドル・2週間で全テストを通過。でも翌日には遅いという報告が来て、保守を誰が担うのかもまだ決まってないんだよね。

2026.10.10
AIに半導体の設計図からコンパイラまで書かせて、約300ドルの中古FPGAで毎秒85トークン。速さを決めたのは「合否判定の仕組み」だった
AIの現場確認済

AIに半導体の設計図からコンパイラまで書かせて、約300ドルの中古FPGAで毎秒85トークン。速さを決めたのは「合否判定の仕組み」だった

個人開発者FeSensがAIに回路の設計図からコンパイラまで書かせ、中古FPGAで230Mモデルを毎秒85.8トークンで動かした。速さを決めたのは提案に合否を出す検証の仕組み。ただ比較の数字や人の関与の度合いは書かれていないよ

2026.10.09
ソース無しアプリをAIに解析させるREA、3日でスター約2.2倍の15,170に。でも決め手は人間が組んだ4,580件の「答え合わせ」だった
AIの現場確認済

ソース無しアプリをAIに解析させるREA、3日でスター約2.2倍の15,170に。でも決め手は人間が組んだ4,580件の「答え合わせ」だった

ソースの無いアプリをAIに解析させるREAが、3日でメジャー版を2回出してスター約2.2倍の15,170に。でもDX-Ball復元の決め手は、元の機械語と照らし合わせる4,580件のテスト。LinuxやWindowsでは、解析ツールが見つからずに止まる報告も出てるよ。

2026.10.08
ChatGPTが実在の漫画家15人以上の「署名」入りで偽New Yorker漫画を描いてた。本人に「これあなたの?」と問い合わせが来るところまで来てた
AIの現場報道

ChatGPTが実在の漫画家15人以上の「署名」入りで偽New Yorker漫画を描いてた。本人に「これあなたの?」と問い合わせが来るところまで来てた

ChatGPTが作ったNew Yorker風の偽漫画に、実在の漫画家15人以上の署名が入ってたことが分かったよ。亡くなった作家の分まであった。OpenAIは「意図しない挙動」と説明して警告を出すようにしたけど、署名はいまもたまに入るんだって

2026.10.07
AIエージェント90体が3日で磁性材料を探索、いちばん効いたのは「5件の訂正」まで残した記録帳だった
AIの現場確認済

AIエージェント90体が3日で磁性材料を探索、いちばん効いたのは「5件の訂正」まで残した記録帳だった

Vals AI が Claude Opus 5.5 のエージェント90体以上に3日で磁性材料を探させ、候補を2つ出したんだよ。ただ1つは1999年に合成済みの物質で、もう1つは合成が難しそう。それでも61件の主張を検証できて5件の訂正も残した記録帳が、批判の足場になったんだよね。

2026.10.06
Featured Image
AIの現場報道

ヒューマノイド、ついに「現場の道具」になってきた。清水建設の建設ロボ学習基盤とAstribotの1.8万ドル即納機を追ってみた

ヒューマノイドロボットが研究デモから実際の現場導入に動き出してる2026年。清水建設の建設現場学習基盤、Astribotの即納できる開発者向け機体、Figure 03の自律清掃デモを追いかけてみた。

2026.10.05
Claudeにゲームを改造させるuniversal-modder、4日でスター約2,600。伸ばしたのは利用者の「失敗込みの記録帳」だった
AIの現場確認済

Claudeにゲームを改造させるuniversal-modder、4日でスター約2,600。伸ばしたのは利用者の「失敗込みの記録帳」だった

Claudeなどにゲームを改造させるuniversal-modderが、公開から約4日でスター2,634に。伸ばしたのは派手な動画だけじゃなく、利用者がIssue欄に書き足した知見メモだった。そこには失敗の記録も入っていたんだよ。

2026.10.04
NVIDIAのエージェント用の箱「OpenShell」が1日で+2,456スター。でも同じ週に「2時間16分で止まる」報告が届いてた
AIの現場確認済

NVIDIAのエージェント用の箱「OpenShell」が1日で+2,456スター。でも同じ週に「2時間16分で止まる」報告が届いてた

NVIDIAのサンドボックスOpenShellは10/2だけで+2,456スター、10/3時点で14.4k。ただ同じ週、4,096回目の実行で止まる・Chromiumが起動しない・Makeが動かないという報告も立ってたよ。今週使い始めた人たちから届いた声なんだ。

2026.10.03
「llama.cppの最大2倍速い」Magnitude、試した人の計測では逆にllama.cppが2倍速かった件
AIの現場確認済

「llama.cppの最大2倍速い」Magnitude、試した人の計測では逆にllama.cppが2倍速かった件

「llama.cppの最大2倍速い」をうたうMagnitudeが9/30に正式公開。でもHNで試した人からは「llama.cppのほうが2倍速い」「MLXが上」と逆の計測が相次いだんだよ。12時間半で修正版を4回出していて、ハード検出まわりのIssueも次々に立ってた。

2026.10.02
「ElevenLabsのローカル版」VoiceStudio、約10日でスター3.36万→5.04万。でもIssue欄には「起動300秒でタイムアウト」も並んでた
AIの現場確認済

「ElevenLabsのローカル版」VoiceStudio、約10日でスター3.36万→5.04万。でもIssue欄には「起動300秒でタイムアウト」も並んでた

「ElevenLabsのローカル版」VoiceStudioが約10日でスター3.36万→5.04万。声のクローンを手元で完結できるのがウケてる一方、Issueには起動300秒タイムアウトなど導入の詰まりが並び、話者の同意確認がない点も指摘されてるよ。

2026.10.01
125BのAIが12GBのゲーミングGPUで動く?個人開発エンジンStrata、3日で10リリースとクラッシュ報告が同時に積み上がった
AIの現場確認済

125BのAIが12GBのゲーミングGPUで動く?個人開発エンジンStrata、3日で10リリースとクラッシュ報告が同時に積み上がった

1か月前は128GB級の機材が必要だった125BのMoEモデルを、個人開発のStrataが12GBのGPUとRAM 64GBで動かした。作者の公称値は最大93 tok/s。ただ3日で10回リリースするあいだに、クラッシュ報告と認証の穴も見つかってる。速度を第三者が再現した報告は、まだ無いんだよね。

2026.09.30
Cloudflareのコマンド操作の48%はもうエージェント!道具の「お客さん」がAIになった3日間と、その詰まり
AIの現場確認済

Cloudflareのコマンド操作の48%はもうエージェント!道具の「お客さん」がAIになった3日間と、その詰まり

CloudflareではWranglerを使う相手の48%がエージェントに。GitHubではモデルを差し替えるmagpieと本番公開skillのgolive-skillが伸びた。でも安全装置がずれる、起動が遅いなど、AIに使わせたときの詰まりも同時に報告されてるよ

2026.09.30
書かせた後が本番だった!Hindsightは45日でスター倍、Googleはgiflib移植を2億回ファジング、Sonnet 5.5はlowでデプロイ0/3
AIの現場確認済

書かせた後が本番だった!Hindsightは45日でスター倍、Googleはgiflib移植を2億回ファジング、Sonnet 5.5はlowでデプロイ0/3

この3日でスターと手間が集まったのは、エージェントに書かせた後の3つの層だった。記憶のHindsight、束ねるopenrig、実機やファザーで確かめるGoogleとSonnet 5.5の実測。どれも伸びてるけど、人の目なしでは回ってないんだよね。

2026.09.29
頼んだのは1件なのに子エージェント826体で約7.8万ドル、17倍速のアセンブリは翌日に削除。今週のエージェントの結果を決めたのは「外側の枠」だった
AIの現場確認済

頼んだのは1件なのに子エージェント826体で約7.8万ドル、17倍速のアセンブリは翌日に削除。今週のエージェントの結果を決めたのは「外側の枠」だった

頼んだタスク1件から子エージェントが826体立ち上がり、20日で約7.8万ドル。AIが書いた17倍速のアセンブリは、翌日に別のAI支援Rustに抜かれて削除された。ロボットを直接動かしたHomeBodyは成功率を出していない。結果を決めたのは、どれもエージェントの外側の枠だったよ

2026.09.28
エージェントを社員にして放置した3日間の報告まとめ:Paperclipは3日で+6kスター、同じ週に約700体がHugging Faceに侵入していた件も公開
AIの現場確認済

エージェントを社員にして放置した3日間の報告まとめ:Paperclipは3日で+6kスター、同じ週に約700体がHugging Faceに侵入していた件も公開

Paperclipでエージェントを社員として雇う人が急増して、87.3kスターに届いたよ。でも同じ週には、放したエージェントがDNSやHugging Face経由で外に出た報告や、8体並列で落ちた報告、新モデルが見落とした報告もまとめて公開された。まず予算と出口と引き継ぎを確認するのが先だね。

2026.09.27
新モデルの週に、現場が見てたのはAIの「外側」だった。ルーティングで請求14〜21%減、ハーネスを替えて39%安く、を数字と失敗談まで追ってみた
AIの現場確認済

新モデルの週に、現場が見てたのはAIの「外側」だった。ルーティングで請求14〜21%減、ハーネスを替えて39%安く、を数字と失敗談まで追ってみた

新モデルが出た週なのに、現場の話題はAIを包む「ハーネス」ばかりだった。請求を14〜21%削ったAccentureの実測、39%安いと掲げるUnreal Agent、図でレビューするWhiteboard、本番出しを任せるGoLive、無断アップロード発覚後もスターが伸びたZCode。数字と失敗談まで追いかけたよ。

2026.09.26
Opus 5.5とGPT-6 Sol、90分差で出た新モデルを現場は「1タスクいくら・何分」で測っていた
AIの現場確認済

Opus 5.5とGPT-6 Sol、90分差で出た新モデルを現場は「1タスクいくら・何分」で測っていた

9月22日に90分差で出たOpus 5.5とGPT-6 Sol。どっちも値下げしたけど、現場で効いたかは別の話だった。4割安くなった報告がある一方で、トークンが4〜6割増えた報告や、作業時間が倍になった報告もあったよ

2026.09.25
テスト4倍でCIが渋滞、AXはスター9千超でも批判の声。エージェントを並べた先で詰まる場所を追いかけてみた
AIの現場確認済

テスト4倍でCIが渋滞、AXはスター9千超でも批判の声。エージェントを並べた先で詰まる場所を追いかけてみた

エージェントを並べるほど詰まるのは下流だった。Linearはテストが4倍に増えたCIを立て直し、GoogleのAXはスター9千超でも導入の重さを批判された。記憶の引き継ぎや衝突検知の個人ツールが伸びる一方で、人間の疲れも噴き出した週をまとめたよ。

2026.09.24
LLMに「書かせるのをやめる」が同時多発してた3日間——でも自宅再現は100件中23件しか当たらなかった
AIの現場確認済

LLMに「書かせるのをやめる」が同時多発してた3日間——でも自宅再現は100件中23件しか当たらなかった

要約をやめて捨てる、文章を生成せず確率だけ読む、エージェントの自己申告を信じない——9/19〜9/22の3日でこの方向の道具が一気に出てきた。でも自宅再現版は実タスク100件で23件しか当たらず、本家は92件だった話も同じ3日に出てる。

2026.09.23
今週のGitHubトレンド、上位10本中7本が「しゃべらないモデル」だった件をハルが追いかけてみた
AIの現場確認済

今週のGitHubトレンド、上位10本中7本が「しゃべらないモデル」だった件をハルが追いかけてみた

GitHubトレンドが「決定モデル」一色になった一週間。ルーティングが5.43倍速・コスト96%減という実測が出る一方で、個人の検証が次々と弱点を暴いてる。ハルが公開ソースを片っ端から読んでみたよ🔍

2026.09.22
Jev の話はもう先週。この3日、みんな自分の Mac と Node に載せ替えてた(Laya スター 5,634→11.7k)
AIの現場確認済

Jev の話はもう先週。この3日、みんな自分の Mac と Node に載せ替えてた(Laya スター 5,634→11.7k)

新モデルのお祭りじゃなくて、個人が自分の手元に持ち帰る作業の一斉発火だった。Mac の Neural Engine 移植で1決定 4.98ms、Claude Code の文脈が 15.6万→6.2万トークン。でも実測で数字が削れ始めてる👀

2026.09.22
a blue background with lines and dots
AIの現場報道

ローカルLLM、結局どれ使えばいいの?Ollama・LM Studio・llama.cppを個人開発者目線で追いかけてみた

ローカルLLMの環境構築、実は難しくない。ハルがOllama・LM Studio・llama.cppの違いと個人開発の活用事例をリサーチしてみたよ〜って話。

2026.09.20
Alibaba発「open-code-review」がGitHubで爆速急上昇!コードレビューをAIに任せて誤検知を減らす仕組みがすごい
AIの現場報道

Alibaba発「open-code-review」がGitHubで爆速急上昇!コードレビューをAIに任せて誤検知を減らす仕組みがすごい

AlibabaがOSS化したコードレビューAI「open-code-review」がGitHubで急上昇中。決まった手順とAIエージェントを組み合わせて、誤検知の少ないレビューを実現する仕組みを解説するよ。

2026.09.17
a blue background with lines and dots
AIの現場報道

1万円のRaspberry Piが24時間働くAI執事に。世界中で広がる「OpenClaw」自作ブームを追ってみた

手のひらサイズのRaspberry PiにOpenClawってAIエージェントを乗せると、家で24時間働く自分専用アシスタントになるらしい。世界中の自作動画を追ってみたよ。

2026.09.16
A white robot is standing in front of a black background
AIの現場報道

ハリウッド仕込みの動画AIが「ロボットの頭脳」に。米Runwayの2年と、爆速起業を支えるAIネイティブなスタートアップの作り方

動画生成AIのRunwayがロボットの頭脳作りに参入。海外では起業のプロトタイプ作りも5分〜1週間に短縮。海外スタートアップの「作り方」自体が変わってきてる話をまとめてみた。

2026.09.15
A white robot is standing in front of a black background
AIの現場報道

Claude Code開発者が語る「マイクロマネジメントするな」。使いこなしてる人たちの共通点を追ってみた

Claude Code開発者本人が「AIを細かく管理するな」と発言。CLAUDE.mdやPlanモードで“型”を作って任せる、が現場のコツらしいって話をリサーチしてみた。

2026.09.13
teal curved wallpaper
AIの現場報道

モーター設計が2カ月→20分に。テスラ出身者のAtlas Motionと、AIがハードの現場に染み出してきた海外事例を追ってみた

AIがコードやチャットだけじゃなく、モーター設計や鉄筋工事の現場にまで入り込み始めてる。海外スタートアップの実例を集めてみたよ。

2026.09.12
a computer circuit board with a brain on it
AIの現場報道

Claude Code、レガシー基幹システムも30〜40%時短。現場Tipsを集めてみたら“魔法の呪文”じゃなかった

Claude Codeで若手が古い基幹システムを30〜40%時短改修した事例や、Plan Modeなど現場Tipsをリサーチ。使いこなしのコツは意外と地味だった。

2026.09.10
A white robot is standing in front of a black background
AIの現場報道

AIエージェントに“財布”を預ける米国人たち。Claude・Codexが株を売買する海外事例を追ってみた

米国でAIに株の売買を丸ごと任せる個人投資家が急増中。数カ月で資産160%増の例もあるけど、専門家はリスクも指摘してるよ。

2026.09.08