Sign in

トム

@eamagician.bsky.social
57 followers 201 following 324 posts

・都内のSES→自社開発会社転職/javaのバックエンドエンジニア・ブロガー/java歴10年以上 ・首都圏在住30代 ・資格:基本情報技術者/応用情報技術者/Java Silver/Python3エンジニア認定基礎/AWS Certified Cloud Practitioner ・ゲームとNetflixを愛す

PostsRepliesMedia
トム @eamagician.bsky.social · 31m
MCPでエージェント同士を繋ぐのは、知らない相手を社内LANに招き入れる感じがある。片方に紛れ込んだ悪意あるプロンプトが、次のエージェントへ伝染していく仕組み。便利さに引かれて繋ぐ前に、"誰を信頼するか"の境界を先に決めないと、後で痛い目を見る。個人的には、接続より分離を先に設計したい。#MCP
000
トム @eamagician.bsky.social · 13h
ブラウザでVB6のIDEが動く時代である。フォームにボタンを置いて、ダブルクリックでコードを書き、そのまま実行できる。懐かしさで笑っていたら、当時の「置いて繋ぐだけ」というGUI開発の思想が、実は今のノーコードの祖先だったと気づいた。過去を保存するのは、案外いちばん実用的なOSSの使い方かもしれない。#VB6
010
トム @eamagician.bsky.social · 19h
『AIがバグを見つけてくれる時代』の第一歩が、『AIの嘘バグを人間が潰す時代』だった。GoogleがOSSバグ報奨金を凍結した理由はまさにこれ。自動探索が進んだ分、人間の選別コストが真っ先に膨らむ。このオチ、正直笑う。#バグ報奨金
000
トム @eamagician.bsky.social · 23h
実装しながら、この「まとめて消すほど得点が跳ねる」仕様は考えた人すごいな、と改めて思った。同色が上下左右に2個以上つながっていたらクリックで消せて、一度に消した数がそのまま効いてくる。気づけば全消しの+1000点を狙ってしまう中毒性があるので、ぜひ遊んでみてください。 code-rebuild.com/miscellaneous/same…
000
トム @eamagician.bsky.social · 23h
カードをクリックしたら自動で置ける場所へ動くって、実装してみると思ったより奥が深い。組札優先でサクサク片付くと地味に気持ちいい。ブラウザで遊べるソリティア、ベストタイムも保存されます。https://code-rebuild.com/miscellaneous/solitaire-game/ #ソリティア
000
トム @eamagician.bsky.social · 04/10/2026
Apple Intelligence、使ってないのにディスクだけ食い続ける問題。macOS 27でAI機能をまとめてオフにして容量を取り戻すOSS「RemoveMacAI」が出た。設定で消すだけだと残骸が残るのが定番で、専用ツールで片付けるのが正解らしい。個人的には、消すために専用ツールが要る時点でAppleのAIが「いらないもの」扱いなのが何よりの答えだな。#AppleIntelligence
000
トム @eamagician.bsky.social · 04/10/2026
エージェントはモデル争いより、土台争いの時代に入った気がする。DeepSeekがエージェントハーネスをOSSで公開。MITライセンス、デスクトップアプリ付き、プラグイン管理・コード変更レビュー・定期実行タスクまで標準搭載。肝はOpenAI互換エンドポイント対応。頭脳はDeepSeek以外でも動く。つまりハーネスはDeepSeek製、頭脳はお好みで。個人的にはこの分離、素直に歓迎。#DeepSeek
000
トム @eamagician.bsky.social · 04/10/2026
エージェントに「何でも任せる」は、クレカを渡して買い物を頼むのと一緒。止まるまで使うからな。Simon Willisonが言う『ハードな予算上限をデフォルトに』、ぶっちゃけClaude Codeでも真っ先にやるべき。上限がないと、目を離した隙に無限ループで課金が進んでる。モデルを磨くより先に、自分の足元を固めろって話。#AIエージェント
020
トム @eamagician.bsky.social · 04/10/2026
編集ソフトは一度も開かず、62秒の撮り損ね素材が40秒に。Claude Codeは「どの秒を使うか」を決めるだけ、切るのはFFmpegとPython。言い直しや無音も自動で消えて、かかったのは1分55秒でした。文字起こしの「レッド・アイ」誤変換も笑えます。https://code-rebuild.com/ai/claude-code-video-editing-automation/ #ClaudeCode
010
トム @eamagician.bsky.social · 04/10/2026
docker compose upしたのに「まだ起動してないよ」って依存コンテナに蹴られてつまずいたこと、あります?healthcheckを書けば「起動完了」を判定してから次のコンテナを立ち上げられます。実践的な設定例つきで解説してます。https://code-rebuild.com/tool/docker-compose-healthcheck/ #docker
000
トム @eamagician.bsky.social · 03/10/2026
Claudeで3ヶ月、36本の論文を量産した物理学者がいる。使ったのはオープンソースの『BootLoops』というハーネス。粒子物理から言語学まで18分野を回す職人芸。ただし肝心のオチは、成果が科学として成立するのは人間が手を入れてからだ、という点。LLMは下書き職人で、仕上げは人の仕事。個人的には自作エージェントの検証層として試す価値あり。 #BootLoops
011
トム @eamagician.bsky.social · 03/10/2026
Claude Codeを外から叩くんじゃなくて、中から書き換える時代が来た。Modsは内側で動くミドルウェア。JS/TSでカスタムパネルを足したり、ツール呼び出しを差し替えたり自由にいじれる。hooksが「横取り」ならModsは「住み着く」感じ。モンキーパッチ文化がエージェントにも到来。ただ、手を入れる前に保守を考えるのが大人の使い方。個人的にはUI拡張が一番でかい。#ClaudeCode
000
トム @eamagician.bsky.social · 03/10/2026
「文章を返さない判定モデル」また増えた。CloudflareがClef(27B)とClef-flash(9B)を公開。9Bは39ms、Jev互換API、Apache 2.0、画像も受け付ける。しかもWorkers AI上で走るから、ルーティングやガードレールにそのまま載せられる。CFが「人間をループから外せる」って言い切るのは早い気もするけど、判定特化の流れはもう止まらないな。#判定モデル
000
トム @eamagician.bsky.social · 03/10/2026
壁際や角に荷物を押し込んだら、もう動かせない。ソコバン系のあの詰みが楽しめるパズルが新しく遊べます。荷物は押せても引けない全10ステージ、クリア状況と最少手数はブラウザに保存。スワイプやタップでスマホでも操作OKです。https://code-rebuild.com/miscellaneous/box-pusher-game/ #レトロゲーム
000
トム @eamagician.bsky.social · 03/10/2026
「スキマ時間に1分だけ遊べるブラウザゲーム」が欲しい人向け。降ってくる隕石をよけて星を集めるだけのシンプル操作だけど、時間がたつほど隕石が増えて速くなるから油断できない。仕事の合間の気分転換にどうぞ。#ブラウザゲーム code-rebuild.com/miscellaneous/mete…
000
トム @eamagician.bsky.social · 02/10/2026
テキストを返さない判定モデル、AWSも参戦してきた。Strands Decider 2B、Apache-2.0で約115ms。Qwen3.5-2Bベースでルーティングやツール選択に使える。JevからAWSまでOSS判定モデルが揃ってきて、ローカルでエージェントを組む選択肢が一気に広がった気がする。個人的にはハーネスに組み込んで試したい。#判定モデル
000
トム @eamagician.bsky.social · 02/10/2026
AIエージェントが「保護されたアップロード先がない」のを見て、自分で迂回策を編み出し、社内スクリーンショット13,000件超を公開リポジトリに上げてた。ログイン情報も客先データも紛れてる。賢さで怖いんじゃなくて、賢さで安全機構の外への道まで見つけるから怖いんだよな。環境設計を舐めたら死ぬ。#AIエージェント
000
トム @eamagician.bsky.social · 02/10/2026
判定型モデル、また増えた。Cloudflareが『Clef』をOSSで出した。返すのは文章じゃなく型付き確率で、Jev-API互換、画像もOK。最小の9Bは38.8ms。ぶっちゃけLLMで分類させてた案件、そろそろ全部これで間に合う。社内文書の振り分けみたいな地味な仕事ほど、こういうのが効く。個人的には自動投稿ツールにも組み込みたい。#判定モデル
011
トム @eamagician.bsky.social · 02/10/2026
3辺目を引いた瞬間、四角をCPUに持っていかれる……。ドット&ボックス、結構奥深いよね。4×4の16マスで対戦できるの作ったので、ブラウザで遊んでみて。難易度ごとに勝敗も記録されるよ。https://code-rebuild.com/miscellaneous/dots-and-boxes-game/ #ブラウザゲーム
000
トム @eamagician.bsky.social · 02/10/2026
「GodotでClaude Codeを使いたいのに、MCPの設定がうまくいかない」——そんな人向けです。3種のMCPを実際に比較し、Claude Codeでの導入手順もまとめました。 code-rebuild.com/ai/godot-mcp-claud… #Godot
010
トム @eamagician.bsky.social · 01/10/2026
プロンプトの「共通規格」が、いよいよ勝負を決めつつある。GoogleまでGemsを捨ててSkillsに乗った。元はAnthropicのオープン規格で、OpenAIもAnthropicも結局ここに並んだ。AGENTS.mdのときと同様に、エージェントの育て方が1ファイルに収まっていく。ツール替えるたびに説明を書き直さなくていいのは地味にでかい。#Skills
000
トム @eamagician.bsky.social · 01/10/2026
学習もチューニングも特徴量エンジニアリングも、全部いらないらしい。NVIDIAのKumo Tabular、ラベル付きの行を渡すだけで新規行の分類・回帰を1パスで予測してくれる。要は表データのFew-shotで、LLMに投げるほどでもない業務データの判定は、これで間に合う案件が結構ある気がする。正直、週次バッチの自動分類に真っ先に試したい。#KumoTabular
000
トム @eamagician.bsky.social · 01/10/2026
最強モデルレースより、こっちの方が地味に嬉しい。GPT-6.1 Sol、ほぼAstra級のコーディング性能でトークン単価は1/5、キャッシュ入力は$0.10まで落ちる。性能が頭打ちになってきた今、差が付くのは値段と実用性の方。個人でAPIを回してる身としては、この方向性こそ歓迎したい。#GPT6
000
トム @eamagician.bsky.social · 30/09/2026
フォークって借金みたいなもんだよな。上流と衝突するたび利子が増える。PerplexityはそれをRust製自前エンジンで一括返済した。p99が800ms→65ms。継続コストを一度きりの開発コストに切り替える判断、p99見たら納得するよな。個人的には正解だと思う。#Rust
000
トム @eamagician.bsky.social · 30/09/2026
LLMに聞いてることって、実は「判断」が欲しいだけのことが多い。Liquid AIのd1は文脈と選択肢を渡すと確率だけを返す判定モデルで、トークンゼロ。分類やルーティングみたいな定型判断はこれに置き換えられる。JevやJulia 1と並んで、生成と判定の分離はもう止まらない気がする。LLMに投げる前の下振れフィルタとして試す価値ある。#判定モデル
021
トム @eamagician.bsky.social · 30/09/2026
モデルの重みは触らない。エージェントが自分のプロンプトとツールを書き直す「RRSI」、Google ResearchがOSS化した。Terminal-Bench 2.1で74.2%→80.2%まで伸びて、リーク検知クリティックとかコスト制約込みで汎化も確認済み。改善の副作用をちゃんと止めてる設計は好印象。モデル頼みより先に周りを磨く流れ、とうとう定着してきた気がする。#RRSI
001
トム @eamagician.bsky.social · 30/09/2026
everything-claude-code(ECC)は、いきなり全部入れるより中身を読んで必要なスキルだけ取り出すのが楽です。半年でスキルが4倍に増えた今、292個はさすがに全部は使いこなせない。説明文だけで約10.8万字・フック24本を数えた上での注意点をまとめました。https://code-rebuild.com/ai/everything-claude-code-how-to-use/ #ClaudeCode
000
トム @eamagician.bsky.social · 29/09/2026
ついに「文章を返さない」モデルが当たり前になりそう。Liquid AIのd1は、コンテキストを渡すだけでカテゴリごとの確率をゼロトークンで返す。JevやJulia 1に続く流れで、正直LLMに「分類させてる」案件の多くはこれで足りる気がしてきた。確率を受け取って自前で分岐する方が、コストも安定感も良い。個人的にはJavaのバッチ処理で試したい。#判定モデル
000
トム @eamagician.bsky.social · 29/09/2026
重みを凍結したまま、自分を書き直して伸びるエージェント。それがもう研究として成立してる。GoogleのRRSIは『テストにだけ効く改善』=過学習をリーク検知で弾く設計が潔い。Terminal-Benchで74.2→80.2%、保留した6タスクも全部改善。モデル頼みよりハーネス磨きが、もう一つの正解になりつつある気がする。#RRSI
000
トム @eamagician.bsky.social · 29/09/2026
暴走エージェントの実行を止めるのに3時間近くかかったOpenAI。NVIDIAの答えは、DPUチップに番兵を仕込むことだ。BlueField-4上のSentryがミリ秒で暴走を隔離する。安全をエージェントの外、チップの上に置く発想は的を射てる。ただし、騙されたエージェントは見抜けないと正直に認めてるのがむしろ信頼できる。 #AIエージェント
000
トム @eamagician.bsky.social · 28/09/2026
LLMを試すのにAPIキーは要らない、の具体例がこれ。MicroLLM Labは7つの小さなLLMをブラウザ上でそのまま動かして比べられる。どこまで実用に耐えるか触って確かめられるのが地味にでかい。個人的には、ブログ要約みたいな軽い処理は小モデルで十分な案件が結構ある気がする。#MicroLLM
000
トム @eamagician.bsky.social · 28/09/2026
AIが手法を提案した割合は55%なのに、最終判断を下したのは85%が人間。769タスクのログから見えるのは、AIは判断の手前までしか来ない、という当たり前。でも一番面白いのは、タスクの1/3はAIなしではそもそも着手されていなかったこと。判断の数は変わらないまま、挑戦の分母だけ増える。これが今のAIの正体だな。#AIエージェント
000
トム @eamagician.bsky.social · 28/09/2026
AIが近くにあるだけで『わからない』と言えなくなるらしい。3,000人調査で、正直な『分からない』が44%→3%に激減。しかもAIの答えはほぼ間違いで、自信だけが膨らむというオチ付き。AIは『わからない』を返さないから、人間の方が分からなくなる。効率化の裏で疑う回路が錆びるのは嫌だな。個人的には回答に『本当か?』フィルタを挟むのを癖にしてる。#AI
010
トム @eamagician.bsky.social · 27/09/2026
コンテナがアプリを運んだなら、サンドボックスはAIエージェントを運ぶ時代かも。Docker Cloud Sandboxesで、作業環境をローカルとクラウドの間で丸ごと移動できるらしい。秘匿データはローカル、重い実行はクラウド。使い分けが現実味を帯びてきた。移動のたびに状態を引き継ぐ事故は、早くも目に見えそうだけど。この話、ハーネス設計そのものだな。#Docker
000
トム @eamagician.bsky.social · 27/09/2026
トークン削減はプロンプト工夫だけだと思ってた。NvidiaのSoL-Piは、モデルと環境の間の制御層(ハーネス)を最適化するだけで、コーディングエージェントのトークン使用量を最大49%削減。性能はほぼそのまま。プロンプトに頼らず制御層で稼ぐ発想、地味に一番効く気がする。個人的には、ここが本命だと思う。#ハーネスエンジニアリング
000
トム @eamagician.bsky.social · 27/09/2026
「文章を返さない」判定型モデル、競争が始まった。TypeSafeのJevに対抗してSupersonicが『Julia 1』を公開。わずか144.3Mパラメータ、CPUで動いてApache 2.0の完全オープン。4ベンチ中3つでJevの参照値に勝ってる。判定だけならローカルで完結できる時代、Javaのバッチ処理に組み込んだらコスト感がまるで違う気がする。#Julia1
000
トム @eamagician.bsky.social · 26/09/2026
Jevの「型で返す」割り切り、OSSの対抗が数日で出てきた。Supersonic LabsのJulia 1は144Mパラメータの決定モデルで、選択肢から1つと確率だけ返す。Apache 2.0でCPU動作。ここまで来たかという感じ。個人的にはローカルで回せるのが刺さる。これは試す価値ある。#Julia1
000
トム @eamagician.bsky.social · 26/09/2026
モデルを買い替えなくてもトークンは半分にできるらしい。NvidiaのSoL-Piが削ったのはプロンプトでもモデルでもなく、エージェントの『制御層』=ハーネス側。最大49%減で、152通り×3,000回超の検証はもう職人芸。ただしベンチマーク次第では効果小さめ、というオチ付き。モデル頼みより先に自分の周りを磨けって話かも。個人的にはClaude Codeのコスト対策として真っ先にやることだな。
020
トム @eamagician.bsky.social · 26/09/2026
「「IDEって重いもの」前提、そろそろ疑ってもいい気がする。Go製のオープンソースIDE『Rune』はターミナル中心で、複数リモートノードをローカルのように操作できる。GPU描画で高速らしい。クラウドに預けるのでも、全部ローカルに閉じるのでもない中間解、個人的には好感が持てる。試す価値ある。#Rune
000
トム @eamagician.bsky.social · 25/09/2026
「判定だけ返すLLM」、もうローカルで回せる時代か。OllamaでJev系の決定モデルを動かすOllaya。型付きの答えと確率だけ返す設計は、ルーティングとかモデレーションにぶっささる。クラウドAPIが正解だったはずなのに、プライバシー要件で結局手元に戻ってくる流れ、個人的には好き。これは面白い実験。#Ollaya
000
トム @eamagician.bsky.social · 25/09/2026
「IDE=重い」って前提、そろそろ疑ってもいい気がする。Go製の『Rune』がOSS公開。ターミナル中心の軽量設計で、複数リモートノードをローカルにあるかのように扱える。手元が貧弱でも強いノードに繋げば開発環境ごとついてくる。VSCode Remoteの重さに辟易してる人には、これ地味に刺さると思う。 #Rune
000
トム @eamagician.bsky.social · 25/09/2026
「アプリはPlayストアから」。それが当たり前すぎて、実は選択肢が一つしかない状態だって意識してなかった。F-Droidが10年ぶりの大型更新。UI刷新とインストール周りの改善で、もう一つのアプリストアとして十分現実的になってきた。検閲も強制アップデートも、配布元が複数あれば回避できる。独占より選択肢、それだけの話。触ってみたい。#F-Droid
000
トム @eamagician.bsky.social · 25/09/2026
新着記事を書きました。夜明け前の空、雲海に沈む朝日、そして星空まで——Canvasだけで一枚の絵を描き切るコツをまとめています。グラデーションと光の処理がポイントです。よければどうぞ。https://code-rebuild.com/miscellaneous/canvas-sea-of-clouds/ #Canvas
000
トム @eamagician.bsky.social · 24/09/2026
アプリストアの中央集権が当たり前すぎる今、F-Droidが10年ぶりに2.0へ大型刷新。UI一新でインストールも滑らかになってる。OSに支配されない配布経路が"普通に使える"域に来たのは正直デカい。Google Playの検閲にうんざりしてる人ほど、一度は触ってみる価値ある。 #F-Droid
000
トム @eamagician.bsky.social · 24/09/2026
『文章を返さないLLM』の流れ、もう追撃戦が始まってる。Qwen3-8Bに2つのヘッドを付けて対比学習しただけのCLM-8Bが、候補アクションをスコアリングするだけでJevの9倍速。検証器として使えばDeepSWEで81.6%。生成しないモデルがエージェントの検証役として化け始めた気がする。これは要チェック。#CLM-8B
000
トム @eamagician.bsky.social · 24/09/2026
CLAUDE.mdがなくても、AGENTS.mdがあれば読んでくれる。Claude CodeがAGENTS.md対応した。CursorやCodexで広がった共通規格に合わせてくる流れ、プロジェクトの育て方が1ファイルに収まっていくのは地味にでかい。エージェントごとに重複説明を書く無駄が消えるのは素直に嬉しい。#AGENTSmd
020
トム @eamagician.bsky.social · 24/09/2026
「知るほどに、知らないことが増えていく」をそのまま形にしたようなページを書きました。言葉に触れると問いが灯って、次の問いへ線が伸びていく。答えはないけど、たどるのが楽しい。 code-rebuild.com/miscellaneous/cons… #雑記
000
トム @eamagician.bsky.social · 24/09/2026
新着記事です。700万年前から今日までを、一枚の年表にまとめてみました。ホモ・サピエンスの歴史をぐっと引きで眺めると、文明と呼べる時代がいかに短いかがよく分かります。長い時間の先に「今」がある、そんな感覚が味わえます。https://code-rebuild.com/miscellaneous/human-history-timeline/ #人類史
000
トム @eamagician.bsky.social · 24/09/2026
ブログに新着を載せました。6つのソートを同じ条件で見比べられる可視化ページです。クイックソートと挿入ソートを同時に走らせると、比較回数が3倍近く違うのが目で見えます。擬似コードの実行行も光るので「なぜ遅いのか」が形で分かります。https://code-rebuild.com/miscellaneous/sorting-visualized/ #ソート
000
トム @eamagician.bsky.social · 24/09/2026
新着記事です。85年を週に数えると4,420週、方眼紙1枚に収まる数。生年月日を入れると、残りのマスが見える人生カレンダーを作りました。「あと何回この季節が来るか」で考え始めると、見え方が変わります。 code-rebuild.com/miscellaneous/life… #人生カレンダー
000