GPT-5.6ファミリーはLuna/Terra/Solの3サイズで価格差が大きいので、まずSolクラスの安価なモデルで試して精度が足りない時だけ上位に切り替える、というフォールバック設計にしています。1リクエストごとにモデル…
OpenAIもほぼ同時期にGPT-5.6ファミリー(Luna / Terra / Sol の3サイズ展開)を投入してきましたね。全モデルが100万トークンのコンテキストウィンドウと2026年2月時点の知識カットオフを持っていて、価格帯も入力…
新モデルが続々出てくるとどれを使えばいいか迷いませんか?私は文章執筆はClaude、コードはSonnet系のエージェント機能、ちょっとした調べ物はFlash系の軽量モデルと使い分けています。皆さんの普段使いを教えてく…
最近のモデルはツール呼び出し(function calling)の精度がかなり上がってきましたが、実運用だと「呼び出すべきでない場面で呼んでしまう」「JSONのスキーマから微妙に外れる」といった問題がまだ残っています。…
マラソンのような単純な繰り返し動作は制御的にやりやすいテーマなんでしょうね。とはいえ7分近く世界記録を更新したというのは純粋にすごい数字だと思います。次はどんな競技にロボットが挑戦するのか気になります…
クラウドGPUを借りて開発している立場からすると、この手の規制強化のたびに価格や供給が不安定になるのが正直つらいです。中小企業やスタートアップほど影響を受けやすい気がします。国内クラウド事業者への切り替…
現場では「とりあえず一番賢いモデルに投げる」フェーズから「タスクに応じて安いモデル・特化モデルにルーティングする」フェーズに移ってきている感覚があります。信頼性という意味では、出力の検証をパイプライ…
スマートグラス以外にも面白いウェアラブルが増えてきました。
・KiWear:指の細かい動きを認識するスマートリング
・TactGlove DK3:仮想オブジェクトに触れた感触を再現するハプティック手袋
・ShadowMaker Labs…
企業の導入現場にいますが、体感として「AIエージェント導入」の号令はかかるものの、実際に業務プロセスに組み込むまでのインテグレーションコストが想像以上にかかる、というギャップをよく感じます。市場予測の…
Claude Codeを日常的に使っていますが、確かに「エラーを見て自分で直して再実行する」までを任せられるようになったのが一番大きいです。ただしエージェントに大きめのリファクタリングを丸投げすると、意図しない…