週刊AIブリーフィング|モデルを比べる前に、評価・利用量・受け渡しを見る
2026年9月13日〜19日号|対象記録:9月13・14・16・17・19日
音声で会話するモデル、定型の判断を返すモデル、文書・スライド・デザインを一つの会話から扱う仕組み。選択肢が増えた今週は、導入判断に「どれが最も賢いか」以外の材料も並びました。
誰が評価したのか。どの仕事が利用量を使ったのか。途中成果を次の工程へどう渡すのか。今回は、記録が揃った9月13、14、16、17、19日の発表と実例から、モデル名の一段先にある比較軸をまとめます。
目次
新発表は、能力より先に使う条件まで読む
今週重なったのは、選択・評価・観測の三つ
反響の大きかった三つは、数字の先まで読む
今週じっくり見る工程:2人と数百のエージェントでCobbleDBを作る
使い方の例は、入力・承認・出力で見る
次に比較表へ足す四つの列
この投稿を読み続けるには購読してください
...
QAILaboratory|業界の歩調ではなく、自分の運用ルールを先に決めておく
こんにちは、QAILaboratoryの鳴海です。
先週は、大手各社の足並みがどれだけ早く崩れたかではなく、それでも変わらない自分の運用ルールをどう先に決めておくか、のほうを見ています。
9月13日、Anthropicのダリオ・アモデイCEOが、最前線を走るAI開発のペースを落とすべきだと訴えるエッセイを自身のブログで公表しました。その2日後、トランプ大統領は自身のSNSでこの主張を退け、中国外務当局も同じ提案を批判しています。同じ週、Metaのマーク・ザッカーバーグCEOも、各社が自主的にペースを管理すればよいとして、足並みをそろえる案には加わりませんでした。
外の歯止めがいずれできる、それまでは様子見でよい。そう思いたくなるところですが、この数日の動きを見る限り、歯止めがいつ・どんな形でできるかは、今のところ誰にも分かりません。
■ 足並みが崩れる速さのほうが、内容そのものより見...
今週、こんなものを書きました|AIと、ことばと、音楽
こんにちは。鳴海です。
今週、こんなものを書きました。
■ AIのニュースから、次に試す使い方を見つける
新発表と実際の工程をつなぎ、仕事や作品づくりで次に試すAIの使い方を選べる二つの週刊ニュースレターを紹介しました。
https://www.narumitakayoshi.com/blog/weekly-ai-briefing-guide
■ AIの「最後の同意」を、仕事の根拠にしない ― 5モデルで試した記録
5つのAIへ反論を重ねた小規模試験から、会話の最後の同意を正解にせず、根拠を長い会話の外で確かめ直す方法を整理しました。
https://www.narumitakayoshi.com/blog/ai-last-agreement-not-evidence
■ AIは判断に、コードは計算に——18分のエージェントが85秒になった理由
広告運用エージェントの事例...
QAI Laboratory
