Getting the transcript
Reading the captions from YouTube. A video nobody has opened here before takes 10 to 30 seconds; this page fills in on its own.
Getting the transcript
Reading the captions from YouTube. A video nobody has opened here before takes 10 to 30 seconds; this page fills in on its own.

サルでもわかるAIにゅーす速報【ゆっくり解説】 · @おさるの惑星
Words
348
Runtime
24:18
Speaking pace
14wpm
Reading time
1min
14 words per minute, below the 160 25th percentile of 349 measured videos. That distribution comes from the 349-video hook study.
Opening (first 30 seconds)
ゆっくり霊夢よ。 ゆっくり魔理沙だぜ。今日は自分が使っている AI が黙ってバカになる話をしていくぜ。オープン AI が今朝画像の理解を劣化させていたバグを直したと発表した。日本時間の 9月28日午前1時49分の投稿だぜ。
7 words, the words spoken in the first 30 seconds at 14 words per minute.
Free, no signup. See how the first 30 seconds hold attention, with rewrites.
Sentence shape
| Measure | This transcript |
|---|---|
| Sentences | 7 |
| Average words per sentence | 49.7 |
| Longest sentence | 98 words |
| Questions asked | 6 |
| Sentences containing a number | 7 |
Most used terms
What this transcript is
Every word below is the caption track YouTube publishes for this video, pulled from the video itself and reproduced unchanged. It is not Prepublish's writing, not a summary, and not a re-transcription: it is the video's own published captions. Japanese captions, generated automatically by YouTube, in the video’s original language. Source: the video on YouTube. A channel that would rather this page did not exist can ask for its removal through the contact page, and it is removed.
No Script X-ray for this video: YouTube shows a Most replayed graph only once a video has enough views.
ゆっくり霊夢よ。 ゆっくり魔理沙だぜ。今日は自分が使っている AI が黙ってバカになる話をしていくぜ。オープン AI が今朝画像の理解を劣化させていたバグを直したと発表した。日本時間の 9月28日午前1時49分の投稿だぜ。 劣化させていたってそれって治る前は今より下手だったって意味になるのよね。 そうだ。同じモデルに同じ画像を渡しても帰ってくる答えの質が違っていた。しかもモデルの名前はその間ずっと同じまだったぜ。 [音楽] GPT6 ソルという名前は最初から最後まで一文字も変わっていない。 名前が同じなら中身も同じだと思うのが普通よ。別物になるなら別の名前にして欲しいわ。 その普通が通じないのがクラウドで動いている AI なんだ。今日の入り口はそこだぜ。値段も上がっていない。むしろ前の世代よりかなり安くなっている。安くて名前も同じでそれで中身だけは悪くなっていたんだ。 それ気づける要素が1 つもないじゃない。私たちは何を手がかりにすればいいのよ。 ないんだ。 だから利用者は最後に自分の感覚の方を疑うことになる。今日はなんか調子が悪いなという一言で話が終わってしまうんだぜ。心当たりがあるわ。私も急に話が通じなくなったと感じて首をかげた時期があるもの。 その感覚が気のせいではないことを今日は仕組みの側から裏付けていくぜ。ちなみにみんなが最初にこいつ急に馬鹿になったなと思った AI は何だった?猿博士の場合はジェミにだったらしいぜ。 私もそれよ。 理解力が落ちた気がして前の状態に戻って欲しいと思ったわ。 同じことを言っている人はこの動画のコメント欄にも来ていたぜ。 回の動画にまさにその書き込みがついていたんだ。 じゃあみんな同じことを感じてたのね。ただ誰も確かめる手段を持っていなかっただけで。 今日はそれを公式の記録の側から確かめられる珍しい会になるぜ。オープン AI 自身が劣化させていたと書いてくれているからな。 自分の方から認めたのね。 それはなかなか珍しいことなんじゃないの? そこは誠実だと思うぜ。ただ認め方の方に少し引っかかる点が残っている。それじゃあゆっくりしていってね。今日はこの [音楽] つが分かるぜ。なぜモデルの名前が同じま中身だけが入れ替わるのか。劣化はいつからまで続いていたのか。自分の AI が劣化した時どうすれば気づけるのか。 つ目が1 番知りたいわ。気づけないまま使い続けるのが 1番気持ち悪いもの。 まずは何が起きたのかを公式の文面から順に抑えていくぜ。発表したのはオープン AI の開発者向けの公式アカウントだ。画像の理解を劣化させていたバグを直したとはっきり書いてある。 バグを直したっていう言い方だと普通は良い報告として受け取るわよね。 そうだ。直した話なんだから形としては前向きなお知らせだぜ。ただこの短い分は直したと同時にもう つのことを認めている。今までは悪かったというかこの事実の方だぜ。 いい報告と悪い報告が 1つの分に同時に入っているんだ。 言われてみればそうね。直したというためには壊れていた時期がいるわけだから。 対象になったのはGPT6ソルとGPT6 ルナの2 つだ。どちらも今月出たばかりのオープン AI の新しい水論モデルだぜ。文章と画像を受け取って文章で返すタイプのモデルだ。 画像も見られるモデルなのね。写真を渡してこれは何かと説明させるやつよね。 そうだぜ。 そして今回壊れていたのはその画像側の処理だけなんだ。文章だけを渡して使っていた人には多分何も起きていない。画像を渡していた人のところにだけ質の低下が出ていたぜ。 [音楽] それは余計に気づきにくいわね。周りに聞いても誰も困っていないかもしれないもの。 まさにそこだぜ。困っている人が限られると自分だけの問題に見えてくる。公式の分はもう少し具体的で影響が出る場所まで書いてある。 APIとコデックスでの画像を使う作業。 それにコンピュータ操作だぜ。 コンピュータ操作ってAI が画面を見て自分でパソコンを動かすあれのことよね。 よく覚えていたな。画面のスクリーンショットを見ながら動くやつだ。あれは画面を画像として読むから画像の処理が落ちれば直撃するぜ。見えているものが曖昧になった状態で操作をさせていたことになる。 それ結構怖いわね。目が悪くなった人にそのまま車を運転させてるようなものじゃない。 近いぜ。しかも本人には目が悪くなった自覚がないまま運転しているんだ。 ここで今日ずっと使っていく例えを先に出しておくぜ。この先の話は全部この例えの上で説明していくからな。行きつけの定食屋を思い浮かべてくれ。 定食屋。急に話が変わったわね。今日は AIの話をしていたんじゃなかったの? これがAI の話なんだ。看板は同じ、値段も同じ、席の並びも同じだぜ。ところがある 日間だけ厨房の料理人が別の人に変わっていた。店の外からはそれが分かる表示はどこにも出ていないんだ。 味が変わったら気づくんじゃないの?いつも食べているものなんだから分かるはずよ。 そこが微妙なところだぜ。全然違う味なら誰でもすぐに気づく。ところが少し落ちただけだと人は自分の方を疑い始めるんだ。疲れているのかな?今日は体調が悪いのかな?という話になっていく。 ああ、それはやるわ。お店を疑うより先に自分の下の方を疑ってしまうのよね。 今回のAI で起きたのがまさにその形だぜ。 看板がモデルの名前で料理人がサーバーの中で動いている実態だ。値段はむしろ下がっていたから疑う理由がさらに減っていたぜ。安くなった上に名前も同じなら文句を言う気にもならないわね。特した気分になるもの。 公式はもう1 つ。利用者に向けた呼びかけも書いているぜ。画像を使う用途評価をやり直すことを推奨すると書いてある。影響を受けた作業はもう 1度試して欲しいとも書いてあるぜ。 評価をやり直すってどういう意味なの?誰が何を測り直すことになるのよ。 自分の仕事でこのモデルが使えるかを点数をつけて試した人たちがいるんだ。会社で導入するかどうかを決めるために試験をする担当者だぜ。その試験を壊れた状態のモデルに受けさせていたことになる。 [音楽] それは大事な話じゃない。落としたモデルが本当は使えたかもしれないってことよね。 そうなるぜ。しかも落とした側はその判断を直す機会がないかもしれない。 1度ダメだと結論が出た道具をもう 1度試す会社は多くないからな。 壊れていた3 日間の判断がそのまま残ってしまう可能性があるぜ。 バグが治っても下がった評判の方は治らないってことになるのね。それは木の毒だわ。 [音楽] ここが今日の2 つ目の疑問につがっていくぜ。壊れていたのはいつからまでだったのかという話だ。期間が分からないとどの判断をやり直すべきかも決められないからな。 [音楽] その前に1 つ聞いていいかしら。画像の処理ってそもそも何をしているものなの? いい質問だぜ。そこを抑えるとなぜ壊れ売るのかが見えてくる。 AI は画像見ているわけじゃないんだ。画像は一旦数字の列に直されてからモデルに入るぜ。 数字?写真が数字になるの?それはちょっと想像がつかないわね。 前に犬の検索の会でやったやつだぜ。まあ覚えていないだろうけどな。 忘れたわ。写真を数字にするって色を番号に置き換えるみたいな話だったかしら。 近いぜ。まず画像を細かい正方形のタイルに切り分けるんだ。その 枚ずつを色と模様を表す数字の並びに置き換える。 その数字の並びを順番につげたものがモデルへの入力になるぜ。 つまり写真を細かく刻んで数字の紙に映し取ってから渡しているってことね。 その理解で十分だぜ。そしてこの映し取る作業を画像エンコードと呼ぶ。今回オープン AI が壊れていたと言っているのはまさにここだぜ。公式の分にも画像エンコードのバグだとそのまま書いてある。モデル本体ではなくモデルに渡す前の下ごの方だ。 下ご定食屋の話に戻すと材料を切るところってことになるのかしら。 [音楽] その通りだぜ。料理人の腕そのものは何も変わっていない。野菜の切り方が雑になって出来上がりだけが落ちたという形だ。包丁の入れ方が変わるだけで味は確かに落ちるからな。 [音楽] 厨房の中で起きている話だから店の外から分かるはずがないわね。納得したわ。 ここが大事な点だぜ。壊れたのは頭脳ではなく目の方なんだ。モデルは渡された数字を真面目に読んで真面目に答えている。ただ渡された数字が元の画像を正しく映していなかっただけだぜ。 それってAI は嘘ついてないのよね。自分に見えたものを正直に答えているだけで。 そうだぜ。だから答えに自信がないようにも見えないんだ。自信満々のまま少しずれた答えを返してくることになる。この形が 番立ちが悪いぜ。間違いの合図がどこにも出ないからな。 エラーが出てくれたら分かるのに普通の顔で答えが返ってくるのが厄介ってことね。 では本題に入るぜ。なぜ名前が同じま中身が変わるのか。 ここは仕組みの話であって、オープン AIが手を抜いたという話ではない。 GPT6 ソルという名前が何をさしているかを考えてくれ。モデルそのものの名前でしょ。製品の名前みたいなものだと思っていたんだけど。 そこが少し違うんだ。あれは呼び出し先を指すアテナに近いぜ。自分の手元にファイルがあってそれを動かしているわけじゃない。名前を書いてお送ると向こうが用意した仕組みが答えを返してくる。 つまり相手の家の中がどうなっているかはこっちからは全く見えないのね。 見えないぜ。 そして向こうの中身はいくつもの部品でできている。画像を数字に直す部品、それを読む部品、文章を作る部品だ。今回壊れていたのはその 番手前の部品だけだったことになる。このどれかを差し替えてもアテナは同じまで通ってしまうんだぜ。 アテナが同じなら届く先の中身が変わっても気づけないってことになるわね。 そうだ。ここが今日の1 つ目の答えになるぜ。モデルの名前は中身が同じであることを何ひつ約束していない。 名前がさしているのはその時その場所で動いている構成の方だ。 じゃあ名前を信じて前の世代と比べるのはそもそも無理があったってことなのね。 厳しく言えばそうなるぜ。ナ札ダは中身の保証書ではないんだ。定職屋の看板が中の料理人を保証していないのと同じだぜ。官板は場所を示しているだけで中にいる人までは示していない。 [音楽] 自分のパソコンで動かす場合はそこはどうなるのかしら?同じ問題が起きるの。 そこが今日のもう1つの軸だぜ。 後半でしっかり扱うから待っていてくれ。先に日付の話を片付けておきたい。壊れていた期間の方だぜ。ここは公式の記録を並べるだけでかなりはっきりする。 公式が期間を発表したの何日から何日まで壊れていましたって形で していないぜ。そこは発表されていない。分からないままだ。ただ日付を並べていくと上限の方は絞り込めるんだ。猿博士が公式の記録を自系列で並べ直したらしいぜ。 記録っていうのはさっき出てきた投稿とはまた別にあるものなのね。 あるぜ。オープンAI は開発者向けに変更の記録を公開している。どの日に何を変えたかが日付きで並んでいるページだ。そこにこのバグの修正もきちんと載っているぜ。 [音楽] じゃあそれを見れば治った日の方は分かるってことになるわね。 分かるぜ。そして少し意外な日付が書かれていたんだ。修正が載っているのは 9月25日の項目だぜ。 待って。さっき発表は9月28日の午前1 時49分だって言ってなかった。 言ったぜ。そこが今日1番地味で1 番聞く発見だと思っている。記録の上では [音楽] 25日に治っていて告知は 27日、日本時間で28 日だ。つまり治ってから知らせが届くまでにさらに 2日あるぜ。 治った後も2 日間利用者は壊れたままだと思い込んでいたってことになるのね。 そういう形になるぜ。ただ糸までは分からないからそこは断定しない。 公式の記録が25日付けで告知が27 日だという事実だけを見ている。わざと送らせたのかどうかは外からは判断できないからな。 送らせた理由が分からなくても空白があったこと自体は変わらないわね。 そこだぜ。そしてもう片方の日付の方がもっと重い。 GPT6ソルトルナが4に出たのは9月 日だ。同じ記録のページに公開の項目としてきちんと乗っているぜ。 22日に出て25 日に治ったということはその間はずっと 日だぜ。公開されてから 日間画像の理解は落ちた状態だった。新品として出てきたその瞬間から目が少し悪かったことになる。途中で壊れたのではなく店開きの日から料理人が違ってたんだ。 それだと元の味を知らないじゃない。比べる相手が最初からないことになるわ。 今日1 番低く指摘をしたな。まさにそこが厄介なところなんだ。 前の味を知らない人は落ちた状態を本来の味だと思って食べる。これがこのモデルの実力かと受け取って終わってしまうぜ。 最初に食べたものが自分の基準になるから下がったことに気づけないのね。 その通りだぜ。しかも公開直後は 番多くの人が試す時期だ。新しいモデルが出た週はみんなが競って点数を測りに来る。記事も動画もその週に出たものが 1番読まれることになるぜ。その 1番人が集まる3 日間が丸ごと壊れていたことになるんだ。 1番見られている時に1 番悪い状態だったの。それは運が悪いとしか言えないわね。 ただ念のため言っておくといつ壊れたかは公式が言っていない。 [音楽]22 日の公開時点から壊れていたのかその後で入り込んだのかは分からない。言えるのは遅くとも 日には治っていたという上限だけだぜ。 分からないことは分からないままにしておくのね。そこは大事なところだと思うわ。 ない数字を作って埋めるのが 番やってはいけないことだぜ。さて、ここまでで気づける手がかりを 2つ潰したことになる。 名前は変わらない。値段も変わらない。この 2つはもう使えないぜ。 残っているのは点数じゃないの?ベンチマークっていう試験があるんでしょ? そう来ると思ったぜ。ではその点数を頼りにできるか実際に試してみよう。猿博士がこのモデルの点数を出所別に並べ直したらしい。同じモデルの同じ試験の点数を複数の場所から集めてきたんだ。ここは今日の話の中で 1番当てが外れたところだぜ。 同じモデルの同じ試験ならどこで見ても同じ数字になるはずよね。 そうでしょう。 そう思うだろう。ところが集めてみたらまるで揃わなかったぜ。 OS ワールドというコンピューター操作の力を測る試験がある。画面を見て操作する試験だから今日の画像の話にも直接関わるぜ。 さっき出てきたコンピューター操作ね。画像が壊れていたら点も落ちるはずだわ。 その通りだぜ。だからこの試験の点数を 1番確かめたかったんだ。ある解説記事は GPT6ソルが60.5 点だと書いていた。 別の比較サイトは同じモデルを 64.4点だと書いていたぜ。4 点近く違うじゃない。どちらかが間違っているってことになるのかしら。 そう単純でもないんだ。よく読むと試験の名前が微妙に違っていた。片方は OSワールド2.0。もう片方はOS ワールド2.0オフラインだ。 名前が似ているだけの別の試験だったということだぜ。 そんなの見分けられないわよ。どっちも OSワールド2.0に見えるじゃない。 見られないぜ。そして食い違いはそれだけじゃなかったんだ。 同じ試験でもどれだけ考えさせたかの設定が違っていた。たくさん考えさせた点数と控えめに考えさせた点数が並んでいたぜ。 条件が違うものを同じ表に並べて比べていたってことになるのね。それはダめだわ。 [音楽] そうなるぜ。しかも勝ち負けの向きまで出所によって逆だった。あるところでは新しい方が買っていて、別のところでは負けていたんだ。同じモデルの同じ名前の試験で勝敗が逆に書かれていたぜ。 それはもう点数を持ってきても話が始まらないじゃない。 何を信じればいいのよ。 だから今日はこの点数を証拠としては使わないことにしたぜ。数字を並べて煽る方が動画としては正直に言って楽なんだがな。どれが正しいか決められないものを断定する形では出せない。 分からないなら分からないという方が後で恥を書かなくて済むものね。 ただこの食い違いそのものが今日の話の証拠になっているぜ。点数も劣化を見分ける道具にはならないということだからな。名前も値段も点数もダメだと手がかりが 3つとも消えたことになる。 本当に何も残らないのね。利用者の側に武器がなさすぎる気がしてきたわ。 ここで思い出して欲しい会があるぜ。 177回だ。GPT6アストラの点数が1 日で61点から55 点に落ちた話をした。あの時はモデルは何も変わっていなくて試験の方が変わったんだ。 測る側が変わったから点が動いたっていう話だったわね。それは覚えているわ。 今日はその完全な裏返しだぜ。試験は変わらずモデルの方が変わった。 [音楽] あの時は物差しが縮んで今回は測られるものが縮んだんだ。どちらの場合も点数を見ている側には同じ光景に見えるぜ。どっちが動いたのか分からないのね。点が下がったことしか見えないんだから。 [音楽] そこが今日1 番覚えて帰って欲しいところだぜ。点数が動いた時原因はモデルと試験のどちらにもありうる。どちらが動いたかは点数だけを見ていても切り分けられない。片方が固定されている保証がないと比較そのものが成立しないんだ。 [音楽] 定食屋だと味が落ちたのか自分の下が変わったのかわからないってことになるのね。 うまく戻したな。まさにその形で両方が同時に動き売るんだ。もう つ同じ時期に別の指摘もあったので触れておくぜ。ただしこちらは個人の観測で公式の裏付けはない話だ。 裏がない話も紹介するのね。そこは分けて聞いた方がいいってことなのかしら。 分けて聞いてくれ。ある観測者が会話の好みの順位を見ていたんだ。 人に2 つの答えを見せてどちらが好きかを選ばせる方式の順位だぜ。そこで新しい GPT6 ソルが前の世代より大きく下がっていたと書いている。 それも劣化じゃないの?今日の話と同じことが起きているんじゃないのかしら? ここは慎重に行くぜ。その順位は文章の方の話なんだ。今日の画像エンコードのバグとは対象がそもそも違っているぜ。だから同じ原因だとは言えない。繋げてしまうと嘘になる。 画像が壊れていたから会話も下手になったとは言えないってことね。 分かったわ。 言えないぜ。同じ時期に別の指摘もあったという以上のことは言わない。こういう時に無理につなげると大抵後で恥を描くからな。では最後だぜ。自分の AI が劣化した時どうすれば気づけるのか。 それを待っていたわ。手がかりが何もないっていう話だったじゃない。 向こうから来る手がかりはないぜ。だから自分の側で作るんだ。やることは つでいつも同じ人皿を注文しておくことだぜ。 定食屋で味を確かめたいなら毎回同じ定食を頼むのが確実だからな。 日替代わりを頼んでいたら味が落ちたのか今が違うのか分からないもんね。 その通りだぜ。だから固定した入力を自分の手元に置いておくんだ。具体的には同じ画像と同じ指示を極用意しておくぜ。難しいことはしなくていい。同じものを毎回使うだけだからな。それを新しいモデルが出た日に投げて答えを丸ごと保存する。 答えを取っておくのね。4 で満足してそのまま消してしまいそうだけど 消したら意味がないぜ。後で比べる相手がなくなってしまうからな。保存する時は日付とモデルの名前も一緒に書いておくんだ。答えの全分をそのまま残すのが大事だぜ。ようやくすると比べられなくなる。 自分専用の試験問題を作って毎回それを受けさせるってことでいいのかしら。 その理解でいいぜ。世の中の点数と違ってこれは条件が動かない。自分で作った問題で自分で保存した答えと比べることになるからな。 出所によって数字が違うというさっきの問題も起きないぜ。 あの食い違いが起きないのは条件を自分が握っているからってことね。そこが勘だぜ。 5組もあれば4 組で同じ傾向が出た時に疑える。 組だけだとたまたま機嫌が悪かったのかもしれないで終わる。数を持っておくことで気のせいかどうかを自分で判定できるぜ。 気のせいかどうかを自分で決められるのは確かに気が楽になるわね。 選ぶ画像は自分がつも実際に使う種類のものにするといいぜ。 表とグラフ、手書きの文字、画面のスクリーンショットあたりが効く。綺麗な写真だけだと少しの劣化では差が出にくいからな。 ちょっと読みにくいものを混ぜておくのね。そこで先に差が出るってことかしら。 そうだぜ。ギリギリ読めるものが 番早く壊れ方を教えてくれる。猿博士も記録を取っていて、今回の食い違いに気づいたらしいぜ。記録がないとこういう話は全部ただの感想で終わってしまうからな。 画像を使う人は特にやっておいた方がいいってことになるわね。 ここでもう一方の陣営の話をしておくぜ。自分の機械で動かす側だ。重みを自分で持つモデル、いわゆるオープンウェイトの方だぜ。ダウンロードして自分のパソコンで動かすやつよね。それは何が違ってくるの? 決定的に違う点が1 つあるぜ。中身を自分で固定できるんだ。落としてきたファイルには内容を表す固の値をつけられる。中身が 文字でも違えばその値も丸ごと変わる仕組みだぜ。その値を取っておけば同じファイルかどうかを機械で確かめられる。 ファイルが同じなら去年の答えが今年も再現できるってことになるのね。 そうなるぜ。しかも知らないうちに差し替えられることが起きない。自分の台所で自分の材料で作っているのと同じ状態だからな。料理人がいつの間にか変わっているということが起きないぜ。 [音楽] じゃあそっちの方がいいってことになるのかしら。安心感はありそうだけど。 そう単純ではないぜ。いいところだけ並べるのは公平じゃない。自分の台所にはいい面と面倒な面が同じだけあるからな。 まず機械を自分で買う必要がある。電気代も置き場所も自分持ちだぜ。 言われてみればそうね。クラウドは何も持たずにその日から使えるんだから。 そして治らないバグも自分持ちになるぜ。誰も直してくれないんだ。今回みたいに誰かが勝手に直してくれることは起きない。壊れたまま気づかなければ壊れたまま使い続けることになるぜ。 [音楽] あら、それは同じ問題が起きるじゃない。気づけないままっていうところが [音楽] 起きるぜ。固定できることと良くなることは別の話だからな。 クラウド側にもちゃんと言い分があることは言っておきたい。今回オープン AI は自分から劣化させていたと公表したぜ。 黙って直して終わりにすることもできたのにわざわざ言ったのね。 できたぜ。中身は勝手に差し替えられるんだから黙れば分からない。それを書いて評価をやり直すよう呼びかけたのは誠実な側だと思う。バグは誰にでもあるし治ったことで特をするのは利用者だからな。 どっちが正しいっていう話じゃないのね。何を自分で握りたいかの違いで。 今日はそこを結論にするつもりだぜ。どちらが上とは言わない。手間をかけずに良くなって欲しいならクラウドが向いている。同じ答えが変える保証が仕事に必要なら自分で持つ方が向くぜ。 仕事の内容で変わるってことね。私は全車でいい気がしてきたわ。 それでいいぜ。大事なのはどちらを選んでも記録を残すことだ。クラウドを使うなら同じ人皿を頼んで答えを保存しておく。自分で持つならファイルの値を書き止めておくんだぜ。 どっちにしても自分の手元に基準を持つっていうところは同じなのね。 そこが今日の持ち帰りだぜ。基準を他人に預けないことだ。名前も値段も点数も他人が動かせるものだったわけだからな。他人が動かせるものだけを並べて比べても答えは出ないんだ。動かないものを [音楽] つだけ自分で持っておけばそれで気づけるぜ。 今日の話で言うと保存しておいた答えがその動かないものになるのね。 最後に今日の中身をまとめておくぜ。 オープンAIが 画像の理解を劣化させていたバグを直したと発表した。対象は GPT6ソルとGPT6ルなの2 つだぜ。壊れていたのはモデル本体じゃなくて画像を数字に直すところだったわね。 そこが今日の要点の1 つだぜ。頭ではなく目の方が壊れていた。モデルは渡された数字を真面目に読んで真面目に答えていたんだ。だから間違いの合図が出ず自信のある顔で少しずれた答えが変った。 エラーにならないのが1 番厄介っていう話ね。それは覚えて帰ることにするわ。 日付の話も抑えておいてくれ。公開されたのは 9月22 日だ。公式の記録では修正が載っているのは 9月25日の項目だぜ。そして告知は 27日。日本時間では28日の午前1時 49分だ。 出てから3日は壊れていて治ってから 2日は知らされていなかったのね。 そうなるぜ。ただつ壊れたかは公式が言っていない。 日から壊れていたのか途中からなのかは分からないままだ。 言えるのは遅くとも25 日には治っていたという条件だけだぜ。 分からないところは分からないままにしておくのね。そこは徹底しているわ。 そして気づく手がかりが3 つとも使えなかったぜ。名前は変わらず値段は下がり、点数は出所によって食い違った。だから自分で固定した人皿を用意して答えを保存しておくんだ。 同じ画像と同じ指示をご組み日付とモデル名をつけて全分保存ね。やってみるわ。 よく覚えたな。それが今日の持ち帰りの全部だぜ。 回の話と合わせて考えるともっとはっきりするぜ。点が動いた時モデルと試験のどちらが動いたかは見分けられない。片方を自分で固定しないと比べる意味がないってことになるのね。 そこまで言えたら今日は十分だぜ。さあ今日の動画はここまでだぜ。 よかったら高評価とチャンネル登録をお願いします。 みんなが最初に急にバカになったなと思った AIは何だった?コメントで教えてくれ。 [音楽] あとクラウド派か自分で持つ派かどちらかも書いてくれると嬉しいわ。 今日の動画は独自に調査した内容を元に作成しています。 図も独自に作成しています。 それではまたな。 [音楽]
The words are the caption track's own and nothing is reworded or re-transcribed. Paragraph breaks are placed between sentences so the text reads as prose.
Free tools for your own script. No signup, no login.
Paste your draft and see where viewers are likely to drop off, with a rewrite for each weak line.
Paste the first 30 seconds of your own draft for a hook score and rewrites.
Check your draft against YouTube's advertiser-friendly guidelines before you record it.
Read this channel's public videos and transcripts, and download a writing brief for it.