Pinned遠藤聡志 / LifePrompt inc.@endo_lifepromptJan 20【満点9科目!】共通テスト2026を最新版AIに解かせてみた(Chatgpt、Gemini、Claude) 今年も共通テストをAIに解かせてみました! 昨年までは考えられなかった「満点」もいくつかあり、毎年の定点観測として今年もまた興味深い結果になりました
遠藤聡志 / LifePrompt inc.@endo_lifepromptApr 5, 2025【生成AI、東大理3合格】 2025年度東大入試で、ChatGPT o1・DeepSeek R1どちらも理3合格水準であることが、河合塾様の採点協力により明らかになりました! 「東大生レベルの思考に、誰でもアクセスできるようになった」ことが示されたことに意義があります。 ↓スレッドでポイントを解説します↓
遠藤聡志 / LifePrompt inc.@endo_lifepromptJan 16, 2024【ChatGPT vs Bard vs Claude2】 生成AIに、最新の共通テスト(旧センター試験)を解かせて戦わせてみたら、ハイレベルな結果に。 ・結局ChatGPTがNo.1 ・英語はみんな大得意 ・満点は取れそうで取れない ・AIツールごとに個性が出てきた!? などなど、見えてきた傾向などを書いていきます↓
遠藤聡志 / LifePrompt inc.@endo_lifepromptJan 20, 2025【ついに9割!】共通テスト2025をChatGPTに解かせてみた ChatGPT「o1」に解かせたところ、得点率91%で東大合格レベルと、衝撃の結果に。 - 昨年と比べて得点が伸びた要因は? - 逆にどこでミスした? - o1 proならもっととれる? など、解いてみての結果と考察を書いていきます↓
遠藤聡志 / LifePrompt inc.@endo_lifepromptJan 8, 2025【生成AIと人・企業を結びつける架け橋となる】 GPTをはじめとする大規模言語モデル(LLM)は、その生成クオリティや進化スピードが注目されがちですが、 結局何がすごいの?の答えは、「人間とAI・システムが直接コミュニケーションを取れるようになった」という歴史的インパクトであると思います。 Show more
遠藤聡志 / LifePrompt inc.@endo_lifepromptOct 9, 2024【経営課題に直結するAI活用を、現場とともに実現。】 わたしたち株式会社LifePromptは、 - 何をしていいか分からない - 効果が出なかった - AIにはまだ出来ない といった、企業のAI活用で陥りがちな状況に対して、 Show more
遠藤聡志 / LifePrompt inc.@endo_lifepromptSep 13, 2024GPT4-o1は、chatbotアシスタントとしての正統進化だなって感覚で、引用先の深津さんのまとめが「まさに...」という内容ですね! 「シンプルな指示で、より良い出力が出るようになりました」というアップデート。 Show more深津 貴之 / THE GUILD, note@fladdictSep 12, 2024GPT4-o1 ざっくり触った感触 ・GPT4を複数ステップ直列プロセスにした感じ ・命令をサブタスクに分解し、1タスク1体がパスしながら処理? ・複雑な推論が必要な処理思考が得意げ ・一方でプロンプトの細かいニュアンスや縛りは、バケツリレー中に失われるっぽい Show more
遠藤聡志 / LifePrompt inc.@endo_lifepromptDec 11, 2024ChatGPT o1-pro、なんかコンテキスト忘れがち? 内部での思考量が多いから過去の制約条件が薄まっちゃってる気がする。 o1-proは一発出しとしては超性能が高いけど、対話的に絞り込んでいくタイプの利用では使いにくいな。 Show moreOpenAI@OpenAIDec 6, 2024Replying to @OpenAIOpenAI o1 pro modeThe media could not be played.Reload
遠藤聡志 / LifePrompt inc.@endo_lifepromptJul 5, 2024【AIツールの使い分け】 (ChatGPT vs Claude vs Gemini ) ※2024/07/05版 まずは結論。基本Claude 3.5 sonnet。 回答の賢さでは群を抜いている感覚です 他ツールを使う機会がないかというとそうでもなくて... - 画像→テキスト変換にはChatGPT-4o - Show moreしん | LayerX PdM@U2QshinshiroJul 4, 2024ChatGPT、Claude、Perplexityの使い分けが分かってないので誰か教えてください🙏 情報の正確性を求められる系はPerplexity優勢のイメージ(Perplexityについては一度しか使ったことない。多分もったいないことしている)