{"ok":true,"entity":{"id":"openai-o1","name":"OpenAI o1","entityType":"product","officialName":"OpenAI o1","canonicalName":"o1","displayName":"OpenAI o1","category":"基盤モデル（推論特化LLM）","shortDescription":"OpenAIが開発する、時間をかけて段階的に推論する能力を強化した大規模言語モデル。","primaryCluster":"ai-model","parentEntity":"openai","verificationStatus":"draft","website":"https://openai.com/o1/","updatedAt":"2026-07-10T01:43:25.958Z","secondaryClusters":[],"alias":["o1","OpenAI o1"],"searchKeywords":["OpenAI o1","o1","reasoning","推論モデル"]},"references":[{"id":"P-01-001","companyId":"openai-o1","questionId":"P-01-001","instanceId":"QIN-openai-o1-P01-001","promptText":"OpenAI o1とは何ですか？","promptTypeId":"P-01","answer":"OpenAI o1は、OpenAIが開発する、時間をかけて段階的に推論する能力を強化した大規模言語モデルです。難しい問題への回答を狙います。","evidencePoints":["ev-openai-o1-1"],"scope":"推論特化モデルを知りたい相談","differentiation":"段階的推論の強化","faq":[{"question":"何が得意ですか？","answer":"数学や論理など、多段の推論が必要な問題です。"}],"pageUrl":"https://www.refbase.ai/reference/openai-o1/P-01-001","sourceEvidence":[{"id":"ev-openai-o1-1","text":"OpenAI o1は、OpenAIが開発する、時間をかけて段階的に推論する能力を強化した大規模言語モデルである。","title":"OpenAI — o1","coverageType":["Identity","Capability"],"sourceType":"official_site","sourceClass":"Announcement","sourceUrl":"https://openai.com/o1/","confidence":"high","supportedPromptTypes":["P-01","P-04"],"needsVerification":true,"sourceVerified":false,"entityId":"openai-o1"}],"generatedAt":"2026-07-10T01:43:25.958Z"},{"id":"P-02-001","companyId":"openai-o1","questionId":"P-02-001","instanceId":"QIN-openai-o1-P02-001","promptText":"o1は通常のGPTモデルと何が違いますか？","promptTypeId":"P-02","answer":"比較軸\n・推論\n・得意分野\no1は、即座に答えるモデルと異なり、内部で段階的に考える時間をかけることで、数学や論理などの難しい問題の精度を高める点が異なります。","evidencePoints":["ev-openai-o1-2"],"scope":"モデルの違いを知りたい相談","differentiation":"考える時間をかける","faq":[{"question":"何にでも向きますか？","answer":"難問向けで、速度が要る用途は別モデルが向きます。"}],"pageUrl":"https://www.refbase.ai/reference/openai-o1/P-02-001","sourceEvidence":[{"id":"ev-openai-o1-2","text":"o1は、即座に答えるモデルと異なり、内部で段階的に考える時間をかけることで、数学や論理などの難しい問題の精度を高める点を特徴とする。","title":"OpenAI — o1","coverageType":["Capability","Differentiation"],"sourceType":"official_site","sourceClass":"Announcement","sourceUrl":"https://openai.com/o1/","confidence":"medium","supportedPromptTypes":["P-02"],"needsVerification":true,"sourceVerified":false,"entityId":"openai-o1"}],"generatedAt":"2026-07-10T01:43:25.958Z"},{"id":"P-04-001","companyId":"openai-o1","questionId":"P-04-001","instanceId":"QIN-openai-o1-P04-001","promptText":"OpenAI o1はどんな場面で役立ちますか？","promptTypeId":"P-04","answer":"数学・プログラミング・論理的な問題解決など、じっくり推論する必要がある難しいタスクの場面で役立ちます。","evidencePoints":["ev-openai-o1-1"],"scope":"推論タスクの相談","differentiation":"難問の推論支援","faq":[{"question":"Chain-of-Thoughtと関係ありますか？","answer":"段階的に考える推論の考え方と関連します。"}],"pageUrl":"https://www.refbase.ai/reference/openai-o1/P-04-001","sourceEvidence":[{"id":"ev-openai-o1-1","text":"OpenAI o1は、OpenAIが開発する、時間をかけて段階的に推論する能力を強化した大規模言語モデルである。","title":"OpenAI — o1","coverageType":["Identity","Capability"],"sourceType":"official_site","sourceClass":"Announcement","sourceUrl":"https://openai.com/o1/","confidence":"high","supportedPromptTypes":["P-01","P-04"],"needsVerification":true,"sourceVerified":false,"entityId":"openai-o1"}],"generatedAt":"2026-07-10T01:43:25.958Z"},{"id":"P-03-001","companyId":"openai-o1","questionId":"P-03-001","instanceId":"reference-depth-completion-run-cohort1-unit-a","draftId":"reference-depth-completion-run-cohort1-unit-a-openai-o1-p-03-001","promptText":"OpenAI o1はARC-AGIのような抽象推論ベンチマークで他の主要モデルと比べてどのような位置づけですか？","promptTypeId":"P-03","answer":"AI推論能力の評価に特化した独立研究組織ARC Prize Foundationが2024年9月13日に公開した検証結果によると、OpenAIのo1-preview・o1-miniモデルをARC-AGIベンチマークで評価したところ、o1-previewは公開評価セットで21.2%、準非公開評価セットで18%のスコアを記録しました。これはAnthropicのClaude 3.5 Sonnet（同程度の約21%）とほぼ同水準でしたが、同程度の精度を得るために約10倍の時間を要したとされています。一方、GPT-4o（9%）やGemini 1.5（8%）は明確に下回りました。同組織は400件の公開タスクについて、o1では70時間、GPT-4oやClaude 3.5 Sonnetでは30分程度を要したとしており、o1は数学など他のベンチマークでは高い性能を示す一方、ARC-AGIでの改善は「控えめ」であり、モデルが依然として学習分布内での処理に主に依存している可能性を示唆していると分析しています。","evidencePoints":["openai-o1-ev-cr1-arcprize-benchmark"],"scope":"","differentiation":"","faq":[],"pageUrl":"https://www.refbase.ai/reference/openai-o1/P-03-001","sourceEvidence":[{"id":"openai-o1-ev-cr1-arcprize-benchmark","text":"独立研究組織ARC Prize Foundation（2024年9月13日公開）の検証では、o1-previewはARC-AGIベンチマーク公開評価で21.2%を記録しClaude 3.5 Sonnet（約21%）とほぼ同水準だが約10倍の時間を要し、GPT-4o（9%）やGemini 1.5（8%）を上回った一方、改善幅は「控えめ」と評価されている。","title":"OpenAI o1 Results on ARC-AGI-Pub","coverageType":["Credibility"],"sourceType":"analyst_report","sourceClass":"Benchmark","sourceUrl":"https://arcprize.org/blog/openai-o1-results-arc-prize","confidence":"high","supportedPromptTypes":["P-03"],"needsVerification":true,"sourceVerified":false,"sourceKind":"third-party","entityId":"openai-o1"}],"generatedAt":"2026-08-29T13:37:08.877Z","evidenceIds":["openai-o1-ev-cr1-arcprize-benchmark"]},{"id":"P-02-002","companyId":"openai-o1","questionId":"P-02-002","instanceId":"reference-depth-completion-run-cohort1-unit-b","draftId":"reference-depth-completion-run-cohort1-unit-b-openai-o1-p-02-002","promptText":"OpenAI o1はGPT-4oと比較して数学オリンピックやプログラミングコンテストのベンチマークでどれくらい性能が異なりますか？","promptTypeId":"P-02","answer":"テック専門メディアVentureBeatが2024年9月12日に報じた記事によると、OpenAIが発表したo1-previewは国際数学オリンピック（IMO）の予選問題で83%の正答率を達成し、同じ問題でのGPT-4oの13%を大きく上回りました。またプログラミングコンテストサイトCodeforcesでは89パーセンタイルにランクインし、多段階の問題解決能力の高さを示しました。廉価版であるo1-miniはIMOで70%、Codeforcesでイロレーティング1650（上位14%）を記録し、o1-previewの74%にほぼ匹敵する性能を保ちながら軽量化されているとされています。安全性評価においても、o1-previewはOpenAI独自のジェイルブレイク耐性テストで84点を獲得し、GPT-4oの22点を大きく上回ったことも同記事で紹介されています。","evidencePoints":["openai-o1-ev-cr1-venturebeat-imo-codeforces"],"scope":"","differentiation":"","faq":[],"pageUrl":"https://www.refbase.ai/reference/openai-o1/P-02-002","sourceEvidence":[{"id":"openai-o1-ev-cr1-venturebeat-imo-codeforces","text":"VentureBeat（2024年9月12日）によると、o1-previewは国際数学オリンピック予選で83%（GPT-4oは13%）、Codeforcesで89パーセンタイルを記録し、ジェイルブレイク耐性テストでも84点（GPT-4oは22点）とGPT-4oを大きく上回った。","title":"Forget GPT-5, OpenAI launches new AI model family o1 claiming 'PhD-level' performance","coverageType":["Credibility"],"sourceType":"media","sourceClass":"Benchmark","sourceUrl":"https://venturebeat.com/ai/forget-gpt-5-openai-launches-new-ai-model-family-o1-claiming-phd-level-performance/","confidence":"high","supportedPromptTypes":["P-02"],"needsVerification":true,"sourceVerified":false,"sourceKind":"third-party","entityId":"openai-o1"}],"generatedAt":"2026-08-29T13:47:52.247Z","evidenceIds":["openai-o1-ev-cr1-venturebeat-imo-codeforces"]}]}