メインコンテンツへスキップ

忙しい方のためのカメラ関連ニュース
海外のカメラ関連ニュースを翻訳してお届け


エージェンティック・コーディング・アリーナ:OpenAI、Anthropic、その他のAIモデルによるアプリ作成能力を比較

  • From 
    Anthropic (Hacker News)

本記事は、最先端のAIモデルがプロンプトに基づいてどれだけ効率的に、そしてどのような品質で小規模なアプリケーションを作成できるかを比較検証したものです。

検証では、52個の異なるアプリケーションが、OpenAI(GPT-5シリーズ)、Anthropic(Opus、Sonnet、Haikuシリーズ)、Google(Geminiシリーズ)、Moonshot AI(Kimiシリーズ)、Z.ai、GLM、Qwenといった、21種類のモデルによって、一切の編集や選別なしに、同一のプロンプトから生成されました。

比較対象となったモデルは以下の通りです。

OpenAI: GPT-5, GPT-5.1, GPT-5.2, GPT-5.3, GPT-5.4, GPT-5.5
Anthropic: Opus 4.1, Opus 4.5, Opus 4.6, Opus 4.7, Opus 4.8, Sonnet 4.5, Sonnet 4.6, Haiku 4.5
Google: Gemini 3, Gemini 3 Flash, Gemini 3.5 Flash
Moonshot AI: Kimi K2.6, Kimi K2.7
CodingZ.ai: GLM-5.2
Qwen: Qwen 3.7 Plus

生成されたアプリは、ランディングページ、ゲーム、インタラクティブコンテンツ、ユーティリティツール、チャットツール、データ分析ツールなど多岐にわたり、その多様性がAIの応用範囲の広さを示しています。

[custom_js_sp]

AIによる翻訳/要約をしています。正確な情報はオリジナルサイトにてご確認ください。
当サイトの記事にはプロモーションが含まれる場合があります。

今週の人気ニュース

アップル関連のニュースはこちら