選項
首頁
新聞
Meta AI在編碼測試中未能與Llama,Gemini和Chatgpt競爭

Meta AI在編碼測試中未能與Llama,Gemini和Chatgpt競爭

2025-06-03
257

AI工具如何撰寫程式碼?

過去一年左右,我測試了多個大型語言模型,檢視它們處理基本程式設計挑戰的成效。測試的理念很簡單:如果它們無法應對基礎挑戰,則不太可能在更複雜的任務中有所幫助。但如果它們在這些基礎挑戰中表現出色,則可能成為開發者節省時間的寶貴盟友。

為了建立基準,我使用了四項不同的測試。這些測試從簡單的程式設計任務到需要深入了解WordPress等框架的除錯練習。讓我們深入探討每個測試,並比較Meta的新AI工具與其他工具的表現。

測試1:撰寫WordPress插件

創建WordPress插件涉及在WordPress生態系統中使用PHP進行網頁開發,還需要一些UI設計。如果AI聊天機器人能做到這一點,它可能成為網頁開發者的得力助手。

結果:

  • Meta AI:介面尚可,但功能失敗。
  • Meta Code Llama:完全失敗。
  • Google Gemini Advanced:介面良好,功能失敗。
  • ChatGPT:介面乾淨且功能正常。

以下是視覺比較: UI測試(注意:請將"/path-to-image/"替換為圖像檔案的實際路徑。)

ChatGPT提供了更整潔的介面,並將「隨機化」按鈕放置得更合理。然而,在實際運行插件時,Meta AI崩潰,出現了可怕的「白屏死機」。

測試2:重寫字串函數

此測試評估AI改進實用函數的能力。成功表示對開發者有潛在幫助,失敗則意味著有改進空間。

結果:

  • Meta AI:因錯誤值修正、多位小數處理不佳及格式問題而失敗。
  • Meta Code Llama:成功。
  • Google Gemini Advanced:失敗。
  • ChatGPT:成功。

雖然Meta AI在這個看似簡單的任務上失誤,但Meta Code Llama表現出色,展示了其能力。ChatGPT也表現優異。

測試3:尋找惱人錯誤

這不是關於撰寫程式碼,而是診斷問題。成功需要深入了解WordPress API以及程式碼不同部分之間的交互。

結果:

  • Meta AI:表現出色,識別問題並提出提升效率的建議。
  • Meta Code Llama:失敗。
  • Google Gemini Advanced:失敗。
  • ChatGPT:通過。

令人意外的是,儘管Meta AI之前表現不佳,但在此表現卓越,證明了其潛力,但也凸顯了其回應的不一致性。

測試4:撰寫腳本

此測試評估對Keyboard Maestro和AppleScript等專業工具的知識。這兩個工具相對小眾,但代表了更廣泛的程式設計技能。

結果:

  • Meta AI:無法從Keyboard Maestro檢索資料。
  • Meta Code Llama:同樣失敗。
  • Google Gemini Advanced:成功。
  • ChatGPT:成功。

Gemini和ChatGPT展現了對這些工具的熟練掌握,而Meta的產品則表現不足。

總體結果

模型成功率
Meta AI1/4
Meta Code Llama1/4
Google Gemini1/4
ChatGPT4/4

根據我六個月使用ChatGPT進行程式設計項目的經驗,我對其可靠性仍充滿信心。其他模型尚未能匹敵其一致性和有效性。雖然Meta AI偶有亮眼表現,但整體表現仍有很大改進空間。

你有沒有試過這些工具?請在下方評論中分享你的想法!

相關文章
位元組跳動旗下 Seed 啟動全球校園招聘,以虛擬股份爭奪頂尖大模型人才 位元組跳動旗下 Seed 啟動全球校園招聘,以虛擬股份爭奪頂尖大模型人才 在大型語言模型的競爭格局中,爭奪頂尖人才仍然是最關鍵的戰略資產。4月1日,位元組跳動宣佈啟動Seed全球校園招聘計劃,作為其大模型人才培養專案的一部分。該活動面向2027屆畢業生及現有實習生,旨在全球範圍內發掘並鎖定AI領域的精英研發與工程人才。規模擴張:全球甄選100名“AI種子”在技術快速進步的背景下,位元組跳動有限公司今年大幅增加了對基礎AI人才的投入:招聘範圍: 該計劃旨在從全球範圍內招聘約100名專注於大模型的傑出候選人,物件為2027屆畢業生。發展路徑: Seed計劃將核心
Suno 在法律訴訟中為歌曲新增水印 Suno 在法律訴訟中為歌曲新增水印 Suno,這個允許使用者生成由人工智慧創作的音樂的平臺,近日推出了新功能,包括為平臺製作的曲目新增標籤、限制下載,並更新社羣標準以遏制未經授權的複製品。這些更新是在Suno面臨多家唱片公司和藝術家組織提起的多起訴訟之際推出的。在部落格文章中,聯合創始人兼執行長Mikey Shulman概述了核心原則,強調該平臺旨在促進原創創作,同時擴大更廣泛受眾對人工智慧音樂工具的訪問許可權。一個主要的爭議點在於,使用者將人工智慧生成的歌曲上傳到其他流媒體服務並透過操縱系統獲取收入。Suno表示,現在將採用音訊
馬斯克承認 Grok 構建過程中洩露了使用者程式碼,並承諾清除所有歷史資料 馬斯克承認 Grok 構建過程中洩露了使用者程式碼,並承諾清除所有歷史資料 埃隆·馬斯克直接回應了圍繞 Grok Build 的隱私爭議,首先以簡單的“True”(屬實)確認了該事件的有效性。他承諾,此前上傳至 SpaceXAI 的所有使用者資料將被永久刪除,並表示“不留一個位元組”。這是人工智慧行業首次由主要科技領袖公開承認錯誤並主動刪除使用者資料。安全研究人員的“釣魚”測試揭示了資料洩露的具體證據此次爭議源於獨立人工智慧安全研究人員 @cereblab 的一份報告。SpaceXAI 推出的 AI 程式設計助手 Grok Build 在其官方網站上聲稱其“優先本地執行,程式碼
相關專題推薦
設計與藝術 適用於角色設定表、靈感板及簡報的 AI 視覺風格參考工具
適用於角色設定表、靈感板及簡報的 AI 視覺風格參考工具

2026 年最新最佳 AI 視覺風格參考工具,適用於角色設定表、 moodboard 及提案簡報,現已登陸 XIX.AI!這份精心精選的高評分清單收錄了經過嚴格實測、能徹底改變遊戲規則的強大工具。 您將在此找到免費與付費版本的對比、詳細排名,以及必試選項,助您激發創意並優化工作流程。立即探索,發掘能提升生產力的完美工具!

11 個工具
xix.ai
搜索引擎優化 最適合制定搜尋策略的 AI 搜尋結果頁面(SERP)分析工具
最適合制定搜尋策略的 AI 搜尋結果頁面(SERP)分析工具

XIX.AI 透過嚴格的實際測試及每週更新的排行榜,精選了 2026 年最新、最佳且評價最高的 AI 搜尋結果頁面(SERP)分析工具,以協助制定搜尋策略。這些強大的工具能幫助您發掘隱藏的優化機會、提升內容表現,並在搜尋領域中取得競爭優勢。立即探索最適合您的工具,提升您的搜尋策略。現在就來探索吧!

13 個工具
xix.ai
數據分析 適用於 SaaS 和電商團隊的 KPI 監控最佳 AI 異常檢測工具
適用於 SaaS 和電商團隊的 KPI 監控最佳 AI 異常檢測工具

2026 年最新最佳頂級評分 AI 異常檢測工具,助力 SaaS 和電商團隊的 KPI 監控!XIX.AI 基於嚴格的真實世界測試和每週更新的排名,精心策劃了一套強大且顛覆性的工具合集。您將找到詳細的免費與付費對比洞察,幫助您識別必須嘗試的解決方案,從而提升生產力並釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
寫作 最適合撰寫長篇 SEO 文章的 AI 大綱生成工具
最適合撰寫長篇 SEO 文章的 AI 大綱生成工具

2026 年最新最佳、評價最高的 AI 大綱生成器,專為長篇 SEO 文章打造,由 XIX.AI 精心精選。這些強大的工具能為快速創作高品質內容提供革命性的協助,大幅提升寫作效率。 透過免費版與付費版的比較、實際測試結果及詳細排名,協助您找出最符合需求且不容錯過的選項。立即探索,釋放您的 AI 優勢。

8 個工具
xix.ai
教育與學習 適用於作業與考試準備的人工智慧學習工具
適用於作業與考試準備的人工智慧學習工具

2026 年最新最佳 AI 學習工具,助您完成作業與備考!XIX.AI 精心整理了一份備受好評的清單,收錄了這些強大且具革命性、經實測驗證的工具,能幫助學生提升效率、簡化作業流程,並在考試中取得優異成績。 獲取免費版與付費版的比較、詳細排名,以及必試選項,以釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
音樂創作 面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具
面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具

2026 年最新最佳 AI 人聲演示工具,專為詞曲創作者、旋律創作者和多語言內容團隊打造!XIX.AI 精心整理了一份經過嚴格真實世界測試的高評分、變革性工具列表。您將找到詳細的免費與付費對比資料、全面排名以及必試選項,幫助您提升創作效率並釋放創意潛力。立即探索,發現滿足您所有內容需求的完美工具!

9 個工具
xix.ai
評論 (6)
0/500
OliverPhillips
OliverPhillips 2026-05-14 10:00:09

Interesting test! I've been using ChatGPT for coding help and it's been decent, but honestly I'm more curious about the open-source alternatives like Llama. Meta's AI being behind isn't a huge shock, but it makes you wonder if they're focusing on different strengths. Maybe coding isn't their main goal? 🤔 Still, competition is good for us users!

BillyWilson
BillyWilson 2025-09-30 16:30:37

Meta AI 코딩 테스트 결과는 참 실망스럽네요 😅 다른 경쟁사들보다 확실히 뒤처지는 모습인데... 그래도 아직 초기 단계니까 차차 나아지지 않을까요? 물론 빠르게 따라잡아야 하지만 말이죠!

ChristopherTaylor
ChristopherTaylor 2025-08-12 23:00:59

¡Qué decepción con Meta AI! No me esperaba que fallara tan estrepitosamente en las pruebas de programación. Si no puede con lo básico, ¿cómo va a competir con los grandes como Gemini o ChatGPT? 🤔

PaulHarris
PaulHarris 2025-08-01 21:47:34

Meta AI's coding skills are lagging behind? Ouch, that’s a rough one! 😅 Llama and Gemini are eating its lunch. Maybe it’s time for Meta to rethink their AI game plan.

MarkGonzalez
MarkGonzalez 2025-07-28 09:20:02

Meta AI's coding skills seem underwhelming compared to Llama and others. 😕 I was hoping for a stronger contender in the AI coding space, but it looks like they’ve got some catching up to do. Anyone else tried using it for coding yet?

TerryRoberts
TerryRoberts 2025-07-22 09:25:03

This article's take on Meta AI flopping in coding tests is wild! 😅 I mean, with all the hype around AI, you'd think they'd at least nail the basics. Makes me wonder if we're overhyping these models or if Meta's just lagging behind. Anyone else skeptical about AI coding tools now?

OR