更多

    LLM

    微軟 GitHub 開源 DeepSpeed Chat 簡化訓練類似 ChatGPT 千億級模型

    訓練 GPT 般大型語言模型的時間和資金成本極高,並非一般人和企業可負擔。微軟在 GitHub 開源 DeepSpeed Chat,將千億級大型模型的訓練成本和花費時間驟降 15 倍。以 1,750 億參數模型為例,在 Azure 上 64x NVIDIA A100 GPU 可在 20 小時完成訓練,花費約 5,120 美元。

    呼籲暫停 AI 開發卻大手購入 GPU Elon Musk 據報在 Twitter 成立部門發展 LLM

    早前 Elon Musk 聯同其他科技界名人,一同聯署呼籲發展 AI 的科企應暫停開發 6 個月,商議如何規範 AI 開發。不過這位前首富似乎另有一份劇本。據 Business Insider 報道,Elon Musk 在控制 Twitter 的 X Corp 成立了個 AI 開發專案部門,並且大手購入約 10,000 張 GPU,準備發展大型語言模型。

    乘 AIGC 熱潮再出擊 Facebook 發表 LLaMA 大語言模型

    Facebook 前年改名 Meta 發展元宇宙事業,投入大量資金還未見成果。但近日科技界轉軚,紛紛投資到人工智能生成內容 AIGC,Meta 也要展示他們也在那方面的能力,發表具備 650 億個參數的大語言模型 LLaMA。

    最新文章

    DJI 新無人機仔 Mini 4 Pro 極速開箱 + 上一代機身比較

    DJI 近月動作頻頻,尋晚(9 月 25 日)又有航拍發燒友期待已久嘅 Mini 4 Pro,作為 249g 或以下嘅無人機仔,必定係最多人留意嘅,而且早於個多月前已有片流出,《PCM》編輯部亦極速搵到一部實機開箱,睇睇 Mini 4 Pro 嘅真機係點嘅。