AI新聞資訊智譜 AI 發佈 MathGLM 數學模型,算術任務性能優於 GPT-409-2511.9K 閱讀智譜 AI 發佈了 MathGLM 數學模型,旨在提升大模型在數學推理方面的性能。MathGLM 能夠準確計算算術運算,包括基礎算術和複雜混合運算,並在中文數學解決能力方面取得了優秀的成果。研究表明,MathGLM 在算術任務中的表現優於 GPT-4。此外,MathGLM 在解決不同年級數學問題和數學應用題上也取得了良好的結果。標籤:MathGLM智譜 AI算術任務相關推薦智智譜 AI 發佈中文 LLM 對齊評測基準 AlignBench["智譜 AI 發佈了針對中文大模型的評測基準 AlignBench","AlignBench 能夠在多維度上細緻評測模型和人類意圖的對齊水平","數據集分爲 8 個大類,包括知識問答、寫作生成、角色扮演等多種類型的問題","開發者可以利用 AlignBench 進行評測,並使用評價能力較強的打分模型進行評分","通過登錄 AlignBench 網站,提交結果可以使用 CritiqueLLM 作爲評分模型進行評測"]12-1218.5K智智譜 AI 發佈第三代基座大模型 ChatGLM3 智譜清言具備代碼交互能力["智譜 AI 在 2023 中國計算機大會上發佈第三代基座大模型 ChatGLM3","ChatGLM3 具備多模態理解能力、代碼生成和執行、網絡搜索增強等新功能","ChatGLM3 經過深度優化,在中英文公開數據集測試中表現優秀","智譜清言成爲國內首個具備代碼交互能力的大模型產品","智譜 AI 期待國產原生大模型與國產芯片在國際舞臺上脫穎而出"]10-2716.7K智智譜 AI 完成 B-4 輪融資 騰訊阿里參投["智譜 AI 完成 B-4 輪融資,騰訊和阿里參與投資。","融資金額達 10 億美元,估值達 10 億美元。","智譜 AI 由清華大學計算機系技術成果轉化而來。","智譜 AI 致力於打造新一代認知智能通用模型。","智譜 AI 推出了認知大模型平臺 Bigmodel.ai。"]09-2012.5K比比GPT-4還強,20億參數模型做算術題,準確率幾乎100%["清華大學等研究者提出20億參數語言模型MathGLM,在算術運算任務上準確率接近100%,明顯優於GPT-4。","MathGLM採用僅解碼器架構,在大規模算術數據集上訓練,數學運算能力得到顯著提升。","MathGLM在處理數字格式複雜的混合算術運算時,也優於GPT-4和ChatGPT等模型。"]09-1912.2KAI 或將取代大部分程序員工作,Zoho創始人和OpenAI CEO發出警告在人工智能(AI)技術迅速發展的背景下,Zoho 的創始人 Sridhar Vembu 和 OpenAI 的 CEO Sam Altman 均表示,未來90% 的程序員工作可能會被 AI 取代,尤其是那些重複性較強的任務。Vembu 在社交媒體上分享了他的看法,他認爲大多數程序員所編寫的代碼都是 “樣板代碼”(boilerplate code),即一些重複性高、創意性低的內容。根據他的說法,程序設計中存在 “必要的複雜性” 和 “偶然的複雜性”。AI 擅長處理這些偶然的複雜性,因此可以高效地生成大量代碼。Vembu 進一步指出,儘管 AI 在消除偶然複雜03-2417.8KBrowser Use 獲1700萬美元融資,打造 AI 代理網頁瀏覽"翻譯層"據TechCrunch 報道,Browser Use 近日向已完成1700萬美元種子輪融資,由 Felicis 的 Astasia Myers 領投,Paul Graham、A Capital 和 Nexus Venture Partners 參投。這筆融資此前尚未被公開報道。作爲 Y Combinator2025年冬季項目的一部分,Browser Use 專注於解決一個關鍵問題:讓網站對 AI 代理更具"可讀性"。該公司由 Magnus Müller 和 Gregor Zunic 於去年通過蘇黎世聯邦理工學院的加速器創立,兩人在五週內開發出首個演示版本並選擇開源發佈。Browser Use 的技術核心是將網站的按鈕和界面元素轉化爲更易於 AI 理解的"文本式"格03-2417.7K
智智譜 AI 發佈中文 LLM 對齊評測基準 AlignBench["智譜 AI 發佈了針對中文大模型的評測基準 AlignBench","AlignBench 能夠在多維度上細緻評測模型和人類意圖的對齊水平","數據集分爲 8 個大類,包括知識問答、寫作生成、角色扮演等多種類型的問題","開發者可以利用 AlignBench 進行評測,並使用評價能力較強的打分模型進行評分","通過登錄 AlignBench 網站,提交結果可以使用 CritiqueLLM 作爲評分模型進行評測"]12-1218.5K
智智譜 AI 發佈第三代基座大模型 ChatGLM3 智譜清言具備代碼交互能力["智譜 AI 在 2023 中國計算機大會上發佈第三代基座大模型 ChatGLM3","ChatGLM3 具備多模態理解能力、代碼生成和執行、網絡搜索增強等新功能","ChatGLM3 經過深度優化,在中英文公開數據集測試中表現優秀","智譜清言成爲國內首個具備代碼交互能力的大模型產品","智譜 AI 期待國產原生大模型與國產芯片在國際舞臺上脫穎而出"]10-2716.7K
智智譜 AI 完成 B-4 輪融資 騰訊阿里參投["智譜 AI 完成 B-4 輪融資,騰訊和阿里參與投資。","融資金額達 10 億美元,估值達 10 億美元。","智譜 AI 由清華大學計算機系技術成果轉化而來。","智譜 AI 致力於打造新一代認知智能通用模型。","智譜 AI 推出了認知大模型平臺 Bigmodel.ai。"]09-2012.5K
比比GPT-4還強,20億參數模型做算術題,準確率幾乎100%["清華大學等研究者提出20億參數語言模型MathGLM,在算術運算任務上準確率接近100%,明顯優於GPT-4。","MathGLM採用僅解碼器架構,在大規模算術數據集上訓練,數學運算能力得到顯著提升。","MathGLM在處理數字格式複雜的混合算術運算時,也優於GPT-4和ChatGPT等模型。"]09-1912.2K
AI 或將取代大部分程序員工作,Zoho創始人和OpenAI CEO發出警告在人工智能(AI)技術迅速發展的背景下,Zoho 的創始人 Sridhar Vembu 和 OpenAI 的 CEO Sam Altman 均表示,未來90% 的程序員工作可能會被 AI 取代,尤其是那些重複性較強的任務。Vembu 在社交媒體上分享了他的看法,他認爲大多數程序員所編寫的代碼都是 “樣板代碼”(boilerplate code),即一些重複性高、創意性低的內容。根據他的說法,程序設計中存在 “必要的複雜性” 和 “偶然的複雜性”。AI 擅長處理這些偶然的複雜性,因此可以高效地生成大量代碼。Vembu 進一步指出,儘管 AI 在消除偶然複雜03-2417.8K
Browser Use 獲1700萬美元融資,打造 AI 代理網頁瀏覽"翻譯層"據TechCrunch 報道,Browser Use 近日向已完成1700萬美元種子輪融資,由 Felicis 的 Astasia Myers 領投,Paul Graham、A Capital 和 Nexus Venture Partners 參投。這筆融資此前尚未被公開報道。作爲 Y Combinator2025年冬季項目的一部分,Browser Use 專注於解決一個關鍵問題:讓網站對 AI 代理更具"可讀性"。該公司由 Magnus Müller 和 Gregor Zunic 於去年通過蘇黎世聯邦理工學院的加速器創立,兩人在五週內開發出首個演示版本並選擇開源發佈。Browser Use 的技術核心是將網站的按鈕和界面元素轉化爲更易於 AI 理解的"文本式"格03-2417.7K