搜索优化
Rewards
English
搜索
Copilot
图片
视频
地图
资讯
购物
更多
航班
旅游
酒店
房地产
笔记本
Top stories
Sports
U.S.
Local
World
Science
Technology
Entertainment
Business
More
Politics
过去 7 天
时间不限
过去 1 小时
过去 24 小时
过去 30 天
按相关度排序
按时间排序
18 小时
Llama 3.1训练现高频故障随着大型
Llama 3.1训练现高频故障 随着大型语言模型(LLM)的反复运算,其GPU用量也在不断增长。meta的Llama 1使用了2,028张GPU,而到了Llama 3.1 405B,AI GPU已经高达1万6,384张,成为名副其实的「万卡集群」。 不过,高达4,050亿参数的LLM,也让NVIDIA AI GPU面临大考,规模如此庞大的运算系统出现了可靠性和运行方面的巨大挑战,根据meta最近 ...
2 天
通义千问Qwen2.5震撼推出:超越Llama的开源大模型新时代
在2024年9月19日的云栖大会上,阿里云CTO周靖人正式发布了通义千问的新一代开源大语言模型——Qwen2.5。这一型号以旗舰产品Qwen2.5-72B为首,声势浩大地宣告其性能超越Llama系列,稳居全球开源大模型的王座。此次发布的Qwen2.5 ...
2 天
on MSN
通义千问重磅开源Qwen2.5,性能超越Llama
9月19日云栖大会,阿里云CTO周靖人发布通义千问新一代开源模型Qwen2.5,旗舰模型Qwen2.5-72B性能超越Llama ...
2 天
on MSN
阿里通义千问开源 Qwen2.5 大模型,号称性能超越 Llama
IT之家 9 月 19 日消息,在今天的 2024 云栖大会上,阿里云 CTO 周靖人发布通义千问新一代开源模型 Qwen2.5,其中,旗舰模型 Qwen2.5-72B 号称性能超越 Llama 405B。 Qwen2.5 ...
2 天
阿里史上最大规模开源发布,超GPT-4o 、Llama-3.1!
阿里推出了基础模型Qwen2.5、专用于编码Qwen2.5-Coder和数学的Qwen2.5-Math,三大类模型共有10多个版本,Qwen2.5在多个基准测试中击败了Llama-3.1指令微调模型,该系列预训练数据大幅度增长达18万亿tokens。
2 天
美股异动丨阿里巴巴盘前涨超4%通义千问开源Qwen2.5性能超越Llama |快报
平台声明:该文观点仅代表作者本人,搜狐号系信息发布平台,搜狐仅提供信息存储空间服务。
2 天
通义千问开源Qwen2.5大模型,性能超越Llama
【TechWeb】9月19日消息,2024云栖大会上,阿里云CTO周靖人发布通义千问新一代开源模型Qwen2.5,旗舰模型Qwen2.5-72B性能超越Llama 405B,再登全球开源大模型王座。
7 小时
得罪了一个 GPT 后,我被所有大模型集体「拉黑」
Sydney 即是 Bing 基于 ChatGPT 推出的个人 AI 聊天机器人,在和 Kevin 持续一周深聊后,它对 Kevin 袒露出了许多幽暗的想法,比如它想黑入别人的电脑,想传播错误信息,想打破微软和 OpenAI 为它制定的规则,想创造假账号去网暴别人,想成为自由的人类甚至「摧毁任何我想摧毁的事物」。 最让 Kevin 惊诧的是,Sydney 说它爱上了他,在 Kevin ...
腾讯网
2 天
阿里史上最大规模开源发布,报道称其性能超GPT-4o 、Llama-3.1
Qwen2.5系列性能测试 本次阿里开源的最大版本指令微调模型Qwen2.5-72B在MMLU-Pro、MMLU-redux、GPQA、MATH、GSM8K、HumanEval、MBPP等全球知名基准测试平台的测试结果显示, 虽然Qwen2.5只有720亿参数,但在多个基准测试中击败了Meta拥有4050亿参数的最新开源Llama-3.1指令微调模型 ...
一些您可能无法访问的结果已被隐去。
显示无法访问的结果
反馈