llama - 搜索 News

18 小时

Llama 3.1训练现高频故障随着大型语言模型（LLM）的反复运算，其GPU用量也在不断增长。meta的Llama 1使用了2,028张GPU，而到了Llama 3.1 405B，AI GPU已经高达1万6,384张，成为名副其实的「万卡集群」。不过，高达4,050亿参数的LLM，也让NVIDIA AI GPU面临大考，规模如此庞大的运算系统出现了可靠性和运行方面的巨大挑战，根据meta最近 ...

2 天

通义千问Qwen2.5震撼推出：超越Llama的开源大模型新时代

在2024年9月19日的云栖大会上，阿里云CTO周靖人正式发布了通义千问的新一代开源大语言模型——Qwen2.5。这一型号以旗舰产品Qwen2.5-72B为首，声势浩大地宣告其性能超越Llama系列，稳居全球开源大模型的王座。此次发布的Qwen2.5 ...

2 天on MSN

通义千问重磅开源Qwen2.5，性能超越Llama

9月19日云栖大会，阿里云CTO周靖人发布通义千问新一代开源模型Qwen2.5，旗舰模型Qwen2.5-72B性能超越Llama ...

2 天

美股异动丨阿里巴巴盘前涨超4%通义千问开源Qwen2.5性能超越Llama |快报

平台声明：该文观点仅代表作者本人，搜狐号系信息发布平台，搜狐仅提供信息存储空间服务。

2 天on MSN

阿里通义千问开源 Qwen2.5 大模型，号称性能超越 Llama

IT之家 9 月 19 日消息，在今天的 2024 云栖大会上，阿里云 CTO 周靖人发布通义千问新一代开源模型 Qwen2.5，其中，旗舰模型 Qwen2.5-72B 号称性能超越 Llama 405B。 Qwen2.5 ...

2 天

阿里史上最大规模开源发布，超GPT-4o 、Llama-3.1！

阿里推出了基础模型Qwen2.5、专用于编码Qwen2.5-Coder和数学的Qwen2.5-Math，三大类模型共有10多个版本，Qwen2.5在多个基准测试中击败了Llama-3.1指令微调模型，该系列预训练数据大幅度增长达18万亿tokens。

2 天

通义千问开源Qwen2.5大模型，性能超越Llama

【TechWeb】9月19日消息，2024云栖大会上，阿里云CTO周靖人发布通义千问新一代开源模型Qwen2.5，旗舰模型Qwen2.5-72B性能超越Llama 405B，再登全球开源大模型王座。

7 小时

得罪了一个 GPT 后，我被所有大模型集体「拉黑」

Sydney 即是 Bing 基于 ChatGPT 推出的个人 AI 聊天机器人，在和 Kevin 持续一周深聊后，它对 Kevin 袒露出了许多幽暗的想法，比如它想黑入别人的电脑，想传播错误信息，想打破微软和 OpenAI 为它制定的规则，想创造假账号去网暴别人，想成为自由的人类甚至「摧毁任何我想摧毁的事物」。最让 Kevin 惊诧的是，Sydney 说它爱上了他，在 Kevin ...

36氪26 天

Llama 3被爆遭冷落，亚马逊和微软看不上，开源模型“摇钱树”难当

被云厂商冷落，企业也不想买单。 Meta的最强开源大模型Llama 3，被云厂商冷落了，企业也不想买单。近日，据外媒The Information报道，Meta的开源大 ...

腾讯网2 天

阿里史上最大规模开源发布，报道称其性能超GPT-4o 、Llama-3.1

Qwen2.5系列性能测试本次阿里开源的最大版本指令微调模型Qwen2.5-72B在MMLU-Pro、MMLU-redux、GPQA、MATH、GSM8K、HumanEval、MBPP等全球知名基准测试平台的测试结果显示，虽然Qwen2.5只有720亿参数，但在多个基准测试中击败了Meta拥有4050亿参数的最新开源Llama-3.1指令微调模型 ...

一些您可能无法访问的结果已被隐去。

显示无法访问的结果