模型训练

微软将为内部AI模型投入更多计算能力

微软将为内部AI模型投入更多计算能力 美国微软公司计划扩展其物理基础设施,以训练自有人工智能模型,希望这些模型能与OpenAI、Anthropic及其他公司竞争。微软消费者人工智能主管穆斯塔法·苏莱曼在周四全体会议上告诉员工,公司将在自有算力集群上进行重大投资用于模型训练。据内部会议与会者透露,苏莱曼向员工表示,对于微软这种规模的企业而言,如果选择自主发展人工智能,实现自给自足的能力至关重要。他补充说,微软正在采取同时深化与OpenAI合作、与其他模型制…

深度求索新模型发布因华为芯片问题而推迟

深度求索新模型发布因华为芯片问题而推迟 据三位知情人士透露,DeepSeek在今年1月发布其R1模型后,被当局鼓励采用华为的昇腾处理器而非英伟达的系统。但上述人士表示,这家中国初创公司在使用昇腾芯片进行其R2训练的过程中持续遇到技术问题,促使该公司改用英伟达芯片进行训练,同时使用华为的芯片进行推理。这些问题是该模型发布从五月推迟的主要原因,导致其落后于竞争对手。两位知情人士称,华为派遣了一支工程师团队到 DeepSeek 办公室,以帮助该公司使用其AI芯…

加载更多博文
未找到任何结果