大模型

共 30 篇文章

大模型
This Former Intel CEO Wants to Jumpstart Moore’s L

在人工智能的算力竞赛中,芯片巨头英特尔(Intel)正在押注一项看似微小却可能改变游戏规则的技术——光。英特尔首席执行官帕特·基辛格(Pat Gelsinger)近日提出,利用微小的光束来驱动人工智能计算,可能是通往更强大AI系统的关键路径。这一设想不仅挑战了传统电子芯片的物理极限,也为整个半导体行业指明了新的发展方向。

基辛格的愿景并非凭空而来。随着AI模型的规模呈指数级增长,从GPT-3到GPT-4,再到未来的多模态大模型,传统基于电子传输的芯片架构正面临日益严峻的瓶颈。电子在导线中移动时会产生热量,导致能耗飙升,同时信号在长距离传输中也会衰减。这些问题在数据中心和高性能...

大模型
谷歌连发三款Gemini新模型,3.5 Pro缺席引猜测

在人工智能领域,模型迭代的速度往往被视为企业技术实力的直接体现。然而,当行业巨头Google(谷歌)于近日悄然发布三款新模型——Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及一款名为Flash Cyber的专用模型时,外界关注的焦点却并非这些新产品的性能参数,而是另一个令人困惑的缺席:备受期待的Gemini 3.5 Pro至今仍未现身。这一反常现象,正在科技圈内引发关于Google AI战略布局的广泛猜测。

按照惯例,Google通常会在推出轻量级或专用模型(如Flash系列)的同时,发布其旗舰级“Pro”版本,以展示其最前沿的技术突破。然而...

大模型
Nvidia Wants to Own Every Chip Inside AI Data Cent

英伟达推出Vera Rubin平台,将CPU与GPU整合进统一系统,从芯片供应商向全栈式AI基础设施提供商转型。该平台通过优化互联架构实现计算协同,旨在提升能效比、降低延迟,应对生成式AI对系统级效率的需求。此举挑战英特尔和AMD的CPU市场,但面临生态迁移成本和竞争压力。Vera Rubin预示AI计算进入异构融合阶段,有望降低开发门槛,但其商业成功需平衡硬件、软件与客户需求。

大模型
Google is working on a new AI chip designed to mak

据行业内部消息透露,Alphabet(谷歌母公司)正在秘密研发一款全新的定制芯片,其核心目标是为旗下的Gemini(双子座)系列大语言模型提供前所未有的运行效率。这一举措标志着科技巨头在人工智能领域的竞争正从模型算法的比拼,进一步延伸至底层硬件的深度定制。

长期以来,谷歌在人工智能芯片领域并非新手。其早已部署的TPU(张量处理单元)系列芯片,在云端训练和推理环节为众多AI模型提供了强大的算力支撑。然而,随着Gemini等前沿多模态模型的复杂度呈指数级增长,传统的通用芯片架构在处理海量参数和实时交互时,逐渐暴露出能耗与性能瓶颈。此次被曝光的全新芯片,据称将彻底摆脱通用计算框架的...

大模型
AI is more likely than humans to form biases when

The next time you apply for a job, AI may screen your résumé before any human sees it. But there’s good reason to question whether AI will judge you fairly. Researchers already know that LLMs pick up human biases from their training data. New research suggests that LLMs can also develop their own bi...

大模型
非营利组织Current AI正打造免费开放的全球AI互联网络

在人工智能技术飞速发展的今天,全球科技巨头纷纷将目光投向大语言模型、多模态能力与算力竞赛,但一个名为“Current AI”的非营利组织却选择了一条截然不同的道路——致力于构建一种“不让任何文化掉队”的人工智能。这家机构近期在设备端AI、智能对话等多个领域取得了令人瞩目的进展,引发了业界对“包容性AI”这一命题的重新思考。

Current AI的核心理念,源于一个被主流科技公司长期忽视的痛点:当前绝大多数AI模型,尤其是大语言模型,其训练数据高度集中于英语、中文、西班牙语等少数几种语言,而全球数千种语言中的绝大多数,尤其是非洲、南亚、东南亚及太平洋岛屿地区的方言,几乎被完全排...

大模型
Databricks估值达1880亿美元,延续AI领域热门后起之秀势头

Databricks正从大数据分析平台转型为纯AI公司,并发布研究称开源权重AI模型在编程任务中成本效益显著,可降低企业总体拥有成本,同时解决数据隐私问题。该研究指出,自托管开源模型在长期运营中比闭源API更经济,但顶级闭源模型在特定场景仍有优势。这一转型反映了AI行业的去中心化趋势,Databricks借此定位为AI基础设施公司,引导企业采用其平台部署开源模型,但中小企业仍面临技术门槛和初期投入挑战。

大模型
前DeepMind研究员未推产品即获3亿美元种子轮估值

在人工智能领域,一个名字或许并不像Sam Altman或Elon Musk那样家喻户晓,但他的工作却深刻影响了我们今天所熟知的AI生态。安德鲁·戴(Andrew Dai),一位在谷歌(Google)和OpenAI等顶级机构拥有超过十年经验的资深研究员,近日在一次深度访谈中分享了他对AI未来走向的独到见解。戴曾参与构建全球最具影响力的AI系统,其早期研究甚至为后来ChatGPT的诞生提供了关键理论基础。如今,他将目光投向了下一个重大前沿:视觉人工智能(Visual AI)。

戴的职业生涯堪称AI发展史的缩影。在过去的十多年里,他先后在谷歌大脑(Google Brain)团队和O...

大模型
AI公司CEO拒绝用‘超级智能’标签,称其概念模糊

在人工智能领域,几乎所有人都在追逐“超级智能”(superintelligence)这一终极目标,但有一位CEO却对此嗤之以鼻。他就是Yann LeCun(杨·勒昆)旗下世界模型初创公司AMI Labs的掌门人Alexandre LeBrun(亚历山大·勒布朗)。在接受媒体采访时,LeBrun直言不讳地表示,他并不认同当前业界对“超级智能”的狂热追捧,认为这一概念被过度炒作,甚至可能误导整个行业的发展方向。

LeBrun的言论在AI圈内引发了不小的震动。作为深度学习先驱Yann LeCun的合作伙伴,AMI Labs专注于构建“世界模型”(world model),这是一种试...

大模型
Moonshot’s upcoming Kimi 3 is expected to close th

在中国人工智能领域,一场新的技术竞赛正在悄然升温。据英国《金融时报》(Financial Times,简称FT)报道,中国AI初创公司月之暗面(Moonshot AI)即将推出其最新一代大语言模型——Kimi K3。这一模型被业界视为迄今为止中国最大的开源AI模型,其参数规模预计将达到2万亿至3万亿之间,这一数字不仅刷新了国内开源模型的纪录,也标志着中国AI技术在全球开源生态中迈出了关键一步。

参数数量是衡量大语言模型能力的重要指标之一。通常而言,参数越多,模型能够处理的信息复杂度越高,推理能力也越强。Kimi K3的2万亿至3万亿参数规模,使其在体量上足以与目前全球顶尖的闭...