大模型
共 30 篇文章
AI is more likely than humans to form biases when
The next time you apply for a job, AI may screen your résumé before any human sees it. But there’s good reason to question whether AI will judge you fairly. Researchers already know that LLMs pick up human biases from their training data. New research suggests that LLMs can also develop their own bi...
非营利组织Current AI正打造免费开放的全球AI互联网络
在人工智能技术飞速发展的今天,全球科技巨头纷纷将目光投向大语言模型、多模态能力与算力竞赛,但一个名为“Current AI”的非营利组织却选择了一条截然不同的道路——致力于构建一种“不让任何文化掉队”的人工智能。这家机构近期在设备端AI、智能对话等多个领域取得了令人瞩目的进展,引发了业界对“包容性AI”这一命题的重新思考。
Current AI的核心理念,源于一个被主流科技公司长期忽视的痛点:当前绝大多数AI模型,尤其是大语言模型,其训练数据高度集中于英语、中文、西班牙语等少数几种语言,而全球数千种语言中的绝大多数,尤其是非洲、南亚、东南亚及太平洋岛屿地区的方言,几乎被完全排...
Databricks估值达1880亿美元,延续AI领域热门后起之秀势头
Databricks正从大数据分析平台转型为纯AI公司,并发布研究称开源权重AI模型在编程任务中成本效益显著,可降低企业总体拥有成本,同时解决数据隐私问题。该研究指出,自托管开源模型在长期运营中比闭源API更经济,但顶级闭源模型在特定场景仍有优势。这一转型反映了AI行业的去中心化趋势,Databricks借此定位为AI基础设施公司,引导企业采用其平台部署开源模型,但中小企业仍面临技术门槛和初期投入挑战。
前DeepMind研究员未推产品即获3亿美元种子轮估值
在人工智能领域,一个名字或许并不像Sam Altman或Elon Musk那样家喻户晓,但他的工作却深刻影响了我们今天所熟知的AI生态。安德鲁·戴(Andrew Dai),一位在谷歌(Google)和OpenAI等顶级机构拥有超过十年经验的资深研究员,近日在一次深度访谈中分享了他对AI未来走向的独到见解。戴曾参与构建全球最具影响力的AI系统,其早期研究甚至为后来ChatGPT的诞生提供了关键理论基础。如今,他将目光投向了下一个重大前沿:视觉人工智能(Visual AI)。
戴的职业生涯堪称AI发展史的缩影。在过去的十多年里,他先后在谷歌大脑(Google Brain)团队和O...
AI公司CEO拒绝用‘超级智能’标签,称其概念模糊
在人工智能领域,几乎所有人都在追逐“超级智能”(superintelligence)这一终极目标,但有一位CEO却对此嗤之以鼻。他就是Yann LeCun(杨·勒昆)旗下世界模型初创公司AMI Labs的掌门人Alexandre LeBrun(亚历山大·勒布朗)。在接受媒体采访时,LeBrun直言不讳地表示,他并不认同当前业界对“超级智能”的狂热追捧,认为这一概念被过度炒作,甚至可能误导整个行业的发展方向。
LeBrun的言论在AI圈内引发了不小的震动。作为深度学习先驱Yann LeCun的合作伙伴,AMI Labs专注于构建“世界模型”(world model),这是一种试...
Moonshot’s upcoming Kimi 3 is expected to close th
在中国人工智能领域,一场新的技术竞赛正在悄然升温。据英国《金融时报》(Financial Times,简称FT)报道,中国AI初创公司月之暗面(Moonshot AI)即将推出其最新一代大语言模型——Kimi K3。这一模型被业界视为迄今为止中国最大的开源AI模型,其参数规模预计将达到2万亿至3万亿之间,这一数字不仅刷新了国内开源模型的纪录,也标志着中国AI技术在全球开源生态中迈出了关键一步。
参数数量是衡量大语言模型能力的重要指标之一。通常而言,参数越多,模型能够处理的信息复杂度越高,推理能力也越强。Kimi K3的2万亿至3万亿参数规模,使其在体量上足以与目前全球顶尖的闭...
Run a Local AI Model with Ollama in 15 Minutes
在人工智能技术飞速发展的今天,大型语言模型(Large Language Model, LLM)如GPT-4、Claude等已成为行业焦点,但它们的运行通常依赖云端服务器和高昂的计算资源。然而,一个名为Ollama的开源工具正在悄然改变这一局面,它让普通用户能够在自己的个人电脑上,在短短15分钟内快速部署并运行一个小型语言模型(Small Language Model, SLM)。这一突破不仅降低了AI技术的使用门槛,还为用户提供了更高的数据隐私保护和离线运行能力。
Ollama的核心理念是简化本地AI模型的部署流程。传统上,运行一个语言模型需要用户具备一定的编程知识、配置复...
How Cars24 scales conversations and builds faster
印度二手车平台Cars24通过部署基于OpenAI的AI语音与聊天代理,每月处理超100万分钟对话,挽回12%流失客户,并将智能代理工作流推广至内部多部门,整体运营效率提升约30%。该AI系统能理解复杂语境、主动引导成交,并实现7×24小时服务。实践表明,AI代理应作为人机协作桥梁,既能降本增效,也能创造增量收入,其成功为全球企业数字化转型提供了可复用的范本。
Microsoft is reportedly training salespeople to ta
在人工智能领域的激烈竞争中,微软(Microsoft)正悄然调整其战略布局,试图将自主研发的AI模型作为一项新的商业增长点推向市场。据知情人士透露,这家科技巨头正积极向潜在客户推销其内部开发的AI模型,并强调这些模型相较于竞争对手的产品,在效率和成本效益方面具有显著优势。这一动向标志着微软在AI领域的角色正在发生转变,从单纯的平台提供者向模型供应商延伸,进一步加剧了全球AI市场的竞争格局。
长期以来,微软在AI领域的策略主要围绕其与OpenAI的深度合作展开。通过将OpenAI的GPT系列模型集成到Azure云服务、Office 365以及Windows操作系统等核心产品中,...
AI Isn’t Smarter Than a Baby—Yet
在人工智能领域,科学家们一直在寻找突破现有技术瓶颈的方法,而最新的灵感或许来自一个意想不到的源头——婴儿的大脑。这些小小的、尚未完全发育的器官,实际上是人类已知最强大的学习机器。越来越多的研究者认为,深入理解婴儿大脑的工作机制,可能为下一代AI系统带来革命性的进步。
传统的人工智能,尤其是深度学习模型,依赖于海量的数据和强大的计算资源。例如,像GPT-4这样的语言模型需要从互联网上抓取数十亿个单词进行训练,才能生成看似合理的文本。相比之下,一个婴儿在出生后的头几年里,接触到的语言数据量极其有限,却能迅速掌握复杂的语法规则、理解抽象概念,并建立起对物理世界的直观认知。这种效率上...