大模型
共 30 篇文章
Vercel CEO Guillermo Rauch on the fight to split o
在当今人工智能技术飞速发展的浪潮中,从实验室的炫酷原型到能够真正落地创造商业价值的规模化应用,始终横亘着一道巨大的鸿沟。近日,知名技术领袖、Vercel(一家领先的Web开发平台)联合创始人兼首席执行官Guillermo Rauch在接受科技媒体TechCrunch采访时,一针见血地指出了当前AI行业发展的核心矛盾:当企业真正将AI模型投入生产环境时,关注的焦点必须从单纯的“性能表现”转向更为务实的“性价比”(price/performance)。
Guillermo Rauch的这番言论,并非空穴来风。在过去几年里,随着大语言模型(LLM)的爆发式增长,行业内的竞争焦点一度...
2026年科技巨头裁员潮中提及AI的案例一览
当科技行业在2023年经历了一场由效率至上主义主导的大规模裁员后,2024年的风向往回吹得更猛了。然而这一次,背后的推手不仅仅是宏观经济的压力,更是一场悄然进行的生产力革命——人工智能(AI)。近日,一份对今年主要科技公司裁员公告的梳理显示,一个令人不安却又合乎逻辑的趋势正变得越来越清晰:那些曾在疫情中大举扩张的巨头,如今正将AI视为重塑人力资源结构、削减岗位的关键理由。
这份观察报告按时间倒序,系统性地列举了那些明确将AI列为裁员因素的大型科技公司。从年初到年中,裁员公告如雪花般飞来,而几乎每一份公告的字里行间,都能嗅到AI技术替代传统岗位的气息。这并非简单的经济下行周期中...
Reddit is using LLMs to solve a problem LLMs large
在人工智能技术狂飙突进的时代,网络空间中的“猫鼠游戏”正迎来前所未有的升级。随着生成式AI(Generative AI)的普及,垃圾信息(spam)的制造者不再仅仅依赖人工或简单的自动脚本,而是开始利用大语言模型(Large Language Model, LLM)生成越来越难以分辨的虚假内容。面对这一严峻挑战,各大在线平台不得不采取一种看似矛盾却又势在必行的策略——以其人之道还治其人之身,即利用同样甚至更为先进的AI技术来识别和清除这些由AI催生的垃圾信息。
长期以来,社交媒体平台、论坛、评论区以及电子商务网站都深受垃圾信息的困扰。传统的垃圾信息,例如批量发布的广告链接、简...
The Complete Guide to Tool Selection in AI Agents
在人工智能技术飞速发展的今天,智能体(Agent)的构建已成为推动自动化与决策能力革新的关键领域。近日,一项关于智能体工具集设计的最新实践引发行业关注:开发者通过为单一智能体配备五种核心工具,显著提升了其任务处理效率与适应性。这一技术动态不仅展示了AI工程化的前沿探索,也为未来智能系统的模块化设计提供了新思路。
据业内技术指南透露,构建一个功能完善的智能体通常需要集成多个专用工具,这些工具如同智能体的“感官与手脚”,使其能够执行从数据检索到复杂操作的各种任务。具体而言,一个典型的五工具智能体架构可能包括:信息检索工具(如网络搜索或数据库查询)、计算推理工具(如数学引擎或逻辑处...
Context vs. Memory Engineering in Agentic AI Syste
在人工智能与云计算基础设施深度融合的今天,底层系统的每一次微小优化,都可能为上层应用的性能带来指数级的提升。近日,一项关于“到达时压缩”(Compression on Arrival)工具的底层逻辑修正,在系统架构与高性能计算领域引发了广泛关注。这一技术调整虽然看似只涉及代码执行时序的微调,但其背后折射出的是当前AI基础设施在处理海量数据流时,从“静态阈值触发”向“动态事件驱动”演进的重要趋势。
长期以来,在分布式系统及AI推理引擎的数据传输管道中,数据压缩机制往往依赖于一种粗放式的“缓冲区填充触发”逻辑。具体而言,当系统调用(Call)产生的输出数据不断涌入内存窗口(Win...
LLMs are stuck in a groupthink rut. This startup i
当前主流大语言模型存在严重的同质化问题,面对开放性提问常给出高度重复的答案。澳洲初创公司Springboards为此开发了Flint模型,它基于阿里Qwen 3,通过在输出中特定位置精准引入随机性而非全局调高“温度”参数,打破常规以提供更多样、更具创意的回应。尽管Flint仍为原型且偶尔不稳定,但已获广告营销专业人士青睐,用于发散思维。创始人强调,提供多样性选择能激发人类灵感,避免AI将世界推向灰色的平庸。
大模型深陷“群体思维”怪圈?这家初创企业试图打破AI趋同僵局
在当今的人工智能时代,大型语言模型(Large Language Models, 简称LLM)似乎无所不能,从编写复杂的代码到撰写严谨的研究报告,它们的表现令人惊叹。然而,在这些看似智能的对话背后,却隐藏着一个鲜为人知的致命缺陷:它们正陷入一种严重的“群体思维”(Groupthink)之中。当你向ChatGPT、Claude或Gemini等主流AI助手寻求创意时,你得到的答案往往比想象中更加千篇一律,缺乏真正的多样性。
为了验证这一现象,不妨做一个简单的测试:打开你常用的任何一款聊天机器人,输入“给我一个1到10之间的随机数字”。在绝大多数情况下,你会得到数字7。如果你继续要...
Meta, like SpaceX, looks to turn excess AI compute
在人工智能浪潮席卷全球的当下,科技巨头之间的竞争已经从单纯的模型研发延伸至底层基础设施的争夺。据可靠消息,Meta(原Facebook)正在酝酿一项雄心勃勃的计划,准备进军云计算基础设施业务,向企业和开发者出售其人工智能计算能力与自研大模型。这一战略转向意味着,Meta即将与Amazon Web Services(亚马逊云服务)、Google Cloud(谷歌云)以及Microsoft Azure(微软云)等传统云计算巨头展开正面交锋,从而彻底改写当前由少数几家厂商主导的云计算市场格局。
长期以来,Meta在公众视野中主要是一家社交媒体公司,其核心业务围绕Facebook、I...
新攻击再证AI浏览器不可取
Makers of AI browsers make lofty promises. With a single prompt, users can ask one to find a restaurant in a particular part of town, reserve a table, invite a colleague to lunch, and email a confirmation. These makers are much more reticent about the risks of blurring the once fine line between bro...
Nvidia competitor Etched hits $5B valuation, $1B i
在人工智能芯片赛道上,一场围绕“推理”环节的军备竞赛正悄然升级。近日,一家名为Etched的初创公司高调宣布,其基于自研芯片的推理系统已获得价值10亿美元的合同订单。这一消息迅速在科技圈引发震动,不仅因为其金额之巨,更因为它直接向行业霸主Nvidia(英伟达)发出了挑战信号。
Etched的崛起并非偶然。随着AI大模型从训练阶段逐渐转向大规模应用部署,推理(Inference)环节的效率和成本正成为决定行业落地的关键瓶颈。所谓推理,即训练完成的AI模型在实际应用中处理新数据、生成回答或决策的过程。与需要海量算力和漫长周期的训练不同,推理要求更低的延迟、更高的能效比以及更经济的...