全部资讯
共 298 页,第 195 页
OpenAI与太平洋西北国家实验室联手打造新基准,或用AI实现联邦审批流程15%效率提升
OpenAI与美国国家实验室合作开发DraftNEPABench基准测试平台,旨在利用AI编码代理加速联邦项目审批中的环境影响评估环节。该系统采用双代理架构,通过真实案例测试展示出在法规遵循性和报告起草效率上达到89%准确率,可节省约15%工作量。面对联邦工程审批周期过长导致的项目延误问题,DraftNEPABench为AI辅助决策提供了量化依据,在保持环境评估严谨性的同时提升效率,尤其适用于当前美国政府大规模基建投资需求。该项目不仅代表AI技术在法规审查中的新应用,更展示了科技与政府流程整合的潜在方向。
AI艺术创作引发版权争议:谁拥有AI生成作品的版权?
AI艺术创作工具的普及引发了复杂的版权问题,法律界和艺术界对此存在广泛争议。
OpenAI Codex 集成 Figma:无缝连接代码与设计提升团队迭代速度
OpenAI与设计平台Figma上周联合推出革命性工具Codex集成方案,旨在简化代码开发与视觉设计间的协作。此前OpenAI已在Visual Studio Code中集成了Codex模型,而Figma则是连接设计与开发的重要桥梁。此次合作结合了OpenAI强大的自然语言生成代码能力(Codex是其第二代模型,能从抽象需求自动转化为结构化代码)与Figma的实时动态原型构建功能。用户只需简单点击,即可将设计直接关联到Codex模型生成代码,显著提升了跨职能团队的工作效率并解决了开发与设计闭环中的核心难题。
欧盟AI法案实施细则出台:企业如何合规?(深度分析)
欧盟发布AI法案实施细则,为企业的AI系统开发和部署提供具体指导。...
美国发布AI行政命令:平衡创新与安全(更新)
美国总统签署AI行政命令,旨在促进AI创新的同时确保安全和公平。...
AI技术被恶意滥用:网络安全防线如何应对?
随着AI技术在网络安全领域的快速发展,恶意行为者正利用其结合网站和社会平台提升攻击效率。他们通过生成高度逼真的虚假内容,如社交媒体帖子和钓鱼网站,大规模传播恶意信息并规避检测机制。过去几年中,AI驱动攻击事件激增30%,尤其在社交媒体成为主要目标,导致金融、医疗等行业面临更高风险。网络安全专家指出,AI的双重用途要求策略从被动转向主动防御,并呼吁加强国际合作应对这一新型威胁。
OpenAI任命Arvind KC为首席人才官,推动公司扩展、文化强化及AI时代工作演变
2024年1月,OpenAI任命DeepSeek旗下人才管理系统的首席架构师Arvind KC担任首席人才官(CPO),反映出AI行业对人才的激烈争夺。随着公司人类友好型AI助手产品进入扩张阶段,KC将负责三项关键任务:扩大人才规模至现有团队两倍、重塑OpenAI的创新文化基因,并领导相关工作,以适应技术迭代带来的组织变革需求。
SWE-bench Verified缺陷被揭露,专家推荐Pro版本
随着人工智能在软件开发中的广泛应用,各大科技公司推出的AI辅助工具竞争加剧。然而,硅谷前沿研发中心的最新报告指出,SWE-bench Verified作为行业基准测试存在严重问题:系统性偏差和训练数据泄露导致约23%的基准结果数值偏差,评分机制不稳定且放大模型差异。报告警告这种现象可能扭曲AI能力评估标准,并揭示测试设计未能捕捉实际应用的复杂性。过去十年,AI编程模型如Codex和GitHub Copilot兴起,SWE-bench快速成为标准工具;但数据完整性危机促使行业转向更可靠的体系,如SWE-bench Pro,并正在开发新一代Alpha Benchmark以解决代码污染和测试分布漂移。
多模态大模型成为新趋势:文本、图像、视频、音频一体化
多模态大模型成为2024年AI领域最热门的方向,各大厂商纷纷推出能够同时理解多种信息形态的模型。
OpenAI 推出新伙伴计划,助力企业实现 AI 从'试验田'到规模化部署的跨越?
OpenAI公布企业级合作计划Frontier Alliance Partners,旨在帮助企业将AI从实验性应用转向大规模生产部署。该计划通过联合云计算与网络安全公司,推出经安全测试的多款AI模型,并降低技术集成复杂度、提升模型可靠性及应对合规压力。此举标志着OpenAI从侧重模型开发转向商业化落地,直击企业级应用痛点,推动AI产业化进程加速。同时,该计划也打破了单一供应商模式,为不同行业提供了灵活整合AI技术的机会,并可能重塑全球AI商业生态格局。