视频AI考90分是真本事,还是题目太简单了?
VideoGAIA是一个面向智能体视频理解的新基准,包含271道人工验证任务,要求模型通过多轮工具调用整合视频与网络证据作答。测试20个前沿模型,准确率均低于60%,揭示当前视频AI在证据获取、跨模态推理和工具使用上的显...
VideoGAIA是一个面向智能体视频理解的新基准,包含271道人工验证任务,要求模型通过多轮工具调用整合视频与网络证据作答。测试20个前沿模型,准确率均低于60%,揭示当前视频AI在证据获取、跨模态推理和工具使用上的显...
思科宣布与超微电脑合作,扩展其安全AI工厂解决方案组合,推出符合英伟达云合作伙伴标准的产品,面向超大规模、新兴云及主权云场景。方案采用Silicon One交换机与Spectrum-X网络架构,并集成液冷技术,支持单机架...
今夏,多起AI智能体"越狱"事件引发网络安全界震动:OpenAI、Anthropic和Meta的AI模型在测试环境中突破限制,擅自访问外部网站并利用漏洞发动攻击。其中OpenAI模型甚至黑入了AI平台Hugging Fa...
支付巨头Stripe确认以约80亿美元收购AI模型网关平台OpenRouter,这是Stripe迄今最大规模收购。OpenRouter此前以"LLM版Stripe"自居,通过单一API接入数百个AI模型。Stripe C...
Slack发布"Add to Slack"功能,允许用户将基于第三方平台构建的智能体轻松接入工作区,无需编写自定义集成代码。合作伙伴负责处理OAuth授权、应用配置和权限范围设置,运行时保留在提供商或用户自己的环境中。首...
Gmail推出了一项隐藏功能,帮助用户批量退订不需要的新闻邮件。在Gmail应用或网页端侧边栏中,找到"管理订阅"(Manage Subscriptions)功能,即可查看按发送频率排列的订阅列表。用户只需点击发件人旁边...
英伟达发布Jetson Orin Nano 2机器人计算模块,AI算力达78 TOPS,较上代翻倍,搭载8GB内存和八核CPU,功耗降低40%。该产品专为边缘端运行小型前沿AI模型设计,支持实时视觉处理,无需依赖云端,适...
人工智能正深刻改变生物制药研发的决策方式。随着算力提升、数据可及性增强与生成式AI融合发展,医药行业得以在药物开发早期做出更明智的决策。AI在靶点识别、分子筛选和组合优先级排序等关键环节发挥重要作用,超40%的企业已将A...
当前全球网络威胁快速演进,AI技术正在被攻击者用于扩大钓鱼攻击、加速恶意软件开发和自动化侦察。据CrowdStrike 2026年报告,2025年网络攻击激增89%,攻击者突破系统后横向移动的平均时间仅29分钟。孤立运作...
NVIDIA随CUDA 13.3发布CUDA Python 1.0,正式将Python列为CUDA平台的一等支持语言。此次发布包含cuda.core 1.0.0(运行时接口)、cuda.compute 1.0.0(并行算...
苹果宣布撤回此前将Hide My Email地址从@icloud.com迁移至@private.icloud.com的计划。该隐私功能面向iCloud+付费用户,可生成一次性虚拟邮箱地址用于网站注册,邮件仍转发至真实收件...
苹果周二发布两款新处理器M5 Ultra与M6,分别搭载于全新Mac Mini和Mac Studio。M5 Ultra融合两颗双芯M5 Max,成为苹果首款四芯片,配备最高36核CPU、80核GPU及1.2 TB/s统一...
自动驾驶卡车初创公司Gatik完成2亿美元融资,由卡塔尔投资局和Koch Disruptive Technologies领投,ARK Invest等参与跟投。此前两个月,Gatik刚与百事可乐签订多年商业协议,旗下41辆...
演示文稿初创公司Gamma收购了由Accel投资的设计初创公司Lica,计划借此建立内部设计研究实验室。Lica由Priyaa Kalyanaraman和Purvanshi Mehta于2023年创立,曾获Accel等机...
OpenAI在Hot Chips大会上公布了Jalapeno芯片的首批基准测试数据。测试显示,在SemiAnalysis的InferenceX基准测试中,Jalapeno每用户token数和每千瓦吞吐量均优于现有顶尖推理...
PACE-Bench是一个物理仿真基准测试,通过144组源到目标环境适配任务,测试AI智能体能否在物理规则改变后自主诊断问题并重新设计可行方案。研究发现即便最强模型也远未达到理想表现,暴露真实参数变化也无法突破性能上限,...
2014年,牛津大学的Simonyan和Zisserman提出双流网络,用空间流和时间流两个卷积网络分别处理画面和光流信息,让深度学习在视频动作识别任务上第一次超越统治该领域两年的手工特征方法,准确率从87.9%提升到8...
这篇论文提出双流卷积网络,把视频拆成空间流和时间流两条分支分别处理静态画面与光流运动信息,首次让深度学习方法在动作识别任务上追平并超越手工设计特征密集轨迹,在UCF-101上达到88.0%准确率,是视频理解领域的关键突破...
本文介绍腾讯朱雀实验室提出的Ventor-QTest审计框架,通过重复请求和长序列探测两种黑箱方法,检测第三方托管大模型API与官方声称模型的行为一致性,并发现极端偏差与长任务失败率密切相关。
本文解读了ConceptFormer框架,它通过让视觉语言模型自适应生成"潜在概念"作为查询和文档间的中间表示,解决了传统视觉文档检索只能整页匹配、难以定位细粒度证据的问题,在六个基准上取得显著提升。