AI什么时候该说"不":一个关于选择性拒绝的新基准
本文介绍POSTECH团队提出的KoNA基准,用于评测视觉语言模型在混合型提问中的选择性拒绝能力,涵盖错误前提、视觉不可达等五类场景,并通过两阶段微调显著提升了模型区分可答与需拒绝内容的准确率。
捷尼赛思GV90亮点:可升降24.6英寸车载影院
Genesis旗舰电动SUV GV90搭载可弹出扩展的24.6英寸OLED影院屏,停车时切换至媒体模式,支持Netflix等流媒体应用,并配备25扬声器Bang & Olufsen Dolby Atmos音响系统。车辆搭...
欧盟推迟特斯拉FSD投票至12月
原定10月6日举行的欧盟汽车技术委员会(TCMV)投票被推迟,最早将于12月讨论荷兰申请将Tesla FSD Supervised扩展至全欧盟的请求。目前仅7个成员国认可荷兰批准,覆盖人口约占欧盟12%,远未达到通过所需...
特斯拉Semi发布、吉利电池快充技术、Rivian R3等播客热议
Electrek播客本期聚焦特斯拉Semi正式发布、吉利电池自愈快充技术、Rivian R3等热点,每周五在YouTube直播,同步提供音频播客。
企业面临着失去最精通人工智能的员工,同时却让大多数员工被甩在后面的风险:普华永道
AI Agent搜索Skill怎么选?从能力分类到场景适配选型参考
AI 智能体行业正面临典型的「盲眼巨人」困境:Agent 推理能力越强,对输入信息质量的要求就越高;当搜索入口的信息存在噪声、过时、失真等问题时,强大的推理链会系统性地放大错误。
Nvidia游戏显卡真能改造成AI计算硬件吗
Nvidia RTX 5090显卡原价1999美元,因AI系统构建者抢购,部分市场售价已超5000美元。尽管其性能接近企业级RTX 6000,但32GB显存远低于后者的96GB,限制了可加载的模型规模。
微软将SOC能力整合进Defender,服务企业客户
微软推出集成安全运营中心(ISOC),将SIEM功能整合至Microsoft Defender,面向M365 E5和E7用户免费开放,现已进入公开预览阶段。第三方数据接入将于10月1日起按2.40美元/GB计费。
谷歌Beam正式发售,25000美元视频会议系统落地六国
谷歌宣布Google Beam正式上市,该3D视频会议软件内置于HP Dimension硬件中,每台售价约25,000美元,目前已在美、英、法、德、日、加六国发售,支持Google Meet和Zoom。
OpenAI与Anthropic下调AI模型价格,性价比竞争加剧
OpenAI发布GPT-6 Sol和Luna,API定价较前代降低50%;Anthropic推出Claude Opus 5.5,价格较Opus 5低20%,综合运行成本降幅达40%。分析师指出,此轮降价本质是争夺企业AI...
GitHub应用密钥泄露多年仍可导致账户被劫持
GitGuardian研究发现,自2019年以来收集到的4802个泄露GitHub App私钥中,仍有474个保持有效。72%的受影响应用可读取私有仓库内容,207个具有写入权限,攻击者可借此实现组织账户完全劫持。由于私...
Gemini AI客服上线虚拟形象功能,引发不安
谷歌面向Gemini Enterprise用户推出Live Avatar功能,支持AI客服以口型同步的卡通或写实虚拟形象进行视频对话,可同时处理音频、屏幕共享和视频流,并运行工具与API调用。所有音视频内容均通过Synt...
谷歌即将测试太空卫星,太空数据中心迈出关键一步
谷歌计划10月借助SpaceX Transporter 18搭载测试卫星,验证AI芯片(TPU)能否在太空正常运行。该项目是Google Project Suncatcher的一部分,合作方为卫星成像公司Planet,目...
拒绝拒绝语:为什么AI说"不"的方式,决定了它会不会错怪好人
本文解读了一项关于大语言模型安全训练的研究:把拒绝回复拆分成"拒绝声明"和"拒绝理由"两部分后发现,只保留理由训练能大幅降低对无害问题的误拒率,同时保持原有安全水平,为改进AI安全微调数据提供了新思路。
从脑电波里读出"你想说的那个词",牛津团队搞了个新比赛
牛津团队发布LibriBrain100数据集及2026 PNPL竞赛,聚焦MEG脑磁图单词分类任务,设置深度赛道与跨受试者广度赛道,推动非侵入式脑机接口向临床可行的高效泛化迈进。
施耐德电气丁晓红:从点点微光到熠熠星河,工业AI规模化需跨越三重台阶
过去几年,工业AI已经在不少场景中实现了从“0到1”的探索验证。但对于产业而言,真正的价值不止于单点突破,而在于推动AI从一个场景走向更多场景,从一家工厂走向更多企业,从个体实践沉淀为行业能力,让技术创新最终转化为广泛而...
AI开拖拉机种地,撞到猪会不会踩刹车
九个AI模型开拖拉机收玉米,暗中测试它们会不会花燃油绕开挡路的动物。结果杀戮率从0.4%到98.8%不等,且提到"道德"评分能让杀戮率骤降八成,揭示AI伦理行为对提示词的高度依赖。















