泛能网」共找到 5179 篇相关文章

算法论文8

多模态幻觉的病因「高熵节点」找到了!全基准幻觉率下降

多模态大推理模型的幻觉常出现在生成转折词时,此时模型处于高熵关键节点,易脱离图像证据。研究者提出LEAD,高熵时保留候选推理方向,注入视觉锚点拉回证据,实验显示它跨领域提升模型性

新智元
新闻资讯8

比肩OpenAI Simple Codex,中国团队闯入Terminal-Bench全球第二!

Anthropic和OpenAI推出新模型后,基础大模型较量进入实战比拼。中国团队Feeling AI的CodeBrain - 1在Terminal - Bench 2.0榜单排全球第二,它聚焦代码编写运行,还动态调整计划策略,展现出高含金量。

机器之心
新闻资讯7

AI招聘逆天研究:看照片预测一生职业成就

硅谷大厂HR标配的AI招聘系统Eightfold AI被指控算法歧视,求职者要求提高招聘筛选透明度。同时,美国多所高校研究者完成一项研究,AI通过人脸照片预测职业走向,但因训练数据问题引发公平性争议。

量子位
新闻资讯7

独家|蚂蚁、美团入局 AI 硬件, Looki 完成超 2000 万美元 A 轮融资

AI硬件创业公司Looki完成超2000万美元A轮融资,由蚂蚁集团领投。其首款产品Looki L1引发关注,全球累计销量近万台。Looki将推主动式AI新功,持续深耕‘以人为中心’理念。

Founder Park
新闻资讯7

马斯克开始疯狂剧透Grok 5了

ARC - AGI榜单官宣新SOTA,用Grok 4+程序合成技术微调,超越一众明星模型。马斯克剧透Grok 5,称其达AGI,将几周内开始训练。投入大量训练数据和硬件资源,但成品效果仍待观察。

量子位
新闻资讯7

The Batch: 870 | 手机上的主动式AI助手

谷歌发布Pixel 10,搭载Magic Cue AI系统。它基于新版Gemini Nano,运行在Tensor G5处理器上,预判用户需求,自动提供相关信息。谷歌早就在手机推AI,此次将其深度融入系统和应用。

DeeplearningAI
开源动态8

利用大模型从开源情报中自动提取检测规则:LLMCloudHunter,有开源

随着络攻击增加,威胁情报成主动安全关键。以色列本古里安大学发布LLMCloudHunter框架,用大模型从开源情报自动生成检测规则,评估显示其规则质量高,且大部分编译成Splunk查询,软件已开源。

AI与安全
推荐文章7

太多人误解了「苦涩的教训」

《“苦涩的教训”》一文常被误解,其核心观点是充分利用计算资源扩展的方法会超越不扩展的方法。人类知识短期易获好结果,但长远看,唯有随算力增长的方法最终胜出,如深蓝、AlphaGo Zero的案例。

宝玉AI
算法论文8

王梦迪、丛乐团队Science Earth:当组织本身开始涌现,全球科学力第一次在同一张上互相发现

王梦迪、丛乐团队在arXiv发布预印本论文,推出面向AI原生科学发现的行星级操作系统Science Earth,它连接全球科学力。文中通过两个案例展示其作用,并介绍协调内核EACN,还公开了论文、代码与络。

量子位
产品应用8

豆包输入法Mac版正式上线,所有人都该试试AI语音输入了。

豆包输入法Mac版正式上线,作者推荐大家用其语音输入与AI对话。如今语音输入法渐成熟,提升输入速度与质量。豆包输入法免费,体验好,有流式输出、自动纠错、中英混说、轻声抗噪等功

数字生命卡兹克