「意识可及」共找到 5946 篇相关文章

新闻资讯7

“像把大象塞进冰箱一样困难”,端侧大模型是噱头还是未来?

InfoQ《极客有约》X AICon 直播聚焦端侧大模型,探讨其落地挑战与破局思路。专家指出端侧部署有隐私、可用性等优势,但面临内存、精度等难题。华为、支付宝等分享方案,还探讨应用场景、商业模式及未来趋势。

InfoQ
算法论文7

大模型追逐星辰大海,GPT和Gemini国际天文奥赛夺金

新论文以国际天文学和天体物理学奥林匹克竞赛 (IOAA) 为基准测试,证明 GPT - 5 和 Gemini 2.5 Pro 能在天文奥赛获金牌。研究还分析不同模型表现、与人类成绩对比及错误类型,强调需全面评估模型科研潜力。

机器之心
推荐文章7

Chrome已死,AI浏览器当立!认知革命比技术成熟来得更快。

文章指出AI浏览器重新定义底层逻辑,从导航工具变为执行意图的引擎,有持续意图记忆等核心能力。即便成功率不高,用户也易完成认知转变,还总结了AI产品团队应知道的规律及失败类型。

探索AGI
产品应用7

通用模型无法完全理解用户,AI产品的下一站是上下文的战场|对话AI知识助手remio

量子位智库对话remio创始人汪源,探讨其开发初衷、核心价值等。remio主打无感自动化,成用户第二大脑,有信息捕获、管理等功能,数据本地存保隐私。还聊了目标用户、指标、功能及应对竞争等。

量子位
开源动态8

2.6K Star!超逼真端侧TTS模型,0.5B参数3秒音频即时克隆!

文章介绍开源项目NeuTTS Air,它是免费、轻量级超逼真语音合成模型,仅0.5B参数,媲美商用TTS引擎,能在低功耗设备运行,支持3秒音频克隆声音,还给出使用步骤和应用场景。

开源星探
产品应用8

谷歌最强AI图像模型Nano Banana 100+精选案例,商业级 AI 创意图集!附高清Prompt

Awesome-Nano-Banana-images收集Nano-banana在各任务场景生成的惊艳图片与提示词,展示Google图像生成与编辑无限可能。文中列举插画变手办、根据地图箭头生成图片等110个案例及对应输入和提示词。

AI Reading Hub
算法论文7

5大维度、4类模态:LLM/Agent数据分析技术全景图

文章分享《LLM/Agent-as-Data-Analyst: A Survey》,上交大、清华、微软等将「LLM/Agent 当数据分析师」技术拆成 5 大设计维度与 4 类数据模态,给出 100+ 代表性方法等,还介绍不同数据类型的分析技术。

PaperAgent
产品应用8

2.12页/秒,MinerU2.5太快了,1.2B硬刚腾讯、阿里

GPT - 4o等刷新OCR榜单,但产业界仍面临文档图像处理难题。MinerU2.5提出1.2B轻量级文档解析模型,采用创新解耦范式,在多基准测试表现出色,单卡吞吐快,还给出可借鉴创新点。

CourseAI
新闻资讯7

ChatGPT推出即时结账,比Claude发布重要得多

OpenAI宣布在ChatGPT推出即时结账功能,用户可在聊天界面直接购买,首批合作商家有Etsy,Shopify超百万商家将加入。由ACP驱动,是开源标准。资本市场反应好,社区反应不一,这标志AI助手向交易平台转变。

AI工程化
产品应用8

科幻!谷歌放出Gemini Robotics-ER 1.5:机器人有了真正的思考力

谷歌推出首个广泛开放给开发者的机器人具身推理模型Gemini Robotics - ER 1.5,可作为机器人高级推理大脑。它能解决物理问题,有新能力如快速空间推理等,还能让开发者平衡延迟与准确性。

AI寒武纪