「模式感知推理」共找到 3108 篇相关文章
阿里自己上场,用Qwen3做起了SmartResume应用
近期,阿里用Qwen3-0.6B+YOLOv10做了智能简历解析系统SmartResume,Code、Model、Paper都已开源。该系统支持多种文档格式,融合OCR与PDF元数据完成文本提取,结合版面检测重建阅读顺序,并通过LLM将内容转换为结构化字段。
Thinking with Video:一种全新的思考范式
在人工智能领域,‘用文本思考’和‘用图像思考’存在局限。复旦大学等团队提出‘用视频思考’范式,通过视频生成模型统一文本与视觉推理,构建VideoThinkBench基准测试Sora - 2,全面解读这一开创性工作。
G2ConS将微软GraphRAG的成本被打下来了~
传统Text - RAG处理多跳推理表现不佳,GraphRAG虽能提升准确率,但成本高。作者提出G2ConS方案,在3个多跳QA基准全面SOTA,平均节省30%费用,EM提升31.44%,整体流程仅3步。
中国游戏行业:产业结构、薪酬体系与核心人才需求分析
文章分析中国游戏行业,指出其已成为复杂数字经济体,2024年市场收入稳健增长。发展历经多阶段,AIGC等技术带来变革。商业模式以F2P与内购为主,“研运一体”是关键。行业薪酬有竞争力但工作强度高,版号影响深远。
AI正在改写地图APP!这一次轮到谷歌了
谷歌让开发者可通过Gemini API调用谷歌地图工具,整合位置感知功能。支持多模型,按查询次数收费。玩法多样,能个性化、实时化处理需求。国内高德早有相关尝试,AI正改写地图APP。
1.58bit不输FP16!微软推出全新模型蒸馏框架,作者全是华人
微软推出蒸馏框架BitNet Distillation,实现几乎无性能损失的模型量化。它含三阶段,经实验在多下游任务表现近全精度模型,降内存开销、提推理速度,作者全是微软研究院华人。
科技赋能艺术 让多样文明在数字时代华彩绽放 |国家大剧院受邀参加第二十四届中国上海国际艺术节
国家大剧院院长王宁在第二十四届中国上海国际艺术节演讲,阐述艺术与科技融合内涵,指出科技为艺术注入动能、艺术推动技术迭代、二者融合构建文化共享模式,还提出四点倡议促发展。
北大彭一杰教授课题组提出RiskPO,用风险度量优化重塑大模型后训练
北大彭一杰教授课题组提出 RiskPO,解决大模型后训练陷入「均值陷阱」问题。它将风险规避理念融入优化目标,用「关注奖励分布左尾」替代「追求整体均值」,在多领域数据集上表现超越 GRPO 等。
100美元、8000行代码手搓ChatGPT,Karpathy最新开源项目爆火,一夜近5k star
AI大神Andrej Karpathy发布开源项目nanochat,可教你100美元自建ChatGPT,覆盖LLM训练和推理。项目有8000行代码,不到12小时获超4500 star,功能丰富,但他认为它不适合个性化应用。
大模型追逐星辰大海,GPT和Gemini国际天文奥赛夺金
新论文以国际天文学和天体物理学奥林匹克竞赛 (IOAA) 为基准测试,证明 GPT - 5 和 Gemini 2.5 Pro 能在天文奥赛获金牌。研究还分析不同模型表现、与人类成绩对比及错误类型,强调需全面评估模型科研潜力。