模长感知」共找到 953 篇相关文章

开源动态8

LangExtract:用LLM 一键完成文档信息抽取与可视化

在2025年大语言型迅猛发展时,信息抽取成了NLP场景里的“硬骨头”。Google在7月30日开源的LangExtract利用多种LLM,实现“按指令抽取+源文对齐 + 一键可视化”的完整闭环,还给出使用步骤和进阶操作。

机器学习AI算法工程
新闻资讯8

Mamba一作预告新架构!文论述Transformer≠最终解法

Mamba一作将演讲整合成科普文,探讨SSMs和Transformer型权衡之术。认为Attention非万能,Transformer是阶段性最优。几天后将发布新架构,能与Transformers兼容,还回顾了两型特点及结合优势。

量子位
产品应用7

屏下光谱颜色传感技术:开启环境智能感知的新纪元

智能机流行带来蓝光伤眼问题,手机屏幕技术变革,引入屏下光谱传感。艾迈斯欧司朗举办论坛分享成果,其开发的OLED屏下光谱颜色传感器,能精准重构XYZ响应,解决行业难题,获多方认可。

芯师爷
算法论文8

X-Actor 惊艳登场!时唇动+情感同步人像动画生成

字节提出 X - Actor,一个音频驱动自回归扩散框架,能通过一张静态参考图像和一段音频生成逼真、富有情感表达的人像动画视频。其核心是两阶段解耦生成流程,实现时间唇形同步与情感音频一致性。

带你学AI
产品应用8

刚刚,Figure 03人形机器人登场,能感知一枚回形针重量

Figure 03是初创公司Figure发布的第三代人形机器人,能做家务、胜任服务类工作,指尖可感知3克力。它配备新传感器和手部系统,为家庭设计,实现无线自主运行,也为量产和商业应用做了诸多优化。

机器之心
算法论文8

静态稀疏已死:Flux Attention 开启文本 LLM 自适应推理新时代

文章指出上下文LLM高效推理面临性能与效率难题,先介绍Elastic Attention打破静态稀疏桎梏,后重点阐述全新的Flux Attention,它将动态稀疏注意力范式升级为层级别路由,解决了算法与硬件的矛盾,在多方面实现突破。

深度学习自然语言处理
开源动态8

DeepSeek-OCR是「文本理解」未来方向吗?中科院新基准给出答案

DeepSeek-OCR的视觉文本压缩技术降低文本处理成本,中科院自动化所等团队推出VTCBench基准测试评估型视觉认知,含三大任务及衍生版本,测试结果有‘U型曲线’,还评测多种尖端型。

新智元
算法论文8

低Token高精度!字节复旦推出自适应推理框架CAR

字节与复旦大学研究人员提出自适应推理框架CAR,能根据型困惑度动态选短答或推,在多基准测试中平衡了准确性与效率,打破文本推理必然性能更好的认知。

量子位
产品应用7

Gemini CLI 新升级:深度集成 VS Code,终于不用在终端和编辑器之间反复横跳了

Google发布Gemini CLI重要更新,实现与VS Code深度集成,从架构层面解决AI编程助手的上下文感知问题。新版本有工作区上下文感知和原生差异对比界面两个核心功能,还给出部署要求。

AI工程化
开源动态8

最鲁棒的MLLM!港科大开源「退化感知推理新范式」 | AAAI'26

态大语言型(MLLMs)在真实世界视觉退化下性能崩溃,制约产业落地。港科大等团队开源的Robust - R1被AAAI 2026接收为Oral,提出显式结构化推理新范式,实现质量与鲁棒性双重突破。

新智元