多模态AI专题
汇总多模态模型、图文视频理解与跨模态应用相关资讯、工具教程、产品动态和应用案例,持续跟进AI行业热门关键词。
2026-07-14 17:00
376
从“新鲜玩意”到“生活必备”,AI眼镜还有多远?
当前智能穿戴设备已步入产业升级关键期,AI眼镜作为交互革新的战略载体,正面临从功能集成向生态构建的跨越。Meta与雷朋联袂打造的Ray-BanMeta智能眼镜,以时尚基因融合基础AI功能开辟消费市场新蓝海。根据[具体数据来源]统计,该产品在2024年斩获224万台销量,占据全球95%市场份额的亮眼成
Agentic AI重构影像创作,影石Insta360联
全民影像记录时代到来,全景相机、运动相机、航拍无人机走进大众生活,每个人都能随手拍摄海量视频素材,但剪辑繁琐、高光筛选耗时、全景素材适配难等行业痛点始终未能彻底解决。市面上主流剪辑工具大多只聚焦后期编辑,平台适配流程复杂、模板同质化严重,针对360°全景画面的智能制作能力更是长期空白。与此同时,全球
多模态AI融入日常交互 用三星Galaxy手机搭建效率工作流
在AI技术不断演进的当下,智能手机正在从“工具”转变为真正的“伙伴”。三星Galaxy智能手机通过不断进化的Samsung One UI和Galaxy AI,正在用更聪明的AI体验、更贴心的功能设计,陪伴用户高效生活、自由表达,从容应对快节奏的每一天。据三星联合 Symmetry Research展
小猿AI接入多模态AI能力,推动智能学习体验升级
小猿AI升级为全学科AI学习助手,强化多模态能力,支持图像识别、文本理解与题目解析;拍照后可智能分析题型、匹配知识点并推荐练习;语文英语模块新增语句纠错、单词解释及作文辅助功能。小猿AI近期在产品能力上迎来重要升级,正式强化多模态AI能力,使其在图像识别、文本理解与题目解析方面表现更加全面。据产品体
视听感知多模态AI大模型来了!海康威视携手南京钢铁为炼钢筑牢“安全感”
当AI与炼钢相遇,一幅炽热而智能的画卷正徐徐展开。6月25日,由南京钢铁集团有限公司主办,中国钢铁工业协会、江苏省发展和改革委员会、江苏省科学技术厅、江苏省工业和信息化厅、江苏省数据局指导的“元·冶”生态智创发展大会在南京成功举行,数百位政企学研嘉宾齐聚,深入交流前沿技术与产业生态的创新融合。在大会
阶跃AI推动多模态AI发展:语音与内容生成能力持续增强
阶跃AI正加速构建多模态AI能力,重点布局语音识别与生成、跨模态内容理解;强化语音交互,支持自然语音输入输出;提升图文理解能力,拓展至营销文案、知识整理等智能写作场景;向全面智能助手演进。阶跃AI正在加速推进多模态AI能力建设,重点布局语音识别、语音生成以及跨模态内容理解能力。在最新技术方向中,阶跃
体验焕新!多模态AI邂逅三星Galaxy Z Fold7|Z Flip7
作为折叠屏手机领域的开创者与引领者,三星凭借深厚的技术积淀与创新能力,始终走在行业发展前沿。如今,历经七代产品迭代,全新的Galaxy Z Fold7与 Galaxy Z Flip7承袭三星折叠屏家族的创新基因,不仅是迄今为止最轻薄、最先进的Galaxy Z系列机型,更搭载具备多模态AI能力的Sam
三星Galaxy Z系列携多模态AI开启智能生态体验新篇章
作为折叠屏手机领域的开创者与引领者,三星凭借深厚的技术积淀与创新能力,始终走在行业发展前沿。如今,历经七代产品迭代,全新的Galaxy Z Fold7与 Galaxy Z Flip7承袭三星折叠屏家族的创新基因,不仅是迄今为止最轻薄、最先进的Galaxy Z系列机型,更搭载具备多模态AI能力的Sam
三星MWC2025以AI描绘未来智能生活新图景
三星在MWC2025打造未来生活实验室,展出无边框OLED墙、27英寸500HzQD-OLED、FlexGaming折叠屏及ProjectMoohan头显,深度融合AI,通过GalaxyS25系列的能量评分、睡眠洞察化身数字健康管家,实现个性化智能生活体验。
美光LPDDR5X技术新突破,三星Galaxy成功应用
美光LPDDR5X内存峰值带宽提升12%,功耗降低超10%,已应用于三星GalaxyS25系列。该内存与UFS4 0闪存协同,为多模态AI助理提供硬件支持,提升端侧AI处理效率与续航表现。
谷歌隐私设置重大调整:用户多媒体数据用于AI训练
谷歌近期对隐私设置进行了一次重要更新,大幅扩展了默认收集用户数据的类型与用途范围,这些数据将被专门用于训练和优化其人工智能模型。根据最新披露的信息,此次调整覆盖的内容远不止文本,还包括用户上传的图像、文件,以及音频和视频录音。换句话说,您在谷歌生态系统中日常产生的各类多媒体内容,均可能直接成为AI模
DeepSeek识图模式上线 多模态能力开放
DeepSeek宣布其识图模式已在网页端和App端正式上线。该功能允许用户直接上传图片进行深度分析,与“快速模式”、“专家模式”并列。此次上线基于公司今年4月公开的“ThinkingwithVisualPrimitives”多模态技术框架,该框架旨在让AI通过视觉原语进行思考。目前,部分App
DeepSeek识图模式回归 多模态能力升级在即
DeepSeek网页版近日更新,此前下线的识图功能已重新上线。该功能最初随V4版本推出后因故暂停,此次回归实测解析速度与信息丰富度表现良好,被视为对原有视觉短板的弥补。这一动向也强烈预示着传闻中的多模态版本DeepSeekV4 1发布在即。多模态能力是AI发展的重点方向,此次更新为后续更全面的AI
DeepSeek识图模式上线,创始人照片识别测试引关注
DeepSeek识图功能近日正式上线,测试中发现无法识别创始人梁文锋的照片,模型将其误识别为董宇辉、张雪峰等公众人物。相比之下,对雷军等公众人物的识别准确率较高。这一现象与梁文锋低调行事、网络公开信息较少有关,也表明模型没有针对创始人进行特殊优化。技术分析指出,AI视觉识别能力高度依赖训练数据的覆盖
Janus-Pro-7B新手教程:多模态AI创作轻松实现
Janus-Pro-7B新手教程:轻松实现多模态AI创作 想体验一个既能看懂图片,又能根据文字生成图片的AI?Janus-Pro-7B正是这样一款多模态模型——它不仅能与你畅聊图片中的内容,还能依据你的描述创造出全新的图像。听起来令人兴奋,但部署起来会不会很复杂?别担心,这篇指南就是为你量身打造的。
- 日榜
- 周榜
- 月榜
最新文章
