AI日报:PixVerse融资破20亿美元,阶跃星辰发布原生手机
人工智能领域正经历从技术探索向产业深化的关键转折。近期的行业动态不仅展示了大模型在垂直场景的落地能力,更揭示了资本、硬件与软件生态的全面重构。从基础模型效率的提升,到终端设备的智能化演进,再到生成式AI在视频与视觉领域的爆发,每一个环节都在重新定义生产力边界。

腾讯混元发布的HyOCR-1.5模型,代表了OCR技术向轻量化、高效率方向演进的重要趋势。该模型仅有1B参数,却实现了端到端的性能飞跃,推理速度提升6.37倍。这一突破的核心在于其引入的“DFlash”投机解码框架,通过预测机制显著降低了计算延迟。同时,智能体驱动的数据流策略增强了模型对复杂文档的理解能力。在全栈源代码开放的背景下,这一低门槛、高性能的工具包将为金融、政务等行业的文档数字化处理带来实质性推动,标志着OCR技术从“可用”向“好用、快用”的跨越。
在资本市场端,PixVerse完成的4.39亿美元C轮扩展融资,使公司估值飙升至20亿美元,这一数字本身即是行业风向标。AI视频生成赛道之所以备受青睐,不仅因为其视觉冲击力,更在于其背后庞大的数据标注与模型训练壁垒。PixVerse构建了涵盖视频生成、影视创作及游戏开发的多元产品矩阵,并强调数据标注的高质量策略,以应对数据同质化的质疑。这种高性价比的图生视频能力,正逐步成为内容创作工业化的基础设施,加速AIGC从娱乐向专业工作流的渗透。
操作系统层面的变革同样引人注目。苹果正式发布iOS 27首个公开测试版,Siri迎来了全面的AI进化。这不仅是语音助手的迭代,更是系统级AI能力的展示。通过深度整合大模型,Siri在理解上下文、执行复杂任务方面展现出更强能力。与此同时,移动端AI体验也在优化,谷歌在移动端应用中首次支持历史聊天记录搜索与文件上传,将高频深度交互功能向移动端平权。这种将AI助手向长效生产力管理平台演进的思路,正在重塑用户与数字世界的交互方式,移动办公场景下的信息检索与流转效率得到显著提升。
硬件终端的创新是AI落地的另一关键载体。阶跃星辰发布的STEPX Neo,被誉为“手机新物种”,其核心在于搭载了原生智能体系统Step AOS。该系统引入双域三步记忆结构,实现了对用户习惯的深度个性化理解,并通过端云多脑体系动态分配模型资源,以应对复杂任务。四维安全闭环的设计则确保了数据隐私。这标志着智能手机从“应用聚合体”向“智能体载体”的转变,硬件与AI的深度绑定将成为未来终端竞争的核心差异化要素。
在具身智能领域,小米机器人的进展展示了AI与物理世界融合的潜力。其在汽车制造场景中,双侧螺母上件成功率达到98%,总装车间物流区作业成功率达90%,已接近人工水平。通过深度接入工厂自动化与数字化系统,小米机器人攻克了长时柔性作业难题,实现了全身运动控制与大范围稳定作业的平衡。这一突破验证了具身智能在复杂工业环境中的可行性,为智能制造提供了新的解决方案,拓宽了AI在实体经济中的应用边界。
视觉理解能力的提升同样不可或缺。商汤科技开源的SenseNova-Vision-7B-MoT多任务视觉模型,为视觉理解及GUI智能体开发提供了有力支撑。该模型具备出色的任务整合能力,支持通过自然语言定义全新视觉任务变体。开源策略不仅促进了社区研究,更为开发者提供了统一的框架,加速了视觉AI技术的创新与落地。在自动化测试、交互设计等领域,这种灵活高效的视觉基座将发挥重要作用。
市场数据进一步印证了AI应用的爆发式增长。QuestMobile报告显示,2026年AI原生App月活达到4.99亿,同比增长85.4%。豆包、千问和DeepSeek构成的第一梯队月活分别达到3.82亿、1.67亿和1.30亿。其中,千问增速暴涨近58倍,显示出强劲的市场穿透力。用户黏性的显著提升表明,AI应用已从尝鲜阶段进入深度依赖阶段,正在快速改写移动互联网的竞争格局。
综合来看,当前AI行业的发展呈现出“基础能力优化、应用场景深化、终端形态创新、市场规模扩张”四大特征。轻量化模型的普及降低了应用门槛,生成式AI在视频等领域的商业化加速,操作系统与终端硬件的智能化重构了交互体验,而具身智能与视觉模型的突破则拓展了物理世界的智能边界。随着数据标注质量的提升与端云协同能力的增强,AI正从单一的技术工具演变为驱动社会生产力变革的核心引擎。未来,如何在提升效率的同时保障数据安全与伦理合规,将是行业持续健康发展的关键命题。