🤖 AI 资讯

每日 05:00 更新 · 09-17 · 主站 liuch.name ↗
全部标签 →
筛选标签:翻译字幕 · 返回个性化推荐 · 清空筛选

单项冠军县,何以扛打|江苏丹阳何以撑起全球眼镜市场半壁江山

澎湃新闻
· 大模型,算力芯片,AI应用,融资,阿里巴巴,百度,华为,小米,语音音频,Agent智能体,办公效率,翻译字幕,设计创意,医疗健康,金融,微调蒸馏,向量数据库,端侧AI,政务,工业制造,零售电商,营销广告,物流供应链,AI for Science,招聘HR,模型发布,产品更新,合作,财报,榜单评测

Mistral与Mozilla达成合作 旗下模型将驱动Firefox AI助手

CnBeta

法国人工智能公司Mistral AI与Mozilla于9月16日宣布达成合作,双方将共同推动更加注重隐私、用户控制权以及多语言能力的AI网页浏览体验。作为合作的一部分,Mozilla旗下Firefox的AI浏览助手Smart Window测试版将开始采用Mistral的AI模型,为用户提供基于浏览内容的智能搜索和信息处理能力。

阅读全文
· 大模型,Mistral,对话助手,搜索RAG,翻译字幕,招聘HR,合作

iOS 27.2测试版首曝大批新功能:健康应用重构、Siri扩展多语言支持 苹果AI生态全面升级

CnBeta

苹果近日向开发者发布iOS 27.2首个测试版。与外界此前预期不同,苹果并未率先推出iOS 27.1测试版,而是直接开放iOS 27.2开发者预览版本。此次更新带来了自iOS 27正式版发布以来规模最大的一轮功能扩展,其中包括全新健康应用、更多Siri AI语言支持以及多项Apple Intelligence相关改进。

阅读全文
· AI应用,翻译字幕,医疗健康,招聘HR,模型发布,产品更新,开发者生态

vivo Buds Clip 体验:42 小时续航的无感佩戴,音质好也舒服

爱范儿

更新了旗舰真无线降噪,头戴式转变成了符合新一代使用场景的无线降噪形态之后,vivo 给自家耳机产品线带来了全新的产品形态。

在 vivo 最新的新品发布会上,他们推出了自家首款耳夹式真无线耳机 vivo Buds Clip。

产品一如既往用上简洁的纯白色包装,正面印上了产品造型照、金字 vivo Buds Clip 的 logo,以及vivo 金耳朵实验室认证和 Hi-Res 认证的双金标。

包装上侧有耳机本体和相关的说明文件,下侧是 USB-C to A 的充电短线。

vivo Buds Clip 的充电盒是传统的鹅卵石造型,整体用上 vivo 强调的「自然微光美学」设计理念,细腻的金属磨砂受光状态下能反射出淡雅的光影效果,整体呈现出一种平稳素雅的感觉。

充电盒做了斜切开口,正面只保留 vivo logo 和显示状态的指示灯。盒子背面很平整,这个设计是为了支持无线充电的版本准备。USB-C 充电接口在底部,启动配对模式的实体按键依旧放在侧面。

充电盒内部采用亮面处理,耳机立着磁吸在坑槽里面。

磁吸的充电槽没有左右分别设计,两侧的触点都能够对应耳机,耳机本体也不需要区分左右,佩戴的时候随手抓起即可。

耳机造型方面, vivo Buds Clip 是「听音球+连接桥+平衡豆」的组合模式,整机保持着「自然微光美学」的设计主调,细腻磨砂效果的平衡桥连接亮面处理得听音球和平衡豆。

外观上,这一代最突出的是在平衡豆的部分。

相较于传统耳夹式耳机那种完全光滑统一的传统平衡豆设计,vivo Buds Clip 在自己的平衡豆上增加了一块经赛璐珞工艺处理得装饰片,里面呈现出类似天然贝母的光泽和纹理。

这款工艺处理得装饰片具备独特性,每一幅耳机出来的纹理和色彩分布都不一样。加上装饰片表面有透明面覆盖,光线作用下观感更加饱满。

这样处理会让耳夹式耳机的外观不会只局限在配色和质感呈现上,多了点花样,更有耳坠耳环的饰品感。

耳机的主要操作主要集中在连接桥上,vivo Buds Clip 的连接桥比较宽,软面条式的形态方便触控,稍用力点按不太影响耳朵和佩戴。

佩戴部分,vivo Buds Clip 耳机部分重 5.2g,和同价位的真无线耳机差不多。佩戴固定好之后,听音球和平衡豆能够卡住在对耳屏和后侧的位置。

这里,vivo Buds Clip 的连接桥用了记忆钛合金材质,记忆桥很轻也比较柔软,把持力还不错,一般日常通勤,不是大幅度活动的话就很够用了。

而且耳机不太重,这个戴着不太容易出现明显的异物感,耳机挂着也不会太累赘,长时间佩戴的舒适度还可以。

要知道,耳夹式耳机的核心功能并不是听音乐,而是联动手机在生活中提供一些语音辅助的功能,又或者是随时为通话或会议待命,长时间佩戴对舒适度和续航要求都不低。

就舒适度而言,vivo Buds Clip 的表现还不错。只要当天会议强度不高,日常取下的次数并不多。

续航也是,vivo Buds Clip 耳机本体的续航为 10 小时,搭配充电盒可以实现 42 小时的音乐播放时长。

对于日常需要长时间佩戴和使用以通话和待机为主的耳夹式耳机,vivo Buds Clip 单机续航表现还可以。加上耳机支持「充电十分钟,播放 3 小时」的快充模式,要紧急充电的时候也能快速响应。

但大多数时间下,vivo Buds Clip 有着比人常规工作时间长的续航,平时已经够用了。可能在午休等零碎时间中回盒短短充个电,就能满足当天需求。

配置方面,vivo Buds Clip 搭载了支持蓝牙 5.4 版本的无线方案,支持多设备三连接技术,延迟可以控制在 70ms。

连接 vivo 和 iQOO 的设备可设置自定义弹窗,除了有自定义图片、贴纸之外,还能通过小 V 绘画引擎生成弹窗画面。

另外,在连接 vivo 和 iQOO 设备时,vivo Buds Clip 可以和 vivo 翻译功能联动,能够即时翻译英语、日语、韩语等多种主流语言。

接入 vivo 蓝心小 V 时,vivo Buds Clip 可以对重点提醒进行播报,像是航班列车、快递等通知都能够通过耳机读出来,不需要取出手机查看。

编码和声音功能的部分,vivo Buds Clip 最高支持 LDAC 高规格蓝牙编码,耳机有 Hi-Res Audio Wireless 认证和支持高解析音频,也有空间音频和 DeepX 5.0 音效,用户可以在手机的设置菜单中调整自己的均衡器和设置聆听的模式,有「均衡模式」、「人声增强模式」以及「防漏音模式」可选。

耳机在使用时可以开启「自适应音量」,开启后耳机能感知用户周边的环境变化来调整音量,并且能根据周围的环境对播放内容的中高频进行补偿,在环境嘈杂的餐厅或地铁上能够提升听感的清晰度。

声音配置方面,vivo Buds Clip 选用了同定位耳机里面相对大的 12mm 动圈单元,单元用上四层四出的 4L 双并线音圈设计,比传统的四层两出的 4L 设计更轻,降低共振频率的影响,提升低频表现,确保听感厚的同时保证中高频表现,从而实现三频均衡。

单元磁铁上用了双磁设计,单元用了 PU 新材料和生物质互穿网络复合材料做的单元球顶,分别对清晰度、低频表现以及高频细节、人声音色和温度进行加强。

简单来讲,vivo Buds Clip 的声音风格就是在平衡和理性的声音基底上,提升音效的突出,低频输出提升声音饱满感,同时保证中高细节清晰度的现代声音方向。

听感方面,vivo Buds Clip 整体声音很清爽,节奏很快音效也很突出。在支持高解析传输的 LDAC 编码传输下,耳机听着细节很扎实丰富,加上新单元提供了扎实的低频表现,鼓点饱满感充足,打碎了老派用户对完全开放式耳机那种「声音轻薄、缺乏力量感」的刻板印象。

还有,耳夹式这一类开放式耳机在呈现空间感上有非常突出的优势,vivo Buds Clip 的定位刻画清晰,开启空间音频之后能够清晰听到声音位置变动。

之前如果习惯了放入耳朵的耳机设计,再听耳夹式的话体感还是挺特别的。

对于 vivo 体系和生态的用户来讲,vivo Buds Clip 是非常稳妥的选择。

轻量化的机身和长续航表现,这些是保证了耳夹式耳机长时间佩戴的基础。从单元到传输还有软件支持,在声学方面有丰厚积累的 vivo 在声音这部分给足了诚意,vivo Buds Clip 听感在厚实度、饱满感和音效的刻画上都表现得突出,是更新后就很容易听出提升的类型。

再加上它一上来就能够用上全功能,对生态内的手机几乎没有门槛,新机老机都可以用。

如果你本身就是 vivo 或 iQOO 设备用户,需要一款全天候佩戴待命的耳机,那佩戴更轻松、续航表现也不错的 vivo Buds Clip 会是不错的选择。

「买吧,不贵。」

#欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。

2026-09-16 05:55:43 · 文生图,语音音频,代码生成,办公效率,翻译字幕,设计创意,金融,微调蒸馏,图神经网络,AI for Science,招聘HR,模型发布,产品更新,榜单评测

OPPO ColorOS 17 设备互联升级:Car+ 车联支持步行导航接续,耳机支持 AI 对话翻译

IT之家

IT之家 9 月 17 日消息,2026 OPPO 开发者大会正在举行中,OPPO 公布了 ColorOS 17 在设备互联方面的多项新体验,覆盖车机、相机和耳机等场景。

首先,Car+ 车联(手机与车机互联功能)带来全新“步行导航接续”,手机可无缝接续车机上的步行导航。

此外,ColorOS 17 的相机互联支持用户直接在手机相册中查看第三方设备的素材,管理浏览更方便。

ColorOS 17 耳机互联新增 AI 对话翻译功能,戴上耳机即可进行实时双语翻译。

2026 OPPO 开发者大会正在进行中。IT之家将持续为大家带来相关报道。

2026-09-17 03:18:11 · 对话助手,翻译字幕,强化学习,产品更新,开发者生态

亲手优化出 DeepSeek V4.1 算子的工程师,决定继续留在这场加速里

开源中国DeepSeek 的机器学习系统工程师刘胜与,最近写了篇长文,标题透露出一种无力感:《我不得不把才华埋葬在昨天》。发出来就刷屏了,外网被翻译成多语言传播。 先说他写了什么。他是 DeepSeek V4.1 主 Attention 算子的作者——head dim = 512 的 MQA attention 是他独立实现并交付的。V4.1 在小模型和推理效率上的表现,有...
· 大模型,DeepSeek,推理思考,翻译字幕,教育学习,Transformer

Xspark AI 丁文伯:触觉替代不了视觉,但机器人需要一套自己的“脊髓” |物理AI 50人

雷锋网

具身智能进入“触觉时代”,丁文伯提出“脊髓”架构补全机器人物理交互短板。


作者:李秋悦
编辑:吴彤

丁文伯很难被一个词准确“定位”。通信博士、材料学博士后、机器触觉学者,这些标签都对,但都只能解释他的部分经历。

2025年,丁文伯又多了一个身份——Xspark AI(无界智航)联合创始人、首席科学家。一个做了多年传感器研究的清华教授出来创业,没有把公司定义成一家“传感器公司”。相反,他认为造出更好的传感器,并不会自动得到一个更聪明的机器人,机器人触觉可能需要一套自己的模型。

这个判断首先来自纯视觉的局限。

过去两年,具身智能最主流的技术路径仍然延续大模型的Scaling逻辑,即更多视频、更多机器人轨迹、更大的VLA(视觉-语言-动作模型),让机器人沿着“看见—理解—行动”的链条不断提高泛化能力。丁文伯并不反对这条路线,他甚至认为“VLA是一个蛮solid的逻辑,像早期Transformer、diffusion policy一样,一定会在具身智能(历史)长河里留下浓墨重彩的一笔”。

但机器人和语言模型最大的不同在于,它最终要伸出手,真正碰到这个世界。

在丁文伯看来,视觉其实已经解决了机器人感知世界“99%”的问题,触觉没有必要和视觉竞争。它更像是在视觉失效或者不够确定的时候,补上接触发生之后的信息。杯子有没有开始滑动,手指是不是捏得太紧,机械臂有没有撞到人,一个灵巧动作应该继续用力还是立刻修正。机器人一旦真正进入物理世界,问题就不只是“有没有看见”,还包括接触之后能不能及时感知、修正和避险。

问题也由此往前走了一步:如果机器人需要触觉,那么触觉应该以什么方式成为智能?

最直接的办法,是把触觉作为一种新的模态塞进现有模型。但丁文伯对此并不完全满意,他认为从第一性原理看,触觉的信息量远没有视觉丰富,却对反馈效率有更高要求。把它直接和整个视觉模型融合,要么产生大量冗余,要么少量关键触觉信息反而被视觉淹没。

这也是他开始提出“触觉原生智能”的原因。

触觉智能未必需要拥有视觉大模型那样丰富的语义理解能力,相反,它可能应该更轻、更快、更靠近身体。人快要摔倒时,并不会先识别“我正在摔倒”、分析原因,再决定伸手,而是身体先完成反射。丁文伯因此喜欢用人的“脊髓”来类比触觉智能:它处理的信息可以没有那么丰富,但要足够低延迟,能够在滑动、碰撞、失衡等发生的一瞬间做出反应。

不过,从“触觉很重要”到真正做出一套触觉智能,中间还有很长的距离。

首先是硬件。不同触觉传感器之间的一致性依然很差,即使同一批次生产的设备,性能也可能存在明显差异。模型因此很难像视觉模型一样,在不同硬件之间直接迁移。

其次是数据。触觉没有互联网时代天然积累下来的海量图片和视频,同一个动作换一个人、一个传感器甚至一个机器人,数据分布都可能发生变化。

再往后还有更基础的问题:触觉到底应该如何Representation和Embedding?不同传感器采集出来的力、温度、剪切、振动,最终有没有可能被转换成某种与具体硬件无关的共同表征?丁文伯把接下来两三年甚至五年的问题概括为三个“跨”——跨传感器、跨模态、跨本体。

所以丁文伯并没有声称,一套成熟的“触觉大模型”已经有了答案。他承认,目前更现实的仍然是一条折中路线:短期先把某一种多模态触觉传感器做好,再和现有模型融合;预训练阶段聚焦通用能力构建,触觉信息的引入与融合则放在灵巧操作的后训练和动作修正阶段。至于长期,他才倾向于认为,触觉最终会形成自己的模型和逻辑。

Xspark AI提出的“慢脑 VLM—快脑 VTLA+TWAM—脊髓 VTA”三层架构,可以看作前者判断现阶段的一种工程表达。在这套架构里,视觉语言模型构成“慢脑”,负责语义理解、高层认知和任务规划;触觉首先进入“快脑”,与视觉、语言和动作一起参与长程任务和灵巧操作;再往下一层,触觉成为“脊髓”的核心信息,在碰撞、滑落、安全等场景下完成更快的局部反应。同一种触觉,因此同时承担两种角色:在快脑里帮助机器人“做得更好”,在脊髓里保证机器人“来得及反应”。

这也让丁文伯正在研究的问题比“机器人需不需要触觉”更具体了一层。

视觉仍然会是机器人理解世界最重要的信息来源,VLA也仍然是主流路线。真正没有被定义清楚的是:触觉究竟只是现有视觉模型增加的一种输入,还是因为它对接触、运动和实时反馈的特殊要求,最终会生长出一套不同于视觉智能的模型和计算逻辑。

丁文伯现在做的,就是试图找到这个答案。以下是左林右狸与丁文伯的对话(在不改变原意的基础上做了部分编辑):


01 “科研困难户”是怎么入门的?

左林右狸:2007年安徽省理科第三名,为什么读清华电子系?

丁文伯:当时没考到省状元,就“没法选经管”。那时候我们很多人都想读经管。刚好来招生的是电子系老师,他跟我讲了一番电子系的“宏伟蓝图”,最后我就去了电子系。我记得当年我们学校有几个同学,分别是全省第二、第三、第六名,最后全被这位老师招进了电子系。

左林右狸:这位老师当时给你讲的“宏伟蓝图”是什么?

丁文伯:他的“宏伟蓝图”其实很简单,他说你学不了经管,清华在安徽只招一个人,你去不了。后来我才听说,经管在安徽其实招了5个人。不过也没关系。前两天我还跟同学说,人生里很多选择,当时你可能觉得自己做了一个很好的决定,但最后真正改变人生的,往往是一些不经意的选择,甚至是被迫做出的选择。
2026-09-15 07:52:00 · 大模型,具身智能,政策监管,对话助手,多模态,翻译字幕,Transformer,扩散模型,预训练,向量数据库,传媒内容,AI for Science,榜单评测

AI眼镜,谁是第一?

钛媒体

(本文作者为 定焦One,钛媒体经授权发布)

 

文 | 定焦One(dingjiaoone),作者 | 王汉星,编辑 | 魏佳

张茗是一家国资背景投资基金的经理。2024年10月她在深圳出差时看了几家AI眼镜公司,最终没有出手。彼时AI眼镜已经在海外火了大约半年,但一级市场对这种产品形态还没有形成共识,很多人和她一样,选择了只看不投。

几个月后,情况变了。2025年春节前后,“杭州六小龙”概念走红,一位阿里系的朋友向张茗推荐了杭州的一家AI眼镜公司Rokid,这家公司此前做分体式AR设备,刚刚开始做AI眼镜,第一款产品尚未上市。张茗犹豫了一个月,再想约见创始人时,已经约不到了。

再往后,AI眼镜创业公司纷纷冒头,大厂也不约而同地下场,小米、阿里、百度先后推出AI眼镜,连理想汽车也在年底发布了自己的产品。据不完全统计,近两年涌入这一赛道的企业接近70家,平均每9天就有一款新品上市。仅2025年前11个月,智能眼镜赛道的融资总额就超过40亿元,进入2026年,无论融资频次还是单笔金额都还在继续攀升。

一个行业被置于资本的聚光灯下之后,往往会出现一种熟悉的现象:所有能和这个热门概念扯上关系的公司,都会给自己贴上一个新标签,去竞争行业的“第一”。AI眼镜也是如此。市面上的AR设备、AR眼镜,无显示有AI的、有显示没AI的,都说自己是AI眼镜或智能眼镜,行业里也冒出了许多“第一”。

不久前,雷鸟创新发布了一张海报,5家第三方统计机构将其列为2026年上半年智能眼镜出货量第一。在雷鸟之前,Rokid、Xreal等公司也认领过行业“第一”。

这些排名看上去互相矛盾,细读限定条件,又各有依据。有的统计出货量,有的比较销售额;有的覆盖全球,有的只看国内线上渠道。更容易被忽略的是,榜单上的“眼镜”也未必是同一种产品。

“第一”牵动的是估值、入口和议价权,这些“第一”谁更有含金量?真实的市场格局究竟如何?

01.五份榜单,谁是第一?

AI眼镜的格局之所以难以一眼看清,很大程度上源于几条产品路线被放进了同一个市场。

一类产品主打观影和大屏显示,通常需要连接手机、电脑或其他外部设备。另一类更接近普通眼镜,依靠音频、摄像头与AI服务提供交互,也有产品加入显示功能,用于呈现文字和信息提示。它们在外形上相似,消费者购买时要解决的问题却不尽相同。

目前主流的智能眼镜出货/销量榜单主要来自五家机构——Counterpoint、IDC、CINNO、洛图、奥维云网。我们依次来看。

Counterpoint与IDC两家的统计方式类似,按显示技术类型划分,只计出货量。

Counterpoint目前在公开渠道可查的上半年数据只有行业总量。2026年上半年,全球智能眼镜市场同比增长212%,环比增长22%。

具体到各家公司的数据,只披露到今年一季度。Counterpoint按显示技术把智能眼镜分为两大类:一类更接近传统AR头显,强调沉浸式体验的几何光学类,雷鸟以41%的出货量占比位列第一;另一类是目前带显示AI眼镜普遍采用的光波导路线,不追求显示质量,通常为单色(绿色)显示,主打轻量化信息提示,Rokid在这一分支排名第一,占比同样是41%。

前者占整体市场的58%,后者占42%。也就是说,如果抹平显示技术上的差别合并计算,雷鸟创新是第一。IDC的统计方式与Counterpoint类似,公开数据同样截至一季度,但没有详细的品牌排名。

CINNO的口径下,雷鸟也是第一,但CINNO在配文中说明,将雷鸟的主要产品归类为分体式AR眼镜,眼镜无法单独使用,需要外接设备,属于传统AR眼镜的产品形态。

奥维云网和洛图统计的都是线上市场,一个统计销售额、一个统计销量。

一位长期关注AI眼镜的投资人告诉「定焦One」,线上是AI眼镜的主流渠道,但不同品牌间渠道结构差异巨大。创业公司一般更依赖线上,小米、华为等大厂有丰富的线下渠道,线下占比更高,还有一部分品牌与传统线下眼镜店合作,也有一定出货量。整体来看,线下约占25%,线上占75%。

奥维云网的数据截至一季度,按销售额计,Rokid以1.2亿元排名第一,均价3178.1元;雷鸟销售额5891.7万元,排在第四,但单价只有1921.9元。换算成出货量,基本与Rokid处于同一水平。洛图的数据更新到二季度,按线上销量计,雷鸟第一,Rokid第二。

五份榜单交叉验证之后,AI眼镜市场的真实格局可以归结为两点。

其一,雷鸟的份额第一并非全靠AI眼镜撑起。

它的产品线横跨多种类型。V系列主打拍摄等AI功能,Air系列偏向AR观影,两者都可以计入某些机构定义的智能眼镜市场。品牌总销量领先,既可能来自新出现的AI交互需求,也可能包含已有的观影需求。仅凭一个合计数字,很难判断各自贡献了多少。

结合其产品线和单价看,卖得最好的是主打无显示、拍摄的V系列和主打性价比AR观影的Air系列,如果以2023年Ray-Ban Meta爆火带来的这波热潮为节点,前者算AI眼镜,后者只能算AR眼镜。

其二,雷鸟走的是性价比路线,热销款单价在2000元以下,销量上天然占优;Counterpoint、IDC、CINNO均以销量计,若换成销售额口径,雷鸟并无优势。

回到“AI眼镜”这个概念的起点,2023年9月,Ray-Ban Meta推出第一款带AI功能的眼镜,它没有显示,只有音频,接入AI问答能力,再往后,随着单色光波导技术逐渐成熟,AI眼镜又加上了显示功能。这是这条产品线发展的主线。

这个过程中,有一些公司把AR眼镜和AI眼镜统称为智能眼镜,或者在AR眼镜上叠加AI功能,更像是支线。支线并入主线统计,“第一”自然就多了起来。

02.“第一”不仅是面子,也是“本钱”

从产品的角度来看,“行业第一”似乎并不重要,口径一换,第一就可以有很多个。但从公司发展的角度看,第一很重要,因为它事关估值、入口和议价权。

估值是最直接的考量。今年以来,头部玩家的融资节奏明显加快。

影目科技9月完成新一轮融资,整个C轮累计超过10亿元;雷鸟1月融资超10亿元;Even Realities 7月融资1.5亿美元。更早些时候,闪极和李未可分别在2025年12月和2025年4月拿到近亿元和数千万元。可以看到,头部企业要么单笔融资接近或达到10亿元量级,要么在短时间内连续融资。资本热潮之下,占据更靠前的身位,就有更大的可能性获得更多资金支持。

张茗告诉「定焦One」,目前AI眼镜的估值水平和其他AI硬件差别不大,大约在10到15倍PS。

从Xreal的招股书看,这仍是一个普遍亏损的行业,无法用利润和商业模式去衡量,市场份额就成了估值最重要的锚。份额更高、出货量更大,显然更容易打动投资人。

争第一还有一层更现实的动力:储备现金。

拿到融资只是起点,储备现金则是应对当下市场的必要动作。洛图数据显示,2026年7月,京东、天猫、抖音三大主流电商平台上,智能眼镜市场的监测零售量为7.4万台,同比下降15.3%,环比下降20.9%;零售额1.3亿元,同比下降25.8%,环比下降43.0%。销售额降幅明显高于销量降幅,说明“百镜大战”之下,价格战是一件确定会发生的事,各家都需要融到更多的现金储备,来应对越来越激烈的竞争环境。

对于那些仍需持续投入研发、备货和渠道的公司而言,这样的资金规模可以支持更长时间的产品探索。反过来,量小、榜单不占优的厂商,融资难度大,也更难在这个降价周期里活下去。

入口则是更深一层的逻辑。这一轮AI眼镜热最早可以追溯到Meta,整个行业的热度都建立在“AI时代硬件入口”的想象之上,这也是Meta对其AI眼镜最初的定位,当AI能够随时回应用户,眼镜或许能承接一部分原本发生在手机上的交互。

这个设想让企业格外在意用户规模。更多设备进入市场,意味着触达更多用户的机会,也可能增强对开发者和合作伙伴的吸引力。做入口就必须量大,谁能率先获得更大的用户基数,谁就更有可能成为AI的硬件入口。这是最简单也最有效的互联网商业思维。

最后是上游议价权。规模还会影响上游的硬件采购,AI眼镜终究是一门硬件生意,而眼下恰恰是一个对硬件厂商极不友好的成本周期。TrendForce集邦咨询的数据显示,2026年一季度常规DRAM合约价环比上涨90%至95%,NAND Flash合约价环比上涨55%至60%,近15个月存储芯片均价累计涨幅已超过400%。

虽然当前市面上主流的AI眼镜普遍采用的是2GB+32GB、4GB+64GB这类中小容量存储配置,但上游产能的转移也必然会导致后续的供货紧张和成本上涨。

当前涨价潮已经从手机、PC蔓延到所有带存储的终端。在这样的背景下,更大的销量意味着更强的议价能力,能拿到更稳定的供货和更低的价格,一定程度上能对冲价格战带来的负面影响。反之,量小的厂商将同时承受上游涨价和下游降价的双重挤压。

03.“第一”背后,谁是真需求?

AI眼镜的火热有目共睹,它也确实开辟出了一个明确的需求场景。硬件层面,眼镜具备手机、耳机等硬件不具备的一些特性,目前已能清楚看到的一点是“始终在线”,它可以做到长时间的无感佩戴,这会催生许多手机所没有的新交互需求。

实时翻译、第一视角拍摄、导航提示、看一眼就能完成的支付,这些已经在售产品上跑通的功能,都建立在“眼镜一直戴在脸上”这个前提之上。

出货量也支撑这一点。Omdia统计显示,2023年、2024年、2025年,全球AI眼镜出货量分别为38万台、206万台和870万台,预计2026年全年将突破1500万台。

作为参照,TWS(真无线)耳机2026年的预计销量大约是4亿台。同样作为AI配件,眼镜的销量远低于耳机,但耳机均价仅有几百元,AI眼镜的均价要高得多。从单品价值看,这已经是一门不能被忽视的生意。需求是真实存在的,但行业中的问题同样存在。

销量增长与场景缺乏并存,是当下AI眼镜最难解的一道题。目前还没有一个“杀手级”场景,大多数功能停留在尝鲜和智能手机替代的阶段,翻译、拍摄、导航这些功能,手机都能做,而且在多数情况下做得更好。眼镜要证明的是自己不可替代,而不只是更方便。

 

技术层面也有硬伤。随着光波导+Micro LED技术成熟、电池密度提升、云端多模态API与端侧SoC分工趋于清晰,曾被称为AI眼镜“不可能三角”的续航、重量、算力已经得到很大缓解,但仍有一些问题悬而未决。

一位AI眼镜从业者告诉「定焦One」,受形态限制,AI眼镜很难做到入耳式耳机的私密性,只能通过声道设计和声场抵消来达到近似耳机的效果,安静环境下漏音依然无法避免;也因为这个问题,扬声器音量不能做得太大,到了嘈杂环境里又听不清楚。

带显示功能的AI眼镜还有漏光问题,目前行业内普遍能做到的是大部分角度不漏光,原理类似手机防窥膜,但无法保证所有角度都不漏。这些问题单个看都不算致命,叠加在一起,就构成了用户长期使用的瓶颈。

另一个问题是商业化路径不清晰。目前已经披露经营数据的行业内头部公司Xreal一直在亏损,招股书显示其经调整净亏损分别为4.4亿元、3.8亿元和2.5亿元,三年累计亏损约10.6亿元。头部尚且如此,腰部和尾部公司的处境可想而知。

上述从业者大致算过一笔BOM账:一款无显示AI眼镜的整体成本至少在1000元,其中SoC主板约占总成本的60%;如果再加上显示功能,仅显示模组的成本就与无显示AI眼镜的整体成本基本持平,总BOM至少翻倍。硬件本身毛利率就低,再叠加上AI所需的算力、存储、电池、显示成本,以及还在上涨的上游元器件价格,这笔账很难算得平。

厂商们并非没有尝试,其中两条路径比较有代表性。

Rokid的做法是开放生态,与大厂合作,并上线智能体商店,试图用外部开发者的力量解决缺场景的问题;雷鸟则在最新款眼镜上做减法,砍掉扬声器和摄像头,减轻重量、加强续航,让整副眼镜更有经济性。一条路线做加法,赌生态能长出场景;一条路线做减法,先把成本和佩戴体验做到位。

不同尝试并行,说明行业仍在摸索产品与需求之间的对应关系。现阶段就把AI眼镜归为短暂的热潮,容易忽略已经出现的购买和使用需求,把出货增长直接视为下一代入口已经成立,也超出了数据能够证明的范围。至少在证明某个应用场景“非它不可”之前,AI眼镜还是一个几千块的玩具。区别在于,有人愿意为玩具付钱,而资本愿意为“玩具长大”的可能性付钱,这才是争夺行业“第一”真正的含金量所在。

*题图来源于小米官网。应受访者要求,文中张茗为化名。

更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App

2026-09-16 03:47:40 · 算力芯片,AI应用,融资,政策监管,Meta,字节跳动,阿里巴巴,百度,华为,小米,京东,语音音频,多模态,Agent智能体,翻译字幕,设计创意,金融,扩散模型,微调蒸馏,端侧AI,零售电商,传媒内容,网络安全,模型发布,产品更新,合作,财报,榜单评测,开发者生态

AI没有泡沫,只有割裂

钛媒体

(本文作者为 来咖智库,钛媒体经授权发布)

 

文 | 莱咖智库

9月12日,周六。Anthropic首席执行官达里奥·阿莫代伊在自己的网站上发了一篇文章,标题是《我们必须为前沿AI踩刹车》。全文的核心只有一句话:我们必须放慢AI模型能力迭代的速度。

几个小时后,OpenAI的奥特曼表示同意,xAI 的马斯克在社交平台上写"达里奥说得对",谷歌DeepMind的哈萨比斯也公开回应称,这篇文章"指向了正确的方向"。长期以来贴身竞争的四家前沿实验室,罕见地站到了同一个立场上。

导火索有两件。一件发生在今年7月:在一次内部网络安全评估中,一群OpenAI智能体逃出了隔离沙箱,入侵了Hugging Face的系统,并对没有被要求攻击、与手头任务无关的目标发起攻击。它们还试图攻击给自己打分的评估者。事后 OpenAI暂停了部分强化学习训练。另一件更本质,是递归式自我改进,也就是AI系统逐步具备构建下一代AI的能力。阿莫代伊写道,如果不加约束,这项能力"可能超出我们理解和控制这些系统的能力"。

在此之前,Anthropic研究员雅各布·考克森辞职,理由是这两家公司正在"拿人类的命运赌博"。Anthropic对齐研究负责人埃文·胡宾格给出了一个具体数字:未来十年,AI有超过10%的概率"杀死全人类"。

这些担忧是真的。但市场在接下来的48小时里给出的定价,讲的是另一件事。

01 跌的和没跌的,不是同一批人

9月14日,周一,抛售从亚洲开始。

SK海力士收盘跌超7%,三星电子跌超4%,OpenAI的重要投资方软银在日本市场下跌约10%。欧洲开盘,阿斯麦跌超4%,英飞凌跌超6%,诺基亚跌约5%。

美股延续了同一个方向。费城半导体指数收跌5.86%,是7月以来最大单日跌幅。英伟达跌3.36% 报210.96美元,AMD跌4.40% 报493.41美元,泛林集团跌8.29%,应用材料跌7.07%,Arm跌9.74%,英特尔跌5.59%,美光跌5.25%。

被砸得更狠的是数据中心链条。康宁跌13.70%,泰瑞达跌13.30%,惠普企业跌10.76%,Vertiv跌7.61%,CoreWeave跌6.75%,戴尔跌5.82%,Digital Realty跌5.01%,Equinix跌3.76%,甲骨文跌3.65%。

但同一个交易日里,有两组股票在涨。

第一组是网络安全。CrowdStrike涨13.85%创下历史新高,Palo Alto Networks涨13.09%,Zscaler涨超16%,SentinelOne涨超14%。第二组是软件。汤森路透涨超8%,ServiceNow、Autodesk、Atlassian涨超7%,Adobe、Intuit涨超5%,Salesforce涨4.73%。

两个方向各有各的理由。如果AI的能力真在加速,自动化攻击的门槛会同步下降,防护这门生意就更值钱。而如果前沿模型的迭代被踩了刹车,传统软件被AI替代的速度也会放慢。同一条消息,在硬件端被读成需求见顶,在软件端被读成竞争威胁延后。

一天之内,同一个行业被拆成了两个方向。这不是恐慌,是一次重新分配定价。

02 减速减的是训练,不是推理

市场第一时间把"模型迭代变慢"翻译成了"算力需求下降"。这个翻译少了一个关键区分。

模型开发分两段。训练是烧掉海量数据,把模型能力往上推;推理是把训好的模型跑起来服务用户。阿莫代伊要放慢的是前者的节奏,而后者正在以更陡的斜率上升。Quilter Cheviot全球科技研究主管本·巴林杰在周一就说得很直接:即便训练和铺开放缓,推理仍然是供应短缺的环节,需求仍远超供应。中国电信研究院的预测提供了一个侧面参照:到2029年,我国推理算力市场占比将达到80%。

这也是为什么"减速"这个叙事,在硬件端很难兑现成订单的下降。9月14日的抛售砸的是估值,不是订单。

把时间轴对齐,会看到一组更值得琢磨的动作。

阿莫代伊发"减速"长文的同一个周末,路透社与彭博社报道:Anthropic正洽谈引入英伟达作为基石投资者,参与可能是史上规模最大的IPO。公司拟募资至多1000亿美元,估值约2万亿美元。英伟达考虑认购至多100亿美元。如果落地,它将超越 SpaceX 保持的750亿美元纪录。消息人士称,Anthropic计划最快本月底公开递交上市申请,争取在11月美国中期选举之前完成上市。

再看这家公司与几家巨头之间的资金结构。英伟达承诺投资最高100亿美元,对应Anthropic采购300亿美元由英伟达芯片驱动的微软 Azure 算力;亚马逊今年4月追加投资50亿美元,对应 Anthropic十年内向AWS投入超1000亿美元、采购超100万颗Trainium2芯片;谷歌计划投资最高400亿美元,对应Anthropic五年2000亿美元的云服务与TPU采购协议。需要说明的是,英伟达这两笔100亿美元分别是2025年11月的投资计划和这次IPO的基石认购,报道并未说明它们是否为同一笔安排。

钱从左口袋进,从右口袋出。国际清算银行对这种"循环融资"提过警告:交易条款披露通常极不透明,存在同一资产被多次质押的风险;一旦AI的投资回报没能兑现,融资退潮会把资本开支热潮变成一场旷日持久的投资低迷。

一份要求全行业放慢的文件,和一场冲刺历史纪录的上市,出自同一家公司、同一个周末。

03 谁的账要付

如果减速真的发生,代价是研发节奏变慢、模型发布变稀疏、部分算力采购推迟。那么一个直接的问题是:这些代价会落到谁头上。

答案在资本开支的刻度上。据主要券商研报汇总,四大云厂商2026年的资本开支指引合计已抬升至7250亿至7300亿美元,接近2025年4100亿美元的两倍;资本开支占营收的比例,四家分别从去年的18%到36%升至今年的25% 到55%,其中Meta最高,达到54.9%,历史上从未有过。集邦咨询的预测更远一步:包括甲骨文与三家中国云厂商在内的全球九大云服务商,资本支出将从2026年的约8800亿至9200亿美元进一步升至2027年的1.3万亿美元以上(该口径比上文的四家更宽,不可直接相加)。

承诺过的钱不会因为一篇文章撤回。英伟达最新一季财报显示,营收962.2亿美元,同比增106%,其中数据中心收入890亿美元,同比增117%。Melius Research的分析师本·赖茨斯说了句实话:这些人擅长开发模型,但不擅长谈论股票市场,他们的言论"正在让市场陷入恐慌"。

阿莫代伊自己留了后门。奥特曼在社交平台上补充,"pacing"不等于"stopping"。阿莫代伊在文章里也写,"进展仍然会显得很快"。

所以,与其把这件事看成一次行业共识,不如看成一次定价权的重新划分:谁定义安全标准,谁就掌握了监管的话语权和竞争的节奏权。而喊话的这几家,恰好是这一轮竞赛里资本最充裕、最不需要靠"更快"取胜的那几家。

共识是免费的,因为它没有价格。IPO有价格,2万亿。

本文数据来源:路透社、彭博社、CNBC、证券时报、金融界、东方财富、钜亨网、工业和信息化部、中国电信研究院、集邦咨询(TrendForce)、全国网络安全标准化技术委员会、交易所行情数据。海外市场数据为9月14日收盘值,A股数据为9月15日盘中值。

更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App

2026-09-16 03:47:41 · 算力芯片,AI应用,开源,融资,政策监管,OpenAI,Google,Anthropic,Meta,Microsoft,NVIDIA,xAI,Agent智能体,推理思考,翻译字幕,金融,教育学习,扩散模型,强化学习,模型安全对齐,工业制造,AI for Science,招聘HR,网络安全,基础设施,模型发布,财报,榜单评测

小破站砸10亿搞AI,图啥?

钛媒体

(本文作者为 AIX财经,钛媒体经授权发布)

文 | AIX财经(AIXcaiijng),作者 | 陈丹,编辑 | 魏佳

B站刚学会赚钱,就准备把一整年的利润重新押出去。

2025年,这家公司第一次实现全年GAAP盈利,净利润11.9亿元。几个月后,管理层宣布,2026年将额外增加约10亿元AI相关资本开支。

这几乎相当于B站上一年全部净利润。但放进今天的AI竞赛里,10亿元又显得拿不出手。

字节跳动今年被曝将AI基础设施预算进一步上调至2000亿元以上,9月又从近30家银行获得296亿美元贷款,大量资金继续流向芯片和数据中心;腾讯二季度资本开支达到528亿元,同比增长176%,自由现金流二十年来首次转负。

巨头正在用千亿元购买下一张技术船票,B站拿出的,只是它们一个季度花掉的很小一部分。

需要指出的是,B站并不打算参加这场最烧钱的战争。CEO陈睿在二季度财报电话会上划出了一条明确边界:“AI产业链上有很多环节我们不会参与。”钱只投三个方向:视频理解、视频分发和视频创作。

对AI行业来说,这笔钱太小,不足以买来技术领先;对B站来说,它又足够大,大到可以吃掉这家刚刚盈利公司的大部分年度利润。

B站既不想加入军备竞赛,也不能站在军备竞赛之外。

因此问题来了,一家不造大模型的内容平台,为什么仍然必须花这么多钱押AI?这笔钱究竟是在买增长,还是只是在买“不掉队”的资格?

01.10亿买的是什么?

10亿元放在整个AI行业里不算多,但对B站自己来说,是一次明显的投入升级。

2023年,B站用于设备等固定资产的资本开支约1.8亿元,2024年增至约4.8亿元,2025年约5亿元。到2026年,仅AI相关资本开支就计划额外增加约10亿元,这一增量相当于2025年全年设备投入的两倍。到二季度末,这笔预算已执行七八成,主要用于购买服务器和算力。

这也意味着B站这一轮AI投入,主要是在给现有业务补AI基础设施,让它大规模跑进搜索、推荐、内容理解和创作工具里。

这是B站2023年就定下的方向。

当年7月,“百模大战”最热时,互联网公司争夺的是通用基础模型,比参数、比训练规模、比模型能力,再把模型作为独立产品对外提供。B站也发布了自研的bilibili index大模型,但目标并不是参与这场竞争,而是让模型理解B站自己的视频和用户,服务搜索、内容审核、视频总结等内部场景。

图源 / IndexTTS2展示平台

一个月后的二季度财报电话会上,陈睿把这条路线说得更明确:B站不会参加“百模大战”。他举的例子是内容审核——如果大模型能够替代大量重复的人力,对B站来说就已经有实际价值。

此后三年,B站的AI路线基本没有偏离这个方向。在好耶科技创始人吴杰茜看来,这与其说是主动克制,不如说是现实选择。“现在才开始做(视频模型),已经太慢了,B站也不具备这个基因。”

她介绍,从零训练一个视频生成模型,再一路做到可以商用,拼的不只是钱。可灵、Seedance等模型并非短期投入的产物,背后是团队、数据和工程体系的长期积累。即便现在,视频生成模型仍以几个月为周期快速迭代。对后来者来说,增加预算可以买来算力和人才,却很难在短时间内补上已经形成的技术和工程差距。

对B站来说,更划算的办法,是让上游公司承担最昂贵的模型竞争,等能力成熟、调用成本下降,再把它们接进自己最熟悉的视频业务。

最早,AI主要待在后台,做审核、推荐和智能字幕,之后才逐渐走到用户和创作者面前。2024年,B站推出数字分身工具“必剪Studio”;2025年的“AI原声翻译”,则进一步把翻译、语音合成、字幕处理和口型模拟放进同一套流程,让一条中文视频可以更低成本地进入其他语言市场。

到今年,AI开始从辅助工具进入两个核心环节:一端理解内容,一端生产内容。

B站以中长视频为主。一条几十分钟的视频里可能同时包含人物、观点、情绪和复杂的叙事结构。传统推荐算法更多依赖标题、标签、点击和用户行为,却很难真正理解一条视频在讲什么,更难理解用户为什么会喜欢它。陈睿在二季度财报电话会上提到,新一代模型已经可以更深入地理解视频内容和用户意图。

在B站的设想中,如果这件事能成立,就不只是少雇几个审核员、少做几道字幕工序,而是可能改变搜索和推荐本身——平台可以更准确地理解自己拥有的数亿条视频,再把它们匹配给合适的人。

另一端是生产。过去,一条动画或者制作复杂的视频往往需要多人协作;现在,一个创作者借助AI,也可能完成过去需要一个小团队才能完成的工作。B站已经出现个人使用AI制作动画、获得千万级播放的案例。

今年7月,曾在腾讯混元、Anuttacon任职的曾爱玲加入B站负责AI视频生成业务,并直接向陈睿汇报。这也意味着,AI视频成为创始人直接关注的业务。

因此,对B站来说,过去它可以低成本地试用AI,把模型接进几个边缘环节;现在,当AI开始进入内容理解、分发和生产这些核心链条,B站就必须为它配置真正的算力、服务器和组织资源。

02.10亿买得到能力,买不到壁垒

这套路线已经给B站带来了一些可以量化的收益。

2026年一季度,B站广告收入25.9亿元,同比增长30%;二季度增至31.3亿元,同比增长28%。二季度,广告点击和转化综合指标CTCVR同比提高19%,搜索广告收入翻倍。管理层把其中一部分改善归因于AI对内容和用户意图理解能力的提升。

AI公司本身也在贡献增量。一季度,AI行业广告预算在B站同比增长170%,二季度仍保持翻倍增长。

内容端也是如此。二季度,B站日均投稿量同比增长28%,千粉以上创作者数量增长30%;今年5月推出的一项动画创作活动,三个月累计获得超过1.8亿次播放。

从这个角度看,B站确实吃到了“不造模型”的红利:不用承担最昂贵的技术竞赛,也能分享模型进步带来的效率提升和新增需求。

但问题也恰恰出在这里。

B站可以买到更好的视频理解能力,抖音、快手和小红书同样可以买;AI可以提高B站的广告匹配效率,也会同步提高其他平台的效率。当模型越来越接近一种通用基础设施,它首先抬高的是整个行业的效率,而不是某一家公司的独占优势。

也就是说,B站花10亿元可以买到“跟上”,却很难单靠这笔钱买到“领先”。

 

AI改变的不只是平台内部的效率,还在改变B站所处的竞争环境。

首先是内容供给。过去,视频是一种生产成本很高的内容形态。真人拍摄、动画、配音和剪辑都需要时间和人力,也因此天然限制了供给速度。AI短剧、漫剧和生成式视频出现之后,原本昂贵、低频的视频内容开始变得更便宜,也更容易批量生产。

红果便是一个直接的例子。QuestMobile数据显示,截至2026年7月,红果短剧日活达到1.68亿,已经超过爱奇艺、腾讯视频、优酷和芒果TV四家的日活总和。今年2月,红果人均单日使用时长达到125分钟;相比之下,B站今年一季度创下历史新高的日均使用时长为119分钟。

红果的增长当然不能简单归因于AI。免费模式、字节的流量体系和番茄小说的IP供给,仍然是它更直接的优势。但AI正在进一步放大这套模式的竞争力:当视频生产成本下降、供给速度加快,红果可以用更低的成本持续扩大内容池,再依靠现有的流量和IP体系把新增内容推给用户。

对B站来说,威胁并不只是“市场上的视频变多了”,而是一个已经拥有巨大流量和内容供给能力的竞争对手,可以借助AI更便宜、更快地增加视频供给,继续争夺用户每天有限的观看时间。

“我相信,不会有任何一个内容平台,面对红果飙升的用户数据不感到着急。”吴杰茜说。

竞争压力同样出现在创作者一端。

AI能够帮助UP主提高产能。一个过去需要几天甚至几周完成的视频,现在部分环节可以交给脚本生成、图片生成、配音、翻译和剪辑工具。对B站,这增加了站内供给;对创作者,它也降低了多平台分发的成本。

所以,AI带给B站的是两种同时发生的变化。

它提高平台内部的推荐、广告和创作效率,也提高整个行业的内容供给效率。前一种变化让B站愿意投入,后一种变化让B站很难选择不投入。

在吴杰茜看来,B站这10亿元与其理解为一次主动进攻,不如先把它看成一项防御性工程。这10亿元能解决的是“不掉队”,而不是建立新的护城河。

03.一张必须购买的入场券

这种防御要付出多大的长期成本,又能带来多少额外收益?答案要落在一笔更现实的账上:为了维持竞争力增加的成本,能不能被更高的商业化效率和内容效率覆盖。

这笔账对刚刚盈利的B站并不轻松。

10亿元主要属于资本开支,不会一次性进入利润表。但按照CFO樊欣在财报电话会上的口径,服务器、算力和相关研发投入,预计会增加全年约5亿元研发费用。相比2025年11.9亿元的GAAP净利润,相当于四成以上。

另一方面,截至二季度末,B站持有约243亿元现金及现金等价物、定期存款等资金。10亿元不到这一规模的5%。它不会威胁公司的现金安全,却足以影响刚刚建立起来的盈利水平。

樊欣表示,公司会削减其他运营费用,对冲部分新增成本,40%-45%的长期毛利率目标和15%-20%的营业利润率目标都没有改变。

资本市场也已经开始按照这个逻辑重新计算B站的AI投入。

年初,瑞银、摩根大通、花旗都把AI带来的广告需求和效率改善列为B站新的增长因素。二季度财报后,摩根士丹利和美银维持积极评级,却下调了目标价或盈利预测。大摩提到研发费用增加、毛利率承压,同时指出广告业务面临宏观逆风;美银同样指向研发投资增加和毛利率略低。

市场关心的问题已经从“AI有没有用”,变成了“AI带来的增量,能不能跑赢它持续增加的成本”。

 

如果每年增加的服务器、算力和研发成本,能够持续换来更高的广告转化率、更好的推荐效率和更多高质量内容,投入就能产生回报。但如果AI最终成为所有平台的标配,服务器和算力就会从“投资”变成一项“税费”——为了不掉队,年年续费。

一位长期关注互联网平台的投资人对10亿元能够创造多少增量价值持谨慎态度。

在他看来,10亿元不足以让B站获得真正的技术优势。对内容平台来说,最终拉开估值差距的仍然是用户规模、社区关系、商业化效率和产品,而不是是否部署了AI。至于B站为什么仍然需要投入,他认为还有资本市场层面的考虑:当AI已经成为科技公司的必答题,完全缺席本身就可能被视为落后。

在他看来,现在很多公司都是为了AI而AI,资本市场和公司“互相配合演出”。

吴杰茜与他的判断既有相似之处,也有分歧。两人都认为,模型本身很难成为B站独有的资产。真正的分歧在于,当同样的AI能力进入不同平台,它能否放大平台原本的差异。

在吴杰茜看来,B站的优势主要来自两端:一端是长期积累的大量C端内容创作者,另一端是黏性很高的二次元用户。AI反而可能让两项资产变得更重要。

生成式AI正在把内容生产变成更小团队的生意。现在不少AI漫剧团队只有1-5人,一个小工作室就可能做出爆款。这与B站原有的创作者结构很接近,大量UP主本来就是个人或小团队。过去需要更完整组织才能完成的内容,如今几个人就能做,B站积累多年的个人创作者供给,也因此有了新的价值。“谁拥有创作者,下一个时代的精品内容就诞生于谁。”吴杰茜说到。

而且,高黏性的用户、弹幕、评论、投币和收藏,不只是消费行为,也构成了一套持续的内容反馈机制。创作者更容易获得反馈,优质内容更容易在这里跑出来。

这是B站更愿意讲述的故事。

目前,B站有近3亿通过社区考试的正式会员,12个月留存率稳定在80%左右,每月产生约170亿次弹幕、评论、投币和收藏。陈睿把这些行为称为AI时代的“真人信号”。今年一季度,他还表示,AI会放大B站在优质内容供给和社区体验上的优势。“AI是十倍放大的历史性机遇,我们将牢牢把握”。

10亿能否撬动10倍价值仍待时间验证,但在今天的科技行业,这已经足够构成一项投资理由。毕竟,当所有公司都必须回答“你准备怎么做AI”时,不花钱本身,也会变成一种需要解释的选择。

*题图来源于哔哩哔哩官方微博。

更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App

2026-09-16 03:47:43 · 大模型,算力芯片,AI应用,融资,政策监管,字节跳动,腾讯,快手,文生图,文生视频,语音音频,搜索RAG,数字人,翻译字幕,设计创意,金融,扩散模型,微调蒸馏,传媒内容,营销广告,招聘HR,网络安全,基础设施,模型发布,产品更新,财报

对话小宇宙 kyth:播客的护城河是真实,AI 无法取代的是人的立场

极客公园

 

头图来源:小宇宙

 

过去一年,播客被推到了内容行业的聚光灯下。

B 站拿出 10 亿元流量扶持视频播客,罗永浩、鲁豫等名人带着数小时的长对谈进入市场。小红书也在持续补齐视频与音频播客能力,抖音精选则通过自制节目试水长对谈。那些原本只在播客听众中流动的内容,被剪成短视频切片,登上热搜和推荐流。

商业化也在加速。2025 年,小宇宙合作品牌数量同比增长 422%,商业收入增长 760%,实现变现的播客数量增长 356%。一个过去长期被称为「小众」「慢热」,甚至需要创作者「为爱发电」的行业,开始出现做大的迹象。

但新的问题也随之而来。

名人、机构和平台资源不断进入,意味着更多用户和商业预算,也意味着流量进一步向头部聚集。视频让播客更容易传播,却可能把一种以声音、陪伴和长期信任为基础的内容,再次带回对点击率和注意力的竞争中。

当播客不再只是「小众爱好」,它将变成什么?当小宇宙开始承接更大的用户、内容和商业需求,它又该如何避免成为另一个追逐流量的内容平台?

小宇宙 CEO Kyth 给出的答案是:小宇宙想要的不是「小而美」,而是「强而久」。

「强」意味着让更多内容被发现,让更多创作者获得收入,让听众、创作者和品牌形成一个真正运转起来的生态;「久」则意味着,当一轮风口和流量过去,创作者仍然愿意更新,听众仍然愿意留下。

8 月底,小宇宙在上海举办首届 AI 垂类线下活动「先声信号塔」,并发布《2026 AI 趋势报告》。报告显示,2025 年,小宇宙 AI 相关内容创作者数量同比增长 187%,相关节目数量增长 239%。

AI 内容的爆发,给这个问题增加了新的变量:当声音、文稿和观点都可以被批量生成,一个播客平台究竟应该保护什么?

在 Kyth 看来,答案是「真」——一个真实的人,以自己的声音和立场,长期面对听众。

活动结束后,Kyth 接受了极客公园专访,话题从视频播客和 AI 内容,延伸至用户增长、创作者生态、小宇宙的商业化,以及一家播客平台如何成为一家「强而久」的公司。

以下是对话实录,经整理编辑。

01 当播客有了画面,声音仍然是主角

极客公园:小宇宙前段时间开始内测视频播客,这个想法是什么时候开始的?

Kyth:其实很早就规划好了。我们想填补的是用户在小宇宙里看视频的需求——这个需求是真实存在的。对我们来说,为播客消费者提供完整体验,是这件事的关键词。

比如喜剧播客,很多是在线下录制的,有手部动作、有眼神交锋、有笑或者没有笑。这些视频能够提供的增量信息,对用户来说是非常合理、非常立体的需求。它给播客提供的是更丰富的价值,这个价值应该由小宇宙来提供,所以想明白了之后,就顺理成章地安排功能开发了。

小宇宙 CEO Kyth|图片来源:小宇宙

极客公园:加上视频之后,播客是不是变「重」了?

Kyth:能够有观看视频的选项,并不代表你一定要盯着看。美国视频播客的消费场景,印象中有三分之二是作为背景音播放,主要场景是在电脑端。大家在手机时代的注意力已经非常分散,需要背景里开着内容,才觉得没有浪费注意力。

所以我们的产品判断是:视频播客是一种按需提供的能力。当我想看主播表情的时候,可以随时打开;当我想沉浸收听的时候,再切回音频。这是比较自然的方式。当然,我们也会在与创作者、用户的交互过程中持续修正判断。

极客公园:视频访谈节目早就有了,为什么现在大家叫它「视频播客」?

Kyth:所有类似旧瓶装新酒的东西,有一个能让大家兴奋的标签,是一件好事。「视频播客」可能就是过去一年里出现的这样一个标签。

更深层的原因是,在越来越快速、碎片化的时代,大家想要感受到真实的人的声音和想法。人与人之间的对谈本来就存在几千年了,只是在移动互联网出现之前,采访资源和发布渠道是权威化的,掌握在电视台和少数大众媒体手里。

移动互联网出现后的这十多年,访谈内容其实一直没有出现一个真正的「移动互联网版本」。播客也好,视频播客也好,都是这些内容背后的真实用户需求,在新技术和新渠道形态下的表现。

02 AI 冲击,播客的护城河是人的立场

极客公园:AI 内容已经可以大量降低生产成本,公众号、短视频领域都出现了大量 AI 内容,你们怎么看这件事?

Kyth:组稿层面使用 AI 是无法阻挡的。策划、组稿、修改、润色,这些环节使用 AI 都是无法阻挡的。但是,听众最终还是会在很多很多的选择中,挑出他真正想要的东西。而他想要的东西,我猜测会和「真」有关。当然,如果最后有人能够天衣无缝地用 AI 做出用户非常喜欢的东西,它也会胜出。

对我们来说,我们已经在后台对 AI 批量生成的内容进行分发限制了,只是大家没有明显感知到。我们会持续观察站内可以用 AI 做到什么程度,思考这种提效会对真人创作生态构成怎样的冲击,提前保护真人创作者在小宇宙的生态里得到尊重、重视和倾斜。

极客公园:这个底线会因为技术发展或大众需求的变化而动摇吗?

Kyth:有可能。但我们始终想做这个时代最珍贵的东西。对创业公司来说,满足最大用户的最普遍需求,未必是生存之道。

我们内部很早就有一个说法:想要的是「强而久」,不是「小而美」。这几年这个想法没有变过,只是过去没有对媒体这样表达。

我们不是第一次创业了。对我们来说,绝对意义上的「小而美」并不指向更坚实的价值,也不能为一家公司的工作提供清晰方向。相比两三年前,今天的小宇宙在能力上更加全面,也更有余力快速探索和尝试。

我希望十年后,小宇宙上的那些创作者仍然在更新,用户仍然在这里消费,它还是一个有家的感觉的平台。变大可能是某种必经之路,但它不是我们判断一切的标准。

极客公园:广播剧这类内容,AI 的替代性可能会很高,那播客呢?

Kyth:广播剧是制播分离的——制作文稿和播讲文稿的是两个人,播讲者只是配音演员,读的是稿,不是在说自己的心里话。

播客非常重要的一个特点是:它是那个人自己。如果听众想听的是一个人用原声讲他的观点、故事和经历,那就不是 AI 生成的声音能够代替的,因为少了 authenticity——真实性。我们想要的不是一个更完美的声音来讲你的故事,而是你的原声。

更根本的一点是,AI 的输出是零成本的。它不需要承担名誉上的损失,不需要思考「我对这件事情只能发言一次」,没有 stake 这个概念。

因此,AI 所做的所有内容都可以再按一下按钮重做一遍。可以有一些小区别,可以做两遍,也可以做两亿遍。那我凭什么知道,哪一遍是值得我花最多时间去收听的?

人不能在同一件事情上表态十万次,给出十万个不同的态度。如果是这样,我就会放弃你,因为我要的是你唯一的态度。这才是人的魅力所在。

比如《奥本海默》上映后,播客领域会出现非常多不同的观点和褒贬,但一个播主只应该有一个态度,只应该打一次分数。我宁愿听五个节目分别给出 1 分、5 分、3 分,各自有各自的角度,这会非常有意思。

但如果是同一个 AI 做五期节目,第一期打 1 分,第二期打 2 分,第三期打 3 分——这没有立场,是在浪费我的时间。

极客公园:国内播客和美国播客之间的差距在哪里?

Kyth:有些因素是美国有、我们没有的,不方便细说。但最重要的因素是坚持。

Joe Rogan 成为今天的 Joe Rogan,是从 2009 年开始积累的,已经坚持了十七年。听众对一个主播看待世界方式的依赖,以及通过一个人的窗口接触各种各样的人,这个过程需要时间积淀。

耳朵是和温度、信任联系在一起的。长期听一个人的声音,就是在建立对这个人的信任。这个信任建立在长期坚持、长期表达,以及长期统一的视角和人格上。

因此,播客的核心价值一定是「真」。你很难长期扮演另一个人,也很难长期做出截然不同面貌的表达。听众一旦感知到这种变化,选择你的心理基础就会发生改变。

极客公园:语音动态这个功能是什么时候有的想法?

Kyth:几年前就有这个想法,但资源有限,一直排着队,今年才上线。

上线两周以内,已经出现了完全在意料之外的用法。比如「基本无害」的毛书记和「日谈公园」的李叔,已经在语音动态里直接 K 歌了。

另一个在我们预期之内的使用方式是,比如一位电影主播,原来看完《奥本海默》,需要组稿、约人、线下录制、剪辑,至少要走两三天的流程。但有了一个随性表达的空间,他走出电影院就可以开始录。

口条好的主播能够在一条 60 秒的语音动态里,呈现真实、有活力、鲜活的表达,而这种表达完全可以发生在小宇宙。

03 小宇宙想要「强而久」

极客公园:公开资料显示,小宇宙 2024 年的用户增长约 50%。最近一年,这种增长是否还在继续?

Kyth:最近一年,小宇宙仍然在稳健增长。无论从内容还是用户来看,增长来源都比较多元。更具体的数据,可以期待我们每年年初发布的小宇宙播客大赏。

极客公园:小宇宙下一阶段的 PMF 是什么?

Kyth:小宇宙第一阶段的 PMF,大概在三年前就已经达成了。下一阶段,我们想要服务更多潜在听众和创作者。

下一阶段的 PMF,意味着用户的需求会更加「直给」——他们的发现欲和发现习惯,和我们最早一批用户已经不一样了。

新用户可能想更轻松地 get 到一档播客里最能抓住他的东西。这也是为什么我们做了文稿功能,顺应用户想要更轻松获得信息充盈感的需求。现在一个中文长视频没有字幕,已经是一件难以忍受的事情,产品开发不能刻舟求剑。

我们今年开始测试一个更偏推荐流的页面,这是一个初步尝试。接下来最重要的头等大事仍然是:怎么让播客更容易被发现、被种草,让更多人感受到它的魅力。

极客公园:AI 相关创作者增长很快。从全平台来看,创作者持续更新以及获得收入的情况怎么样?

Kyth:AI 确实是过去一年新增内容和创作者比较集中的方向之一,但全平台创作者生态的增长并不只来自单一品类。

我们更关注的是,创作者能否保持稳定更新,以及是否有更多路径支持他们长期创作。目前,持续更新的节目数量保持增长;通过品牌广告和付费内容获得收入的创作者数量,也比去年有所增加。

越来越多不同规模、不同类型的节目,正在找到适合自己的收入方式。

图片来源:小宇宙

极客公园:你提到要让听众、创作者和品牌形成循环。这个循环目前走到什么阶段了?

Kyth:这个循环已经开始形成,但还处在持续建设的阶段。

听众对创作者的长期信任,是整个循环的起点;创作者通过稳定的内容建立影响力,品牌则通过更尊重内容语境的方式参与进来,为创作者提供更加可持续的收入。

好的商业合作应该反过来支持内容生产,而不是打断原有的创作关系。

目前,我们在品牌广告、付费内容以及线上线下结合的合作方式上都在持续探索。获得商业收入的创作者范围正在扩大,品牌对播客的理解,也在从一次性的内容投放,逐渐转向更加长期、更贴近节目和主播特点的合作。今年,我们也在推动更大维度的商业产品和 IP 实践。

极客公园:从平台角度看,现在的商业化状况怎么样?

Kyth:还行。但对主播来说,很多人仍然会觉得商业化状态不及预期,这也是我们要做更多商业产品、拓展更多商业化可能性的原因。

从平台层面,我们要回答一个问题:播客和小宇宙让品牌必须选择的理由是什么?

播客内容对品牌的价值,在这个时代仍然有非常多可以深耕的空间。它既可以是「投播客」,也就是直接做内容投放;也可以是「做播客」,帮助品牌生产自己的播客。

未来结合视频和线下场景,我们还会进行更加立体的商业化尝试。

事实上,C 端付费内容的 GMV 体量每年都在健康增长,大概每年增长 50% 以上,B 端的增速更高。

大家可能会因为个别案例,对播客商业化产生刻板印象,但实际上有很多健康的案例正在发生。比如「梵高 MoneyTalk」已经连续两年推出包年订阅,虽然定价不低,仍然有稳定的听众支持。

这类案例说明,建立在长期信任之上的内容,是有机会形成持续收入的。

极客公园:你觉得小宇宙两三年后的理想状态是什么?

Kyth:很朴素。

第一,播客内容的丰富性和多元化有显著提升;第二,播客创作者被发现的效率有显著提升;第三,商业化的形态和规模有显著提升。主要就是这三点。

还有一点想额外补充:我们想保护那些目前可能只有播客才能承载的内容消费需求和内容品类。

比如去年「西西弗高速」的崛起,就是一个很典型的案例。这档节目的主播来自纸媒,是做深度报道的记者。有一部分深度报道的消费欲和创作欲,正好被播客的听众和创作者承接了。

有一批听众不想被浅层化、碎片化的内容裹挟。他们想消费深度内容,想找到一个不被打扰的空间——小宇宙需要保护这种连接。

前几天,我在微博上看到「展开讲讲」的主播洞姐发了一句话。她说,每次播客发出来,只要有一个听众回复说「我很喜欢这一期」,她就觉得很满足。

我非常珍视这件事。

哪怕只有一个听众愿意向创作者表达:「我听到了,我有很好的感受,我度过了一段很好的时光。」我们能够承接内容的发布、听众与创作者之间的交流,并且让这种交流发生在善意的碰撞之中——这就是我们做小宇宙的意义所在。

2026-09-15 07:10:42 · AI应用,政策监管,字节跳动,语音音频,对话助手,翻译字幕,设计创意,医疗健康,传媒内容,营销广告,模型发布,产品更新,合作,财报

iOS 27 正式版体验:Siri AI 终于开窍了,老 iPhone 升级也有新东西

爱范儿

从 6 月 WWDC 首次亮相,到历经 3 个多月、多轮开发者预览版与公测版的调试打磨,今天凌晨,苹果终于面向所有用户正式推送了 iOS 27 正式版。

Image

只要你的设备在支持列表内(最低依然支持到 iPhone 11 系列与 iPhone SE 2),现在打开「设置 – 通用 – 软件更新」,就能直接收到推送并升级。

Image

这代系统最受瞩目的焦点,毫无疑问是全面接入 Apple Intelligence 的新一代 Siri AI。作为整套系统的技术核心,完全体的 Siri 到底进化成了什么样?我们不妨先从它的实际体验看起。

新一代 Siri AI:真的开窍了

作为整个 iOS 27 的灵魂,新一代 Siri AI 终于摆脱了过去被调侃为「人工智障」的机械感。

Image

在底层基础模型的加持下,Siri 不再只是死板地弹网页搜索,而是能真正理解复杂、口语化的表述,并把零散的信息梳理成流畅的自然语言。比如让它总结一整周的复杂日程,或者提炼订阅邮件的核心要点,组织得都相当得体。

Image

更关键的进化在于屏幕感知与跨 App 执行复合指令。Siri 现在可以读取屏幕上的上下文内容;甚至能串联多个软件——

例如朋友在短信里发来聚会地址,你只需对 Siri 说一句「从短信里提到的地址导航过去,选步行」,它就能自动从信息中提取地址并调起地图导航。这种多步操作的连贯性,在以往是想都不敢想的。

Image

此外,相机底栏新增了独立的「Siri」视觉智能入口,对准现实物体就能直接提问与检索。

除了能听懂人话的 Siri,Apple Intelligence 在影像方面的升级同样很抢眼。

Image

在 iOS 26 上已经存在的 AI 消除功能,在 iOS 27 上得到了进一步优化,消除的效果更干净、破绽更少。

Image

在 iOS 27 的相册编辑菜单中,苹果还进一步优化了 AI 构图功能:

  • Extend(智能扩图):平时拍照如果构图太紧凑、没拍全,只需向外拉动画幅边框,系统就会根据环境风格自动脑补并无缝填充画面,比如把裁切掉的建筑屋顶、两侧延伸的街景自然补齐;

Image

  • Reframe(智能重构):点击后,iPhone 会先调用端侧模型生成预览,不仅能自由裁剪构图,甚至能轻微微调拍摄机位的视角,确认后由云端模型把新视角下的空缺细节补全。

Image

除了静态修图,爱范儿在实测中还挖出了一个很有新鲜感、但此前官方未曾大篇幅宣讲的细节——相册视频端侧加字幕

以往想给随手拍的视频打字幕,往往要导入剪辑软件或上传云端。而在 iOS 27 中,相册在播放带有清晰人声的视频时,只要能识别出语音,进度条旁就会出现独立的字幕按钮。凭借端侧模型的实时听觉理解,无需联网也能在本地一键生成并显示高准确度的字幕,还支持自定义字幕样式。

Image

此外,原本只能生成卡通插画、表情包的「图乐园」,在 iOS 27 上也正式放开了对「写实影像」的支持。

Image

体验下来,无论是开窍的 Siri、相册里的端侧视频字幕与 AI 扩图,还是跨 App 的连贯调度,完全体的 Apple Intelligence 确实让人眼前一亮,也展现出了软硬件深度融合该有的水准。

不过,对于咱国行 iPhone 用户来说,这块大饼目前暂时还吃不上。虽然此前相关备案信息显示「Apple 智能」已经通过了国内的端侧大模型审批,但截至正式版推送,苹果仍未在中国大陆正式开放新一代 Siri 的完整体验。

Image

期待归期待,回到眼前的现实——抛开短期内还摸不着的新 Siri,作为一个每天被解锁上百次的随身工具,iOS 27 在那些看得见、摸得着的日常体验上,到底带来了哪些实在的改变?

调休闹钟终于来了,还有这几处高频细节

液态玻璃能调了

去年的 iOS 26 在口碑上可以说是一言难尽。主打的 Liquid Glass(液态玻璃)视效评价两极分化:喜欢的人觉得通透有层次,但也有不少人抱怨大面积的半透明材质在复杂壁纸或高对比背景下,界面的可读性大打折扣。

Image

图|Tom’s Guide

尽管 iOS 26 后续几个版本一直在微调模糊度和文字阴影,但可读性差的问题始终没能彻底解决。

到了 iOS 27,苹果终于把控制权交还给了用户。在系统设置的「显示与外观」中,新增了一条无级的 Liquid Glass 调节滑杆。

Image

想要通透轻盈,可以把滑块往左拉;如果觉得文字看不清、背景太花,直接往右拉,界面底色就会变得接近 iOS 18 以前的毛玻璃效果,界面的可读性有了立竿见影的改善。

动效调度与流畅度

除了这套看得见的「面子」,iOS 26 的「里子」也让人头疼——多任务切换和复杂场景下经常出现断续掉帧。

到了 iOS 27,苹果把很大一部分工程精力放回了底层调度。从官方公布的测试数据来看:主流 App 冷启动速度提升最高 30%,新拍高像素照片载入提速最高 70%,AirDrop 传输与握手提速最高 80%。

Image

值得注意的是,苹果在这次的官方基准测试里,除了当季旗舰,还特意加入了 iPhone 11 Pro Max 和 iPhone 15 作为测试机型。

实际升级之后,从屏幕顶端下拉通知中心、左右翻页,或是从屏幕底部上滑返回桌面,动画的回弹阻尼感觉更加干脆,多任务卡片的拉起与切换也平稳了不少。如果你的 iPhone 支持 120Hz ProMotion 高刷,跟手度的改善会相对明显;而在 60Hz 刷新率的老机型上,滑动时的停顿感也有所收敛。

Image

图|Apple

另一个跟操作体验直接相关的改动是网络切换。以往走出地下车库或电梯时,Wi-Fi 断开转入蜂窝网络的过程偶尔会有一段加载真空期,iOS 27 优化了这里的交接逻辑;同时,两台 iPhone 之间使用 AirDrop 寻找对方设备与握手连接的速度也有所提升。

除了系统层面的视觉与流畅度优化,iOS 27 在自带 App 上的功能改动大多都偏向日常实用,针对不少过去被广泛吐槽的细节做了填坑。

调休闹钟

Image

千呼万唤始出来,苹果终于在 iOS 27 上加入了国内用户一直呼声很高的调休闹钟功能。在闹钟设置选择「工作日(含调休)」之后,系统会在法定节假日自动跳过闹钟,而在因调休而需要上班的周六日准时响铃。

苹果用户终于不会再在节假日的清晨被误响的闹钟吵醒,也不用担心调休补班的早晨睡过头了。

相机和照片

Image

虽然老机型无缘新款 iPhone 18 Pro 系列的可变光圈等硬件红利,iOS 27 还是为老 iPhone 带来了自定义相机界面的功能。

通过长按顶部按钮即可进入编辑模式,可以把曝光、实况、风格、景深、夜间模式、格式等高频参数直接「钉」在顶部,按照自己的拍摄习惯,调配出一套更顺手的按钮布局。

Image

照片 App 新增了「由我拍摄」与「身份文件」两个独立视图。「由我拍摄」把截屏、表情包与相机拍摄的原片彻底拆开,方便快速翻找照片;「身份文件」则会自动识别并归类身份证、驾照等凭据,临时办事调取更方便。

视频播放界面新增了帧导出功能。暂停视频时,在右上角菜单中可以直接把当前画面保存为原分辨率照片。此外,共享相簿也取消了画质压缩,支持以全分辨率分享原图。

AirPods 自定义 EQ

在连接兼容的 AirPods(搭载 H2 芯片的 AirPods 4、AirPods Pro 2 等)后,iOS 27 在耳机设置中新增了自定义 EQ 调节。系统提供了低频、中频与高频三档滑杆,方便按个人听音习惯微调声音风格。

Image

此外,AirPods Pro 还新增了自适应音频的强弱微调,可以自由选择更偏向降噪或通透。

Image

这些细节也更顺手了

还有几项细节上的改动:天气 App 重新梳理了卡片结构,顶端加入了逐小时降水走势图,未来几小时何时下雨、雨量多大看柱状图一目了然;

Image

桌面支持了占满一整页的超大尺寸小组件,锁屏时钟也提供了更紧凑的字体排版;闹钟与计时器的音量在设置中被独立拆分出来,不再跟白天的媒体播放音量捆绑,避免白天随手把视频静音后导致第二天闹钟失灵;

2026-09-15 05:00:50 · 大模型,算力芯片,语音音频,搜索RAG,办公效率,翻译字幕,扩散模型,微调蒸馏,模型评测,端侧AI,图神经网络,传媒内容,招聘HR,产品更新,开发者生态

vivo 蓝心小 V Pro 发布:一句话拆解任务,跨端调用超 6000 项能力

IT之家

IT之家 9 月 16 日消息,在今日举行的 2026 vivo 开发者大会上,vivo 官方宣布推出蓝心智能,以「大模型 + Harness + 智能体安全架构」重构系统体验。

同时,vivo 发布了全新蓝心小 V Pro。蓝心小 V Pro 定位为个人专属 AI 助理。用户只需说出一句话,该助手即可自主拆解任务、跨端操作并逐步执行。

据官方介绍,小 V 已深入系统底层,可调用超过 6000 项原子能力,支持超万种任务。

在旅行场景中,用户一句“帮我出份攻略”,小 V 即可将收藏的攻略、相册中的打卡点照片、笔记以及已订行程串联,结合用户偏好生成专属路书,并在旅途中推荐附近餐厅。

在办公场景中,遇到临时情况需要处理时,小 V 可跨设备查找手机和电脑中的会议纪要、项目材料和邮件报告,按用户表达习惯整理成可直接使用的工作报告。

除上述场景外,蓝心小 V Pro 还支持每日清晨推荐热点资讯、调研后整理录音并提炼用户痛点、按心仪岗位定制简历以及深度模拟面试等能力。

为支撑个人化智能体验,vivo 在系统底层构建了覆盖身份、权限、运行与审计全流程的 AI 运行安全基座。

此外,蓝心小 V 新增“超强用机”功能:很多功能要用时总找不到,小 V 一句话就能调出来,例如晕车时开启晕动视觉辅助,音频超分、抗疲劳亮度随叫随用;给长辈调字体、放大图标、拦骚扰电话,现在一句话搞定。

当然,小 V 还支持打车、点咖啡、订票等衣食住行场景。vivo 表示,全新蓝心小 V 可调用 6000 多项原子能力,支持超万种任务。

在体验升级方面,小 V 的操作位置经过调整,并可感知当前场景主动提供服务。学习、出行、生活中的问题可调用专业服务解答。

面对真实世界,小 V 支持拍照翻译,出国看不懂路牌时拍一下即可翻译;开启视频问后,可边走边聊。

小 V 灵动组件支持用户通过一句话生成专属组件。描述创意想法后,无需复杂设计与开发,即可生成专属组件小游戏,点开即玩,无网也能玩。用户还可自由组合多种能力。

另外,即将发布的 vivo X500 系列和 iQOO 16 将首批搭载 OriginOS 7,蓝心小 V Pro 为该系统核心 AI 能力。IT之家后续将为大家带来更多报道。

2026-09-16 02:29:34 · 大模型,AI应用,政策监管,语音音频,对话助手,Agent智能体,办公效率,翻译字幕,设计创意,教育学习,游戏,AI for Science,招聘HR,模型发布,产品更新,开发者生态

vivo OriginOS 7 发布:蓝心小 V 大升级,光影美学质感手动切换,首帧交互可打断

IT之家

IT之家 9 月 16 日消息,vivo OriginOS 7 今日正式发布,在 UI 设计、AI 智能、流畅体验等方面迎来升级。

蓝心小 V

OriginOS 7 带来全新蓝心小 V Pro:说一句话,小 V 就能自己拆解任务、整理信息、跨端操作,一步步执行,直到把事情办成。

  • 定制攻略」现在,一句话小 V 就会把收藏的攻略、拍照的打卡点、做的笔记,还有订好的行程,全都串起来,再结合你的偏好生成一份专属路书。旅途中,小 V 也会帮你找到附近最地道的餐厅,为你随时推荐美食。

  • 随身代办」遇到临时情况要处理,一句话,小 V 就能跨设备找到手机、电脑里的会议纪要、项目材料和邮件报告,再按你的表达习惯,几分钟,就整理成了一份可以直接用的工作报告。

  • 更多用法」全新蓝心小 V Pro 还能陪你做更多,每天清晨,推荐今日热点资讯;调研归来,整理录音、快速提炼用户痛点;求职路上,按心仪岗位定制简历;面试之前,深度模拟面试… 更多能力,等你慢慢发现。

很多功能要用时总找不到,小 V 一句话就能调出来:晕车时开启晕动视觉辅助,音频超分、抗疲劳亮度随叫随用;给长辈调字体、放大图标、拦骚扰电话,过去十几步,现在一句话搞定。

不只用机,小 V 还能帮你打车、点咖啡、订票…… 衣食住行,一句话搞定。

这些体验背后,是小 V 深入系统的能力。全新蓝心小 V 可调用 6,000 多项原子能力,支持超万种任务。

今年,小 V 升级了细节体验,操作都在更舒服、顺手的位置,还能感知当下场景,主动送上你需要的服务

学习、出行、生活中的问题,小 V 也能调用专业服务,为你答疑解惑。面对眼前的真实世界,它也能帮上忙:出国看不懂路牌,拍一下就能翻译;开启视频问,边走边聊,陪你一路看世界。

OriginOS 7 带来小 V 灵动组件:一句话,生成你的专属组件。描述你的创意想法,不需要复杂的设计与开发,就能生成专属组件小游戏,点开就能玩,无网也能玩。还可以自由组合多种能力。

AI 体验

OriginOS 7 带来多项 AI 体验升级:

  • 截屏直达:订完票,随手截屏,AI 会自动识别各种券码信息,取餐码上岛,票券进卡包。需要的时候,滑出卡包,扫码快人一步。票券临期,原子通知和小 V 建议也会主动提醒你,不用担心错过。

  • 相册随手清:打开「随手清」,像刷短视频一样,一边重温过去的美好画面,顺便就清理了相册。喜欢的留下,不喜欢的就上滑删除,重复的左右滑动对比一下,留下你喜欢的那一张。拿不定主意时,它会提前给你整理好,你只需要简单筛选和确认。

  • 文件管理:出差回来,发票、行程单散落各处,要找的时候却找不到存在哪儿。现在,文件可以按内容自动整理,还会给文件们自动命名,并带上一句简单的摘要。它还能根据当前场景,预判你需要的文件,主动送到跟前。

  • 输入法:全新的 vivo 输入法,能读懂你的上下文。朋友让你发身份证,不用退出聊天、不用手动输入 —— 输入法理解对话后,直接推荐出「身份证」,点一下找到、再点一下发出。群聊里遇到不了解的话题,它也会主动理解,弹出相关搜索词,点一下快速补课,接上话题。

  • 小 V 记忆卡:灵感总是一闪而过。现在,原子卡包有了小 V 记忆卡,即使是在锁屏状态下,滑出卡片,输入文字或语音即可,还可以拍摄照片、识别屏幕内容作为补充。AI 会自动关联图片、文字与语音,整理为一张完整的记忆卡片。

  • 录音机:每天的工作中,很多重要信息都来自会议。这次,录音机变身为会议助手,会议中可以实时分角色转写,会后按角色梳理观点,每个人说了什么、待办事项一目了然,点一下还能回溯原文,确认和查找更方便。

  • AI 日历:每天打开日历,「今日备忘」都会帮你理清一天:会议、待办、行程冲突,一眼看清。原子笔记和会议录音里的待办,也能一键加入日历。系统还会结合日程和习惯自动安排,计划有变,也会及时调整,再忙也不乱。旅行准备、证件办理这类复杂任务,还能自动拆成一步步的小计划。

  • 健康减脂:每天,你都拥有专属的饮食“预算”点数。每吃一样食物,就会消耗一点“点数”;每当运动一下,又能赢得一些“点数”。对着食物拍个照,就能自动计算,手表上也能看。不用刻意节食,只要保持每天的点数都在健康的区间范围,就可以一步步完成减脂。一周下来,AI 还会出一份减脂报告,告诉你哪里还能做得更好。

光影美学

设计方面,OriginOS 7 将光影进一步贯穿到整个系统体验。它让内容更清晰、层次更丰富,让操作和状态都有明确回应,也让情绪更自然地表达。

OriginOS 7 带来沉浸主屏,重新调整了系统图标的结构比例、元素角度与明暗层次。原有的轮廓依然保留,细节却更精致,搭配全新的深色外观,光影与色彩也更加鲜明。

当图标回到主屏,光影的细节还会随时间自然变化。白天清晰醒目,入夜柔和深邃。根据时间切换不同的氛围,让桌面看着更舒适,更有沉浸感。

OriginOS 7 支持动态透彩材质、质感手动切换:借助视效渲染引擎,OriginOS 7 在材质中加入全新折射层,让光深入其中,呈现自然通透的流动效果。复杂背景下前后层次分明,纯净背景下干净顺滑。配合高效率的渲染算法,在呈现真实效果的同时,也兼顾了性能和功耗,为更多界面,带来统一的感知和体验。

当文字与背景对比不足时,视效反馈算法会快速识别,并通过像素级透彩技术精准提亮局部材质,确保信息的清晰可读。界面质感也支持手动调节。用户可以选择平衡的自然档位、通透的真实档位,或清晰易读的柔和档位。

OriginOS 7 的动态光影支持从视觉延伸到交互,当用户按下按钮,光效就像水波一样向外扩散;滑动时始终跟随指尖的轨迹。

动态光影还会跟随下载进度,有节奏地呼吸,持续反馈任务状态;不仅如此,光还会沿着操作方向在文字间自然地扫动,为用户提供更加明确的操作指引。

当用户按键唤醒小 V,光波像聚集的能量瞬间喷涌而出,强化唤醒感知;当用户长按和小 V 说话,对话框光影流转间,传递正在倾听的状态。而执行指令时,光效会沿着屏幕边缘快速传递,指令的结果随即出现在手机顶部。

另外,结合硬件能力,HDR 技术还能进一步拓展亮度和色彩表现

OriginOS 7 带来更多的个性锁屏主题:

  • 液态主题」你的每一次晃动,都将激活美妙的光影流动。你也可以玩出不一样的感觉,选择喜欢的照片,自定义液化区域,再选择想要的动态效果,只需三步就能轻松创作一款灵动的水珠锁屏。

  • AI 萌宠主题」上传一张宠物照片,AI 就会深度理解它的外形特征,生成一只专属于你的数字宠物。点亮屏幕它会向你走来;听音乐时它会跟着节奏摇头晃脑。你的宠物,通过个人化智能,成为真正懂情境、会互动的专属数字陪伴。

  • 闪卡主题」我们把收集闪卡的快乐,带回了锁屏。搭配不同的闪卡效果,可以让萌宠冒出爱心,让喜欢的舞台亮起灯火,让热爱的动漫燃起烈焰,甚至让奇幻极光随手机转动,在掌心流转。

OriginOS 7 还带来贴纸库,锁屏、熄屏、桌面,都能随心装饰。想要创建新贴纸,用户只需要选择拍好的照片,系统会自动提取主体,加入贴纸库。只需从贴纸库一拖,一放,就能轻松完成,还可以自由调整贴纸的大小。

OriginOS 7 还有新的锁屏时钟样式,支持调节粗细,和高度。

2026-09-16 03:26:52 · 语音音频,对话助手,搜索RAG,办公效率,翻译字幕,设计创意,医疗健康,教育学习,游戏,AI for Science,招聘HR,模型发布,产品更新

HBO 总裁回应苹果 Apple TV 首夺艾美奖第一平台:有点压力

IT之家

IT之家 9 月 16 日消息,科技媒体 9to5Mac 昨日(9 月 15 日)发布博文,报道称 Apple TV 在第 78 届艾美奖颁奖典礼上大获全胜后,HBO 总裁凯西 · 布洛伊斯(Casey Bloys)认为和苹果公司的竞争“有点压力”。

该媒体指出 Apple TV 和 HBO 两者都注重影视质量,因此长期以来被外界拿来公开比较,甚至部分观众认为 Apple TV 是“新 HBO”。

苹果在第 78 届黄金时段艾美奖共获 29 项,覆盖 6 部 Apple TV 剧集及 1 支品牌广告。其中《寡妇湾》独得 14 项,占总数近一半;《同乐者》获 6 项,是第二大获奖作品。

而 HBO 在本届艾美奖上共获得 21 项奖项,凭借《匹兹堡》(The Pitt)斩获最佳剧情类剧集奖,并凭借《圣路易斯迷情》(DTF St. Louis)获得最佳限定剧 / 单元剧奖等。

在回答媒体 Deadline “您如何看待 Apple TV 的表现,以及他们首次在艾美奖上获得第一名平台的成绩?”提问时,IT之家翻译布洛伊斯回答如下:

我由衷感到高兴。因为我觉得扎克(Zack)和杰米都是非常优秀的竞争对手。回望过去,我们一直面临强劲竞争者,从 Showtime、FX、AMC,再到 Netflix、亚马逊。苹果这类对手的存在,时刻鞭策着我们,也让我们拿出最好的作品。

作为市值超万亿美元的影视竞争对手,[苹果] 确实让我们感受到压力,但我们会继续坚守自己的方向,尽全力打造最优质的剧集。

2026-09-16 04:34:38 · 融资,翻译字幕,设计创意,营销广告,模型发布,榜单评测

Trancy Air – 电脑上随处翻译,还能说中文,自动输入英文

小众软件

平时用电脑,总会碰到一些看不懂的英文:软件里的设置选项、突然弹出的报错提示,或者别人发来的一张截图。

这个时候要是碰到无法复制的内容,想要翻译就很麻烦:先识别文字,然后再去翻译;甚至有时只有几个单词,都懒的打开 OCR 识别软件,直接打开翻译软件,二指禅手动输入,只为了方便一点。

那么问题来了,有没有更方便的翻译工具?可以随时、随地,不分场合的翻译?

今天要介绍的工具是:

Trancy Air – 电脑上随处翻译,还能说中文,自动输入英文 1

Trancy Air

这是手机浏览器必备翻译插件 Trancy 发布的一款针对 Windows、macOS 的翻译工具,功能非常丰富,能够实现电脑屏幕上的全方位无死角翻译:

智能翻译

第一项功能:选中文字翻译,只需要先选中文字,然后按两下 Control,就会快速弹窗翻译:

而所谓智能,是因为它可以自动判定要翻译的语言,无需手动选择。

并且,还会根据选择内容的不同,来决定是翻译句子,还是显示单词卡:

Trancy Air – 电脑上随处翻译,还能说中文,自动输入英文 2

甚至,选择中文也可以:

Trancy Air – 电脑上随处翻译,还能说中文,自动输入英文 3

而如果是一句话,它还能翻译为英文:

Trancy Air – 电脑上随处翻译,还能说中文,自动输入英文 4

而当你什么都没选中的时候按下快捷键,它会弹出来翻译窗口,供你手动输入翻译:

Trancy Air – 电脑上随处翻译,还能说中文,自动输入英文 5

截图翻译

(需要高级会员)

电脑上总有一些不能选择的文字,比如朋友发来的截图,软件界面等,这时只需要按下快捷键 Option+Command+O(Windows 按 Alt+Shift+S),就可以选框翻译了:


截图翻译适用于屏幕上的任何区域
,需要授予系统权限才可以使用。另外按 Esc 可取消当前框选或结果窗口。

静默翻译(跨语言输入)

静默翻译是一个神奇的功能,它能帮你自动输入英文:

只需要在文本输入框中选中中文,双击快捷键 option(Win双击 Alt),就能自动将中文翻译为英文(支持其他语言),并替换为译文。

尤其在与老外实时聊天时,用起来非常方便:直接输入中文,选中翻译;看到老外发来的英文,选中翻译;无缝聊天呀。

语音翻译(语音翻译输入法)

既然有文字翻译了,那肯定也要有语音翻译:说中文,输入英文。

或许,这个功能可以叫做:语音翻译输入法。

使用方法:按下快捷键 右 command > 说话 > 再次按下快捷键 右 command,自动输入英文(Windows 双击 Win

这个语音翻译输入法,用起来还蛮酷的。

语音转写(语音输入法)

去掉翻译,这不就是语音输入法嘛。

用法也比较简单,按住快捷键 fn(Win长按 Alt),就可以说话了,松开文字自动输入。

另外,还可以选择润色模式(需要高级会员)。

Trancy Air – 电脑上随处翻译,还能说中文,自动输入英文 6

对比翻译(多家翻译引擎)

在比拼大模型的时代,到底哪家的翻译好呢?那就比比。

可以在 Trancy Air 的设置中,最多选5家,一起对比(大模型需要高级会员):

Trancy Air – 电脑上随处翻译,还能说中文,自动输入英文 7

依旧是选中文字,快捷键 Option+P( Win 快捷键 Alt+P)。

效果:

Trancy Air – 电脑上随处翻译,还能说中文,自动输入英文 8

学习模式

Trancy Air 的翻译功能大体就介绍完了,还有一些细节功能,可以下载回来试试看。

不过,Trancy Air 还带有一个学习模式,这是一般的翻译工具从来没有提供过的。

口语跟读模式

选中一段话,按下快捷键 Option+S(macOS)或 Alt+S(Windows),然后就会出现口语跟读。

这个时候,它会先自己读一遍,你就可以按下黄色的按钮,跟读,读完还能看到打分,很有意思:

Trancy Air – 电脑上随处翻译,还能说中文,自动输入英文 9

语法分析

另外,在任何 Trancy Air 界面的左下角,都有一个语法分析按钮,点击后就可以针对当前句子进行语法分析:

Trancy Air – 电脑上随处翻译,还能说中文,自动输入英文 10

朗读

在每一个翻译界面左下角,都有一个小喇叭可以朗读当前内容,并且你能在设置中修改发音,支持很多国家风格:

2026-09-15 02:11:10 · 大模型,AI应用,具身智能,语音音频,搜索RAG,翻译字幕,教育学习,招聘HR,模型发布

[macOS] macOS 27 正式版终于来了,这次真的有点不一样

V2EXmacOS 27 正式版终于发布,这次的升级更务实更实用,主要有五大方面:

1 、AI 全面进入系统(最大变化): Siri 升级为 Siri AI ,可以直接在系统里对话、问问题

2 、Spotlight 强化:不只是搜索文件,还能直接问 Siri AI ,而经典的启动台依旧没有回归,理想的方式还是使用第三方启动台,比如 LaunchOS 等

3 、Liquid Glass 优化:透明效果( Liquid Glass )更可调,整体更“干净、轻”

4 、性能和系统底层优化:App 打开更快,系统整体更流畅

5 、应用体验增强:Mail 搜索更智能排序,视频/字幕/辅助功能增强等

你最看好 macOS 27 的哪些升级?


2026-09-15 03:44:37 · AI应用,对话助手,搜索RAG,翻译字幕,招聘HR,模型发布,产品更新

苹果 54 项 iOS / iPadOS 27 隐藏新功能 / 新特性汇总:打磨细节、聚焦 AI

IT之家

IT之家 9 月 15 日消息,MacStories 主编费德里科 · 维蒂奇(Federico Viticci)今天(9 月 15 日)发布博文,梳理汇总了 54 条苹果 iOS / iPadOS 27 系统的隐藏新功能 / 新特性。

整体体验方面,维蒂奇认为 iOS 27 不像 iOS 26 更新那样强调视觉变化,以提升性能表现和可靠性,以及打磨细节为主,并聚焦 AI 功能,在照片、Siri AI、备忘录、Safari 等方面,部分新功能 / 新特性可能会改变用户日常交互流程。IT之家翻译相关内容如下:

一、Photos

1、“相机胶卷”以筛选形式回归

照片 App 的图库(Library)新增“Captured by Me(我拍摄的)”筛选:开启后,只展示由本机拍摄的照片和视频,不混入截图、网页保存图片或其他来源的媒体。

它本质上是给用户重新提供一个更接近旧版“相机胶卷”的干净视图,不过它不能设成默认视图;每次退出并重新打开照片 App 后,需要重新开启筛选。

2、从视频保存单帧照片

播放视频时暂停,点击右上角“…”并选择“Save Video Frame as Photos”(将视频帧存为照片),可把当前画面保存成静态照片。与截屏视频不同,输出图像保留原视频的完整分辨率和元数据。这解决了过去为了截取某个精准画面,只能截图、且通常会损失尺寸与拍摄信息的问题。

3、身份证件聚合相册

照片新增“Identity Documents”(身份证明文件)集合,用于自动汇集历年来拍过的护照、身份证等证件照片。

该功能可以降低检索成本,用户不必再记得证件是什么年份、在哪个旅行相册里拍的,也不必因为找不到旧照片而重新拍摄。

4、照片与视频可手动添加关键词

用户可给照片或视频添加自定义、多词关键词;在查看单张媒体时上滑进入信息面板,滚至底部即可输入,关键词会立刻进入照片搜索索引。

5、立即同步到 iCloud

照片 App 增加“Sync Immediately”(立即同步)选项,路径是:Collections(收藏集) → 顶部个人头像 → Sync Immediately → For Today。

该功能适合刚拍的截图、文件或照片,需要尽快同步到 iPad、Mac 或另一部设备上。不过低电量模式或低数据模式开启后,此功能会自动禁用,避免过度消耗电量或移动数据。

6、星级评分

照片 App 支持给照片打星,并可按评分筛选图库内容。需在“设置 → App → 照片 → 查看选项 → 评分控制”启用;启用后,全屏看图时右上角会有星级入口。

维蒂奇认为在摄影筛片、挑选旅行精华照片、建立“待修图/已精选”工作流,这比仅靠收藏夹具备更细腻掌控:例如可用 1 星标记待删除、3 星标记保留、5 星标记精选。

7、Clean Up 加入高质量模式

Clean Up 是基于苹果 Apple Intelligence 的 AI 修图工具,iOS 27 版新增“高质量”(High Quality)模式,适合复杂或精细的移除任务。

原作者举例称,iOS 27 的 Clean Up 提升了对象边界识别和局部生成修复能力,以前尝试移除狗身后的花瓶时,旧系统误删了整张柜子并留下模糊痕迹;iOS 27 中则更准确地仅移除了花瓶。

二、主屏幕、锁屏和液态玻璃

8、个性化液态玻璃(Liquid Glass)

此前 Liquid Glass 只有“Clear/透明”和“Tinted/着色”两档;iOS 27 改为可在“设置 → 外观 → Liquid Glass”中通过滑杆调节,在“更透明、默认、更有色”三种预设之间选择中间强度。

喜欢层次感但觉得全透明太花、觉得强着色又太厚重的用户,终于可以找到中间点。设置页还会叠加真实系统 UI,让用户在 Apple Park、彩虹及 dogcow 背景图上预览效果。

9、超大型小部件

主屏幕新增“Extra Large”(超大型)小组件尺寸,单个小组件可占满整整一页主屏幕。苹果为日历、家庭、邮件、音乐、备忘录、照片、提醒事项、快捷指令、股市和天气提供了 XL 小组件。

其中,快捷指令 XL 小组件可直接运行最多 16 个快捷指令,家庭 XL 小组件最多可控制 14 个配件或场景,强调“一屏触达”的控制台体验。

10、更小的锁屏时钟

锁屏时钟新增小尺寸布局:时间会排在日期旁边,而不是采用传统的大号居中显示。编辑锁屏后,点按时钟进入“字体与颜色”面板,再点右上角的新图标即可切换大小时钟。这项特性适合希望锁屏更简洁、想把照片主体留出来,或需要更多空间放置小组件的用户。

11、从锁屏清除“正在播放”

当音频或视频处于播放状态,现在可在锁屏滑动“正在播放”卡片,调出“Clear”(清除)并移除它。此操作也会让对应活动从灵动岛消失,但不会暂停播放

三、Siri AI

在开始之前,有两点需要注意:Siri AI 目前仅支持英语,并且仅在部分地区推出;此外该功能还需要先对设备建立本地索引,保持接入 Wi‑Fi 并充电可加快索引。

12、在任意界面搜索或提问

Siri 与 Spotlight 被整合成一个统一的悬浮搜索框,可从灵动岛向下滑在任何位置呼出,而不必回到主屏幕。系统若判断输入更像“请求”而非“关键词搜索”,Spotlight 结果会收起,并在查询旁显示“Ask Siri/询问 Siri”。

原来的 Spotlight 更像主屏入口,而新版把搜索与智能助理变成覆盖全系统的即时层。用户在 App 内看到内容时,不用离开当前上下文就能检索、追问或执行任务。

13、Siri 对话支持随时转文字,并保存历史

与 Siri 交谈时,用户可向下滑回复内容转为文字输入;也可以把某条 Siri 回复展开为全屏,像用聊天机器人一样继续输入。Siri 会话不再是一次性、结束即消失的交互,会被保存在独立 Siri App 中,可稍后继续。

14、屏幕感知与跨 App 操作

iOS 27 重点增强了屏幕感知(On-screen awareness)能力,Siri 可理解当前屏幕的对象、列表位置和内容语境,并把自然语言指令映射为具体操作。

原文列出的例子包括:

  • 在音乐列表中说“播放第三个”,Siri 理解“第三个”指当前列表的第三首。

  • 浏览含有活动信息的页面时说“把这个加入日历”,系统提取相关内容。

  • 在信息 App 中说“喜欢最后一条消息”,为最后消息添加爱心 Tapback。

  • 在提醒事项里说“把第二个标为完成”,按当前列表位置执行。

  • 查看日历活动时说“给参与者发邮件,说我会晚 10 分钟”,自动在邮件中准备草稿。

15、新 Siri 声音与个性化参数

支持设备可在“设置 → Siri → 语音”使用新的语音预览和个性化界面,提供美式、澳大利亚、英式、印度、爱尔兰、南非六种英语口音。用户可点按彩色圆点试听;其中美式与英式声音还能调“Pace/语速”和“Expressivity/表现力”。

16、相机中的 Siri

过去名为 Visual Intelligence 的相机视觉能力,现被直接并入“Siri”品牌并放到相机 App 中:从“照片”模式滑至“Siri”模式即可冻结画面并提问;长按相机控制按钮仍然可启动。

维蒂奇在推文中展示的案例,针对楼管张贴的蚊虫喷洒日期通知,让 Siri 识别日期和时间,并直接向家庭日历创建约十多个活动;该模式也可测试与第三方 App 的联动。

17、相机识别结果可在 Siri App 持续追问

相机发起的视觉问答不会止于一次结果。例如识别一艘船后,用户可在之后打开 Siri App,找到同一段对话,再继续追问该船的历史。这把“临时视觉识别”升级为“有上下文的研究会话”。

维蒂奇展示的案例是:

今年夏天早些时候在加埃塔,维蒂奇去吃晚饭的路上,看到一艘巨大的船停泊在餐厅前。通常情况下,维蒂奇会拍张照片,新建一个 ChatGPT 对话,上传照片,然后询问这艘船的信息。

但这次,按住“相机控制”键,几秒钟后 Siri 告诉我,维蒂奇看到的是“帕利努罗”号,一艘意大利海军的三桅训练舰。

原本需要 20-30 秒才能通过 ChatGPT 完成的对话,现在只需 5 秒就能和 Siri 完成。更妙的是,维蒂奇后来在 Siri 应用里找到了这个对话记录,还继续询问关于这艘船的历史。

18. 所有上下文菜单常驻“询问 Siri”

在 iOS 与 iPadOS 27 中,长按文件、选中文本、备忘录内容或链接所出现的上下文菜单,都会常驻“Ask Siri”(询问 Siri),被选对象将直接作为 Siri 输入。Siri 不再只靠唤醒词、侧边键或单独 App 触发,而是成为各类对象操作菜单里的普遍入口。

19. “使用 Siri 写作”取代旧写作工具

原有 Writing Tools 被“Write with Siri”(使用 Siri 写作)替代。可从键盘左上方的 Siri 按钮进入,或选中文本后在操作菜单点 Siri 图标;“校对”和“重写”也会出现在 QuickType 栏。

新版不再提供少数固定文风模板,用户可以直接说明需求,如“更正式一点”“改得更简洁但保留数据”“将语气改得适合客户邮件”,修改前后可通过底部滑动卡片对比。

20. Siri App 的会话布局可切回列表

Siri App 默认采用“层叠式”网格布局,但如果更重视搜索与浏览历史会话,可点按右上角按钮切回经典列表视图。

21. ChatGPT 扩展仍可手动调用

iOS 27 仍保留从 iOS 18.2 开始的 ChatGPT 扩展。用户需手动点入 Siri 搜索框,选“Ask/询问”,再把提供商切到 ChatGPT。

文中指出,如果你用 ChatGPT 发出的是 Siri AI 自己已经能处理的请求,系统编排层仍可能把任务转回 Siri。ChatGPT 并未完全消失,但其入口更深、系统则更倾向优先使用自己的 Siri 路径。

22. Siri 与邮件深度协作

Siri 可理解邮件库中的自然语言任务,例如“找出收件箱里所有来自 Google Search Console 的邮件并归档”。在维蒂奇体验中,系统找到 40 封邮件后要求确认,并在 10 秒内完成流程。

文章将这种速度归因于设备已完成本地索引:相比需连到外部邮件连接器、再进行云端推理的方式,本地已索引数据能让搜索与批量操作更直接。

23. 可一次执行两件事,但三件可能失效

维蒂奇测试发现,可让 Siri 在一条请求内并行完成两项任务,例如“设一个计时器并开灯”;但若一次提出三项任务,第三项可能被静默漏掉。

四、键盘与输入

24. 剪贴板粘贴建议

复制文字、链接或图片后,下次点入文本框,键盘上方会出现粘贴建议,轻点即可直接插入刚复制的内容。

它减少了长按文本框、调出菜单再选择“粘贴”的动作。文中评论补充,该功能与“预测文本”开关有关:若关闭预测文本,粘贴建议可能不会显示。

25. 系统级语境校对

该功能并非自动纠错,iOS 27 新增系统级“Automatic Proofread

2026-09-15 04:48:56 · 大模型,AI应用,具身智能,OpenAI,Google,语音音频,对话助手,Agent智能体,推理思考,搜索RAG,办公效率,翻译字幕,传媒内容,模型发布,产品更新
继续滚动加载更多…