极客早知道
13min read
OpenAI 首款 AI 硬件曝光;DeepSeek 拟上调 API 服务定价;曝字节拟训练超 5 万亿超大参数模型|极客早知道
极客早知道2026/08/07

摘要
深圳诞生国产消费级 3D 打印机「四小龙」;加大 AI 投入,关注情感陪伴;Bose 推出新一代 QuietComfort 头戴式耳机

古尔曼爆料 OpenAI 首款 AI 硬件:甜甜圈造型、冰球大小,先进语音交互等
8 月 7 日消息,彭博社的马克 · 古尔曼(Mark Gurman)今天(8 月 7 日)发布 Power On 实时通讯,爆料称 OpenAI 的首款 AI 硬件为冰球(Hockey Puck,约 115.8 立方厘米)大小,售价预估在 300 美元到 400 美元(IT 之家注:现汇率约合 2,029 元到 2,705 元人民币)之间,有望 2027 年发布。
定位方面,这款 AI 硬件本质上是「没有显示屏的智能音箱」,面向家庭场景设计,用户可用单手在家中携带它移动,由 OpenAI 公司和前设计师乔纳森 · 伊夫(Jony Ive)合作开发。
外观方面,消息称这款 AI 硬件外形呈「甜甜圈形」,大小约等于冰球。IT 之家查询公开资料,标准冰球(Hockey Puck)直径约为 7.62 厘米,体积约为 115.8 立方厘米。
硬件方面,古尔曼透露这款硬件配备可移动部件,其中部分部件可自动移动,用于提示设备正在响应或与用户互动。设备还将配备灯光、摄像头系统和其他传感器。
交互方式上,古尔曼透露该设备的运行机制,类似于手机端的 ChatGPT 语音模式,
会使用更先进的模型,以支持更接近人类交流的互动。(来源: IT 之家)
科技媒体 @PatentlyApple 制作的渲染图

曝字节拟训练超 5 万亿参数大模型 参数规模超 Kimi K3
8 月 6 日消息,据《晚点 LatePost》报道,字节跳动正在讨论训练一个参数规模超 5 万亿的模型,它超过阿里的 Qwen 3.8-Max(2.4 万亿参数)和月之暗面的 K3(2.8 万亿参数),也是目前国内已知参数规模最大的模型。该计划仍处于早期阶段,模型最终不一定会发布。
报道称,新模型将由 Seed Foundation 负责人项亮主导,与大语言模型预训练数据负责人沈科合作。为此,Seed 正在重新梳理组织,划分职责,分配资源。
项亮与沈科均是字节跳动人工智能及大模型研发体系内的核心骨干,均出自字节的「搜广推」体系。项亮本科毕业于中国科学技术大学,博士就读于中科院自动化所,2016 年加入字节,曾负责机器学习中台 AML 团队,后调任豆包大模型 Foundation 团队任负责人。沈科 2018 年清华毕业后,加入字节跳动,现主要负责 LLM 预训练数据。
针对字节讨论训练超 5 万亿参数模型的原因,报道援引接近 Seed 人士消息称,Seed 团队认为,与其在现有尺寸上继续追赶其他大模型,不如把参数规模一次推到同行的数倍,争取领先位置。
两周前的 Seed 全员会上,字节跳动创始人张一鸣安抚了 Seed 的成员。他认为,训大模型本就是一件很难的事,团队不必过度焦虑。他明确一段时间内可接受模型落后于行业,希望大家以追求智能上限为目标,期待 Seed 模型能力能跻身世界第一梯队。
张一鸣认为编程是当前的关键方向,并表态自己反对蒸馏。在其看来,蒸馏能在短期内改善模型表现,但本质上仍是在复制 Claude 已有的能力。沿着这条路走,最多只能不断逼近对方,很难真正实现超越。
(来源:新浪科技)
宇树科技:本次发行价格 150.80 元/股,本次发行数量占发行后总股本 10%
8 月 6 日消息 宇树科技公告称,公司首次公开发行股票并在科创板上市,发行价格为 150.80 元/股。本次发行数量为 4044.6434 万股,占发行后总股本 10%。发行市盈率为 219.23 倍,高于行业平均市盈率 38.56 倍。预计募集资金总额约 60.99 亿元,净额约 59.17 亿元。战略配售获配 808.9286 万股,包括社保基金、深度求索、中国石油团等。网上申购日为 8 月 10 日,缴款日为 8 月 12 日。
公告中提到,本次发行价格 150.80 元/股对应的发行人 2025 年摊薄后静态市销率为 35.89 倍,高于同行业可比公司 2025 年静态市销率平均水平;本次发行价格 150.80 元 /股对应的发行人 2025 年扣除非经常性损益前后孰低的摊薄后市盈率为 219.23 倍,高于中证指数有限公司发布的行业最近一个月平均静态市盈率,存在未来 发行人股价下跌给投资者带来损失的风险。发行人和保荐人(主承销商)提请 投资者关注投资风险,审慎研判发行定价的合理性,理性做出投资。
此前,宇树科技启动科创板初步询价,计划 8 月 10 日开启网上、网下申购。宇树科技此次 IPO 拟募资 42.02 亿元,拟发行数量占发行后总股本比例为 10%;按此推算,宇树科技市值有望达到 420 亿元。(来源:新浪科技)
DeepSeek 拟上调 API 服务定价,预计涨幅较大
据 DeepSeek 最新公告,公司计划近期整体上调 DeepSeek API 服务定价,预计涨幅较大。公司建议广大用户合理安排使用,具体方案以正式通知为准。
近期,DeepSeek V4 Flash 预览版登顶全球 AI 模型聚合平台 OpenRouter 模型调用量全球榜单,最新发布的 DeepSeek V4 Flash 正式版也上升至第 8 位。
技术突破外,近期市场还传出 DeepSeek 重启第二轮融资,计划募资 500 亿元相关消息。据报道,伴随第二轮融资启动,DeepSeek 投前估值约 5000 亿元,并计划将在 8 月下旬完成签约。(来源:新浪科技)

小红书加大 AI 投入:布局 AI 社交方向,开启 AI 陪伴产品自研
8 月 6 日消息,小红书正全面提速 AI 战略,布局 AI 社交产品、AI 社区互动工具等方向,从后台技术应用转向前台自研、产品化与生态化全面竞速。
一位知情人士透露,「小红书正在高薪招募 AI 人才,投入系列 AI 产品自研,要找有强烈 Al Native 产品思维的人。」
新浪科技在招聘平台检索发现,小红书近日正密集招募 AI 应用研发人才。其中,「AI 社交产品经理」岗位职责包括:主导 AI 陪伴产品的设计与打造,探索 AI 在情感连接、兴趣匹配、个性化互动等维度的深度应用,构建有温度的 AI 陪伴体验。
今年 5 月,小红书发布内部信,宣布新一轮组织升级,其中核心变化就包括,成立 AI 一级部门 Dots 和企业智能部,从产品技术和组织两方面加大对 AI 的投入。
事实上,小红书早已在 AI 领域有所布局。今年 4 月,小红书集中开源 REDSearcher 搜索 Agent、FireRed-Image-Edit 多模态图像编辑工具、FireRed-OpenStoryline 视频创作模型三大 AI 技术。此前,小红书还全资收购生活场景 AI 搜索产品「点点」,实现内容平台向「内容创作+智能服务」的转型。(来源:新浪科技)
国产消费级 3D 打印机拿下全球 9 成份额,深圳诞生「四小龙」
8 月 6 日消息,国家统计局数据显示,2026 年上半年,国内 3D 打印设备产量同比增长 48.5%,增速在主要工业产品中排名第一。出口端表现更为突出,上半年我国累计出口 3D 打印机 362 万台,同比增长 90.2%,出口金额达 96.11 亿元,同比增长 109.3%。
据财联社今日报道,3D 打印资源库创始人谭文杰表示,按照目前的增速,2026 年全年 3D 打印机出口量有望达到 800 万台。据国泰海通研报数据,全球 3D 打印市场收入预计到 2034 年将达到 1,150 亿美元(IT 之家注:现汇率约合 7,776.54 亿元人民币),10 年复合年增长率达 18%。
报道还称,拓竹、创想三维、纵维立方、智能派四家深圳企业合计占据了全球消费级 3D 打印约九成的出货份额。谭文杰表示,目前,深圳 3D 打印「四小龙」已经几乎掌握了全球消费级市场的话语权。
工业级 3D 打印也在增长,但增速与消费级差距明显。CONTEXT 数据显示,2026 年第一季度,全球工业级 3D 打印机出货量同比增长 18%,中国市场增长 29%,同期国内消费级设备产量增速接近 50%。(来源:IT 之家)
小米徐洁云就「孩 go」言论回应,称有小米用户养的宠物名字叫「孩 go」
8 月 6 日消息,今日,有网友评论小米集团董事长特别助理、战略市场部副总经理徐洁云:「王腾比你强的不是一点点」,徐洁云转发后回应:「当然啊,创业者都非常了不起。」
我们注意到,有网友回评:「张口闭口 higo 的人都能做高管我是服气的。」随后,徐洁云就此进行了回应:「一位小米用户经常在网上晒她养的宠物,宠物名字叫『孩 go』。我看得多了互动问候下,这很合理吧?」
去年 11 月,原小米集团公关部总经理王化转岗小米武汉总部,徐洁云接任了小米集团公关部总经理一职。今年 1 月,小米创办人、董事长兼 CEO 雷军举行了新年的第一场直播,拆一辆小米 YU7 汽车,同时就网络热议话题进行了集中回应。(来源:IT 之家)

Bose 推出新一代 QuietComfort 头戴式耳机,加入有线无损播放、空间音频
8 月 6 日消息,音响品牌 Bose 正式推出新一代 QuietComfort 耳机,完成三年来首次硬件升级。新款不仅改善佩戴设计,还加入了空间音频、有线无损播放和更完善的降噪功能。
新款 QuietComfort 首次支持此前 QuietComfort Ultra 系列独占的 Bose 沉浸空间音频,系统会利用内置运动传感器模拟立体声场,让声音呈现出更明显的空间感。该耳机同步加入了影院模式,可在观看电影和电视剧时突出人声,让对白更加清楚。

通过 USB-C 连接后,该耳机可以播放最高 24 位 / 48 千赫兹的有线无损音频,同时保留无线连接方式。USB-C 还支持双向音频传输,使用视频会议软件时能够改善麦克风收音。即使正在充电,耳机也无需停止使用。
该耳机同时升级了降噪算法。开启通透模式后,系统面对突如其来的巨大噪声时,反应会更加自然。六麦克风主动降噪系统还可弥补耳罩与头部之间的密封缝隙,眼镜腿对降噪效果造成的影响也会相应减小。
外观和佩戴体验同样有所调整。Bose 升级了头梁,加入更厚实柔软的衬垫,并采用椭圆形耳罩。除常规黑色和白色外,新款 QuietComfort 还将推出多种限量配色。据 IT 之家了解,这款耳机将于 8 月 8 日开放预订,8 月 13 日正式发货。(来源:IT 之家)
可直接调用微距、长焦:微信 iOS 版灰度测试相机多焦段切换功能
8 月 6 日消息,据多名网友分享,微信 iOS 版正灰度相机多焦段切换功能。用户在聊天界面打开相机进行拍摄,可以直接在拍照页面选用手机的长焦、微距等。
从网友反馈的微信新版相机界面来看,在拍摄的时候会出现 0.5x、1x、2x 和 3x 不同的拍摄焦段,同时旁边还有一个花朵样式图标的微距按钮,和系统自带的相机非常像。
目前,该功能并非向所有微信账号和设备开放,部分用户尚未收到推送属于正常现象,后续将随着灰度范围的逐步扩大而覆盖更多设备与账号。(来源:IT 之家)
即日起,ChatGPT 可以调用 Adobe Photoshop、Lightroom 来修图、设计了
8 月 6 日消息,Adobe 去年底借助 OpenAI 的 Apps SDK,把 Photoshop、Acrobat 和 Adobe Express 带入 ChatGPT。时间来到今天,合作范围得到进一步扩大,新推出的 Adobe 插件几乎涵盖旗下整套创意软件。
用户安装插件后,可以直接在 ChatGPT 中调用 Photoshop、Premiere、Acrobat、Lightroom、Illustrator 和 InDesign 等 70 多款 Adobe 工具。
我们测试发现,用户可以打开 ChatGPT 设置菜单,在插件页面中添加 Adobe 插件。完成设置后,只需在提示词输入框中输入「@Adobe」和具体任务,便可调用相应工具。
Adobe 称,插件与 OpenAI 的 Codex 编程应用及近期发布的 Work 套件配合使用时效果最佳,用户不登录 Creative Cloud 账户也能使用基本功能,登录后则可保存不同会话中的工作进度,并直接访问云端文件。此外,Creative Cloud 账户还可用于调用 Adobe Firefly 提供的生成式 AI 模型。
Adobe 希望用户通过新插件完成照片编辑、营销视频制作和 PDF 生成等任务,同时也不会打算用 ChatGPT 取代现有专业软件。
Adobe Firefly 及智能体 AI 副总裁福雷斯特 · 基表示:「我们希望,无论人们在哪里工作,都能使用 Adobe 的专业级创意和生产力工具。ChatGPT 中的 Adobe 插件并不是创意专业人士每天依赖的旗舰应用的替代品。需要精确操作和充分掌控创作过程时,旗舰应用仍能提供更深入的功能。」(来源:IT 之家)
阿里全新一代视频生成模型 Wan3.0 公测:单次生成能 30 秒,号称万物皆可生视频
「阿里云」公众号 8 月 6 日宣布,全新一代视频生成模型 Wan3.0 开启公测。
Wan3.0 在生成时长、万能创作、全能参考与真实感等维度全面升级,单次可生成 30 秒视频,完整表达创作意图;在文本、图片、音频、视频四种基础模态之外,首次支持 doc、xls、ppt、pdf、md 等文档格式输入,号称将让「万物皆可生视频」。
Wan3.0 支持单段 30 秒视频生成,带来更大的创作自由度,令连续运镜、一镜到底等复杂镜头语言得以充分表达,从「生成一个镜头」走向「讲述一段完整的故事」。此外,Wan3.0 还支持智能时长功能,可根据提示词自动推荐合适时长;搭配视频延长功能,还能延展故事走向与剧情发展,让创意自然生长。
此外,为告别 AI 人物的油腻感与千篇一律,Wan3.0 文生视频模式中的人像力求「千人千面」:更敏锐地刻画五官与皮肤细节,人物情绪表达自然克制,微表情与肢体动作彼此联动;即便是群像场景,也能细腻呈现不同人物的复杂情绪。
在全能参考任务中,Wan3.0 可精准复刻参考细节,保持角色、道具、声音、空间关系、风格等关键维度的一致性。对于角色,五官、发型发色、形体、服饰、配饰等细粒度特征均可稳定保持,避免出戏;对于道具,多角度外观、硬件结构、Logo、材质细节均保持稳定;对于场景,准确处理角色站位与机位视角的关系;对于风格,精准渲染影视拍摄调性,多风格创作时也不易发生风格混淆。
即日起,Wan3.0 在阿里云百炼、万镜一刻、万相官网和千问创作 PC 端开启公测,在千问 APP 灰度开放,480P/720P/1080P 的 API 价格分别为 0.3/0.6/1.2 元 / 秒,API 接口将于近期全量开放。(来源:IT 之家)

美国祖父母热衷将孙辈写进 AI 生成童书,引发父母辈大量反感
美国一些祖父母正热衷于把孙辈写进 AI 生成童书,却让孩子父母大为反感,甚至引发家庭矛盾。
据《连线》杂志当地时间 7 月 29 日报道,美国各地不少父母陆续收到孩子祖父母送来的 AI 童书。祖父母原本只是想给孙辈准备一份充满个人色彩的礼物,结果往往适得其反。
在祖父母看来,用 AI 制作一本由孙辈担任主角的绘本「既新奇又可爱」。孩子父母却未必认同,尤其无法接受把孩子的照片和身份信息交给 AI 平台处理。
一名家长在 Reddit 帖子中大发牢骚。尽管自己已经多次明确反对,母亲仍没有停手。「我已经说过无数次,我不支持 AI 生成艺术,也明确划下红线:绝对不能把我们的任何照片输入 AI,更不能以任何方式使用能够识别我们身份的信息。可她仍然根据自己和我孩子相处的经历编故事,把角色设计得和我的孩子很像,还用我们家人的名字,让角色代表我们,好让我的孩子『在故事里看到自己的家人』。」
一门围绕 AI 个性化童书的生意也随之兴起。Imagitime、StoryWonderBook 和 Childbook.ai 等平台已经把制作流程做得极其简单,用户只需提供孩子的信息,便能把孩子直接塞进一个由 AI 编造的故事。
然而孩子似乎对自己收到的「专属故事」并不感冒。一名育有 7 岁和 3 岁孩子的父亲告诉《连线》,亲友送来的 AI 个性化童书只让两个孩子觉得「无聊」。「故事又长又啰嗦。只读过一遍,我的两个孩子就说:『行了,还是读《小蓝卡车》吧。』」(来源:IT 之家)
OpenAI