9月17日消息,谷歌抢攻语言市场,并将语音战场进行了明确的架构分工,推出两款AI即时对话模型Gemini 3.8 Live及 3.8 Live Extended Thinking,针对企业及消费市场,用户可以通过语言指示模型工作。谷歌亦公布两款新即时对话模型于Artifical Analysis在Agentic Performance(τ-Voice)的评分,该测试评分模拟客服人员的场景中,AI成功解决问题的比例。当中3.8 Live Extended Thinking(High)以68.6%居首,略胜于排名第2、OpenAI的GPT-Live-1 Astra (Medium)的67.9%。与排名第4、xAI的Grok Voice Think Fast 2.0 (High)的56.5%有较大差距。另Gemini 3.8 Live则以30.1%排第12。
谷歌推出两款AI即时对话模型,抢攻客服及语音市场
了解更多
-
国产RSI模型交卷!Flash模型靠它反打旗舰
RSI,彻底火了。 从硅谷一路烧到国内, 「让模型参与训练下一版自己」 几乎一夜之间成了AI圈最热的叙事。 不过热闹归热闹,目前真正拿模型交卷的还屈指可数。 而就在这一当口,「港股AGI第一股」云知声
-
智能体如何改造芯片设计?新思科技掏出EDA家底,助攻中国创新
智东西9月17日报道,昨日,在2026新思科技开发者大会上,新思科技总裁兼CEO盖思新(Sassine Ghazi)提出重塑未来需要三项关键投资——协同设计、数字孪生、AI智能体,并分享了从芯片到系统
-
Meshy: 角色驱动下SPMD范式的RL训练框架
在过去的几年里,LLM RL 系统的工作负载发生了巨大的变化。早期的 RLHF 围绕同步训练展开:模型按固定顺序进行生成、打分和训练,每个阶段之间有着明确的同步边界。如今,系统还需要处理异步生成、持续
-
OpenAI首次公开六起模型对齐失效案例,涉及瞒报错误、编造数据等
IT之家 9 月 17 日消息,当地时间 9 月 16 日,OpenAI 发布报告,披露了其“对齐失效”框架下的六起模型异常行为案例,涉及隐瞒错误、编造数据、未经许可上传文件等。 对齐失效在这里是指
猜你想看
-
沉迷“拜佛”的母亲和她无处托付沉重人生
1 27岁那年,我确诊了卵巢功能早衰,平时身体一向结实的我怎么也想不到自己的生育功能已经岌岌可危。刚和爱人结婚不久,就被判下不孕的命运,这对我们来说是一个巨大的打击。几番商议之下,我们最终决定求助于现
-
专题报告 | 母婴行业舆情观察:安全之下,心智生变
核心导览 当“异物投诉”频繁见报、“有毒检出”屡上热搜,一场由高频舆情与心智变迁共同驱动的“避险消费”浪潮在母婴赛道持续升温。舆论场中,公众对“符合国标”的信任阈值不断前移,对“看不见的风险”的追问日
-
轻松一秒:小腹三层,非一日之馋
哈啰大家好啊,我是实习生 小桃 ,大家周三愉快。~轻松一秒,快乐十分~再次强调,咱是轻松一秒!咱是轻松一秒!咱是轻松一秒!咱真的不是轻松一刻!大家千万不要将我和我大哥弄混啦! 【上期提问】 答案:评论
-
为了买房,我们领了结婚证
1 2020年7月,我硕士毕业留在上海工作,男朋友博士在读,预计比我晚一年毕业,我们是校园恋爱,感情稳定。为了方便外出实习找工作,男朋友打算从博士公寓搬出来和我合租。由于疫情的缘故,从回校打包行李、领