豌豆羊输入法 – AI输入工具,支持动态预测与智能纠错

豌豆羊输入法是什么

豌豆羊输入法是专为年轻人设计的趣味AI输入法工具,由蚂蚁云通(上海)信息技术有限公司开发。通过多种创新功能,满足用户在聊天场景中的个性化和趣味化表达需求。主要功能包括智能回复、表情包制作和多样化的输入方式。用户可以用AI智能替身回复聊天,选择多种AI人设(如情话、怼人、夸赞等),能通过AI生图能力制作搞怪表情包。豌豆羊输入法支持拼音、手写、语音等多种输入方式,提供智能纠错和动态预测功能,让输入更高效。支持个性化设置,用户可以根据聊天场景切换角色和主题,打造专属输入体验。

豌豆羊输入法

豌豆羊输入法的主要功能

  • AI智能替身:接入大模型,用户上传聊天截图后,AI可自动回复,提供多种AI人设(如情话、怼人、夸赞、宫斗等),满足不同社交场景需求。
  • 智能纠错与预测:支持动态预测、整句输入,能智能纠错,让用户输入更高效。
  • AI生图能力:提供丰富的表情包制作工具,支持AI配梗、AI重绘,用户可一键生成搞怪表情包,轻松应对各种聊天场景。
  • 多种输入法:支持拼音、手写、语音、笔画、五笔等多种输入方式,满足不同用户的输入习惯。
  • 混合输入:支持中文、英文、数字、符号的混合输入免切换,方便快捷。
  • 自定义角色切换:用户可以根据聊天场景自定义角色和设定,切换输入法主题,打造专属输入体验。
  • 主题管理:提供丰富的主题选择,用户可以根据喜好更换输入法界面风格。

豌豆羊输入法的官网地址

  • 官方应用商店:豌豆羊输入法

豌豆羊输入法的应用场景

  • 社交聊天:在聊天中,用户可以通过上传聊天截图,让AI根据聊天内容生成合适的回复。
  • 高效输入:支持中英文、数字、符号的混合输入免切换,适合在学习和工作中快速输入各种内容。
  • 个性化表达:在学习和工作中,用户也可以通过自定义角色切换和主题管理,让输入法更符合自己的风格,提高输入的愉悦感。
  • 表情包制作:用户可以根据聊天内容,用AI生图能力制作搞怪表情包。

Qwen3-235B-A22B-Thinking-2507 – 阿里推出的最新推理模型

Qwen3-235B-A22B-Thinking-2507是什么

Qwen3-235B-A22B-Thinking-2507 是阿里巴巴发布的全球最强开源推理模型。基于2350亿参数的稀疏混合专家(MoE)架构,每次激活220亿参数,拥有94层Transformer网络和128个专家节点。模型专为复杂推理任务设计,支持256K原生上下文处理能力,可应对长文本和深度推理链。在性能方面,Qwen3-235B-A22B-Thinking-2507 在逻辑推理、数学、科学分析、编程等核心能力上显著提升,特别是在AIME25(数学)和LiveCodeBench v6(编程)等基准测试中刷新了全球开源模型的最佳成绩,超越了部分闭源模型。在知识、创意写作、多语言能力等通用任务上也表现出色。

模型采用Apache 2.0开源协议,免费商用,用户可通过QwenChat、魔搭社区或Hugging Face体验和下载。定价为每输入百万token 0.7美元,每输出百万token 8.4美元。

Qwen3-235B-A22B-Thinking-2507

Qwen3-235B-A22B-Thinking-2507的主要功能

  • 逻辑推理:在逻辑推理任务中表现出色,能够处理复杂的多步推理问题。
  • 数学运算:在数学能力上显著提升,特别是在 AIME25 等高难度数学测试中刷新了开源模型的最佳成绩。
  • 科学分析:能处理复杂的科学问题,提供准确的分析和解答。
  • 代码生成:能生成高质量的代码,支持多种编程语言。
  • 代码优化:帮助开发者优化现有代码,提高代码效率。
  • 调试支持:提供代码调试建议,帮助开发者快速定位和解决问题。
  • 256K 上下文支持:原生支持 256K 的长文本处理能力,能处理超长上下文,适用于复杂的文档分析和长篇对话。
  • 深度推理链:自动启用多步推理,无需用户手动切换模式,适合需要深度分析的任务。
  • 多语言对话:支持多种语言的对话和文本生成,能满足跨语言交流的需求。
  • 指令遵循:能准确理解和执行用户的指令,生成高质量的文本输出。
  • 工具调用:支持与外部工具结合使用,扩展模型的功能。

Qwen3-235B-A22B-Thinking-2507的技术原理

  • 稀疏混合专家(MoE)架构:Qwen3-235B-A22B-Thinking-2507 采用稀疏混合专家(Mixture of Experts,MoE)架构,总参数量为2350亿,每次推理激活220亿参数。这种架构包含128个专家节点,每个token动态激活8个专家,平衡了计算效率与模型能力。
  • 自回归Transformer结构:模型基于自回归Transformer结构,拥有94层Transformer层,支持超长序列建模,原生支持256K上下文长度。使模型能处理复杂的长文本任务。
  • 推理模式优化:Qwen3-235B-A22B-Thinking-2507 专为深度推理场景设计,默认强制进入推理模式。在逻辑推理、数学运算、科学分析、编程及学术测评等需要专业知识的领域表现出色。
  • 训练与优化:模型通过预训练与后训练双阶段范式进一步提升性能。在多项基准测试中,如AIME25(数学)、LiveCodeBench(编程)等,模型刷新了全球开源模型的最佳成绩。
  • 动态激活机制:MoE架构中的动态激活机制允许模型在推理过程中根据任务复杂性动态选择专家节点。

Qwen3-235B-A22B-Thinking-2507的项目地址

  • HuggingFace模型库:https://huggingface.co/Qwen/Qwen3-235B-A22B-Thinking-2507

Qwen3-235B-A22B-Thinking-2507的应用场景

  • 代码生成与优化:能生成高质量的代码,帮助开发者优化现有代码。
  • 创意写作:在创意写作、故事创作、文案撰写等方面表现出色,能提供丰富的创意和详细的构思。
  • 学术写作:能辅助撰写学术论文、文献综述等,提供专业的分析和建议。
  • 研究方案设计:帮助设计研究方案,提供科学合理的建议。

Coze Studio – 字节跳动开源的AI Agent开发平台

Coze Studio是什么

Coze Studio(扣子开发平台)是字节跳动开源的AI智能体开发平台,帮助开发者快速构建、部署和管理AI智能体。提供一站式开发环境,支持Prompt、RAG、Plugin、Workflow等核心技术,通过可视化工作流编排,开发者可以零代码或低代码开发复杂AI应用。平台内置插件框架,可将第三方API或私有能力封装为插件,扩展智能体功能。Coze Studio采用Golang和React开发,遵循领域驱动设计(DDD)原则,易于二次开发。支持本地及私有化部署,部署门槛低,仅需双核CPU和4GB内存即可运行,提供一键部署脚本。

Coze Studio的主要功能

  • 一站式开发环境:提供从开发到部署的全流程支持,涵盖Prompt、RAG、Plugin、Workflow等核心技术。
  • 可视化工作流编排:通过拖拽节点的方式,快速构建复杂的工作流,支持零代码或低代码开发,方便开发者设计业务逻辑。
  • 智能体构建与管理:提供健全的应用模板和编排框架,支持快速创建、发布和管理AI智能体。
  • 多模型支持:支持集成多种主流大模型(如OpenAI、火山引擎等),并提供统一的模型接口抽象。
  • 知识库管理:集成RAG(检索增强生成)能力,支持向量检索,可上传文档或数据,智能体基于知识库生成精准回答。
  • 插件系统:支持创建、配置和管理插件,可封装第三方API或私有功能,扩展智能体的能力。
  • 数据库支持:集成数据库资源,支持数据存储与查询。
  • API与SDK集成:提供聊天和工作流相关API,支持Python、JavaScript、Java等SDK,方便二次开发。
  • 实时交互:通过WebSocket支持实时聊天、语音合成和转录。

Coze Studio的项目地址

  • Github仓库:https://github.com/coze-dev/coze-studio

如何使用Coze Studio

  • 环境准备
    • 确保电脑满足最低配置要求:双核 CPU 和 4GB 内存。
    • 提前安装 Docker 和 Docker Compose,并启动 Docker 服务。
  • 获取源码:打开终端或命令提示符,运行以下命令克隆 Coze Studio 的源码:git clone https://github.com/coze-dev/coze-studio.git
  • 配置模型
    • 进入克隆后的项目目录:cd coze-studio
    • 从模板目录复制模型配置模板文件:cp backend/conf/model/template/model_template_ark_doubao-seed-1.6.yaml backend/conf/model/ark_doubao-seed-1.6.yaml
  • 修改配置文件
    • 进入 backend/conf/model 目录。
    • 打开 ark_doubao-seed-1.6.yaml 文件。
    • 设置以下字段:
      • id:模型 ID,由开发者自行定义,必须是非 0 的整数,且全局唯一。
      • meta.conn_config.api_key:模型服务的 API Key。
      • meta.conn_config.model:模型服务的 model ID。
  • 部署并启动服务
    • 进入 docker 目录,复制环境变量模板文件,启动服务。
    • 首次部署可能需要拉取镜像和构建本地镜像,耗时较长。如果看到提示 “Container coze-server Started”,则表示服务启动成功。
  • 访问平台:打开浏览器,访问 http://localhost:8888/,即可打开 Coze Studio 的前端页面。
  • 注册与登录:在 Coze Studio 的登录页面,使用邮箱或手机号注册并登录。
  • 创建智能体:登录后,点击左上角的“创建 Bot”按钮,输入 Bot 的基本信息(如名称、头像等)。
  • 配置智能体
    • 在配置页面,可以设置 Bot 的角色、技能和限制(提示词)。
    • 添加官方提供的插件或自定义插件,配置工作流、知识库或数据库。
    • 在调试页面与 Bot 进行对话,测试其功能。
  • 使用插件
    • 在 Bot 中使用插件
      • 在 Bot 编辑页面,选择插件区域,点击加号图标添加插件。
      • 配置插件参数,并在预览与调试区域测试插件功能。
    • 在工作流中使用插件节点
      • 创建或选择工作流,在工作流中添加插件节点。
      • 配置输入输出参数,并测试插件功能。
  • 发布应用:完成所有配置后,点击右上角的“发布”按钮,将智能体发布到 Coze 的应用商店。

Coze Studio的应用场景

  • 快速原型验证(POC):开发者可以快速搭建 AI 应用的原型,验证想法和概念。
  • 中小企业 AI 应用落地:中小企业可以通过 Coze Studio 快速利用大模型能力解决业务问题。
  • 私有化部署:对于数据安全要求高的企业,Coze Studio 支持私有化部署,确保业务数据不流出企业内网。
  • 企业内部问答机器人:使用知识库构建公司 SOP 智能体,通过工作流添加审批、填表、发邮件等逻辑。
  • AI 交互式问卷系统:使用工作流引导用户填写问卷,调用插件生成数据图表,将数据同步到后端 BI 系统。

Coze Loop – 字节Coze推出的AI Agent开发与调试平台

Coze Loop是什么

Coze Loop(扣子罗盘)是字节跳动旗下Coze平台开源的专注于AI智能体(Agent)开发与运维的管理平台,为开发者提供从开发、调试、评估到监控的全生命周期管理能力。包括提示词工程、Agent效果评测、性能监控与调优、透明决策监控以及多模型对比。支持提示词的编写、优化和版本管理,提供AI辅助优化功能,显著提升提示词开发效率。Coze Loop通过系统化的评估体系,能对Agent的输出效果进行多维度自动化检测,确保其准确性和合规性。提供性能监控、异常告警以及透明化的决策链路展示,帮助开发者快速定位问题并优化模型表现。

Coze Loop

Coze Loop的主要功能

  • 提示词工程:支持提示词的编写、调试、优化及版本管理,提供AI辅助优化功能,显著提升提示词开发效率。
  • Agent效果评测:提供系统化的Agent性能评估体系,能对Prompt和AI智能体的输出效果进行多维度自动化检测,例如准确性、简洁性和合规性等。
  • 性能监控与调优:通过Trace数据追踪、性能统计和异常告警,快速定位问题根源,优化模型表现。
  • 透明决策监控:可视化展示AI工作流程,包括用户输入、模型调用和工具调用,实现全链路透明化。
  • 多模型对比:支持不同模型(如DeepSeek、豆包等)的性能对比,帮助开发者选择最优方案。

Coze Loop的项目地址

  • Github仓库:https://github.com/coze-dev/cozeloop
  • 官网地址:https://www.coze.cn/loop

如何使用Coze Loop

  • 访问与注册:访问Coze Loop的官网,注册并登录平台,创建或导入项目。
  • Prompt开发
    • 编写与调试:使用Prompt智能中枢编写和调试Prompt,实时预览不同模型的回答效果。支持智能优化、多版本对比和版本管理。
    • AI辅助优化:平台提供AI辅助优化功能,帮助提升Prompt开发效率。
  • 评测
    • 配置评测集:自定义评测集(输入数据和预期输出结果),设置评估标准。
    • 运行自动化测试:平台自动调用模型输出并对齐真实结果,支持准确率、语言规范性等多维度统计。
  • 观测
    • 启用观测功能:监控AI工作流程,包括用户输入、模型调用和工具调用,实现全链路透明化。
    • 实时预警:通过Trace数据追踪、性能统计和异常告警,快速定位问题根源。
  • 优化与迭代:根据观测和评测结果,优化Prompt或模型。迭代更新并部署最终版本。
  • 多模型对比:支持不同模型(如DeepSeek、豆包等)的性能对比,帮助选择最优方案。
  • 部署与集成:调试完成后,可通过SDK一键集成至业务代码,实现开发流程无缝对接。

Coze Loop的应用场景

  • 虚拟陪伴AI开发:通过透明化决策链优化人物设定,提升对话自然度。
  • 营销内容生成:自动化生成公众号、小红书等内容,结合评测确保合规性与质量。
  • 企业智能客服:监控问答链路,快速定位错误并优化响应准确性。
  • 教育领域智能辅导:评测不同模型的教学效果,选择最适合的AI辅导方案。
  • 金融风控分析:实时观测模型决策过程,确保合规并降低风险。

快手 AutoThink 大模型 KAT-V1 正式开源,40B 性能逼近 R1-0528,200B 性能飞跃

近日,快手发布并开源了KAT-V1 自动思考(AutoThink)大模型,这是一款融合思考与非思考能力、并且可以根据问题难度自动切换思考形态的模型。

KAT-V1模型共有40B和200B两个版本。在自动思考模式下,40B版本的性能可追平今年5月发布的新版DeepSeek-R1(参数量为6850亿)。而200B版本的模型,则在多项基准测试中超过了Qwen、DeepSeek和Llama这三大开源模型家族中的旗舰模型。

快手Kwaipilot团队在技术报告中,揭秘了KAT-V1模型背后的多项技术创新。

该团队不仅提出了一种全新的长短思考混合模型训练范式,还基于传统强化学习算法(GRPO),提出了带有新型强化学习方法Step-SRPO,进一步提升了模型输出token的思考密度以及对是否应该开启思考模式的判断力。

在部分基准测试中,即使模型自我选择不开启思考模式,受益于融合训练方法和推理模板,性能也有小幅上涨。

讯飞星火X1升级版正式上线!

今天,基于全国产算力训练的深度推理大模型——讯飞星火X1升级版正式上线。

这是一次全面的跃升:

1️⃣综合能力大幅提升。整体效果对标OpenAI o3等国内外一流大模型最新版本效果,在翻译、推理、文本生成、数学等方面保持领先。

2️⃣幻觉治理取得显著进步。幻觉问题是掣肘大模型落地应用的关键问题,升级后的星火X1在幻觉治理方面领先业界主流模型。

3️⃣多语言能力已覆盖130+语种。为世界提供全栈自主可控大模型底座的“第二种选择”。

4️⃣基于星火X1底座的语音同传大模型在翻译效果、实时响应、语音听感、专业精深等方面大幅跃升,持续行业领先。

5️⃣得益于星火X1模型的升级,教育、医疗、企业应用、代码、科研等行业大模型和智能体也取得了新的进步,在复杂行业场景任务上进一步解决用户关键刚需。

6️⃣星火X1最新升级的能力可直接在讯飞星火网页版和APP进行体验,全新API已同步上线讯飞开放平台

构建可信任的AI底座,打造懂你的“全场景助手”。

接下来,我们一起来看看具体细节吧!👇

此次升级,星火X1在多个任务上持续进步,综合能力再升级,特别是在翻译、推理、文本生成、数学、多语言上效果亮眼。

同时,在幻觉治理方面,对于大模型自身生成内容是否符合客观事实的事实性幻觉治理,以及在用户给定额外参考资料时大模型回复是否忠于原文的忠实性幻觉治理两方面均取得明显进步,显著提高了大模型行业落地应用的可靠性。

今年6月,在国内大模型挑战全国高考数学一卷的评测中,星火X1-0420版本突破了140分。本次升级,数学能力再次精进。

例如,2025年全国高考数学一卷的最后一题,难住了不少大模型,星火X1-0720版本完美答对~

今年6月,在国内大模型挑战全国高考数学一卷的评测中,星火X1-0420版本突破了140分。本次升级,数学能力再次精进。

例如,2025年全国高考数学一卷的最后一题,难住了不少大模型,星火X1-0720版本完美答对~

有了星火X1强大的多语言能力加持,讯飞的同传会议服务、SaaS端产品,还有讯飞翻译机、讯飞AI录音笔这些智能设备,翻译效果和用户体验都上了一个新台阶。

这背后离不开三大核心技术的突破——

1️⃣强化学习技术:提出了结合评语模型与细粒度反馈的强化学习技术,将单一标量奖励信号升级为文本级评语信号、在回复各步骤提供细粒度奖励的强化学习改进方案,有效降低了数学答题等任务的训练难度,解决了奖励稀疏痛点;

2️⃣数据反写技术:提出基于人类专家数据的通用认知任务数据反写技术,极大缓解了SFT高质量数据获取困难、人工标注数据成本过高等问题,实现了主观语言类任务文笔和风格化的显著提升;

3️⃣幻觉治理技术:提出了基于多路径采样验证及事实性约束强化学习的幻觉治理技术,在大模型思考过程及回复生成阶段实现客观问题上与标准答案的深度强对齐,大幅减少了在慢思考下的幻觉率,有效保障了文本摘要、RAG等任务的回复可靠性。

从灵感到网站,只要5分钟,扣子空间网页设计功能上线

给扣子做一个官方招聘网站需要多久?

反复修改设计稿7版…

等前端排期3天…

上线前紧急改需求2天…

no no no 🤚

现在只需要:  打开扣子空间!

扣子空间最新上线网页设计功能,

输入你的想法,让扣子空间帮你开发!

第二步

对话框中输入你的需求

当你输入:

生成一个现代、响应式、专注于“coze”招聘的官方网站。网站主题色统一为`#E3E4FF`,整体背景使用白色,采用简洁的布局和清晰的排版,并适当呈现积木元素风格,营造科技感与秩序感。网站品牌名称是“coze”

点击进入扣子官方招聘网站:

https://space.coze.cn/coding-expert-runtime/135999697922

注意!本次招聘网站皆为真实招聘信息,欢迎大家投递简历~

第四步

不满意的地方,点击元素可以继续编辑,

同时也支持自然语言!

你还可以随时调整细节,比如直接使用对话修改:”导航栏使用浅紫到白色渐变色”——AI瞬间就能完成修改。

生成一个网站只需5分钟 阿里开源最强AI编程模型Qwen3-Coder

来源:IT时报

IT时报记者 郝俊慧

“王炸”一个接着一个。

7月23日清晨,阿里开源全新的通义千问AI编程大模型Qwen3-Coder,编程能力登顶全球开源模型阵营,并超越GPT4.1等闭源模型,比肩全球最强的编程模型Claude 4。截至7月23日19点,全球程序员云集的Github上已为Qwen3-Coder打出6400颗星。

Qwen3-Coder在代码能力及Agent调用能力方面取得重大突破。它在代码占比70%的7.5T数据上预训练,在后训练阶段进行了编程任务及智能体任务的强化学习,最终实现了通用能力、代码能力及Agent能力的飞升。

其中,能力最强的Qwen3-Coder-480B-A35B-Instruct在Agentic Coding(自主编程)、Agentic Browser-Use(自主网页浏览)和Agentic Tool-Use(自主调用工具)上取得了开源模型的SOTA(最佳效果),媲美Claude Sonnet 4。

借助Qwen3-Coder,刚入行的程序员一天就能完成资深程序员一周的工作,生成一个品牌官网最快只需5分钟。

支持智能体自主编程

Qwen3-Coder是千问系列模型中首个采用混合专家MoE架构的代码模型,总参数达480B,激活35B参数。也就是说,推理时仅需激活35B参数,因此可以在较低的计算成本下实现高性能,大大节省了算力消耗,上下文长度也有了很大提升,原生支持256Ktoken的上下文并可通过YaRN扩展到1Mtoken,

Qwen3-Coder具备出色的Agent能力,尤为擅长解决多步骤的长任务,它能通观全局自主安排工作内容,支持Agent调用各种工具深入钻研,最终解决复杂编程任务。

基于Qwen3-Coder,网页开发、AI搜索、深度研究等智能体应用将变得更智能、更高效。实测数据显示,在执行任务时,Qwen3-Coder能够调用的工具数量比Claude多几倍,效果非常出色。

Qwen3-Coder能帮助程序员完美完成基础编程任务,比如写代码、补全代码、修Bug等,编程工作效率大幅提升,代码测试、查询生成等工作从人工编写的数小时骤降至数分钟。同时,Qwen3-Coder也极大降低了普通人入门编程的门槛,让AI氛围编程(Vibe Coding)真正成为现实,一句话就能生成精妙复杂的3D物理模拟过程。

压力给到Claude  4

编码能力是许多智能体实现复杂任务的关键。此前最受开发者欢迎的编码大模型是Claude 4,但价格不菲。记者从Anthropic公司官网上看到,Claude Sonnet 4的输入费用是3美元/百万token,输出费用是15美元/百万token。

由于Qwen3-Coder 在智能体编码、浏览器使用和工具使用等基准测试中已经与Claude Sonnet 4相媲美,开源之后,可以为开发者提供一个强大的、可免费使用的工具,大大降低了开发编码辅助、自动化开发、甚至能够自主完成软件工程任务智能体的门槛。

同时,Qwen3-Coder 会对闭源模型形成压力,尤其是在纯粹的编码任务上,迫使 Anthropic重新评估其针对编码相关用例的定价策略。

业内人士指出,开源的Qwen3-Coder有望取代昂贵的Claude,成为Agent领域最受欢迎的编程模型。

据了解,Qwen3-Coder已在魔搭社区、HuggingFace等平台开源,全球开发者都可以免费下载使用。Qwen3-Coder很快将接入阿里的AI编程产品通义灵码,API也已上线阿里云百炼。

为方便开发者更好地使用Qwen3-Coder,通义团队还开源了一款命令行工具QwenCode,可充分发挥Qwen3-Coder在代理式编程上的潜力。此外,Qwen3-Coder的API可以和ClaudeCode、Cline等工具协同使用。

截至目前,千问系列编程模型全球下载量已突破2000万次,是全球最受欢迎的开源编程模型。据悉,阿里巴巴内部已开始大量使用AI编程。一汽集团、中国石油、建设银行、平安集团、南方航空、小鹏汽车等各行业头部企业也已接入千问AI编程模型。

阿里本周将发布首款自研AI眼镜,加入“百镜大战”丨智能涌现独家

《智能涌现》独家获悉,阿里巴巴将于本周发布首款自研AI眼镜。加入“百镜大战”。

一位知情人士向《智能涌现》透露,阿里即将发布的这款AI眼镜,会拥有市面上多数产品拥有的的基础功能,如语音助手、音乐播放、电话通话、实时翻译、会议纪要等功能。

这款产品还会实现对阿里巴巴生态内的整合,包括地图、支付、购物类的功能。“高德、支付宝、淘宝等技术团队等都参与了进来。”上述人士称。

而在产品的AI能力上,基础模型将调用通义千问,夸克则会训练学习、健康等方向的垂类模型。

据我们了解,这款AI眼镜在硬件规格上将超越Ray-Ban Meta智能眼镜,将分为两个版本——不带显示的AI智能眼镜,以及带显示的AI+AR智能眼镜,后者优先级更高。产品硬件层面,这款眼镜将采用双芯片架构,为高通骁龙AR1+恒玄BES2800。

这也是阿里自去年底整合AI To C业务之后,推出的首款AI产品,“是阿里AI to C战略的延展。”内部人士告诉我们。

我们曾系统报道过这一战略的演变。从2024年年底开始,阿里开始了一系列业务整合——先是通义应用团队调整至阿里智能信息事业群;而后,拥有To C硬件品牌“天猫精灵”的智能互联事业群,与夸克团队相融合,上述团队均由阿里巴巴集团副总裁吴嘉统管。

而在团队完成融合后,阿里首款自研AI眼镜也正由天猫精灵硬件团队和夸克AI研发团队协同完成,主要负责人为阿里巴巴智能信息事业群智能终端业务负责人宋刚,他曾担任多款华为旗舰手机主架构师,主导研发了智能手机、游戏设备、机器人、XR设备及家庭移动终端等全系列智能硬件产品。

此前,市面上的多数AI眼镜在应用场景上非常有限。这一方面是因为技术发展仍在早期,续航时间短、佩戴不适、配镜等问题,诸多AI眼镜产品仍停留在爱好者群体中,部分厂商的AI眼镜也遭遇了难产问题。

另一方面,在软件层,市面上普遍的AI眼镜,会具备拍照识别、翻译、导游、会议记录等功能,但功能都还处于比较粗糙的阶段,比如拍照、录像的分辨率也还并不如人意。

销量也印证了这点。目前,全球AI眼镜市场上,除了Meta的Ray-ban三个季度破百万台销量之外,其他品牌都还在发展早期。洛图科技(RUNTO)线上监测数据显示,一季度国内智能眼镜(含AR眼镜)销量大约11.6万台,其中AI拍摄眼镜仅1.6万台。

业务场景更为多元化的互联网巨头入场,将有助于改变这一局面。

上述消息人士对《智能涌现》表示,如果阿里能在满足美观的前提下,再结合夸克在AI、学习、存储等方面的优势,以及通过业务生态中的地图导航、扫码支付、淘宝比价、飞猪商旅提醒等更多生活高频场景的触达,则有可能打破当前AI眼镜生态碎片化、应用场景单一的发展瓶颈,让AI眼镜进入更多大众消费视野。

在软件层面,这款眼镜也会加入夸克AI助手的不少能力——这半年里,阿里在大模型应用侧有多项进展,包括夸克从一款浏览器、搜索工具升级为“超级框”,如今已经是带有Agent(智能体)能力的智能助手。在更底层的模型上,推理速度加快、成本进一步降低,让端侧的发展迎来可能。

这些能力加载在眼镜上,才有可能让AI眼镜成为真正意义上的“随身助手”。
AI眼镜行业虽然未到爆发期,但涌入赛道的消费电子巨头、互联网大厂还是创业公司,都在尝试着杀入大众消费市场。

小米AI眼镜则是近期最受关注的行业节点。6月26日晚,小米发布首款AI眼镜,共有3个版本,价格1999元起,产品形态上基本对标Ray-Ban Meta,一定程度也是走向更多普通消费者的尝试。

纵观其他玩家,不论是Meta等巨头,还是Rokid等明星初创公司,近期都在争相推新品,覆盖日常支付、运动等更多生活场景。

除了阿里,包括百度、字节等其他大厂们也都在入局,他们也都拥有技术、资金以及生态优势。其中,百度的AI眼镜已经发布,但还未正式发售,字节的AI眼镜也已经规划已久。随着2025年下半年不少新AI眼镜的出货和正式发售,这将会成为AI眼镜行业的重要节点。

讯飞星火X1将于7月25日全新升级!

今天,分享一个好消息:

讯飞星火X1升级版将于7月25日正式上线!

基于全国产算力训练的深度推理大模型讯飞星火X1,这次升级会有哪些惊喜?

核心升级亮点抢先看图片!

图片
综合能力大幅提升

在数学、翻译、推理、文本生成等方面保持领先。

图片
幻觉治理显著进步

慢思考模式的幻觉治理准确率大幅领先,大模型回复更加可靠。
图片
多语言能力全面扩展

底座多语言能力扩展支持130+语种,处于业界一流水平。

👉🏻得益于底座能力的提升,讯飞星火X1在各个应用领域都将带来更好的表现:

1️⃣星火语音同传大模型的同传体验大幅提升,中英同传持续领先,专业领域覆盖度也取得了显著进步。作为2025世界人工智能大会“翻译合作伙伴”,科大讯飞将为全球用户带来更强大的AI能力体验。

2️⃣教育、医疗、企业级应用、科学智能等行业大模型取得新的进步,在关键产品的复杂任务上继续扩大领先优势。

届时,全新API将同步上线【讯飞开放平台】,大家也可以在【讯飞星火网页版】和【讯飞星火APP】第一时间体验升级版大模型带来的变化。