微软团队,包括 TypeScript 创始人 Anders Heljsberg 在内,推出 TypeChat,旨在解决自然语言界面开发过程中面临的复杂问题。
发布新库的文章中表示,目前的 LLM(大语言模型的英文缩写)默认使用会话式自然语言,即诸如英语一类的人类交流时使用的语言。而解析自然语言是一项极其困难的任务。
TypeChat 基于 TypeScript 类型。TypeChat 库可以为 LLM(大语言模型)人工智能(如 OpenAI 的 ChatGPT)构建提示,要求LLM以符合类型的方式返回数据。如果回复未能通过验证,TypeChat会尝试通过进一步的交互进行修复。最终TypeChat 会对交互进行总结,以便在采取任何行动前进行确认。数据将以 JSON 格式传输,文档指出,由于“许多语言模型都擅长生成 JSON”。
微软团队提供的示例包括用户输入的情感分析、咖啡馆或餐厅的订餐、日历安排、数学计算以及在 Spotify 上播放音乐。
据称好处是准确性更高、编程更容易上手,另外,由于类型限制了人工智能的响应,因此安全性也更高一些。
OpenAI 几周前曾推出“新的Chat Completions API 中函数调用功能”。函数调用功能使得开发人员能够“在调用模型时通过 JSON 模式描述函数”,还可以令 LLM 输出一些带参数的 JSON 去调用这些函数。TypeChat 的想法并无不同,因为这意味着 LLM 的输出可以与开发人员的代码进行整合。
这样一来 TypeChat会不会是多余的呢?这个问题有人已经在 TypeChat 的 GitHub 仓库上提出过。但毫无疑问一部分的答案是,TypeChat旨在与任何 LLM 配合使用,而不仅仅是配合 OpenAI使用。尽管目前团队提供的所有示例都是在 OpenAI 或 Azure OpenAI 端点上运行,但考虑到微软与 OpenAI 的密切关系,这也就不足为奇了。
开发者的反应各不相同,有的说“迫不及待想试试 ”,也有的说“LLM就是专门生成自然语言输出,为什么我们要从这样的输出获取结构化输出呢?”另外其实已经有很多其他项目也是在解决同样的问题,尤其是微软自己的 Guidance 项目。
不过,TypeChat 的吸引力在于,数百万的开发者已经颇为熟悉TypeScript,而且TypeChat背后的团队包括 Hejlsberg 以及 TypeScript 高级项目经理 Daniel Rosenwasser、技术研究员 Steve Lucco 等资深人士。
真正的问题或许在于,到目前为止该项目带着浓厚的微软和 OpenAI 色彩,这可能会有碍于TypeChat团队希望的被厂商中立采用。
好文章,需要你的鼓励
API管理工具厂商Kong宣布收购开源使用计量和计费平台开发商OpenMeter。此次收购将为Kong Konnect平台增加原生货币化功能,帮助企业大规模计量、定价和货币化API、AI令牌及数据流。随着API成为AI模型和服务的主要接口,传统计费系统面临挑战。整合预计2026年初完成,OpenMeter的7人团队全部加入Kong。
ROSE是一项突破性的视频编辑技术,能够彻底移除视频中的物体及其环境影响。由浙江大学等机构研发,该系统不仅删除目标物体,还智能处理阴影、反射、光照等五种副作用。通过3D渲染生成训练数据,采用引用式擦除和差异掩码预测等创新方法,ROSE在各项性能指标上全面超越现有技术,为视频编辑领域带来了新的可能。
芬兰量子计算初创公司IQM Quantum Computers完成3.2亿美元B轮融资,累计融资总额达6亿美元。本轮融资由美国投资方Ten Eleven Ventures领投。IQM专注于超导量子比特计算机开发,其旗舰产品IQM Radiance提供20至150量子比特选择。公司计划利用资金扩展美国业务,建设云数据中心基础设施和制造产线,目标在2032年前实现百万量子比特规模。
新加坡南洋理工大学研究团队提出TriMM系统,这是首个融合RGB图像、深度图和点云数据的3D生成模型。通过协同多模态编码技术,系统能够同时利用彩色图像的丰富纹理和几何数据的精确结构信息,仅用4秒即可从单张图片生成高质量3D模型。该技术在多个数据集上的表现超越现有方法,为3D内容创作提供了新的解决方案。