Accès ouvert déclaré
2025
preprint
Apple Intelligence Foundation Language Models: Tech Report 2025
Ethan Li, Anders Larsen, Chen Zhang, Xiyou Zhou, Jun Qin, Dian Ang Yap, N. R. Srinivasa Raghavan, Xuankai Chang, Margit Bowler, Eray Yildiz, John Peebles, Hannah Gillis Coleman, Matteo Ruggero Ronchi, Peter Gray, Anthony Spalvieri-Kruse, Ruoming Pang, Rong Li, Yuli Yang, Emad Soroush, Zhiyun Lu, Caiqin Xiao, Jordan Huffaker, David Griffiths, Zaid Ahmed, Peng Zhang, Daniel Parilla, Asaf Liberman, Jennifer Mallalieu, Parsa Mazaheri, Qibin Chen, Manjot Bilkhu, Aonan Zhang, Eric Wang, David Nelson, Thomas C. Voice, Jeremy Liu, John R. Shaffer, Shiwen Zhao, Prasanth Yadla, Farzin Rasteh, Pengsheng Guo, Arsalan Farooq, Stephen Murphy, Minsik Cho, George Horrell, Sam Dodge, Lindsay Hislop, Sumeet Singh, Alex Dombrowski, Aiswarya Raghavan, Sasha Sirovica, Mandana Saebi, Max W. Y. Lam, TJ Lu, Zhaoyang Xu, Karanjeet Singh, Marc Kirchner, David Mizrahi, Rajat Arora, Haotian Zhang, H. Benjamin Mason, Li Zhou, Yi Hua, Ankur Jain, Felix Bai, Joseph Astrauskas, Floris Weers, Josh Gardner, Yi Zhang, Pulkit Agrawal, Tony Sun, Quentin Keunebroek, Matthew Hopkins, Bugu Wu, Tao Jia, Chen Chen, Xingyu Zhou, N. Y. Wang, Peng Liu, Ruixuan Hou, Rene Rauch, Yuan Gao, Afshin Dehghan, Jonathan Janke, Z. Wang, Chen Cha, Xiaoyi Ren, Feng Nan, Dong Yin, Yusuf Gören, Jeff Lai, Yiran Fei, Syd Evans, M. C. Yu, Guoli Yin, Yi Qin, Erin Feldman, Isha Garg, A. Rajamani, Karla Vega, Walker Cheng, Trevor Collins, Hans Han, Raul Rea Menacho, Simon S. Yeung, S. H. Lee, Phani Mutyala, Ying-Chang Cheng, Zhe Gan, Justin Lazarow, Alessandro Pappalardo, Federico Scozzafava, Jing Lu, Erik Daxberger, Laurent Duchesne, David Güera, Stefano Ligas, Mary Beth Kery, Brent Ramerth, Ciro Sannino, Marcin Eichner, Haoshuo Huang, Moritz Schwarzer-Becker, David Riazati, Mingfei Gao, Bailin Wang, J. M. Cackler, Lu Yang, Ransen Niu, John Dennison, Guillaume Klein, Jeffrey P. Bigham, Deepak Gopinath, Navid Shiee, Darren Botten, Guillaume Tartavel, S. Y. Xu, Victoria MönchJuan Haladjian, Zi-Yi Dou, Matthias Paulik, Zongjin Li, Hong-You Chen, Chao Jia, Dhaval Doshi, Zhengdong Zhang, Raunak Manjani, Zhile Ren, David Chen, Artsiom Peshko, N. Raghuram, Hans Hao, Jiulong Shan, Kavya Nerella, Ramsey Tantawi, Vivek Kumar, Saiwen Wang, Brycen Wershing, Bhuwan Dhingra, Dhruti Shah, Ob Adaranijo, Xin Zheng, Hadas Kotek, Chang Liu, Xia Yin, Hanli Li, Suma Jayaram, Yanchao Sun, Ahmed Fakhry, Vasileios Saveris, Yanghao Li, Alp Aygar, Andres Romero Mier y Terán, Mark Lee, Xiujun Li, Yuhong Li, Tyler B. Johnson, Jay Tang, Joseph Y. Cheng, Futang Peng, Andrew Walkingshaw, Abhishek Sharma, Cheng Shen, P. Maj, You-Cyuan Jhang, Valerie Ma, Tommi Vehviläinen, Kelvin Zou, Jeffrey A. Nichols, David Qiu, Yihao Qian, G. Santhanam, Wentao Wu, Yena Han, Dominik Moritz, Haijing Fu, Mingze Xu, Vivek Rathod, Jian Liu, Louis D'hauwe, Qin Ba, Haitian Sun, Haoran Yan, Philipp Dufter, Anh D. Nguyen, Y. L. Feng, Emma Wang, Ke-yu He, Rahul Anil Nair, Sanskruti Shah, Jiarui Lu, Patrick Sonnenberg, Jeremy L. Warner, Yuanzhi Li, Bo‐Wen Pan, Ziyi Zhong, Joe Zhou, Sam Davarnia, Olli Saarikivi, I. I. Belousova, Shang-Chen Wu, Di Feng, Bas Straathof, Yuanyang Zhang, M. Zuliani, Eduardo Jiménez-Morales, Xianzhi Du, Chang Lan, Nilesh Shahdadpuri, Peter Grasch, Sergiu Sima, Josh Newnham, Varsha Paidi, Jianyu Wang, Kaelen Haag, Daniele Molinari, Richard Wei, Brenda Yang, Nicholas Lusskin, Joanna Arreaza-Taylor, Meng Cao, Nicholas Seidl, Simon Wang, Jiaming Hu, Yiping Ma, Mengyu Li, Hang Su, Sachin Ravi, Chong Wang, Xin Wang, Kevin Smith, Haoxuan You, Binazir Karimzadeh, Rui Li, Jinhao Lei, Wei Fang, Alec Doane, Sam M. Wiseman, Ismael Almazán Fernández, Jane Li, Andrew J. Hansen, Javier R. Movellan, Hanzhi Zhou, Chris Chaney, Nazir Kamaldin, Valentin Wolf, Fernando Bermúdez-Medina, Joris Pelemans, Peter P. Fu, Xiang Kong, Gabriel Jacoby-Cooper, Dongcai Shen, Tom Gunter, Guillaume Seguin, Fangping Shi, Shiyu Li, Yang Xu, A. T. Kamal, Saptarshi Guha, Qi Zhu, Changyuan Zhang, Rebecca M. Callahan, Charles Maalouf, Wilson Tsao, Boyue Li, Qingqing Cao, N Sabo, Yi Wang, Anupama Mann Anupama, Colorado Reed, Kenneth Jung, Zhifeng Chen, Mohana Prasad Sathya Moorthy, Yifei He, Erik Hornberger, Devi Krishna, Michael, Lee, David Haldimann, Yang Zhao, Bowen Zhang, Chang Gao, Chris Bartels, Sushma R. Rao, Nathalie Tran, Simon Lehnerer, Chau Minh Giang, Patrick Dong, Junting Pan, Bi-Yao Wang, Dongxu Li, Mehrdad Farajtabar, Dongseong Hwang, Grace Duanmu, Eshan Verma, Sujeeth Reddy, Qi Shan, Hongbin Gao, Nan Du, Pragnya Sridhar, Yingbo Wang, Nikhil Bhendawade, Sai Aitharaju, Fred Hohman, Lauren Gardiner, Chung‐Cheng Chiu, Yinfei Yang, Alper Kokmen, Frank Chu, Ke Ye, K. S. Elgin, Oron Levy, Ji Soo Park, Donald Zhang, Eldon Schoop, Nina Wenzel, Hyunjik Kim, Chinguun Erdenebileg, Nan Dun, Eric Liang Yang, Priyal Chhatrapati, Vishaal Mahtani, Gang Hu, Kohen Chia, D V R Seshadri, Donghan Yu, Yan Meng, Kelsey Peterson, Zhen Yang, Yongqiang Wang, Doug Kang, Anuva Agarwal, Albert Antony, Juan Lao Tebar, Albin Madappally Jose, Regan Poston, Gerard Casamayor, Elmira Amirloo, Violet Yao, Wojciech Kryściński, Kun Duan, L Lezhi
0Citations signalées, ce qui n’est pas une note de qualité
1Institutions déclarées
1Pays d’affiliation déclarés
Rattachement africain : tw.
Niveau de preuve : code pays fourni par la source.
Le résumé fourni par la source
We introduce two multilingual, multimodal foundation language models that power Apple Intelligence features across Apple devices and services: i a 3B-parameter on-device model optimized for Apple silicon through architectural innovations such as KV-cache sharing and 2-bit quantization-aware training; and ii a scalable server model built on a novel Parallel-Track Mixture-of-Experts PT-MoE transformer that combines track parallelism, mixture-of-experts sparse computation, and interleaved global-local attention to deliver high quality with competitive cost on Apple's Private Cloud Compute platform. Both models are trained on large-scale multilingual and multimodal datasets sourced via responsible web crawling, licensed corpora, and high-quality synthetic data, then further refined with supervised fine-tuning and reinforcement learning on a new asynchronous platform. The resulting models support several additional languages while understanding images and executing tool calls. In public benchmarks and human evaluations, both the server model and the on-device model match or surpass comparably sized open baselines. A new Swift-centric Foundation Models framework exposes guided generation, constrained tool calling, and LoRA adapter fine-tuning, allowing developers to integrate these capabilities with a few lines of code. The latest advancements in Apple Intelligence models are grounded in our Responsible AI approach with safeguards like content filtering and locale-specific evaluation, as well as our commitment to protecting our users' privacy with innovations like Private Cloud Compute.
Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.
Le contrôle bibliographique ouvert
La source scientifique ouverte est momentanément indisponible.
Les institutions déclarées
Une affiliation ne permet pas de déduire la nationalité d’un auteur.
Les sujets associés
Big Data and Digital EconomyAdvanced Malware Detection TechniquesAdvanced Neural Network Applications